Điểm chuẩn của Grok 4.7: Liệu nó có vượt qua tất cả các mô hình không?

Grok 4.7 đạt 46 điểm trên chuẩn AA, xếp thứ tư, có cải thiện về lập trình nhưng chi phí token tăng.

22/09/2026 02:41Đọc khoảng 10 phút

SpaceXAI đã ra mắt Grok 4.7, và các đánh giá độc lập xếp nó ở vị trí thứ tư trong số các phòng thí nghiệm AI hàng đầu.

Công ty đánh giá chuẩn Artificial Analysis đã cho mô hình điểm số 46 trên Chỉ số Thông minh của họ, cao hơn 2 điểm so với Grok 4.6. Các thứ hạng cao hơn thuộc về Claude Fable 5.1, GPT-6 Astra và Claude Opus 5.

Grok 4.7 Đưa SpaceXAI Vào Nhóm Bốn Phòng Thí Nghiệm AI Hàng Đầu

Trước khi ra mắt, Elon Musk đã tuyên bố rằng mô hình sẽ dựa trên hệ thống 2,1 nghìn tỷ tham số và vượt qua tất cả các mô hình hiện có. Ông cũng đề cập rằng quá trình đào tạo bao gồm dữ liệu từ SpaceX.

Grok 4.7 đã có mặt.

Đây là một cải tiến đáng kể so với Grok 4.6 với cùng mức giá và tốc độ. pic.twitter.com/H3OTBbXyvO

— SpaceXAI (@SpaceXAI) Ngày 21 tháng 9 năm 2026

Trên AA-Briefcase, một chuẩn đánh giá cho các tác vụ chuyên nghiệp thực tế, Grok 4.7 đạt 1657 Elo. Điều này thể hiện mức tăng 111 điểm so với Grok 4.6 và đưa mô hình gần với hiệu suất của Claude Opus 5.

Trong đánh giá GDPval-AA, mô hình đạt 1695 Elo, cao hơn 90 điểm so với phiên bản tiền nhiệm. Kết quả kiểm tra lập trình cũng theo cùng xu hướng tăng.

Khi được sử dụng với Grok Build, tác nhân lập trình của nó, Grok 4.7 đạt 56 điểm trên Chỉ số Tác nhân Lập trình, cao hơn 9 điểm so với Grok 4.6.

Mô hình đã vượt qua GPT-5.6 Sol và hiện chỉ xếp sau Claude Fable 5.1 của Anthropic, GPT-6 Astra và Opus 5.

"Grok 4.7 đạt 46 điểm trên Chỉ số Thông minh Artificial Analysis, đưa SpaceXAI vào top 4 phòng thí nghiệm AI. Hiệu suất Chỉ số Tác nhân Lập trình cũng được cải thiện, vượt qua GPT-5.6 Sol," bài viết cho biết.

Ở những nơi khác, tiến bộ của mô hình là rất nhỏ. Nó tăng 4,5 điểm phần trăm trên Terminal-Bench 4.0 và 3 điểm trên GDP.pdf. Tuy nhiên, điểm số giảm trên các bài kiểm tra AA-LCR và AutomationBench-AA. Grok 4.5 từng đứng đầu AutomationBench vào tháng 7, ủng hộ tuyên bố của Musk rằng nó ngang bằng với Claude Opus.

Những Tiến Bộ Đi Kèm Với Hóa Đơn Token

Bảng giá không thay đổi. Grok 4.7 vẫn được định giá ở mức 2 đô la cho mỗi triệu token đầu vào và 6 đô la cho mỗi triệu token đầu ra. Cache hits vẫn được giảm giá ở mức 0,50 đô la, và cửa sổ ngữ cảnh 500.000 token được kế thừa từ Grok 4.6.

Tuy nhiên, mô hình thực hiện nhiều công việc hơn đáng kể cho mỗi câu trả lời. Artificial Analysis đo được khoảng 81.000 token đầu ra cho mỗi tác vụ Index, so với 36.000 đối với Grok 4.6 và 27.000 đối với GPT-6 Astra. Do đó, mức giá ổn định trên mỗi token vẫn dẫn đến chi phí cao hơn cho mỗi tác vụ.

Khả năng tiêu thụ token đó thuộc về một bộ phận đã báo cáo khoản lỗ 1,26 tỷ đô la. Trong khi đó, Musk cho biết vào ngày 14 tháng 9 rằng Grok 4.8 sẽ hoàn thành quá trình đào tạo trong vòng một tuần.

Ông cũng kỳ vọng Grok 5 sẽ là mô hình đạt được trí tuệ nhân tạo tổng quát. Bản phát hành tiếp theo sẽ kiểm tra liệu SpaceXAI có thể leo lên bảng xếp hạng mà không cần thêm chi phí tính toán hay không.

Chia sẻ tới

X (Twitter)Telegram

Tuyên bố miễn trừ trách nhiệm: Nội dung bài viết đến từ bên thứ ba, chỉ mang tính tham khảo và không phải lời khuyên đầu tư. Tiền mã hóa và các sản phẩm tài chính khác có rủi ro biến động giá lớn, vui lòng cân nhắc kỹ trước khi quyết định.

Bài viết liên quan