OpenAI và Anthropic Triển Khai Các Mô Hình AI Giá Rẻ Hơn Giữa Cuộc Tranh Luận Về Chậm Lại
Anthropic đã ra mắt Opus 5.5 và OpenAI giới thiệu GPT-6 Sol và Luna, cả hai đều có giá thấp hơn, sau lời kêu gọi của các CEO về việc làm chậm phát triển AI.
Grok 4.7 đạt 46 điểm trên chuẩn AA, xếp thứ tư, có cải thiện về lập trình nhưng chi phí token tăng.
SpaceXAI đã ra mắt Grok 4.7, và các đánh giá độc lập xếp nó ở vị trí thứ tư trong số các phòng thí nghiệm AI hàng đầu.
Công ty đánh giá chuẩn Artificial Analysis đã cho mô hình điểm số 46 trên Chỉ số Thông minh của họ, cao hơn 2 điểm so với Grok 4.6. Các thứ hạng cao hơn thuộc về Claude Fable 5.1, GPT-6 Astra và Claude Opus 5.
Trước khi ra mắt, Elon Musk đã tuyên bố rằng mô hình sẽ dựa trên hệ thống 2,1 nghìn tỷ tham số và vượt qua tất cả các mô hình hiện có. Ông cũng đề cập rằng quá trình đào tạo bao gồm dữ liệu từ SpaceX.
Grok 4.7 đã có mặt.
— SpaceXAI (@SpaceXAI) Ngày 21 tháng 9 năm 2026
Đây là một cải tiến đáng kể so với Grok 4.6 với cùng mức giá và tốc độ. pic.twitter.com/H3OTBbXyvO
Trên AA-Briefcase, một chuẩn đánh giá cho các tác vụ chuyên nghiệp thực tế, Grok 4.7 đạt 1657 Elo. Điều này thể hiện mức tăng 111 điểm so với Grok 4.6 và đưa mô hình gần với hiệu suất của Claude Opus 5.
Trong đánh giá GDPval-AA, mô hình đạt 1695 Elo, cao hơn 90 điểm so với phiên bản tiền nhiệm. Kết quả kiểm tra lập trình cũng theo cùng xu hướng tăng.
Khi được sử dụng với Grok Build, tác nhân lập trình của nó, Grok 4.7 đạt 56 điểm trên Chỉ số Tác nhân Lập trình, cao hơn 9 điểm so với Grok 4.6.
Mô hình đã vượt qua GPT-5.6 Sol và hiện chỉ xếp sau Claude Fable 5.1 của Anthropic, GPT-6 Astra và Opus 5.
"Grok 4.7 đạt 46 điểm trên Chỉ số Thông minh Artificial Analysis, đưa SpaceXAI vào top 4 phòng thí nghiệm AI. Hiệu suất Chỉ số Tác nhân Lập trình cũng được cải thiện, vượt qua GPT-5.6 Sol," bài viết cho biết.
Ở những nơi khác, tiến bộ của mô hình là rất nhỏ. Nó tăng 4,5 điểm phần trăm trên Terminal-Bench 4.0 và 3 điểm trên GDP.pdf. Tuy nhiên, điểm số giảm trên các bài kiểm tra AA-LCR và AutomationBench-AA. Grok 4.5 từng đứng đầu AutomationBench vào tháng 7, ủng hộ tuyên bố của Musk rằng nó ngang bằng với Claude Opus.
Bảng giá không thay đổi. Grok 4.7 vẫn được định giá ở mức 2 đô la cho mỗi triệu token đầu vào và 6 đô la cho mỗi triệu token đầu ra. Cache hits vẫn được giảm giá ở mức 0,50 đô la, và cửa sổ ngữ cảnh 500.000 token được kế thừa từ Grok 4.6.
Tuy nhiên, mô hình thực hiện nhiều công việc hơn đáng kể cho mỗi câu trả lời. Artificial Analysis đo được khoảng 81.000 token đầu ra cho mỗi tác vụ Index, so với 36.000 đối với Grok 4.6 và 27.000 đối với GPT-6 Astra. Do đó, mức giá ổn định trên mỗi token vẫn dẫn đến chi phí cao hơn cho mỗi tác vụ.
Khả năng tiêu thụ token đó thuộc về một bộ phận đã báo cáo khoản lỗ 1,26 tỷ đô la. Trong khi đó, Musk cho biết vào ngày 14 tháng 9 rằng Grok 4.8 sẽ hoàn thành quá trình đào tạo trong vòng một tuần.
Ông cũng kỳ vọng Grok 5 sẽ là mô hình đạt được trí tuệ nhân tạo tổng quát. Bản phát hành tiếp theo sẽ kiểm tra liệu SpaceXAI có thể leo lên bảng xếp hạng mà không cần thêm chi phí tính toán hay không.
Chia sẻ tới
Tuyên bố miễn trừ trách nhiệm: Nội dung bài viết đến từ bên thứ ba, chỉ mang tính tham khảo và không phải lời khuyên đầu tư. Tiền mã hóa và các sản phẩm tài chính khác có rủi ro biến động giá lớn, vui lòng cân nhắc kỹ trước khi quyết định.
Anthropic đã ra mắt Opus 5.5 và OpenAI giới thiệu GPT-6 Sol và Luna, cả hai đều có giá thấp hơn, sau lời kêu gọi của các CEO về việc làm chậm phát triển AI.
Nasdaq Composite và Nasdaq 100 đạt mức đóng cửa kỷ lục khi hy vọng ngoại giao về Iran gây áp lực lên dầu thô, trong khi Dow giảm và S&P 500 đi ngang.
Hầu hết các công ty áp dụng chiến lược kho bạc bitcoin đều thua lỗ trong 18 tháng, với một số cổ phiếu giảm hơn 90%.
Cổ phiếu châu Âu nhích nhẹ khi hy vọng giảm dần về hòa bình Iran nhanh chóng bù đắp tin tức xếp dỡ của Saudi, với Ý và Anh đóng cửa thấp hơn.