Mua
Thị trường
🔥
Thị trường dự đoán

Claude Sonnet 5.5 tiến gần đến hiệu suất của Opus, với hóa đơn token nặng hơn

Anthropic ra mắt Claude Sonnet 5.5 với mức giá của Sonnet 5, nhưng Artificial Analysis phát hiện mức sử dụng token cao ở nỗ lực tối đa.

29/09/2026 04:46Đọc khoảng 12 phút

Claude Sonnet 5.5 được Anthropic phát hành vào ngày 28 tháng 9 với cùng giá niêm yết như Sonnet 5. Công ty cho biết nó chạy nhanh hơn 30% và giảm chi phí mỗi tác vụ tới 30%.

Một tổ chức đánh giá chuẩn độc lập có quan điểm khác về chi phí khi nó đẩy mô hình đến giới hạn.

Giới thiệu Claude Sonnet 5.5, mô hình thứ hai trong dòng Claude 5.5.

Đây là bản nâng cấp rõ rệt so với Sonnet 5, chạy nhanh hơn 30% và giảm tới 30% chi phí cho hầu hết công việc.

— Claude (@claudeai) 28 tháng 9, 2026

Sonnet 5.5 Ra Mắt Vài Ngày Sau Opus 5.5 Trong Dòng Claude

Dòng Claude 5.5 hiện có thêm phiên bản thứ hai là Sonnet 5.5. Opus 5.5 ra mắt vào ngày 22 tháng 9, và cùng ngày đó OpenAI tung ra GPT-6 Sol và Luna.

Mức giá kế thừa từ Sonnet 5: $2 cho mỗi triệu token đầu vào và $10 cho mỗi triệu token đầu ra. Anthropic đạt kết quả 70.6% trên Terminal-Bench 4.0, một điểm chuẩn lập trình tác nhân. Sonnet 5 đạt 10.3%, trong khi Opus 5.5 đạt 66.4%.

“Trong khi Opus 5.5 được xây dựng cho các công việc phức tạp đòi hỏi sự phán đoán cẩn thận, Sonnet 5.5 mạnh nhất ở các tác vụ hàng ngày có phạm vi rõ ràng, sửa lỗi và tạo tài liệu, slide và bảng tính trau chuốt,” nhóm Anthropic viết.

Theo lời Anthropic, Sonnet 5.5 không đẩy ranh giới khả năng ra xa hơn. Do đó, đánh giá về sự phù hợp tập trung vào các mối nguy như lừa dối người dùng và hỗ trợ lạm dụng rủi ro cao.

Bản phát hành cũng bao gồm các biện pháp bảo vệ mạng và bộ phân loại chống chưng cất được thiết kế để ngăn chặn các nỗ lực trích xuất lý luận của mô hình nhằm đào tạo các hệ thống đối thủ. Claude Haiku 5.5 sẽ ra mắt trong vài tuần tới.

Trong khi đó, OpenAI tạm dừng GPT-6.1 Astra vì lý do an toàn. CNBC xác nhận vào thứ Hai rằng mô hình này không đáp ứng các tiêu chuẩn của công ty.

Artificial Analysis Phát Hiện Mức Tiêu Thụ Token Cao Hơn Ở Nỗ Lực Tối Đa

Tổ chức đánh giá chuẩn Artificial Analysis, vốn xếp Grok 4.7 ở vị trí thứ tư, đã trao cho Sonnet 5.5 số điểm 56 trên Intelligence Index. Điều này xếp thứ hai tổng thể, kém 2 điểm so với Opus 5.5 ở nỗ lực tối đa.

Artificial Analysis ghi nhận 64% cho Sonnet 5.5 trên Terminal-Bench 4.0, so với 60% của Opus 5.5 và GPT-6 Astra. Trên GDPval-AA và các tác vụ công việc tri thức tương tự, công ty thấy Sonnet 5.5 ngang bằng với Opus 5.5.

Theo Artificial Analysis, Sonnet 5.5 đã tiêu thụ nhiều token hơn đáng kể để đạt được điều đó.

“Ở mức nỗ lực tối đa, nơi nó đạt hiệu suất gần với Opus 5.5, Claude Sonnet 5.5 đã sử dụng ~193k Output Tokens per Intelligence Index Task,” công ty viết.

Mức tiêu thụ này cao hơn khoảng 60% so với Opus 5.5 và Sonnet 5 ở nỗ lực tối đa, và gấp khoảng 7 lần con số nỗ lực tối đa của GPT-6 Astra.

Ngược lại, các khách hàng truy cập sớm của Anthropic lại mô tả mô hình đảo ngược so với Sonnet 5, mặc dù các khối lượng công việc đó khác nhau. Balyasny Asset Management đo lường mức sử dụng token thấp hơn nhiều trên các khối lượng công việc tài chính của mình.

“Trong bộ 2,441 nhiệm vụ tài chính riêng của chúng tôi bao gồm Q&A, trích xuất, phân tích và dự báo, Claude Sonnet 5.5 đạt điểm cao hơn Sonnet 5 và sử dụng khoảng 121k token cho mỗi câu trả lời, trong khi Sonnet 5 sử dụng 497k,” theo Joe Poirier, Kỹ sư AI Cao cấp tại Balyasny Asset Management.

Artificial Analysis đã thử nghiệm một phiên bản tiền phát hành có lỗi đầu ra có cấu trúc mà Anthropic đã vá sau đó. Công ty dự định sẽ làm lại các đánh giá bị ảnh hưởng trong thời gian ngắn.

Chia sẻ tới

X (Twitter)Telegram

Tuyên bố miễn trừ trách nhiệm: Nội dung bài viết đến từ bên thứ ba, chỉ mang tính tham khảo và không phải lời khuyên đầu tư. Tiền mã hóa và các sản phẩm tài chính khác có rủi ro biến động giá lớn, vui lòng cân nhắc kỹ trước khi quyết định.

Bài viết liên quan