
Claude Sonnet 5.5 là mô hình Sonnet mới của Anthropic, có hiệu năng tiến gần Opus 5.5 nhưng giá niêm yết chỉ bằng một nửa. Theo số liệu Anthropic cung cấp và được The New Stack dẫn lại, mô hình tạo đầu ra nhanh hơn hơn 30% so với Sonnet 5. Chi phí cho mỗi tác vụ có thể giảm tới 30%.
Sonnet 5.5 hướng đến những công việc hằng ngày có phạm vi rõ ràng. Các tác vụ gồm sửa lỗi phần mềm, tạo tài liệu, bản trình chiếu và bảng tính hoàn chỉnh. Đây là thành viên thứ hai trong gia đình Claude 5.5, sau Opus 5.5. Một phiên bản Claude Haiku mới, nhỏ nhất và có chi phí thấp nhất trong gia đình Claude, cũng dự kiến xuất hiện trong vài tuần tới.
Nhanh hơn 30% và giảm tới 30% chi phí mỗi tác vụ
Sonnet 5.5 tạo đầu ra nhanh hơn hơn 30% so với Sonnet 5. Chi phí cho mỗi tác vụ có thể giảm tới 30%. Theo Anthropic, đây là mẫu Sonnet nhanh nhất của hãng tính đến thời điểm công bố.
Anthropic mô tả Sonnet 5.5 là lựa chọn nhanh hơn và ít tốn kém hơn để bổ trợ cho Claude Opus 5.5. Những người thử nghiệm sớm cho biết mô hình có thể hoàn thiện giao diện người dùng. Mô hình cũng bám theo mẫu trình chiếu để tạo các bộ trang chiếu chỉ cần chỉnh sửa rất ít.
Khả năng diễn đạt cũng được cải thiện. Anthropic từng nhấn mạnh giọng văn rõ ràng và tự nhiên hơn trên Opus 5.5, còn Sonnet 5.5 có cùng đặc điểm đó.
Hiệu năng lập trình tiến gần Opus 5.5
Sonnet 5.5 đạt 70,6% trên Terminal-Bench 4.0, cao hơn mức 66,4% của Opus 5.5 trong kết quả Anthropic công bố. Trên các bài đánh giá lập trình khác, khoảng cách giữa hai mô hình vẫn nhỏ nhưng Opus 5.5 giữ lợi thế.
Terminal-Bench 4.0 đánh giá khả năng tác tử thực hiện nhiệm vụ bằng dòng lệnh. Sonnet 5 chỉ đạt 10,3% trong bài kiểm tra này. Nhóm duy trì Terminal-Bench lưu ý Sonnet 5 đôi khi gặp giới hạn thời gian và giới hạn token, góp phần giải thích mức điểm thấp của phiên bản cũ.
Trên CursorBench, bộ nhiệm vụ lấy từ các phiên lập trình thực tế trong Cursor, Sonnet 5.5 chỉ kém Opus 5.5 khoảng hai điểm. Với FrontierCode của Cognition, bài đánh giá xem một thay đổi mã có thể được hợp nhất mà không cần con người chỉnh sửa hay không, Sonnet 5.5 đạt 52,1% ở mức nỗ lực cao thứ hai. Opus 5.5 đạt 54,4%, còn GPT-6 Sol của OpenAI đạt 49,3%.
Những kết quả này phản ánh vai trò ngày càng lớn của tác tử AI viết mã trong quy trình phát triển phần mềm. Tuy nhiên, điểm đánh giá không có nghĩa mô hình có thể thay thế hoàn toàn việc kiểm tra của kỹ sư, nhất là khi chất lượng và khả năng xác minh mã vẫn là vấn đề thực tế.
Nội dung công việc tri thức chỉ kém Opus hai điểm
Sonnet 5.5 đạt 1.844 điểm trên GDPval-AA, chỉ thấp hơn Opus 5.5 hai điểm và cao hơn Sonnet 5 khoảng 400 điểm. Kết quả do Anthropic dẫn từ Artificial Analysis cho thấy Sonnet 5.5 tiến gần mẫu Opus trong các nhiệm vụ tri thức thực tế.
GDPval-AA xếp hạng mô hình bằng điểm Elo dựa trên nhiệm vụ thuộc 44 nghề nghiệp. GPT-6 Sol đạt 1.487 điểm trong cùng bài đánh giá.
Sonnet 5.5 cũng tiến gần Opus 5.5 trong các bài kiểm tra sử dụng máy tính và Humanity’s Last Exam. Trong một thử nghiệm ít chính thức hơn về công việc kéo dài và khả năng hiểu hình ảnh, Anthropic cho biết đây là mẫu Sonnet đầu tiên hoàn thành Pokémon Red chỉ bằng cách quan sát ảnh chụp màn hình.
Ở một số bài đánh giá, Anthropic cho biết Sonnet 5.5 tại mức nỗ lực thấp hoặc trung bình vượt điểm tốt nhất của Sonnet 5 với chi phí mỗi tác vụ chỉ bằng khoảng một phần mười. Anthropic vẫn đánh giá Opus 5.5 mạnh hơn rõ rệt đối với công việc phức tạp, có phạm vi mở và cần duy trì khả năng phán đoán trong thời gian dài.
Giá bằng một nửa Opus 5.5
Sonnet 5.5 có giá 2 USD cho mỗi triệu token đầu vào và 10 USD cho mỗi triệu token đầu ra. Cả hai mức giá đều bằng một nửa Opus 5.5, theo bảng giá Anthropic được The New Stack dẫn lại.
| Mô hình | Đầu vào | Đầu ra |
|---|---|---|
| Claude Sonnet 5.5 | 2 USD/triệu token | 10 USD/triệu token |
| Claude Opus 5.5 | 4 USD/triệu token | 20 USD/triệu token |
Đọc dữ liệu từ bộ nhớ đệm trên Sonnet 5.5 có giá 0,20 USD cho mỗi triệu token. Mức giá niêm yết của mô hình cũng ngang với GPT-6 Sol, mẫu mạnh thứ hai của OpenAI sau Astra.
Anthropic cho biết Sonnet 5.5 sử dụng ít token hơn đáng kể so với Sonnet 5. Nếu kết quả đo của hãng phản ánh đúng khối lượng công việc thực tế, tổng chi phí vận hành phiên bản mới sẽ thấp hơn dù đơn giá token không thay đổi. Doanh nghiệp nên xem xét cả đơn giá và mức tiêu thụ token khi xây dựng hạ tầng AI cho sản phẩm và doanh nghiệp.
Đã có trên các nền tảng đám mây lớn
Sonnet 5.5 hiện có trên Claude Platform, Amazon Web Services, Google Cloud và Microsoft Azure. Nhà phát triển đang chạy Sonnet với chế độ suy luận bị tắt cần chuyển sang thiết lập between_tools trước khi nâng cấp.
Opus 5.5 đã từ chối những yêu cầu tắt hoàn toàn chế độ suy luận. Vì vậy, nhóm kỹ thuật nên kiểm tra cấu hình tác tử và chuỗi gọi công cụ trước khi đổi mô hình, thay vì chỉ thay tên phiên bản trong hệ thống đang vận hành.
Sonnet lần đầu áp dụng lớp bảo vệ an ninh mạng cấp cao
Anthropic đánh giá năng lực an ninh mạng của Sonnet 5.5 tương đương Opus 5.5. Đây là mẫu Sonnet đầu tiên được phát hành với cùng loại biện pháp bảo vệ mạng dành cho những mô hình mạnh nhất của hãng.
Việc sửa lỗi thông thường không bị ảnh hưởng. Với yêu cầu an ninh mạng có mức rủi ro cao hơn, hệ thống sẽ chuyển về Sonnet 5. Anthropic cũng trang bị cho Sonnet 5.5 các bộ phân loại nhằm ngăn kẻ tấn công trích xuất quá trình suy luận để huấn luyện mô hình riêng.
Đội ngũ cân nhắc Sonnet 5.5 nên thử mô hình trên khối lượng công việc hiện có, sau đó đo tốc độ, lượng token và chất lượng đầu ra trước khi triển khai rộng.


