
Anthropic đã giảm giá Claude Opus 5.5, nhưng việc nâng cấp không chỉ là đổi tên mô hình. Bốn thay đổi có thể ảnh hưởng đến suy luận, gọi công cụ, chuyển mô hình và điều khiển máy tính. Yêu cầu đang chạy trên Opus 5 có thể trả về lỗi 400 hoặc khiến tác tử phản ứng khác mà không báo lỗi.
Theo bài phân tích gốc của The New Stack về quá trình chuyển sang Opus 5.5, giá đầu vào giảm từ 5 USD xuống 4 USD cho mỗi một triệu token. Giá đầu ra giảm từ 25 USD xuống 20 USD. Cửa sổ ngữ cảnh một triệu token và mức đầu ra tối đa 128.000 token không đổi.
Rủi ro này cần được kiểm tra trước khi các nhóm trong nước đưa Opus 5.5 vào tác tử AI viết mã và các quy trình tự động khác. Chi phí token thấp hơn chỉ có ý nghĩa khi vòng lặp công cụ, lịch sử hội thoại và giao diện theo dõi tiến độ vẫn hoạt động đúng.
Suy luận luôn được bật
Opus 5.5 luôn bật suy luận và dùng tham số effort để kiểm soát lượng suy luận. Yêu cầu tắt suy luận hoặc kết hợp trạng thái bật với budget_tokens có thể trả về lỗi 400. Mã giả định khối nội dung đầu tiên là văn bản cũng có thể đọc sai phản hồi.
Theo The New Stack, Opus 5.5 trả về lỗi 400 nếu yêu cầu đặt suy luận ở trạng thái tắt hoặc dùng trạng thái bật cùng tham số budget_tokens. Những tác tử từng tắt suy luận ở các bước đơn giản để giảm thời gian và số token phải chuyển sang mức effort thấp hơn.
Vì suy luận luôn bật, phản hồi bắt đầu bằng khối suy luận. Đoạn mã đang mặc định khối nội dung đầu tiên là văn bản vì thế cũng phải được sửa.
Mức effort mặc định giảm từ cao trên Opus 5 xuống trung bình trên Opus 5.5. Theo khuyến nghị của Anthropic được The New Stack dẫn lại, nhà phát triển nên đặt mức này rõ ràng và chạy lại các phép đánh giá. Nếu bỏ trống tham số, tác tử có thể âm thầm vận hành ở mức suy luận thấp hơn trước, trong khi chi phí và độ trễ của từng bước cũng thay đổi.
Không thể ép tác tử gọi công cụ như trước
Opus 5.5 không chấp nhận tool_choice ở chế độ any hoặc tool. Cấu hình từng buộc tác tử gọi công cụ có thể gây lỗi 400 cả khi thực thi lẫn khi đếm token, nên nhóm phát triển phải thay đổi cách điều phối và ước tính chi phí.
Theo The New Stack, lỗi xuất hiện kể cả trên điểm cuối dùng để đếm token. Phép ước tính chi phí dựa trên cùng cấu hình vì thế có thể hỏng trước khi tác tử bắt đầu công việc.
Nhiều vòng lặp tác tử buộc phải gọi công cụ khi cần truy vấn cơ sở dữ liệu, chạy mã hoặc kết nối dịch vụ khác. Cách thay thế do Anthropic đưa ra là dùng chế độ auto cùng cơ chế sử dụng công cụ nghiêm ngặt hoặc đầu ra có cấu trúc, đồng thời nêu rõ trong lời nhắc khi nào công cụ cần được dùng.
Thay đổi này cho thấy lỗi của tác tử có thể xuất hiện ở lớp điều phối thay vì riêng mô hình. Các nhóm xử lý khối lượng thay đổi lớn có thể tham khảo cách xác minh trong quy trình 2.000 yêu cầu hợp nhất mỗi tháng: thay đổi tự động vẫn cần một bước kiểm tra rõ ràng trước khi đi vào môi trường thật.
Chuyển mô hình có thể làm mất mạch suy luận

Khối suy luận của Opus 5.5 gắn với mô hình và cuộc hội thoại đã tạo ra nó. Nếu bộ định tuyến chuyển cuộc hội thoại sang một mô hình không tương thích, các lượt sau có thể chạy mà không có phần suy luận trước đó, dù hệ thống không nhất thiết báo lỗi.
Trên giao diện lập trình Claude, The New Stack cho biết Fable 5.1 và Mythos 5.1 là hai mô hình khác duy nhất có thể đọc khối suy luận của Opus 5.5. Một cơ chế dự phòng chuyển hội thoại sang mô hình khác có thể làm mất phần suy luận trước đó.
Khả năng đọc theo chiều ngược lại không đối xứng. Opus 5.5 có thể đọc khối suy luận từ Opus 5 và các mô hình Opus, Sonnet, Haiku cũ hơn, nhưng không đọc được khối từ Fable hoặc Mythos. Một bộ định tuyến chỉ kiểm tra khả năng nhận yêu cầu có thể bỏ qua khác biệt này và làm thay đổi kết quả giữa cuộc hội thoại.
Lịch sử hội thoại phải giữ nguyên thứ tự
Lịch sử hội thoại phải được giữ theo kiểu chỉ nối thêm. Việc cắt tin nhắn cũ hoặc thay đổi định nghĩa công cụ sẽ làm các khối suy luận hiện có mất hiệu lực. Tóm tắt ngữ cảnh ở phía máy khách hoặc viết lại lời nhắc hệ thống giữa cuộc hội thoại cũng gây ra vấn đề này.
Theo tài liệu của Anthropic về bảo toàn suy luận được nguồn gốc dẫn lại, quy tắc mới áp dụng với tài khoản tạo từ ngày 31 tháng 8 năm 2026. Sau những chỉnh sửa như vậy, việc phát lại một khối suy luận mặc định trả về lỗi 400 kể từ nửa đêm theo giờ phối hợp quốc tế. Tài khoản cũ không nhận lỗi, nhưng khối không hợp lệ vẫn được gửi tới mô hình. Anthropic cho biết các mô hình tương lai sẽ áp dụng phép kiểm tra này cho mọi tài khoản.
Những tích hợp không sửa các lượt trước không cần đổi mã. Claude Code, claude.ai, Claude Managed Agents và Claude Agent SDK đã vận hành theo cách đó. Các tác tử tự rút gọn ngữ cảnh cần tuân theo tài liệu bảo toàn suy luận của Anthropic.
Công cụ điều khiển máy tính đổi hình dạng phản hồi
Trên giao diện lập trình Claude và Google Cloud, Opus 5.5 thay công cụ computer_20251124 bằng computer_toolset_20260801. Việc chuyển đổi còn làm thay đổi cấu trúc phản hồi, cách nhận diện hành động và dữ liệu phải gửi lại trong vòng lặp tác tử.
Theo The New Stack, Opus 5.5 từ chối công cụ computer_20251124 và chỉ chấp nhận chức năng điều khiển máy tính qua bộ công cụ computer_toolset_20260801.
Yêu cầu gửi đi gọn hơn vì không còn tiêu đề thử nghiệm, còn mục bộ công cụ không cần tên hoặc kích thước màn hình. Phần vòng lặp tác tử cần nhiều sửa đổi hơn. Mỗi hành động được trả về trong một khối tool_use riêng, nhận diện bằng tên khối thay vì input.action. Một lượt có thể chứa nhiều khối và mọi kết quả phải gửi lại đúng toolset_name.
Công cụ cũ vẫn hoạt động trên Amazon Bedrock. Với nền tảng khác, Anthropic yêu cầu nhà phát triển đối chiếu tài liệu tương thích của công cụ điều khiển máy tính.
Hai thay đổi không báo lỗi có thể làm tác tử im lặng

Opus 5.5 chuyển phần diễn giải giữa các lần gọi công cụ từ khối văn bản sang khối suy luận cập nhật tiến độ. Nếu ứng dụng không bật chế độ hiển thị phù hợp hoặc không xử lý phản hồi từ chối, tác tử có thể im lặng hoặc dừng giữa nhiệm vụ mà giao diện không giải thích rõ nguyên nhân.
Trên Opus 5, phần diễn giải Claude tạo ra giữa các lần gọi công cụ được trả về dưới dạng khối văn bản. Trên Opus 5.5, nội dung này chuyển thành khối suy luận cập nhật tiến độ. Theo The New Stack, khi bỏ trống thiết lập mặc định thinking.display, các khối đó sẽ rỗng.
Giao diện phải xử lý khối cập nhật tiến độ
Giao diện từng truyền trực tiếp phần diễn giải cho người dùng có thể im lặng giữa các lần gọi công cụ. Để giữ cập nhật tiến độ, nhà phát triển phải đặt chế độ hiển thị thành updates hoặc summarized. updates trả về tiến độ nhưng vẫn ẩn suy luận, còn summarized trả về cập nhật tiến độ và bản tóm tắt suy luận, không phải suy luận ẩn nguyên bản. Giao diện sau đó cần hiển thị từng khối suy luận có nội dung trước lần gọi công cụ tương ứng.
Opus 5.5 cũng có bộ phân loại an toàn rộng hơn. Phản hồi có thể mang lý do dừng là từ chối. Chi tiết dừng bổ sung các nhóm sinh học và trích xuất suy luận bên cạnh an ninh mạng. Cơ chế dự phòng phía máy chủ của Anthropic không thử lại yêu cầu bị từ chối vì trích xuất suy luận. Hệ thống chuyển thẳng kết quả từ chối cho ứng dụng.
Nếu vòng lặp không xử lý trường hợp từ chối, tác tử có thể dừng giữa nhiệm vụ. Thiết kế vòng lặp vì thế phải xác định tác tử được phép làm gì khi phản hồi an toàn xuất hiện. Đây cũng là trọng tâm của cuộc thảo luận về mức quyền nên cấp cho AI trong hoạt động an ninh.
Nội dung nâng cấp từ các phiên bản cũ cần thêm bước
Nhóm dùng Opus 4.8 phải chuyển sang Opus 5 trước khi áp dụng các thay đổi của Opus 5.5. Các phiên bản cũ hơn còn có thêm khác biệt về tham số lấy mẫu, suy luận mở rộng thủ công, cơ chế điền trước và bộ tách token.
Theo The New Stack, quá trình chuyển từ Opus 4.8 sang Opus 5 gồm việc xử lý suy luận được bật mặc định. Nhóm phát triển cũng phải xử lý những thay đổi về hình dạng phản hồi. Nhóm dùng Opus 4.7 hoặc cũ hơn phải xử lý nhiều khác biệt hơn. Với mô hình cũ hơn Opus 4.7, các tham số lấy mẫu có thể bị từ chối và suy luận mở rộng thủ công không còn được chấp nhận. Cơ chế điền trước cũng bị loại bỏ, còn bộ tách token đã thay đổi.
Công cụ hỗ trợ không thay thế kiểm tra thủ công
Người dùng Claude Managed Agents chỉ cần đổi tên mô hình. Trong Claude Code, nhà phát triển có thể chạy lệnh /claude-api migrate để thay mã mô hình và điều chỉnh tham số. Lệnh này cũng thay cơ chế điền trước và hiệu chỉnh mức effort trên toàn bộ mã nguồn. Sau đó vẫn phải kiểm tra thủ công các mục mà công cụ liệt kê.
Anthropic khuyến nghị thử quá trình chuyển đổi trong môi trường phát triển trước khi đưa lưu lượng thật sang Opus 5.5. Phạm vi kiểm thử nên bao gồm lời gọi công cụ, chuyển giao giữa các mô hình, cách lưu lịch sử hội thoại, phản hồi từ chối và cập nhật tiến độ mà người dùng nhìn thấy.
Nếu hệ thống đang dùng Opus 5, hãy kiểm tra bốn điểm tích hợp trên một luồng thử nghiệm hoàn chỉnh trước khi chuyển lưu lượng thật sang Opus 5.5. Giá thấp hơn không bù được một tác tử mất mạch suy luận, gọi sai công cụ hoặc dừng giữa nhiệm vụ.


