Thẻ hero được tạo có tiêu đề Claude Sonnet 5.5 ra mắt, phụ đề năm thay đổi phá vỡ tương thích đối với mã đã chạy trên Claude Sonnet 5, với các nhãn dạng pill ghi $2 / $10 mỗi triệu không đổi, Chỉ số Thông minh 56 so với 38, và Phát hành 2026-09-28, cùng chân trang trích dẫn Artificial Analysis v4.3.2 cho Chỉ số và Anthropic cho giá và vòng đời.
Guides & Insights

Claude Sonnet 5.5 ra mắt trên Claude và API — với năm thay đổi phá vỡ mã hiện có

Tác giả

Magnus Corvin

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Claude Sonnet 5.5 đã ra mắt. Thông báo của nhà cung cấp ghi ngày 28 tháng 9 năm 2026, trang mô hình của Claude Platform liệt kê nó là "Mới nhất", và mã định danh là claude-sonnet-5-5 trên Claude API, Amazon Bedrock, các bảng điều khiển đám mây, Microsoft Foundry và Claude Platform trên AWS. Việc triển khai tới chính Claude và tới API là phần đang diễn ra trong tuần này. Phần sẽ khiến bạn tốn cả một ngày lại nằm ở chỗ khác trong cùng tài liệu đó: năm thay đổi phá vỡ tương thích ảnh hưởng đến mã đang chạy trên Claude Sonnet 5, và thay đổi thứ sáu làm biến đổi cấu trúc phản hồi mà không khiến một yêu cầu nào thất bại.

Đó là hình dạng của bản phát hành này. Bảng giá không hề nhúc nhích: Claude Sonnet 5.5 có giá $2 cho mỗi triệu token đầu vào và $10 cho mỗi triệu token đầu ra, đúng bằng giá của Claude Sonnet 5, với $0.20 cho lượt đọc cache và $2.50 cho lượt ghi cache năm phút. Năng lực thì đã tiến rất xa. Ở bản sửa đổi hiện tại của Artificial Analysis, mô hình mới cao hơn mô hình mà nó thay thế 18 điểm, mức chênh lệch rộng nhất giữa hai mô hình Sonnet liên tiếp trên bảng xếp hạng đó. Chi phí chuyển đổi tương ứng cũng lớn nhất. Không điều nào trong số đó là lời phàn nàn — một mô hình trở nên tốt hơn mà không đắt hơn là trường hợp đáng mừng — nhưng hai sự thật ấy đến cùng nhau, và ghi chú phát hành là nửa quyết định liệu tuần của bạn có ổn không.

Điều gì thực sự đã được phát hành vào ngày 28 tháng 9?

Anthropic's Claude Platform documentation page for Claude Sonnet 5.5, headed 'The best combination of speed and intelligence', showing the model ID claude-sonnet-5-5, a 1M-token context window, 128K max output, input pricing of $2 per million tokens and output pricing of $10 per million tokens, and the five breaking changes listed in the overview.

Đặc tả là sự tiếp nối trực tiếp của tầng chứ không phải một hình dạng mới:

• ID mô hình — claude-sonnet-5-5 trên Claude API, Claude Platform on AWS và Microsoft Foundry; anthropic.claude-sonnet-5-5 trên Amazon Bedrock

• Giá — 2 USD / MTok đầu vào, 10 USD / MTok đầu ra, 2,50 USD cho ghi cache năm phút, 4 USD cho ghi cache một giờ, 0,20 USD cho đọc cache

• Batch — giảm 50% cả hai chiều, vậy $1 / $5 mỗi MTok

• Ngữ cảnh và đầu ra — 1M token đầu vào, 128K token đầu ra đồng bộ, 300K đầu ra trên Message Batches API nằm sau output-300k-2026-03-24 tiêu đề beta

• Suy nghĩ — thích ứng, với mức nỗ lực mặc định là cao; mốc kiến thức và huấn luyện đều là tháng 6 năm 2026

• Vòng đời — không lưu trữ dữ liệu kể từ khi ra mắt, và mốc ngừng hoạt động tối thiểu được công bố là không sớm hơn ngày 28 tháng 9 năm 2027

Hai chi tiết dễ bị bỏ sót và đều quan trọng. Thứ nhất, không có phụ phí cho ngữ cảnh dài: Anthropic tính toàn bộ cửa sổ 1M token theo mức giá tiêu chuẩn, nên một yêu cầu 900.000 token có cùng chi phí trên mỗi token như một yêu cầu 9.000 token. Thứ hai, mức giá $2 / $10 trên mô hình trước đó ban đầu là giá giới thiệu, với kế hoạch tăng lên $3 / $15 vào ngày 1 tháng 9 năm 2026; trang định giá của Anthropic hiện nêu rằng mức tăng đó sẽ không diễn ra, khiến giá hiện tại của hạng Sonnet trở thành một cam kết thường trực thay vì một chương trình khuyến mãi. Cả hai điều đó đều là tuyên bố của nhà cung cấp, không phải các phát hiện độc lập.

Danh sách migration, theo thứ tự chúng sẽ gây rắc rối

Tổng quan về Sonnet 5.5 của Anthropic thẳng thắn một cách bất thường về điều này: năm thay đổi không tương thích ngược ảnh hưởng đến mã đang chạy trên Claude Sonnet 5. Chúng không mang tính phong cách. Mỗi thay đổi đều trả về lỗi hoặc âm thầm thay đổi hành vi.

• Việc buộc sử dụng công cụ bị từ chối. Việc đặt tool_choice thành "any", hoặc thành một công cụ được đặt tên, giờ trả về lỗi thay vì ràng buộc mô hình. Nếu vòng lặp agent của bạn ghim một công cụ để đảm bảo một lệnh gọi có cấu trúc, vòng lặp đó sẽ ngừng hoạt động ngay ở yêu cầu đầu tiên. Giải pháp thay thế là để mô hình tự chọn và xác thực kết quả, hoặc chuyển đảm bảo đó vào structured outputs.

• thinking: {"type": "disabled"} bị từ chối. Tắt hoàn toàn thinking không còn là một tùy chọn được hỗ trợ nữa. Giải pháp thay thế là between_tools, thứ tắt thinking từ đầu và hoạt động ở high effort hoặc thấp hơn. Đây là thiết lập thinking thấp nhất trên mô hình, không phải công tắc tắt.

• Các khối suy nghĩ gắn với mô hình và cuộc hội thoại.Phần suy luận mà một lượt trước đó tạo ra được chuyển tiếp từ Claude Sonnet 5 sang Claude Sonnet 5.5, nhưng không chuyển sang một họ mô hình khác và không xuyên tài khoản. Các ứng dụng phát lại bản ghi hội thoại trên các phiên bản mô hình sẽ thấy các khối suy nghĩ bị từ chối ở nơi trước đây chúng từng được chấp nhận.

• computer_20251124 không được chấp nhận trên Claude API hoặc Google Cloud. Mã đã khai báo phiên bản công cụ sử dụng máy tính trước đó phải chuyển sang bộ công cụ hiện tại.

• Công cụ cố vấn từ chối chính những thành viên trong cùng dòng sản phẩm của nó.Claude Opus 4.8, Claude Opus 4.7 và Claude Sonnet 5 đều bị từ chối làm cố vấn, vì vậy bất kỳ quy trình nào dùng một mô hình Claude nhỏ hơn để kiểm tra đối chiếu với một mô hình lớn hơn đều cần được ghép cặp lại.

Rồi còn có thay đổi không khiến bất cứ thứ gì thất bại. Văn bản mà mô hình phát ra giữa các lần gọi công cụ giờ đây nằm trong thinking — tức các khối — thay vì là đầu ra thông thường. Một ứng dụng truyền phát văn bản cho người dùng sẽ im lặng giữa các lần gọi công cụ — không lỗi, không ngoại lệ, chỉ là giao diện có vẻ như bị treo cho đến khi bạn đặt một giá trị display để trả lại văn bản, hoặc chuyển sang between_tools. Đây là kiểu lỗi dễ lọt vào production nhất, vì không có gì trong bộ kiểm thử ném lỗi cả.

Thêm một điều nữa, để cho đầy đủ: việc đặt temperature, top_p hoặc top_k thành bất kỳ giá trị không mặc định nào đều trả về mã 400. Nếu gateway hoặc thư viện máy khách của bạn đặt temperature theo thói quen thay vì có chủ đích, thì thói quen đó giờ đây là một sự cố ngừng dịch vụ.

Tuyên bố 30%, đối chiếu với con số độc lập

Artificial Analysis model page for Claude Sonnet 5.5 (adaptive reasoning, max effort, default fallback), released September 2026, showing an Intelligence Index of 56 at rank 3 of 216 models, pricing of $2.00 per million input tokens and $10.00 per million output tokens, an average cost of $7.60 per Intelligence Index task, a measured output speed of 142 tokens per second, 410M output tokens generated during the Index evaluation against a median of 88M, and a 1M-token context window.

Thông điệp tiếp thị của Anthropic dành cho Claude Sonnet 5.5 là nó "tốn ít hơn tới 30% chi phí cho mỗi tác vụ so với phiên bản tiền nhiệm" ở cùng mức giá trên mỗi token, và rằng nó "tạo ra kết quả nhanh hơn 30%+" so với Claude Sonnet 5. Cả hai đều là những tuyên bố về token chứ không phải về giá, và cả hai đều do nhà cung cấp tự báo cáo. Cơ chế đằng sau điều đầu tiên có thể thấy trong bảng đánh giá của chính nhà cung cấp: ở mức Medium effort trên Terminal-Bench, Anthropic nói Claude Sonnet 5.5 đánh bại điểm số tốt nhất của Claude Sonnet 5 với "chi phí mỗi tác vụ chưa bằng một phần mười", và đưa ra những tuyên bố tương tự cho CursorBench ở mức Low effort và AA-Briefcase ở mức Medium.

Bức tranh độc lập đồng thuận về hướng đi và bất đồng về quy mô. Trên Chỉ số Trí tuệ v4.3.2 của Artificial Analysis — mười đánh giá, được chạy trong cùng một cấu hình trên mọi mô hình — Claude Sonnet 5.5 đạt 56 điểm, và trang này xếp nó ở vị trí thứ 3 trong số 216. Claude Sonnet 5 đạt 38 điểm trên cùng bảng xếp hạng. Đó là mức chênh 18 điểm giữa hai mô hình liên tiếp trong cùng hạng ở cùng mức giá, và là khoảng cách lớn nhất mà Anthropic đã tạo ra trong dòng Sonnet năm nay.

Con số chi phí là chỗ mà tuyên bố của nhà cung cấp trở nên khó đứng vững hơn. Artificial Analysis đo Claude Sonnet 5.5 ở mức 7,60 đô la cho mỗi tác vụ Intelligence Index đã hoàn thành. Con số đó không thấp hơn 30% so với bất kỳ thứ gì trong cùng phân khúc, bởi vì mô hình cực kỳ dài dòng: nó đã phát ra 410 triệu token đầu ra để hoàn thành các đánh giá Index, so với mức trung vị 88 triệu trên các mô hình tương đương. Hiệu quả trên mỗi token và hiệu quả trên mỗi tác vụ là những đại lượng khác nhau, và Claude Sonnet 5.5 đặc biệt giỏi ở cái đầu tiên nhưng chỉ ở mức trung bình ở cái thứ hai.

Toàn bộ các số liệu đánh giá của chính Anthropic cho bản phát hành này đều do nhà cung cấp tự báo cáo và chưa được bên thứ ba tái lập, và hai trong số đó có những chú thích đáng để nhắc lại: các con số GDPval-AA v2.1 và AA-Briefcase v1.1 được Artificial Analysis chạy trên một bản triển khai tiền phát hành mắc lỗi có thể khiến điểm số bị đánh giá thấp, còn ghi chú của Anthropic về con số FrontierCode 1.1 giải thích vì sao Claude Sonnet 5.5 đạt điểm thấp hơn ở Max effort so với Xhigh trong đánh giá đó. Một bảng mà ở đó một mô hình tự đánh bại chính nó ở một thiết lập nỗ lực thấp hơn là một bảng cho bạn biết cấu hình đánh giá của nó chưa ổn định.

Làm cách nào để kiểm thử nó mà không đặt cược cả một luồng production vào nó?

Có một lý do cụ thể để chạy Claude Sonnet 5.5 qua router thay vì gọi trực tiếp endpoint của nhà cung cấp khi thực hiện migration: bạn không phải chọn giữa model cũ và model mới trong lúc tìm hiểu. Trên OrcaRouter, Claude Sonnet 5 đã có thể định tuyến kể từ ngày 30 tháng 6 với mức giá $2 / $10 của chính Anthropic, không cộng thêm markup, là một trong hơn 200 model đứng sau một endpoint tương thích OpenAI duy nhất, và đây vẫn là model mà phần lớn lưu lượng Claude API chạy trên đó. Claude Sonnet 5.5 vẫn chưa có trong danh mục của chúng tôi, nên cách để dùng nó hôm nay là API của chính Anthropic.

Cách làm hiệu quả trong lúc chờ đợi là gửi một phần lưu lượng đến mô hình mới và để cơ chế chuyển đổi dự phòng gánh phần còn lại — với Claude Sonnet 5 làm phương án dự phòng, nhờ đó lỗi 400 từ một trong năm thay đổi phá vỡ tương thích sẽ chuyển thành một câu trả lời chậm hơn thay vì một yêu cầu thất bại. Đó cũng là cách rẻ nhất để đo điều mà tuyên bố của nhà cung cấp không cho bạn biết: số token của chính bạn cho mỗi tác vụ trên cả hai mô hình ở cùng một thiết lập mức nỗ lực. Con số 30% là mức trung bình trên các đánh giá của chính Anthropic; lưu lượng của bạn không phải mức trung bình đó.

Điều gì sẽ đến tiếp theo

Thông báo của Anthropic cho biết Claude Haiku 5.5 sẽ gia nhập dòng sản phẩm “trong những tuần tới”, điều này sẽ hoàn thiện thế hệ 5.5 ở phân khúc nhỏ. Cho đến lúc đó, hai quyết định mà một nhóm đang vận hành Sonnet trong môi trường sản xuất phải đối mặt có thể tách rời: việc di chuyển là công việc một ngày mà bạn có thể lên lịch, còn việc hoán đổi mô hình là một phép đo mà bạn có thể trì hoãn. Làm chúng theo thứ tự ngược lại — hoán đổi trước rồi phát hiện lỗi forced-tool-use trong môi trường sản xuất — là phiên bản của đợt triển khai này khiến bạn tốn cả một cuối tuần.

Single-column scoreboard for Claude Sonnet 5.5 with six rows: Released September 28 2026, Model ID claude-sonnet-5-5, Price $2.00 / $10.00 per 1M, Intelligence Index 56 at rank 3 of 216, Cost per Index task $7.60, and Output speed 142 tokens/sec, with a footer reading 'Index, cost per task and speed per Artificial Analysis v4.3.2; pricing and lifecycle per Anthropic.'