
Claude Sonnet 5.5 ra mắt trên Claude và API — với năm thay đổi phá vỡ mã hiện có
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 348 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 107 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- xAISpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
Claude Sonnet 5.5 đã ra mắt. Thông báo của nhà cung cấp ghi ngày 28 tháng 9 năm 2026, trang mô hình của Claude Platform liệt kê nó là "Mới nhất", và mã định danh là claude-sonnet-5-5 trên Claude API, Amazon Bedrock, các bảng điều khiển đám mây, Microsoft Foundry và Claude Platform trên AWS. Việc triển khai tới chính Claude và tới API là phần đang diễn ra trong tuần này. Phần sẽ khiến bạn tốn cả một ngày lại nằm ở chỗ khác trong cùng tài liệu đó: năm thay đổi phá vỡ tương thích ảnh hưởng đến mã đang chạy trên Claude Sonnet 5, và thay đổi thứ sáu làm biến đổi cấu trúc phản hồi mà không khiến một yêu cầu nào thất bại.
Đó là hình dạng của bản phát hành này. Bảng giá không hề nhúc nhích: Claude Sonnet 5.5 có giá $2 cho mỗi triệu token đầu vào và $10 cho mỗi triệu token đầu ra, đúng bằng giá của Claude Sonnet 5, với $0.20 cho lượt đọc cache và $2.50 cho lượt ghi cache năm phút. Năng lực thì đã tiến rất xa. Ở bản sửa đổi hiện tại của Artificial Analysis, mô hình mới cao hơn mô hình mà nó thay thế 18 điểm, mức chênh lệch rộng nhất giữa hai mô hình Sonnet liên tiếp trên bảng xếp hạng đó. Chi phí chuyển đổi tương ứng cũng lớn nhất. Không điều nào trong số đó là lời phàn nàn — một mô hình trở nên tốt hơn mà không đắt hơn là trường hợp đáng mừng — nhưng hai sự thật ấy đến cùng nhau, và ghi chú phát hành là nửa quyết định liệu tuần của bạn có ổn không.
Điều gì thực sự đã được phát hành vào ngày 28 tháng 9?

Đặc tả là sự tiếp nối trực tiếp của tầng chứ không phải một hình dạng mới:
• ID mô hình — claude-sonnet-5-5 trên Claude API, Claude Platform on AWS và Microsoft Foundry; anthropic.claude-sonnet-5-5 trên Amazon Bedrock
• Giá — 2 USD / MTok đầu vào, 10 USD / MTok đầu ra, 2,50 USD cho ghi cache năm phút, 4 USD cho ghi cache một giờ, 0,20 USD cho đọc cache
• Batch — giảm 50% cả hai chiều, vậy $1 / $5 mỗi MTok
• Ngữ cảnh và đầu ra — 1M token đầu vào, 128K token đầu ra đồng bộ, 300K đầu ra trên Message Batches API nằm sau output-300k-2026-03-24 tiêu đề beta
• Suy nghĩ — thích ứng, với mức nỗ lực mặc định là cao; mốc kiến thức và huấn luyện đều là tháng 6 năm 2026
• Vòng đời — không lưu trữ dữ liệu kể từ khi ra mắt, và mốc ngừng hoạt động tối thiểu được công bố là không sớm hơn ngày 28 tháng 9 năm 2027
Hai chi tiết dễ bị bỏ sót và đều quan trọng. Thứ nhất, không có phụ phí cho ngữ cảnh dài: Anthropic tính toàn bộ cửa sổ 1M token theo mức giá tiêu chuẩn, nên một yêu cầu 900.000 token có cùng chi phí trên mỗi token như một yêu cầu 9.000 token. Thứ hai, mức giá $2 / $10 trên mô hình trước đó ban đầu là giá giới thiệu, với kế hoạch tăng lên $3 / $15 vào ngày 1 tháng 9 năm 2026; trang định giá của Anthropic hiện nêu rằng mức tăng đó sẽ không diễn ra, khiến giá hiện tại của hạng Sonnet trở thành một cam kết thường trực thay vì một chương trình khuyến mãi. Cả hai điều đó đều là tuyên bố của nhà cung cấp, không phải các phát hiện độc lập.
Danh sách migration, theo thứ tự chúng sẽ gây rắc rối
Tổng quan về Sonnet 5.5 của Anthropic thẳng thắn một cách bất thường về điều này: năm thay đổi không tương thích ngược ảnh hưởng đến mã đang chạy trên Claude Sonnet 5. Chúng không mang tính phong cách. Mỗi thay đổi đều trả về lỗi hoặc âm thầm thay đổi hành vi.
• Việc buộc sử dụng công cụ bị từ chối. Việc đặt tool_choice thành "any", hoặc thành một công cụ được đặt tên, giờ trả về lỗi thay vì ràng buộc mô hình. Nếu vòng lặp agent của bạn ghim một công cụ để đảm bảo một lệnh gọi có cấu trúc, vòng lặp đó sẽ ngừng hoạt động ngay ở yêu cầu đầu tiên. Giải pháp thay thế là để mô hình tự chọn và xác thực kết quả, hoặc chuyển đảm bảo đó vào structured outputs.
• thinking: {"type": "disabled"} bị từ chối. Tắt hoàn toàn thinking không còn là một tùy chọn được hỗ trợ nữa. Giải pháp thay thế là between_tools, thứ tắt thinking từ đầu và hoạt động ở high effort hoặc thấp hơn. Đây là thiết lập thinking thấp nhất trên mô hình, không phải công tắc tắt.
• Các khối suy nghĩ gắn với mô hình và cuộc hội thoại.Phần suy luận mà một lượt trước đó tạo ra được chuyển tiếp từ Claude Sonnet 5 sang Claude Sonnet 5.5, nhưng không chuyển sang một họ mô hình khác và không xuyên tài khoản. Các ứng dụng phát lại bản ghi hội thoại trên các phiên bản mô hình sẽ thấy các khối suy nghĩ bị từ chối ở nơi trước đây chúng từng được chấp nhận.
• computer_20251124 không được chấp nhận trên Claude API hoặc Google Cloud. Mã đã khai báo phiên bản công cụ sử dụng máy tính trước đó phải chuyển sang bộ công cụ hiện tại.
• Công cụ cố vấn từ chối chính những thành viên trong cùng dòng sản phẩm của nó.Claude Opus 4.8, Claude Opus 4.7 và Claude Sonnet 5 đều bị từ chối làm cố vấn, vì vậy bất kỳ quy trình nào dùng một mô hình Claude nhỏ hơn để kiểm tra đối chiếu với một mô hình lớn hơn đều cần được ghép cặp lại.
Rồi còn có thay đổi không khiến bất cứ thứ gì thất bại. Văn bản mà mô hình phát ra giữa các lần gọi công cụ giờ đây nằm trong thinking — tức các khối — thay vì là đầu ra thông thường. Một ứng dụng truyền phát văn bản cho người dùng sẽ im lặng giữa các lần gọi công cụ — không lỗi, không ngoại lệ, chỉ là giao diện có vẻ như bị treo cho đến khi bạn đặt một giá trị display để trả lại văn bản, hoặc chuyển sang between_tools. Đây là kiểu lỗi dễ lọt vào production nhất, vì không có gì trong bộ kiểm thử ném lỗi cả.
Thêm một điều nữa, để cho đầy đủ: việc đặt temperature, top_p hoặc top_k thành bất kỳ giá trị không mặc định nào đều trả về mã 400. Nếu gateway hoặc thư viện máy khách của bạn đặt temperature theo thói quen thay vì có chủ đích, thì thói quen đó giờ đây là một sự cố ngừng dịch vụ.
Tuyên bố 30%, đối chiếu với con số độc lập

Thông điệp tiếp thị của Anthropic dành cho Claude Sonnet 5.5 là nó "tốn ít hơn tới 30% chi phí cho mỗi tác vụ so với phiên bản tiền nhiệm" ở cùng mức giá trên mỗi token, và rằng nó "tạo ra kết quả nhanh hơn 30%+" so với Claude Sonnet 5. Cả hai đều là những tuyên bố về token chứ không phải về giá, và cả hai đều do nhà cung cấp tự báo cáo. Cơ chế đằng sau điều đầu tiên có thể thấy trong bảng đánh giá của chính nhà cung cấp: ở mức Medium effort trên Terminal-Bench, Anthropic nói Claude Sonnet 5.5 đánh bại điểm số tốt nhất của Claude Sonnet 5 với "chi phí mỗi tác vụ chưa bằng một phần mười", và đưa ra những tuyên bố tương tự cho CursorBench ở mức Low effort và AA-Briefcase ở mức Medium.
Bức tranh độc lập đồng thuận về hướng đi và bất đồng về quy mô. Trên Chỉ số Trí tuệ v4.3.2 của Artificial Analysis — mười đánh giá, được chạy trong cùng một cấu hình trên mọi mô hình — Claude Sonnet 5.5 đạt 56 điểm, và trang này xếp nó ở vị trí thứ 3 trong số 216. Claude Sonnet 5 đạt 38 điểm trên cùng bảng xếp hạng. Đó là mức chênh 18 điểm giữa hai mô hình liên tiếp trong cùng hạng ở cùng mức giá, và là khoảng cách lớn nhất mà Anthropic đã tạo ra trong dòng Sonnet năm nay.
Con số chi phí là chỗ mà tuyên bố của nhà cung cấp trở nên khó đứng vững hơn. Artificial Analysis đo Claude Sonnet 5.5 ở mức 7,60 đô la cho mỗi tác vụ Intelligence Index đã hoàn thành. Con số đó không thấp hơn 30% so với bất kỳ thứ gì trong cùng phân khúc, bởi vì mô hình cực kỳ dài dòng: nó đã phát ra 410 triệu token đầu ra để hoàn thành các đánh giá Index, so với mức trung vị 88 triệu trên các mô hình tương đương. Hiệu quả trên mỗi token và hiệu quả trên mỗi tác vụ là những đại lượng khác nhau, và Claude Sonnet 5.5 đặc biệt giỏi ở cái đầu tiên nhưng chỉ ở mức trung bình ở cái thứ hai.
Toàn bộ các số liệu đánh giá của chính Anthropic cho bản phát hành này đều do nhà cung cấp tự báo cáo và chưa được bên thứ ba tái lập, và hai trong số đó có những chú thích đáng để nhắc lại: các con số GDPval-AA v2.1 và AA-Briefcase v1.1 được Artificial Analysis chạy trên một bản triển khai tiền phát hành mắc lỗi có thể khiến điểm số bị đánh giá thấp, còn ghi chú của Anthropic về con số FrontierCode 1.1 giải thích vì sao Claude Sonnet 5.5 đạt điểm thấp hơn ở Max effort so với Xhigh trong đánh giá đó. Một bảng mà ở đó một mô hình tự đánh bại chính nó ở một thiết lập nỗ lực thấp hơn là một bảng cho bạn biết cấu hình đánh giá của nó chưa ổn định.
Làm cách nào để kiểm thử nó mà không đặt cược cả một luồng production vào nó?
Có một lý do cụ thể để chạy Claude Sonnet 5.5 qua router thay vì gọi trực tiếp endpoint của nhà cung cấp khi thực hiện migration: bạn không phải chọn giữa model cũ và model mới trong lúc tìm hiểu. Trên OrcaRouter, Claude Sonnet 5 đã có thể định tuyến kể từ ngày 30 tháng 6 với mức giá $2 / $10 của chính Anthropic, không cộng thêm markup, là một trong hơn 200 model đứng sau một endpoint tương thích OpenAI duy nhất, và đây vẫn là model mà phần lớn lưu lượng Claude API chạy trên đó. Claude Sonnet 5.5 vẫn chưa có trong danh mục của chúng tôi, nên cách để dùng nó hôm nay là API của chính Anthropic.
Cách làm hiệu quả trong lúc chờ đợi là gửi một phần lưu lượng đến mô hình mới và để cơ chế chuyển đổi dự phòng gánh phần còn lại — với Claude Sonnet 5 làm phương án dự phòng, nhờ đó lỗi 400 từ một trong năm thay đổi phá vỡ tương thích sẽ chuyển thành một câu trả lời chậm hơn thay vì một yêu cầu thất bại. Đó cũng là cách rẻ nhất để đo điều mà tuyên bố của nhà cung cấp không cho bạn biết: số token của chính bạn cho mỗi tác vụ trên cả hai mô hình ở cùng một thiết lập mức nỗ lực. Con số 30% là mức trung bình trên các đánh giá của chính Anthropic; lưu lượng của bạn không phải mức trung bình đó.
Điều gì sẽ đến tiếp theo
Thông báo của Anthropic cho biết Claude Haiku 5.5 sẽ gia nhập dòng sản phẩm “trong những tuần tới”, điều này sẽ hoàn thiện thế hệ 5.5 ở phân khúc nhỏ. Cho đến lúc đó, hai quyết định mà một nhóm đang vận hành Sonnet trong môi trường sản xuất phải đối mặt có thể tách rời: việc di chuyển là công việc một ngày mà bạn có thể lên lịch, còn việc hoán đổi mô hình là một phép đo mà bạn có thể trì hoãn. Làm chúng theo thứ tự ngược lại — hoán đổi trước rồi phát hiện lỗi forced-tool-use trong môi trường sản xuất — là phiên bản của đợt triển khai này khiến bạn tốn cả một cuối tuần.

