Thẻ tiêu đề cho Claude Sonnet 5.5 trong Claude Code với tiêu đề 'Claude Sonnet 5.5 trong Claude Code', phụ đề 'Cùng một mô hình, hai nhà cung cấp, hai mặc định' và dòng chú thích 'Mức nỗ lực mặc định: cao trên Claude API, trung bình trong Claude Code.', cùng ba thẻ ghi v2.1.284, 28 thg 9 2026, $2 / $10 mỗi 1M token, và 'bí danh sonnet đã thay đổi trên một nhà cung cấp'.
Guides & Insights

Claude Sonnet 5.5 trong Claude Code: Alias đã dịch chuyển ở một nhà cung cấp, và giá trị mặc định đã hạ xuống

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Bản tin của bên thứ ba đưa Claude Sonnet 5.5 trở lại tầm ngắm trong tuần này cho biết mô hình "đang hoạt động ở mọi nơi, bao gồm cả Platform và Claude Code." Nửa đầu là lời của chính nhà cung cấp từ tháng 9, và điều đó hoàn toàn chính xác: Claude Sonnet 5.5 đã có mặt trên Claude API, Amazon Bedrock, Claude Platform on AWS, Goog​le Cloud và Microsoft Foundry với mức giá 2 và 10 USD mỗi triệu token, không thay đổi so với Claude Sonnet 5. Nửa sau chỉ đúng nếu "Claude Code" có nghĩa là một nhà cung cấp duy nhất. Bản dựng Claude Code ra mắt cùng buổi chiều hôm đó, v2.1.284, trỏ alias sonnet tới Claude Sonnet 5.5 trên API Anthro​pic — và để nó vẫn trỏ tới Claude Sonnet 4.6 trên Claude Platform on AWS, Claude Sonnet 4.5 trên Amazon Bedrock và Goog​le Cloud. Chạy /model sonnet với một triển khai Bedrock thì bạn sẽ không nhận được mô hình mới. Có một điều thứ hai đã thay đổi, và hầu như không ai viết về nó: trên Claude API Claude Sonnet 5.5 bắt đầu ở mức effort high; trong Claude Code nó bắt đầu ở mức medium. Cả hai sự thật đều được ghi chép lại, cả hai đều có tính quyết định đối với bất kỳ ai đang cân nhắc xem có nên chuyển đổi trong tuần này hay không, và cả hai đều nằm bên dưới cùng một câu nói rằng mô hình đang hoạt động ở mọi nơi.

v2.1.284 thực sự đã thay đổi những gì

Mục changelog của Claude Code chỉ dài một dòng, và nửa quan trọng lại là một chi tiết hạn định: "Đã thêm Claude Sonnet 5.5 (claude-sonnet-5-5), hiện là mô hình Sonnet mặc định trên Ant​hropic API — ngữ cảnh 1M, $2/$10 mỗi Mtok với $0.20/Mtok cho lượt đọc cache." Bản dựng đó được phát hành lên npm vào ngày 28 tháng 9 lúc 17:11 UTC, tức là ngày phát hành kèm dấu thời gian chứ không phải một số phiên bản. Tài liệu cấu hình mô hình có chứa bảng phân giải mà changelog không có.

• sonnet là bí danh — Claude Sonnet 5.5 trên API Ant​hropic; Claude Sonnet 4.6 trên Claude Platform on AWS; Claude Sonnet 4.5 trên Amazon Bedrock và Agent Platform của Goo​gle Cloud; Claude Sonnet 4.5 trên Microsoft Foundry.

• opus bí danh — Claude Opus 5.5 trên Ant​hropic API, Claude Platform trên AWS, Amazon Bedrock và Goo​gle Cloud; Claude Opus 4.6 trên Microsoft Foundry.

• mặc định — Claude Opus 5.5 trên Pro, Max, Team, Enterprise và Anthropic API, cùng Claude Sonnet 4.5 trên Microsoft Foundry. Kể từ v2.1.280 vào ngày 22 tháng 9, mô hình này đã là Opus 5.5; trước đó là Claude Sonnet 5 trên Pro và Team Standard.

• sonnet[1m] — không có tác dụng ở những nơi sonnet vốn đã được phân giải thành Claude Sonnet 5.5 hoặc Claude Sonnet 5, vì cả hai đều sở hữu cửa sổ 1M token gốc. Hậu tố không phải là cách để có ngữ cảnh dài trên mô hình này; bản thân mô hình đã có sẵn nó.

Đọc hàng thứ nhất và hàng thứ ba cùng nhau, và hệ quả thực tế thì hẹp nhưng sắc bén. Trên API Ant​hropic, nâng cấp Claude Code chính là toàn bộ việc di trú — sonnetsẽ tự chuyển giúp bạn. Trên Bedrock, Goo​gle Cloud và Claude Platform trên AWS, mô hình vẫn được phục vụ nhưng bí danh thì không được di chuyển, và tài liệu nói rõ về cách khắc phục: khi một bí danh phân giải thành một mô hình cũ hơn, các mô hình mới hơn có thể truy cập được bằng cách gọi tên đầy đủ hoặc bằng cách đặt ANTHROPIC_DEFAULT_SONNET_MODEL. Vậy nên "Sonnet 5.5 đã hoạt động trên Claude Code" là một câu nói về giá trị mặc định, và giá trị mặc định thì tùy theo từng nhà cung cấp.

Mức nỗ lực mặc định là một nấc khác nhau trên mỗi bề mặt.

Đây là phần thay đổi hóa đơn của bạn chứ không phải chuỗi mô hình của bạn, và nó được chia thành hai trang không tham chiếu chéo lẫn nhau. Tài liệu về effort của Claude API nêu rằng Claude Sonnet 5.5 hỗ trợ tất cả năm mức và rằng high là mặc định ở đó. Trang cấu hình mô hình của Claude Code nêu thứ tự giải quyết cho một phiên — một lựa chọn rõ ràng (biến CLAUDE_CODE_EFFORT_LEVEL, --effort, hoặc /effort), sau đó là cài đặt đã lưu của bạn, sau đó là mặc định của chính mô hình — và sau đó đưa ra mặc định của mô hình đó là: "high trên mọi mô hình hỗ trợ effort, ngoại trừ việc Opus 5.5 và Sonnet 5.5 mặc định là medium, Opus 4.7 mặc định là xhigh."

Hai mặc định, một mô hình, cách nhau một bậc. Trên chỉ số độc lập, một bậc đó đáng giá khoảng sáu điểm trí tuệ và khoảng 84% nhiều tiền hơn cho mỗi tác vụ hoàn thành. Hướng dẫn của chính Anthropic cho Claude Sonnet 5.5 — hãy bắt đầu ở mức high trừ khi khối lượng công việc mang tính agentic hoặc nhạy cảm với độ trễ, và bắt đầu ở mức medium cho lập trình agentic và sử dụng công cụ nhiều bước — được viết cho bề mặt API, nơi high là thứ bạn nhận được khi không làm gì cả. Claude Code đã tự đưa ra lựa chọn đó cho bạn theo hướng ngược lại.

Việc nó đưa ra quyết định đúng đắn hay không thực sự phụ thuộc vào khối lượng công việc, và lập luận của nhà cung cấp cho medium là có cơ sở: các mức độ nỗ lực của model được hiệu chỉnh lại một cách rõ ràng dựa trên Claude Sonnet 5, và ghi chú chuyển đổi nói rằng nên chạy lại một lượt khảo sát mức nỗ lực thay vì mang nguyên một cài đặt sang. Nhưng "hiệu chỉnh lại" thì có thể hiểu theo cả hai chiều, và phần tiếp theo chính là nơi điều đó thể hiện.

The Claude Code model-configuration documentation page, showing the per-provider resolution table: the sonnet alias resolves to Claude Sonnet 5.5 on the Anthropic API, Claude Sonnet 4.6 on Claude Platform on AWS, and Claude Sonnet 4.5 on Amazon Bedrock and Google Cloud's Agent Platform; the opus alias resolves to Claude Opus 5.5 on the first four providers and Claude Opus 4.6 on Microsoft Foundry.

Chi phí của thang, được đo lường

Artificial Analysis đã đo Claude Sonnet 5.5 ở mọi bậc trên Intelligence Index v4.3.2, một bộ gồm mười bài đánh giá, và chi phí cho mỗi bậc là con số mà một bảng giá không thể cho bạn thấy. Tất cả số liệu dưới đây đều là của đơn vị đánh giá đó, được đọc từ chính dữ liệu trên trang mô hình vào ngày 30 tháng 9 năm 2026; còn mức giá của nhà cung cấp là của Anthropic.

• Thấp — chỉ số 35,84 với 0,41 USD mỗi tác vụ; đoạn đầu tiên trong 1,04 giây.

• Medium, mặc định của Claude Code — 40,74 ở mức $0,59; chunk đầu tiên trong 1,34 giây.

• High, mặc định của Claude API — 46.74 với $1.08; chunk đầu tiên trong 16.6 giây.

• Xhigh — 51.85 với $2.74; chunk đầu tiên trong 39.7 giây.

• Max — 55.98 với $7.60; chunk đầu tiên trong 378.8 giây.

Bây giờ hãy đặt Claude Sonnet 5 với thang riêng của nó bên cạnh, vì đó là mô hình mà hầu hết độc giả sẽ chuyển từ. Các nấc của nó ghi 24.26, 28.05, 31.66, 34.38 và 38.16, với chi phí $0.51, $1.00, $1.79, $2.87 và $5.09 mỗi tác vụ. Claude Sonnet 5.5 ở mức mặc định của Claude Code, trung bình đạt 40.74 — cao hơn Claude Sonnet 5 có kết quả tốt nhất ở bất kỳ mức nỗ lực nào — với $0.59 so với $5.09. Điều đó rẻ hơn 8.7 lần cho mỗi tác vụ hoàn thành trên cùng bộ kiểm thử, và đây là phiên bản độc lập cho tuyên bố "chi phí ít hơn một phần mười" của Anthropic, mà nhà cung cấp đưa ra trên Terminal-Bench ở mức nỗ lực Trung bình. Cùng hướng, hệ số nhỏ hơn một chút, và đây là kết quả đo lường chứ không phải bảng của nhà cung cấp. Giảm xuống thấp thay vào đó và thứ tự đảo ngược: 35.84 thấp hơn Claude Sonnet 5, trần của nó, đây là mức sàn trung thực cho khoản tiết kiệm.

Bậc không hề rẻ trên cả hai mô hình là bậc cao nhất. Ở mức nỗ lực tối đa Claude Sonnet 5.5 tốn $7 cho mỗi tác vụ chỉ mục so với Claude Sonnet 5 có giá $5.09 — cao hơn khoảng 49%, chứ không phải thấp hơn. Đó không phải là mâu thuẫn với con số của nhà cung cấp. Đó là cùng một đường cong được đọc ở đầu bên kia, và đó là nơi một quá trình di chuyển sẽ đi tới nếu cài đặt nỗ lực được giữ nguyên thay vì bị gạt bỏ.

Cài đặt mức độ nỗ lực đã lưu của bạn có thể không đi theo bạn

Có một cài đặt thứ ba đang tham gia và đây là cái dễ bị sai một cách âm thầm nhất. Claude Code lưu mức độ nỗ lực theo từng model, dưới modelSettings trong cài đặt người dùng của bạn, nên mỗi model giữ mức riêng của nó. Dạng cũ hơn — một khóa cấp cao nhất duy nhất effortLevel, thứ mà /effort đã ghi trước khi tính năng lưu theo từng model tồn tại — được xử lý khác đối với các model gần đây. Tài liệu nói rằng khóa đó "vẫn tiếp tục áp dụng ở những nơi nó từng áp dụng, trên Opus 5, Fable 5.1 và các model cũ hơn, trong khi Opus 5.5 và các model ra mắt sau nó bắt đầu ở mức mặc định riêng của chúng cho đến khi bạn chọn một mức cho chúng."

Claude Sonnet 5.5 được phát hành sau Claude Opus 5.5 — ngày 28 tháng 9 so với ngày 22 tháng 9 — nên nó thuộc nhóm thứ hai. Một nhóm đã đặt effortLevel: "high" ở mức toàn cục cách đây một năm để giữ cho Claude Sonnet 5 luôn sắc bén thì không nhận được high trên mô hình mới. Họ nhận được medium, đây là mặc định của Claude Code, và không có gì trong phiên làm việc cho biết điều đó. Cùng trang đó lưu ý rằng max chỉ áp dụng cho phiên hiện tại, trừ khi nó được đặt qua biến môi trường, và rằng các khóa effortLevel ở cấp dự án, cục bộ hay được quản lý, hoặc một khóa được truyền kèm --settings, thì đều áp dụng cho mọi mô hình. Nếu bạn muốn một chính sách về mức effort tồn tại qua các bản phát hành mô hình, thì đó chính là dạng để viết nó.

Một thay đổi liền kề đáng để gọi tên vì nó dùng chung số phiên bản: Ultracode, công tắc trong thanh trượt nỗ lực, là cài đặt Claude Code chứ không phải mức nỗ lực của model, và việc giữ nó bật ở các mức khác ngoài xhigh, hoặc tắt nó bằng /effort ultracode off, yêu cầu v2.1.284 — cùng bản dựng đã mang Sonnet mới. Ultracode không phải là một mức nỗ lực và không nên được hiểu là một mức nỗ lực, nhưng nếu bạn đã viết script dựa trên hành vi cũ, thì đó là phiên bản mà nó đã thay đổi.

Chờ đợi là ngân sách suy nghĩ, không phải tốc độ token.

Các số liệu về độ trễ ở trên là thứ hữu ích nhất về mặt vận hành trên trang, vì chúng đảo ngược trực giác thông thường. Tốc độ đầu ra trên Claude Sonnet 5.5 không giảm khi mức nỗ lực tăng; nó tăng theo, từ 85 token mỗi giây ở mức nỗ lực thấp lên 137 ở mức tối đa. Thứ bùng nổ là thời gian chờ trước khi token đầu tiên xuất hiện — 1,0 giây ở mức thấp, 1,3 ở mức trung bình, 16,6 ở mức cao, 39,7 ở xhigh, 378,8 ở mức tối đa. Ở nấc cao nhất, mô hình không chậm hơn trên mỗi token. Nó suy nghĩ lâu hơn trước khi bắt đầu, và ở nấc trên cùng, đó là hơn sáu phút im lặng trước mỗi tác vụ.

Điều đó định hình lại mục đích của cài đặt này. trung bình không phải là một thỏa hiệp về chất lượng mà đúng hơn là bậc duy nhất nơi mô hình hành xử như một công cụ hội thoại; tối đa là một thao tác theo lô khoác lên mình giao diện tương tác. Một client streaming che giấu độ trễ khiến cao trông ổn trong một bản demo và có cảm giác hỏng trong terminal. Cách phân chia thực tế mà hầu hết các nhóm sẽ chốt là dùng bậc thấp cho bất cứ thứ gì con người đang theo dõi và bậc cao cho công việc chạy không cần người giám sát — điều này gần với chính lời khuyên của nhà cung cấp, được rút ra từ phía độ trễ thay vì phía chi phí.

Sự so sánh thực sự có thể định tuyến được ngay hôm nay

Nếu ý của thang bậc là medium mới là nơi giá trị nằm, thì câu hỏi thú vị là còn gì khác nằm gần nó. Claude Opus 5.5 ở mức mặc định Claude Code của chính nó là medium đạt 51,24 với $1,34 mỗi tác vụ trên cùng bộ kiểm thử. Claude Sonnet 5.5 ở mức high đạt 46,74 với $1,08. Bốn điểm rưỡi chỉ số tách biệt chúng với chi phí cao hơn khoảng một phần tư mỗi tác vụ, và Claude Opus 5.5 cũng vượt trội một cách đo đếm được ở mọi bậc trên mức mặc định của nó.

Một lưu ý về tính khả dụng, được nói rõ chứ không chỉ ngầm hiểu: Claude Sonnet 5.5 không nằm trong danh mục của OrcaRouter. Nó vắng mặt trong danh sách mô hình công khai và mọi cách viết slug đều trả về kết quả không tìm thấy, nên không có gì ở đây nên được hiểu là một đường dẫn tới nó. Thứ có thể định tuyến được chính là mô hình mà bạn sẽ chuyển từ đó và mô hình nằm trên nó. anthropic/claude-sonnet-5 đã có mặt trên nền tảng từ ngày 30 tháng 6 năm 2026 với mức giá của chính Anthropic là $2.00 và $10.00 mỗi triệu token, cùng $0.20 cho mỗi lần đọc cache và $2.50 cho mỗi lần ghi cache, được phục vụ qua /v1/messages, /v1/chat/completions và /v1/responses. anthropic/claude-opus-5.5 đã có mặt từ ngày 22 tháng 9 với mức $4.00 và $20.00, qua các endpoint tương thích với Anthropic và chat-completions.

Sự kết hợp đó chính là thứ khiến một cuộc quét mức nỗ lực trở nên rẻ để chạy. Cả hai phía của phép so sánh — mô hình đương nhiệm ở thiết lập cũ và mô hình anh em lớn hơn ở nấc mà mặc định của mô hình mới đang được đem ra cân nhắc — đều trả lời bằng một thông tin xác thực duy nhất, không cần hợp đồng thứ hai và không cần thay đổi mã nào ngoài chuỗi tên mô hình, còn danh mục chuyển thẳng giá niêm yết của nhà cung cấp mà không thêm phụ phí. Điều duy nhất nó sẽ không làm là phục vụ bạn chính Claude Sonnet 5.5, và cho đến khi điều đó thay đổi, phiên bản trung thực của lời khuyên trong bài viết này là hãy đánh giá nấc đó trên API riêng của Anthropic và đánh giá các lựa chọn thay thế ở nơi chúng vốn đã có thể tiếp cận được.

The OrcaRouter model page for anthropic/claude-sonnet-5, showing a 1M-token context window, up to 128K output tokens, input at $2.00 and output at $10.00 per 1M tokens with a $0.20 cache read and $2.50 cache write, a listing dated Jun 30, 2026, and tiles reading AA Coding 71.5 and AA Intelligence 38.2.The Artificial Analysis model page for Claude Sonnet 5.5, labelled Adaptive Reasoning, Max Effort, Default Fallback, released September 2026. It shows an Intelligence Index of 56, class ranks of #3 of 216 on intelligence and #98 of 216 on cost, $2.00 input and $10.00 output per 1M tokens with a 90% cache discount, a $7.60 average cost per Intelligence Index task, 410M tokens generated against a median of 88M, 137 tokens per second, 1M-token context window, and text and image input.

Việc cần làm trong tuần này

Ba điều, theo đúng thứ tự mà chúng sẽ khiến bạn tốn tiền nếu bạn bỏ qua. Hãy kiểm tra xem phiên Claude Code của bạn thực sự chạy trên nhà cung cấp nào trước khi bạn cho rằng bản nâng cấp đã có hiệu lực, bởi vì trên Bedrock, Goo​gle Cloud và Claude Platform on AWS, alias sonnet vẫn trỏ tới Claude Sonnet 4.5 hoặc Claude Sonnet 4.6 và mô hình phải được gọi tên đầy đủ. Hãy kiểm tra xem mức effort bạn đã lưu là một mục modelSettings theo từng mô hình hay là khóa cấp cao nhất kiểu cũ, bởi vì chỉ mục đầu tiên mới đi theo bạn sang một mô hình được phát hành sau Claude Opus 5.5. Và khi bạn chạy lại đợt quét mà nhà cung cấp yêu cầu, hãy quét cả lên trên lẫn xuống dưới: ở mức mặc định của Claude Code, Claude Sonnet 5.5 đánh bại kết quả tốt nhất của Claude Sonnet 5 với chi phí chưa bằng một phần chín, nghĩa là câu hỏi thú vị không còn là có nên hạ xuống hay không, mà là bạn có thể chi trả để vươn lên cao đến đâu.

Câu hỏi còn bỏ ngỏ là Claude Haiku 5.5, mà Ant​hropic nói sẽ gia nhập gia đình này trong vài tuần tới và sẽ nằm dưới mô hình này. Nếu quy luật từ Claude Opus 5.5 vẫn đúng, thì nó sẽ ra mắt trên API của Ant​hropic trước tiên rồi lan dần ra các nhà cung cấp khác với độ trễ được đo bằng số bản phát hành Claude Code chứ không phải bằng ngày. Độ trễ đó chính là điều cần để mắt tới, bởi mọi thứ ở trên về bí danh và giá trị mặc định thực ra đều là hệ quả của nó.

So sánh trong bài viết này3

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày