Thẻ hero cho Claude Sonnet 5.5 với tiêu đề 'Một bài kiểm tra ngầm, hay chính bảng giá bạn đã có sẵn', cùng ba pill ghi 'chưa phát hành', 'chưa công bố ID mô hình' và 'đã thông báo: trong vài tuần tới', phần chân trang dẫn một bài đăng trên X ngày 24 tháng 9 năm 2026 và bài đăng ra mắt Opus 5.5 của Anthropic ngày 22 tháng 9 năm 2026, cùng logo OrcaRouter ở góc dưới bên phải
Guides & Insights

Claude Sonnet 5.5: Một rò rỉ từ cuộc thử nghiệm kín đáo, được dựng nên từ bốn con số vốn đã tồn tại

Tác giả

Alistair Wren

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Bốn con số đã được đăng trên X vào ngày 24 tháng 9 như bằng chứng rằng Claude Sonnet 5.5 "đang được thử nghiệm ngầm": cửa sổ ngữ cảnh 1M token, đầu ra tối đa 128K token, 2 USD mỗi triệu token đầu vào và 10 USD mỗi triệu token đầu ra. Cả bốn con số này hiện đều nằm trong bảng giá của chính Anthro​pic, gắn với Claude Sonnet 5 — mẫu mà bản 5.5 sẽ thay thế, được cung cấp rộng rãi từ ngày 30 tháng 6 năm 2026. Mức giá tiêu đề 2 USD / 10 USD y hệt cũng thuộc về GPT-6 Sol, mẫu mà Open​AI phát hành vào ngày 22 tháng 9, và chính sự trùng lặp đó khiến bài đăng được đọc như một câu trả lời dành cho Open​AI hơn là một lần làm mới hạng mục thông thường: "Với tôi, điều này đọc như một phản hồi trực tiếp gửi GPT-6-Sol. Cùng mức giá và có lẽ hiệu năng tương tự."

Không điều nào trong số đó khiến tuyên bố trở nên sai. Nó khiến tuyên bố trở thành không thể chứng minh là sai, một vấn đề khác và hữu ích hơn để ghi lại. Một lần bắt gặp trong thử nghiệm kín chỉ đáng tin cậy ngang với bằng chứng đằng sau nó, và bằng chứng đằng sau lần này là một bảng thông số kỹ thuật không thể phân biệt với mô hình mà Anthropic đã cung cấp suốt mười hai tuần qua.

Những gì thực sự đã được đăng

Nguồn là một bài đăng X duy nhất từ tài khoản @kimmonismus, đề ngày 24 tháng 9 năm 2026. Bài đăng nêu cửa sổ ngữ cảnh, trần đầu ra và hai mức giá, so sánh giá với GPT-6 Sol, và kết luận rằng Sonnet 5.5 đang được thử nghiệm. Không có ảnh chụp màn hình, không có chuỗi model, không có phản hồi API, không có bảng liệt kê console, không có mô tả của người thử nghiệm về hành vi, và không có người quan sát thứ hai nào gắn với bất kỳ điều nào trong số đó. Bài đăng là một tuyên bố có kèm các con số, và những con số đó là các giới hạn công khai của hạng đó.

Điều đó đáng được tách ra khỏi kiểu câu chuyện trước phát hành khác của Anthropic, vì năm 2026 đã tạo ra cả hai và chúng trông chẳng giống nhau chút nào. Các định danh truy cập sớm tháng Tám là claude-marshmallow-eap và claude-melon-eap từng là những chuỗi tồn tại trong các request — xấu xí, thiếu hào nhoáng và có thể kiểm chứng. Câu chuyện Opus 5.2 kéo dài suốt tháng Chín là một báo cáo định tuyến: các nhà phát triển nhận thấy rằng backend đằng sau nhãn “Opus 5” trả lời khác đi, và mô tả hành vi đó. Cả hai đều là dấu vết. “Đang được thử nghiệm ngầm” mà không kèm dấu vết nào chỉ là bản tóm tắt về những gì hạng Sonnet vốn đã bán.

Cũng có một mô thức đáng lưu ý ngay trong chính nguồn tin. Cùng tài khoản đó đã đăng một bản tổng hợp vào ngày 20 tháng 9, mở đầu bằng bốn mô hình mà nó nói là "đã thấy có thử nghiệm cho" — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 và Gemini 4 Pro. Trong bốn cái tên đó, các mục Opus và Fable có những báo cáo riêng, đã được chứng thực, làm hậu thuẫn, còn mục Gemini có những lần xuất hiện của riêng nó. Mục Sonnet chỉ có một vị trí trong danh sách. Bốn ngày sau, tuyên bố về Sonnet đã mọc thêm một bảng thông số kỹ thuật, và bảng thông số ấy chính là mô hình đã tồn tại.

Bốn con số là các con số của Claude Sonnet 5

Đây là phần chỉ mất ba mươi giây để kiểm tra mà gần như không ai thực hiện. Trang tổng quan các mô hình của Anthropic, đọc hôm nay, liệt kê Claude Sonnet 5 với cửa sổ ngữ cảnh 1M token, đầu ra tối đa 128K và $2 / $10 mỗi triệu token. Hãy đối chiếu thông tin rò rỉ với điều đó:

• Cửa sổ ngữ cảnh — 1M token được tuyên bố cho Claude Sonnet 5.5; 1M token được công bố cho Claude Sonnet 5

• Đầu ra tối đa — 128K token được tuyên bố; 128K token được công bố

• Giá đầu vào — 2 USD mỗi triệu theo tuyên bố; 2 USD mỗi triệu theo công bố

• Giá đầu ra — $10 mỗi triệu được công bố; $10 mỗi triệu đã xuất bản

• ID mô hình — không có thông tin nào được công bố cho Claude Sonnet 5.5; claude-sonnet-5 cho Claude Sonnet 5

• Điểm số độc lập — không có điểm nào cho mô hình được tuyên bố; Artificial Analysis xếp Claude Sonnet 5 ở Chỉ số Thông minh là 38, xếp hạng 54 trong số 210 mô hình mà họ đo lường, trong cấu hình suy luận thích ứng, nỗ lực tối đa

Two-column scoreboard titled 'Claude Sonnet 5.5 vs Claude Sonnet 5 - the scoreboard'. The left column, Claude Sonnet 5.5 (leaked), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID none published; independent scores none. The right column, Claude Sonnet 5 (shipped June 30, 2026), reads: context window 1M tokens; max output 128K tokens; input price 2 dollars per million; output price 10 dollars per million; model ID claude-sonnet-5; independent scores AA Index 38. The footer reads 'Claude Sonnet 5 figures per Anthropic and Artificial Analysis; Claude Sonnet 5.5 figures unverified, single observer.'

Có một lớp thứ hai đối với vấn đề giá mà bản rò rỉ hiểu ngược lại. Khi Claude Sonnet 5 ra mắt, mức $2 / $10 được công bố là giá giới thiệu kéo dài đến hết ngày 31 tháng 8 năm 2026, với kế hoạch tăng lên $3 / $15 vào ngày 1 tháng 9. Việc tăng giá đó đã không xảy ra. Trang giá của Anthropic hiện có chú thích ghi rằng $2 / $10 "hiện là mức giá tiêu chuẩn" và rằng "mức tăng đã được lên lịch trước đó lên $3 / $15 mỗi triệu token đầu vào/đầu ra vào ngày 1 tháng 9 năm 2026 sẽ không diễn ra." Vậy nên mức giá mà bản rò rỉ trình bày như vũ khí cạnh tranh của mô hình mới lại chính là mức giá vĩnh viễn của mô hình hiện hành — nghĩa là một Sonnet 5.5 ra mắt ở mức $2 / $10 sẽ ra mắt mà không hề được giảm giá chút nào, vào một phân khúc vốn đã được định giá so với GPT-6 Sol.

Điều duy nhất mà Anthropic thực sự đã nói

Gạt bỏ mọi thứ đến từ những nguồn rò rỉ ẩn danh, và chỉ còn sót lại một câu từ chính chủ. Khi Anthropic ra mắt Claude Opus 5.5 vào ngày 22 tháng 9 năm 2026, hãng cho biết Claude Sonnet 5.5 và Claude Haiku 5.5 sẽ ra mắt tiếp theo “trong những tuần tới”, mang lại những cải thiện tương đương về hiệu năng, hiệu quả và an toàn. Câu đó là toàn bộ ghi nhận đã được xác nhận. Nó không có mã model, không có cửa sổ ngữ cảnh, không có giá, không có benchmark và không có ngày — và đặc biệt, nó không nói bất cứ điều gì về thử nghiệm tàng hình, lộ trình xám, hay bất kỳ hình thức thử nghiệm nào.

Phần còn lại trong bề mặt công khai của Anthropic cũng đồng tình với cách diễn giải đó. Phần tổng quan về các mô hình vẫn liệt kê bốn mô hình — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 và Claude Haiku 4.5 — không có hàng thứ năm, không có mục giá và không có dấu hiệu "sắp ra mắt" nào cho một phiên bản kế nhiệm Sonnet. Nếu một checkpoint thuộc tầng Sonnet đang được phục vụ ở đâu đó mà lập trình viên có thể truy cập, thì định danh sẽ là thứ đầu tiên xuất hiện, vì một mô hình được phục vụ phải có tên trong yêu cầu. Không có gì như vậy.

Một điều mà thông báo tháng 9 đã làm rõ: nó mâu thuẫn với rò rỉ trước đó cho rằng dòng Haiku sẽ bị khai tử và thế hệ 5.5 sẽ tái cấu trúc danh mục sản phẩm. Theo Anthropic, Haiku 5.5 sắp ra mắt, nghĩa là câu chuyện tái cấu trúc đã sai theo hướng mà các nguồn rò rỉ hiếm khi sai — phân khúc giá rẻ vẫn sẽ tồn tại.

Vụ rò rỉ tháng Tám cho biết 2 triệu token. Còn lần này nói 1 triệu.

Sáu tuần trước bài đăng ngày 24 tháng 9, vào ngày 9 tháng 8, một tài khoản X khác đã đăng một bảng thông số “SONNET 5.5 LEAK” với một tuyên bố táo bạo hơn nhiều: cửa sổ ngữ cảnh 2 triệu token, gấp đôi của Sonnet 5, suy luận nhanh hơn, sử dụng công cụ trình duyệt và terminal tốt hơn, hiệu năng tiệm cận Claude Fable 5, và phát hành “tháng sau”. Bản rò rỉ đó đi kèm một hình họa được tạo kiểu trông giống thẻ xem trước của Anthropic. Nó cũng đi kèm một chi tiết chí mạng mà những người chỉ trích nó lập tức bám vào: mật danh mà nó đưa ra, “Fennec”, chính là mật danh đã được phát hành cùng Claude Sonnet 5 vào ngày 30 tháng 6. Một mật danh không thể là bằng chứng mới cho một phiên bản kế nhiệm của mô hình đã dùng nó.

Hai đợt rò rỉ không thống nhất với nhau về con số được trích dẫn nhiều nhất. Tháng Tám nói ngữ cảnh 2M. Tháng Chín nói 1M. Cả hai không thể cùng mô tả một bản dựng. Cách lý giải khả dĩ nhất là cách nhàm chán: bài đăng tháng Chín mô tả các giới hạn đã công bố của hạng Sonnet, vì đó là những gì một mô hình thuộc hạng Sonnet trông như thế nào từ bên ngoài, còn bài đăng tháng Tám chỉ là phỏng đoán xem một bản làm mới có khả năng sẽ tăng gấp đôi con số nào. Hãy để ý con số đã dịch chuyển theo hướng nào — đi xuống, về phía thứ vốn đã tồn tại.

Vậy so sánh GPT-6 Sol có đúng không?

Phần lớn là vậy, và chỗ mà nó không còn đúng mới là phần thú vị. GPT-6 Sol ra mắt vào ngày 22 tháng 9 năm 2026, cùng ngày với Claude Opus 5.5, và giá niêm yết của nó khởi điểm từ $2 mỗi triệu token đầu vào và $10 mỗi triệu token đầu ra — đúng bằng mức giá của Sonnet 5 và đúng như thông tin rò rỉ khẳng định về Sonnet 5.5. Nó cung cấp cửa sổ ngữ cảnh 1.050.000 token với giới hạn đầu ra 128K, cả hai chỉ chênh lệch một chút so với các con số của Claude Sonnet 5. Mẫu anh em rẻ hơn, GPT-6 Luna, nằm ở mức $0.10 / $0.50.

Điểm khác biệt nằm ở ngữ cảnh dài. GPT-6 Sol định giá theo hai mức: $2 / $10 cho tới 272.000 token đầu vào, rồi $4 / $15 khi vượt mức đó. Anthropic không làm vậy trên dòng Sonnet — Claude Sonnet 5 tính toàn bộ cửa sổ 1M theo mức giá tiêu chuẩn, nên một yêu cầu 900K token tốn cùng chi phí mỗi token như một yêu cầu 9K. Do đó, một Sonnet 5.5 thực tế so với một GPT-6 Sol thực tế là hòa nhau về giá đối với các prompt thông thường, và là khoảng cách gấp đôi đối với các khối lượng công việc tài liệu dài và repo lớn mà cả hai mô hình đều được bán để phục vụ. "Cùng mức giá" đúng ở dòng tiêu đề và sai ở những khối lượng công việc mà tại đó người ta chọn mức giá.

Một lưu ý thứ hai nằm bên dưới toàn bộ phép so sánh. Claude Sonnet 5 sử dụng tokenizer mới hơn của Anthropic, vốn tạo ra lượng token nhiều hơn khoảng 30% cho cùng một đoạn văn bản so với tokenizer trước đó. Mức giá được quảng cáo không phải là hóa đơn; hóa đơn là số token trên mỗi tác vụ, và đó là con số mà chưa từng có rò rỉ nào mang theo.

Điều gì sẽ làm cho Sonnet 5.5 trở nên quan trọng?

Gạt sang một bên chuyện nó có tồn tại hay không, hãy tự hỏi điều gì sẽ thay đổi đối với một người phải trả tiền cho token. Bốn điều, và không điều nào trong số đó là một bảng thông số kỹ thuật.

Điều đầu tiên là mức giá dưới $2 / $10. Với việc đợt tăng ngày 1 tháng 9 bị hủy, mức giá của sản phẩm đương nhiệm giờ là vĩnh viễn — vì vậy một sản phẩm kế nhiệm giữ nguyên mức giá đó là một bước đi ngang, và tin tức duy nhất ở tầng Sonnet có thể làm dịch chuyển dòng tiền là một đợt giảm giá.

Điều thứ hai là ngữ cảnh vượt 1M. Đó là đề xuất thực sự của vụ rò rỉ tháng 8 và đó là khoảng trống năng lực duy nhất mà vụ rò rỉ có thể nêu tên mà bên đương nhiệm chưa bao phủ.

Thứ ba là số token trên mỗi tác vụ. Tính năng suy luận thích ứng của Claude Sonnet 5 được bật mặc định, và phân tích độc lập đã đo được rằng nó tạo ra lượng token đầu ra trên mỗi tác vụ nhiều hơn đáng kể so với phiên bản tiền nhiệm. Một phiên bản giữ nguyên mức giá 2 USD / 10 USD mà chặn đứng tình trạng lạm phát token đó sẽ cắt giảm hóa đơn thực tế nhiều hơn so với một đợt giảm giá được quảng cáo rầm rộ.

Thứ tư là một định danh. Một chuỗi mô hình API, một dòng tài liệu, một mục giá, một thẻ mô hình — bất kỳ thứ nào trong số đó cũng đủ khép lại cuộc tranh luận, và việc thiếu vắng cả bốn thứ ấy sau một vụ rò rỉ rõ ràng đến vậy tự nó đã là dữ kiện đáng nói nhất trong câu chuyện này.

Những gì bạn có thể gọi hôm nay

Claude Sonnet 5 không phải là một giải pháp tạm thời trong khi phân khúc này tự ổn định. Đây là mô hình mà phần lớn lưu lượng Claude API vốn đã chạy trên đó, với cửa sổ 1M token, đầu ra 128K và mức giá $2 / $10 giờ đây đã là tiêu chuẩn chứ không còn mang tính khuyến mại.

Artificial Analysis model page for Claude Sonnet 5 (Adaptive Reasoning, Max Effort), released June 2026, showing an Intelligence Index of 38 at rank 54 of 210, an output speed of 79.3 tokens per second at rank 77 of 210, a cost of $2.00 per million input tokens and $10.00 per million output tokens with a 90% cache discount and $5.09 cost per Intelligence Index task, a verbosity of 370M output tokens, reasoning enabled, and a 1M token context window

Nó đã có mặt trên OrcaRouter từ tháng Sáu với mức $2 / $10 của chính Anthropic, được chuyển qua theo đúng giá niêm yết của nhà cung cấp, không cộng thêm phụ phí, nên nếu nhà cung cấp thay đổi giá ở dòng Sonnet thì tại đây sẽ được cập nhật ngay trong cùng ngày thay vì phải chờ đến kỳ thanh toán kế tiếp. Cùng một key đó cũng đã truy cập được GPT-6 Sol ở mức $2 / $10, điều này quan trọng hơn mức thông thường trong một bài viết như thế này: phép so sánh mà rò rỉ dựa vào là phép so sánh bạn có thể tự chạy chỉ với một thông tin xác thực thay vì hai hợp đồng.

OrcaRouter model page for anthropic/claude-sonnet-5, attributed to Anthropic and dated 2026-06-30, showing a 1M token context window, 128K maximum output, text plus image and file inputs, an INPUT price of $2.00 per million tokens and an OUTPUT price of $10.00 per million tokens, a p50 time to first token of 5.67 seconds, and OpenAI-compatible base URL https://api.orcarouter.ai/v1

Đó cũng là cách rẻ nhất để trả lời câu hỏi mà vụ rò rỉ đặt ra. Nếu Sonnet 5.5 xuất hiện, nó sẽ có mặt trong danh mục như bất kỳ thứ gì khác, và bạn định tuyến một phần lưu lượng truy cập đến nó đằng sau chuyển đổi dự phòng tự động sang Claude Sonnet 5 — không cần tích hợp thứ hai, không cần đàm phán lại, và không có đường dẫn sản xuất nào phụ thuộc vào một mô hình chưa được ai đánh giá độc lập. Thử nghiệm một tầng chưa được chứng minh là một quyết định định tuyến, không phải là một dự án di chuyển.

Xem gì thay vì bài rò rỉ tiếp theo

Ba tín hiệu, theo thứ tự giảm dần về mức độ chúng sẽ cho bạn biết. Một định danh là yếu tố quyết định, vì một mô hình đang được phục vụ phải có tên trong một yêu cầu và đó là cách mọi câu chuyện tiền phát hành có thể kiểm chứng của Anthropic trong năm 2026 trở nên có thể kiểm chứng. Sự xác nhận từ nhà cung cấp — một thẻ mô hình, một dòng trong tài liệu, một dòng bảng giá, hoặc mô hình chỉ đơn giản xuất hiện trong danh sách của chính Anthropic — chấm dứt chuyện đó dứt khoát; câu "trong vài tuần tới" nghĩa là một trong những thứ đó thực sự phải được đưa ra. Một báo cáo của người thử nghiệm mô tả hành vi thay vì thông số kỹ thuật là tín hiệu yếu nhất trong ba, và vẫn nhiều hơn những gì tồn tại ngày nay.

Cho đến khi một trong số đó thành hiện thực, tóm tắt trung thực là Anthropic đã hứa sẽ ra mắt bản làm mới Sonnet trong vài tuần tới và một nhà quan sát đã mô tả nó bằng các con số của mô hình mà nó sẽ thay thế. Nếu stack của bạn đã chạy claude-sonnet-5, thì không có gì phải chờ đợi và không có gì để lên kế hoạch xung quanh. Nếu bạn đang cân nhắc Claude Sonnet 5 so với GPT-6 Sol, những con số bạn có thể dựa vào để hành động là những con số đã được công bố — và chúng cũng chính là những con số mà vụ rò rỉ đang cố bán cho bạn như một tin mới.

So sánh trong bài viết này2

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày