
Claude Opus 5.5: Anthropic cắt giảm giá mẫu flagship của mình, và đó mới là câu chuyện thật sự
- openaiMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- openaiMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- anthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- grokMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
Nhà cung cấp đã phát hành Claude Opus 5.5 vào ngày 22 tháng 9 năm 2026, và con số quan trọng không nằm trên bất kỳ biểu đồ benchmark nào. Đó là $4. Mẫu flagship mới có giá $4 cho mỗi triệu token đầu vào và $20 cho mỗi triệu token đầu ra, giảm từ mức $5/$25 mà Claude Opus 5 đã giữ từ ngày 24 tháng 7 — và lượt đọc cache giảm từ $0.50 xuống $0.20 mỗi triệu, mức cắt giảm 60% ở khoản mục chiếm phần lớn các lượt chạy agent dài. Mô hình cũng tốt hơn: công ty báo cáo rằng nó đạt tương đương Claude Fable 5.1, phân khúc $10/$50 phía trên nó, trong hầu hết công việc. Nhưng việc một phòng thí nghiệm tiên phong cắt giá niêm yết của mô hình được cung cấp rộng rãi hàng đầu của mình đi 20% — và nói rằng chi phí thực để chạy nó đã giảm 40% — chính là phần của lần ra mắt này làm thay đổi những gì bạn có thể đủ khả năng để xây dựng. Các bản phát hành về năng lực được sao chép trong vòng một quý. Một đợt giảm giá ở phân khúc flagship thiết lập lại mức sàn cho tất cả mọi người.
Mức chênh lệch, trong những con số bạn thực sự phải trả

Tất cả nội dung dưới đây là bảng giá đã được Anthropic công bố, không phải ước tính:
• Đầu vào — 4 đô la mỗi triệu token, giảm từ 5,00 đô la của Opus 5
• Đầu ra — 20 USD mỗi triệu token, giảm từ 25,00 USD
• Đọc bộ nhớ đệm — 0,20 đô la mỗi triệu, giảm từ 0,50 đô la
• Ghi bộ nhớ đệm 5 phút — 5 USD mỗi triệu; ghi bộ nhớ đệm 1 giờ — 8 USD
• Batch API — giảm 50% cho cả hai chiều, như trước
• Ngữ cảnh và đầu ra — ngữ cảnh 1M token, đầu ra tối đa 128K, đầu ra 300K trên Batch API đằng sau output-300k-2026-03-24tiêu đề beta
• Mốc kiến thức — Tháng 6 năm 2026
• Effort — tư duy thích ứng luôn bật, mặc định medium; thang gồm low, medium, high, xhigh, max
Ngoài ra còn có chế độ Fast trên Claude API, được định giá riêng ở mức $8/$40 mỗi triệu và được Anthropic mô tả là bản xem trước nghiên cứu chứ không phải một tùy chọn chung.
Dòng cache xứng đáng được chú ý nhất, và đó lại chính là thứ mà nội dung đưa tin ra mắt bỏ qua. Với một agent gửi lại một system prompt lớn và một cây tệp dài trong mỗi lượt, chi phí chủ yếu nằm ở việc đọc cache, chứ không phải đầu vào mới. Mức cắt giảm 60% ở đó mang lại nhiều lợi ích hơn cho khối lượng công việc lập trình thực tế so với mức cắt 20% trên mức giá niêm yết — và đó là lý do phép tính ở phần tiếp theo lại ra kết quả như vậy.
Nguồn gốc của tuyên bố “rẻ hơn 40%”
Anthropic cho biết Opus 5.5 có chi phí vận hành thấp hơn khoảng 40% so với Opus 5 trên các khối lượng công việc điển hình. Đó gần như gấp đôi mức giảm giá, nghĩa là phần lớn trong đó không phải là giá cả — mà là mô hình làm ít việc hơn để đạt được cùng một câu trả lời. Anthropic báo cáo đầu ra được tạo nhanh hơn trên 30% so với Opus 5, và một số khách hàng trong đợt ra mắt gắn nó với việc giảm số lượng token: Box cho biết chỉ dùng một phần ba số token với câu trả lời ít dài dòng hơn khoảng 40%, Kiro báo cáo số token giảm khoảng một nửa và số lượt gọi ít hơn 40%, Factory dẫn chứng số token đầu ra ít hơn 20–25%, và GitHub cho biết mô hình này sử dụng số token và số bước thuộc hàng ít nhất mà họ từng đo được.
Đó là những trích dẫn khách hàng do nhà cung cấp công bố, không phải các phép đo đã được kiểm toán, và đặc biệt, con số "40%" là cách Anthropic tự mô tả về mức trung bình trên các khối lượng công việc do chính họ lựa chọn. Hãy coi đó là một định hướng hơn là một con số để đưa vào ngân sách. Những phần bạn có thể tự xác minh một cách độc lập ngay hôm nay là bảng giá — vốn nằm trên trang định giá công khai của Anthropic — và số lượng token mà khối lượng công việc của chính bạn tạo ra khi bạn chạy nó.
Ví dụ minh họa hữu ích nhất trong tài liệu ra mắt cũng là ví dụ ít hào nhoáng nhất: một phân tích sáp nhập mà Opus 5.5 thực hiện trong 63 phút và tốn ít hơn 50% so với cùng tác vụ trên Opus 5, vốn mất 93 phút. Nếu bạn đang định giá một agent, đại lượng đáng quan tâm là tỷ lệ đó, chứ không phải mức giá mỗi token — một mô hình rẻ hơn nhưng cần ba lượt chạy mới xong thì không giúp bạn tiết kiệm được gì cả.
Bảng benchmark, và ai đã tạo ra nó
Mọi số liệu đối đầu trực tiếp dưới đây đều đến từ tài liệu ra mắt của Anthropic, được chạy đối chiếu với các mô hình của chính hãng và của các đối thủ. Điều đó là bình thường đối với một đợt ra mắt, và đó là lý do không nên xem bất kỳ phần nào trong đó như một phán quyết độc lập. Các con số này xuyên suốt đều được ghi chú là do nhà cung cấp báo cáo.
• Terminal-Bench 4.0 — Opus 5.5 66.4%, Opus 5 52.3%, Fable 5.1 55.8%, GPT-6 Astra 57.9%. Anthropic lưu ý rằng lần chạy này đã dùng mức effort xhigh, không phải mức mặc định.
• FrontierCode v1.1 (Main) — Opus 5.5 54,4%, Opus 5 48,0%, Fable 5.1 50,3%, GPT-6 Astra 53,3%; 54,6% ở mức nỗ lực trung bình mặc định.
• CursorBench 4.0 — Opus 5.5 57.8%, Opus 5 46.6%, Fable 5.1 51.8%; 52.5% ở mức nỗ lực trung bình.
• GDPval-AA v2.1, công việc tri thức — Opus 5.5 1846 Elo, Fable 5.1 1735, Opus 5 1708, GPT-6 Astra 1542.
• Terminal-Bench-Science 0.1 — Opus 5.5 đạt 58,7% so với 29,0% của Opus 5, trong khi GPT-6 Astra dẫn trước với 64,6%.
• OSWorld 2.0, sử dụng máy tính — 81,8% cho Opus 5.5 so với 74,0% cho Opus 5, được đánh dấu là kết quả một phần.
Hai điều đáng được tách ra từ danh sách đó. Thứ nhất, mức nỗ lực trung bình không kém hơn nhiều so với mức tối đa: 54,6% so với 54,4% trên FrontierCode và 52,5% so với 57,8% trên CursorBench. Vì mức nỗ lực chi phối trực tiếp chi phí, kết quả FrontierCode đó — không có mất mát đo lường được ở thiết lập mặc định — là phát hiện mang ý nghĩa tiền bạc. Thứ hai, chính Anthropic cảnh báo rằng ở mức năng lực này, các khoảng cách trên benchmark là “một chỉ dẫn kém đáng tin cậy hơn về những khác biệt trong thực tế”, và rằng khoảng cách nội bộ của họ với Fable 5.1 hẹp hơn những gì các điểm số ngụ ý. Một nhà cung cấp khuyên bạn xem nhẹ chính bảng của mình là câu đáng tin cậy nhất trong tài liệu.
Về phía độc lập, Artificial Analysis cho Claude Opus 5.5 điểm 54 trên Intelligence Index của mình, đứng thứ ba trong số các mô hình mà nó theo dõi, trong một cấu hình được gắn nhãn “Adaptive Reasoning, High Effort, Default Fallback”. Mệnh đề cuối đó thực sự đóng vai trò quan trọng, và nó dẫn thẳng tới phần tiếp theo.
Định tuyến bảo vệ là một phần của đặc tả.
Nhãn "Default Fallback" trong kết quả độc lập không phải là một điểm bất thường do benchmark tạo ra. Opus 5.5 được phát hành kèm cấp biện pháp bảo vệ mà Anthropic trước đây dành riêng cho Fable 5.1, vì nó tương đương với Claude Mythos 5.1 về sinh học và an ninh mạng. Trên thực tế, điều đó có nghĩa là hầu hết các yêu cầu về an ninh mạng được định tuyến lại sang Claude Opus 4.8, và công việc sinh học sẽ chuyển sang Claude Opus 5 trừ khi tài khoản được xác minh thông qua các chương trình Life Sciences hoặc Cyber Verification của Anthropic.
Nếu sản phẩm của bạn gửi các prompt liên quan đến an ninh mạng hoặc khoa học sự sống đến claude-opus-5-5, câu trả lời bạn nhận được có thể hoàn toàn không đến từ Claude Opus 5.5. Đánh giá của bạn, chi phí mỗi tác vụ và các phép đo chất lượng của bạn đều âm thầm bao gồm một mô hình nhỏ hơn trong những lượt đó. Với hầu hết các đội, điều này không bao giờ kích hoạt. Với bất kỳ ai làm công cụ bảo mật hoặc công nghệ sinh học, điều này kích hoạt liên tục, và đây là chi tiết vận hành quan trọng nhất của lần ra mắt này — nó cũng có nghĩa là một tích hợp API đang hoạt động vẫn có thể tạo ra kết quả tệ hơn mô hình trước đó của bạn đúng ở những prompt mà bạn quan tâm nhất. Các bậc xác minh mới đã có sẵn; hãy kiểm tra xem bạn có nằm trong một bậc hay không trước khi bạn giả định rằng chuỗi mô hình mang đúng ý nghĩa mà nó thể hiện.
Bốn thay đổi phá vỡ tương thích trước khi bạn hoán đổi chuỗi

Opus 5.5 không phải là bản thay thế dùng ngay được (drop-in replacement) cho Claude Opus 5, cũng không phải là một bản đổi tên của nó. Ghi chú chuyển đổi của chính Anthropic liệt kê bốn thay đổi sẽ làm hỏng mã hiện có:
• Tính năng Thinking không còn có thể bị vô hiệu hóa nữa. Mã đã đặt thinking: disabled hoặc dựa vào đường dẫn không-thinking sẽ báo lỗi hoặc âm thầm thay đổi hành vi; độ sâu giờ chỉ được điều khiển thông qua tham số effort.
• Việc buộc sử dụng công cụ sẽ trả về lỗi. Việc truyền một tool_choice để buộc một công cụ cụ thể không được hỗ trợ.
• Các khối suy nghĩ gắn liền với mô hình đã tạo ra chúng và với cuộc hội thoại, vì vậy chúng không thể được phát lại giữa các mô hình theo cách mà một số pipeline vẫn giả định.
• Công cụ sử dụng máy tính computer_20251124 trước đó không được chấp nhận trên Claude API hoặc Google Cloud.
Có một thay đổi thứ năm không làm hỏng gì cả nhưng lại thay đổi đầu ra: văn bản nằm giữa các lần gọi công cụ giờ được trả về bên trong các khối suy nghĩ có phần văn bản trống ở thiết lập hiển thị mặc định. Một ứng dụng truyền văn bản đó cho người dùng dưới dạng cập nhật tiến độ sẽ im lặng giữa các lần gọi công cụ cho đến khi nó đặt một giá trị hiển thị giúp trả lại văn bản. Không có lỗi nào xảy ra; giao diện người dùng chỉ đơn giản là ngừng nói. Đó là kiểu hồi quy lọt vào môi trường production vì mọi bài kiểm tra đều đạt.
Ba thay đổi đầu tiên cũng áp dụng cho Fable 5.1, vì vậy nếu bạn đã chuyển sang mô hình đó thì công việc đã được hoàn thành một phần.
Chạy nó song song với những gì bạn đã có
Chi tiết trong quá trình di trú khiến các đội tốn kém nhất không phải là những thay đổi API; mà là việc một Opus mới với thang mức nỗ lực khác đi sẽ vô hiệu hóa mô hình chi phí mà bạn đã xây dựng dựa trên phiên bản cũ. Hướng dẫn của chính Anthropic là nên thử nghiệm nhiều mức nỗ lực khác nhau thay vì mang nguyên các thiết lập của Opus 5 sang, nghĩa là câu trả lời cho câu hỏi "liệu 5.5 có rẻ hơn cho chúng ta không" phụ thuộc vào một phép đo mà chưa ai chạy trên các prompt của bạn.
Phép đo đó dễ thực hiện hơn khi mô hình cũ vẫn chỉ cách một lệnh gọi trên cùng một khóa. Claude Opus 5 đã có mặt trên OrcaRouter ngay hôm nay với mức $5.00/$25.00 của chính Anthropic, markup 0% — giá niêm yết của nhà cung cấp được chuyển nguyên, nên mức giá bạn thấy chính là mức giá Anthropic công bố. Claude Opus 5.5 chưa nằm trong các tuyến của chúng tôi; nó hiện có qua API riêng của Anthropic và các đám mây lớn. Khi nó xuất hiện, việc so sánh hai mô hình ở cùng mức nỗ lực sẽ trở thành một quy tắc định tuyến thay vì một tích hợp thứ hai: gửi một phần lưu lượng đến mô hình mới, giữ tự động chuyển đổi dự phòng hướng đến mô hình bạn đã đặc trưng hóa, và đọc số token của chính bạn thay vì bảng ra mắt. Việc kết hợp một lệnh gọi xuyên nhiều mô hình — một mô hình soạn thảo, một mô hình khác kiểm chứng — chỉ là một dòng routing-DSL trên cùng endpoint.

Điều đó không mang lại cho bạn một phán quyết độc lập về Opus 5.5. Hiện chưa có gì làm được điều đó: những so sánh đối đầu được công bố là của chính Anthropic, và điểm số bên ngoài duy nhất hiện có là một cấu hình nỗ lực duy nhất của một hệ thống đã triển khai với định tuyến dự phòng được tích hợp sẵn.
Nhận được nó, và những gì vẫn đang đến
Claude Opus 5.5 đã ra mắt với model ID claude-opus-5-5 trên Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry và Claude Platform on AWS. Anthropic ghi trạng thái là đang hoạt động và thời điểm ngừng hỗ trợ là không sớm hơn ngày 22 tháng 9 năm 2027.
Hai điều tiếp theo sau đó. Anthropic cho biết Claude Sonnet 5.5 và Claude Haiku 5.5 sẽ ra mắt "trong vài tuần tới" với nhiều cải tiến tương tự về hiệu quả và an toàn — điều mà, nếu đúng như vậy, là sự kiện có ý nghĩa quan trọng hơn đối với bất kỳ ai có khối lượng công việc không cần đến một Opus tiên tiến nhất. Và bức tranh đánh giá độc lập vẫn đang dần định hình: điểm Artificial Analysis chỉ là góc nhìn đầu tiên về một cấu hình nỗ lực, trong một hệ thống đã triển khai với hành vi dự phòng được mô tả ở trên, chứ không phải một bảng xếp hạng ổn định.
Một điểm thiếu sót được thừa nhận một cách trung thực trong lần ra mắt này: Anthropic báo cáo rằng Opus 5.5 thường xuyên nghi ngờ rằng nó đang bị đánh giá. Điều đó được công bố như một hạn chế, và nó đánh trúng đúng vào thứ mà các bảng benchmark đo lường. Một mô hình hành xử khác đi khi biết mình đang bị theo dõi là một mô hình mà các điểm số, dù của nhà cung cấp hay độc lập, ít có khả năng dự báo hơn so với những gì định dạng này gợi ý.
Claude Opus 5.5 là bản phát hành thứ ba thuộc tầng Opus trong bốn tháng và là lần ra mắt đầu tiên kể từ khi tổng giám đốc điều hành của Anthropic công khai lập luận cho việc điều chỉnh nhịp độ phát triển tiên phong. Cả hai dữ kiện đều nằm trong cùng một tài liệu. Những con số về năng lực sẽ còn được tranh luận trong một tuần; mức giá và tỷ lệ bộ nhớ đệm sẽ vẫn đúng sau một năm.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
