
Demo Claude Opus 5.5 tốn từ 3 đến 26 USD: Cách đọc những ngày đầu của các bản dựng
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 495 tok/s
- openaiMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- openaiMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- anthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- grokMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 186 tok/s
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 113 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
Hai con số từ tuần đầu tiên của Claude Opus 5.5mô tả cùng một mô hình và chênh lệch nhau một bậc độ lớn. Một người xây dựng báo cáo một phòng thí nghiệm thấu kính tương tác đã hoàn thiện — một trang nơi bạn kéo một vòng lấy nét và xem một mặt phẳng lấy nét phát sáng quét qua một thung lũng — ở mức $25.66 cho chi tiêu API và một giờ 26 phút thời gian thực tế. Một bài tổng hợp được chia sẻ rộng rãi về các bản demo ra mắt định giá một hoạt ảnh lâu đài Blender được dựng theo thủ tục, hoàn chỉnh với pháo hoa và hình ảnh phản chiếu trên mặt hồ, ở mức $13.30 và 35 phút. Một chủ đề đã lọt lên trang nhất của r/ClaudeAI nói rằng $3.21. Nhà cung cấp đã phát hành Claude Opus 5.5 vào ngày 22 tháng 9 năm 2026 với giá $4 cho mỗi triệu token đầu vào và $20 cho mỗi triệu token đầu ra, và không có con số nào trong ba con số đó là sai. Chúng đang đo lường những thứ khác nhau, và nếu bạn đang lập ngân sách dựa trên chúng, bạn cần biết con số nào.
Khoảng cách đó không phải là nhiễu. Nó là sự khác biệt giữa những gì một lần chạy tác nhân tạo ra và những gì nó tiêu thụ, và bốn ngày vừa qua đã tạo ra một lượng đáng kể của cái sau với rất ít sự hạch toán cho nó. Vậy đây là phép tính mà không ai đăng kèm theo các bản demo, rồi đến phần của đợt ra mắt thực sự nằm trên bảng giá và có thể kiểm chứng.
$25.66 thực sự đã mua được gì
Đầu đắt tiền của dải sản phẩm lại chính là đầu hữu ích nhất, bởi vì nhà chế tạo đã công bố cả sản phẩm lẫn hóa đơn.
Phòng thí nghiệm ống kính của Ryan Sael, có tiêu đề “Mặt phẳng lấy nét”, là một trang tương tác duy nhất được tạo từ một prompt trong một phiên. Nó đưa một ống kính máy ảnh lên màn hình, cho phép bạn kéo vòng lấy nét, và cho bạn thấy điều mà mọi nhiếp ảnh gia đều biết nhưng hầu như chẳng ai từng thấy: tấm mỏng trong thế giới thực nơi bức ảnh thực sự trở nên sắc nét. Xoay vòng lấy nét và tấm đó di chuyển, các thấu kính trượt tới hoặc lui bên trong thân ống kính để cho thấy tại sao, và một bảng điều khiển hiển thị khoảng cách, khẩu độ và vùng nét — 60 cm, f/2, độ sâu 1,9 cm, ở thiết lập mà trang mở ra. Khép khẩu độ từ f/2 xuống f/16 và vùng nét mở rộng khi chùm sáng hình nón thu hẹp lại. Chế độ xem bung tách rời các thấu kính. Không có mô hình hình ảnh nào ở bất kỳ đâu trong quy trình, và không có tài nguyên nào được tải xuống: mọi thành phần đều được vẽ và tạo hoạt ảnh bằng mã, đó là lý do toàn bộ phần minh họa về vòng tròn nhòe là một mô phỏng trực tiếp thay vì một sơ đồ.
Đó là một bài giải thích thực sự hay, và tuyên bố gắn với nó chính xác một cách bất thường: một lần chạy, 1 giờ 26 phút, $25.66 chi phí sử dụng API, với trang vẫn hoạt động tại lens.lab.sael.net khi tôi đọc nó. Con số này do tự báo cáo và không thể kiểm toán, nhưng nó cũng là chi phí demo duy nhất đang lưu hành mà đi kèm một thời lượng phiên để chia ra.
Hãy làm phép tính trên bảng giá. Với mức giá công bố của Claude Opus 5.5 là 4 đô la mỗi triệu token đầu vào và 20 đô la mỗi triệu token đầu ra, 25,66 đô la nằm trong khoảng từ 1,28 triệu token đến 6,4 triệu token tùy theo tỷ lệ pha trộn — mức cao nếu lượt chạy chỉ toàn đầu vào, mức thấp nếu chỉ toàn đầu ra. Một bản dựng kiểu agent như thế này nằm đâu đó ở khoảng giữa, và lý do nó nằm gần mức thấp hơn là khoản mục mà hầu hết mọi người bỏ qua: các lượt đọc cache trên Claude Opus 5.5 tốn 0,20 đô la mỗi triệu token, bằng một phần bốn mươi mức giá đầu vào, nên một phiên dài liên tục đọc lại cùng một cơ sở mã đang lớn dần gần như không tốn gì cho lưu lượng đó. Mười triệu token đầu vào được cache tốn 2 đô la. Phía đầu ra là nơi tích tụ một tiếng rưỡi mô hình viết mã, suy nghĩ và viết lại: ở mức 20 đô la mỗi triệu token, một triệu token đầu ra là 20 đô la, và token suy nghĩ được tính phí như token đầu ra. Con số của Sael phù hợp với một lượt chạy tạo ra vào khoảng một triệu token đầu ra so với một phía đầu vào lớn, rẻ, được cache — đúng chính xác là hình dạng của một bản dựng 86 phút không người giám sát.
Có hai điều tiếp theo. Thứ nhất, việc cắt giảm giá niêm yết gây chú ý trong ngày ra mắt, từ $5/$25 xuống $4/$20, là mức thay đổi 20% trên mỗi token và tự nó sẽ không làm cho lần chạy này trở nên rẻ; việc cắt giảm giá đọc bộ nhớ đệm từ $0.50 xuống $0.20 mới là dòng mục khiến một vòng lặp 90 phút trở nên có thể chi trả được. Thứ hai, và ít dễ chịu hơn: không có gì trong báo cáo $25.66 cho bạn biết liệu lần chạy đó có diễn ra tốt đẹp hay không. Một lần chạy một phát được thực hiện tốt và một phiên vật lộn suốt một tiếng rưỡi rồi mới thành công đều tạo ra cùng một hóa đơn.
Con số $13.30 không trụ nổi trước chính phép tính của nó
Phần giữa của khoảng này lại đáng chú ý vì một lý do khác. Một bản tổng hợp các demo ra mắt công bố ngày 23 tháng 9 báo cáo một cuộc đối đầu trực tiếp, trong đó Claude Opus 5.5 được yêu cầu dựng theo quy trình một hoạt cảnh Blender dài mười giây chỉ từ một câu lệnh — lâu đài, phản chiếu trên mặt hồ, pháo hoa — đối đầu với GPT-6 Astra, không chỉnh sửa thủ công, và báo cáo 35 phút cùng 199.600 token đầu ra với chi phí khoảng 13,30 đô la, so với 28 phút và khoảng 14,50 đô la cho GPT-6 Astra. Số lượng token mới là phần thú vị, bởi nó không khớp với mức giá.
199.600 token đầu ra ở mức 20 đô la một triệu của Claude Opus 5.5 là 3,99 đô la, không phải 13,30 đô la. Để đạt 13,30 đô la chỉ riêng phần đầu ra, bạn sẽ cần 665.000 token. Số tiền còn thiếu nằm ở các cột khác: đầu vào ở mức 4 đô la một triệu, ghi bộ nhớ đệm ở mức 5 đô la một triệu cho điểm ngắt năm phút và 8 đô la một triệu cho một giờ, cùng mọi lần thử lại. Đó không phải là mâu thuẫn trong báo cáo — mà là báo cáo đang trung thực về một số lượng token đếm một thứ và một hóa đơn đếm bốn thứ, vốn là sự nhầm lẫn phổ biến nhất trong các cuộc bàn luận về chi phí tuần ra mắt. Nếu bạn chỉ lấy một con số từ một bản demo đã công bố, hãy lấy con số đô la, và coi bất kỳ số lượng token nào bên cạnh nó là mô tả một phần về lần chạy đó.
Ở mức rẻ nhất, việc hạch toán chi phí còn mỏng hơn nữa. Thread r/ClaudeAI báo cáo $3.21 chi phí sử dụng API cho một bản dựng hoàn chỉnh là điển hình cho thể loại này: một tiêu đề, một video, và không có phân tích chi tiết. Có khả năng đó là một phiên ngắn hơn, một sản phẩm nhỏ hơn, hoặc rất nhiều input được cache. Đó không phải là thứ để lập ngân sách dựa vào, và tôi không thể xác minh nổi một đô-la nào trong đó.
Vì sao mỗi một trong những con số này đều là một cận dưới
Cơ chế thất bại ở đây không phải là những người xây dựng che giấu. Mà là sự chọn lọc. Những bản demo được lan truyền là những bản đã hoạt động, được công bố bởi những người mà chúng đã phục vụ, và bốn lần thử tạo ra một trang hỏng tốn chi phí ngang với lần không hỏng. Bài tổng hợp đã biên soạn so sánh Blender nói thẳng điều này — rằng không ai đăng những thất bại — và mục chi tiết nhất của chính nó là một ví dụ điển hình: một trang web thương hiệu đồng hồ đã làm sai đề bài và dùng một phông chữ khó đọc trong lần thử đầu tiên và cần đến lần thứ hai để trở thành phiên bản được trình bày.
"One shot" cũng đang âm thầm làm việc trong hệ từ vựng đó. Nó mô tả một phiên duy nhất, chứ không phải một lần thử duy nhất, và một phiên được phép chứa bao nhiêu phần tự sửa lỗi tùy theo mô hình có thể tạo ra — mà với một lần chạy 86 phút, thì đó là rất nhiều. Việc mô hình viết lại mã của chính nó hai lần trong cùng một cửa sổ ngữ cảnh là một shot và hai lần thử.
Vậy cách diễn giải trung thực về bốn ngày đầu tiên là ba tầng bằng chứng, và chúng không nên được lấy trung bình:
• Chi phí tự khai báo kèm độ dài phiên — dùng được để ước lượng theo bậc độ lớn, không thể xác minh. Con số $25.66 của Sael trong 1h26m là mục mạnh nhất trong nhóm này.
• Chi phí tự khai báo kèm số lượng token — thường không nhất quán nội bộ, như con số $13.30 cho thấy.
• Một con số đô la không có gì đằng sau — một tín hiệu rằng ai đó đã xây dựng được thứ gì đó, và không hơn thế.
Phần của đợt ra mắt được niêm yết trên bảng giá
Bỏ qua những tuyên bố mang tính trình diễn, bức tranh có thể xác minh được thì hẹp và rõ ràng. Tất cả số liệu dưới đây là mức phí đã công bố của Anthropic, được lấy từ tài liệu mô hình và thông báo của chính công ty vào ngày 25 tháng 9 năm 2026:
• Đầu vào — 4 USD mỗi triệu token. Đầu ra — 20 USD mỗi triệu, với token suy nghĩ được tính như đầu ra, và chế độ suy nghĩ thích ứng của Claude Opus 5.5 luôn bật và không thể tắt.
• Đọc bộ nhớ đệm — 0,20 USD mỗi triệu, hệ số nhân 0,05x. Ghi bộ nhớ đệm — 5 USD mỗi triệu ở mốc năm phút, 8 USD mỗi triệu ở một giờ. Batch API — giảm 50% cả hai chiều, còn 2 USD và 10 USD.
• Chế độ nhanh — 8 USD đầu vào và 40 USD đầu ra mỗi triệu, tốc độ nhanh gấp tới 2,5 lần, và Anthropic vẫn gắn nhãn đây là bản xem trước nghiên cứu.
• Phạm vi — ngữ cảnh 1M token, 128K token đầu ra ở chế độ đồng bộ và 300K trên Batch API với header beta, mốc kiến thức đáng tin cậy là tháng 6 năm 2026, mức nỗ lực mặc định là medium thay vì mức high mà Claude Opus 5 mặc định dùng.
• Khả dụng — Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry, và Claude Platform trên AWS, với cam kết ngừng hỗ trợ không sớm hơn ngày 22 tháng 9 năm 2027.
Các tuyên bố về hiệu năng của chính nhà cung cấp, được dán nhãn là tuyên bố: Claude Opus 5.5 hoạt động ở mức ngang với Claude Fable 5.1 trong hầu hết công việc, tốn chi phí vận hành ít hơn khoảng 40% so với Claude Opus 5, và tạo ra đầu ra nhanh hơn trên 30%. Con số 40% là mức trung bình trên khối lượng công việc do nhà cung cấp lựa chọn, không phải một con số trên bảng giá, và không nên trích dẫn hai thứ đó như thể chúng là cùng một loại dữ kiện.
Cuộc kiểm tra độc lập nhỏ hơn bảng của nhà cung cấp và chỉ về cùng một hướng với biên độ ít hơn. Artificial Analysis chấm Claude Opus 5.5 57,6 điểm trên Chỉ số Thông minh của mình, cùng với 61,4 trên Humanity's Last Exam, 66,9 trên SciCode và 84,7 về khả năng ghi nhớ ngữ cảnh dài trong các số liệu mà trang mô hình của nó đưa ra. Trên phép đo coding-agent của cùng ấn phẩm đó, vốn báo cáo chi phí mỗi tác vụ thay vì chi phí mỗi token, con số lại đi theo hướng ngược lại: ở mức nỗ lực tối đa, chi phí mỗi tác vụ tăng lên khoảng 13,04 đô la, so với 10,79 đô la cho Claude Opus 5 trong cùng một harness. Một token rẻ hơn mà mô hình tiêu thụ nhiều hơn không đồng nghĩa với một tác vụ rẻ hơn. Đó chính là bài học mà các hóa đơn demo đang dạy, đến từ một bên thứ ba.
Làm gì khác trong tuần thứ hai
Nếu con số $25.66 là thứ khiến bạn muốn thử điều này, thì bước hữu ích không phải là lập ngân sách $25.66 — mà là làm cho lần chạy của riêng bạn tạo ra một con số mà bạn có thể giải thích.
Hãy đặt effort một cách rõ ràng thay vì chấp nhận giá trị mặc định, vì đây là núm điều chỉnh ảnh hưởng đến lượng token cho mỗi tác vụ nhiều hơn cả việc chọn model, và giá trị mặc định trên model này đã thay đổi so với Claude Opus 5. Hãy chủ động cache tiền tố ổn định: prompt tối thiểu có thể cache trên Claude Opus 5.5 là 512 token, giảm từ 1.024, nên những tiền tố chia sẻ ngắn trước đây không bao giờ được cache thì nay đã được cache. Hãy chừa dư địa trong max_tokens cho mọi tác vụ chạy dài, vì thinking là một phần của ngân sách đó và không còn có thể tắt được — hướng dẫn migration của chính Anthropic đề xuất bắt đầu ở 64K cho công việc ở các mức effort cao nhất rồi tinh chỉnh từ đó. Và hãy gắn instrumentation cho lượt chạy ở phần cuối, không phải ở đầu: đọc trường model ở cấp cao nhất trên mọi response, vì với những prompt mà bộ phân loại của họ gắn cờ, Anthropic định tuyến lại yêu cầu bên trong cùng một lệnh gọi, và chuỗi model bạn gửi đi không mô tả thứ đã trả lời.
Điểm cuối cùng đó chính là chỗ một router thôi không còn chỉ là chuyện tiện lợi. Một bản build chạy không giám sát suốt một tiếng rưỡi xuyên qua một ranh giới bảo vệ có thể quay về với việc đã âm thầm hoàn tất vài lượt trên một mô hình nhỏ hơn, và cách duy nhất để phát hiện là nhìn vào. Claude Opus 5.5 có mặt trên OrcaRouter đúng theo giá niêm yết của chính Anthropic với mức markup 0% — mức giá của nhà cung cấp được chuyển thẳng qua, nên khi nhà cung cấp đổi giá thì ở đây cập nhật ngay trong cùng ngày công bố — và đó lại là điều kém thú vị nhất mà routing làm ở đây. Điều thú vị là một API cho hơn 200 mô hình đặt toàn bộ thử nghiệm lên một khóa duy nhất, nên "chạy nó trên mô hình tiên phong, và fallback thay vì thất bại" chỉ là một dòng cấu hình thay vì một hợp đồng thứ hai cùng một cuộc viết lại. Tự động chuyển đổi dự phòng là thứ khiến một mô hình xa lạ trở nên an toàn để đưa lên một đường đi mà bạn quan tâm, và một lời từ chối mà bạn có thể đi vòng qua là một lời từ chối không kết thúc lượt chạy của bạn ở phút thứ 70.
Con số sẽ di chuyển tiếp theo
Anthropic đã nói rằng Claude Sonnet 5.5 và Claude Haiku 5.5 sẽ ra mắt "trong vài tuần tới", và điều đó sẽ định giá lại từng bản demo này mà không thay đổi hình dạng của chúng: mức giá trên mỗi token rẻ hơn so với một số lượng token mà không ai có thể dự đoán trước. Sự bất định tương tự đã khiến các con số của tuần đầu tiên trở nên vô dụng sẽ vẫn áp dụng cho thế hệ tiếp theo, và đó chính là lý do để xây dựng thói quen ngay bây giờ thay vì sau khi đợt giảm giá lại ập đến.
Hiện tại, bản tóm tắt trung thực thì ngắn gọn. Claude Opus 5.5 là thật, đã được cung cấp rộng rãi, và có giá 4 đô la và 20 đô la, với mức đọc từ bộ nhớ đệm rẻ nhất mà dòng sản phẩm này từng có. Những bản demo nó tạo ra trong bốn ngày đầu tiên thật đáng kinh ngạc, và mức giá của chúng chỉ mang tính giai thoại. Nếu bạn muốn biết chi phí cho khối lượng công việc của riêng mình, công cụ duy nhất đo được nó là chính lượt chạy của bạn, có giới hạn mức chi, rồi đọc hóa đơn sau đó.



So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
