
Claude Haiku 5.5 trong OpenCode Go: 10 đô một tháng thực sự mua được gì
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
Anthropic đã phát hành Claude Haiku 5.5 vào ngày 7 tháng 10 năm 2026, và chỉ trong vòng một ngày, nó đã được đưa vào danh mục Go và Zen của OpenCode — những gói đăng ký dành cho agent lập trình tính theo hạn mức đô-la hàng tháng thay vì tính tiền theo token. Danh mục thứ hai đó chính là phần đáng để chậm lại mà xem xét, bởi vì hạn mức mà OpenCode công bố cho Claude Haiku 5.5 không phải là một khoản giảm giá cho mô hình. Đó là một chiếc đồng hồ đo ngân sách được đặt theo đúng giá niêm yết của Anthropic, và mọi con số đằng sau nó đều có thể kiểm chứng dựa trên hai trang công bố nó. Nếu bạn vẫn đang cân nhắc nên gọi thứ gì thay cho Claude Haiku 4.5, thì hạn mức mới là yếu tố quyết định, chứ không phải giá niêm yết.
The signal itself is one line: OpenCode posted "Claude 5.5 Haiku now available in OpenCode and Go" to X at 19:37 UTC on October 7, hours after the model went live. That is a platform wiring up somebody else's launch, not a launch of its own — which is exactly why it is checkable. OpenCode's marketing page carries a "Claude Haiku 5.5 — New" row at 3,850 estimated requests per five hours on the $10 Go plan and 15,380 on the $40 Go Plus plan. Its documentation lists the model id claude-haiku-5-5 against the endpoint https://opencode.ai/zen/go/v1/messages, and the same string appears in the Zen catalogue at https://opencode.ai/zen/v1/messages. Two independent surfaces, same model id, same day.
Những gì Anthropic đã công bố chính thức vào ngày 7 tháng 10
Nhà cung cấp đã không âm thầm tung ra sản phẩm này. Newsroom của Anthropic có một thông báo ghi ngày, một trang sản phẩm với bảng benchmark, một system card, một bảng giá và sáu trích dẫn từ khách hàng được nêu tên. Không có repository nào và không có bản phát hành trọng số nào để kiểm tra, bởi vì không có gì để phát hành: Artificial Analysis ghi nhận Claude Haiku 5.5 là độc quyền, với số lượng tham số không được tiết lộ. Bất kỳ ai mô tả đây là một mô hình bị rò rỉ hoặc chưa được công bố đều đang đọc một repo không tồn tại.
Cách định vị của chính Anthropic là một mô hình phổ thông thay vì một mô hình tiên phong:
• Định vị — "mô hình nhỏ rẻ nhất, nhanh nhất và mạnh nhất mà chúng tôi từng phát hành," hướng đến tóm tắt, nén, truy vấn cơ sở dữ liệu và phân loại, đồng thời được giới thiệu như một subagent đi cùng với Claude Opus 5.5 và Claude Sonnet 5.5 trong công việc lập trình.
• Giá — $0,10 mỗi triệu token đầu vào và $0,50 mỗi triệu token đầu ra cho các prompt tối đa 100.000 token; $0,50 và $2,50 nếu vượt mức đó. Đọc cache $0,01 / $0,05, ghi cache $0,125 / $0,625.
• Ngữ cảnh và đầu ra — cửa sổ 1M token với đầu ra tối đa 128.000 token, cùng giới hạn tổng thể mà các mô hình lớn hơn thuộc tầng 5.5 mang lại, được tái tạo trên tầng rẻ nhất.
• Effort — mô hình đầu tiên thuộc lớp Haiku với thiết lập effort có thể điều chỉnh, chạy từ Low đến Max, mặc định là medium. Anthropic công bố các đường cong độ chính xác so với chi phí ở từng thiết lập thay vì một con số duy nhất.
• Các chỉ số đánh giá, do nhà cung cấp báo cáo và chưa được tái lập độc lập — GDPval-AA v2.1 1620 so với 735 của Claude Haiku 4.5; AA-Briefcase v1.1 1578 so với 614; OSWorld 2.1 72,4% so với 15,7%; Humanity's Last Exam 45,9% khi không dùng công cụ và 57,4% khi dùng công cụ, so với 10,2% và 18,7%; Terminal-Bench 4.0 39,2% so với 0,0%; Chartography 46,4% so với 6,4%.
• Mức trần của chính nhà cung cấp — bình luận của Anthropic về biểu đồ Terminal-Bench của mình cho biết Claude Sonnet 5.5 và Claude Opus 5.5 “vẫn là lựa chọn tốt hơn cho các tác vụ lập trình tác nhân phức tạp”. Các trích dẫn khách hàng trong cùng bài đăng là từ những đối tác truy cập sớm đang mô tả các đánh giá của chính họ, không phải các cuộc kiểm toán: Asana báo cáo độ trễ thấp hơn trên 30% và suy luận nhanh hơn tới 2,5 lần mỗi lượt tác nhân, HubSpot đạt 92,8% tính trung bình qua ba lần chạy, AlphaSense đạt 0,84 so với 0,76 trên 400 truy vấn trong khối lượng công việc khoảng 8 triệu cuộc gọi mỗi tuần, Box cao hơn 11 điểm với độ trễ chỉ bằng khoảng một nửa, và Cognition đạt điểm FrontierCode 66,2 với Haiku 5.5 làm trợ thủ.

Anthropic cũng đã nhân dịp ra mắt để điều chỉnh hai mức giá liền kề: lượt đọc bộ đệm trên Claude Sonnet 5.5 giảm một nửa xuống còn 0,10 USD mỗi triệu token, mà công ty cho biết khiến Sonnet 5.5 rẻ hơn khoảng 20% trong hầu hết công việc agentic, và một khoản tín dụng API hàng tháng mới cho người đăng ký Claude Max và Team. Cả hai đều là những thay đổi đối với gói bậc trên, và cả hai đều quan trọng hơn đối với một nhóm đã chuẩn hóa trên Sonnet so với bất kỳ ai đang tìm mua một mô hình nhỏ.
Khoản trợ cấp là ngân sách bằng đô-la, không phải là khoản giảm giá.
Đây là phần mà dòng tweet thông báo không nói đến. Tài liệu Go của OpenCode nêu rằng "mức sử dụng được định nghĩa là số tiền đô-la hằng tháng", rằng token là như nhau trên cả hai gói, và rằng hạn mức của mỗi mô hình giảm dần theo một lịch trình cố định: 20% hạn mức hằng tháng mỗi năm giờ, 50% mỗi tuần, 100% mỗi tháng. Tài liệu cũng công bố số token cho mỗi yêu cầu đối với mô hình này — 1.100 token đầu vào, 55.000 token được lưu trong bộ nhớ đệm, 240 token đầu ra.
Đem những con số đó đối chiếu với giá niêm yết của Anthropic và số lượng yêu cầu được công bố sẽ không còn trông giống như một sự phân bổ tùy tiện nữa:
• Chi phí cho mỗi yêu cầu theo giá niêm yết — 1,100 đầu vào ở mức $0.10/M cộng 55,000 lượt đọc từ bộ nhớ đệm ở mức $0.01/M cộng 240 đầu ra ở mức $0.50/M tổng cộng là $0.00078.
• Số lượng yêu cầu hàng tháng — $15 chia cho $0,00078 bằng 19.230, đây là con số mà tài liệu in ra. Hạn mức $60 của gói $40 chia ra cho kết quả là 76.923, và tài liệu in 76.920.
• Việc giảm dần — 20% của 19.230 là 3.846, in ra là 3.850 mỗi 5 giờ; 50% là 9.615, in ra là 9.620 mỗi tuần. Go Plus áp dụng cùng phép tính ở mức 15.380 và 38.460.
• Điều đó nghĩa là bao nhiêu đô — hạn mức này tương đương 15 USD token tính theo giá của Anthropic ở gói 10 USD và 60 USD ở gói 40 USD. Do đó, một gói đăng ký 10 USD chỉ mua được tối đa 15 USD token của mô hình này mỗi tháng nếu bạn dùng toàn bộ hạn mức cho Claude Haiku 5.5 và không dùng gì khác.
Đó là cách trung thực để hiểu huy hiệu “New” trên trang Go. Gói đăng ký rẻ, mô hình rẻ, và hai sự thật này độc lập với nhau: hạn mức là một ngân sách được đo theo mức giá riêng của nhà cung cấp, nên gói giới hạn số tiền bạn có thể chi chứ không phải mô hình rẻ đến mức nào. Người dùng nặng sẽ chạm trần và trả tiền trực tiếp cho Anthropic — hoặc tự định tuyến mô hình.

Chín mươi phần trăm, bảy mươi lăm phần trăm, và ngưỡng gấp năm lần
Thông điệp chính của Anthropic là Claude Haiku 5.5 có chi phí thấp hơn khoảng 90% so với Claude Haiku 4.5 đối với các prompt tối đa 100.000 token, và rằng tính trung bình, nó "hiện có chi phí chạy thấp hơn khoảng 75%." Cả hai con số đều do nhà cung cấp đưa ra. Chúng cũng đều đúng, và khoảng cách giữa chúng chính là toàn bộ rủi ro về giá.
• Trong khoảng này — 0,10 USD cho đầu vào và 0,50 USD cho đầu ra, so với mức cố định 1 USD và 5 USD của Haiku 4.5. Anthropic cho biết khoảng 90% yêu cầu gửi đến mô hình Haiku trước đó của mình nằm trong khoảng này, và con số 90% bắt nguồn từ đó.
• Vượt trên khung — cùng một yêu cầu được tính phí $0.50 cho đầu vào và $2.50 cho đầu ra, tức mức tăng gấp năm lần đối với đầu vào. Điều đó vẫn chỉ bằng một nửa mức giá của Haiku 4.5, nhưng còn xa mới đạt mức giảm 90%.
• Tuyên bố tổng hợp — con số 75% là ước tính của chính Anthropic trên một hỗn hợp lưu lượng thực tế, chứ không phải bảng giá, và đó là con số cần đưa vào bản dự báo.
• Tokenizer — tokenizer mới hơn được dùng chung với Claude 4.7 và các phiên bản sau tạo ra lượng token nhiều hơn khoảng 30% cho cùng một đoạn văn bản, theo tài liệu của chính Anthropic, nên việc cắt giảm trên mỗi token không có nghĩa là hóa đơn sẽ nhỏ hơn tương ứng theo tỷ lệ một-đối-một.
Núm điều chỉnh nỗ lực khuếch đại tất cả những điều đó. Vì mặc định là medium và các đường cong được công bố chạy tới Max, cùng một prompt có thể tốn vài lần nhiều hơn tùy thuộc vào một tham số mà hầu hết người gọi không bao giờ đặt — và ước tính yêu cầu của OpenCode giả định một cấu hình token cố định tại một thiết lập ngầm định. Nếu prompt của bạn ở gần 100.000 token, chạy một subagent sử dụng có giới hạn, hoặc bạn thay đổi núm điều chỉnh nỗ lực, thì con số tiêu đề 90% không phải là con số bạn sẽ thấy.
Hội đồng độc lập đồng thuận về điểm số và tự chỉ ra vấn đề trong phép tính của chính mình.
Artificial Analysis chấm điểm Claude Haiku 5.5 ở mức 43 trên Intelligence Index v4.3.2 của nó trong cấu hình Max của mô hình, so với trung vị của bảng xếp hạng là 13, và đo được 241,9 token đầu ra mỗi giây so với trung vị của các mô hình tương đương là 110,9. Cùng trang đó đưa chi phí ở mức 0,21 USD cho mỗi tác vụ Intelligence Index và báo cáo rằng mô hình đã tạo ra 440 triệu token đầu ra trong quá trình đánh giá so với trung vị 100 triệu — mô tả nó là "rất dài dòng".
Tính dài dòng là nơi hai bảng xếp hạng tương tác với nhau. Phép tính hạn mức ở trên được tính theo từng token, nên một mô hình suy luận dài dòng sẽ tiêu tốn ngân sách nhanh hơn mức mà số lượng yêu cầu gợi ý, và hồ sơ 55.000 token được lưu đệm cho mỗi yêu cầu của OpenCode là một giả định về lưu đệm prompt mà người dùng thuê bao có thể tái tạo hoặc không. Hai tiết lộ trên trang Artificial Analysis có giá trị hơn cả dòng tít của nó: con số 43 là cấu hình Max chứ không phải thiết lập nỗ lực mà bạn nhận được khi không làm gì, và trang có một ghi chú rõ ràng rằng Claude Haiku 5.5"có mức giá cao gấp 5 lần đối với các đầu vào có ngữ cảnh dài hơn, vốn hiện chưa được phản ánh" trong các số liệu chi phí của nó. Vách đá ngữ cảnh dài là có thật, và bảng xếp hạng độc lập đã nói với bạn rằng nó vẫn chưa nằm trong chính các con số của mình.

Dòng về việc giữ lại mà hầu hết người mua sẽ bỏ qua
Tài liệu Go của OpenCode có một bảng quyền riêng tư theo từng mô hình, và đây là hàng mà Claude Haiku 5.5 khác với phần lớn danh mục. Cách diễn đạt của chính nhà cung cấp là không lưu giữ, kèm ngoại lệ. Hầu hết các mô hình trên bảng Go đó đều ghi “0 ngày”. Mô hình này ghi “30 ngày”, kèm ghi chú rằng các yêu cầu được lưu giữ trong 30 ngày theo chính sách dữ liệu của Anthropic — cách đối xử tương tự mà nó dành cho GPT-6 Luna và GPT-5.6 Luna, và ngược lại với các hàng 0 ngày vốn chiếm phần lớn danh sách.
Đối với một coding agent, điều đó có nghĩa là các prompt, đường dẫn tệp và mã nguồn được dán có thể được lưu giữ bởi nhà cung cấp thượng nguồn trong một tháng, trên một gói mà ngôn ngữ tiếp thị là không lưu trữ. Đó không phải là lý do để tránh mô hình; đó là lý do để đọc hàng thay vì biểu ngữ. Trong khi đó, không có gì trong tài liệu ra mắt của Anthropic thay đổi quan điểm phía API: API Claude đã cung cấp khả năng không lưu trữ dữ liệu và các điều khoản lưu trữ của thẻ mô hình là những điều khoản chi phối một tích hợp trực tiếp.
Điều gì đã được xác nhận, và điều gì chưa được xác nhận?
Tập hợp đã được xác nhận thì lớn và cụ thể, điều đó thật bất thường đối với một mô hình mới như thế này. Những gì chưa được xác nhận thì hẹp hơn, và đáng để gọi tên thay vì lướt qua:
• Đã xác nhận — model này tồn tại, chỉ khả dụng qua API với id claude-haiku-5-5, ra mắt ngày 7 tháng 10 trên Claude API cùng Amazon Web Services, Google Cloud và Microsoft Azure, với mức giá nêu trên, cửa sổ 1 triệu token, effort có thể điều chỉnh, và một system card đã được công bố.
• Đã xác nhận — hai nền tảng bên thứ ba đã niêm yết nó với ID mô hình, endpoint và hạn mức tính theo lưu lượng sử dụng trong cùng ngày.
• Chưa được xác nhận — chúng tôi không tìm thấy bất kỳ benchmark độc lập nào đã tái lập được bảng của nhà cung cấp. Mọi con số độ chính xác trong bài đăng ra mắt của Anthropic đều đến từ hệ thống đánh giá của chính Anthropic, và mọi trích dẫn khách hàng đều là báo cáo tự thân về thử nghiệm ban đầu của đối tác.
• Chưa được xác nhận — không có trọng số, không có kho lưu trữ, không có checkpoint và không có giấy phép nào để kiểm tra. Mô hình này là đóng, và mọi tuyên bố về kiến trúc hoặc kích thước của nó đều chỉ là suy luận.
• Chưa được xác nhận — liệu các ước tính yêu cầu của nền tảng có còn đúng với bất kỳ hồ sơ token nào khác ngoài hồ sơ giả định của nó hay không, và liệu (hoặc khi nào) mức giá gấp 5 lần cho ngữ cảnh dài sẽ xuất hiện trong các số liệu chi phí của những bảng xếp hạng độc lập.
Chạy nó bên cạnh thứ mà bạn vẫn gọi là
Câu hỏi thực tiễn mà lần ra mắt này đặt ra không phải là "Haiku 5.5 có tốt không" — bảng của nhà cung cấp nói là tốt, và chưa ai ngoài Anthropic kiểm chứng. Mà là "hóa đơn sẽ là bao nhiêu, và điều gì xảy ra khi gói rẻ không phải là gói phù hợp cho lời gọi cụ thể này." Cả hai nửa đều là những bài toán định tuyến.
Về chi phí, thước đo là hóa đơn token, chứ không phải giá niêm yết: cắt giảm 90% đầu vào cộng với tokenizer lớn hơn 30% cộng với một mô hình suy luận dài dòng cộng với bước ngữ cảnh dài gấp năm lần nghĩa là con số bạn dự báo và con số bạn trả sẽ lệch nhau trừ khi bạn đo phân phối độ dài prompt của chính mình. Một mô hình đắt hơn gấp 5 lần khi trên 100.000 token sẽ khuyến khích việc nén — và Haiku 5.5 tự nó được quảng bá là mô hình nén, một vòng lặp đáng để ý.
Về rủi ro, một tầng chưa được kiểm chứng đúng là trường hợp để không đặt cược lộ trình sản xuất vào nó. Claude Haiku 4.5 đã có trên OrcaRouter với đúng giá niêm yết của Anthropic, chênh lệch 0%, nên tầng cũ không cần hợp đồng mới, và một tuyến tự động chuyển về từ model mới sang model đã biết chỉ là thay đổi cấu hình chứ không phải viết lại. Tham số effort là theo từng lần gọi, nghĩa là cùng một endpoint có thể chạy tóm tắt ở effort thấp và trích xuất khó ở effort cao mà không cần duy trì hai tích hợp — DSL định tuyến tồn tại chính xác cho dạng quyết định này, và tự động chuyển đổi dự phòng chính là thứ cho phép bạn đặt một model mới vài ngày tuổi trước lưu lượng thật trước khi bạn có số liệu độc lập về nó. Điều vẫn chưa đúng là điều hiển nhiên: Claude Haiku 5.5 hiện không có trên các tuyến của chúng tôi, và nếu bạn muốn có nó trong tuần này thì bạn đang gọi trực tiếp Anthropic hoặc đi qua nền tảng đã công bố nó.
Ai nên chuyển: những đội có khối lượng công việc là tóm tắt, phân loại, nén và công việc subagent, nơi khung 90% được áp dụng và 30% của tokenizer là phép toán bạn có thể hấp thụ. Ai nên chờ: bất kỳ ai có prompt thường xuyên vượt 100.000 token, bất kỳ ai cần một benchmark độc lập trước khi cam kết, và bất kỳ ai có mã không thể nằm trong cửa sổ lưu giữ 30 ngày. Đợt ra mắt là thật và mức giá là thật. Bằng chứng vẫn thuộc về nhà cung cấp.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
