
Claude Haiku 5.5 vs GPT-5.6 Luna: Một nửa giá niêm yết, nhiều hơn 19% cho mỗi tác vụ hoàn thành
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
Mức giá ngang bằng mà mọi người đã viết về là có thật, và nó không nằm ở mô hình này. Claude Haiku 5.5, mà nhà cung cấp ra mắt vào ngày 7 tháng 10 năm 2026, niêm yết ở mức 0,10 đô la cho mỗi triệu token đầu vào và 0,50 đô la cho mỗi triệu token đầu ra cho các prompt tối đa 100.000 token. GPT-5.6 Luna, tầng tối ưu chi phí từ ngày 9 tháng 7 năm 2026, niêm yết ở mức 0,20 đô la và 1,20 đô la. Vậy nhà cung cấp đúng bằng một nửa mức giá của mô hình cũ hơn trên cả hai thước đo — và đúng bằng GPT-6 Luna, mô hình kế nhiệm đã thay thế nó vào ngày 22 tháng 9 năm 2026 và là mô hình mà chính bài đăng ra mắt của nhà cung cấp lấy làm chuẩn so sánh.
Đó là một nơi kỳ lạ để viết một bài so sánh, nên cần chính xác về mục đích của cuộc so tài này. GPT-5.6 Luna là mẫu duy nhất trong hai mẫu đã bị ngừng hỗ trợ trên bảng xếp hạng độc lập, nó không còn là Luna trong bảng giá chủ lực của OpenAI, và nó vẫn là Luna mà bạn sẽ thấy trong rất nhiều mã tích hợp ngày nay. So sánh nó với Claude Haiku 5.5 là một câu hỏi về một cuộc di trú mà có thể bạn đã đến lúc phải thực hiện, chứ không phải câu hỏi về việc nên gọi mô hình nào trong hai mô hình hiện hành.
Và câu trả lời cho câu hỏi hiển nhiên chính là phần thú vị. Trong cùng một lượt đánh giá độc lập, một tác vụ Intelligence Index đã hoàn thành tốn $0.21 trên Claude Haiku 5.5 và $0.18 trên GPT-5.6 Luna. Một nửa giá token, nhưng nhiều hơn 19% cho mỗi câu trả lời.
Hai bảng giá
Tính trên mỗi triệu token bằng đô la Mỹ. Mức giá của Anthropic và OpenAI lấy từ tài liệu của chính họ; điểm số dùng chung là Artificial Analysis Intelligence Index v4.3.2, đọc vào ngày 2026-10-08.

• Đầu vào — Claude Haiku 5.5 $0,10 cho tối đa 100.000 token và $0,50 cho phần vượt trên; GPT-5.6 Luna $0,20, tăng gấp đôi lên $0,40 đối với các yêu cầu trên 272.000 token.
• Đầu ra — Claude Haiku 5.5 $0,50 cho tới 100.000 token và $2,50 trở lên; GPT-5.6 Luna $1,20, tăng lên $1,80 trên tuyến ngữ cảnh dài.
• Đầu vào được lưu trong bộ nhớ đệm — Claude Haiku 5.5 $0,01 và $0,05, giảm 90%; GPT-5.6 Luna $0,02, cũng giảm 90%, cộng thêm phí ghi bộ nhớ đệm $0,25.
• Ngữ cảnh — 1 triệu token cho Claude Haiku 5.5 và 1.050.000 cho GPT-5.6 Luna. Cả hai đều giới hạn một phản hồi ở mức 128.000 token, và OpenAI công bố mốc kiến thức ngày 16 tháng 2 năm 2026 cho mô hình của mình.
• Kiểm soát suy luận — Claude Haiku 5.5 cung cấp một thang mức độ nỗ lực từ Low đến Max, với medium là mặc định; GPT-5.6 Luna cung cấp sáu cài đặt: none / low / medium (mặc định) / high / xhigh / max.
• Điểm số độc lập — 43,40 cho Claude Haiku 5.5 (Max) so với 37,32 cho GPT-5.6 Luna (Max), mức chênh lệch 6,07 điểm trên bảng xếp hạng gồm 182 mô hình.
• Trạng thái — Claude Haiku 5.5 là phiên bản hiện hành, độc quyền, chỉ dùng qua API. GPT-5.6 Luna mang cờ đánh dấu ngừng hỗ trợ trên bảng độc lập và không còn giữ một dòng trong bảng giá chủ lực của OpenAI.

Giá bằng một nửa, nhưng đắt hơn trên mỗi câu trả lời.
Phép tính bảng giá ở đây đặc biệt có lợi cho Anthropic — gấp đôi gọn gàng trên cả hai đồng hồ đo trong chế độ prompt ngắn — nên kết quả trên từng tác vụ chính là thứ cần được giải thích.
Claude Haiku 5.5 phát ra 162.164 token đầu ra cho mỗi tác vụ Intelligence Index, chia thành 129.047 token suy luận và 33.118 token trả lời. GPT-5.6 Luna phát ra 41.235 token, chia thành 28.098 token suy luận và 13.136 token trả lời. Mô hình của Anthropic tiêu tốn gấp 3,9 lần lượng token đó cho cùng một công việc, và với tốc độ đầu ra chỉ bằng một nửa, điều đó khiến nó đắt hơn 19% cho mỗi tác vụ hoàn thành. Lợi thế về tốc độ và bất lợi về tính dài dòng chỉ chênh nhau trong khoảng gấp đôi, nên chúng gần như triệt tiêu lẫn nhau — và phần chênh lệch còn lại nghiêng về phía OpenAI.
Hai mức chi phí trên mỗi tác vụ khá gần nhau, nhưng cách cấu thành của mỗi loại thì không. Mức $0,1783 mỗi tác vụ của GPT-5.6 Luna gồm khoảng một nửa là ghi cache và một phần tư là output; mức $0,2128 của Claude Haiku 5.5 là $0,1317 đầu vào — chủ yếu là đọc từ cache — cộng với $0,0811 đầu ra. Xét về giá trị tuyệt đối, cả hai mô hình đều không đắt, và chúng đắt ở những chỗ khác nhau, chính điều đó khiến tổng chi phí trên mỗi tác vụ hội tụ lại trong khi bảng giá lại chênh nhau gấp đôi.
Đây chính là hiệu ứng tương tự khiến cho việc so sánh theo từng token giữa các mô hình suy luận nói chung trở nên không đáng tin cậy, và điều này đáng được gọi tên một cách thẳng thắn: một đơn giá rẻ nhân với một ngân sách token lớn, và tích số chính là thứ bạn phải trả. Ghi chú ra mắt của chính Anthropic cũng thẳng thắn về điều này, khi nói rằng Claude Haiku 5.5 "đặc biệt đáng giá khi được dùng cho các tác vụ có prompt lên tới 100.000 token, vốn chiếm khoảng 90% yêu cầu gửi đến mô hình Haiku trước đây của chúng tôi."
Phép toán pha trộn kể cùng một câu chuyện từ hướng ngược lại. Với hỗn hợp 7:2:1 thiên về đầu vào của Artificial Analysis — dạng mà hầu hết lưu lượng sản xuất thực tế có — Claude Haiku 5.5 có giá $0,077 mỗi triệu token so với $0,174 của GPT-5.6 Luna. Đó chính là mức 2,26 lần mà bạn sẽ kỳ vọng từ giá niêm yết. Chỉ khi bạn đánh trọng số cho chỉ số đầu ra theo cách một khối lượng công việc suy luận làm, thì hai mô hình mới hội tụ, và khi vượt qua 100.000 token thì chúng cắt nhau.
Vách đá 100.000 token so với cái 272.000 token
Cả hai nhà cung cấp đều định giá lại các yêu cầu dài, và các ngưỡng cách nhau hơn hai lần rưỡi.
Ngưỡng của Anthropic là 100.000 token đầu vào. Vượt qua ngưỡng đó, mức tính của Claude Haiku 5.5 trở thành 0,50 USD cho đầu vào và 2,50 USD cho đầu ra — gấp năm lần mức giá cho lời nhắc ngắn, áp dụng cho toàn bộ yêu cầu. Ngưỡng của OpenAI là 272.000 token đầu vào. Vượt qua ngưỡng đó, mức tính của GPT-5.6 Luna trở thành 0,40 USD cho đầu vào và 1,80 USD cho đầu ra — gấp 2 lần đầu vào và 1,5 lần đầu ra, cũng áp dụng cho toàn bộ yêu cầu.
Vậy nên điểm giao nhau không phải là một sự hội tụ chậm; mà là một bước nhảy. Một prompt truy xuất 120.000 token nằm ở mức giá dài của Anthropic và nằm gọn trong mức giá ngắn của OpenAI, điều này biến lợi thế 2x của Anthropic thành lợi thế 1,25x của OpenAI ở đầu vào và lợi thế 1,39x ở đầu ra. Và ngưỡng của Anthropic đủ thấp để một pipeline nhiều tài liệu thường xuyên vượt qua nó, trong khi ngưỡng của OpenAI đủ cao đến mức hầu hết những pipeline như vậy không bao giờ chạm tới.
Dưới 100.000 token, không có gì về điều này thay đổi thứ tự. Trên 272.000, thứ tự đảo ngược và vẫn giữ nguyên đảo ngược.
Điều gì đã thay thế mô hình mà bạn đang so sánh với?
Đây là phần cần quyết định xem rốt cuộc bạn dành bao nhiêu thời gian cho việc so sánh.
OpenAI đã phát hành GPT-6 Luna vào ngày 22 tháng 9 năm 2026 — mười lăm ngày trước khi Anthropic phát hành Claude Haiku 5.5 — với mức 0,10 USD đầu vào và 0,50 USD đầu ra, ngữ cảnh 1 triệu token, giới hạn phản hồi 128.000 token và cùng thang điều khiển nỗ lực suy luận sáu bước. Đó là bảng giá giống hệt Claude Haiku 5.5, trên cả hai chỉ số, ở dạng prompt ngắn.
Trên bảng đánh giá độc lập, hai mô hình đủ sát nhau đến mức thứ hạng tổng hợp không thể phân định: Claude Haiku 5.5 đạt 43,40 so với 38,12 của GPT-6 Luna — vẫn là mức dẫn trước 5,28 điểm của Anthropic — nhưng chi phí cho mỗi tác vụ hoàn thành là 0,21 USD so với 0,068 USD. Đó là một lợi thế gấp ba của OpenAI trên con số thực sự được tính tiền, và nó tồn tại vì cùng lý do dài dòng như trên: GPT-6 Luna phát ra 50.012 token đầu ra mỗi tác vụ Index, so với 162.164 của Claude Haiku 5.5.
Bài đăng ra mắt của Anthropic tự thực hiện so sánh này, trong một bảng đặt Haiku 5.5 đối đầu với "GPT-6 Luna" trên GDPval-AA v2.1 (1620 so với 1437), AA-Briefcase v1.1 (1578 so với 1336), tập con ngoại tuyến của OSWorld 2.1 (72,4% so với 48,9%) và Terminal-Bench 4.0 (39,2% so với 16,4%). Đó là những con số của chính Anthropic và chúng do nhà cung cấp báo cáo, nhưng lựa chọn đối thủ mới là dấu hiệu tiết lộ: mô hình mà Anthropic chọn để đánh bại chính là phiên bản kế tiếp của mô hình xuất hiện trong tiêu đề bài viết này.
Nơi Luna cũ vẫn chiếm ưu thế
Ba điều, và không điều nào trong số đó là năng lực.
Video và âm thanh. Cả hai mô hình đều không phải dạng native video — Claude Haiku 5.5 đọc văn bản và hình ảnh, còn GPT-5.6 Luna đọc văn bản và hình ảnh — nên hạng mục này hòa nhau và cả hai đều thua kém bất kỳ thứ gì có pipeline xử lý phương tiện.
Ghi cache. OpenAI công bố mức giá ghi cache là 0,25 USD mỗi triệu cho GPT-5.6 Luna, còn Anthropic không công bố mức nào cho Claude Haiku 5.5, nghĩa là cách nói trung thực là chi phí ghi nằm trong mức tính giá đầu vào 0,10 USD của Anthropic chứ không phải là không tồn tại. Một tác vụ nặng về tiền tố với cache ngắn hạn sẽ phải trả khoản chênh lệch đó ở mỗi lượt.
Và bản thân hướng đi ngữ cảnh dài, nơi ngưỡng cao hơn của OpenAI là một lợi thế mang tính cấu trúc thực sự, chẳng liên quan gì đến việc mô hình nào thông minh hơn.

Cả hai đều có thể gọi được, một trong số đó không phải của chúng tôi.
GPT-5.6 Luna đã có mặt trong danh mục OrcaRouter hôm nay tại openai/gpt-5.6-luna — $0.20 đầu vào, $1.20 đầu ra, phí ghi bộ nhớ đệm $0.25, ngữ cảnh 1.050.000 token và giới hạn phản hồi 128.000 token, với bậc ngữ cảnh dài 272.000 token được ghi thành một bước riêng trong bản ghi giá thay vì bị lấy trung bình mà mất đi. Được chuyển nguyên theo giá niêm yết của OpenAI với mức đánh thêm 0%, và chuyển đổi dự phòng tự động ở bên dưới, điều này có giá trị cụ thể đối với một mô hình bị thay thế có chủ đích: nếu năng lực của chính OpenAI dành cho nó bị thắt chặt, tuyến sẽ chuyển trước khi ngân sách lỗi của bạn kịp bị ảnh hưởng.
Claude Haiku 5.5 không có trong danh mục. Nó có thể truy cập được qua API của Anthropic và qua AWS, Google Cloud và Microsoft Azure, và đó là cách diễn đạt chính xác. Điều mà danh mục thực sự có từ Anthropic là Claude Sonnet 5.5 và Claude Opus 5.5, vì vậy con đường nâng cấp từ một tầng phân loại rẻ tiền lên một tầng tác tử trung cấp là một cài đặt định tuyến chứ không phải một tích hợp — và chính danh mục đó có GPT-6 Luna với đúng bảng giá mà Claude Haiku 5.5 sử dụng, khiến cho phép so sánh A/B trung thực cho mức giá này chỉ là thay đổi hai chuỗi ký tự chứ không phải một thủ tục mua sắm.
Làm gì với so sánh này
Nếu tích hợp của bạn ghi tên gpt-5.6-luna, thì kết luận hữu ích không phải là Claude Haiku 5.5 vượt qua nó sáu điểm chỉ số. Mà là bạn đang dùng một mô hình mà nhà cung cấp của bạn đã hai lần thay thế trong phân khúc flash của chính họ — lần đầu bởi thế hệ Terra, rồi bởi GPT-6 Luna, mô hình mà chính Anthropic coi là đối thủ hiện tại ở mức giá này. Chuyển sang GPT-6 Luna là một sự tương xứng về bảng giá và giảm ba lần chi phí cho mỗi tác vụ hoàn thành trên cùng một phép đo độc lập.
Nếu bạn đang chọn giữa Claude Haiku 5.5 và dòng Luna về năng lực, Anthropic thắng ở chỉ số tổng hợp, ở các dòng terminal và code, và ở khả năng sử dụng máy tính, và chính bảng của nhà cung cấp nói như vậy. Nếu bạn đang chọn dựa trên hóa đơn, dòng Luna đã thắng mọi phiên bản của so sánh này với cách biệt lớn, và lý do là một con số duy nhất: 162.164 token đầu ra mỗi tác vụ so với 41.235.
Điều mà cuộc đối đầu này thực sự định đoạt là một thước đo rẻ hơn hai lần lại không đáng giá bằng một mô hình tinh gọn hơn bốn lần. Anthropic đã định giá Claude Haiku 5.5 ngang bằng GPT-6 Luna và nó đã làm được — chính xác, trên cả hai thước đo — vậy mà vẫn tốn gấp ba lần để có được câu trả lời từ nó.
