Một thẻ hero được tạo tự động cho 'Mô hình nhỏ của Mỹ giờ đây là lựa chọn rẻ hơn', gắn nhãn 'MỨC GIÁ SÀN' với dòng kicker 'NGÀY 7 THÁNG 10 NĂM 2026' và phụ đề 'Claude Haiku 5.5 ở mức $0.10 và $0.50 so với DeepSeek V4 Flash - cho đến 100.000 token.' Bốn chip hiển thị '$0.10 so với $0.15 đầu vào', '$0.50 so với $0.60 đầu ra', 'bước 100K' và 'các khung giờ cao điểm'. Hai thẻ bên dưới được dán nhãn 'DƯỚI 100.000 TOKEN' ('Anthropic rẻ hơn ở cả hai chỉ số') và 'TRÊN NGƯỠNG ĐÓ' ('DeepSeek rẻ hơn gấp ba đến bốn lần'). Phần chân trang ghi 'Giá niêm yết do các nhà cung cấp công bố, đọc ngày 8 tháng 10 năm 2026.' Logo OrcaRouter được ghép vào góc dưới bên phải.
Guides & Insights

Claude Haiku 5.5 vs DeepSeek V4 Flash: Anthropic vừa phá vỡ mức giá sàn

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Trong suốt hai năm, phân khúc giá rẻ của thị trường có một hình dạng mà ai cũng biết: các phòng thí nghiệm Mỹ thu giá cao hơn còn các phòng thí nghiệm Trung Quốc thu giá thấp hơn, và bạn chọn phe của mình cho phù hợp. Claude Haiku 5.5đã phá vỡ điều đó vào ngày 7 tháng 10 năm 2026, khi ra mắt với mức 0,10 đô la cho mỗi triệu token đầu vào và 0,50 đô la cho mỗi triệu token đầu ra — thấp hơn mức giá công bố của DeepSeek V4 Flash, mô hình vốn là điểm tham chiếu cho giá rẻ kể từ mùa hè.

Đó là một chiến thắng hẹp hơn vẻ ngoài của nó, và những lý do đáng giá hơn cả tiêu đề. Mức giá của Ant​hropic chỉ áp dụng cho các prompt tối đa 100.000 token. Vượt qua ngưỡng đó, nó trở thành $0,50 và $2,50, tức cao gấp nhiều lần giá của Dee​pSeek. Và bảng giá của chính Dee​pSeek có một hình dạng không ai sao chép: nó tăng gấp đôi trong hai khung giờ vào các ngày trong tuần. Hai nhà cung cấp, hai quan niệm hoàn toàn khác nhau về ý nghĩa của từ "rẻ".

Những gì mỗi nhà cung cấp thực sự công bố

Trên mỗi triệu token, tính bằng đô la Mỹ. Số liệu của Anthropic được lấy từ tài liệu định giá của Anthropic; số liệu của DeepSeek được lấy từ trang Mô hình & Định giá của chính DeepSeek, đây là bảng giá chính thức cho mô hình.

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• Đầu vào — Claude Haiku 5.5 $0.10 cho tối đa 100.000 token, $0.50 nếu vượt mức đó. DeepSeek V4 Flash $0.15 ngoài giờ cao điểm, $0.30 trong các khung giờ cao điểm.

• Đầu ra — Claude Haiku 5.5 $0,50 cho tối đa 100.000 token, $2,50 khi vượt mức đó. DeepSeek V4 Flash $0,60 ngoài giờ cao điểm, $1,20 trong giờ cao điểm.

• Đầu vào được lưu trong bộ nhớ đệm — Claude Haiku 5.5 $0,01 cho tối đa 100.000 token và $0,05 cho phần vượt quá. DeepSeek V4 Flash $0,003 ngoài giờ cao điểm và $0,006 trong giờ cao điểm, rẻ hơn gấp hơn ba lần.

• Khung giờ cao điểm — Ant​hropic không có; mức giá thay đổi theo độ dài prompt và không gì khác. Dee​pSeek tăng gấp đôi mức giá từ 01:00 đến 04:00 và một lần nữa từ 06:00 đến 10:00 UTC, từ Thứ Hai đến Thứ Sáu, không bao gồm các ngày lễ công cộng của Trung Quốc.

Ngữ cảnh và đầu ra — 1M token và đầu ra tối đa 128.000 cho Claude Haiku 5.5; 1M và đầu ra tối đa 384.000 cho DeepSeek V4 Flash.

• Phương thức — Claude Haiku 5.5 nhận văn bản và hình ảnh; DeepSeek V4 Flash chỉ xử lý văn bản, và khả năng thị giác nằm ở mô hình anh em chứ không phải mô hình này.

• Điểm số độc lập — Artificial Analysis Intelligence Index v4.3.2 xếp Claude Haiku 5.5 (Max) ở mức 43.40, đứng thứ hai trong số 182 mô hình, và DeepSeek V4 Flash 0731 (Max) ở mức 34.33, đứng thứ mười trong số 117.

• Tốc độ — cùng nguồn đó đo được 241,9 token đầu ra mỗi giây đối với Claude Haiku 5.5 và 222,0 đối với DeepSeek V4 Flash, nhanh thứ hai trên bảng xếp hạng của chính nó.

Sự giao thoa là toàn bộ câu chuyện.

Xếp hai thẻ thẳng hàng trong cùng một yêu cầu thì phép so sánh sẽ đảo ngược hai lần.

Dưới 100.000 token, Ant​hropic rẻ hơn trên cả hai thước đo và trên con số giá quan trọng: $0.10 so với $0.15 cho đầu vào, $0.50 so với $0.60 cho đầu ra. Đây là lần đầu tiên một mô hình nhỏ của Ant​hropic xuống dưới mức giá Dee​pSeek Flash trong điều kiện so sánh tương đương, và đó là điểm mà bài đăng ra mắt mở đầu bằng.

Trên 100.000 token, nó đảo ngược mạnh. Giá đầu vào $0.50 của Anthropic cao hơn hơn ba lần mức giá ngoài giờ cao điểm của DeepSeek, và giá đầu ra $2.50 cao hơn hơn bốn lần mức đó. Một pipeline truy xuất hoặc xử lý tài liệu dài thường xuyên tổng hợp các prompt 150.000 token hoàn toàn không phải là khách hàng của Claude Haiku 5.5; mà là khách hàng của mô hình mà nó vốn đã sử dụng.

Và trong hai khung ngày thường của Dee​pSeek, phép so sánh thứ hai thu hẹp lại từ hướng ngược lại, vì mức giá của chính Dee​pSeek tăng gấp đôi trong khi mức giá của Ant​hropic không thay đổi. Không nhà cung cấp nào có cấu trúc tốt hơn về mặt lý thuyết. Một bên định giá theo lượng bạn gửi, bên kia định giá theo thời điểm bạn gửi, và chỉ một trong hai điều đó nằm trong tầm kiểm soát của bạn tại thời điểm gửi yêu cầu.

Chi phí của một nhiệm vụ đã hoàn thành, đó là con số công bằng duy nhất

Giá niêm yết tính theo từng token, và hai mô hình không phát ra cùng số lượng token cho cùng một khối lượng công việc. Đó chính là chỗ mà phép tính khi ra mắt trở nên khó xử đối với Anthropic.

Artificial Analysis xếp Claude Haiku 5.5 (Max) ở mức $0,21 cho mỗi tác vụ Intelligence Index và DeepSeek V4 Flash 0731 (Max) ở mức $0,22 mỗi tác vụ. Giá đầu vào chỉ bằng một phần mười, cửa sổ rộng hơn và khoảng cách Intelligence Index 26 điểm — 43,40 so với 34,33 — vậy mà chi phí đo được để hoàn thành một tác vụ lại nằm trong vòng một xu so với mô hình mà nó lẽ ra phải rẻ hơn.

Lý do nằm ngay trên cùng trang đó. Khi đánh giá chỉ số Index, Claude Haiku 5.5 tạo ra 440 triệu token đầu ra so với mức trung vị 100 triệu, và bên đánh giá gọi nó là cực kỳ dài dòng. DeepSeek V4 Flash tạo ra 240 triệu so với mức trung vị 140 triệu và cũng bị gọi là cực kỳ dài dòng. Cả hai mô hình đều suy nghĩ dài, cả hai đều tính phần suy nghĩ như token đầu ra, và đầu ra chính là đồng hồ đo quyết định hóa đơn. Việc cắt giảm 90% chi phí đầu vào là có thật, và khoản đó được tính trên nửa nhỏ hơn của hóa đơn.

Có một hiệu ứng thứ hai, âm thầm hơn. Tài liệu của chính Anthropic cho biết Claude Haiku 5.5 sử dụng tokenizer mới hơn, dùng chung với Claude 4.7 và các phiên bản sau, nên cùng một đoạn văn bản được tính thành khoảng 30% token nhiều hơn so với khi dùng trên Claude Haiku 4.5. Mức giá đã giảm 10 lần; số lượng token thì không giảm chút nào, và với cùng đoạn văn bản đó, nó còn tăng lên.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

Mô hình đằng sau cái tên Dee​pSeek cũng đã thay đổi

Bất kỳ ai định so sánh hai thứ này dựa trên một bảng benchmark đã cũ vài tháng thì nên biết điều này trước khi làm vậy.

Trang định giá của DeepSeek hiện liệt kê deepseek-flash là tên mô hình, được hỗ trợ bởi DeepSeek-V4.1-Flash, và nêu rằng id cũ deepseek-v4-flash vẫn được chấp nhận nhưng "các mô hình tương ứng đã bị khai tử" — các yêu cầu dưới tên cũ được phục vụ bởi mô hình mới hơn và được tính phí theo giá Flash. Nói cách khác, id vẫn giữ nguyên tên, mức giá và vị trí của nó trong danh mục, còn các trọng số bên dưới nó đã thay đổi.

Đó không phải là một lời chỉ trích; đó là một lời cảnh báo về việc một bảng điểm chuẩn được ghi ngày theo cái gì. Mục Artificial Analysis mà bài viết này trích dẫn là dành cho bản phát hành 0731 của DeepSeek V4 Flash ở cấu hình Max, tức mô hình mà bảng đã đo lường, và nó không tự động là một phát biểu về bất cứ thứ gì đáp lại id đó ngày hôm nay. Ngược lại, Claude Haiku 5.5 của Anthropic là một id cố định, không có hậu tố ngày và không có bí danh, và vị trí của nó trên Index được ghi ngày theo đúng tuần ra mắt của chính nó.

Hai mô hình, một endpoint

Lý do việc so sánh này dễ tự mình phân định hơn là dựa vào bảng thông số kỹ thuật là ở chỗ cả hai phía đều có thể được gọi từ cùng một nơi — với một ngoại lệ đáng để nêu ra.

DeepSeek V4 Flash đã có trên danh mục của OrcaRouter ngay hôm nay, và cơ chế chuyển đổi dự phòng tự động nằm bên dưới nó, nên nhánh DeepSeek trong so sánh này có thể được chúng tôi gọi ngay sáng nay thay vì chỉ đọc thông tin về nó. Một lưu ý đáng nói rõ thay vì để bạn tự phát hiện: mức giá niêm yết của chính chúng tôi cho model này là $0.22 đầu vào và $0.66 đầu ra mỗi triệu token, mức này nằm trên bảng giá giờ thấp điểm của DeepSeek và dưới mức giờ cao điểm. Hãy coi trang của DeepSeek, chứ không phải trang của chúng tôi, là nguồn thông tin chính thức về cơ cấu cao điểm và thấp điểm, còn con số của chúng tôi là một mức gộp duy nhất để bạn bắt đầu một lượt chạy có tính phí. Claude Sonnet 5.5 và Claude Opus 5.5 cũng có trên danh mục. Vì vậy, một so sánh A/B giữa nhánh DeepSeek Flash và nhánh Claude chỉ cần một key và một SDK, và DSL định tuyến sẽ kết hợp chúng thành một lời gọi duy nhất nếu logic leo thang thuộc về route thay vì ứng dụng.

Claude Haiku 5.5 vẫn chưa có trên danh mục. Đó không phải là một cách nói úp mở — điều đó có nghĩa là phía Ant​hropic của so sánh này hiện phải được truy cập trực tiếp tại Ant​hropic, còn phía Dee​pSeek thì không. Nếu bạn muốn tầng giá rẻ của dòng Dee​pSeek trên cùng một khóa như phần còn lại của stack của bạn ngay hôm nay, thì phần đó đã hoạt động rồi.

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Chọn cái nào?

Nếu các lệnh gọi của bạn ngắn — phân loại, trích xuất, định tuyến, tóm tắt, lượt tác nhân phụ — và chúng nằm dưới 100.000 token, thì Claude Haiku 5.5 hiện là mô hình rẻ hơn trên cả hai thước đo và mạnh hơn trên bảng xếp hạng độc lập, và lập luận rất rõ ràng. Nó cũng là mô hình duy nhất trong hai mô hình có thể xử lý hình ảnh.

Nếu các lệnh gọi của bạn kéo dài, nếu bạn gửi lại một tiền tố chia sẻ lớn, hoặc nếu bạn có thể lên lịch, thì phép tính lại chỉ theo hướng ngược lại và lệch một khoảng rất lớn: đầu vào được lưu đệm của Dee​pSeek ở mức $0.003 ngoài giờ cao điểm thấp hơn một bậc độ lớn so với mức $0.01 của Ant​hropic, trần đầu ra của nó cao gấp ba lần, và chiết khấu ngoài giờ cao điểm của nó là một vấn đề lên lịch chứ không phải hạn chế của sản phẩm.

Điều mà buổi ra mắt thực sự định đoạt thì hẹp hơn so với "Ant​hropic giờ đã rẻ". Nó định đoạt rằng các phòng thí nghiệm Mỹ sẽ định giá thấp hơn các phòng thí nghiệm Trung Quốc trong trường hợp prompt ngắn, và rằng trường hợp prompt ngắn chính là nơi phần lớn lưu lượng sản xuất tập trung. Mọi thứ vượt quá 100.000 token vẫn là thị trường của mô hình kia.