
Claude Sonnet 5.5 vs Grok 4.5: Hai mức giá đầu vào $2 và sáu phút chờ đợi
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 931 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 192 tok/s
- OrcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- xAISpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
Claude Sonnet 5.5 và Grok 4.5 tính cùng mức giá cho đầu vào: 2,00 USD mỗi triệu token. Đó là điểm kết thúc của mọi sự tương đồng, và một con số nói lên điều đó rõ hơn bất kỳ bảng thông số kỹ thuật nào. Trên bản sửa đổi Chỉ số Trí tuệ v4.3.2 của Artificial Analysis, thời gian trung vị để có token trả lời đầu tiên của Claude Sonnet 5.5 ở thiết lập Max Effort là 370,8 giây. Với Grok 4.5, con số đó là 6,9 giây. Cùng mức giá đầu vào. Thời gian chờ lâu gấp năm mươi ba lần trước khi có bất cứ thứ gì trả về. Claude Sonnet 5.5, ra mắt ngày 28 tháng 9 năm 2026, và Grok 4.5, ra mắt ngày 8 tháng 7 năm 2026 và đã bị vượt mặt hai lần ngay trong chính gia đình của mình, là hai cách rẻ nhất để bước vào nửa đầu của biên giới tiên phong trên giấy tờ — và tờ giấy ấy đang che giấu quyết định thực sự quan trọng, đó là bạn đang mua gì bằng khoảng thời gian chờ đợi.
Con số đó cần đi kèm ngay lưu ý của nó, vì một con số độ trễ mà không có cấu hình thì vô nghĩa: 370,8 giây là chế độ suy luận mặc định của Anthropic ở mức nỗ lực tối đa, dành một ngân sách suy nghĩ rất lớn trước khi phát ra token trả lời. Người gọi muốn có token đầu tiên nhanh sẽ cấu hình thứ khác. Nhưng hướng đi là thật và đó không phải là hiện tượng giả tạo — Artificial Analysis đo tốc độ đầu ra của Claude Sonnet 5.5 ở mức 138,7 token mỗi giây, chỉ đứng sau một vài mô hình, và của Grok 4.5 ở mức 59,2. Mô hình chờ lâu nhất cũng viết nhanh nhất. Điều bạn đang lựa chọn giữa hai thứ là một quá trình cân nhắc dài theo sau là một câu trả lời nhanh, và một quá trình ngắn theo sau là một câu trả lời chậm hơn.
Có gì thay đổi vào ngày 28 tháng 9
Claude Sonnet 5.5 mới ra đời được một ngày. Anthropic đã phát hành nó vào ngày 28 tháng 9 năm 2026 với mã định danh API claude-sonnet-5-5 trên Bedrock, Google Cloud và Microsoft Foundry, và mô tả nó chạy nhanh hơn 30% so với Claude Sonnet 5 và tốn ít hơn tới 30% chi phí cho mỗi tác vụ trong hầu hết công việc. Đây là những con số do nhà cung cấp đưa ra và chưa được kiểm chứng độc lập; mức giá mà nó được đối chiếu là có thật, vì bảng giá vẫn giữ nguyên ở mức 2,00 USD mỗi triệu token đầu vào, 10,00 USD mỗi triệu token đầu ra, 0,20 USD cho đọc bộ đệm và 2,50 USD cho ghi bộ đệm. Cửa sổ là 1.000.000 token với mức trần đầu ra đồng bộ 128.000 token, và 300.000 token trên Message Batches API khi dùng tiêu đề output-300k-2026-03-24. Thời điểm cắt kiến thức là tháng 6 năm 2026. Tính năng không lưu trữ dữ liệu có sẵn ngay từ khi ra mắt, và Anthropic sẽ không ngừng hỗ trợ mô hình trước ngày 28 tháng 9 năm 2027.

Trang tài liệu của chính Anthropic cũng rõ ràng một cách bất thường về cái giá của việc nâng cấp: năm thay đổi phá vỡ tương thích tách Claude Sonnet 5.5 khỏi mô hình mà phần lớn lưu lượng Claude hiện đang chạy trên đó, và chúng được đề cập ở phần dưới.
Grok 4.5 là lựa chọn cũ hơn và cũng phức tạp hơn. SpaceXAI — công ty vẫn phát hành dưới thương hiệu xAI trên thẻ mô hình của mình — đã ra mắt nó vào ngày 8 tháng 7 năm 2026 dưới dạng một mixture of experts 1,5 nghìn tỷ tham số, được huấn luyện song song với trình soạn thảo mã Cursor, với cửa sổ 500.000 token, đầu vào văn bản, hình ảnh và tệp, cùng bài giới thiệu khi ra mắt gần như hoàn toàn dựa trên tính kinh tế token thay vì điểm số hàng đầu. Nó không còn là flagship nữa. Grok 4.6 và Grok 4.7 đều tồn tại, cả hai đều có cùng mức giá niêm yết $2.00 / $6.00, và danh mục của chúng tôi liệt kê cả ba. Do đó, câu hỏi thú vị vào tháng 9 năm 2026 không phải là liệu Grok 4.5 có tốt hay không; mà là liệu có bất cứ điều gì vẫn đủ lý để chọn mô hình cũ nhất trong ba.
Hóa đơn không phải là bảng giá niêm yết
Đặt hai thứ cạnh nhau trên bảng độc lập và hình dạng của thương vụ hiện ra.
• Chỉ số Trí tuệ, bản sửa đổi v4.3.2 — Claude Sonnet 5.5 56 ở Max Effort so với Grok 4.5 39
• Chi phí mỗi tác vụ Index — Claude Sonnet 5.5 $7.60 so với Grok 4.5 $1.04, cả hai đều được đo lường thực tế, không phải ước tính
• Giá đầu ra — Claude Sonnet 5.5 10,00 USD mỗi triệu so với Grok 4.5 6,00 USD mỗi triệu
• Tốc độ đầu ra — Claude Sonnet 5.5 138,7 token/giây so với Grok 4.5 59,2 token/giây
• Thời gian đến token trả lời đầu tiên, Max Effort — Claude Sonnet 5.5 370,8 giây so với Grok 4.5 6,9 giây
• Số token được tạo ra trên toàn bộ quá trình đánh giá Index — Claude Sonnet 5.5 410M so với Grok 4.5 77M
• Ngữ cảnh — Claude Sonnet 5.5 1.000.000 token so với Grok 4.5 500.000 token
Dòng độ rườm rà chính là cơ chế đằng sau khoảng cách chi phí trên mỗi tác vụ, và đây là con số hữu ích nhất trên trang này. Một mô hình phát ra 410 triệu token trong một đánh giá mà đối thủ của nó chỉ phát ra 77 triệu không cần mức giá đầu ra cao hơn 67% để tốn gấp bảy lần chi phí mỗi tác vụ — nhưng nó vẫn có mức đó, và cả hai hiệu ứng đều đẩy theo cùng một hướng. Cách diễn giải của chính Anthropic đồng tình với cách hiểu này chứ không hề mâu thuẫn với nó: “tiết kiệm tới 30% mỗi tác vụ” là một tuyên bố về số lượng token, không phải về đơn giá, bởi vì đơn giá không thay đổi giữa Claude Sonnet 5 và Claude Sonnet 5.5. Artificial Analysis đi đến cùng kết luận từ phía ngược lại và mô tả mô hình bằng ngôn ngữ đơn giản là nhanh đáng kể nhưng rất rườm rà. Khi so với một mô hình tinh gọn, chính đặc tính đó là rủi ro vận hành lớn nhất của Claude Sonnet 5.5.

Nơi mức giá rẻ của Grok 4.5 không còn rẻ nữa
Dòng $2.00 / $6.00 là một bậc giá, không phải một mức giá. Trên tài liệu dành cho nhà phát triển của chính SpaceXAI, mức giá đó áp dụng tối đa 200.000 token đầu vào và tăng gấp đôi lên $4.00 đầu vào và $12.00 đầu ra khi vượt ngưỡng đó. Cửa sổ của Grok 4.5 là 500.000 token, vì vậy nửa sau của cửa sổ mà nó quảng cáo tốn gấp đôi nửa đầu. Nạp một prompt quy mô kho mã nguồn vào Grok 4.5 không phải là thao tác có đầu ra $6; đó là thao tác có đầu ra $12, và tại thời điểm đó, mô hình có mức giá đầu ra $10 "đắt đỏ" lại là mô hình rẻ hơn cho bất kỳ yêu cầu nào cũng phát ra nhiều token.
Claude Sonnet 5.5 không có hạng tương đương. Mức giá $2.00 / $10.00 giữ nguyên trên toàn bộ cửa sổ 1.000.000 token, và việc đọc bộ nhớ đệm được tính ở mức $0.20 — bằng một phần mười mức giá đầu vào — chính điều này khiến trường hợp ngữ cảnh dài trở nên khả thi trên thực tế chứ không chỉ trên giấy tờ.
Kích thước cửa sổ là nửa còn lại của lập luận đó, và nó cũng chỉ về cùng một hướng. Cửa sổ của Grok 4.5 là 500.000 token, và mỗi token đều được tính phí đúng theo mức phí quảng cáo. Claude Sonnet 5.5 có 1.000.000 token để làm việc, và chính hình dạng của khối lượng công việc mới khiến điều đó trở nên quan trọng: một kho mã để suy luận, một bản ghi tác nhân dài, một đống ngữ cảnh phải luôn nằm trong tầm mắt. Trần cao gấp đôi, không có điểm gãy bậc nào ở nửa đường, và đọc từ bộ nhớ đệm chỉ tốn một phần mười chi phí — tất cả biến việc mang ngần ấy ngữ cảnh qua nhiều lần gọi thành một khoản mục rõ ràng thay vì một canh bạc.
Sự phân chia thực tế không hề tinh tế:
• Lời nhắc ngắn với đầu ra dày đặc — Grok 4.5 thắng về tỷ lệ và lại thắng ở thói quen dùng token
Prompt vượt quá 200.000 token đầu vào — mức giá của 4.5 thì không, còn của Claude Sonnet 5 thì có.
• Công việc tương tác nhạy cảm với độ trễ — Grok 4.5 trả lời trước, với cách biệt lớn, ở cài đặt mặc định
• Các lượt chạy agentic tầm xa — điểm tổng hợp và mức trần đầu ra 128K của Claude Sonnet 5.5 chính là thứ bạn đang trả thêm chi phí tác vụ để có được, và mức trần 300K của Batches còn mở rộng điều đó hơn nữa
Việc di chuyển không phải là một chuỗi mô hình.
Bất kỳ ai chuyển từ Claude Sonnet 5 sang Claude Sonnet 5.5 đều nên đọc ghi chú di chuyển của Anthropic trước khi viết mã, vì năm hành vi đã thay đổi và chỉ một trong số đó báo lỗi rõ ràng ngay ở một chỗ dễ thấy.
• Không dùng giá trị mặc định temperature, top_p hoặc top_k giờ trả về lỗi 400 — một pipeline phụ thuộc nhiều vào sampling sẽ ngừng hoạt động thay vì chỉ suy giảm hiệu năng
• thinking: {"type": "disabled"} trả về 400 và phải trở thành between_tools, với effort bị giới hạn ở low, medium hoặc high; xhigh và max bị từ chối
• Buộc sử dụng công cụ — tool_choice là "any" hoặc một công cụ được đặt tên — bị từ chối thẳng, vì vậy một vòng lặp buộc phải có lệnh gọi hợp lệ theo schema phải chuyển sang auto với strict tool use hoặc structured outputs
• Công cụ sử dụng máy tính cũ hơn computer_20251124 bị từ chối trên Claude API và trên Google Cloud
• Các khối Thinking gắn với model và tài khoản đã tạo ra chúng, nên suy luận được chuyển tiếp từ Claude Sonnet 5 nhưng không đi ngang sang một họ model khác — và công cụ cố vấn không còn chấp nhận Claude Opus 4.8, Claude Opus 4.7 hoặc Claude Sonnet 5 làm cố vấn đằng sau một bộ thực thi Sonnet 5.5
Có một thay đổi thứ sáu không làm hỏng bất cứ thứ gì cả, và chính điều đó khiến nó trở thành thay đổi nguy hiểm: văn bản giữa các lần gọi công cụ giờ đây được trả về bên trong các khối suy nghĩ. Một ứng dụng truyền trực tiếp văn bản đó cho người dùng sẽ im lặng giữa các lần gọi công cụ cho đến khi ứng dụng đặt một giá trị hiển thị hoặc tắt hoàn toàn chế độ suy nghĩ từ đầu. Không có lỗi nào xảy ra. Đầu ra chỉ đơn giản là ngừng xuất hiện.
Grok 4.5 không yêu cầu bất kỳ điều nào trong số đó. Đây là một mô hình theo định dạng OpenAI với bề mặt lấy mẫu còn nguyên vẹn, và việc chuyển sang nó từ chính các phiên bản tiền nhiệm của Grok 4.5 chỉ là một thay đổi chuỗi mô hình. Chi phí di trú hoàn toàn nằm ở phía Claude, và đó là một ngày làm việc chứ không phải một buổi chiều.
Cả hai trên cùng một thông tin xác thực, và giới hạn trung thực của điều đó
Việc giữ một phép so sánh hai nhà cung cấp trong đầu thì dễ; chạy nó thực tế mới là chỗ chi phí ẩn nấp. OrcaRouter đặt hơn 200 mô hình phía sau một endpoint duy nhất tương thích OpenAI, với giá niêm yết của nhà cung cấp được chuyển thẳng và không cộng thêm phụ phí, nên khi một bên thay đổi giá, ở đây cập nhật ngay trong cùng ngày thay vì chờ đến kỳ gia hạn hợp đồng tiếp theo, cùng với chuyển đổi dự phòng tự động giữa các nhà cung cấp thượng nguồn và một DSL định tuyến để tổ hợp các lời gọi. Toàn bộ dòng Grok đều có trong danh mục với mức giá riêng của SpaceXAI, và Grok 4.5 có thể được định tuyến dưới dạng grok/grok-4.5 với giá $2.00 cho đầu vào và $6.00 cho đầu ra trên mỗi triệu token trong cửa sổ 500.000 token của nó.
Claude Sonnet 5.5 không có trong danh mục của chúng tôi, và trang này sẽ không ngụ ý điều ngược lại. Cách để truy cập nó ngày hôm nay là qua kênh của chính Anthropic, hoặc Bedrock và Google Cloud nếu đó là nơi hạ tầng của bạn đang nằm.Claude Sonnet 5 đã có thể định tuyến tại đây kể từ ngày 30 tháng 6 với mức $2.00 và $10.00 của Anthropic và vẫn là mô hình mà phần lớn lưu lượng Claude API chạy trên đó, khiến nó trở thành mục tiêu chuyển đổi dự phòng tự nhiên trong khi Claude Sonnet 5.5 vẫn chỉ mới một ngày tuổi và nằm ngoài bằng chứng sản xuất của bất kỳ ai.
Có một lưu ý áp dụng cho tất cả những điều trên, và nó không hề nhỏ. Dòng Grok 4.5 ở trên là bài chào hàng của nhà cung cấp như danh mục của chúng tôi hiện đang tái hiện; bộ đếm lưu lượng trên mục đó hiển thị số 0 trong bảy ngày qua và chỉ số thông lượng của nó không được đo, với thời gian đến token đầu tiên nằm ở mức sàn một giây mà một mô hình hầu như không được gọi thường thể hiện. Một mô hình không có lưu lượng gần đây ở đây không phải là bằng chứng cho thấy mô hình đó kém — 4.6 và 4.7 mới là nơi các lượt gọi của dòng này đã chuyển sang — nhưng điều đó có nghĩa là các số liệu vận hành trên trang đó còn mỏng, và chỉ số độ trễ đáng tin cậy chính là kết quả đọc từ một tuyến đang hoạt động.

Nên chọn cái nào
Grok 4.5 là mô hình phù hợp khi prompt ngắn, câu trả lời đặc, và tích hợp đã nói ngôn ngữ OpenAI — và khi yêu cầu không vượt quá 200.000 token đầu vào, bởi vì vượt qua ranh giới đó, phép tính sẽ đổi chủ. Nó cũng là lựa chọn đúng khi token đầu tiên phải đến trong vài giây thay vì vài phút. Điều nó không phải là mẫu flagship Grok hiện tại; Grok 4.6 và Grok 4.7 nằm trên nó ở cùng mức giá niêm yết, và lý do chọn 4.5 thay vì một trong hai cần phải là một lý do cụ thể.
Claude Sonnet 5.5 là mô hình phù hợp khi prompt cực lớn, công việc mang tính tác tử đến mức mười bảy điểm Index và giới hạn đầu ra 128K biện minh cho chi phí cao gấp bảy lần cho mỗi tác vụ, hoặc điểm tổng hợp đơn giản là thứ đang được mua. Tính dài dòng của nó là một quyết định thiết kế, không phải khiếm khuyết, và đó là con số cần đo trên lưu lượng của chính bạn trước khi cam kết — bởi vì 7,60 USD cho mỗi tác vụ Index so với 1,04 USD là một chỉ báo thay thế cho một con số mà chỉ khối lượng công việc của bạn mới có thể tạo ra.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
