Thẻ tiêu đề được tạo cho Claude Opus 5.5 so với GPT-6 Sol, với phụ đề 'Nửa giá, cho đến khi ngữ cảnh trở nên dài', cùng hai biểu tượng dạng nét phẳng (một tài liệu và một đám mây) và một dòng chân trang ghi 'Chỉ số theo Artificial Analysis ở mức nỗ lực tối đa; giá theo nhà cung cấp.' Logo OrcaRouter thật được ghép ở góc dưới bên phải.
Guides & Insights

Claude Opus 5.5 vs GPT-6 Sol: Rẻ bằng một nửa, cho đến khi ngữ cảnh trở nên dài

Tác giả

Magnus Corvin

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Ant​hropic và Open​AI đã tung ra những mẫu flagship cạnh tranh vào cùng một buổi chiều. Claude Opus 5.5 đã ra mắt vào ngày 22 tháng 9 năm 2026 với giá 4 USD cho mỗi triệu token đầu vào và 20 USD cho mỗi triệu token đầu ra, giảm 20% ở cả hai mức so với Claude Opus 5. GPT-6 Sol ra mắt cùng ngày với mức 2 USD đầu vào và 10 USD đầu ra, giảm thẳng 50% so với GPT-5.6 Sol, mức giảm mà Open​AI mô tả là vĩnh viễn chứ không phải khuyến mãi. Chỉ cần đọc hai câu đó thôi thì cuộc đối đầu trông như đã ngã ngũ ngay từ trước khi bắt đầu: mô hình của Open​AI bằng một nửa giá, mà một nửa giá thì vẫn là một nửa giá. Đọc phần còn lại của cả hai bảng giá thì khoảng cách phần lớn khép lại — không phải vì nhà cung cấp nào đã thay đổi điều gì, mà vì cả hai mô hình đều áp phụ phí cho cùng một kiểu yêu cầu, và nó lấy đi của Sol nhiều lợi thế hơn hẳn so với mức nó lấy đi của Ant​hropic.

Hai bảng giá, cả hai đều có một bước trong đó

Dưới 272.000 token đầu vào, đây là phép so sánh đơn giản nhất trong biên giới hiện tại:

• Đầu vào — GPT-6 Sol $2.00 mỗi triệu so với Claude Opus 5.5 $4.00

• Đầu ra — GPT-6 Sol $10.00 mỗi triệu so với Claude Opus 5.5 $20.00

• Đầu vào đã lưu đệm — GPT-6 Sol rẻ hơn khoảng 90% ở phần đã lưu đệm so với mức $0.20 mỗi triệu token của Claude Opus 5.5, tức hệ số nhân 5% trên giá đầu vào cơ bản

• Ngữ cảnh và đầu ra — GPT-6 Sol 872K theo đo lường của Artificial Analysis, 1M được tuyên bố ở nơi khác, đầu ra tối đa 128K so với Claude Opus 5.5 1M và 128K

• Mốc kiến thức — Claude Opus 5.5 tháng 6 năm 2026 so với GPT-6 Sol không được nêu theo cùng cách diễn đạt

Trên 272.000 token đầu vào, phép tính thay đổi ở cả hai bên, và không cùng một mức. GPT-6 Sol tính lại giá cho toàn bộ yêu cầu — không phải phần vượt, mà là toàn bộ lần gọi — ở mức gần gấp đôi giá đầu vào và gấp rưỡi giá đầu ra, rơi vào khoảng 4,00 USD đầu vào và 15,00 USD đầu ra. Bảng giá của Claude Opus 5.5 không có bậc ngữ cảnh dài: Anthropic tính 4,00 USD và 20,00 USD trên toàn bộ cửa sổ 1M token và nêu rõ rằng một yêu cầu 900K token có chi phí trên mỗi token bằng với yêu cầu 9K token.

Ghép những điều đó lại và thứ tự đảo ngược ở một chỗ không ngờ tới. Trong một lần gọi ngữ cảnh dài, mức giá đầu vào hội tụ ở khoảng 4 đô la trên cả hai mô hình — lợi thế giá bằng một nửa của Sol ở đầu vào biến mất hoàn toàn — trong khi đầu ra thu hẹp từ khoảng cách gấp 2 lần xuống còn khoảng 15 đô la so với 20 đô la, một lợi thế 25% thay vì 50%. Sol vẫn rẻ hơn. Nó không còn đủ rẻ để là con số duy nhất trong quyết định, và lý do là hai khoản phụ phí có hình dạng khác nhau: mô hình của Anthropic tính một mức giá cố định mà tình cờ lại cao hơn, còn của OpenAI tính một khoản phạt giáng mạnh nhất đúng vào các khối lượng công việc mang tính tác tử, đọc kho mã, tập tài liệu mà cả hai công ty đang bán các mô hình này cho.

A generated graphic titled 'Two rate cards, one step each', with a subtitle reading 'Above 272,000 input tokens the input rates converge and the output gap narrows to about a quarter.' Two panels compare per-million-token input and output rates: below 272,000 input tokens Claude Opus 5.5 is $4.00 / $20.00 against GPT-6 Sol at $2.00 / $10.00, and above 272,000 input tokens Claude Opus 5.5 stays at $4.00 / $20.00 while GPT-6 Sol moves to approximately $4.00 / $15.00 because the whole call reprices. The footer reads 'Per-million-token rates. Sol's step per OpenAI; Opus 5.5 bills its full 1M window at one rate per Anthropic.'

Điểm số độc lập, vốn là phép so sánh trong cùng điều kiện duy nhất

A two-column scoreboard comparing Claude Opus 5.5 and GPT-6 Sol across six shared rows: Intelligence Index (58, ranked #1 of 210, against 48, ranked #18), price in and out ($4.00 / $20.00 per million against $2.00 / $10.00), output speed (not yet published against 113.3 tokens per second), time to first token (not yet published against 142.74s), knowledge cutoff (Jun 2026 against not stated in the same terms) and long-context step (none against the whole call repriced above 272K). The footer reads 'Index, speed and latency figures per Artificial Analysis at max effort; prices and the 272K step per the vendors.'

Cả hai bảng ra mắt đều không chứa mô hình mới của bên kia — cả hai đều được viết trước khi các bản phát hành cùng ngày ra mắt — nên tài liệu của nhà cung cấp hoàn toàn không thể xếp hạng hai mô hình này. Artificial Analysis thì có thể, vì nó chạy mọi mô hình trong một cấu hình đã công bố:

• Chỉ số Trí tuệ — Claude Opus 5.5 đạt 58, xếp hạng #1 trong số 210, so với GPT-6 Sol đạt 48, xếp hạng #18

• Nhãn cấu hình — cả hai đều được chấm điểm ở mức nỗ lực tối đa; Claude Opus 5.5 còn được gắn thêm nhãn "Default Fallback"

• Tốc độ đầu ra — GPT-6 Sol 113,3 token/giây, xếp thứ 38 so với Claude Opus 5.5 chưa được công bố

• Thời gian đến token đầu tiên — GPT-6 Sol 142,74 giây so với trung vị trên bảng xếp hạng là 3,83 giây; Claude Opus 5.5 chưa được công bố

• Giá — GPT-6 Sol $2.00 / $10.00 mỗi triệu so với Claude Opus 5.5 $4.00 / $20.00

Mười điểm chỉ số và mười bảy bậc xếp hạng là khoảng cách rộng nhất trong bất kỳ cặp so tài Claude-đối-OpenAI nào hiện nay, và đây là lần thứ hai trong tháng này nó bất lợi cho mô hình rẻ hơn — cùng kiểu mẫu đó cũng xuất hiện khi GPT-6 Sol gặp Claude Opus 5 trong một so sánh trước đó và thua ba điểm với chi phí thấp hơn 60%. Hàng tốc độ lại đi theo hướng ngược lại và quan trọng hơn vẻ ngoài của nó: 113,3 token mỗi giây gần gấp đôi mức mà mẫu chủ lực GPT-6 Astra đạt được, và đây là con số nhanh nhất trong nhóm này. Kết hợp với token đầu tiên mất 142 giây, chân dung tổng thể là một mô hình suy nghĩ rất lâu rồi sau đó viết nhanh, vốn không phù hợp với bất cứ thứ gì có tính tương tác và là lựa chọn hợp lý cho những lượt chạy dài không cần giám sát.

Cả hai con số đều mang cùng lưu ý như các con số của nhà cung cấp: đây là những phép đo ở mức nỗ lực tối đa, và mặc định khi phát hành của cả hai mô hình đều không phải mức nỗ lực tối đa. Claude Opus 5.5 mặc định ởtrung bình trên thang nỗ lực chạy từ thấp đến tối đa; GPT-6 Sol đưa ra một thang chạy từ không đến tối đa. Chỉ số nỗ lực tối đa là một cách công bằng để so sánh các mức trần và là một cách gây nhầm lẫn để dự đoán hóa đơn của bạn.

Điều gì sẽ hỏng khi bạn chuyển đổi, theo cả hai hướng

Ma sát di trú ở đây mang tính bất đối xứng và đáng để biết trước khi thực hiện một trong hai bước đi.

Claude Opus 5.5 không phải là bản thay thế trực tiếp cho Claude Opus 5. Không thể tắt Thinking được nữa, nên mã đặt đường xử lý không Thinking sẽ báo lỗi hoặc thay đổi hành vi một cách âm thầm. Việc sử dụng công cụ bắt buộc sẽ trả về lỗi. Các khối Thinking bị ràng buộc với mô hình và cuộc trò chuyện đã tạo ra chúng, nên không thể phát lại chúng trên các mô hình khác. Công cụ computer-use computer_20251124 cũ hơn không được chấp nhận trên Claude API hoặc Google Cloud. Ngoài ra, văn bản giữa các lần gọi công cụ giờ đây được trả về bên trong các khối Thinking trống ở cài đặt hiển thị mặc định, nên một ứng dụng truyền phát văn bản đó dưới dạng tiến trình sẽ chỉ im lặng giữa các lần gọi mà không ném ra bất cứ lỗi nào.

Thang mức nỗ lực của GPT-6 Sol là thang linh hoạt hơn trong hai: nó có thể được thay đổi giữa cuộc trò chuyện mà không làm mất hiệu lực bộ đệm prompt, nghĩa là một lượt chạy đầu rẻ và một lần thử lại đắt đỏ trên cùng ngữ cảnh là một mô hình được hỗ trợ, chứ không phải một cách phá vỡ bộ đệm. Đó là một lợi thế kỹ thuật thực sự cho bất kỳ ai đang chạy suy luận theo tầng trong một phiên duy nhất, và đó là lập luận mạnh nhất cho Sol mà không xuất hiện trong bất kỳ bảng giá nào.

Chạy cả hai và quyết định bằng những con số của chính bạn.

Quan điểm trung thực về màn so kè này là các bảng của nhà cung cấp không thể phân xử được, và chỉ số độc lập chỉ giải quyết được mức trần. Điều còn lại là câu hỏi về khối lượng công việc — ngữ cảnh của bạn thực sự chạy trong bao lâu, và một lần thử thất bại tốn bao nhiêu — và điều đó có thể đo lường trên lưu lượng của chính bạn thay vì tranh cãi từ một thông cáo báo chí.

Cả hai mô hình đều có thể định tuyến từ OrcaRouter theo giá niêm yết của nhà cung cấp với mức chênh lệch 0%: GPT-6 Sol ở mức $2.00 / $10.00 của OpenAI và Claude Opus 5.5 ở mức $4.00 / $20.00 của Anthropic. Vì việc chuyển tiếp là chính xác và giá thay đổi ngay vào ngày nhà cung cấp thay đổi chúng, tỷ lệ bạn đo được trong môi trường staging chính là tỷ lệ bạn phải trả trong môi trường production, không có lớp chênh lệch nào để phải tính lại. Một khóa duy nhất bao quát cả hai, nên quy tắc định tuyến gửi các lệnh gọi dưới 272K đến Sol và các lệnh gọi ngữ cảnh dài đến mô hình nào thắng trong bài đánh giá của bạn chỉ là một thay đổi cấu hình thay vì một tích hợp thứ hai — và tự động chuyển đổi dự phòng nghĩa là một bản ra mắt cùng ngày ở một trong hai bên là thứ bạn có thể dành một phần lưu lượng truy cập cho nó thay vì một canh bạc bạn đặt cược bằng cả một pipeline.

A screenshot of OrcaRouter's own model page for openai/gpt-6-sol, headed 'GPT-6 Sol' and credited to OpenAI, showing a 1M-token context, 128K max output, and a stat strip reading INPUT $2.00 and OUTPUT $10.00 per 1M tokens with a 2.25s p50 time to first token and 4.8M tokens of traffic over 7 days.

Phiên bản của thứ này trụ được khi chạm trán với một hóa đơn.

GPT-6 Sol là mô hình rẻ hơn ở mọi dòng, trong mọi cấu hình, và điều đó không có gì phải tranh cãi. Điều không đứng vững là giả định rằng "một nửa giá" chính là con số để hoạch định: trong một lượt gọi ngữ cảnh dài, đơn giá đầu vào gặp nhau ở khoảng $4 và khoảng cách đầu ra thu hẹp còn một phần tư, đó là một quyết định khác với quyết định mà các trang ra mắt mô tả. Cân nhắc điều đó với khoảng cách chỉ số mười điểm, mười bảy bậc xếp hạng, và token đầu tiên đo được 142 giây, thì sự phân chia tự hiện ra cho hầu hết khối lượng công việc — Sol là lựa chọn mặc định cho khối lượng lớn ở ngữ cảnh ngắn và trung bình, Claude Opus 5.5 khi ngữ cảnh kéo dài hoặc tác vụ đủ khó đến mức việc thử lại tốn kém hơn phần chênh lệch token. Sai lầm đáng tránh là chọn một trong hai chỉ dựa trên mức giá tiêu đề, bởi chính con số thứ hai trên mỗi bảng giá mới quyết định trường hợp mà cả hai mô hình được tạo ra để giải quyết.

So sánh trong bài viết này2

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày