Thẻ tiêu đề hero cho "Fugu Max so với GPT-5.6 Sol" với phụ đề "Tuyên bố về giá nhắm vào phần giữa của dòng sản phẩm", ba huy hiệu dạng viên thuốc ghi "đầu ra $6.00 so với $20.00", "tuyên bố 40-60% so với Terra", "Sáu chiến thắng, không có điểm số", một dòng chân trang ghi "Sakana AI so với OpenAI - tháng 9 năm 2026", và logo OrcaRouter ở góc dưới cùng bên phải.
Guides & Insights

Fugu Max vs GPT-5.6 Sol: tuyên bố về giá nhắm đến phân khúc giữa của dòng sản phẩm

Tác giả

Magnus Corvin

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Fugu Max's price justification names a G​PT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same Ope​nAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.

Đang đối chiếu tuyên bố với họ mà nó chỉ đến.

Con số 40 đến 60 phần trăm của Sakana có thể kiểm chứng được, vì mô hình mà nó nêu tên có mức giá được công bố. GPT-5.6 Terra niêm yết ở mức $2,00 cho đầu vào và $12,00 cho đầu ra mỗi triệu token. Fugu Max niêm yết ở mức $2,00 cho đầu vào và $6,00 cho đầu ra. Chạy phép so sánh và hai điều lộ ra. Ở đầu ra, $6,00 so với $12,00 là mức cắt giảm đúng 50 phần trăm — nằm chính giữa khoảng 40 đến 60 được nêu, điều này là dấu hiệu cho thấy khoảng đó được vẽ ra xung quanh phép so sánh này thay vì được phát hiện từ nó. Ở đầu vào, hai mức giá giống hệt nhau đến từng xu.

That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the G​PT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.

• Giá đầu vào — Fugu Max $2.00 mỗi 1 triệu token so với GPT-5.6 Sol $4.00 mỗi 1 triệu token

• Giá đầu ra — Fugu Max $6.00 mỗi 1 triệu token so với GPT-5.6 Sol $20.00 mỗi 1 triệu token

• Đầu vào được lưu trong bộ nhớ đệm — Fugu Max $0,25 mỗi 1 triệu token, so với GPT-5.6 Sol: bộ nhớ đệm được tính giá như một khoản chiết khấu trên mức giá đầu vào cơ sở

• Bối cảnh — Fugu Max chưa được công bố so với GPT-5.6 Sol 1M token

• Giới hạn đầu ra — Fugu Max không được công bố so với GPT-5.6 Sol 128K token

• Phương thức đầu vào — Fugu Max chưa được công bố so với GPT-5.6 Sol: văn bản, hình ảnh và tệp

• Thẻ năng lực — Fugu Max không công bố thông tin nào so với GPT-5.6 Sol: thị giác, sử dụng công cụ, chế độ JSON, suy luận

• Endpoints — Fugu Max một bề mặt tương thích OpenAI so với chat completions của GPT-5.6 Sol và Responses API

• Số liệu benchmark — Fugu Max khẳng định sáu chiến thắng nhưng không kèm điểm số, so với các số liệu do nhà cung cấp công bố của GPT-5.6 Sol, bao gồm Terminal-Bench 2.0 đạt 91,9% và SWE-bench Pro đạt 64,6%

Vì sao nấc giữa là nấc đúng để gọi tên

Có một phiên bản có thể biện minh được cho lựa chọn của Sakana, và nó đáng được nêu ra trước những lời chỉ trích. Một bộ điều phối định tuyến từng tác vụ đến mô hình nhẹ nhất có khả năng không cạnh tranh với một mô hình flagship trong công việc dành cho flagship. Nó đang cạnh tranh với một mô hình tầm trung trong công việc tầm trung, và đề nghị làm một phần nhỏ của công việc đó với chi phí rẻ hơn. Nếu lời chào hàng là "phần lớn lưu lượng của bạn không cần Sol", thì Terra mới là đối tượng so sánh đúng, vì Terra là thứ hầu hết các đội thực sự tìm đến khi họ không muốn trả mức giá của Sol. Đo lường so với phân khúc mà khách hàng của bạn nếu không thì sẽ mua là trung thực hơn việc đo lường so với mô hình đắt nhất hiện có.

Khó khăn nằm ở chỗ chính câu đó cũng tuyên bố hiệu năng “trong tầm với của các mô hình tinh hoa”. Hai nửa ấy của lời quảng bá kéo theo hai hướng trái ngược nhau. Nếu Fugu Max là bản thay thế cho Terra, thì cách định vị theo mô hình tinh hoa đang làm một việc marketing mà nó không thể chống đỡ, bởi Terra rõ ràng không được định vị là tinh hoa — nó được định vị là phân khúc đủ tốt. Nếu Fugu Max thực sự ở trong tầm với của Sol, thì việc so sánh giá lẽ ra phải được đối chiếu với Sol, nơi khoảng cách là lớn nhất và thể hiện có lợi nhất. Một bản phát hành đưa ra tuyên bố năng lực mạnh mẽ và so sánh giá thận trọng trong cùng một đoạn văn là đang cố có cả đôi đường, và người đọc không có cách nào để biết nửa nào là phần chịu lực.

A two-column scoreboard titled "Fugu Max vs GPT-5.6 Sol - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Context not published, Modality not published, Benchmarks six wins with no figures. Right column GPT-5.6 Sol: Output price $20.00 / 1M, Input price $4.00 / 1M, Cached input discount on base rate, Context 1M tokens with 128K output, Modality text, image and file, Benchmarks 91.9% on Terminal-Bench 2.0. Footer reading "Fugu Max figures vendor-reported by Sakana AI. Sakana's 40-60% output claim names GPT-5.6 Terra at $2.00 / $12.00, not Sol.", with the OrcaRouter logo bottom-right.

Sáu benchmark, không có một con số nào, và một cái tên hẳn phải khiến người ta đặt câu hỏi.

Nửa phần năng lực của bài chào hàng nằm ở một danh sách. Fugu Max "đạt điểm tổng thể tốt nhất" trên Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench và SWEFish. Không có điểm số nào được công bố cho bất kỳ mục nào trong số đó. SWEFish là benchmark lập trình nội bộ của chính Sakana, nghĩa là một trong sáu chiến thắng được chấm bằng một bài kiểm tra do nhà cung cấp tự viết và chưa công bố.

GPT-5.6 Sol báo cáo các số liệu. Sol được liệt kê ở mức 91,9% trên Terminal-Bench 2.0 và 64,6% trên SWE-bench Pro trong dữ liệu so sánh của bên thứ ba. Lưu ý sự lệch phiên bản ở benchmark terminal: con số được công bố của Sol là dành cho Terminal-Bench 2.0, còn Sakana tuyên bố giành chiến thắng trên 2.1, vốn là một đánh giá khác và không thể đem đối chiếu với nó. Điều đó đáng được nêu ra vì hai tuyên bố trông nằm sát nhau trong một tiêu đề và trên thực tế không thể so sánh với nhau.

Việc so sánh thích hợp cho màn đối đầu này sẽ là Sol đấu với một mô hình Fugu trên cùng một đánh giá chung. Các trang so sánh của bên thứ ba có đưa ra GPT-5.6 Sol đối đầu với thế hệ Sakana Fugu cơ sở — Sol dẫn trước trên Terminal-Bench 2.0 với 91,9% so với 80,2% và trên SWE-bench Pro với 64,6% so với 59% — nhưng đó là các số liệu của thế hệ trước đó, không phải Fugu Max, và chính những nguồn ấy cũng nói rõ rằng họ không đưa ra kết luận về người thắng chung cuộc vì độ phủ đánh giá chung quá mỏng. Không có bất kỳ so sánh nào được công bố giữa Fugu Max và GPT-5.6 Sol. Ai khẳng định có đều đang suy diễn.

Không có bên độc lập nào đã đánh giá Fugu Max, và không có mục Artificial Analysis nào tồn tại cho nó hoặc cho bất kỳ mô hình Fugu nào. Mọi con số trong bản công bố, bao gồm sáu chiến thắng, đều đến từ nhà cung cấp. Ngược lại, Sol đã được cung cấp rộng rãi từ ngày 9 tháng 7 năm 2026 và xuất hiện trên các bảng xếp hạng của bên thứ ba — một mức độ giám sát từ bên ngoài mà Fugu Max chưa có cơ hội nhận được.

Bạn thực sự đang mua gì ở mỗi bên

Việc cấu hình GPT-5.6 Sol là một yếu tố đã được biết rõ. Nó sở hữu cửa sổ ngữ cảnh 1M token, giới hạn đầu ra 128K, đầu vào văn bản, hình ảnh và tệp, khả năng thị giác, sử dụng công cụ, chế độ JSON và suy luận như những năng lực đã được ghi nhận, cùng hai endpoint — chat completions và responses API — nên một tích hợp sẵn có vẫn có đường để chuyển đổi. Nó cho thấy thời gian đến token đầu tiên p50 là 6,68 giây trên lưu lượng mà chúng tôi phục vụ, chậm hơn so với những mô hình nhanh nhất trong danh mục của chúng tôi và là điều đáng biết trước khi bạn xây dựng một sản phẩm tương tác dựa trên nó.

Việc cấu hình Fugu Max gần giống với việc mua một mức dịch vụ hơn là mua một mô hình. Bạn nhận được một endpoint tương thích với OpenAI, một thay đổi tham số chỉ một dòng để chuyển sang nó từ một Fugu trước đó, và một bộ điều phối quyết định sẽ gọi những mô hình nào. Điều bạn không nhận được, từ trang phát hành, là cửa sổ ngữ cảnh, giới hạn đầu ra, danh sách modality, con số độ trễ hay điểm đánh giá chuẩn. Các quyết định định tuyến của bộ điều phối không được công bố theo thiết kế. Trong bản phát hành này, nhóm mô hình đã mở rộng để bao gồm các mô hình trọng số mở và mô hình chuyên biệt, với dòng NVIDIA Nemotron được nêu tên thông qua hợp tác với NVIDIA, còn lại thì không được tiết lộ.

Lý do được Sakana đưa ra cho sự không minh bạch đó là có thể biện minh được — một pool không phụ thuộc nhà cung cấp, có thể hoán đổi, là sự bảo vệ trước việc ngừng hỗ trợ, thay đổi giá cả và rút khỏi khu vực. Đó là một biện pháp phòng ngừa thực sự, và mức giá đầu vào được lưu cache $0.25 cho thấy Sakana kỳ vọng vào các khối lượng công việc ngữ cảnh dài, lặp lại cao — nơi biện pháp phòng ngừa đó sẽ quan trọng nhất. Nhưng điều đó có nghĩa là thông số kỹ thuật bạn đang mua là một lời hứa về chuỗi cung ứng chứ không phải là bản mô tả sản phẩm.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Cách chạy bài kiểm tra

Cách đúng đắn để giải quyết chuyện này không phải là đọc trang của một trong hai nhà cung cấp. Hãy lấy một mẫu lưu lượng của chính bạn — vài trăm yêu cầu thực tế, lý tưởng nhất là bao gồm cả những yêu cầu mà nhóm bạn hiện đang chuyển lên xử lý — rồi chạy chúng với cả hai endpoint khi đã bật tính toán token. Hãy tính chi phí theo token cho mỗi tác vụ hoàn thành thay vì token cho mỗi lần gọi, đặt ngân sách đầu ra trước khi bắt đầu để việc phân nhánh không thể khiến bạn bất ngờ, và đo chất lượng bằng việc liệu một người thứ hai có đồng ý rằng câu trả lời là chấp nhận được hay không. Thử nghiệm đó sẽ trả lời câu hỏi trong một tuần và tốn rất ít.

The friction is that Fugu Max is not on OrcaRouter. It reaches you through Sakana's own OpenAI-compatible API and several third-party platforms, which means a second integration, a second credential set and a second invoice. GPT-5.6 Sol is on our catalogue at Ope​nAI's list price with 0% markup — the provider's rate passed through rather than marked up, so a change to Ope​nAI's pricing is live on your existing key the same day, with automatic failover across provider paths when one is rate-limited or unavailable. It sits behind the same key as more than 200 other models, so when the pilot ends you keep the integration and change one string.

Kết luận

GPT-5.6 Sol thắng trong cuộc so sánh mà Sakana đã từ chối đưa ra. Nó tốn chi phí gấp đôi cho đầu vào và hơn gấp ba lần cho đầu ra, và đổi lại, bạn nhận được một cửa sổ ngữ cảnh được công bố, giới hạn đầu ra 128K, đầu vào đa phương thức có tài liệu, các thẻ năng lực được đặt tên, hai endpoint, cùng các benchmark của nhà cung cấp mà bên thứ ba đã có nhiều tháng để xem xét. Nếu công việc của bạn thuộc loại mà Sol được tạo ra để giải quyết — suy luận nhiều bước chuyên sâu, kỹ thuật phần mềm quy mô lớn, các tác vụ agentic dài hạn — thì chênh lệch giá chính là cái giá phải trả để mua thứ mà bạn có thể đặc tả.

Fugu Max thắng ở một canh bạc hẹp hơn và thực sự thú vị, đồng thời nó là lựa chọn rẻ hơn với khoảng cách lớn: thấp hơn GPT-5.6 Terra 50% ở output, thấp hơn Sol 70%, với mức giá cache thấp nhất trong cả hai bảng giá. Nếu lưu lượng của bạn có khối lượng lớn, chỉ văn bản, có thể kiểm chứng, và phần lớn không cần suy luận của mô hình hàng đầu, thì một orchestrator định tuyến đến mô hình đủ dùng tinh gọn nhất là một thiết kế mạch lạc, và mức giá đầu ra $6.00 chính là nơi giá trị nằm ở đó. Hãy tiếp nhận cách định vị của chính bản phát hành theo đúng nghĩa đen và thí điểm nó như một lựa chọn thay thế Terra chứ không phải Sol — và nếu bạn muốn mô hình hàng đầu với giá niêm yết của nhà cung cấp được giữ nguyên không thay đổi, GPT-5.6 Sol chỉ cách một key trên OrcaRouter.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol, captured September 11, 2026, English UI), showing the Featured badge, the openai/gpt-5.6-sol model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-09, the /v1/chat/completions and /v1/responses endpoints, the pricing tiles reading INPUT $4.00 and OUTPUT $20.00 per 1M tokens with p50 TTFT 6.68s and 153.0M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày