Thẻ tiêu đề hero ghi 'GPT-6 Sol Pro vs Gemini 3.1 Pro Preview' với phụ đề 'Bảy tháng xem trước, và cái giá phải trả', cùng logo OrcaRouter thật ở góc dưới bên phải.
Guides & Insights

GPT-6 Sol Pro so với Gemini 3.1 Pro Preview: Bảy tháng xem trước, và cái giá bạn phải trả

Tác giả

Alistair Wren

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Gemini 3.1 Pro Preview đã ở dạng preview được bảy tháng. Nhà cung cấp đã công bố nó vào ngày 19 tháng 2 năm 2026 với mức $2.00 mỗi triệu token đầu vào và $12.00 mỗi triệu token đầu ra, và tính đến tuần này, thẻ mô hình vẫn mô tả nó là "được cung cấp ở dạng preview," cảnh báo rằng nó "có thể có hạn chế về độ ổn định hoặc tính khả dụng so với các bản phát hành ổn định," và nói rằng nó "có thể thay đổi hoặc bị ngừng hỗ trợ mà không báo trước." Không có ngày khả dụng chung và không có ngày tắt trên bảng ngừng hỗ trợ. GPT-6 Sol Pro — cấu hình của GPT-6 Sol, mô hình đã đạt tính khả dụng chung vào ngày 22 tháng 9 năm 2026 với $2.00 đầu vào và $10.00 đầu ra — là thế ngược lại: một API production với giá được công bố, một nút điều chỉnh effort được ghi tài liệu, và một nhà cung cấp đã cam kết với con số đó.

Điều thú vị khi so sánh hai mô hình này không nằm ở bảng benchmark. Mà nằm ở những gì mỗi nhà cung cấp đã hứa với bạn về quý tới.

Hai dòng giá, một trong số đó là bản xem trước

Cả hai đều là danh sách nhà cung cấp. Số liệu của chính GoogleOpenAI, được các nền tảng lưu trữ chúng truyền đi nguyên vẹn.

• Đầu vào — GPT-6 Sol $2.00 mỗi triệu token so với Gemini 3.1 Pro Preview $2.00 mỗi triệu token

• Đầu ra — GPT-6 Sol $10.00 mỗi triệu token so với Gemini 3.1 Pro Preview $12.00 mỗi triệu token

• Ngữ cảnh dài — Gemini 3.1 Pro Preview định giá lại đầu vào ở mức $4,00 và đầu ra ở mức $18,00 cho mỗi triệu token khi vượt ngưỡng 200.000 token; GPT-6 Sol áp dụng mức định giá lại ngữ cảnh dài của riêng mình khi vượt một ngưỡng đầu vào cao hơn

• Đọc bộ nhớ đệm — GPT-6 Sol $0.20 mỗi triệu token so với Gemini 3.1 Pro Preview $0.20 mỗi triệu token

• Cửa sổ ngữ cảnh — GPT-6 Sol 1.050.000 token so với Gemini 3.1 Pro Preview 1.000.000 token

• Đầu ra tối đa — GPT-6 Sol 128.000 token so với Gemini 3.1 Pro Preview 65.000 token

• Phương thức đầu vào — GPT-6 Sol: văn bản và hình ảnh so với Gemini 3.1 Pro Preview: văn bản, hình ảnh, âm thanh, video và tệp

• Trạng thái khả dụng — GPT-6 Sol nhìn chung đã khả dụng kể từ ngày 22 tháng 9 năm 2026, so với Gemini 3.1 Pro Preview đang ở dạng xem trước kể từ ngày 19 tháng 2 năm 2026 và chưa có ngày GA nào được công bố

Các mức giá được công bố đủ gần nhau đến mức chúng không phải là yếu tố quyết định. Đầu vào là như nhau. Đầu ra khác nhau 20%. Sự khác biệt thực sự nằm ở hai dòng cuối: Gemini nhận thêm bốn phương thức đầu vào và gấp đôi giới hạn đầu ra theo hướng ngược lại — 65.000 token so với 128.000 — và đã được phát hành dưới dạng bản xem trước trong phần lớn một năm.

A two-column scoreboard card titled 'GPT-6 Sol vs Gemini 3.1 Pro Preview - the scoreboard'. Left column 'GPT-6 Sol': AA Index, current 48; index at Feb 2026 not scored; price in/out $2 / $10; cost per index task $1.06; max output 128K; input modalities text + image. Right column 'Gemini 3.1 Pro Preview': AA Index, current 30; index at Feb 2026 57, retired index; price in/out $2 / $12; cost per index task $0.67; max output 65K; input modalities text, image, audio, video. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

Trạng thái xem trước là một thuộc tính vận hành thực sự

Văn bản trong danh mục của chính Google nhắc nhở các nhà phát triển hãy lên kế hoạch cho việc bản xem trước sẽ bị ngừng hỗ trợ. Câu đó đang gánh một trọng trách lớn, và đáng để đọc như một ràng buộc kỹ thuật hơn là một lời tuyên bố miễn trách.

Một mô hình xem trước là mô hình bạn có thể xây dựng dựa trên, nhưng không thể lập kế hoạch xoay quanh. Ba hệ quả kéo theo, và không có hệ quả nào trong số đó xuất hiện trong bảng giá.

• Không có cam kết về độ ổn định. Thẻ nêu rõ rằng mô hình có thể có những hạn chế về độ ổn định so với các bản phát hành ổn định, và rằng OrcaRouter không cung cấp bảo đảm độ trễ cụ thể cho mô hình xem trước này. Dữ liệu đo từ xa của chính chúng tôi trên trang mô hình cho thấy p50 và p95 thời gian đến token đầu tiên đều ở mức 10,00 giây trong tuần gần nhất, đây là mức cao nhất của phạm vi hiển thị chứ không phải trung vị đo được.

• Không có ngày ngừng hỗ trợ. Một mô hình có ngày ngừng hoạt động có thể được lên lịch loại khỏi lộ trình. Một mô hình không có ngày GA cũng không có ngày ngừng hoạt động thì hoàn toàn không thể được lên lịch theo hướng nào — bạn không biết khi nào nó sẽ trở nên an toàn để phụ thuộc vào, và bạn không biết khi nào nó sẽ ngừng hoạt động.

• Không có vị trí nào trên lộ trình. Google đã tung ra các mẫu Flash mới hơn trong cùng dòng, hiện đạt điểm cao hơn Gemini 3.1 Pro trên các bảng tổng hợp độc lập, bao gồm Gemini 3.8 Flash vào ngày 2 tháng 9 năm 2026. Thế hệ 3.5 Pro đã bị trì hoãn và được cho là đã bị gác lại. Không có Gemini 3.8 Pro. Mẫu mang tên Pro không còn là mẫu đạt điểm cao nhất của nhà cung cấp nữa, và nó vẫn chỉ là bản xem trước.

Đó là cách diễn giải trung thực cho bất kỳ ai đang cân nhắc giữa hai lựa chọn này. GPT-6 Sol mới ra đời được sáu ngày và có mức giá cố định, được công bố, vĩnh viễn. Gemini 3.1 Pro Preview đã ra đời được bảy tháng và có một dòng trạng thái thay vì một lộ trình.

Điều mà hồ sơ độc lập cho thấy, và vì sao nhãn phiên bản chính là toàn bộ lập luận

Artificial Analysis công bố một trang so sánh trực tiếp cho đúng cặp này trên chỉ mục hiện tại, khiến nó trở thành một trong số ít các cặp đối đầu trong lô này mà các con số trung lập thực sự có thể so sánh ngang hàng. GPT-6 Sol ở mức nỗ lực tối đa đạt 48 điểm với $1.06 mỗi tác vụ chỉ mục. Gemini 3.1 Pro Preview đạt 30 điểm với $0.67 mỗi tác vụ chỉ mục.

Mười tám điểm là một khoảng cách lớn, và đó không phải khoảng cách mà mô hình có hồi tháng Hai. Khi ra mắt, Artificial Analysis đã xếp Gemini 3.1 Pro Preview ở vị trí đầu tiên trên Intelligence Index của mình với 57 điểm. Mô hình đã không thay đổi kể từ đó. Chỉ số thì có — nó đã được chấm điểm lại vào ngày 19 tháng 9 năm 2026, và cùng một mô hình không hề thay đổi giờ đây đạt 30 điểm. Cả hai con số đều là của Artificial Analysis; không con số nào sai; đặt chúng cạnh nhau mà không kèm phiên bản là lỗi phổ biến nhất trong các bài viết về mô hình này, và đó là lý do vì sao rất nhiều trang so sánh mô tả một mô hình dẫn đầu hồi tháng Hai như thể nó ngang hàng vào tháng Chín.

Chi phí mỗi tác vụ kể một câu chuyện thứ hai đáng để bỏ công tính toán. Gemini rẻ hơn trên mỗi tác vụ — $0.67 so với $1.06 — nhưng lại đạt điểm thấp hơn. Chi phí trên mỗi điểm chỉ số là $0.022 đối với GPT-6 Sol và $0.022 đối với Gemini. Theo thước đo đó, hai bên ngang ngửa, và đó là cách gọn gàng nhất để nói điều thực sự đang diễn ra ở đây: Gemini không phải là một cách rẻ hơn để mua cùng một lượng trí tuệ, mà là một cách rẻ hơn để mua ít trí tuệ hơn.

Hai con số độc lập khác đứng bên cạnh những con số đó, cả hai đều có nhãn. Trên OSWorld-Verified, bộ đánh giá chuẩn về sử dụng máy tính, trang đánh giá của chính Google báo cáo 76,2% cho Gemini 3.1 Pro. Con số đó xuất hiện trên các tài liệu của Google và trong những bản tóm tắt của bên thứ ba về chúng, và nó không xuất hiện trên bảng OSWorld được xác minh độc lập, nơi liệt kê các mô hình Gemini khác — 3.6 Flash ở 83%, 3.5 Flash ở 78,4% — và hoàn toàn không có hàng nào cho 3.1 Pro. Trên bảng OSWorld 2.0 khó hơn, mô hình đạt 30,6%. Còn trên GDPval-AA, mô hình đứng ở khoảng 1.316 Elo, xếp sau Claude Sonnet 4.6 và Claude Opus 4.6.

Đây không phải là lời cáo buộc về ý đồ xấu; các số liệu tự báo cáo là bình thường và cả hai nhà cung cấp đều công bố chúng. Đó là một nhận định về những gì một bản xem trước bảy tháng tuổi thực sự mang lại cho bạn: đủ thời gian để một con số do nhà cung cấp báo cáo lan truyền rộng rãi, và không đủ sự tái lập độc lập để con số đó được kiểm chứng. Ngược lại, thành tích trung lập của GPT-6 Sol thì ngắn, rõ ràng và mới chỉ sáu ngày.

Khoảng trống kiến thức mười lăm tháng mà không ai nhắc đến

Gemini 3.1 Pro Preview có thời điểm cắt kiến thức là tháng 1 năm 2025. GPT-6 Sol là ngày 20 tháng 4 năm 2026 — muộn hơn mười lăm tháng.

Khoảng trống đó không hề xuất hiện trên bất kỳ trang so sánh nào về cặp đối đầu này, và nó quan trọng hơn cả mức chênh lệch giá đầu ra đối với một nhóm công việc cụ thể: bất cứ thứ gì liên quan đến các API gần đây, các phiên bản thư viện gần đây, các sự kiện gần đây, hay những dữ kiện gần đây về mặt tổ chức. Một mô hình có mốc cắt dữ liệu tháng 1 năm 2025 sẽ trả lời đầy tự tin về một thế giới đã tiến xa thêm một năm một quý, và kiểu thất bại này không phải là một thông báo lỗi — mà là một câu trả lời sai nhưng nghe có vẻ hợp lý. Với công việc tăng cường truy xuất, mốc cắt gần như không còn quan trọng vì ngữ cảnh đã mang sẵn các dữ kiện. Còn với bất cứ thứ gì dựa vào kiến thức tham số, đây là ràng buộc đầu tiên cần kiểm tra và cũng là điều cuối cùng mà người ta kiểm tra.

Screenshot of the Artificial Analysis model page for GPT-6 Sol, captured 23 September 2026, showing an Artificial Analysis Intelligence Index of 48 at maximum reasoning effort and 43 at high effort, a cost per index task of $1.06 and $0.37, a 1.05M-token context window, a 128k-token maximum output, and blended list pricing of $2.00 per million input tokens and $10.00 per million output tokens.

Khoảng cách phương thức là lập luận mạnh nhất ủng hộ Gemini, và nó là có thật

Sẽ rất dễ để mô tả cuộc so tài này như một chiến thắng dễ dàng cho mẫu mới hơn. Nhưng không phải vậy, và lý do nằm ở dòng đầu vào.

Gemini 3.1 Pro Preview chấp nhận đầu vào văn bản, hình ảnh, âm thanh, video và tệp một cách nguyên bản trên cùng một endpoint. GPT-6 Sol chấp nhận văn bản và hình ảnh. Đối với một khối lượng công việc được xây dựng xoay quanh việc hiểu video, phiên âm cuộc họp hoặc xử lý tài liệu trải rộng nhiều định dạng, đó không phải là sự khác biệt về tính năng — mà là sự khác biệt giữa một lệnh gọi API và một pipeline gồm ba bước, với các bước trung gian được tính phí riêng và các kiểu lỗi nhân lên.

Lời cảnh báo trung thực gắn với điều đó: một mô hình xem trước với tỷ lệ lỗi 77,6% được hiển thị trên trang mô hình lưu trữ của nó là một mô hình xem trước mà lợi thế đa phương thức của nó phải được cân nhắc so với việc liệu nó có trả lời hay không. Con số đó đúng như được hiển thị trên trang và nó đủ cao để đòi hỏi phải xác minh trước khi bất kỳ ai xây dựng dựa trên nó — đó chính xác là điều mấu chốt. Đã bảy tháng trôi qua, lời khuyên trung thực về mô hình này vẫn là "hãy tự đo lường nó", và đó là câu mà không ai viết về một bản phát hành GA.

Nơi một lớp định tuyến thay đổi phép tính

Gemini 3.1 Pro Preview có trong danh mục của OrcaRouter với giá $2.00 cho đầu vào, $12.00 cho đầu ra và $0.20 cho mỗi lần đọc bộ nhớ đệm trên một triệu token, với cửa sổ ngữ cảnh 1.000.000 token, giới hạn đầu ra 65.000 token, các endpoint /v1/chat/completions và /v1beta/models/{model}:generateContent, và thời gian đến token đầu tiên p50 là 10,00 giây theo đo lường trên trang model của chúng tôi trong tuần vừa qua. Giá niêm yết của nhà cung cấp được chuyển nguyên với không cộng thêm phụ phí nào.

GPT-6 Sol không phải là một trong những tuyến của chúng tôi, vì vậy không có nội dung nào ở đây là tuyên bố về giá của nó thông qua chúng tôi.

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview), captured 23 September 2026, showing Vision, Audio, Tools, JSON and Reasoning header badges, 'by Google — 2026-02-19', a 65K-token maximum output, an input price of $2.00 and an output price of $12.00 per million tokens, a p50 time to first token of 10.00 seconds, and both the /v1/chat/completions and /v1beta/models/{model}:generateContent endpoints.

Một mô hình preview là ví dụ kinh điển cho việc định tuyến thay vì cam kết. Cả lý do nên thử Gemini 3.1 Pro Preview lẫn lý do không nên xây dựng một luồng production dựa trên nó đều là cùng một đặc tính — nó có thể thay đổi mà không báo trước — và một endpoint duy nhất với chuyển đổi dự phòng tự động chính là cách bạn tận dụng điều thứ nhất mà không phải chấp nhận điều thứ hai. Hình dạng của request không thay đổi khi mô hình phía sau nó thay đổi, nên đường dự phòng chỉ là một mục cấu hình chứ không phải một cuộc di trú. Điều đó ở đây quan trọng hơn so với hầu hết các cặp so sánh, bởi mô hình có khả năng thay thế mô hình này trong một chuỗi dự phòng cao nhất là một Flash mới hơn từ cùng nhà cung cấp, trên cùng key, với mức giá chỉ bằng một phần nhỏ giá đầu ra.

Quy tắc quyết định

• Đầu vào video, âm thanh hoặc định dạng hỗn hợp chỉ trong một lần gọi — Gemini 3.1 Pro Preview. Không có gì trong cột GPT-6 Sol chấp nhận tệp video, và không có mức chênh lệch giá nào bù đắp được cho một pipeline nhập liệu mà bạn phải tự xây dựng.

• Bất cứ thứ gì có kèm một cam kết về tính khả dụng — GPT-6 Sol. Sáu ngày tuổi, được cung cấp rộng rãi, mức giá công bố được mô tả là vĩnh viễn, và một nút điều chỉnh nỗ lực đã được ghi lại thành tài liệu. Đó chính là hình mẫu của thứ có thể lên lịch.

• Các lượt sinh dài — GPT-6 Sol, ở trần đầu ra chứ không phải ở mức giá. 128.000 token so với 65.000 mới là ràng buộc gây khó chịu trước tiên trong công việc tổng hợp, và nó gây khó chịu trước cả mức chênh lệch 20% về giá đầu ra.

• Đánh giá Gemini 3.1 Pro Preview — hãy thực hiện nó phía sau một đường chuyển đổi dự phòng, và tự đo tỷ lệ lỗi trước khi bạn định cỡ khối lượng công việc. Bảy tháng ở dạng xem trước với tỷ lệ lỗi hiển thị 77,6% trên trang được lưu trữ không phải là một công cụ đã ổn định.

• Nếu kế hoạch của bạn phụ thuộc vào việc mô hình này rẻ trong quý tới — thì không bên nào cả. Bản xem trước của Gemini có thể bị đổi giá hoặc ngừng cung cấp mà không báo trước, và mức giá của GPT-6 Sol chỉ mang tính vĩnh viễn theo nghĩa là OpenAI đã nói như vậy trong tuần này. Một mức giá cố định là một cam kết, không phải một bảo đảm; nó chỉ đơn thuần là một cam kết mạnh hơn so với cam kết mà một thẻ xem trước đưa ra.

So sánh trong bài viết này2

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày