Thẻ tiêu đề hero có nội dung "Gemini 4 Argon — tên này gắn với cái gì", với một thẻ được làm nổi bật duy nhất cho Gemini 4 Argon và bên dưới nó là danh sách các tạo tác tồn tại cho nó — bài đăng thông báo, trang dòng sản phẩm, bảng benchmark của nhà cung cấp, phương pháp đánh giá — bên cạnh một danh sách bị gạch bỏ gồm các tạo tác không tồn tại, với nội dung: không có ID mô hình, không có endpoint API, không có model card, không có cửa sổ ngữ cảnh được công bố, không có ngày GA, và một dòng chân trang ghi "Số liệu chỉ mục theo Artificial Analysis, bản sửa đổi v4.3.2; Argon không thể gọi được trên bất kỳ API công khai nào."
Guides & Insights

Gemini 4 Argon: Google đã công bố những gì, và cái tên này gắn với điều gì

Tác giả

Elias Hawthorne

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Gemini 4 Argon là Gemini 4 duy nhất hiện có. Câu đó nghe có vẻ tầm thường cho đến khi bạn tính ra giá trị của nó, và việc tính ra giá trị của nó chính là mục đích của trang này. Goog​le đã công bố Gemini 4 Argon vào ngày 30-09-2026, trong một bài đăng trên DeepMind được ghi công cho Koray Kavukcuoglu; đây là tên mô hình thật trên một trang chính thức của chính nhà phát triển, nó đã được Artificial Analysis đo với Chỉ số Thông minh là 52,56 ở bản sửa đổi v4.3.2, và nó nằm trong khoảng nửa điểm so với GPT-6 Astra ở 52,67 và Claude Fable 5.1 ở 53,35 — trong khi thấp hơn năm điểm so với Claude Opus 5.5 ở 57,62 và Claude Sonnet 5.5 ở 56,00, và trong khoảng một điểm so với GPT-6.1 Sol ở 51,83. Điều nó không có chính là thứ mà mọi đối thủ trong số đó đều có: một mã định danh mô hình mà bạn có thể đưa vào một yêu cầu.

Vậy nên câu trả lời trung thực gói gọn trong một dòng cho câu hỏi "Gemini 4 Argon là gì" là: đó là một mô hình mà Google đã công bố và đã đo điểm chuẩn nhưng chưa cho phép gọi, rằng cái tên này gắn với một đợt triển khai có kiểm soát chứ không phải một sản phẩm, và rằng "Gemini 4" tự nó chẳng gắn với bất cứ thứ gì. Cả hai vế của câu đó đều có thể kiểm chứng từ terminal, và đó là lý do trang này kiểm chứng chúng thay vì chỉ khẳng định suông.

Tên là thật. Sản phẩm thì không.

Hãy bắt đầu với những gì một kiểm tra thực thể thực sự trả về. Tính đến ngày 8 tháng 10 năm 2026, trang gia đình của Google tại deepmind.google/models/gemini/ hiển thị Gemini 4 Argon là thẻ dẫn đầu, dưới khẩu hiệu “Kỷ nguyên trí tuệ tiên phong tiếp theo của chúng tôi”, với phần mô tả năng lực nêu tên kỹ thuật phần mềm, công việc tri thức doanh nghiệp trong lĩnh vực pháp lý và tài chính, cùng an ninh mạng phòng thủ. Bài đăng công bố tồn tại trên đường dẫn blog.google/innovation-and-ai/models-and-research/gemini-models/. Có một trang về dòng mô hình. Có một bảng đánh giá chuẩn của nhà cung cấp gồm mười chín hàng. Có một PDF phương pháp đánh giá dài năm trang. Đó là một dấu vết giấy tờ đáng kể, và nó nhiều hơn những gì một vụ rò rỉ có được.

Bây giờ hãy liệt kê những gì còn thiếu trong đó, bởi vì danh sách những thứ còn thiếu chính là bài viết.

• Một ID model — danh sách model của Gemini API không có bất kỳ lần xuất hiện nào của “argon” và không có bất kỳ lần xuất hiện nào của “gemini-4”. Các định danh mới nhất được tài liệu của Google công nhận là dòng 3.8.

• Một endpoint hoặc mức giá mà bạn có thể bị tính phí — mức 2 đô cho đầu vào / 10 đô cho đầu ra trên mỗi triệu token trong thông báo là mức giá giới thiệu cho một đợt triển khai vẫn chưa tiếp cận được khách hàng trả phí.

• Một thẻ mô hình hoặc thẻ hệ thống — chỉ mục thẻ mô hình của DeepMind không có dòng Argon, và đường dẫn thẻ mô hình của dòng họ này trả về 404.

• Một cửa sổ ngữ cảnh — Google đã công bố giới hạn đầu ra là 1 triệu token, tăng từ mức trần 64K trước đó, và không công bố phần đầu vào của cặp đó. Artificial Analysis ghi nhận 1M cho mô hình mà họ đo.

• Một ngày phát hành chính thức — thông báo mô tả một đợt triển khai theo từng giai đoạn mà không có ngày nào cho bất kỳ giai đoạn nào sau giai đoạn đầu tiên.

• Một số lượng tham số, điều mà Google chưa công bố cho bất kỳ Gemini nào.

Quá trình triển khai mà Google mô tả diễn ra theo ba giai đoạn không nêu rõ thời lượng. Thứ nhất, một nhóm hữu danh gồm các chuyên gia phòng thủ mạng thông qua Chương trình Fairwind. Thứ hai, khách hàng API trả phí và người đăng ký Google AI Ultra. Thứ ba, nhà phát triển, doanh nghiệp và người tiêu dùng. Chỉ giai đoạn đầu là đang hoạt động theo bất kỳ nghĩa nào mà người đọc có thể xác minh, và Google không gắn mốc thời gian nào cho giai đoạn hai và ba. Đó không phải là một chú thích nhỏ. Đó là sự khác biệt giữa một mô hình và một đồng hồ đếm ngược.

A screenshot of Google's Gemini 4 Argon announcement post, showing the headline and the byline for Koray Kavukcuoglu, SVP Google DeepMind and Chief AI Architect, above the intro pricing line of $2 per million input tokens and $10 per million output tokens with cached input at 95 percent off, and the line stating an output limit of 1 million tokens, up from the previous 64K ceiling.

Bảng của chính Google tuyên bố điều gì, và ai thực sự đã đo lường điều đó

Trang giới thiệu dòng sản phẩm của Google có một bảng đánh giá chuẩn gồm bốn cột với Gemini 4 Argon, GPT-6 Astra, Claude Fable 5.1 và Claude Opus 5.5. Bảng này đáng để đọc, và đáng để đọc trong khi vẫn để tâm đến nguồn gốc xuất xứ của số liệu, bởi vì Google công bố nguồn gốc đó trong tệp PDF về phương pháp luận, và việc công bố ấy làm thay đổi mức độ mà bảng có thể chuyên chở được.

Các tuyên bố, được ghi nhãn là của Google: Argon dẫn đầu trên Vals Index ở mức 68,9 so với 67,0 của Opus 5.5 và 65,8 của Fable 5.1; trên AutomationBench ở mức 51,3 so với 42,5, 31,4 và 41,4; trên Vals Finance Agent v2 ở mức 65,4; trên Harvey’s Legal Agent Benchmark ở mức 19,6 so với 3,8, 6,7 và 5,4 — khoảng cách gấp bốn đến năm lần; trên DeepSWE v1.1 ở mức 77,9 so với 74,2, 67,4 và 74,1; trên Vibe Code Bench ở mức 91,9, một mức chênh 1,6 điểm; trên LABBench 2 ở mức 88,8 so với 73,1, 68,6 và 85,4; trên RiemannBench ở mức 76,0; trên cả hai dòng GraphWalks, 99,7 ở ≤128k và 84,2 ở 256k–1M; trên Agent’s Last Exam ở mức 39,5; trên Terminal-Bench Science 0.1 ở mức 57,6; trên Chartography ở mức 71,6; và trên LVBench ở mức 91,7, đạt mức tiên tiến nhất.

Và nó thua ngay trên trang của Google: FrontierSWE v2 đạt 55,0 so với 65,5 của Astra và 62,3 của Opus 5.5; Terminal-bench 4.0 đạt 57,4 so với 66,4 của Opus 5.5; PostTrainBench đạt 45,3 so với 49,3 của Opus 5.5; và OSWorld-2.0 đạt 69,2 so với 72,6 của Astra. CWE-bench v1 hòa với Astra ở mức 68,0.

Dòng xuất xứ quan trọng hơn bất kỳ hàng đơn lẻ nào. Phương pháp luận của Google nêu rằng kết quả là pass@1, một lần thử, ở cài đặt suy nghĩ cao nhất, và — điều then chốt — rằng các số liệu không phải Gemini trong bảng đó là những con số do chính các nhà cung cấp tự báo cáo, với GPT-6 Astra, Claude Fable 5.1 và Claude Opus 5.5 được lấy ở mức suy nghĩ tối đa khi có sẵn. Một bảng của nhà cung cấp mà các cột đối thủ là thông cáo báo chí của chính các đối thủ là một tài liệu hữu ích, nhưng nó không phải là một so sánh có kiểm soát. Mỗi một hàng trong số đó đều do Google báo cáo, và một số trong đó là Google báo cáo lại những gì người khác đã báo cáo. Hãy xử lý các mức chênh lệch, không chỉ các giá trị, cho phù hợp.

Một mô hình, ba chỉ số, và vì sao tất cả chúng đều đúng

Vị thế độc lập của Argon thú vị hơn một con số đơn lẻ, bởi vì con số ấy thay đổi tùy vào nơi bạn đọc nó, và sự thay đổi đó không phải là lỗi.

Artificial Analysis đo Gemini 4 Argon (High) ở mức 52,56 trên bản sửa đổi v4.3.2 của Chỉ số Thông minh của mình. Cùng chỉ số đó xếp Claude Opus 5.5 ở mức 57,62, Claude Sonnet 5.5 ở mức 56,00, Claude Fable 5.1 ở mức 53,35, GPT-6 Astra ở mức 52,67, GPT-6.1 Sol ở mức 51,83 và Gemini 3.8 Flash ở mức 40,93. Trong thứ tự hiển thị trên bảng xếp hạng, khoảng mười mô hình đứng đầu nén lại trong khoảng sáu điểm chỉ số, và Argon nằm trong cụm chen chúc đó chứ không phải bên dưới.

Rồi người đọc nhìn thấy một con số thứ hai — 53 — trong phần hiển thị đã làm tròn của bảng xếp hạng, và thêm một con số thứ ba nếu họ so sánh với một cấu hình khác của một mô hình cùng dòng, rồi kết luận rằng một trong các nguồn là sai. Không nguồn nào sai cả. Con số 53 đã làm tròn chính là cùng một phép đo với 52.56. Điều khác biệt giữa các cấu hình là mức độ nỗ lực suy luận: Artificial Analysis đo mỗi mô hình ở nhiều mức nỗ lực khác nhau, và cùng một mô hình ở mức nỗ lực cao hơn có thể chênh lệch vài điểm. Đó là lý do bảng xếp hạng liệt kê Opus 5.5 thành bốn lần riêng biệt, ở các mức 58, 56, 54 và 51. Argon xuất hiện một lần, ở mức nỗ lực cao, vì đó là cấu hình duy nhất mà Google đã công bố để đo. Nếu Google phát hành một bậc Argon với mức suy luận tối đa, dòng đó sẽ thay đổi, và điều trung thực nhất để nói về nó hôm nay là nó vẫn chưa thay đổi.

Ba số liệu độc lập khác của Argon đáng để ghi nhớ, tất cả đều đến từ Artificial Analysis và đều được đo trên cấu hình (Cao). Tốc độ đầu ra là 60,69 token mỗi giây (trung vị). Thời gian đến token trả lời đầu tiên là 2,92 giây (trung vị). Chi phí cho mỗi tác vụ Chỉ số Thông minh — điểm chỉ số được chuẩn hóa theo lượng token bỏ ra để đạt được nó — là 1,99 đô la. Con số cuối cùng đó là con số cần giữ lại, vì đây là chỗ vị thế của Argon trở nên không thoải mái: Opus 5.5 đạt điểm cao hơn năm điểm và tốn 5,98 đô la mỗi tác vụ Chỉ số, nên Argon rẻ hơn ba lần trên mỗi đơn vị năng lực được đo. Nhưng GPT-6.1 Sol đạt điểm thấp hơn nửa điểm và tốn 0,72 đô la, tức khoảng một phần ba con số của Argon. Argon không phải là lựa chọn đáng giá trong chính dải chỉ số của nó. Nó ở giữa dải đó.

Có thêm hai kết quả đọc độc lập nữa mà một người đọc cẩn thận không nên nhầm lẫn với nhau. Artificial Analysis ghi nhận con số AutomationBench của Argon là một phần điểm số 0,7751 trên thang 0–1, trong khi bảng của Google báo cáo 51,3 trên 100 trên bảng AutomationBench. Đó không phải là cùng một chỉ số, và việc đặt chúng cạnh nhau chính là kiểu so sánh tạo ra một con số bịa đặt. Cũng cần thận trọng tương tự với các nhóm công việc tri thức trong bảng của nhà cung cấp: “dẫn đầu về công việc tri thức” là tóm tắt của Google về bảng của chính Google.

Trang “Gemini 4” nào mà bạn thực sự đang tìm kiếm?

Đây là sự nhầm lẫn mà cái tên gây ra, và thật đáng để làm rõ ở một chỗ, vì blog hiện đã viết về năm thứ “Gemini 4” khác nhau và chúng không phải là các biến thể của cùng một bài viết.

• Nếu bạn muốn ngày phát hành và lộ trình triển khai — khi Argon được công bố, việc triển khai theo từng giai đoạn là gì, và các bảng xếp hạng đấu trường đã làm gì với nó — thì đó là bài viết về ngày phát hành, tức bài nắm giữ mốc thời gian và các chỉ số từ Text Arena và Code Arena.

• Nếu bạn muốn biết “Gemini 4 Argon là một bậc hay một mô hình”, và liệu có tồn tại Gemini 4 Ultra hay không — thì đây là bài về định vị theo bậc, đọc ra thang bậc từ chính các đường dẫn của Google và giải thích vì sao đường dẫn Ultra lại dẫn đến một trang đăng ký thuê bao.

• Nếu bạn muốn bản thân câu hỏi đặt tên, thì lập luận rằng trong “Gemini 4” và “Gemini 4 Argon” đúng một cái là một mô hình và một cái là tiền tố thế hệ không có ID mô hình, không có endpoint và không có giá — đó là cuộc đối đầu trực diện giữa hai cái tên Google.

• Nếu bạn muốn kết quả FrontierSWE v2 ở vị trí thứ ba cùng với quan sát về tính tự phê bình đi kèm với nó, thì đó chính là phần đánh giá FrontierSWE.

• Nếu bạn muốn Argon đối đầu với một đối thủ cụ thể trên các con số, thì trên trang web có mười ba trang so sánh bao quát dải frontier, và đó chính là nơi phù hợp để đọc so sánh hai mẫu máy.

Điều mà không trang nào trong số đó là, và điều mà trang này là, chính là cột trụ: nơi duy nhất nói lên thực thể này là gì, mỗi con số gắn với nó có nghĩa gì và không có nghĩa gì, và hôm nay bạn thực sự có thể làm gì với nó. Trang liên quan “Gemini 4 vs Gemini 4 Argon” đã trình bày đầy đủ lập luận về cách đặt tên và trang này sẽ không nhắc lại. Mọi thứ bên dưới đều mới.

A screenshot of the Artificial Analysis page for Gemini 4 Argon, showing the model name and the line reading released September 2026, a proprietary reasoning model with a 1M token context window, and the statement that it is available via API through 1 provider — with the provider count identifiable in artificial analysis's own hosting panel rather than named in this description.

Áp lực mà vẫn chưa cho chúng ta biết bất cứ điều gì

Hai trong số những tín hiệu mạnh nhất trong câu chuyện Argon đều chỉ về một bản phát hành dành cho nhà phát triển sắp diễn ra, và cả hai đều không phải là bằng chứng cho thấy một bản phát hành dành cho nhà phát triển đã xảy ra.

Điều đầu tiên là các bề mặt API của chính Google đã tiến lên mà không có Argon. Mục mới nhất trong nhật ký thay đổi API Gemini là ngày 6 tháng 10 năm 2026 — Gemini Nano Banana 2.1 chính thức khả dụng, dưới định danh gemini-nano-banana-2.1. Nói cách khác, trong tám ngày kể từ khi Argon được công bố, Google đã chọn một quy ước đặt tên cho một mô hình Gemini đang được dùng trong môi trường sản xuất và phát hành một định danh GA cho một mô hình khác, và gemini-4 vẫn là không gian tên trống. Một mô hình có đợt triển khai thực sự sẽ để lại dấu vết trên nhật ký thay đổi. Mô hình này thì chưa để lại dấu vết nào.

Thứ hai là cách định khung về an ninh quốc gia. Google tuyên bố rằng họ “đang tích cực tham gia vào quy trình tự nguyện của chính phủ Hoa Kỳ về việc tiếp cận mô hình trước khi phát hành”, và giai đoạn triển khai đầu tiên là một nhóm phòng vệ mạng được nêu tên. Điều đó nhất quán với một đợt phát hành theo từng giai đoạn, trong đó nhóm đối tượng có năng lực tiên phong nhận được mô hình trước khi API công cộng có được nó, và nó cũng nhất quán không kém với việc mô hình đơn giản là chưa sẵn sàng cho lưu lượng truy cập chung. Không có gì trong cách định khung này cho bạn biết đó là trường hợp nào. Bất kỳ ai nói rằng nó cho biết thì đều đang đoán mò, và Google vẫn chưa ấn định ngày cho giai đoạn API để giải quyết điều đó.

Những gì bạn có thể gọi hôm nay, và những gì bạn không thể

Đây là phần của trang bị lỗi thời nhanh nhất, nên nó mang theo ngày tháng của mình. Tính đến ngày 8 tháng 10 năm 2026, API mô hình OrcaRouter trả về HTTP 404 đối với google/gemini-4-argon. Nó không nằm trong các tuyến của chúng tôi. Cũng không phải là google/gemini-4, cũng không phải là google/gemini-4-argon-high, cũng không phải là google/gemini-4-pro — không có định danh nào trong số đó phân giải được, bởi vì không có cái nào trong số chúng tồn tại như một mô hình có thể gọi được ở bất kỳ đâu.

Hôm nay trên các tuyến đường của chúng ta có gì, từ cùng một nhà cung cấp, và mỗi thứ có giá bao nhiêu theo giá niêm yết của nhà cung cấp:

• google/gemini-3.8-flash — phát hành ngày 2026-09-02, cửa sổ ngữ cảnh 1.048.576 token và đầu ra tối đa 65.536 token, với giá $0,75 cho đầu vào và $3,75 cho đầu ra trên mỗi triệu token. Đây là mô hình mà Argon rốt cuộc sẽ được đem ra so sánh bởi những người sở hữu thẻ tín dụng, và nó là thứ gần nhất với một khối lượng công việc tương tự Argon mà bạn có thể chạy ngay chiều nay.

• google/gemini-3.6-flash — phát hành ngày 21/07/2026, với mức giá $0,75 và $3,75.

• google/gemini-3.5-flash — phát hành ngày 2026-05-23, với giá $1.50 và $9.00.

• google/gemini-3.5-flash-lite — phát hành ngày 2026-07-21, với giá $0.30 và $2.50.

• google/gemini-3.1-flash-lite — với giá $0,25 và $1,50.

• google/gemini-3.1-pro-preview — phát hành ngày 2026-02-19, với mức giá $2.00 và $12.00. Đây là Gemini duy nhất ở vị trí Pro mà bạn có thể gọi, và nó tụt hậu ba thế hệ rưỡi so với mẫu mới nhất của dòng Flash.

Tất cả những mô hình đó chạy trên cùng một khóa như các mô hình tiên tiến Claude và OpenAI trong cùng chỉ số — Claude Opus 5.5, Claude Sonnet 5.5, Claude Fable 5.1, GPT-6 và GPT-6.1 Sol đều nằm trong cùng nhóm — nghĩa là điều thú vị về vị thế của Argon là ở chỗ nó có thể được đo lường mà không cần Argon. Nếu bạn muốn biết 52 điểm chỉ số của công việc tri thức cảm giác ra sao ở mức một nửa giá, hôm nay bạn có thể đo lường điều đó với google/gemini-3.8-flash ở mức 40.93, và nếu bạn muốn đỉnh của dải, bạn có thể đo Claude Opus 5.5 ở mức 57.62 cùng ngày, trong cùng tài khoản, mà không cần hợp đồng thứ hai và không cần thay đổi mã. Đó là điểm của toàn bộ bài viết: một API cho hơn 200 mô hình, 0% phụ phí theo cơ chế chuyển tiếp nguyên giá, việc nhà cung cấp giảm giá đến với bạn ngay trong ngày, và tự động chuyển đổi dự phòng giữa các mô hình cho ngày một mô hình bạn phụ thuộc ngừng phản hồi. Chúng tôi mô tả điều đó ở đây vì nó đúng với Gemini 3.8 Flash mà bạn có thể gọi, không phải vì nó nói lên điều gì về Argon. Argon không nằm trong số đó.

Nếu bạn muốn chính Argon, thì hiện tại lựa chọn của bạn là nhóm cyber-defender của Fairwind và chờ đợi. API của chính Google không phục vụ nó, chúng tôi cũng không, và không tuyến bên thứ ba nào có thể phục vụ một mô hình không có mã định danh để định địa chỉ.

Những câu hỏi còn bỏ ngỏ, và chính xác điều gì sẽ giải đáp chúng

Bốn điều vẫn chưa được giải quyết, và mỗi điều đều có một dấu hiệu kích hoạt cụ thể, có thể kiểm chứng. Giữ danh sách đó ngắn gọn chính là mục đích — một trang như thế này chỉ hữu ích khi nó vẫn còn có thể bị phản bác.

• Argon có nhận được mã định danh API Gemini không? Hãy theo dõi danh sách mô hình API để tìm bất kỳ ID có tiền tố gemini-4. Ngay khi một ID như vậy xuất hiện, câu hỏi về giá trở thành hiện thực và mức giá giới thiệu $2 / $10 trở thành một con số mà bạn có thể bị tính phí dựa vào, thay vì chỉ là một con số trong bài blog. Cũng hãy theo dõi liệu mức giá giới thiệu có tồn tại đến giai đoạn API hay không, và liệu nó có tăng lên $4 / $20 hay ở một mức nào khác.

• Cấu hình được đo có thay đổi không? Argon được đo ở một mức suy luận duy nhất và đạt 52,56. Nếu Google công bố một cấu hình đòi hỏi nỗ lực cao hơn, con số đó sẽ thay đổi; những đối thủ mà nó đang bám đuổi đều được liệt kê ở hai đến bốn mức nỗ lực, vì vậy việc Argon chỉ được liệt kê một lần là một dữ kiện về tính khả dụng, chứ không phải về giới hạn trần của mô hình.

• Các tuyên bố về pháp lý và tài chính có trụ vững qua một lần chạy độc lập không?Harvey’s Legal Agent Benchmark ở mức 19.6 so với 3.8 của một đối thủ, và Vals Finance Agent v2 ở mức 65.4 dẫn đầu lĩnh vực, là hai mức chênh lệch tương đối lớn nhất trong bảng của Google. Chúng cũng là hai dòng có khả năng được chạy lại cao nhất bởi một người không làm việc cho Google. Mức chênh lệch gấp bốn đến năm lần trên một benchmark chuyên ngành hoặc là câu quan trọng nhất trong thông báo, hoặc là một khác biệt về harness, và cách để biết là theo dõi xem có một lần chạy thứ hai hay không.

• Có một mô hình anh em nào không? Bài đăng công bố của Argon không nêu tên một dòng mô hình nào, không hé lộ trước một bản Pro và cũng không hé lộ trước một bản Ultra. Một đường dẫn gemini-4-* thứ hai, một cột thứ hai, hoặc một mục thẻ mô hình — mỗi thứ đều sẽ lật ngược cách hiểu đó trong vòng một ngày. Bài viết về định vị theo hạng liệt kê đầy đủ các phản chứng.

Điểm mấu chốt

Gemini 4 Argon là một mô hình tiên phong đích thực với một bảng điểm chuẩn đích thực và điểm chỉ số đích thực là 52.56 từ Artificial Analysis — và nó không phải là một sản phẩm, theo nghĩa cụ thể rằng không tồn tại mã định danh mô hình, endpoint, thẻ mô hình, cửa sổ ngữ cảnh hay ngày phát hành chung (general availability) nào cho nó, và cả tài liệu của chính Google lẫn các dịch vụ đo lường bên thứ ba đều đồng ý rằng chính xác một nhà cung cấp vận hành nó. “Gemini 4” trong tên nó là một nhãn thế hệ; “Argon” là phần gắn với mô hình. Nếu bạn đang chọn thứ gì đó để xây dựng trong tháng này, quyết định không liên quan đến Argon: nó liên quan đến Gemini 3.8 Flash mà bạn có thể gọi ngay hôm nay với giá $0.75 / $3.75 và các mô hình tiên phong trong cùng dải chỉ số nằm trên cùng một khóa. Hãy đọc lại trang này khi một mã định danh gemini-4 xuất hiện trong danh sách API. Cho đến lúc đó, mọi thứ về Argon đều là tuyên bố mà Google đưa ra về một mô hình mà không ai ngoài nhóm đầu tiên có thể truy cập.

A single-column comparison scoreboard titled "Gemini 4 Argon vs Gemini 3.8 Flash — the scoreboard", with the left column headed Gemini 4 Argon showing rows reading Artificial Analysis Index: 52.6, Context window: 1M (output limit 1M), Price: $2 in / $10 out intro, Cost per Index task: $1.99, Callable via API: No — gated rollout, and Supplier count: 1, and the right column headed Gemini 3.8 Flash showing the same six dimension labels with Artificial Analysis Index: 40.9, Context window: 1,048,576, Price: $0.75 in / $3.75 out, Cost per Index task: $1.24, Callable via API: Yes, and Supplier count: on our routes, with a footer line reading "Argon index, price and cost-per-task figures per Artificial Analysis, v4.3.2 revision; Argon availability verified 2026-10-08."

So sánh trong bài viết này3

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày