Титульная карточка главного баннера с надписью «Gemini 4 Argon против GPT-6 Astra», с чипом «Индекс 52,6 против 52,7» и чипом «Стоимость за задачу индекса $1,99 против $3,26», а также строка нижнего колонтитула с надписью «Показатели Argon предоставлены производителем; показатели индекса и стоимости — по данным Artificial Analysis, 2026-09-30».
Guides & Insights

Gemini 4 Argon против GPT-6 Astra: ноздря в ноздрю по индексу и снижение цены на две трети

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Две передовые модели с разницей в 0,11 балла в Intelligence Index от Artificial Analysis. Gemini 4 Argon набирает 52,56. GPT-6 Astra набирает 52,67. Если бы вам пришлось выбирать между ними по измеренной общей способности, вы могли бы подбросить монету, и разница между двумя оценками меньше, чем доверительный интервал для любой из них. Это по-настоящему редкая ситуация на рынке, где десять лучших моделей охватывают в общей сложности около пятнадцати баллов, и это делает это противостояние Gemini 4 Argon самым простым для анализа, потому что аргумент о способностях заканчивается, не успев начаться, и всё, что остаётся, — это экономика и доступ.

Впрочем, эти две модели — не близнецы. Argon был анонсирован 30 сентября 2026 года компанией Google DeepMind и внедряется поэтапно, начиная с доверенных специалистов по киберзащите в программе Fairwind. GPT-6 Astra вышел в начале сентября — в нашей карточке каталога указана дата 2026-09-04, Artificial Analysis указывает 2026-09-03 — и это активный маршрут, который можно вызвать сегодня днём по цене $10 за вход и $50 за выход за миллион токенов, с контекстным окном в 1 050 000 токенов и потолком вывода в 128 000 токенов. У одной из этих моделей есть цена, по которой вам уже сегодня могут выставить счёт.

Где разрыв в 0,11 пункта реален, а где — шум

Индекс — это составной показатель, поэтому две модели с одинаковым значением по составному показателю могут содержательно различаться по его частям. Здесь части в основном согласуются, но есть три исключения, которые стоит назвать.

• Terminal-Bench 4.0 — GPT-6 Astra 59,1% против Gemini 4 Argon 57,1%. Astra впереди, но с небольшим отрывом.

• Рассуждение с длинным контекстом — GPT-6 Astra 80,7% против Gemini 4 Argon 79,7%.

• GPQA Diamond — GPT-6 Astra 96,1%. Argon не публикует никаких данных по этому бенчмарку.

• CritPt — GPT-6 Astra 31,7% против Gemini 4 Argon 27,1%.

• SciCode — Gemini 4 Argon 61,8% против GPT-6 Astra 56,5%.

• Humanity's Last Exam — Gemini 4 Argon 57,1% против GPT-6 Astra 54,7%.

• AutomationBench-AA — Gemini 4 Argon 77,5% против GPT-6 Astra 68,5%.

• GDPval — Gemini 4 Argon 1 611 против GPT-6 Astra 1 542.

• Omniscience — GPT-6 Astra 43,4 против Gemini 4 Argon 42,4.

• ITBench-SRE — GPT-6 Astra 48,6 % при отсутствии опубликованного показателя Argon.

• Скорость вывода — GPT-6 Astra 51,2 токена в секунду против Gemini 4 Argon 48,9. Практически на одном уровне.

• Задержка до первого токена на тестовом стенде index — Gemini 4 Argon: 2,8 секунды против GPT-6 Astra: 320,2 секунды.

Astra имеет преимущества в научных рассуждениях с множественным выбором, в задачах по физике критических точек и в бенчмарке SRE. Argon имеет преимущества в научном программировании, в более сложном наборе сквозных задач и в работе, оцениваемой по GDP. Ни одно из этих преимуществ не является достаточно большим, чтобы само по себе служить основанием для миграции.

A two-column scoreboard comparing Gemini 4 Argon and GPT-6 Astra on six dimensions. Gemini 4 Argon reads: AA Intelligence Index 52.6, price $2 / $10 per million tokens, cost per index task $1.99, output ceiling 1M tokens, first token 2.8 s, input modalities text, image, video and files. GPT-6 Astra reads: AA Intelligence Index 52.7, price $10 / $50, cost per index task $3.26, output ceiling 128K tokens, first token 320.2 s, input modalities text, image and files, with a note that its standard rate steps to $20 input and $75 output above 272K input tokens. A footer line reads that Argon figures are vendor-reported and both models' index and cost figures are per Artificial Analysis.

Вопрос задержки — это другое дело. 320 секунд до первого токена — это пять с половиной минут тишины, прежде чем будет выдан хоть какой-то результат, против менее трёх секунд у Argon. Оба измеряют одно и то же — время до первого чанка в прогонах индекса Artificial Analysis, — так что это сопоставимо. Рассуждения Astra всегда включены и настраиваются от низкого до максимального уровня усилий; запуск с максимальным уровнем усилий на сложной задаче действительно может размышлять минутами, прежде чем ответить. Является ли это недостатком, полностью зависит от вашего интерфейса. Для пакетной задачи это ничего не стоит. Для всего, где пользователь смотрит на индикатор загрузки, это самое заметное для пользователя различие между этими двумя моделями, большее, чем любой разрыв в бенчмарках на странице.

Шаг цены, который является настоящей темой

Именно здесь связь обрывается, и обрывается так, что это легко смоделировать неправильно, потому что тарифная сетка Astra состоит из трёх похожих друг на друга уровней.

• Стандартный тариф, до 272 000 входных токенов — GPT-6 Astra: $10.00 за вход / $50.00 за выход, чтение из кэша — $1.00, запись в кэш — $12.50.

• Длинный контекст, свыше 272 000 входных токенов — GPT-6 Astra: $20.00 за вход / $75.00 за выход, чтение из кэша — $2.00. По более высокому тарифу пересчитывается весь запрос, а не только превышение: 2× за вход и 1,5× за выход.

• Быстрый режим — в 2 раза выше применимого стандартного тарифа, то есть $20.00 на входе / $100.00 на выходе. Именно эту цифру $100 обычно приводят так, будто это тариф для длинного контекста; однако это не так.

• Gemini 4 Argon — $2.00 за ввод / $10.00 за вывод по единому тарифу на вводных условиях, кэшированный ввод — $0.10, без опубликованной ступени и без опубликованного быстрого тарифа.

Итак, Argon в пять раз дешевле на входе и в пять раз дешевле на выходе, чем стандартный тариф Astra, и в десять раз дешевле на входе при объёме выше 272K. Два независимых измерения затрат подтверждают тот же вывод с другой стороны: Artificial Analysis оценивает Argon в $1.99 за задачу индекса против $3.26 у Astra и в $2,407 за запуск всего индекса против $5,324 у Astra. Соотношение на задачу меньше, чем соотношение на токен, по той же причине, что и в случае с DeepSeek — Argon использует меньше токенов для завершения, — но оно всё равно составляет 1,6×.

Взвешенное по ВВП табло Vals рассказывает третью версию той же истории: Argon первый с 68,90% и $15,68 за запуск, Astra шестой с 63,13% и $18,46. Astra дороже и набирает меньше баллов там. В материалах Google прямо сказано, что это цена по вводному тарифу, а слово «вводный» означает, что она может измениться, и честный вывод таков: ценовое преимущество Argon реально, но его постоянство не гарантировано.

Два факта об архитектуре, которые значат больше, чем бенчмарки

A capture of the Google DeepMind blog post announcing Gemini 4 Argon, dated Sep 30 2026, credited to Koray Kavukcuoglu, SVP Google DeepMind and Chief AI Architect, with the standfirst describing frontier performance across real-world software engineering, enterprise knowledge work like legal and finance, and cybersecurity defense.

Сначала — потолок вывода. Gemini 4 Argon генерирует до 1 000 000 токенов за одну траекторию — в анонсе Google это отмечается как рост с 64K в предыдущем поколении. GPT-6 Astra ограничен 128 000. У обеих моделей контекстное окно около миллиона токенов, так что речь исключительно о том, сколько модель может написать за один раз. Для генерации длинных текстов, изменения кода полным патчем или составления документа за один проход это восьмикратная разница в том, что может выдать один вызов. Для чата, извлечения данных и коротких шагов агента оба потолка фактически бесконечны, и эта разница вам ничего не стоит.

Модальности — второй пункт, и здесь преимущество в одном отношении оказывается на другой стороне. GPT-6 Astra принимает текст, изображения и файлы. Gemini 4 Argon принимает текст, изображения, видео и файлы, а материалы запуска Google делают особый упор именно на понимании длинных видео — показатель LVBench 91,7%, заявленный производителем. Если ваш конвейер принимает видео, Astra не является заменой. Аудио также не указано в опубликованном списке модальностей Argon, поэтому не стоит предполагать, что обновление его поддерживает.

Что на самом деле делать

Astra доступна, а Argon — нет, и это определяет большинство решений на следующий месяц. Конкретный путь, который не тратит усилия впустую: стройте на GPT-6 Astra, если вашей нагрузке нужна постоянно работающая модель рассуждений с высокой научной точностью и подтверждённым опытом агентной работы; оставьте название модели в конфигурации; настраивайте тайм-ауты клиента исходя из измеренного поведения Astra, а не из оптимизма — прогон, в котором первый токен приходит через пять минут, приведёт к срабатыванию стандартного 60-секундного тайм-аута, а поток, обрывающийся на 300-й секунде, выглядит как сбой. Если вы чувствительны к стоимости при объёме входных данных выше 272K токенов, явно смоделируйте изменение цен, прежде чем принимать решение, потому что этот шаг удваивает стоимость ввода и на 50% увеличивает стоимость вывода на одной границе.

A capture of the OrcaRouter model page for OpenAI: GPT-6 Astra, showing the OpenAI provider, a release date of 2026-09-04, a 1,050,000-token context window, a 128,000-token maximum output, text, image and file input, and pricing of $10.00 input / $50.00 output per million tokens.

Интересный средний путь заключается в том, что вам не обязательно выбирать один-единственный вариант по умолчанию. Astra и Argon — когда Argon выйдет — это модели одинаковой формы, нацеленные на один и тот же класс задач, что делает их естественными партнёрами для отказоустойчивого переключения, а не претендентами на одно и то же место. В OrcaRouter openai/gpt-6-astra доступен по прейскурантной цене провайдера без наценки, на том же OpenAI-совместимом эндпоинте, что и ещё 200 с лишним других, с автоматическим переключением между провайдерами при сбое и DSL маршрутизации для описания схемы «основной и резервный» на одном ключе. Когда Argon присоединится к каталогу под тем id, который опубликует Google, переключение — это строка: никакого второго контракта, никакой интеграционной работы и никакой переделки того, что вы построили вокруг Astra за это время.

Что могло бы навсегда разрешить ничью?

Опубликованная цена Argon после окончания вводного периода и независимое воспроизведение агентных заявлений Google — показатель 77,9% в DeepSWE v1.1 и результат 68% в CWE-bench v1 — оба заявлены вендором, и ни за одним из них не стоит внешний прогон. Любой из этих факторов может существенно сдвинуть Argon вверх или вниз, потому что преимущество в индексе на 0,11 пункта не является буфером против 1,6-кратного проигрыша по стоимости, если ценовое преимущество окажется временным, и это не дефицит, если Google удержит вводный тариф, а тариф Astra с длинным контекстом в продакшене окажется более болезненным, чем ожидалось.

Пока что: по измеренной общей способности эти двое — одна и та же модель в двух обёртках. Astra — та, у которой есть действующий маршрут, известный ценовой шаг и пятиминутная пауза на размышление. Argon — та, у которой более дешёвая карта и нет эндпоинта. Ничья реальна, и одну из её сторон можно купить.

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube