
GPT-6 Luna против Gemini 3.1 Pro: семимесячная предварительная версия по двадцатикратной цене за ввод
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Фронтирная модель рассуждений носит метку «Preview» с тех пор, как Gemini 3.1 Pro была запущена 19 февраля 2026 года. Семь месяцев спустя она всё ещё в статусе preview, всё ещё по цене $2,00 за миллион входных токенов и $12,00 за миллион выходных, и всё ещё то, что страница продукта называет фронтирной моделью рассуждений компании. 22 сентября 2026 года вендор выпустил GPT-6 Luna в качестве общедоступного (GA) малого уровня по цене $0,10 и $0,50. Сравните две тарифные карты, и более новая, более дешёвая GA-модель в двадцать раз дешевле на входе и в двадцать четыре раза дешевле на выходе — и она набирает более высокий балл по независимому индексу, который важен для отделов маркетинга обоих вендоров.
Вот на последнем пункте стоит задержаться. GPT-6 Luna при максимальном усилии набирает 37 баллов в Artificial Analysis Intelligence Index. Gemini 3.1 Pro Preview в той же версии набирает 30. Модель, которую позиционируют как экономичное решение для больших объёмов, на семь пунктов опережает модель, которую позиционируют как передовую систему рассуждений, при цене за входные данные в двадцать раз ниже. Это не случай, когда дешёвая модель догоняет дорогую. На этой конкретной оси дешёвая модель просто впереди, а дорогая уже семь месяцев находится в статусе предварительной версии.
Естественный вывод — что Gemini 3.1 Pro переоценена — тоже не совсем верен, а в остальной части этого текста речь пойдёт о трёх областях, где модель Google оправдывает свой тариф, потому что они реальны и отнюдь не малы.
Пять вещей, которые решают всё
Прежде чем перейти к деталям — краткая версия:
• GPT-6 Luna выигрывает по цене примерно в 20 раз на входе и в 24 раза на выходе, по кэшированному вводу — с большим отрывом, а по индексу общего назначения — на семь пунктов при сопоставимом максимальном усилии.
• Gemini 3.1 Pro выигрывает по входной модальности — он принимает аудио и видео, чего GPT-6 Luna не делает, — и по тому, что был доступен уже семь месяцев, что для превью является долгой историей эксплуатации в продакшене.
• Предельные объёмы вывода далеки друг от друга: GPT-6 Luna выдаёт до 128 000 токенов, Gemini 3.1 Pro — до 65 000.
• Оба имеют границу тарифного уровня для длинного контекста, из-за которой пересчитывается стоимость всего запроса: при 272 000 входных токенов для GPT-6 Luna и примерно 200 000 для Gemini 3.1 Pro.
• Ловушка усилия по умолчанию применима только к Luna: её 37 — это оценка при максимальном усилии, а стандартная средняя настройка даёт 29, что ниже 30 у Gemini 3.1 Pro.
Две тарифные карты и арифметика между ними
По одной строке на каждое измерение, обе стороны — на каждом:
• Ввод за 1 млн — GPT-6 Luna $0.10 против Gemini 3.1 Pro $2.00
• Вывод за 1M — GPT-6 Luna $0.50 против Gemini 3.1 Pro $12.00
• Кэшированный ввод — GPT-6 Luna $0,01 за 1 млн, скидка 90% по сравнению с Gemini 3.1 Pro $0,20 за 1 млн, скидка 90%
• Граница длинного контекста — GPT-6 Luna при более чем 272 тыс. входных токенов против Gemini 3.1 Pro при примерно более 200 тыс. входных токенов
• Эффект длинного контекста — GPT-6 Luna: 2x за вход и кэш, 1.5x за выход, на весь запрос, против Gemini 3.1 Pro: $4.00 за вход / $18.00 за выход, также на весь запрос
• Окно контекста — GPT-6 Luna 1 050 000 токенов против Gemini 3.1 Pro 1 млн токенов
• Максимальный объём вывода — GPT-6 Luna 128 000 токенов против Gemini 3.1 Pro 65 000 токенов
• Модальность ввода — GPT-6 Luna: текст и изображения, а Gemini 3.1 Pro: текст, изображения, аудио, видео и файлы
• AA Intelligence Index — GPT-6 Luna: 37 при максимальном усилии, 29 при настройке по умолчанию, против 30 у Gemini 3.1 Pro
• Скорость вывода — GPT-6 Luna 153,9 токенов/с против примерно 115–143 токенов/с у Gemini 3.1 Pro в зависимости от снапшота
• Выключатель рассуждений — GPT-6 Luna: от none до max против Gemini 3.1 Pro, ориентированного на рассуждения; режим без рассуждений не предоставляется
• Статус — GPT-6 Luna общедоступна с 2026-09-22, тогда как Gemini 3.1 Pro находится в предварительном доступе с 2026-02-19

Интересна не строка с ценой. Интересна пара строк внизу. Метка preview у Gemini 3.1 Pro — не формальность: она меняет обязательства Google перед вами. Модель в статусе preview можно изменить, переоценить или отозвать без уведомления о прекращении поддержки, которое получает GA-модель, а цена, не менявшаяся семь месяцев, — это обещание, которого никто не давал в письменной форме. Всё нижеследующее о том, что модель Google — более безопасный вариант для продакшена, нужно читать с учётом этой оговорки, потому что «семь месяцев стабильности» и «семь месяцев без гарантии стабильности» — это одни и те же семь месяцев.
Где модель Google оправдывает двадцатикратную доплату
Три места, и первое — это то, что для некоторых команд сразу ставит точку в сравнении.
Модальность. Gemini 3.1 Pro принимает аудио- и видеовход. GPT-6 Luna — текст и изображения. Если ваш конвейер обрабатывает записи звонков, снимки экрана или видео, то не существует такого варианта этого противостояния, где разница в цене имела бы значение, потому что одна из двух моделей просто не способна выполнить задачу. Это не разрыв в результатах бенчмарков, который сократится с точечным релизом; это возможность, которая либо есть, либо её нет, и это самая весомая причина, по которой тарифная сетка Google выдерживает столкновение с реальной закупкой.
Потолок вывода — в обратную сторону. Ограничения вывода работают противоположно входной модальности, и здесь преимущество у OpenAI. GPT-6 Luna выдаёт до 128 000 токенов в одном ответе; Gemini 3.1 Pro — до 65 000. Если вы генерируете длинные структурированные артефакты — полный документ, крупный рефакторинг, патч для нескольких файлов, — потолок Google примерно вдвое ниже, чем у OpenAI, а конвейер, обрезающий результат на 65 000 токенов, сломан независимо от того, сколько он платит за токен.
Работа на переднем крае мультимодальности. Gemini 3.1 Pro позиционируется как модель рассуждений, которая к тому же является мультимодальной, и практическое следствие этого в том, что задачи, требующие рассуждений над диаграммой, графиком или видеозаписью экрана, попадают к ней, а не к ориентированному в первую очередь на текст малому классу. GPT-6 Luna принимает изображения, так что граница проходит не только по аудио и видео — дело в том, что модель Google создана для визуальных и аудиорассуждений как основного сценария использования, а модель OpenAI — для пропускной способности.
В чём дешёвый тариф на самом деле проигрывает — и это не там, где вы ожидаете.
Ловушка в этой паре — это настройка усилий по умолчанию, и здесь она бьёт больнее, чем если бы соперник был слабее. Заявленный показатель индекса GPT-6 Luna, равный 37, измеряется при максимальных усилиях рассуждения. По умолчанию у неё средний уровень, и на среднем она набирает 29 — на один пункт ниже 30 у Gemini 3.1 Pro. Так что преимущество в семь пунктов, с которого началась эта статья, — это сравнение потолка одной модели с потолком другой, а команда, которая устанавливает GPT-6 Luna и оставляет конфигурацию без изменений, работает с моделью, которая совсем немного уступает модели Google, на семь месяцев старше, всё ещё в предварительном доступе, при цене в двадцать раз ниже.
Для большинства рабочих нагрузок это всё ещё правильный компромисс — один пункт индекса не означает разницы в возможностях, а двадцатикратный разрыв в цене — означает. Но это не тот компромисс, который рекламируют тарифные карты, и он незаметен, если специально не искать параметр effort.
Второе, в чём дешёвый тариф проигрывает, — это арифметика длинного контекста. Обе модели заново рассчитывают стоимость всего запроса, как только он пересекает порог, вместо того чтобы начислять надбавку за превышение, и оба порога достаточно низки, чтобы иметь значение: 272 000 входных токенов у GPT-6 Luna, примерно 200 000 у Gemini 3.1 Pro. Условие GPT-6 Luna удваивает стоимость ввода и кэша и увеличивает стоимость вывода в полтора раза. Условие Gemini 3.1 Pro переводит весь вызов на $4.00 за ввод и $18.00 за вывод. Ни то, ни другое не является небольшой надбавкой, а для модели, чей главный аргумент — цена, это условие и есть цена.
Третья — это многословность, статья расходов, которая никогда не появляется в тарифной сетке. Artificial Analysis измерила, как GPT-6 Luna генерирует 150 млн выходных токенов за прогон по индексу при медиане 85 млн — модель болтлива, и при $0.50 за миллион выходных токенов это $75 токенов там, где лаконичная модель потратила бы $42.50. Это всё ещё на порядок дешевле альтернативы. Это также причина, по которой показатели стоимости за задачу и стоимости за токен рассказывают разные истории, и причина измерить собственный объём выходных данных, прежде чем моделировать экономию.
Как выглядит миграция между ними
Модель Google доступна через API самого поставщика и несколько сторонних платформ; GPT-6 Luna доступна через API самой OpenAI, и на момент написания ни одна из них не представляет собой более простую половину этой пары, на которой можно было бы стандартизироваться. Обе предоставляют совместимый с OpenAI интерфейс chat completions, а это значит, что проблема не в форме вызова — проблема в параметрах. Лестница усилий GPT-6 Luna, её оговорка о 272 000 токенах и требование, чтобы function calling в Chat Completions выполнялся при значении reasoning effort, установленном в none, — всё это поведение, не свойственное Gemini 3.1 Pro; а перенос, при котором меняется только строка модели, даст работающий вызов с неверным профилем стоимости.
Gemini 3.1 Pro Preview доступен на OrcaRouter по каталожной цене Google, в рамках сквозного ценообразования, при котором изменение тарифов Google вступает в силу на нашей стороне в тот же день. GPT-6 Luna на момент написания этого текста отсутствует в нашем каталоге. Для команды, использующей обе модели — модель Google для всего, что требует аудио или видео, и модель OpenAI для больших объёмов текста, — это один ключ для Gemini 3.1 Pro наряду с тем, что вы уже используете для OpenAI, при этом решение о маршрутизации выражается в виде конфигурации, а не двух путей в коде. Именно в этой паре это особенно важно, потому что эти две модели совершенно не взаимозаменяемы: маршрут, которому приходится выбирать между мультимодальным превью и текстовой GA-моделью младшего уровня, — это маршрут, который придётся пересматривать каждый раз, когда любой из вендоров выпускает обновление.

Что могло бы это изменить?
Сравнение в его нынешнем виде — это снимок необычного момента: GA-модель из сентября обходит preview-модель из февраля по общему индексу при цене входных данных в одну двадцатую, но проигрывает по модальности и по зрелости, которую preview так и не обретает в полной мере. Три вещи могли бы изменить эту картину, и за каждой стоит наблюдать, а не гадать.
Первый — это Gemini 3.1 Pro покидает preview. Релиз GA принёс бы политику устаревания, стабильную тарифную сетку и, весьма вероятно, изменение цены — Google удерживал $2.00/$12.00 на протяжении семи месяцев preview, пока остальной рынок вокруг него сокращал цены вдвое, и эта сдержанность больше соответствует стартовой цене, ожидающей даты GA, чем взвешенной позиции.
Второй вопрос — расширит ли OpenAI лестницу усилий Luna или изменит её значение по умолчанию. Разрыв в двадцать два пункта между оценкой GPT-6 Luna при максимальном усилии и её оценкой при усилии по умолчанию — самая большая чувствительность к конфигурации в этой статье, и изменение значения по умолчанию изменило бы эффективные возможности модели для каждого вызывающего, который никогда не трогал этот параметр.
Третье — это разрыв модальностей. Это единственное измерение здесь, которое не является вопросом степени, и именно оно не позволяет свести всё к прямому сравнению цен. Пока одна из этих моделей не сможет делать то, чего не может другая, двадцатикратный разрыв — это реальная цифра, указывающая на две разные задачи.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
