
Union Alpha против Gemini 3.8 Flash: у одного есть оценка, у другого — заявление
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Union Alpha и Gemini 3.8 Flash — это одна и та же подача, представленная на двух совершенно разных уровнях доказательности. Оператор Union Alpha описывает его как обладающий «производительностью фронтирного уровня в широком диапазоне задач общего назначения» и не опубликовал ни бенчмарка, ни количества параметров, ни лицензии, ни названия. Gemini 3.8 Flash вышел с датированной таблицей оценок, Artificial Analysis Intelligence Index, показателями стоимости за задачу от независимых тестировщиков и документированным графиком цен, рассчитанным до 2027 года. Если вы выбираете между ними по любому критерию, кроме цены, вы выбираете между числом, которое можно проверить, и фразой, которую проверить нельзя.
Бок о бок, перед ссорой
• Контекстное окно — 262 144 токена у Union Alpha против 1 048 576 токенов у Gemini 3.8 Flash.
• Максимальная длина вывода — 131 072 токена против 65 536 токенов. Union Alpha выигрывает по этому пункту, и это единственная структурная ось, по которой он выигрывает.
• Входные данные — текст и изображения у обоих, но Gemini 3.8 Flash дополнительно принимает видео, аудио и файлы.
• Цены — Union Alpha $0 во время предпросмотра против Gemini 3.8 Flash: $0,75/млн входных, $3,75/млн выходных, $0,075/млн кэшированных входных, с удвоением до $1,50/$7,50 1 января 2027 года.
• Средства управления рассуждениями — на Union Alpha они не представлены, тогда как уровни мышления в Gemini 3.8 Flash напрямую влияют и на качество, и на стоимость.
• Опубликованная оценка — ни одной от оператора Union Alpha против полной таблицы с датами по Gemini 3.8 Flash.
• Происхождение — анонимный оператор, без весов против датированного релиза и документированной родословной Gemini 3.8 Flash.

О чём на самом деле говорят цифры Gemini 3.8 Flash
Gemini 3.8 Flash вышел 2 сентября 2026 года — третий выпуск Flash от Google примерно за шесть недель, и это говорит о том, насколько история этой модели связана скорее с ритмом выпусков, чем с прорывом. Опубликованная таблица оценок приписывает данные artificialanalysis.ai и deepmind.google в совокупности, так что воспринимайте её как смесь независимых и вендорских показателей, а не как чистый сторонний аудит.
• AA Coding — 76,3, что является по-настоящему высоким показателем в области программирования.
• AA Intelligence — 41,2. Обратите внимание, что Artificial Analysis отдельно сообщает 59 по индексу интеллекта при высоком уровне усилий рассуждения, поэтому число сильно меняется в зависимости от настройки усилий; указывайте эту настройку, иначе число бессмысленно.
• GPQA Diamond — 95,3, самый высокий единичный показатель в этом сравнении с большим отрывом.
• HLE-Verified — 54,9, при этом обычный Humanity's Last Exam — 47,8.
• Terminal-Bench 2.1 — 89,4 по собственной таблице Google, что чуть опережает 89,1 у Claude Opus 5.
• Воспроизведение длинного контекста — 81.3; SciCode 56.6; tau_banking 44.9.
• Наблюдаемая пропускная способность — 323 выходных токена в секунду за недавнее семидневное окно, при доле ошибок 0,63 %, медианном времени до первого токена 3,46 секунды и 498,5 млн токенов измеренного трафика.
Слабые стороны задокументированы так же, как и сильные. На Terminal-Bench 4.0 он набирает 19,1 против 51,8 у Claude Opus 5. На OSWorld 2.0 он показывает 59,0% против 75,4%. На GDPVal-AA v2 он отстаёт с 1545 Elo против 1824. Gemini 3.8 Flash превосходен в определённом диапазоне задач, но резко проваливается на самых сложных оценках универсальных агентов — и именно такую картину позволяет увидеть опубликованная таблица.
Ценовой подвох, который застаёт людей врасплох
Google оставил цену за токен неизменной по сравнению с Gemini 3.7 Flash. Счёт всё равно вырос.
Модель работает усерднее: больше шагов рассуждения, больше итеративных вызовов инструментов. Независимое тестирование, проведённое Artificial Analysis, показало примерно на 30% больше выходных токенов на задачу и примерно на 40% более высокую стоимость на задачу, чем у 3.7 Flash. При высоком уровне рассуждений это составляет около $0,58 за задачу; средний — около $0,41, а низкий — около $0,24.
Это самое полезное в сравнении для всех, кто планирует бюджет, и это применимо далеко за пределами этих двух моделей: цена за единицу и стоимость за задачу — разные числа, и только одно из них фигурирует на странице с ценами. Google сохранил доступность 3.7 Flash как более дешёвого варианта, что является молчаливым признанием этого сдвига.
Что вместо этого предлагает Union Alpha
Union Alpha появился в сторонних каталогах 16 сентября 2026 года и работает на бесплатном тарифе OrcaRouter. Он анонимный — ни лаборатории, ни весов, ни лицензии, ни даты отсечения знаний — и бесплатный в течение заявленного окна около недели, с ограничением частоты запросов, без объявленной цены после предварительного просмотра.
Его эндпоинт проверяем, даже там, где его происхождение — нет: контекст в 262 144 токена, максимальный вывод в 131 072 токена, ввод текста и изображений с выводом только текста, вызов инструментов и вывод JSON, temperature, top_p, max_tokens, и никаких средств управления рассуждениями какого-либо рода. Выбор инструментов фактически поддерживает только «auto».
Есть ровно одно независимое измерение. SMF Clearinghouse провела 157 тестов Official A с отключённым режимом рассуждений, и результат составил 136/157 — 86,6%, ноль ошибок, десятое место из двадцати шести. Рассуждения были безупречны — 30/30, инструменты — 2/2, программирование — 26/30, математика — 24/30. Письменная речь — 2/5.
Это неплохой результат. Просто он несопоставим. Official A — это широкий общий набор из 157 тестов; AA Coding и GPQA Diamond — это разные инструменты, измеряющие разные вещи при разной сложности. Поставить 136/157 рядом с 95.3 в GPQA Diamond и объявить победителя — это было бы ровно тем видом отмывания, из-за которого цифры вендоров становятся бесполезными.


Сравнение затрат, которое никому не под силу завершить
Вот разобранный пример, и он намеренно неполный.
Возьмите задачу, которую вы выполняете тысячу раз в месяц. На Gemini 3.8 Flash при высоком уровне рассуждений опубликованный показатель стоимости за задачу около $0.58 даёт примерно $580 в месяц. Это реальная, обоснованная цифра, полученная на основе измеренного потребления токенов.
В Union Alpha те же тысяча задач сегодня стоят $0. Сколько они будут стоить через три недели — неизвестно, потому что не существует цены после превью. Сколько они стоят с точки зрения надёжности — тоже неизвестно, потому что модель ограничена по скорости, работает на одном эндпоинте без резервного провайдера и отвечает кодом HTTP 429, как только вы превысите лимит, который никто не публиковал.
Так что честный ответ таков: Union Alpha выигрывает единственное доступное сравнение затрат и теряет возможность прогнозировать затраты. Для разового сравнительного теста это нормально. Для статьи бюджета это не число — это надежда с URL.
Где каждому свое место
Gemini 3.8 Flash подходит везде, где нужен выверенный базовый уровень: работа с документами в длинном контексте с видео- или аудиовходом, задачи по программированию, где оценка AA Coding 76,3 — это релевантный инструмент, и любая рабочая нагрузка с бюджетом, потому что вы можете рассчитать стоимость до принятия обязательств и знаете, что 1 января 2027 года она удвоится.
Union Alpha — как раз для исследовательского слота: попробуйте 256K-модель со зрением, у которой потолок вывода вдвое выше, чем у Gemini, на задачах, где исчезнувший эндпоинт ничего вам не стоит.
Причина запускать их через одну конечную точку, а не через две интеграции, в том, что это сравнение будет неоднократно менять форму. DSL маршрутизации позволяет объединить оба варианта в один вызов — Gemini 3.8 Flash как измеряемый путь, Union Alpha как экспериментальная ветка — вместо жёстко зашитого решения, к которому вы захотите вернуться, когда закончится окно бесплатного доступа или когда истечёт вводное ценообразование Google. Обе эти даты не за горами, и обе изменят расчёты.
Что бы это уладило
Одна датированная запись для Union Alpha в таблице лидеров, где также присутствует Gemini 3.8 Flash. Это и есть весь недостающий фрагмент. До тех пор защитимая позиция состоит не в том, что «Union Alpha так же хорош, как Gemini 3.8 Flash», а в том, что «Union Alpha бесплатен в течение недели, и никто не измерял его ни с чем, что публикует Google». Это очень разные утверждения, и на данный момент верно только одно из них.
Измеренная половина пары задокументирована здесь: страница модели Gemini 3.8 Flash содержит тарифы $0.75/$3.75, 90%-ную скидку на кэшированный ввод и потолок вывода в 65 536 токенов, который определяет работу над длинными отчётами.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
