
Dots против Gemini 3.1 Pro: агент с рабочим столом против модели с пятью чувствами
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 349 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 210 tok/s
- OrcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- xAISpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
The word "multimodal" hides the real difference between these two, so start with what each one does with the world. Gemini 3.1 Pro Preview is Google's flagship reasoning model, released in preview on February 19, 2026: it accepts text, images, audio, video and files as input and returns text, works across a 1,048,576-token context window with up to 65,536 tokens of output, and costs $2.00 per million input tokens and $12.00 per million output tokens below a 200,000-token prompt, repricing to $4.00 and $18.00 above it. Dots is the company's always-on agent, announced at DevDay on September 29, 2026: an agent with its own cloud computer and browser that works across more than 4,000 connected apps, runs on GPT-6 Astra, and comes included with Pro and Business Premium. Gemini 3.1 Pro watches the world and describes it; a dot acts inside it. Those are different verbs, and almost every practical question about this pair follows from which verb your problem needs.
Ввод — это не то же самое, что действие.
Поддержка медиафайлов у Gemini 3.1 Pro действительно широка — двухчасовая запись, фотография продукта, экспорт электронной таблицы и контракт могут поступить в одном запросе, — но каждый из этих входных данных существовал ещё до вызова. Выход модели — текст: ответ, извлечение, план, черновик. Ничто за пределами разговора не меняется из-за того, что модель отработала.
Точка переворачивает это. Её входные данные обыденны — ваши сообщения, данные ваших приложений, описанная вами задача, — а на выходе — изменение в мире: файл перемещён, тикет обновлён, сообщение отправлено после вашего одобрения, страница открыта в её собственном браузере. В материалах запуска OpenAI описывается, как она продвигает несколько проектов сразу, учится на обратной связи и принимает новые задачи без нового треда. Это описание работника, а не модели, и оно объясняет, почему OpenAI не опубликовала для неё ни одного бенчмарка: коллегу не оценивают в таблице лидеров — вы смотрите, что у него получается, и проверяете Activity View.
• Что принимает на вход — сообщения, описания задач и данные подключённых приложений с одной стороны; текст, изображение, аудио, видео и файл — с другой
• Что это создаёт — изменения внутри другого программного обеспечения, подчиняющиеся правилам и этапам утверждения, в отношении текста, который затем обрабатываете вы сами
• Где это работает — облачный компьютер OpenAI с собственным браузером, изолированный от вашей машины, если только вы не свяжете их, в отличие от инфраструктуры Google, доступной через API откуда угодно.
• Контекст — недокументирован для точки, против 1,048,576 токенов на входе и 65,536 токенов на выходе
• Доказательства — демонстрации вендоров, без независимого бенчмарка, против Artificial Analysis Intelligence Index 29,7 при 94,1 по GPQA Diamond и 82 по recall на длинном контексте, указанных независимо от Google
Что в Gemini 3.1 Pro стоит иметь
Причина держать такую модель под рукой в том, что восприятие — сложная задача, и большинство агентов плохо с ней справляются. Опубликованный независимый профиль Gemini 3.1 Pro необычен: 94,1 на GPQA Diamond — результат почти фронтирного уровня, 82 в тесте на воспроизведение длинного контекста — второй по величине показатель среди моделей, которые мы перечисляем, а 58,7 на SciCode — вершина именно этой таблицы. А вот где он не сияет — это принятие агентных решений: оценка 95,6 в τ²-Bench вызывает уважение, но его срез τ-banking, тот, что измеряет многошаговое использование инструментов применительно к банковским системам, составляет 21,4. Все это — сторонние измерения, указанные вместе с источником в нашем каталоге, а не цифры вендора; именно поэтому они ценнее, чем презентация на запуске.
Другая половина этой истории с оплатой за запрос заключается в том, что модель не бесплатна. Она появилась в режиме предварительного просмотра в феврале, за несколько месяцев до выпуска текущей передовой модели, и её цена выше дешёвого тарифа: $2,00 и $12,00 за миллион токенов — это примерно $0,0006 за ввод на страницу плотного текста, что ничего не значит, пока вы не запустите обработку видео по библиотеке, а тогда это уже отдельная статья расходов. Чтение кадра видео стоит столько же, сколько чтение абзаца, и модель с удовольствием выставит вам счёт за оба.

Две модели затрат, которые отказываются конвертироваться
Стоимость dot — это подписка с необъявленным лимитом: первый dot входит в Pro или Business Premium, в первый месяц действуют расширенные лимиты, разговоры с вашим dot не расходуют лимиты использования ChatGPT, а опубликованной цены ни за второй dot, ни за дополнительную скорость или ёмкость, ни за завершённую задачу нет. В отчёте CNBC о презентации Сара Фрайар представляет цену нового тарифа Pro 500 за $500 как плату за лимит использования плюс режим Ultrafast, а не как ставку за dot, так что самый дорогой тариф в прайс-листе OpenAI тоже не даёт стоимости за единицу работы агента.
Gemini 3.1 Pro преобразует в токены всё, включая те части, которые не являются текстом. Аудио, видео и изображения тарифицируются как входные данные, поэтому стоимость задачи зависит от того, какую долю мира вы заставили модель просмотреть, — свойство полезное, потому что его можно измерить, и опасное, потому что самая крупная цифра в счёте зачастую оказывается той, которую никто не планировал. Маршрутизация моделей помогает здесь конкретным, а не универсальным образом: более 200 моделей за одним ключом по цене из прайс-листа провайдера без наценки — благодаря этому дорогое мультимодальное чтение и дешёвая последующая работа могут выполняться на разных моделях в рамках одного конвейера, а изменение тарифов от Google отражается на вашем счёте в тот же день, а не при продлении.

Где эти двое работают вместе
Естественная пара — это dot, который координирует, и мультимодальная модель, которая воспринимает. Работа поступает, dot направляет её: всё, что нужно посмотреть или послушать, отправляется в Gemini 3.1 Pro для структурированного описания, и описание возвращается в рабочий процесс, где расписание или правило могут на него воздействовать. dot занимается отслеживанием; модель занимается чтением. Такое разделение также делает дорогостоящие вызовы модальностей аудируемыми, что важно, потому что именно они удивляют людей.
В OrcaRouter модель маршрутизируется как google/gemini-3.1-pro-preview по каталожной цене провайдера, пропускаемой без наценки — 0%, наравне с остальным каталогом, с автоматическим переключением при сбое между вышестоящими провайдерами, когда один из них деградирует, и DSL маршрутизации для объединения нескольких моделей в один вызов. Стоит быть точными в том, чего это не включает: dots нет в нашем каталоге, для неё нет эндпоинта, и не существует идентификатора модели, на который можно было бы направить запрос. Если вы хотите держать слой восприятия под собственным контролем — а превью-модель от февраля это ровно тот тип зависимости, который стоит изолировать, — модель должна стоять за вашим эндпоинтом, а агент остаётся там, где вы его арендовали.
Какой глагол нужен вашей задаче?
Если работа заключается в том, чтобы смотреть на что-то или слушать что-то и выдавать ответ, то инструмент — Gemini 3.1 Pro, а dot — это неправильная покупка. Если работа заключается в том, чтобы довести что-то до конца в нескольких приложениях без вашего управления, то инструмент — dot, и никакой объем мультимодальных входных данных его не заменит. Команды, которые делают это правильно, используют и то и другое и четко обозначают границу: восприятие — на тарифицируемой модели, которую можно измерить, действие — за продуктом, от которого можно отказаться.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
