
GPT-6 Sol против GPT-5.6 Sol: один пункт индекса, вдвое дешевле — и регрессия, о которой никто не объявлял
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 610 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 189 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
Да, обновляйтесь — но перед этим прочитайте второй абзац. GPT-6 Sol, выпущенный 22 сентября 2026 года, набирает 48 баллов в Intelligence Index от Artificial Analysis. GPT-5.6 Sol, выпущенный 9 июля 2026 года, набирает 47 баллов. Один балл. Модель, которая его заменила, стоит вдвое меньше: $2.00 за миллион входных и $10.00 за миллион выходных против $4.00 и $20.00. Судя по главным цифрам, это самое простое решение об обновлении в текущей линейке, и снижение цены реально, постоянно и является крупнейшим разовым снижением, которое производитель применил к флагманской модели.
Осложнение в том, что собственная оценка Artificial Analysis для GPT-6 Sol выявила смесь улучшений и регрессий, а не чистое повышение уровня. Наблюдаются регрессии на GDPval-AA v2.1. Также существует тариф с пересмотром цен для длинного контекста выше 272 000 входных токенов, который примерно удваивает тариф на ввод и увеличивает тариф на вывод на половину — и 272K — это ровно тот диапазон, где у GPT-5.6 Sol есть опубликованное преимущество. Миграция, которая выглядит как прямое сокращение вашего счёта вдвое, на трафике с длинным контекстом может оказаться ближе к нулевому результату с сопутствующим компромиссом по возможностям.
Что на самом деле означает рост Индекса на один пункт
Обе модели измерялись на одной и той же плате, версии 4.3.2, что делает это сравнение самым чистым во всей серии GPT-6 Sol — никаких различий в тестовой оснастке, никакого несоответствия между вендором и независимой стороной, одна лаборатория измеряет две модели одного вендора.
• AA Intelligence Index — GPT-6 Sol 48, 18-е место из 212 против GPT-5.6 Sol 47, 19-е место из 212
• Стоимость за задачу Index — GPT-6 Sol примерно вдвое меньше, чем GPT-5.6 Sol
• Скорость вывода — GPT-6 Sol 104,4 токена/сек против GPT-5.6 Sol 72,6 токена/сек
• Время до первого токена — GPT-6 Sol 107,18 с против GPT-5.6 Sol, который быстрее; оба — на фоне медианы по таблице лидеров в 3,87 с
• Цена ввода — GPT-6 Sol $2.00 за 1M против GPT-5.6 Sol $4.00 за 1M
• Цена вывода — GPT-6 Sol $10.00 за 1M против GPT-5.6 Sol $20.00 за 1M
• Кэшированный ввод — GPT-6 Sol примерно на 90% дешевле по сравнению с GPT-5.6 Sol: $0.40 за 1M
• Пакетный тариф — GPT-6 Sol не опубликован против GPT-5.6 Sol $2.50 / $15.00
• Тариф длинного контекста — GPT-6 Sol меняет цену при вводе свыше 272K, тогда как у GPT-5.6 Sol аналогичного шага нет
• Контекстное окно — 872K у GPT-6 Sol по данным AA, заявлено 1,05M против примерно 1,05–1,1M у GPT-5.6 Sol
• Максимальный вывод — 128K на обоих
• Выпущено — GPT-6 Sol 2026-09-22 vs GPT-5.6 Sol 2026-07-09

Посмотрите на две линии скорости вместе. GPT-6 Sol генерирует вывод примерно на 44% быстрее, чем его предшественник, и он значительно медленнее выдаёт первый токен — 107,18 секунды против медианы по таблице 3,87. GPT-5.6 Sol тоже не быстрая модель по меркам таблицы, но он не в этой категории. Если вы перешли на GPT-5.6 Sol для интерактивного продукта, GPT-6 Sol не является заменой, которую можно просто подключить, и это функциональная регрессия, не зависящая от каких-либо бенчмарков.
Одна строка незаметно говорит в пользу нового: стандартный тариф GPT-6 Sol в размере $2/$10 ниже пакетного тарифа GPT-5.6 Sol в размере $2,50/$15. Даже тариф со скидкой у старой модели дороже прейскурантной цены новой. Это самое сильное доказательство того, что снижение носит структурный, а не промоционный характер.
Самое интересное — это регрессия.
Artificial Analysis обнаружила, что GPT-6 Sol примерно вдвое снижает стоимость выполнения задачи, демонстрируя при этом сочетание улучшений и регрессий. GDPval-AA v2.1 — это указанная регрессия. Отдельно стоит отметить, что GPT-5.6 Luna от OpenAI также показала регресс в Coding Agent Index — что указывает на закономерность в этом поколении, а не на единичную неудачу одной модели.
К этому стоит отнестись серьёзно именно потому, что это независимый вывод. Презентационные материалы OpenAI к запуску строятся вокруг стоимости за задачу и вокруг выбранных ею строк бенчмарков; у Artificial Analysis нет продукта для продажи, и она сообщает то, что выдал её испытательный стенд. Модель, которая дешевле и примерно равна по композитному показателю, но измеримо хуже на конкретных подзадачах, не является строго лучшей моделью. Это другая точка на фронтире.
Практическая версия этого: если ваша рабочая нагрузка в значительной степени имеет форму GDPval-AA — экономически ценная интеллектуальная работа, тот тип задач, для оценки которых был создан этот бенчмарк — то прирост композитного показателя на один пункт вас не покрывает, и регрессия — это число, которое имеет значение. Если ваша рабочая нагрузка универсальна, сокращение стоимости одной задачи вдвое — это число, которое имеет значение, а композитный показатель говорит, что вы не потеряли ничего измеримого.
Где GPT-5.6 Sol всё ещё побеждает
У GPT-5.6 Sol есть опубликованный результат по извлечению в длинном контексте, которому GPT-6 Sol не может противопоставить ничего эквивалентного: MRCR v2, 8-needle, 91,5% в диапазоне 256K–512K. Это показатель точности извлечения в диапазоне, где меняется тарифная сетка GPT-6 Sol.
Сопоставьте два факта. При объёме свыше 272 000 входных токенов весь запрос GPT-6 Sol переоценивается примерно в $4 за вход и $15 за выход. Это примерно прежняя ставка GPT-5.6 Sol на входе и три четверти её на выходе — так что 50%-ная экономия, ради которой вы мигрировали, схлопывается примерно до 0% на входе и 25% на выходе, ровно в том диапазоне контекста, где у GPT-5.6 Sol есть документированное преимущество, а у GPT-6 Sol нет опубликованного аналога.
Остальные опубликованные результаты GPT-5.6 Sol остаются достойными, и именно поэтому некоторые команды не переходят:
• Последний экзамен агентов — GPT-5.6 Sol 53.6
• Terminal-Bench 2.1 — GPT-5.6 Sol 88.8 / 88.0
• SWE-Bench Pro — GPT-5.6 Sol 64.6
• OSWorld 2.0 — GPT-5.6 Sol 62.6
• BrowseComp — GPT-5.6 Sol 90,4
• GDPval-AA v2 — GPT-5.6 Sol 1747.8 Elo
• HLE — GPT-5.6 Sol 49.5
• MRCR v2, 8 игл — GPT-5.6 Sol 91,5% при 256K–512K
Это данные, которые сообщает OpenAI. Обратите внимание: BrowseComp с 90,4 и показатель MRCR — это два показателя, которые сложнее всего заменить: агенты для веб-исследований и извлечение из длинного контекста — это рабочие нагрузки, в которых модель двухмесячной давности с опубликованным числом — более надёжная ставка, чем новая модель без сопоставимого измерения.
Что GPT-6 Sol даёт такого, чего нет в прайс-листе
Ценообразование — это главное, но изменились ещё три вещи.
Во-первых, потолок контекста. GPT-6 Sol указан у Artificial Analysis на уровне 872 000 токенов, тогда как в других материалах OpenAI заявлено 1,05 млн, при максимальном входе 922 тыс. токенов. GPT-5.6 Sol находится где-то в диапазоне от 1,05 до 1,1 млн в зависимости от источника. На бумаге это небольшой шаг назад по полезному окну — с той оговоркой, что стоимость определяет не потолок, а граница уровня в 272 тыс. токенов.
Во-вторых, доступность. GPT-6 Sol доступен в API, а также в ChatGPT Work и Codex на тарифах Plus, Pro, Business, Enterprise и Edu — при этом администраторы Enterprise должны включить его, прежде чем пользователи смогут его увидеть. В ChatGPT Chat его нет. GPT-5.6 Sol внедрялся шире. Если доступ вашей команды зависит от администратора предприятия, миграция — это не просто изменение кода.
Во-третьих, выпуск нового флагмана обычно означает, что старый становится более дешёвым запасным вариантом, а не снимается с эксплуатации. GPT-5.6 Sol за $4/$20 — по-прежнему превосходная модель с показателем 47 в Индексе, а для задач поиска по длинному контексту у неё опубликовано число, которого нет у GPT-6 Sol.
Миграция, которая обходится дешевле, чем кажется
Причина, по которой это конкретное обновление так легко, заключается в том, что обе модели от одного и того же поставщика, имеют одинаковую структуру API и расположены рядом в рейтинге — а значит, миграция сводится к изменению строки модели, а не к переработке архитектуры, и резервный путь уже есть в вашем коде. GPT-5.6 Sol доступна на OrcaRouter по прейскурантной цене OpenAI, в рамках сквозной модели ценообразования, при которой изменение цен OpenAI вступает в силу на нашей стороне в тот же день, а не после того, как реселлер пересмотрит условия.
На момент написания этой статьи GPT-6 Sol отсутствует в нашем каталоге — до него можно добраться через собственный API OpenAI. Так что честный вид миграции — это маршрут, за которым на том же ключе стоит GPT-5.6 Sol: направлять новый трафик на GPT-6 Sol, держать предыдущую модель на расстоянии одного изменения конфигурации и позволить автоматическому переключению при сбое покрыть окно, пока доступность нового флагмана ещё стабилизируется. Для модели, которой всего два дня, с корпоративным переключателем активации перед ней и уровнем длинного контекста, который меняет экономику выше 272K токенов, наличие всё ещё подключённого предыдущего поколения — это не осторожность, это разница между плохим днём и плохой неделей.

Контрольный список миграции
Измерьте фактическое распределение вашего контекста прежде всего остального. Если 95-й процентиль ваших запросов находится ниже 272 000 входных токенов, мигрируйте — экономия составит настоящие 50 % по обеим сторонам счёта, стоимость одной задачи уменьшится вдвое, а композитный индекс говорит, что вы ничем не пожертвовали. Если значительная доля трафика находится выше этой границы, тщательно смоделируйте этот тариф: при примерно $4/$15 преимущество перед $4/$20 у GPT-5.6 Sol составляет 25 % на выходе и ноль на входе, и вы платите за это потерей задокументированного результата извлечения в длинном контексте.
Проверьте, ждёт ли кто-нибудь первый токен. 107 секунд — это примерно в двадцать восемь раз больше медианы по борду, и именно этот режим отказа проявится в продакшене первым. Всё, где на другом конце находится человек, должно оставаться на GPT-5.6 Sol или маршрутизироваться куда-то ещё.
Затем проверьте путь включения. В тарифах Enterprise администратор должен включить GPT-6 Sol, а в ChatGPT Chat он полностью отсутствует. Убедитесь, что ваши пользователи действительно могут получить к нему доступ, прежде чем объявлять о миграции внутри компании.
Наконец, в течение первого месяца следите за GDPval-AA v2.1 на своих собственных eval-прогонах. Независимая лаборатория обнаружила там регрессию, и прирост сводного показателя на один пункт не говорит вам, поднялся или опустился ваш конкретный набор задач. Запустите свои eval-прогоны на обеих моделях до переключения, а не после.

Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
