Сгенерированная hero-карточка под названием «GPT-6 Sol vs GPT-5.6 Sol» с заголовком «Разница в 1 пункт индекса, вдвое дешевле», на карточках двух моделей указаны AA Index 48 против 47 и цены $2.00/$10.00 против $4.00/$20.00, а в правом нижнем углу — логотип OrcaRouter.
Guides & Insights

GPT-6 Sol против GPT-5.6 Sol: один пункт индекса, вдвое дешевле — и регрессия, о которой никто не объявлял

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Да, обновляйтесь — но перед этим прочитайте второй абзац. GPT-6 Sol, выпущенный 22 сентября 2026 года, набирает 48 баллов в Intelligence Index от Artificial Analysis. GPT-5.6 Sol, выпущенный 9 июля 2026 года, набирает 47 баллов. Один балл. Модель, которая его заменила, стоит вдвое меньше: $2.00 за миллион входных и $10.00 за миллион выходных против $4.00 и $20.00. Судя по главным цифрам, это самое простое решение об обновлении в текущей линейке, и снижение цены реально, постоянно и является крупнейшим разовым снижением, которое производитель применил к флагманской модели.

Осложнение в том, что собственная оценка Artificial Analysis для GPT-6 Sol выявила смесь улучшений и регрессий, а не чистое повышение уровня. Наблюдаются регрессии на GDPval-AA v2.1. Также существует тариф с пересмотром цен для длинного контекста выше 272 000 входных токенов, который примерно удваивает тариф на ввод и увеличивает тариф на вывод на половину — и 272K — это ровно тот диапазон, где у GPT-5.6 Sol есть опубликованное преимущество. Миграция, которая выглядит как прямое сокращение вашего счёта вдвое, на трафике с длинным контекстом может оказаться ближе к нулевому результату с сопутствующим компромиссом по возможностям.

Что на самом деле означает рост Индекса на один пункт

Обе модели измерялись на одной и той же плате, версии 4.3.2, что делает это сравнение самым чистым во всей серии GPT-6 Sol — никаких различий в тестовой оснастке, никакого несоответствия между вендором и независимой стороной, одна лаборатория измеряет две модели одного вендора.

• AA Intelligence Index — GPT-6 Sol 48, 18-е место из 212 против GPT-5.6 Sol 47, 19-е место из 212

• Стоимость за задачу Index — GPT-6 Sol примерно вдвое меньше, чем GPT-5.6 Sol

• Скорость вывода — GPT-6 Sol 104,4 токена/сек против GPT-5.6 Sol 72,6 токена/сек

• Время до первого токена — GPT-6 Sol 107,18 с против GPT-5.6 Sol, который быстрее; оба — на фоне медианы по таблице лидеров в 3,87 с

• Цена ввода — GPT-6 Sol $2.00 за 1M против GPT-5.6 Sol $4.00 за 1M

• Цена вывода — GPT-6 Sol $10.00 за 1M против GPT-5.6 Sol $20.00 за 1M

• Кэшированный ввод — GPT-6 Sol примерно на 90% дешевле по сравнению с GPT-5.6 Sol: $0.40 за 1M

• Пакетный тариф — GPT-6 Sol не опубликован против GPT-5.6 Sol $2.50 / $15.00

• Тариф длинного контекста — GPT-6 Sol меняет цену при вводе свыше 272K, тогда как у GPT-5.6 Sol аналогичного шага нет

• Контекстное окно — 872K у GPT-6 Sol по данным AA, заявлено 1,05M против примерно 1,05–1,1M у GPT-5.6 Sol

• Максимальный вывод — 128K на обоих

• Выпущено — GPT-6 Sol 2026-09-22 vs GPT-5.6 Sol 2026-07-09

A generated two-column scoreboard titled 'GPT-6 Sol vs GPT-5.6 Sol — the scoreboard'. Left column GPT-6 Sol: Input $2.00 per 1M, Output $10.00 per 1M, AA Index 48, Speed 104.4 tok/s, Long context 'reprices above 272K', Released 2026-09-22. Right column GPT-5.6 Sol: Input $4.00 per 1M, Output $20.00 per 1M, AA Index 47, Speed 72.6 tok/s, Long context 'no step', Released 2026-07-09. Footer: 'Both measured by Artificial Analysis, Index v4.3.2.'

Посмотрите на две линии скорости вместе. GPT-6 Sol генерирует вывод примерно на 44% быстрее, чем его предшественник, и он значительно медленнее выдаёт первый токен — 107,18 секунды против медианы по таблице 3,87. GPT-5.6 Sol тоже не быстрая модель по меркам таблицы, но он не в этой категории. Если вы перешли на GPT-5.6 Sol для интерактивного продукта, GPT-6 Sol не является заменой, которую можно просто подключить, и это функциональная регрессия, не зависящая от каких-либо бенчмарков.

Одна строка незаметно говорит в пользу нового: стандартный тариф GPT-6 Sol в размере $2/$10 ниже пакетного тарифа GPT-5.6 Sol в размере $2,50/$15. Даже тариф со скидкой у старой модели дороже прейскурантной цены новой. Это самое сильное доказательство того, что снижение носит структурный, а не промоционный характер.

Самое интересное — это регрессия.

Artificial Analysis обнаружила, что GPT-6 Sol примерно вдвое снижает стоимость выполнения задачи, демонстрируя при этом сочетание улучшений и регрессий. GDPval-AA v2.1 — это указанная регрессия. Отдельно стоит отметить, что GPT-5.6 Luna от OpenAI также показала регресс в Coding Agent Index — что указывает на закономерность в этом поколении, а не на единичную неудачу одной модели.

К этому стоит отнестись серьёзно именно потому, что это независимый вывод. Презентационные материалы OpenAI к запуску строятся вокруг стоимости за задачу и вокруг выбранных ею строк бенчмарков; у Artificial Analysis нет продукта для продажи, и она сообщает то, что выдал её испытательный стенд. Модель, которая дешевле и примерно равна по композитному показателю, но измеримо хуже на конкретных подзадачах, не является строго лучшей моделью. Это другая точка на фронтире.

Практическая версия этого: если ваша рабочая нагрузка в значительной степени имеет форму GDPval-AA — экономически ценная интеллектуальная работа, тот тип задач, для оценки которых был создан этот бенчмарк — то прирост композитного показателя на один пункт вас не покрывает, и регрессия — это число, которое имеет значение. Если ваша рабочая нагрузка универсальна, сокращение стоимости одной задачи вдвое — это число, которое имеет значение, а композитный показатель говорит, что вы не потеряли ничего измеримого.

Где GPT-5.6 Sol всё ещё побеждает

У GPT-5.6 Sol есть опубликованный результат по извлечению в длинном контексте, которому GPT-6 Sol не может противопоставить ничего эквивалентного: MRCR v2, 8-needle, 91,5% в диапазоне 256K–512K. Это показатель точности извлечения в диапазоне, где меняется тарифная сетка GPT-6 Sol.

Сопоставьте два факта. При объёме свыше 272 000 входных токенов весь запрос GPT-6 Sol переоценивается примерно в $4 за вход и $15 за выход. Это примерно прежняя ставка GPT-5.6 Sol на входе и три четверти её на выходе — так что 50%-ная экономия, ради которой вы мигрировали, схлопывается примерно до 0% на входе и 25% на выходе, ровно в том диапазоне контекста, где у GPT-5.6 Sol есть документированное преимущество, а у GPT-6 Sol нет опубликованного аналога.

Остальные опубликованные результаты GPT-5.6 Sol остаются достойными, и именно поэтому некоторые команды не переходят:

• Последний экзамен агентов — GPT-5.6 Sol 53.6

• Terminal-Bench 2.1 — GPT-5.6 Sol 88.8 / 88.0

• SWE-Bench Pro — GPT-5.6 Sol 64.6

• OSWorld 2.0 — GPT-5.6 Sol 62.6

• BrowseComp — GPT-5.6 Sol 90,4

• GDPval-AA v2 — GPT-5.6 Sol 1747.8 Elo

• HLE — GPT-5.6 Sol 49.5

• MRCR v2, 8 игл — GPT-5.6 Sol 91,5% при 256K–512K

Это данные, которые сообщает OpenAI. Обратите внимание: BrowseComp с 90,4 и показатель MRCR — это два показателя, которые сложнее всего заменить: агенты для веб-исследований и извлечение из длинного контекста — это рабочие нагрузки, в которых модель двухмесячной давности с опубликованным числом — более надёжная ставка, чем новая модель без сопоставимого измерения.

Что GPT-6 Sol даёт такого, чего нет в прайс-листе

Ценообразование — это главное, но изменились ещё три вещи.

Во-первых, потолок контекста. GPT-6 Sol указан у Artificial Analysis на уровне 872 000 токенов, тогда как в других материалах OpenAI заявлено 1,05 млн, при максимальном входе 922 тыс. токенов. GPT-5.6 Sol находится где-то в диапазоне от 1,05 до 1,1 млн в зависимости от источника. На бумаге это небольшой шаг назад по полезному окну — с той оговоркой, что стоимость определяет не потолок, а граница уровня в 272 тыс. токенов.

Во-вторых, доступность. GPT-6 Sol доступен в API, а также в ChatGPT Work и Codex на тарифах Plus, Pro, Business, Enterprise и Edu — при этом администраторы Enterprise должны включить его, прежде чем пользователи смогут его увидеть. В ChatGPT Chat его нет. GPT-5.6 Sol внедрялся шире. Если доступ вашей команды зависит от администратора предприятия, миграция — это не просто изменение кода.

Во-третьих, выпуск нового флагмана обычно означает, что старый становится более дешёвым запасным вариантом, а не снимается с эксплуатации. GPT-5.6 Sol за $4/$20 — по-прежнему превосходная модель с показателем 47 в Индексе, а для задач поиска по длинному контексту у неё опубликовано число, которого нет у GPT-6 Sol.

Миграция, которая обходится дешевле, чем кажется

Причина, по которой это конкретное обновление так легко, заключается в том, что обе модели от одного и того же поставщика, имеют одинаковую структуру API и расположены рядом в рейтинге — а значит, миграция сводится к изменению строки модели, а не к переработке архитектуры, и резервный путь уже есть в вашем коде. GPT-5.6 Sol доступна на OrcaRouter по прейскурантной цене OpenAI, в рамках сквозной модели ценообразования, при которой изменение цен OpenAI вступает в силу на нашей стороне в тот же день, а не после того, как реселлер пересмотрит условия.

На момент написания этой статьи GPT-6 Sol отсутствует в нашем каталоге — до него можно добраться через собственный API OpenAI. Так что честный вид миграции — это маршрут, за которым на том же ключе стоит GPT-5.6 Sol: направлять новый трафик на GPT-6 Sol, держать предыдущую модель на расстоянии одного изменения конфигурации и позволить автоматическому переключению при сбое покрыть окно, пока доступность нового флагмана ещё стабилизируется. Для модели, которой всего два дня, с корпоративным переключателем активации перед ней и уровнем длинного контекста, который меняет экономику выше 272K токенов, наличие всё ещё подключённого предыдущего поколения — это не осторожность, это разница между плохим днём и плохой неделей.

A screenshot of the Artificial Analysis page for GPT-6 Sol (max), showing an Intelligence rank of 18th of 212 models, a Cost rank of 49th and a Verbosity rank of 43rd, input pricing of $2.00 and output of $10.00 per 1M tokens with a 90% cache discount, a cost per Intelligence Index task of $1.06, an 872k-token context window, 77M tokens generated during the index run, and a total of $1,550.08 spent evaluating the model on the Intelligence Index.

Контрольный список миграции

Измерьте фактическое распределение вашего контекста прежде всего остального. Если 95-й процентиль ваших запросов находится ниже 272 000 входных токенов, мигрируйте — экономия составит настоящие 50 % по обеим сторонам счёта, стоимость одной задачи уменьшится вдвое, а композитный индекс говорит, что вы ничем не пожертвовали. Если значительная доля трафика находится выше этой границы, тщательно смоделируйте этот тариф: при примерно $4/$15 преимущество перед $4/$20 у GPT-5.6 Sol составляет 25 % на выходе и ноль на входе, и вы платите за это потерей задокументированного результата извлечения в длинном контексте.

Проверьте, ждёт ли кто-нибудь первый токен. 107 секунд — это примерно в двадцать восемь раз больше медианы по борду, и именно этот режим отказа проявится в продакшене первым. Всё, где на другом конце находится человек, должно оставаться на GPT-5.6 Sol или маршрутизироваться куда-то ещё.

Затем проверьте путь включения. В тарифах Enterprise администратор должен включить GPT-6 Sol, а в ChatGPT Chat он полностью отсутствует. Убедитесь, что ваши пользователи действительно могут получить к нему доступ, прежде чем объявлять о миграции внутри компании.

Наконец, в течение первого месяца следите за GDPval-AA v2.1 на своих собственных eval-прогонах. Независимая лаборатория обнаружила там регрессию, и прирост сводного показателя на один пункт не говорит вам, поднялся или опустился ваш конкретный набор задач. Запустите свои eval-прогоны на обеих моделях до переключения, а не после.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol), showing the Vision, Tools, JSON and Reasoning badges, a 1.05M-token context with 128K maximum output and text + image + file input, list pricing of $4.00 input and $20.00 output per 1M tokens, and the description of GPT-5.6 Sol as the flagship of OpenAI's GPT-5.6 series, strong at command-line and multi-file coding tasks.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно