
Claude Sonnet 5.5 против Kimi K3: ни одна из моделей не будет учитывать вашу настройку температуры
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 984 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 195 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
Вот сравнение, в котором обе модели сходятся в одном, и это так или иначе сломает ваш код. Claude Sonnet 5.5, выпущенный 28 сентября 2026 года, отклоняет любой запрос, где temperature, top_p или top_k заданы значением, отличным от значения по умолчанию, с ошибкой 400. Kimi K3, находящийся в общем доступе от Moonshot AI с середины июля 2026 года, не принимает никаких параметров сэмплирования вообще — ни temperature, ни top_p, ни seed — и предоставляет управление глубиной рассуждений только через reasoning_effort. Две разные лаборатории, две разные архитектуры, один общий вывод: ручки сэмплирования, которые большинство интеграций всё ещё выставляют по привычке, исчезли в обеих.
Это не то сравнение, о котором кто-либо пишет. Сравнение, о котором пишут все, — это цена: Kimi K3 по $3 за миллион входных токенов и $15 за выходные против Claude Sonnet 5.5 по $2 и $10, что является очевидной победой Anthropic по тарифной сетке. Но Kimi K3 — это модель смеси экспертов с открытыми весами и 2,8 триллиона параметров, которую можно скачать и запустить в своём собственном периметре, а Claude Sonnet 5.5 — это закрытая модель, доступная в четырёх облаках. Между более дешёвой закрытой моделью и более дорогой скачиваемой решение вообще не принимается на основе цены за токен.
Что представляет собой каждый из них, по одному абзацу на каждый
Claude Sonnet 5.5 — вторая модель в поколении 5.5 от Anthropic, появившаяся в Claude API через пять дней после запуска Claude Opus 5.5. Она поставляется как claude-sonnet-5-5 в Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry, сохраняет контекстное окно в 1 млн токенов и ограничение синхронного вывода в 128K, а также в точности сохраняет цены Claude Sonnet 5: $2 за вход, $10 за выход, $0,20 за миллион для чтения из кэша. Адаптивное мышление включено по умолчанию при высоком уровне усилий. Она доступна с нулевым хранением данных, и Artificial Analysis присваивает ей Intelligence Index 56 в своей редакции v4.3.2 — третье место среди 216 моделей, которые она измеряет.

Kimi K3 — флагманская модель Moonshot: смесь экспертов с 2,8 триллиона параметров, активирующая примерно 104 миллиарда параметров на токен, с контекстным окном в 1 млн токенов и нативным визуальным пониманием. Она создана для длительных задач программирования и многошаговой работы со знаниями, и Moonshot прямо называет её применительно к программным обвязкам для кода. Она говорит на формате OpenAI API, предоставляет reasoning_effort в качестве единственного средства управления рассуждениями и открыта по лицензии Kimi K3 — а это не то же самое, что открытый исходный код, и именно эту разницу стоит прочитать, прежде чем строить на ней.
Тарифная карта и число под ней.
Сопоставьте эти два по параметрам, которые решают судьбу законопроекта, а не заголовка:
• Цена ввода — Claude Sonnet 5.5 $2 за миллион против Kimi K3 $3 за миллион
• Цена вывода — Claude Sonnet 5.5 $10 за миллион против Kimi K3 $15 за миллион
• Чтения из кэша — $0.20 за миллион против $0.30 за миллион
• Контекстное окно — 1 000 000 токенов против 1 048 576 токенов
• Веса — проприетарные, четыре хостинг-платформы, против открытых весов по лицензии Kimi K3
• Индекс интеллекта — Claude Sonnet 5.5 56 против Kimi K3 44 на одной и той же ревизии v4.3.2
• Стоимость одной задачи Intelligence Index — Claude Sonnet 5.5 $7.60 против Kimi K3 $2.00
• Многословность в индексе — Claude Sonnet 5.5: 410M выходных токенов против Kimi K3: 160M
Эта последняя пара — тот самый разворот, над которым стоит задержаться. Модель Anthropic на 50% дешевле на входе и на треть дешевле на выходе, но всё равно стоит в 3,8 раза дороже при выполнении той же оценки, потому что тратит в 2,6 раза больше токенов, чтобы до неё добраться. По композитному показателю она также набирает на двенадцать пунктов больше, так что это не тот случай, когда расточительная модель не даёт ничего взамен. Это случай двух моделей, чьё поведение с точки зрения затрат нельзя сравнить, просто прочитав два прайс-листа, — именно поэтому и существует показатель по индексной задаче.
Ни один из этих подсчётов токенов не будет вашим подсчётом токенов. Собственная документация Moonshot отмечает, что глубина рассуждений K3 задаётся с помощью reasoning_effort, а не сэмплированием, и то же самое по сути верно для параметра усилия Claude Sonnet 5.5 — поэтому на обеих моделях крупнейший отдельный рычаг, влияющий на ваш счёт, — это настройка усилия, а не переговоры о цене.

Ошибки 400 в деталях

Общее неприятие параметров сэмплирования — самое практичное пересечение здесь, потому что именно этот сбой даёт о себе знать наутро после смены модели.
В Claude Sonnet 5.5 правила явные и беспощадные. Значение, отличное от значения по умолчанию, для temperature, top_p или top_k возвращает 400. Отправка thinking: {"type": "disabled"} возвращает 400 с указанием на between_tools — новую минимальную настройку thinking, которая принимается при низком, среднем и высоком уровне усилий, но отклоняется при xhigh или max. Принудительное использование инструментов — tool_choice, установленный в "any" или в именованный инструмент — возвращает 400 с сообщением "tool_choice: type \"tool\" and \"any\" are not supported for this model", а исправление — auto плюс strict tool use или structured outputs. И ещё: блоки thinking теперь привязаны к модели и аккаунту, которые их создали, поэтому диалог можно перенести из Claude Sonnet 5 в Sonnet 5.5 с сохранением рассуждений, но нельзя перенести эти рассуждения в другое семейство моделей, а изменённый префикс может превратить воспроизведение в 400.
В Kimi K3 поверхность меньше, но последствия аналогичны. Параметров сэмплирования для отправки нет, поэтому любой клиент, который жёстко задаёт один из них, уже отправляет параметр, который модель не читает. Глубина рассуждений — это поле верхнего уровня reasoning_effort вместо этого.
Оба изменения указывают в одну сторону: подход с детерминированными ручками к управлению промптом заменяется регулятором усилий на стороне модели. Любой пайплайн, который настраивал себя с temperature 0.2 и фиксированным seed, приходится перенастраивать по уровню усилий на обеих этих моделях, и эта перенастройка и есть миграция.
Что открытые веса на самом деле дают вам здесь
Причина рассматривать Kimi K3 в сравнении с более дешёвой и более результативной закрытой моделью — не возможности и не цена. Это граница.
Запуск K3 в вашей собственной инфраструктуре означает, что промпты, документы и выходные данные никогда не покидают сеть, которую контролируете вы, а это совсем другой разговор о соответствии требованиям, нежели соглашение о нулевом хранении данных с поставщиком. Это также означает, что модель не выведут из эксплуатации у вас из-под ног: для Claude Sonnet 5.5 действует обязательство Anthropic о прекращении поддержки не ранее 28 сентября 2027 года, а у скачанного чекпойнта такой даты нет. И это означает, что кривая предельных затрат выполаживается: после оборудования токены бесплатны, а это единственная структура, в которой модель с 2,8 трлн параметров вообще становится дешёвым вариантом.
Лицензия — это то, что вы фактически подписываете. Kimi K3 — это модель с открытыми весами, а не открытый исходный код, и Moonshot не использует последний термин. Лицензия Kimi K3 широка для большинства видов использования, но бизнесу, предоставляющему модель как услугу, при превышении скользящего порога выручки требуется отдельное коммерческое соглашение, а продукты, превышающие крупные пороги по числу пользователей или выручке, должны отображать атрибуцию «Kimi K3». Называть её лицензированной по MIT — это неточность эпохи K2, которая всё ещё встречается. Если вы планируете строить на весах, а не вызывать API, это предмет юридической проверки, а не сноска.
И веса настолько велики, что самостоятельный хостинг — это решение о капитальных вложениях. MoE с 2,8 трлн параметров и примерно 104 млрд активных параметров — это не развёртывание на одном сервере, и усилия, необходимые для его развёртывания, — это и есть реальная стоимость этого варианта, которая затмевает разницу в $5 за миллион в тарифах на вывод.
Где применяется OrcaRouter
Большинство команд, оценивающих эти два варианта, не хотят выбирать между управляемым API и закупкой оборудования. Они хотят маршрутизировать.
OrcaRouter — это единый эндпоинт, совместимый с OpenAI, для более чем 200 моделей: цена по прайс-листу провайдера передаётся как есть, без наценки, поэтому изменение тарифа поставщика с любой стороны вступает в силу в тот же день, а не в следующем цикле выставления счетов. Kimi K3 находится в каталоге с июля по собственной цене Moonshot $3 / $15, при измеренном p50 времени до первого токена около восьми секунд и примерно 371,9 млн токенов, прошедших через него за последнюю неделю. Claude Sonnet 5 — модель, на которой по-прежнему работает большая часть трафика Claude API, с измеренной скоростью 150 выходных токенов в секунду — доступен для маршрутизации с 30 июня по цене Anthropic $2 / $10.
Claude Sonnet 5.5 пока нет в нашем каталоге. Там, где это так, говорите об этом прямо и ищите обходной путь: собственный API вендора — это путь к нему, а способ протестировать его без обязательств — это доля трафика за автоматическим переключением при отказе, с Claude Sonnet 5 или Kimi K3 в качестве резервного варианта. Если вы смотрите на K3 из-за границы, а не из-за тарифа, веса можно скачать уже сегодня, а API — это временное решение, а это решение о вашей инфраструктуре, а не о сравнении моделей.
Вердикт, разделённый по тому, что вы на самом деле покупаете
Выбирайте Claude Sonnet 5.5, когда работа связана с длинным контекстом и большим объёмом вывода, когда покупается именно двенадцать пунктов составного индекса и когда управляемый API с нулевым хранением данных проходит вашу проверку. Заложите в бюджет расход токенов — 410 млн токенов на Index против 160 млн у K3 — это реальный множитель — и заложите день на изменения в использовании инструментов и блоках размышлений.
Выбирайте Kimi K3, когда граница — это требование, когда вам нужен чекпоинт, который ни один вендор не сможет снять с поддержки, или когда ваша рабочая нагрузка — агентное программирование в больших объёмах, где $2.00 за задачу индексации против $7.60 дают накопительный эффект. Примите как данность, что это модель с 2,8 трлн параметров, которую нужно хостить, что в её лицензии есть пункты об указании авторства и о выручке и что по сводному показателю она уступает уровню Anthropic.
Чего не избежать ни одному из вариантов — так это первого абзаца: параметры сэмплирования исчезли в обоих, а регулятор усилия — это элемент управления, который их заменил. Какой бы из этих двух вы ни выбрали, именно это изменение и нужно вашему коду.
Сравнение в этой статье2
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
