
Claude Haiku 5.5 против Sakana Namazu: оба дешёвые, оба быстрые, и почти ничего больше общего
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 за 1 млн токенов · 72 tok/s
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 116 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 382 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
На первый взгляд эти двое кажутся равными по возможностям. Claude Haiku 5.5 — это малая быстрая модель в линейке вендора, выпущенная 7 октября 2026 года по цене $0,10 за миллион входных токенов и $0,50 за миллион выходных при окне в один миллион токенов, созданная для классификации, извлечения данных, маршрутизации и работы субагентов. Sakana Namazu — это специализированная на японском языке API-модель от Sakana AI, запущенная 3 августа 2026 года, с оплатой $0,95 за миллион входных токенов и $4,00 за миллион выходных при ставке $0,15 за кэшированный ввод, доработанная на основе открытой базовой модели Kimi K2.6 с использованием собственного постобучения Sakana и доступная через OpenAI-совместимый эндпоинт.
Оба они позиционируются как доступный вариант в своих линейках, и на этом сходство заканчивается. Claude Haiku 5.5 — это западная модель общего назначения, к которой вы обратитесь для маршрутизации трафика; Sakana Namazu — это модель, специализированная на конкретной стране, к которой вы обратитесь, когда задача на японском, а альтернатива — модель общего назначения, делающая это плохо. Интересный вопрос не в том, какая из них лучше. А в том, что даёт вам специалист, где на самом деле проходит граница этой специализации и чего стоит выйти за её пределы.
Что на самом деле создала Sakana AI
Sakana Namazu стоит понять прежде, чем сравнивать её с чем-либо, потому что её конструкция необычна. Её не обучали с нуля. Это доработанная версия существующей модели с открытыми весами — Kimi K2.6, — которую Sakana дополнительно дообучила и которую она предоставляет в виде закрытого API. Происхождение имеет значение: общие способности базовой модели к рассуждению и программированию унаследованы, а то, что добавила Sakana, — это слой, специфичный для Японии.
Этот слой задокументирован, чего не скажешь о большинстве заявлений о локализации. Sakana сообщает, что Namazu сохраняет производительность базовой модели на общих оценках — AIME26, MMLU-Pro, LiveCodeBench v6 — при этом превосходя её на японском и специфичном для Японии наборе, а FairPoliticsQA вырос с 34,10% до 56,30%. Она использует собственный внутренний бенчмарк для перевода на японский, JFBench, и также сообщает об улучшениях по всем показателям. Отдельное тематическое исследование — инструмент поиска доказательств для врачей — сообщает о 96,8% на 119-м национальном медицинском экзамене и 96,4% на 120-м.
Это цифры Sakana на бенчмарках Sakana, а JFBench — не публичный стандарт, который мог бы воспроизвести кто-либо другой. Утверждение, которое выдерживает эту оговорку, узкое, но реальное: модель — это именованная базовая модель плюс документированный этап постобучения, а заявленные дельты приведены относительно её собственной базы, а не относительно всей области.
API и коммерческие условия — это то, что определит большинство бизнес-кейсов. Namazu совместим с OpenAI — изменение конечной точки и имени модели sakana-namazu — единственное изменение в коде, согласно документации самой Sakana. Оплата выставляется в долларах США, а на тарифе Enterprise доступна оплата в иенах. Сюда же добавляются расходы на инструменты, которые никогда не выявить при сравнении цены за токен: 7,00 $ за тысячу вызовов веб-поиска и 0,12 $ за час выполнения кода, которые Sakana включает в продукт.
Есть два ограничения, которые важнее любых цифр в тарифной сетке. Namazu недоступен в ЕС, ЕЭЗ, Великобритании и Швейцарии до завершения работ по обеспечению соответствия GDPR — согласно собственной странице Sakana. А политика обработки данных по умолчанию гласит, что вводимые данные могут использоваться для обучения и улучшения моделей Sakana, при этом возможность отказа доступна в настройках Console; компания говорит, что в настоящее время не может гарантировать, что обработка полностью остаётся в пределах Японии. Для европейской команды или команды из Великобритании первое — дисквалифицирующий фактор, а второе — вопрос, на который нужно ответить до первого звонка.
Граница, если говорить честно
Это тот раздел, где сравнение по спецификациям ввело бы вас в заблуждение, поэтому вот что действительно сопоставимо:
• Цена — Claude Haiku 5.5: $0,10 за ввод и $0,50 за вывод за миллион токенов до 100 000 токенов промпта, затем $0,50 и $2,50. Sakana Namazu: $0,95 и $4,00, при ставке $0,15 за кэшированный ввод. Namazu примерно в девять с половиной раз дороже по вводу и в восемь раз по выводу на первом уровне.
• Кэширование — чтения из кэша Claude Haiku 5.5 стоят $0.01 и $0.05 за миллион в зависимости от уровня; у Sakana Namazu — фиксированные $0.15. Абсолютные значения близки на верхнем уровне и различаются в двадцать девять раз на нижнем.
• Инструменты — ни один из них не является чисто текстовой моделью, и каждый взимает плату по-своему. Claude Haiku 5.5 поставляется с адаптивным мышлением, регулятором усилий от Low до Max и поддержкой инструментов на стороне сервера; Sakana Namazu включает веб-поиск за $7.00 за тысячу вызовов и выполнение кода за $0.12 в час.
• Контекст — один миллион токенов для Claude Haiku 5.5. Sakana не публикует размер контекстного окна для Namazu, и любая цифра, которую вы видите указанной для него, — это предположение о базовой модели Kimi K2.6, а не спецификация.
• Независимая оценка — Claude Haiku 5.5 имеет индекс интеллекта Artificial Analysis Intelligence Index, равный 43, занимая второе место из 182 в своём классе в этом рейтинге, при стоимости $0,21 за задачу Intelligence Index. У Sakana Namazu нет записи в Artificial Analysis и нет сторонней оценки какого-либо рода, которую я смог бы найти. Его опубликованные показатели — его собственные.
• Доступность — Claude Haiku 5.5 доступна в Claude API, Amazon Bedrock, Vertex AI, Microsoft Foundry и Claude Platform on AWS, с опубликованным обязательством о прекращении поддержки не ранее 7 октября 2027 года. Sakana Namazu доступна в собственном API Sakana, Sakana Chat и продукте Sakana Translate, а также недоступна в ЕС, ЕЭЗ, Великобритании и Швейцарии.
• Обработка данных — Условия поставщика соответствуют корпоративным стандартам, а блоки рассуждений модели привязаны к учётной записи, которая их создала. По умолчанию Sakana Namazu допускает использование входных данных для обучения с возможностью отказа.
• Модальность — Claude Haiku 5.5 принимает текст и изображения; охват модальностей Sakana Namazu не опубликован, за исключением его позиционирования как решения, ориентированного в первую очередь на текст.
• Лицензия и происхождение — Claude Haiku 5.5 — проприетарная модель, доступная только через API. Sakana Namazu — проприетарная, но построена на открытых весах Kimi K2.6, а значит, базовую модель можно изучить, а дообученную — нет.
Честная проблема оценивания
Прочитайте этот список и заметьте, чего в нём недостаёт: ни одной строки, где сказано, какая модель выдаёт лучший результат на японском. Это не упущение. Между ними нет общего бенчмарка, который мог бы разрешить этот вопрос. Сильные показатели Claude Haiku 5.5 на японском — не то, что вендор продвигает в качестве главного заявления, а числа Sakana в JFBench — это её собственный инструмент. Универсальная малая модель frontier-уровня от вендора с сильной многоязычной поддержкой, оценённая против модели на основе Kimi, дообученной специально под японский, — это сравнение, которое никто на самом деле не проводил и не публиковал.
То, что можно утверждать, носит структурный, а не эмпирический характер. Вся коммерческая идентичность Namazu строится на утверждении, что универсальная модель недостаточно хороша для работы с японским языком — что языковая специфика страны, культурные умозаключения и национальный контекст представляют собой отдельную способность, оправдывающую специализированную модель при девятикратной ценовой премии. Если вы верите в это утверждение, Namazu — это ответ, и цена — это то, сколько стоит ответ. Если нет, то вы используете универсальную модель за $0.10 за миллион токенов, и вопрос в том, сможете ли вы измерить разницу на своём собственном трафике.
Измеримая версия этого утверждения — та, которую приводит Sakana: FairPoliticsQA растёт с 34,10% до 56,30% относительно базовой модели, из которой он был дообучен. Это реальное улучшение на реальном бенчмарке, но это сравнение с Kimi K2.6, а не с Claude Haiku 5.5 — и оно говорит о том, что посттренировка под специфичный для Японии политический контекст реально влияет на результат в этой задаче, а это более узкое и более защитимое утверждение, чем «лучше владеет японским».

Как выглядит разрыв в стоимости при больших объёмах
Запустите небольшой пайплайн на 10 миллионов входных и 2 миллиона выходных токенов в день через оба.
• Стоимость входных данных, в день — $1.00 на Claude Haiku 5.5, $9.50 на Sakana Namazu.
• Стоимость вывода в день — $1.00 на Claude Haiku 5.5, $8.00 на Sakana Namazu.
• Итог за день — $2,00 против $17,50; примерно $60 в месяц против $525.
Эти $525 — это ещё до единого вызова веб-поиска или часа выполнения кода. Добавьте 500 вызовов поиска в день — и Namazu будет стоить ещё $3.50 ежедневно, что доведёт сумму до $21.00 против $2.00 — соотношение лучше, чем десять к одному, которое не закроет никакая экономия токенов.
Много это или нет — полностью зависит от того, какова альтернатива. Если ваш выбор — Namazu или универсальная модель, выдающая посредственный японский текст, который вашим проверяющим приходится править вручную, то $525 — это покупка обратно часов работы проверяющих, и сравнение идёт не токен против токена, а токен против зарплаты. Если ваш японский трафик обычен и уже достаточно хорош на универсальной модели, эта надбавка не даёт ничего измеримого, и те же деньги в другом месте купят в десять раз больший объём.
Третий вариант — самый интересный для продукта на японском языке: использовать специализированную модель там, где её заявленное преимущество действительно оправдано — перевод, локальный контекст, нормативные и политические тексты, — а общую модель для объёмной работы вокруг этого. Это не компромисс. Это архитектура, которую фактически подразумевает ценообразование, ведь надбавка за Namazu платится за токен, и нет причин платить её за классификацию.

Ни та, ни другая модель не представлена в нашем каталоге.
Нам следует сказать об этом прямо, потому что это как раз тот вид сравнения, в который легко протащить абзац о доступности: OrcaRouter не обслуживает ни Claude Haiku 5.5, ни Sakana Namazu. Namazu доступна через собственный API Sakana, а Claude Haiku 5.5 — через API вендора и основные облачные платформы. Ни то, ни другое не меняет сравнения, которое опирается на опубликованные тарифы, опубликованные возможности и опубликованные ограничения.
Роль, которую один эндпоинт играет в подобном случае, более узкая и более честная, чем рекламный врез. Это ветвь гибрида, работающая с универсальной моделью — место, куда вы бы направляли неяпонский трафик классификации и извлечения, не требующий специалиста, не заводя ради этого отношения со вторым поставщиком. Единый API для более чем 200 моделей, тарифы из списков провайдеров передаются с наценкой 0%, автоматическое переключение при сбое между провайдерами, и DSL маршрутизации, когда маршрут должен определять язык запроса, а не приложение. Если вы ведете японский продукт вместе с английским, это тот шов, который иначе пришлось бы создавать вручную.
Какой именно, для кого?
Выбирайте Sakana Namazu, когда японский — это сам продукт, а не локаль: когда ваши рецензенты исправляют результаты, когда речь идёт о внутреннем законодательстве, медицине, политике или обслуживании клиентов, когда девятикратная надбавка за токены меньше стоимости исправлений, которых она позволяет избежать, и когда ваши пользователи находятся за пределами ЕС, ЕЭЗ, Великобритании и Швейцарии — или у вас есть юристы, которые уже уладили вопрос обработки данных.
Выбирайте Claude Haiku 5.5, когда работа носит общий характер, объём большой и вам нужна независимо измеренная оценка, а не бенчмарк от вендора — когда $0.10 и $0.50 за миллион токенов делают расчёты за вас, когда вам нужно окно в один миллион токенов для длинного документа или когда ответ на вопрос «что лучше справляется с японским» должен исходить из вашей собственной оценки, а не из оценки того или другого вендора.
Эти две модели на самом деле не соперники. Одна — универсальная модель, цена которой рассчитана на постоянное использование; другая — специализированная, цена которой рассчитана на осознанное использование. Ошибка — покупать специализированную модель для работы, с которой универсальная уже хорошо справляется, а противоположная ошибка — считать, что универсальная модель справляется с языком и контекстом конкретной страны так же хорошо, как нечто обученное для этого, — это та ошибка, на которой построен весь бизнес Sakana: на том, что люди её совершают.

