일본 자체 LLM API인 Sakana Namazu의 히어로 타이틀 카드. 부제: 'Kimi K2.6 기반, 일본 비즈니스에 최적화 — 2026년 8월 2일 출시'. 1M 토큰당 $0.95/$4.00, OpenAI 호환 API, 내장 웹 검색 및 코드 실행을 위한 스탯 칩 포함. OrcaRouter 로고는 오른쪽 하단에 합성.
Engineering & Research

Sakana Namazu API: 기본 모델 가격의 일본 자체 LLM

작성자

Jim Song

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

사카나 나마즈(Sakana Namazu)는 Moonshot의 오픈 가중치 Kimi K2.6을 기반으로 구축된 Sakana AI의 일본 비즈니스용 LLM API로, 2026년 8월 2일에 출시되었습니다. 그리고 가장 중요한 숫자는, 기본 모델과 정확히 동일한 비용이 든다는 점입니다. Moonshot은 자체 API에서 Kimi K2.6에 대해 입력 토큰 100만 개당 0.95달러, 출력 토큰 100만 개당 4.00달러를 청구합니다. Sakana는 일본어, 경어, 비즈니스 맥락을 위해 자체적으로 사후 학습(post-training)한 모델인 Sakana Namazu에 대해 동일한 0.95달러 / 4.00달러를 청구합니다. 사후 학습 프리미엄은 전액 0달러입니다.

실제로 출시된 것

이 API는 OpenAI와 호환됩니다. 기존 클라이언트를 유지한 채 base_url만 변경하고 모델을 sakana-namazu로 설정하면 기능 호출(function calling)을 포함해 바로 작동합니다. 일반적인 Kimi K2.6 엔드포인트와 가장 크게 다른 점은 웹 검색과 코드 실행이 일급 도구로 내장되어 있으며, 모델이 이를 자율 루프에서 사용하도록 튜닝되었다는 것입니다. Sakana는 인간의 개입 없이 계획, 검색, 교차 검증, 보고서 작성까지 수행하는 주간 시장 조사 에이전트와, 티켓에 응답하면서 주문 데이터를 집계하는 고객 지원 워크플로우, 그리고 수족관 스크린샷을 읽고 다음 모티프를 결정해 실행하는 물고기 떼 조명 쇼를 시연했습니다.

게시된 사양:

• 베이스 모델 — Moonshot AI의 Kimi K2.6, 1T 파라미터 / 32B 활성 오픈 웨이트 MoE, Sakana 자체 일본어 데이터로 사내에서 후학습(post-training)된 모델

• 인터페이스 — OpenAI 호환; 모델 이름 sakana-namazu; base_url과 API 키만 변경하면 되며 코드 재작성은 필요 없습니다.

• 가격 — 입력 토큰 100만 개당 $0.95, 출력 토큰 100만 개당 $4.00, 캐시된 입력 100만 개당 $0.15; 추론 토큰은 출력 요금으로 청구

도구 — 웹 검색 1,000회 호출당 $7.00, 코드 실행 시간당 $0.12(세션 유지), 토큰 비용에 추가로 청구

• 모달리티 — 텍스트 및 이미지 입력, 텍스트 출력

• 컨텍스트 창 — Sakana가 공개하지 않음

• 가용성 — Sakana의 API 콘솔을 통해 제공되며, GDPR 관련 작업이 진행되는 동안 EU/EEA, 영국, 스위스에서는 사용할 수 없습니다.

정직성의 격차에 유의하세요: 여기 있는 모든 품질 주장은 공급업체가 보고한 것입니다. Sakana는 컨텍스트 창을 공개하지 않았고, 지연 시간이나 처리량 수치도 발표하지 않았으며, 어떤 독립 연구소도 아직 Sakana Namazu를 평가하지 않았습니다.

A single-column scoreboard for Sakana Namazu listing the Kimi K2.6 base, $0.95/$4.00 per 1M tokens, an undisclosed context window, built-in web search and code execution, a vendor-reported FairPoliticsQA jump from 34.1% to 56.3%, and no independent scores, with a sourcing footer noting vendor-reported benchmarks. OrcaRouter logo composited bottom-right.

FairPoliticsQA 점프가 진짜 이야기다.

사카나가 선두를 달리는 벤치마크는 FairPoliticsQA로, 정치적·역사적으로 논란이 많은 질문에 대한 답변 중립성을 평가하는 내부 지표입니다. 바로 한 국가의 인터넷 데이터로 주로 학습된 모델이 그 국가의 관점을 흡수하기 쉬운 주제들입니다. 사카나는 Sakana Namazu가 기본 모델인 Kimi K2.6 대비 34.10%에서 56.30%로 상승했다고 보고합니다. 이는 놀라운 수치이며, 검증할 가치가 있는 솔직한 결과입니다. 이 평가는 사카나 자체적으로 만든 것이고, 그 구성이 완전히 공개된 것도 아니며, 중립성 벤치마크에서의 상승 폭은 기본 모델의 초기 편향을 보여주는 동시에 그 개선 효과를 보여주기도 합니다. 하지만 그 방향성이야말로 이 제품의 핵심입니다. 중국이나 미국식으로 답하지 않는 일본 주권 LLM이라는 점이 바로 그것입니다.

그 외 결과는 {{1}}기존 성능을 유지하면서 약간 개선된{{/1}} 양상입니다: JFBench(일본어 지시 따르기)는 기본 모델 대비 1.5% 상승했고, 내부 일본어→영어 번역 평가는 경어 중심 텍스트에서 개선되었으며, AIME26, MMLU-Pro, LiveCodeBench v6는 거의 변동이 없었습니다. {{2}}기본 모델이 이미 강력했다면, 튜닝된 모델이 일본어 맥락 동작을 개선하면서도 강점을 유지하는 것은 사후 훈련(post-training) 작업에서 정확히 원하는 트레이드오프입니다.{{/2}}

A pricing card for Sakana Namazu v1.0 showing $0.95 input, $4.00 output, and $0.15 cached input per 1M tokens, web search at $7.00 per 1,000 calls, code execution at $0.12 per hour, and a note that the model is not available in the EU/EEA, UK, or Switzerland and may train on inputs by default.

가격은 기본 모델의 가격입니다.

가격 책정은 Sakana Namazu가 영리하거나 절박한 모습을 보이는 지점이며, 두 해석 모두 진지하게 받아들일 가치가 있다. 기본 모델의 정가를 청구한다는 것은 개발자가 "Kimi K2.6 직접 호출"과 "일본어 튜닝을 거친 Sakana Namazu 호출"을 비교할 때 튜닝에 대한 추가 비용이 없다는 것을 의미하며, 이는 하나의 숫자로 요약되는 전체 채택 전략이다. 또한 이는 일본 비즈니스 워크로드에서 그 가치를 분명히 드러낸다. keigo, 전문 용어, 거절 감소, 내장 웹 검색, 코드 실행이 토큰당 추가 요금 없이 제공되기 때문이다.

도구 수수료는 주목해야 할 부분입니다. 에이전트 루프가 실제로 비용을 지출하는 곳이기 때문입니다. 웹 검색은 1,000회 호출당 $7.00, 코드 실행은 시간당 $0.12라서 작아 보이지만, 주간 리서치 에이전트가 수백 건의 검색을 실행하면 이야기가 달라집니다. 확장되는 것은 토큰 가격이 아니라 호출 수입니다. 공급업체 가격을 마크업 없이 그대로 전달하는 라우팅 게이트웨이는 이러한 수치를 정확히 투명하게 유지합니다. 즉, 플랫폼 계층이 도구 비용을 부풀리지 않고, 공급업체의 가격 인하가 게시된 당일에 귀하 쪽에 바로 반영됩니다. (Sakana Namazu 자체는 아직 OrcaRouter의 카탈로그에 없습니다 — Sakana 자체 콘솔에서 실행됩니다 — 하지만 패스스루 원칙 덕분에 기본 모델과의 비교가 깔끔하게 유지됩니다.)

The Artificial Analysis page for Kimi K2.6 in English, showing an Intelligence Index of 45, first-party pricing of $0.95/$4.00 per 1M tokens, and a note that Moonshot has since launched Kimi K3, captured August 11, 2026.

사카나가 공개하지 않은 것들

어떤 벤치마크보다도 더 중요한 세 가지 허점이 있다. 첫째, 컨텍스트 창에 대한 정보가 없다. {{1}}Sakana의 발표와 제품 페이지에는 이 정보가 전혀 없는데, 에이전트용으로 마케팅되는 API로서는 이례적이다.{{/1}} 둘째, 독립적인 평가가 없다. {{2}}기반 모델인 Kimi K2.6은 세계에서 가장 정밀하게 측정된 오픈웨이트 모델 중 하나이며, Artificial Analysis는 이를 오픈웨이트 분야 최상위로 평가한다. 그러나 Sakana Namazu의 개선 수치는 전적으로 자체 보고에 의존한다.{{/2}} 셋째, 데이터 처리 방식이다. {{3}}기본적으로 입력 데이터가 학습에 사용될 수 있으며, 콘솔에서 이를 거부(opt-out)할 수 있다. 또한 처리가 일본 내에서만 이루어진다고 보장되지 않는다. 고객 데이터를 전송하기 전에 알아두어야 할 사항이다.{{/3}}

누가 시도해 봐야 하고, 누가 기다려야 할까

일본어 제품이나 내부 도구를 출시하는데, 일본 비즈니스 상대처럼 답하는 모델 — 경어를 유지하고, 거절을 줄이고, 에이전트 도구가 내장된 — 이 빠진 조각이고, 당분간 독립적인 벤치마크 없이도 괜찮다면 사용해 보세요. 배포 지역이 EU, 영국, 또는 스위스(그곳에서는 사용할 수 없음)라면, 규정 준수상 일본 내에서만 데이터 처리가 보장되어야 한다면, 또는 검색 설계를 계획할 수 있는 컨텍스트 윈도우가 필요하다면 보류하세요.

향후 몇 주 동안 주목할 것: Sakana Namazu에 대한 공개 리더보드의 독립적인 평가표, 컨텍스트 윈도우 공개, 그리고 EU 규제가 해제되는지 여부입니다. 그런 것들이 도래할 때까지는 Sakana Namazu를 있는 그대로 취급하십시오 — 진지하고, 가격이 합리적이며, 일본 국책적인 베팅으로서, 현재로서는 제작자의 말만이 근거인 투자처입니다.

© 2026 OrcaRouter

제공업체용

추론 플랫폼을 운영하시나요? OrcaRouter에 모델을 등록하세요.

문의하기

커뮤니티에 참여하세요

DiscordEmailXGitHubYouTube