
Sakana Namazu API: LLM riêng của Nhật Bản với mức giá của mô hình cơ sở
- metaMỚIMeta: Muse Spark 1.22026-08-0557Trí tuệ72Lập trình
- qwenMỚIQwen: Qwen3.8 Max2026-08-0358Trí tuệ72Lập trình
- deepseekMỚIDeepSeek: DeepSeek V4 Flash 07312026-07-3152Trí tuệ69Lập trình
- minimaxMỚIMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token · 2143 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2152Trí tuệ69Lập trình
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Trí tuệ49Lập trình
- metaMeta: Muse Spark 1.12026-07-1653Trí tuệ71Lập trình
- kimiMoonshotAI: Kimi K32026-07-1560Trí tuệ76Lập trình
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Trí tuệ71Lập trình
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Trí tuệ77Lập trình
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Trí tuệ77Lập trình
- grokxAI: Grok 4.52026-07-0856Trí tuệ72Lập trình
- tencentTencent: Hy32026-07-0642Trí tuệ59Lập trình
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Trí tuệ42Lập trình
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Trí tuệ39Lập trình
- anthropicAnthropic: Claude Sonnet 52026-06-3055Trí tuệ72Lập trình
- klingKling: Kling 3.0 Turbo2026-06-1757Trí tuệ52Lập trình57Toán
Sakana Namazu, API LLM dành cho doanh nghiệp Nhật Bản của Sakana AI, được xây dựng trên Kimi K2.6 mã nguồn mở (open-weight) của Moonshot, đã chính thức ra mắt vào ngày 2 tháng 8 năm 2026 — và con số quan trọng nhất là chi phí của nó bằng chính xác chi phí của mô hình gốc. Moonshot tính phí $0.95 cho mỗi triệu token đầu vào và $4.00 cho mỗi triệu token đầu ra cho Kimi K2.6 trên API của chính họ. Sakana cũng tính phí $0.95 / $4.00 tương tự cho Sakana Namazu, một mô hình mà họ tiếp tục huấn luyện nội bộ cho tiếng Nhật, kính ngữ (keigo) và bối cảnh kinh doanh. Toàn bộ phần phí cộng thêm cho việc huấn luyện bổ sung là bằng không.
Những gì thực sự đã được phát hành
API tương thích với OpenAI: bạn giữ nguyên client hiện tại, đổi base_url, đặt model thành sakana-namazu, và nó hoạt động ngay lập tức — bao gồm cả function calling. Điểm khác biệt lớn nhất so với một endpoint Kimi K2.6 đơn thuần là tìm kiếm web và thực thi mã được tích hợp như những công cụ hạng nhất, và mô hình được tinh chỉnh để sử dụng chúng trong một vòng lặp tự động. Sakana đã trình diễn một agent nghiên cứu thị trường hàng tuần có thể lập kế hoạch, tìm kiếm, đối chiếu chéo và viết báo cáo mà không cần sự can thiệp của con người; một quy trình hỗ trợ khách hàng tổng hợp dữ liệu đơn hàng trong khi trả lời ticket; và một màn trình diễn ánh sáng bầy cá có thể đọc ảnh chụp màn hình bể cá, quyết định họa tiết tiếp theo và thực thi nó.
Thông số kỹ thuật như đã công bố:
• Mô hình cơ sở — Kimi K2.6 của Moonshot AI, một MoE mã nguồn mở với 1T tham số / 32B hoạt động, được huấn luyện bổ sung nội bộ trên dữ liệu tiếng Nhật của chính Sakana
Giao diện — tương thích OpenAI; tên mô hình sakana-namazu; thay đổi base_url và API key, không cần viết lại mã.
• Giá — 0,95 USD cho mỗi 1 triệu token đầu vào, 4,00 USD cho mỗi 1 triệu token đầu ra, 0,15 USD cho mỗi 1 triệu token đầu vào đã lưu cache; token tư duy được tính theo giá token đầu ra.
• Công cụ — tìm kiếm web với giá $7,00 cho mỗi 1.000 lượt gọi, thực thi mã với giá $0,12 mỗi giờ (phiên được giữ lại), được tính thêm ngoài chi phí token.
• Phương thức — đầu vào văn bản và hình ảnh, đầu ra văn bản
• Cửa sổ ngữ cảnh — không được Sakana tiết lộ
Tính khả dụng — hoạt động trực tiếp qua bảng điều khiển API của Sakana; không khả dụng tại EU/EEA, Vương quốc Anh hoặc Thụy Sĩ trong khi công việc GDPR vẫn đang được tiếp tục.
Lưu ý về khoảng cách trung thực: mọi tuyên bố về chất lượng ở đây đều do chính nhà cung cấp báo cáo. Sakana chưa công bố cửa sổ ngữ cảnh, chưa công bố số liệu về độ trễ hoặc thông lượng, và chưa có phòng thí nghiệm độc lập nào chấm điểm Sakana Namazu.

Sự tăng vọt của FairPoliticsQA mới là câu chuyện thực sự.
Chuẩn đánh giá mà Sakana dẫn đầu là FairPoliticsQA, một bài đánh giá nội bộ về tính trung lập của câu trả lời đối với các câu hỏi mang tính chính trị và lịch sử nhạy cảm — chính xác là những chủ đề mà một mô hình được huấn luyện phần lớn trên internet của một quốc gia có xu hướng tiếp thu cách diễn giải của quốc gia đó. Sakana báo cáo Sakana Namazu tăng từ 34,10% lên 56,30% so với mô hình nền Kimi K2.6. Đây là một con số ấn tượng và đáng để kiểm tra một cách thẳng thắn: bài đánh giá này do chính Sakana thực hiện, cách xây dựng của nó không hoàn toàn công khai, và một bước nhảy trên chuẩn đánh giá tính trung lập phản ánh thiên kiến ban đầu của mô hình nền cũng nhiều như phản ánh sự khắc phục. Tuy nhiên, hướng đi mới chính là toàn bộ ý nghĩa của sản phẩm — một LLM có chủ quyền của Nhật Bản, không trả lời như mô hình của Trung Quốc hay Mỹ.
Ở những nơi khác, bức tranh là "giữ vững phong độ cộng thêm một chút": {{1}}JFBench (tuân theo hướng dẫn tiếng Nhật) tăng 1,5% so với mô hình cơ sở, một bài đánh giá dịch tiếng Nhật sang tiếng Anh nội bộ đã cải thiện trên các văn bản nặng kính ngữ, và AIME26, MMLU-Pro cùng LiveCodeBench v6 gần như không đổi.{{/1}} Nếu mô hình cơ sở đã mạnh, thì mô hình tinh chỉnh vẫn mạnh trong khi cải thiện hành vi theo ngữ cảnh tiếng Nhật chính là sự đánh đổi bạn mong muốn từ một nỗ lực hậu huấn luyện.

Giá này là giá của phiên bản cơ sở.
{{1}}Định giá là nơi Sakana Namazu hoặc tỏ ra khôn ngoan, hoặc tỏ ra liều lĩnh, và đáng để xem xét nghiêm túc cả hai cách diễn giải.{{/1}} Việc tính giá niêm yết của mô hình gốc có nghĩa là một nhà phát triển so sánh "gọi Kimi K2.6 trực tiếp" với "gọi Sakana Namazu bản tinh chỉnh tiếng Nhật" sẽ không thấy mức phụ phí nào cho việc tinh chỉnh — đó chính là toàn bộ chiến lược áp dụng được gói gọn trong một con số. {{2}}Điều này cũng khiến giá trị trở nên rõ ràng đối với các khối lượng công việc kinh doanh tại Nhật Bản: kính ngữ (keigo), thuật ngữ chuyên ngành, giảm thiểu tỷ lệ từ chối, tìm kiếm web và thực thi mã tích hợp sẵn — tất cả đều không có phụ phí theo token.{{/2}}
Phí công cụ là phần cần theo dõi, vì đó là nơi một vòng lặp agentic thực sự tiêu tốn tiền. Tìm kiếm web với giá $7,00 mỗi 1.000 lượt gọi và thực thi mã với giá $0,12 mỗi giờ nghe có vẻ nhỏ, cho đến khi một tác nhân nghiên cứu hàng tuần chạy vài trăm lượt tìm kiếm — số lượng cuộc gọi, chứ không phải giá token, mới là thứ tăng theo quy mô. Một cổng định tuyến chuyển thẳng giá nhà cung cấp mà không cộng thêm phí sẽ giữ cho những con số này luôn trung thực: không có lớp nền tảng nào thổi phồng chi phí công cụ, và đợt giảm giá của nhà cung cấp sẽ hiển thị trực tiếp phía bạn ngay trong ngày được công bố. (Bản thân Sakana Namazu chưa có trong danh mục của OrcaRouter — nó chạy trên console riêng của Sakana — nhưng nguyên tắc chuyển thẳng giá chính là lý do khiến phép so sánh với mô hình gốc vẫn giữ được sự minh bạch.)

Những điều Sakana đã không công bố
Ba thiếu sót đáng quan tâm hơn bất kỳ điểm chuẩn nào. Thứ nhất, không có cửa sổ ngữ cảnh — thông báo và trang sản phẩm của Sakana bỏ qua hoàn toàn thông số này, điều bất thường đối với một API được tiếp thị cho mục đích sử dụng tác nhân (agentic). Thứ hai, không có đánh giá độc lập; Kimi K2.6, mô hình gốc, là một trong những mô hình open-weight được đo lường kỹ lưỡng nhất thế giới — Artificial Analysis xếp nó đứng đầu trong lĩnh vực open-weight — nhưng các mức cải thiện (delta) của Sakana Namazu hoàn toàn do tự báo cáo. Thứ ba, xử lý dữ liệu: theo mặc định, dữ liệu đầu vào của bạn có thể được dùng để huấn luyện, với tùy chọn từ chối (opt-out) trong console, và việc xử lý không được đảm bảo diễn ra tại Nhật Bản — điều cần biết trước khi bạn gửi dữ liệu khách hàng qua nó.
Ai nên dùng thử, ai nên chờ
Hãy thử nó nếu bạn phân phối các sản phẩm hoặc công cụ nội bộ bằng tiếng Nhật và mảnh ghép còn thiếu là một mô hình trả lời như một đối tác kinh doanh Nhật Bản — kính ngữ nguyên vẹn, giảm thiểu từ chối, tích hợp sẵn các công cụ agent — và bạn có thể tạm thời chấp nhận không có các bài đánh giá độc lập. Hãy cân nhắc nếu hệ thống triển khai của bạn ở EU, Anh hoặc Thụy Sĩ (mô hình không có sẵn ở đó), nếu quy định tuân thủ của bạn yêu cầu đảm bảo xử lý dữ liệu chỉ tại Nhật Bản, hoặc nếu bạn cần một cửa sổ ngữ cảnh mà bạn có thể lên kế hoạch thiết kế truy xuất dựa trên đó.
Điều cần theo dõi trong vài tuần tới: bảng điểm độc lập cho Sakana Namazu trên bảng xếp hạng công khai, việc công bố cửa sổ ngữ cảnh, và liệu lệnh hạn chế của EU có được dỡ bỏ hay không. Cho đến khi những điều đó được xác nhận, hãy coi Sakana Namazu đúng như bản chất của nó — một canh bạc nghiêm túc, được định giá hợp lý, đặt vào chủ quyền Nhật Bản, hiện chỉ đáng tin đến mức lời hứa của nhà sản xuất.
