כרטיס הירו מחולל שכותרתו 'Claude Haiku 5.5 vs Sakana Namazu' עם שני פאנלים זה לצד זה. הפאנל השמאלי, Claude Haiku 5.5, מפרט 'שימוש כללי', '$0.10 / $0.50 ל-1M' ו-'Index 43'. הפאנל הימני, Sakana Namazu, מפרט 'מומחה ליפנית', '$0.95 / $4.00 ל-1M' ו'בנצ'מרקים של הספק בלבד'. רצועה ברוחב מלא מתחת מציינת 'אותה צורה מהירה וזולה, התמחויות מנוגדות.' בתחתית נכתב 'Index לפי Artificial Analysis; נתוני Namazu לפי Sakana AI, ללא ביקורת.' הלוגו של OrcaRouter מורכב בפינה הימנית התחתונה.
Guides & Insights

Claude Haiku 5.5 לעומת Sakana Namazu: שניהם זולים, שניהם מהירים, וכמעט אין ביניהם שום דבר אחר משותף

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

על פני השטח, השניים האלה נראים כשווים. Claude Haiku 5.5הוא שכבת ה-small fast tier הקטנה והמהירה של הספק, שיצאה ב-7 באוקטובר 2026 במחיר של 0.10 דולר למיליון טוקני קלט ו-0.50 דולר למיליון טוקני פלט, עם חלון של מיליון טוקנים, ונבנתה לסיווג, חילוץ, ניתוב ועבודת תת-סוכנים. Sakana Namazuהוא מודל API של Sakana AI המתמחה ביפנית, שהושק ב-3 באוגוסט 2026, בתעריף של 0.95 דולר למיליון טוקני קלט ו-4.00 דולר למיליון טוקני פלט, עם תעריף של 0.15 דולר לקלט במטמון; הוא שוכלל מעל בסיס Kimi K2.6 הפתוח עם post-training של Sakana עצמה, וזמין דרך נקודת קצה תואמת OpenAI.

שניהם ממוקמים כאפשרות במחיר נוח בסדרות שלהם, ושם הדמיון נגמר. Claude Haiku 5.5 הוא מודל מערבי רב-תכליתי שאליו תפנו כדי לנתב תעבורה; Sakana Namazu הוא מודל ייעודי למדינה שאליו תפנו כאשר המשימה ביפנית והחלופה היא מודל כללי שעושה זאת רע. השאלה המעניינת היא לא מי טוב יותר. היא מה מומחה מקנה לך, היכן באמת עובר הגבול של אותה התמחות, ומה העלות של לצאת ממנה.

מה ש-Sakana AI בנתה בפועל

כדאי להבין את Sakana Namazu לפני שמשווים אותו לשום דבר אחר, משום שהבנייה שלו יוצאת דופן. הוא לא אומן מאפס. זהו עידון של מודל קיים עם משקלים פתוחים — Kimi K2.6 — אשר Sakana אימנה אותו עוד בשלב הפוסט-אימון, ושאותו היא מגישה כ-API סגור. השושלת חשובה: היכולות הכלליות של המודל הבסיסי — חשיבה וכתיבת קוד — עוברות בירושה, ומה ש-Sakana הוסיפה הוא הרובד הספציפי ליפן.

השכבה הזו מתועדת, וזה יותר ממה שאפשר לומר על רוב טענות הלוקליזציה. סקאנה מדווחת שנמזו שומרת על ביצועי מודל הבסיס בהערכות כלליות — AIME26, MMLU-Pro, LiveCodeBench v6 — בעוד שהיא עוקפת אותו בסט היפני ובסט הספציפי ליפן, כאשר FairPoliticsQA עולה מ-34.10% ל-56.30%. היא מפעילה בנצ'מרק תרגום ליפנית פנימי משלה, JFBench, ומדווחת גם על שיפורים בכל התחומים שם. מקרה בוחן נפרד, כלי לאיתור ראיות עבור רופאים, מדווח על 96.8% בבחינה הלאומית לרפואה ה-119 ועל 96.4% בבחינה ה-120.

אלה המספרים של Sakana על הבנצ'מרקים של Sakana, ו-JFBench אינו תקן ציבורי שמישהו אחר יכול לשחזר. הטענה ששורדת את ההסתייגות הזו היא צרה אך אמיתית: המודל הוא מודל בסיס בעל שם בתוספת שלב אימון־גמר מתועד, והפערים המדווחים הם מול הבסיס של עצמו ולא מול שאר התחום.

ה-API והתנאים המסחריים הם החלקים שיכריעו ברוב המקרים העסקיים. Namazu תואם ל-OpenAI — שינוי של נקודת קצה ושם דגם sakana-namazu הוא השינוי היחיד בקוד, לפי התיעוד של Sakana עצמה. הוא מחייב בדולרים אמריקאיים ומציע תשלום ביין בתוכנית Enterprise. הוא גם נושא עלויות כלים שהשוואה לפי טוקן לעולם לא תחשוף: $7.00 לאלף חיפושי אינטרנט ו-$0.12 לשעת הרצת קוד, אשר Sakana מצרפת למוצר.

יש שתי מגבלות שחשובות יותר מכל מספר בכרטיס התעריפים. Namazu אינו זמין באיחוד האירופי, באזור הכלכלי האירופי, בבריטניה או בשווייץ עד להשלמת עבודות תאימות הקשורות ל-GDPR, לפי הדף של Sakana עצמה. ומדיניות ברירת המחדל לטיפול בנתונים קובעת שקלטים עשויים לשמש לאימון ולשיפור המודלים של Sakana, עם אפשרות ביטול הסכמה (opt-out) הזמינה בהגדרות Console; החברה אומרת שהיא אינה יכולה להבטיח כרגע שהעיבוד יישאר כולו ביפן. עבור צוות אירופי או בריטי, הראשון פוסל והשני הוא שאלה שצריך להשיב עליה לפני השיחה הראשונה.

הגבול, כשהוא נאמר בכנות

זה הקטע שבו השוואה של דף מפרט הייתה משקרת לך, אז הנה מה שבאמת ניתן להשוות:

• מחיר — Claude Haiku 5.5:‏ $0.10 לקלט ו-$0.50 לפלט למיליון טוקנים עד 100,000 טוקנים של פרומפט, ולאחר מכן $0.50 ו-$2.50. Sakana Namazu:‏ $0.95 ו-$4.00, עם תעריף קלט במטמון של $0.15. Namazu יקר בערך פי תשע וחצי בקלט ופי שמונה בפלט בדרגה הראשונה.

• מטמון — קריאות מטמון של Claude Haiku 5.5 הן $0.01 ו-$0.05 למיליון, בהתאם לדרגה; זה של Sakana Namazu הוא $0.15 בשיעור אחיד. המספרים המוחלטים קרובים בדרגה העליונה, ובבדרגה התחתונה הפער ביניהם הוא פי עשרים ותשעה.

• כלים — אף אחד מהם אינו מודל טקסט בלבד, ואף אחד מהם לא גובה באותו אופן. Claude Haiku 5.5 מגיע עם חשיבה אדפטיבית, חוגת מאמץ מ־Low עד Max ותמיכה בכלים בצד השרת; Sakana Namazu כולל חיפוש באינטרנט ב־7.00 דולר לאלף קריאות והרצת קוד ב־0.12 דולר לשעה.

• הקשר — מיליון טוקנים עבור Claude Haiku 5.5. Sakana אינה מפרסמת חלון הקשר עבור Namazu, וכל נתון שתראו שמצוטט עבורו הוא הנחה לגבי הבסיס Kimi K2.6 ולא מפרט.

• ניקוד בלתי־תלוי — ל-Claude Haiku 5.5 יש מדד בינה של Artificial Analysis של 43, שני מתוך 182 בקטגוריה שלו בלוח הזה, עם עלות של $0.21 לכל משימת מדד בינה. ל-Sakana Namazu אין רשומה ב-Artificial Analysis, ואין הערכה של צד שלישי מכל סוג שאיתרתי. הנתונים המפורסמים שלו הם שלו עצמו.

• זמינות — Claude Haiku 5.5 זמין ב-Claude API, ב-Amazon Bedrock, ב-Vertex AI, ב-Microsoft Foundry וב-Claude Platform on AWS, עם התחייבות מפורסמת לפרישה שלא לפני 7 באוקטובר 2027. Sakana Namazu זמין ב-API של Sakana עצמה, ב-Sakana Chat ובמוצר Sakana Translate, ואינו זמין באיחוד האירופי, באזור הכלכלי האירופי, בממלכה המאוחדת ובשווייץ.

• טיפול בנתונים — התנאים של הספק הם בסטנדרט ארגוני, ובלוקי החשיבה של המודל מוגבלים לחשבון שיצר אותם. ברירת המחדל של Sakana Namazu היא שקלטים עשויים לשמש לאימון, עם אפשרות ביטול.

• מודאליות — Claude Haiku 5.5 קולט טקסט ותמונות; כיסוי המודאליות של Sakana Namazu לא פורסם מעבר למיצוב שלו כמערכת שמתמקדת קודם כול בטקסט.

• רישיון ושושלת — Claude Haiku 5.5 הוא קנייני וזמין רק דרך API. Sakana Namazu הוא קנייני אך בנוי על משקולות פתוחות של Kimi K2.6, מה שאומר שהבסיס ניתן לבדיקה אך המודל המכוונן לא.

בעיית הניקוד ההוגן

קראו את הרשימה ההיא ושימו לב למה שחסר: כל שורה שאומרת איזה מודל מפיק פלט יפני טוב יותר. זו אינה שגגה. אין ביניהם בנצ'מרק משותף שיכריע את זה. הביצועים החזקים של Claude Haiku 5.5 ביפנית אינם משהו שהספק מפרסם כטענה מרכזית, והמספרים של JFBench מבית Sakana הם כלי מדידה משלה. מודל קטן כללי ברמת החזית מספק בעל יכולת רב-לשונית חזקה, שהוערך מול מודל מבוסס Kimi שעבר אימון-המשך במיוחד עבור יפנית, הוא השוואה שאיש לא באמת ערך ופרסם.

מה שאפשר לומר הוא מבני ולא אמפירי. הזהות המסחרית כולה של Namazu היא הטענה שמודל כללי אינו טוב מספיק לעבודה ביפנית — ששפה ייחודית למדינה, הסקה תרבותית והקשר מקומי הם יכולת נפרדת שמצדיקה מודל מתמחה במחיר גבוה פי תשעה. אם אתם מאמינים לטענה הזו, Namazu הוא התשובה, והמחיר הוא מה שהתשובה עולה. אם לא, מודל כללי במחיר של $0.10 למיליון טוקנים הוא מה שאתם משתמשים בו, והשאלה היא אם אתם יכולים למדוד את ההבדל בתעבורה שלכם.

הגרסה הניתנת למדידה של הטענה היא זו ש-Sakana מספקת: FairPoliticsQA עובר מ-34.10% ל-56.30% לעומת מודל הבסיס שממנו הוא כוונן. זהו שיפור אמיתי בבנצ'מרק אמיתי, אבל זו השוואה מול Kimi K2.6, לא מול Claude Haiku 5.5 — והיא מלמדת אותך שפוסט-אימון להקשר פוליטי ייחודי ליפן משפר באופן מורגש את הביצועים במשימה הזו, שזו הצהרה מצומצמת יותר וניתנת להגנה יותר מאשר "טוב יותר ביפנית".

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Sakana Namazu - the scoreboard', with six rows carrying both sides. Input price: $0.10 / 1M against $0.95 / 1M. Output price: $0.50 / 1M against $4.00 / 1M. Cached input: $0.01 to $0.05 / 1M against $0.15 / 1M. Focus: general purpose against Japanese language and context. Lineage: proprietary against Kimi K2.6 post-trained. Independent index: 43 against no entry. The footer reads 'Claude Haiku 5.5 index per Artificial Analysis; Namazu figures per vendor.' The OrcaRouter logo is composited in the bottom-right corner.

איך נראה פער העלויות בהיקף

הריצו פייפליין צנוע של 10 מיליון טוקני קלט ו-2 מיליון טוקני פלט ביום דרך שניהם.

• עלות קלט, ליום — $1.00 ב-Claude Haiku 5.5, $9.50 ב-Sakana Namazu.

• עלות פלט, ליום — $1.00 ב-Claude Haiku 5.5, $8.00 ב-Sakana Namazu.

• סה״כ יומי — $2.00 לעומת $17.50, בערך $60 בחודש לעומת $525.

אותם 525 דולר הם לפני אפילו קריאת חיפוש אינטרנט בודדת או שעת הרצת קוד אחת. תוסיפו 500 קריאות חיפוש ביום, ו-Namazu עולה עוד 3.50 דולר ליום, מה שמעלה את הסכום ל-21.00 דולר מול 2.00 דולר — יחס של יותר מעשרה לאחד, ששום כמות של יעילות טוקנים לא סוגרת.

האם מדובר בהרבה תלוי לחלוטין במהי החלופה. אם הבחירה שלך היא Namazu או מודל כללי שמייצר פלט יפני בינוני שאנשי הביקורת שלך צריכים לתקן ביד, ה-$525 קונה בחזרה שעות של סוקרים, וההשוואה אינה טוקן מול טוקן אלא טוקן מול משכורת. אם התעבורה שלך ביפנית שגרתית וכבר טובה מספיק במודל כללי, תוספת המחיר לא קונה שום דבר מדיד, ואותם דולרים קונים פי עשרה נפח במקום אחר.

האפשרות השלישית היא המעניינת עבור מוצר בשפה היפנית: להשתמש במודל המתמחה במקום שבו טענת ההתמחות מחזיקה — תרגום, הקשר מקומי, טקסט רגולטורי ופוליטי — ובמודל כללי לעבודת הנפח שסביב זה. זו אינה פשרה. זו הארכיטקטורה שהתמחור למעשה מרמז עליה, מפני שהפרמיה של Namazu משולמת לפי טוקן ואין סיבה לשלם אותה על סיווג.

A headless capture of Anthropic's Claude Platform model documentation showing the Models overview comparison table with the Claude Haiku 5.5 column alongside Claude Fable 5.1, Claude Opus 5.5 and Claude Sonnet 5.5, including the 'From $0.10 / input MTok' and 'From $0.50 / output MTok' pricing rows, the 1M-token context window entry and the 'Fastest' comparative latency listing for Claude Haiku 5.5.

אף אחד מהדגמים אינו בקטלוג שלנו

עלינו להיות ברורים לגבי זה, מפני שזהו סוג ההשוואה שבה קל להבריח פסקה על זמינות: OrcaRouter אינו מספק לא את Claude Haiku 5.5 ולא את Sakana Namazu. Namazu זמין דרך ה-API של Sakana עצמה, ו-Claude Haiku 5.5 דרך זה של הספק ושל העננים הגדולים. אף אחת מהעובדות הללו אינה משנה את ההשוואה, שנשענת על תעריפים מפורסמים, יכולות מפורסמות ומגבלות מפורסמות.

התפקיד שנקודת קצה אחת ממלאת במקרה כזה הוא צר יותר וכנה יותר מאשר תוסף. זהו החלק של המודל הכללי בפתרון היברידי — המקום שאליו תנתב את תעבורת הסיווג והחילוץ שאינה ביפנית ושאינה זקוקה למומחה, בלי להקים מערכת יחסים עם ספק נוסף עבורה. API אחד ליותר מ-200 מודלים, תעריפי המחירון של הספקים מועברים הלאה בתוספת של 0%, מעבר אוטומטי לגיבוי בין ספקים, וה-DSL של הניתוב כששפת הבקשה צריכה לקבוע את הנתיב ולא האפליקציה. אם אתם מריצים מוצר בשפה היפנית לצד מוצר בשפה האנגלית, זה התפר שאחרת הייתם בונים במו ידיכם.

איזה אחד, ולמי

בחר ב-Sakana Namazu כאשר יפנית היא המוצר ולא רק לוקאל — כאשר הסוקרים שלך מתקנים את הפלט, כאשר התחום הוא משפט מקומי, רפואה, פוליטיקה או שירות לקוחות, כאשר תוספת מחיר של פי תשעה על טוקנים קטנה מהעלות של התיקונים שהיא מייתרת, וכאשר המשתמשים שלך נמצאים מחוץ לאיחוד האירופי, לאזור הכלכלי האירופי, לבריטניה ולשווייץ, או שיש לך יועצים משפטיים שאישרו את שאלת הטיפול בנתונים.

בחר ב-Claude Haiku 5.5 כאשר העבודה כללית, הנפח גבוה, ואתה רוצה ציון שנמדד באופן עצמאי ולא בנצ'מרק של ספק — כאשר $0.10 ו-$0.50 למיליון טוקנים עושים את החשבון בשבילך, כאשר אתה צריך את חלון מיליון הטוקנים במסמך ארוך, או כאשר התשובה לשאלה "מה טוב יותר ביפנית" צריכה לבוא מההערכה שלך ולא מזו של אף אחד מהספקים.

השניים אינם באמת יריבים. האחד הוא מודל לשימוש כללי שמתומחר לשימוש מתמיד; האחר הוא מודל מומחה שמתומחר לשימוש מחושב. הטעות היא לקנות את המומחה לעבודה שהמודל הכללי כבר עושה היטב, והטעות ההפוכה — להניח שמודל כללי מתמודד עם השפה וההקשר של מדינה מסוימת באותה מידה כמו משהו שאומן לכך — היא זו שכל העסק של Sakana בנוי על כך שאנשים עושים אותה.

A headless capture of the OrcaRouter models catalogue page reading '207 models, 16 providers, one API key, one bill', with the filter sidebar showing input-modality counts, a pricing filter and a populated model list, and the panel that reads 'How to call any model' with an OpenAI-compatible curl sample pointing at https://api.orcarouter.ai/v1/chat/completions.