כרטיס הירו שנוצר שכותרתו 'Claude Haiku 5.5 נגד Aion 3.5', עם כותרת מקדימה 'פי 30 ממחיר הקלט' וכותרת משנה 'אחד מדורג. אחד לא.', הנושא צ'יפים המציגים $0.10 לעומת $3.00 למיליון טוקני קלט, מדד AA של 43 לעומת אין, ו-1M לעומת הקשר של 262K.
Guides & Insights

Claude Haiku 5.5 לעומת Aion 3.5: פי שלושים ממחיר הקלט עבור מודל שאיש לא נתן לו ציון

מחבר

Alistair Wren

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Claude Haiku 5.5 מתומחר ב-0.10 דולר למיליון אסימוני קלט. Aion 3.5 מתומחר ב-3.00 דולר. זה פי שלושים ממחיר הקלט ופי שתים עשרה ממחיר הפלט עבור שני מודלים ששניהם מקבלים פרומפט טקסט ארוך ומחזירים טקסט, והפער אינו מוסבר ביכולת — הוא מוסבר במה שכל חברה מוכרת. Claude Haiku 5.5, שיצא ב-7 באוקטובר 2026, הוא סוס עבודה עם תמחור סחורתי, חוגת מאמץ וציון עצמאי. Aion 3.5, שיצא ב-23 בספטמבר 2026 על ידי AionLabs, הוא אנסמבל עם הסקה מחייבת שמגיע בשני גדלים, שאחד מהם זול באמת. השאלה אם שווה לשלם את הפרמיה של פי שלושים תלויה כולה בשאלה שהספק לא ענה עליה.

החלק הלא־נוח מלכתחילה: Artificial Analysis העניקה ציון ל-Claude Haiku 5.5 ומעולם לא פרסמה ציון עבור Aion 3.5. גם לא מצאנו שאף אחד אחר עשה זאת. לכן זו אינה השוואה בין שני דברים שנמדדו. זו השוואה בין דבר אחד שנמדד לבין סט אחד של טענות ספק, והדרך הכנה לכתוב אותה היא לומר זאת בכל סעיף ולא רק פעם אחת בהערת שוליים.

שני המודלים, כל אחד בפסקה אחת

Claude Haiku 5.5הוא המודל הקטן של הספק, עם מזההclaude-haiku-5-5, קלט טקסט ותמונה ופלט טקסט, עם חלון הקשר של 1M טוקנים, פלט מקסימלי של 128,000 טוקנים (300,000 עם כותרת בטא ב-Batch API), חיתוך אימון של יוני 2026 והתחייבות של Anthropic שלא להפסיק אותו לפני 7 באוקטובר 2027. ניתן לכוונן את המאמץ בין Low, Medium, High, Xhigh ו-Max, כאשר ברירת המחדל היא Medium, עם חשיבה אדפטיבית מופעלת כברירת מחדל. קריאות מטמון עולות $0.01 למיליון טוקנים. מעל 100,000 טוקנים של פרומפט, גם תעריפי הקלט וגם תעריפי הפלט מוכפלים בחמישה.

Aion 3.5 הוא הדגם המוביל של AionLabs, מזהה aion-labs/aion-3.5, והוא טקסט-בלבד בשני הכיוונים. חלון ההקשר הוא 262,144 טוקנים — כפול מ-131,072 של Aion 3.0 — עם פלט מרבי של 32,768 טוקנים. החשיבה היא חובה ולא אופציונלית, עם ברירת מחדל של high שניתן להעלות ל-max או להוריד ל-low. מבחינה ארכיטקטונית הוא מתואר כאנסמבל רב-מודלי במשפחת GLM ולא כרשת מאומנת יחידה, וזה הדבר המעניין ביותר בו וגם הדבר הקשה ביותר לאימות מבחוץ. המחיר הוא $3.00 למיליון טוקני קלט, $0.75 לקלט שמור במטמון ו-$6.00 לפלט, אחיד לאורך כל החלון. Aion 3.5 Mini, שהושק באותו יום, עולה $0.70 / $0.18 / $1.40 עבור אותו חלון הקשר של 256K — והאח הקטן הזה הוא מה שהופך את ההשוואה הזו למעניינת.

A capture of the AionLabs documentation page listing available models and their pricing, showing Aion 2.0, Aion 3.0, Aion 3.0 Mini, Aion 3.5 and Aion 3.5 Mini with their context windows and per-million input, cached-input and output rates, including Aion 3.5 at 256K context and Aion 3.5 Mini at the lower tier.

• המידות, כל אחת בשורה אחת

• מחיר קלט — Claude Haiku 5.5‏ $0.10 למיליון עד 100K טוקנים, ועולה ל-$0.50 מעל זה; Aion 3.5‏ $3.00 אחיד לאורך כל חלון ה-256K.

• מחיר פלט — Claude Haiku 5.5‏ $0.50 למיליון עד 100K ואז $2.50; Aion 3.5‏ $6.00 אחיד.

• קלט במטמון — Claude Haiku 5.5 $0.01 למיליון בקריאות ו-$0.125 בכתיבות של חמש דקות; Aion 3.5 $0.75 על קלט במטמון, ללא תעריף קריאה שפורסם בנפרד.

• חלון הקשר — 1,000,000 אסימונים לעומת 262,144.

• פלט מקסימלי — 128,000 טוקנים לעומת 32,768.

• אופני קלט — טקסט ותמונות לעומת טקסט בלבד.

• בקרת חשיבה — חוגת מאמץ בת חמש עמדות מ-Low עד Max לעומת שלוש עמדות שבהן high מוגדר כברירת המחדל.

• ציון עצמאי — Artificial Analysis Intelligence Index‏ 43 עם תצורת Max של 43.40, מקום שני מתוך 182 מודלים; עבור Aion 3.5 לא פורסם ציון.

• עלות לכל משימה שהושלמה — $0.21 למשימת אינדקס של Artificial Analysis עבור Claude Haiku 5.5; לא ניתנת למדידה עבור Aion 3.5 ללא ציון.

• מהירות פלט — 243.4 טוקנים לשנייה עבור Claude Haiku 5.5; לא דווח עבור Aion 3.5.

למה התעריף האחיד הוא לא הניצחון שהוא נראה

התעריף האחיד של Aion 3.5 — $3.00 על פני 256K — הוא הדבר הנקי ביותר בתמחור שלו, והוא תשובה ישירה לבעייתיות בצד של Anthropic: פרומפט שגדל מ-99,000 ל-101,000 טוקנים עולה פי חמישה יותר לכל טוקן, מה שמאלץ אותך או להישאר הרחק מתחת לקו או לוותר לגמרי על הטווח הזול. ל-Aion 3.5 אין קו. אפשר לשלוח 240,000 טוקנים ולשלם את אותו תעריף לכל טוקן שהיית משלם עבור 4,000.

היתרון הזה מתאדה ברגע שעושים את החשבון על עומס עבודה אמיתי. קריאה בת 240,000 טוקנים ב-Aion 3.5 עולה כ-$0.72 בקלט; אותה קריאה ב-Claude Haiku 5.5 מעל הסף עולה כ-$0.12. אפילו כשמשלמים את התעריף המוענש שאחרי 100K, Haiku 5.5 זול יותר בערך פי שישה על הפרומפט הגדול ביותר שכל אחד מהמודלים יכול לקבל. התעריף האחיד מסיר צוק, לא עלות.

המקום שבו תמחור אחיד באמת עוזר הוא ביכולת החיזוי. צינור שגודל הפרומפט בו נע בין 80,000 ל־130,000 טוקנים הוא סיוט לתקצוב בתוכנית מדורגת וטריוויאלי בתוכנית אחידה, ואם זה הפרופיל שלך, האחידות של Aion 3.5 שווה משהו עוד לפני שהיכולת נכנסת לשיחה.

הטיעון בעד Aion 3.5, בניסוח החזק ביותר שהראיות מאפשרות.

שלושה טיעונים מחזיקים מים. ראשית, הסקה מחייבת בברירת מחדל גבוהה משמעה פחות הנדסת פרומפטים: אין פרמטר מאמץ לכוונן, ואין סיכון שהגדרה נמוכה תרכך בשקט משימה שאיש לא בדק מחדש. שנית, אנסמבל במשפחת GLM הוא פרופיל כשל שונה בתכלית מזה של מודל קטן בודד של Anthropic, ואם אתם כבר מריצים Claude Haiku 5.5 על פני משטח רחב, לחוות דעת שנייה לא־מתואמת יש ערך גם במחיר גבוה פי שלושים ממחיר הקלט — אתם תנתבו אליה רק לעתים רחוקות. שלישית, Aion 3.5 Mini במחיר $0.70 / $0.18 / $1.40 עם אותו הקשר של 256K הוא שכבת מחיר זולה ואמינה, וכל השוואה שמסתכלת רק על מודל הדגל משווה את מודל Aion הלא נכון.

מה שלא מחזיק מים הוא היחס למחיר הפרימיום הגבוה פי שלושים כהוכחה ליכולת גבוהה פי שלושים. AionLabs אינה מפרסמת בנצ'מרקים ל־Aion 3.5 שאנו מצליחים למצוא, אף גורם עצמאי לא העניק לו ציון, ולטענת ה־ensemble אין שום דבר פומבי שמצורף אליה. ספק שיש לו מודל חזק יותר מ־Claude Haiku 5.5 ויכול להדגים זאת — היה מדגים זאת.

היכן ש-Claude Haiku 5.5 מנצח באופן מוחלט, וזה לא צמוד

קלט תמונות, למשל. Aion 3.5 הוא טקסט בלבד, ו-Claude Haiku 5.5 מקבל תמונות, מה שמכריע כל עומס עבודה של מסמכים, צילומי מסך או תרשימים עוד לפני שמזכירים תמחור. פלט מקסימלי, כדוגמה נוספת: 128,000 טוקנים לעומת 32,768, עם מסלול בטא של 300,000 טוקנים ב-Batch. ומחוג המאמץ, שהוא מנגנון לבקרת עלויות ולא יכולת: ברמה Low, Claude Haiku 5.5 מייצר הרבה פחות טוקני חשיבה, ומכיוון שחשיבה מחויבת כפלט, שם שומרים סוכן מפורט בתוך הטווח הזול.

הציון העצמאי הוא המילה האחרונה בנושא. במדד של Artificial Analysis, Claude Haiku 5.5 נמצא בציון כולל של 43 ובציון 43.40 בתצורת Max שלו, השני מבין 182 מודלים, במחיר של $0.21 לכל משימת מדד עם 243.4 טוקנים לשנייה של פלט. אלה נתונים שנמדדו בהרצה בלתי תלויה. ל-Aion 3.5 אין כאלה, ועד שיהיו לו, ההשוואה שהקונה בעצם עורך היא בין "מודל עם ציון מפורסם ומחיר שאני יכול לחזות" לבין "מודל עם מחיר גבוה יותר וללא ציון", וזו אינה החלטה קשה עבור מסלול פרודקשן.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs Aion 3.5 — the scoreboard'. Claude Haiku 5.5 reads input $0.10 to $0.50 per million, output $0.50 to $2.50, 1M-token context, 128K maximum output, AA Index 43, text and image in; Aion 3.5 reads input $3.00 flat, output $6.00 flat, 262K context, 32K maximum output, no published independent score, text only. A footer notes that Claude Haiku 5.5 figures are per Artificial Analysis and Aion 3.5 figures are vendor-reported and unreproduced.

להריץ את שניהם בלי להכפיל את הצנרת

Aion 3.5 נגיש דרך ה-API של AionLabs עצמה וכמה פלטפורמות צד שלישי. Claude Haiku 5.5 זמין דרך ה-API של Anthropic, ומשם, בכל מקום שבו נמכרים מחדש המודלים של Anthropic. אף אחד מהם אינו בקטלוג של OrcaRouter כיום, ולא נרמוז אחרת: מה שאנחנו מנתבים מהפינה הזו של השוק הוא anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 וanthropic/claude-fable-5.1 — הדרגה שמעל המודל שעליו עוסק המאמר הזה.

הסיבה שזה חשוב כאן היא שהארכיטקטורה ההגיונית לשילוב הזה היא נתח קטן של תעבורה על המודל היקר. לא מעבירים צינור נתונים ל-ensemble שעולה $3.00 למיליון; שולחים לו את שני האחוזים מהקריאות שבהן חוות דעת שנייה שווה $3.00, ואת כל השאר משאירים על המודל הזול. המשמעות היא שני ספקים, שני מפתחות ושני משטחי חיוב עבור עומס של שני אחוזים — וזה בדיוק הצורה שעבורה נועד שער (gateway). OrcaRouter מעביר הלאה את מחיר המחירון של הספק במרווח של 0%, כך ששינוי מחיר של ספק נכנס לתוקף באותו יום ולא במחזור תמחור מחדש, וה-A/B הוא מחרוזת מודל ולא אינטגרציה שנייה. כשאף אחת מהרגליים לא נמצאת בקטלוג שלנו, התשובה הכנה היא שאנחנו השכבה הלא נכונה לכך, ומה שאתם רוצים הוא אינטגרציה ישירה.

A capture of Anthropic's Claude Platform models documentation showing the current Claude lineup — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 — with each model's context window, maximum output and per-million input and output pricing.

מה יפתור את זה?

הערכה בלתי תלויה אחת של Aion 3.5. זהו כל החלק החסר. אם מעבדה ניטרלית תעניק לו ציון בכלל סמוך ל-43 של Claude Haiku 5.5 במחיר של $0.21 למשימה, אז AionLabs גובה פי שלושים ממחיר הקלט עבור שוויון ביצועים, וסיפור האנסמבל הוא נטל ולא תכונה. אם הוא יקבל ציון גבוה באופן מהותי, אז הפרמיה אמיתית והמהלך הנכון הוא להוציא אותה על החלק הקטן של הקריאות שזקוק להן. עד שהמספר הזה יהיה קיים, קונה שבוחר בין השניים בוחר בין מודל מדוד במחיר מפורסם לבין מודל לא מדוד במחיר גבוה יותר — ויש רק ברירת מחדל אחת מוצדקת בזוג הזה.

המשמעות היא שני ספקים, שני מפתחות ושני משטחי חיוב עבור עומס של שני אחוזים, שזה בדיוק מה ששער מיועד לו.