כרטיס הירו שנוצר עבור 'פי שישה מהעלות עבור שתי נקודות מדד', עם תג 'עלות לכל משימה', עם הקיקר 'שני מודלים ברמת Flash, לוח אחד' וכותרת המשנה 'Claude Haiku 5.5 ב-43.40 מול Gemini 3.8 Flash ב-40.93 במדד Intelligence Index v4.3.2.' ארבעה צ'יפים מציגים '43.40 מול 40.93', '$0.21 מול $1.24', '$0.10 מול $0.75' ו'עולה ב-1 בינואר 2027'. שני כרטיסים למטה מסומנים 'היתרון של Anthropic' ('גבוה יותר בלוח המשותף, וזול פי שישה לכל משימה שהושלמה') ו'היתרון של Google' ('קלט דיבור ווידאו, ותעריף אחיד לאורך החלון'). בפוטר כתוב 'מדידות בלתי תלויות מ-Artificial Analysis; מחירי המחירון נלקחו ב-8 באוקטובר 2026.' הלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

Claude Haiku 5.5 מול Gemini 3.8 Flash: שתי נקודות במדד, פי שישה עלות לכל משימה

מחבר

Alistair Wren

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Claude Haiku 5.5 וGemini 3.8 Flash קרובים יותר זה לזה ביכולת הנמדדת מכל זוג אחר בטווח המחירים הזה — 43.40 מול 40.93 במדד Artificial Analysis Intelligence Index v4.3.2, ושניהם דורגו בתוך חמישים המקומות הראשונים בלוח המונה 225 מודלים. מה שמפריד ביניהם הוא המחיר של נקודת מדד אחת. לפי אותה מדידה בלתי תלויה, משימת Intelligence Index שהושלמה עולה $0.21 ב-Claude Haiku 5.5 ו-$1.24 ב-Gemini 3.8 Flash.

זהו פער של פי שישה עבור הפרש של שתיים וחצי נקודות בציון, וזה המספר שאמור להכריע בהשוואה הזו. כל השאר — תעריפי המחירון, רשימת המודאליות, המועדים הכרוכים בתמחור של גוגל — הוא ויכוח על השוליים.

שני הדגמים, במספרים שחשובים

למיליון טוקנים בדולרים אמריקאיים, מתיעוד התמחור של Anthropic ו-Google עצמן, עם המדידות הבלתי תלויות המיוחסות ל-Artificial Analysis. נשמר במטמון 2026-10-08.

A generated scoreboard titled 'Claude Haiku 5.5 vs Gemini 3.8 Flash - on the numbers that matter'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, input modality text and images, Intelligence Index v4.3.2 43.40, cost per task $0.21. Gemini 3.8 Flash reads input $0.75 now and $1.50 after January 1 2027, output $3.75 and $7.50, cached input $0.075 plus storage, maximum output 65,536 tokens, input modality text images speech and video, Intelligence Index v4.3.2 40.93, cost per task $1.24. A footer reads 'Vendors' published list rates; Google's lower rate runs through December 31, 2026; independent scores from Artificial Analysis.'

• קלט — Claude Haiku 5.5: ‏$0.10 עד 100,000 טוקנים ו-‏$0.50 מעל לכך; Gemini 3.8 Flash: ‏$0.75 בתעריף אחיד, כשיעלה ל-‏$1.50 ב-1 בינואר 2027.

• פלט — Claude Haiku 5.5 $0.50 עד 100,000 טוקנים ו-$2.50 מעל; Gemini 3.8 Flash $3.75 אחיד, ועולה ל-$7.50 באותו תאריך.

• קלט במטמון — Claude Haiku 5.5 $0.01 ו-$0.05; Gemini 3.8 Flash $0.075, בתוספת חיוב אחסון של $0.50 למיליון טוקנים לשעה.

• הקשר — 1M אסימונים לשניהם. פלט מקסימלי — 128,000 אסימונים עבור Claude Haiku 5.5 לעומת 65,536 עבור Gemini 3.8 Flash.

• מודליות קלט — טקסט ותמונות עבור Claude Haiku 5.5; טקסט, תמונות, דיבור ווידאו עבור Gemini 3.8 Flash. זהו השורה היחידה שבה הרשימה של Google ארוכה יותר באופן ממשי.

• ציון עצמאי — 43.40 עבור Claude Haiku 5.5 (Max) לעומת 40.93 עבור Gemini 3.8 Flash (High), ב-Intelligence Index v4.3.2.

• עלות עצמאית לכל משימה — $0.21 לעומת $1.24 על אותו לוח.

• מהירות — 241.9 אסימוני פלט לשנייה לעומת 125.2, שניהם נמדדו על ידי Artificial Analysis.

מאיפה מגיע המספר של פי שישה

הפער בעלות לכל משימה גדול יותר מפער המחיר הנקוב, וזה החלק המעניין, כי זה אומר שכרטיס התעריפים לבדו אינו מסביר אותו.

החשבון לפי המחיר הנקוב פשוט למדי: $0.10 מול $0.75 בקלט זה זול פי שבעה וחצי, ו-$0.50 מול $3.75 בפלט הם אותו יחס. אם שני המודלים היו מייצרים את אותם טוקנים עבור אותה עבודה, היחס הזה היה עובר ישירות לחשבונית.

זה לא ממשיך הלאה, ושתי ההשפעות פועלות לטובתה של גוגל. Claude Haiku 5.5 הוא מפורט באופן שהספק שלו עצמו מכיר בו: Artificial Analysis תיעדה 440 מיליון אסימוני פלט בעת הרצת האינדקס, לעומת חציון של 100 מיליון, ומכנה את המודל מפורט מאוד. Gemini 3.8 Flash ייצר 170 מיליון לעומת חציון של 81 מיליון — גם הוא סומן כמפורט, אך עם שליש ממספר האסימונים. התיעוד של Anthropic עצמה מוסיף את ההשפעה השנייה: Claude Haiku 5.5 משתמש בטוקנייזר החדש יותר, המשותף עם Claude 4.7 ואילך, כך שאותו טקסט נספר בכ-30% יותר אסימונים מאשר במודל שהוא מחליף.

כשמחברים את הדברים, הגרסה הישרה של טענת התמחור היא זו: יתרון של עשרה לאחד בתעריף הקלט ויתרון של שבעה וחצי לאחד בתעריף הפלט, שנשחקים חלקית על ידי מודל שכותב יותר טוקנים לכל תשובה, ומגיעים ליתרון של שישה לאחד במדד שגובה עבור העבודה כולה. עדיין הכרעה מוחצת, וקטנה מזו שמרמז עליה כרטיס התעריפים.

למחיר של גוגל יש תאריך

הדבר השימושי ביותר בעמוד התמחור של גוגל הוא משפט שרוב טבלאות ההשוואה משמיטות.

Gemini 3.8 Flash רשום במחיר של 0.75 דולר לקלט ו-3.75 דולר לפלט "עד 31 בדצמבר 2026", וב-1.50 ו-7.50 דולר "החל מ-1 בינואר 2027". קלט במטמון עובר מ-0.075 דולר ל-0.15 דולר באותו תאריך. זהו מחיר היכרות שתפוגתו מודפסת לצידו, כאחד עשר שבועות בקירוב ממועד כתיבת הדברים האלה.

שום דבר בכרטיס של Ant​hropic לא כתוב כך. התעריפים של Claude Haiku 5.5 מצוינים כפי שהם, עם מבנה דו-שכבתי שנקבע לפי אורך הפרומפט ולא לפי לוח שנה, והתחייבות לפרישה שלא לפני 7 באוקטובר 2027. אם אתה בונה מודל של תהליך שנמשך אל תוך השנה הבאה, הצעד של גוגל בינואר הוא הכפלה והוא שייך למודל; ל-Ant​hropic אין אירוע מקביל שיש לתכנן לקראתו.

זה פועל לשני הכיוונים, והקריאה ההוגנת אינה ש"ספק אחד ישר והאחר לא". תעריף מבצעי הוא תעריף אמיתי כל עוד הוא תקף, וגוגל רשאית לתמחר השקה בדרך הזו. זו פשוט עובדה בנוגע להשוואה: הצד הנראה זול יותר בנתוני ינואר הוא זה שיש לו מועד אחרון.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications row and the published pricing table beneath it, with the per-million-token input, output and cache rates and the prompt-length threshold at which the second tier begins.

מה שוות שתי נקודות מדד?

פער של 2.47 נקודות במדד שמגיע לשישים אינו שגיאת עיגול ואינו תהום. שני המודלים נמצאים באותה רצועת עבודה, והשאלה המעשית היא אם הפער בא לידי ביטוי במשימות שאתם מריצים בפועל.

לפי הנתונים של הספקים עצמם, השניים אינם נמדדים על אותה ערכת בדיקה, ולכן לא ניתן להשוות אותם ישירות — Ant​hropic מפרסמת תוצאות של GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 ו-FrontierCode עבור Claude Haiku 5.5, ו-Google מפרסמת סט משלה עבור Gemini 3.8 Flash, ואף אחד מהספקים לא הריץ את הסוויטה של האחר. ההשוואה היחידה בתנאים זהים הזמינה היא לוח הדירוג העצמאי, ושם התשובה היא ש-Ant​hropic מובילה בפער מדיד אך קטן.

ההבדל ביכולות שיהיה חשוב יותר לחלק מהצוותים הוא בקו המודאליות. Gemini 3.8 Flash מקבל קלט של דיבור וווידאו; Claude Haiku 5.5 מקבל טקסט ותמונות. צינור עיבוד שקולט הקלטות שיחות או לכידת מסך באופן נייטיבי כלל לא בוחר בין שני המודלים האלה לפי מחיר — אחד מהם לא יכול לבצע את המשימה בלי שלב תמלול או חילוץ פריימים לפניו, ולשלב הזה יש עלות משלו ומצבי כשל משלו.

הרצת הצד הזול של הזוג

Gemini 3.8 Flash נמצא בקטלוג של OrcaRouter במחיר המחירון של Google עם 0% תוספת, וזה חשוב כאן יותר מהרגיל: התעריף של הספק מועבר הלאה כמו שהוא ולא ממוזג, כך שאם אתם רוצים לראות מה שלב ינואר עושה בפועל לחשבון, המספר משתנה כשהמספר של Google משתנה. Claude Sonnet 5.5 ו-Claude Opus 5.5 נמצאים גם הם בקטלוג, מה שהופך מבחן ניתוב תלת-כיווני — הקטע של Flash של Google, דרגת ביניים של Ant​hropic, ודרגה קטנה של Ant​hropic בהמשך — לתצורה ולא לפרויקט. מפתח אחד, SDK אחד, מעבר אוטומטי לגיבוי בשכבה התחתונה, וגם ה-DSL של הניתוב אם אתם מעדיפים לבטא את ההסלמה בנתיב ולא בקוד האפליקציה.

Claude Haiku 5.5 עצמו עדיין לא נמצא בקטלוג, ומוטב לומר זאת מאשר להשאיר זאת מעורפל. החלק של Anthropic בהשוואה הזו נגיש כרגע רק אצל Anthropic, ואילו החלק של Google ניתן לקרוא מאיתנו היום במחיר המוצג לעיל.

A screenshot of the OrcaRouter catalogue page for Gemini 3.8 Flash, showing the model identifier in provider-slash-model form, the provider Google, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

איזה אחד, ולמי?

אם העבודה שלך היא טקסט נכנס וטקסט יוצא, הפרומפטים שלך נמצאים מתחת ל־100,000 טוקנים, ואתה משלם לפי טוקן עבור נפח אמיתי, Claude Haiku 5.5 הוא המודל הזול יותר לפי כל מדד בכתבה הזו, והמודל בעל הניקוד הגבוה יותר בלוח המשותף היחיד — עם ההסתייגות שהיתרון הוא פי שישה בעלות לכל משימה ולא פי עשרה כפי שהמחיר המוצהר מרמז.

אם יש לך צורך בקלט אודיו או וידאו, או שאתה זקוק לתגובה של 65K ומעלה, או שהפרומפטים שלך נוטים להיות ארוכים באופן קבוע, החישוב משתנה: Gemini 3.8 Flash מקבל קלטים שהרמה הקטנה של Ant​hropic לא יכולה לקבל, ומעבר ל-100,000 טוקנים הרמה השנייה של Ant​hropic עצמה מתומחרת הרבה מעל התעריף הקבוע של Google.

הדבר היחיד שכדאי להיאחז בו הוא התאריכים. התעריף של Google תקף עד סוף השנה ומכפיל את עצמו לאחריה. זה של Anthropic מוצהר כקבוע עם מדרגה לפי אורך. בכל צד של זה שתנחתו עליו, בנו את לוח הזמנים בתוך הגיליון האלקטרוני לפני שאתם בונים את הפייפליין.