
Claude Haiku 5.5 לעומת Gemini 3.6 Flash: עלות גבוהה פי 7.5 לכל תשובה, מודל עם תשע נקודות פחות
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
Claude Haiku 5.5 ו-Gemini 3.6 Flash נמצאים באותה דרגה בקווי המוצרים שלהם — הקטן, המהיר והזול — ושם הדמיון נגמר. במדד Artificial Analysis Intelligence Index v4.3.2, Claude Haiku 5.5 משיג ציון 43.40 בתצורת Max שלו, לעומת 33.98 עבור Gemini 3.6 Flash בתצורת High שלו. באותה הרצה, משימת Index אחת שהושלמה עולה $0.21 ב-Claude Haiku 5.5 ו-$1.60 ב-Gemini 3.6 Flash.
קראו את הצמד הזה יחד, כי כל אחד מהם לבדו מטעה. המודל הזול יותר אינו זול רק במעט; הוא זול פי 7.5 לכל משימה שהושלמה. והמודל שהוא מביס אינו חלש רק במעט; הוא חלש ב-9.42 נקודות מדד, אשר בלוח של 182 מודלים הוא המרחק בין הרביעון העליון לאמצע.
שתי העובדות מגיעות מאותה הרצה עצמאית, וזה חשוב מפני שכרטיסי הספקים כאן לא מספרים לך אף אחת מהן. Anthropic השיקה את Claude Haiku 5.5 ב-7 באוקטובר 2026; Google שחררה את Gemini 3.6 Flash ב-21 ביולי 2026. שלושת החודשים שביניהם הם החלק המעניין.
שני הכרטיסים, זה לצד זה
למיליון טוקנים בדולרים אמריקאיים. התעריפים של Anthropic ו-Google מגיעים ממסמכי התמחור שלהם; השורות המשותפות הן Artificial Analysis Intelligence Index v4.3.2. נשמר במטמון 2026-10-08.

• קלט — Claude Haiku 5.5 $0.10 עד 100,000 טוקנים ו-$0.50 מעל לכך; Gemini 3.6 Flash $0.75 בתעריף אחיד היום, ויעלה ל-$1.50 ב-1 בינואר 2027.
• פלט — Claude Haiku 5.5: $0.50 עד 100,000 טוקנים ו-$2.50 מעבר לכך; Gemini 3.6 Flash: $3.75 אחיד היום, ועולה ל-$7.50 באותו תאריך.
• קלט במטמון — Claude Haiku 5.5 $0.01 ו-$0.05; Gemini 3.6 Flash $0.075, בתוספת דמי אחסון של $0.50 לכל מיליון טוקנים בשעה.
• הקשר ותקרת הפלט — 1M טוקנים לשניהם. Claude Haiku 5.5 מגביל תגובה ל-128,000 טוקנים; Gemini 3.6 Flash ל-65,536.
• מודאליות — Claude Haiku 5.5 מקבל טקסט ותמונות. Gemini 3.6 Flash מקבל טקסט, תמונות, וידאו, אודיו וקבצים. זו השורה היחידה שבה הצד של Google מוביל באופן חד-משמעי, ובצינור עיבוד להבנת מדיה זה יכול להכריע את כל השאלה.
• ציון עצמאי — 43.40 עבור Claude Haiku 5.5 (Max) לעומת 33.98 עבור Gemini 3.6 Flash (High).
• עלות לכל משימה שהושלמה — $0.21 לעומת $1.60, באותה הרצת הערכה.

למה המספר שבו יש להשתמש הוא לפי משימה, ולא לפי טוקן
מכפיל כרטיס התעריפים נראה כמו 7.5 בקלט ו-7.5 בפלט כבר, כך שהנתון לכל משימה אינו מפתיע כאן — אבל כדאי להראות למה שני המודלים מגיעים לאותו מקום במדד אחד ומרוחקים כל כך זה מזה במדד האחר, כי אותה אריתמטיקה חותכת בכיוון ההפוך בהתמודדויות האחרות של האצווה הזו.
Gemini 3.6 Flash הוא הפחות רב-המלים מבין השניים. הוא פולט 41,606 אסימוני פלט לכל משימת Intelligence Index — 20,061 חשיבה ו-21,545 תשובה — לעומת 162,164 של Claude Haiku 5.5, המתחלקים ל-129,047 חשיבה ו-33,118 תשובה. המודל של Anthropic מוציא כמעט פי ארבעה אסימונים לביצוע אותה עבודה, והוא זה שקצב הפלט שלו הוא שביעית מזה של גוגל, כך שפער האסימונים ופער הקצב מכפילים זה את זה ולא מתקזזים.
השילוב הזה — תעריף זול כפול שימוש כבד — הוא תיאור כן של הכלכלה של Claude Haiku 5.5, והפוסט של Anthropic עצמה על ההשקה מכיר בצד השני של זה: המודל הוא "משתלם במיוחד כשמשתמשים בו למשימות עם פרומפטים של עד 100,000 טוקנים, שמהווים כ-90% מהבקשות למודל ה-Haiku הקודם שלנו." מעבר ל-100,000 טוקנים תעריף הקלט הופך ל-$0.50 ותעריף הפלט ל-$2.50, ואז המכפיל לעומת Gemini 3.6 Flash מצטמצם לבערך פי 1.5.
מה עשתה השכבה של גוגל עצמה בזמן שההשוואה הזו עמדה במקום
כאן הטקסט מפסיק להיות השוואה בין שני מודלים והופך לאזהרה בשאלה לאיזה Gemini אתה למעשה משווה.
Google שמרה על מחיר ה-Flash קבוע לאורך שלושה דורות. Gemini 3.6 Flash, Gemini 3.7 Flash ו-Gemini 3.8 Flash כולם מופיעים במחיר של $0.75 לקלט ו-$3.75 לפלט בתיעוד התמחור של Google עצמה, עם אותו שיעור מטמון של $0.075 ואותה העלאת מחיר ב-1 בינואר 2027 ל-$1.50 ו-$7.50. הכרטיס של Google עבור סדרת 3.6 מתאר אותו כ"דגם ה-Flash מהדור הקודם שלנו", שהם מילותיו של הספק עצמו לגביו.
מה שזז היה הציון, לא המחיר. בלוח העצמאי, Gemini 3.6 Flash מציג ציון 33.98, Gemini 3.7 Flash 39.06, ו-Gemini 3.8 Flash 40.93 — כולם בתצורה המפורסמת שלהם בעוצמה הגבוהה ביותר. תשע נקודות מדד נוספו בשכבת הפלאש של גוגל בתוך שישה שבועות, ללא שינוי בתעריף.
ההשלכה לכל מי שנמצא בעיצומו של תהליך הערכה היא מוחשית: אם מדדתם את ההתמודדות הזו לפני שלושה שבועות מול Gemini 3.7 Flash, התוצאה שלכם אינה מעודכנת, ואם תמדדו אותה מול Gemini 3.8 Flash, הפער מול Claude Haiku 5.5 מצטמצם ל-2.47 נקודות. Gemini 3.6 Flash היא הגרסה של ההשוואה הזו שמחמיאה ל-Anthropic ביותר, והיא גם הגרסה ש-Google הכי רחוקה מלמכור.
Artificial Analysis מסמן את הערך 3.6 כמיושן. תיעוד התמחור של Google עדיין מפרסם את התעריף, ורשימת המודלים שלה עדיין מפנה למדור 3.6, כך שהקריאה הכנה היא לא "נעלם" אלא "הוחלף פעמיים בתוך משפחתו תוך עשרה שבועות" — וזו עובדה על כמה מהר הדרגה הזו נעה, לא סיבה לדלג על ההשוואה.
למי זה בעצם מחליט
יש טיעון אמיתי בעד Gemini 3.6 Flash, והוא לא הניקוד.
אם אתם צריכים אודיו או וידאו בפרומפט, Claude Haiku 5.5 לא מסוגל לעשות זאת כלל — הוא קורא טקסט ותמונות ושום דבר אחר. Gemini 3.6 Flash קורא טקסט, תמונות, וידאו, אודיו וקבצים, והקטלוג שלנו מתעד אותו בקצב מדוד של 582 אסימוני פלט לשנייה, עם חציון של 4.1 שניות לזמן עד לאסימון הראשון בשבוע האחרון, וזהו מודל מהיר אפילו לפי הסטנדרטים של Flash. עבור צינור להבנת מדיה, רשימת המודאליות היא כל ההחלטה, ופער האינדקס הוא רק הערת שוליים.
אם העבודה שלכם היא טקסט ותמונות, החשבון לא קרוב מספיק כדי להתווכח עליו. בתמהיל עתיר-קלט של 7:2:1 — הצורה שרוב תעבורת הייצור מגיעה בה — Claude Haiku 5.5 מגיע ל-$0.077 למיליון טוקנים לעומת $0.63 עבור Gemini 3.6 Flash. עבור יותר ממיליון טוקנים משולבים ביום, זה 77 סנט לעומת $6.30, והמספר השני מחמיר ב-1 בינואר 2027 בעוד הראשון לא זז.
מצוק 100,000 הטוקנים הוא התנאי היחיד שהופך את הכף. צינור אחזור או מסמכים ארוכים שמרכיב באופן שגרתי פרומפטים של 150,000 טוקנים משלם את מדרגת $0.50/$2.50 של Anthropic על כל הבקשה, ובנקודה הזו שני המודלים נמצאים בטווח של פי 1.5 זה מזה במחיר, בעוד Gemini 3.6 Flash עדיין מנצח במודאליות ובנתון 91.8% ש-Google מפרסמת עבור אחזור מרובה-מחטים בממוצע של 128k. זה מדווח על ידי הספק ולא שוחזר, ויש למקם אותו בדיוק במסגור הזה.

להתקשר לשניהם, או להתקשר לאחד
Gemini 3.6 Flash נמצא היום בקטלוג של OrcaRouter בכתובת google/gemini-3.6-flash, במחיר המחירון של Google עם 0% תוספת — $0.75 ו-$3.75 עם קריאה מהמטמון ב-$0.075, כפי שגובה הספק. זה חשוב במיוחד במודל המסוים הזה, משום שההתייקרות של Google ב-1 בינואר היא שינוי תעריף, וקטלוג בהעברה ישירה מאמץ אותה ביום שבו היא קורית ולא בחידוש החוזה הבא. מפתח API אחד וקריאת SDK אחת מפעילים גם את המודל הזה וגם כל אחד מ-200 ומעלה האחרים בקטלוג, כך ש-A/B בין מסלול של Google למסלול של Anthropic הוא שינוי של מחרוזת מודל עם failover אוטומטי מתחתיו, ולא אינטגרציה שנייה.
Claude Haiku 5.5 אינו בקטלוג. המודל של Anthropic נגיש דרך ה-API של Anthropic עצמה, וכן דרך AWS, Google Cloud ו-Microsoft Azure, וזו כל התשובה הכנה. מה שכן יש לנו מהמגוון הזה הוא Claude Sonnet 5.5 ו-Claude Opus 5.5 — וזה מה שהופך את מסלול ההסלמה מקריאת סיווג זולה לקריאה אג'נטית בדרג ביניים להחלטת ניתוב ולא לפרויקט.
מה שמשאיר את פסק הדין פשוט מספיק כדי לומר אותו בפשטות. בעבודה עם טקסט ותמונות באורכי פרומפט קצרים, Claude Haiku 5.5 מנצח בכל ציר מלבד תקרת התגובה. בכל דבר שיש בו אודיו או וידאו, Gemini 3.6 Flash הוא היחיד מבין השניים שמסוגל בכלל להשיב — ואם בכוונתכם לשלם את התעריף של גוגל עבור היכולת הזאת, שאלו עבור איזה Gemini אתם משלמים אותו, כי בדרג הזה אפשר לקבל תשע נקודות מדד נוספות תמורת אותו כסף מאח חדש יותר.
API אחד ליותר מ-200 מודלים, מפתח אחד, מעבר אוטומטי בעת תקלה מתחת לפני השטח, כך שבדיקת A/B בין מסלול של Google למסלול של Anthropic היא שינוי במחרוזת מודל ולא אינטגרציה שנייה.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
