
Claude Sonnet 5.5 מול Gemini 3.1 Pro: זול יותר לכל טוקן, יקר פי אחד עשר לכל משימה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 984 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 195 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
בלוח המחירים, Claude Sonnet 5.5 הוא המודל הזול יותר, וביכולות אין בכלל מה להשוות. הוא הגיע לזמינות כללית ב-28 בספטמבר 2026 במחיר של $2.00 למיליון טוקני קלט ו-$10.00 למיליון טוקני פלט; Gemini 3.1 Pro, שהוכרז ב-19 בפברואר 2026 ועדיין מוגש מנקודת קצה של תצוגה מקדימה, עולה $2.00 ו-$12.00. Sonnet 5.5 גם מקבל ציון 56 במדד Intelligence Index v4.3 של Artificial Analysis לעומת 30 של Gemini 3.1 Pro Preview — פער של עשרים ושישה נקודות בהרנס בודד. חלון ההקשר של 1,048,576 טוקנים של Gemini הוא הנתון הכותרתי היחיד שבו הוא מנצח באופן מובהק. עם זאת, אותו מעריך מדווח שסיום משימה פתוחה אחת עולה $0.67 במודל של Google ו-$7.60 במודל של Anthropic, כלומר פי אחד עשר בכיוון ההפוך. שני המספרים נכונים, והסיבה שהם מתקיימים זה לצד זה — תקרת פלט של 65,536 טוקנים בצד אחד ובעיית עודף מלל בצד השני — היא כל מהות ההשוואה הזו.
מהי כל נקודת קצה למעשה
תקנו את הזהויות לפני החישוב. הנושא כאן הוא anthropic/claude-sonnet-5.5, שוחרר ב-28 בספטמבר 2026, קלט טקסט, תמונה וקבצים, הקשר של 1,000,000 טוקנים, פלט מרבי של 128,000 טוקנים, חשיבה מסתגלת עם פרמטר מאמץ שברירת המחדל שלו היא high בפלטפורמת Claude. היריב הוא google/gemini-3.1-pro-preview, שוחרר ב-19 בפברואר 2026, קלט טקסט, תמונה, וידאו, אודיו וקבצים, הקשר של 1,048,576 טוקנים, פלט מרבי של 65,536 טוקנים. אחד משני השמות האלה נושא מילה שהשני אינו נושא, והיא אינה קישוט.
סיומת ה-preview מחוברת מזה שבעה חודשים. גוגל הוציאה כמה מהדורות Flash בתוך החלון הזה, ולא יורש לשכבת ה-Pro; המודל ש-3.1 Pro החליף רשום כמושבת. שום דבר מכל זה אינו פגם במודל — הוא היה פעיל, יציב ומתומחר נכון כל הזמן — אבל זה כן אומר שנקודת הקצה שאתה מבצע מולה אינטגרציה אינה מכוסה בהתחייבות מחזור חיים של זמינות כללית, והמשפחה הזו כבר הוציאה מכלל שימוש מודל Pro אחד. התייחס לכך כסעיף קבוע ולא כהערת שוליים, כי זה משנה את העלות של החלטת ארכיטקטורה רב-שנתית אם תטעה.
שני מספרים שמצביעים בכיוונים מנוגדים
ההשוואה לפי טוקן קודם, כי היא זו שכולם מריצים והיא מעדיפה את המודל החדש יותר.
• קלט — $2.00 למיליון בשניהם; שוויון מוחלט בתעריף המוצהר
• פלט — $10.00 עבור Claude Sonnet 5.5 לעומת $12.00 עבור Gemini 3.1 Pro; המודל של Anthropic זול ב-17%
• קריאה מהמטמון — $0.20 למיליון, בשניהם מתחת לגבול השכבה
• כתיבת מטמון — $2.50 למיליון עבור חלון של חמש דקות ב-Claude Sonnet 5.5 לעומת $0.375 ב-Gemini 3.1 Pro; כתיבת רשומת מטמון עם Google זולה פי כשבעה
• הקשר — 1,000,000 לעומת 1,048,576; הבדל ללא השלכה מעשית
• פלט מקסימלי — 128,000 טוקנים לעומת 65,536; למודל של Anthropic יש תקרה גבוהה כמעט פי שניים
• מודאליות קלט — טקסט, תמונה וקובץ מול טקסט, תמונה, וידאו, אודיו וקובץ
ואז ההשוואה לכל משימה, מאותו מעריך, באותו שבוע, בתצורה של מאמץ מרבי בשני הצדדים: 7.60 דולר עבור Claude Sonnet 5.5 לעומת 0.67 דולר עבור Gemini 3.1 Pro. פי אחד עשר. המנגנון מתועד באותו עמוד ולא מוסק — Sonnet 5.5 ייצר 410 מיליון טוקנים בכל מערך המדדים לעומת חציון של 88 מיליון בתחום, שאותו המעריך מתאר כוורבוזי מאוד, בעוד ש-Gemini 3.1 Pro מתואר כתמציתי למדי. כשמודל אחד כותב פי כמה מהאחר, יתרון של 17% בתעריף הפלט לא שורד מפגש עם החשבונית.
הלקח חורג משני המודלים האלה: כרטיס תעריפים מתמחר טוקן, ואתה מחויב על עבודה גמורה. כל השוואה שעוצרת בגיליון המחירים מודדת את הכמות הלא נכונה.
גבול הדרגה ב-200,000 טוקנים
התמחור של Gemini 3.1 Pro אינו אחיד, והקפיצה גדולה מספיק כדי להפוך חלקים מההשוואה שלעיל. מתחת לפרומפט של 200,000 טוקנים התעריפים הם $2.00 קלט ו-$12.00 פלט עם קריאת מטמון של $0.20. מעל לקו הזה הקריאה כולה מתומחרת מחדש ב-$4.00 קלט, $18.00 פלט ו-$0.40 קריאת מטמון — תעריף הקלט מוכפל לכדי פי שניים בדיוק מזה של Claude Sonnet 5.5, והפלט עובר מ-17% זול יותר בצד של Anthropic ל-80% יקר יותר בצד של Google.
הגבול אינו אקזוטי. פרומפט של 200,000 טוקנים הוא בסיס קוד קטן, אוסף חוזים ארוך, כמה שעות של תמלול, או סוכן שפועל כבר זמן מה. עבודה עם הקשר ארוך היא בדיוק מה שחלון של 1M טוקנים נמכר למענו, ולכן הדרגה שהחלון משתלם בה ביותר היא גם הדרגה שבה יתרון המחיר נעלם. אם הפרומפטים שלך עוברים באופן שגרתי את 200,000 הטוקנים, בחן את Gemini 3.1 Pro בתעריפים של $4.00 ו-$18.00, ולא לפי התעריפים שבעמוד הנחיתה.
כתיבות מטמון ראויות למשפט משלהן, כי הן מתהפכות בכיוון השני ושורדות את שינוי המדרג. ב-$0.375 למיליון לעומת $2.50, Gemini זול בהרבה לאכלס באמצעותו מטמון, והתעריף הזה לא זז כשחוצים את הגבול. עבור סוכן שבונה מחדש קידומת גדולה בכל תור במקום לעשות שימוש חוזר באחת, השורה הבודדת הזו יכולה להיות יתרון מבני גדול יותר מתעריף הקלט — והיא השורה היחידה בהשוואה הזו שאף גבול מדרג לא נוגע בה.
תקרת 65,536 הטוקנים, ומדוע היא מכריעה את הארכיטקטורה
הנתון שהכי משנה את מה שאפשר לבנות הוא הפלט המקסימלי: 65,536 טוקנים ב-Gemini 3.1 Pro לעומת 128,000 ב-Claude Sonnet 5.5. תקרה אינה מדד ביצועים; היא מגבלה על השאלה אם משימה נכנסת בקריאה אחת.
כל דבר שפולט ארטיפקט גדול — קובץ מקור מלא, דוח ארוך, מסמך מלא, מערך נתונים מובנה — מעל 65,536 אסימונים במקרה של Gemini, חייב להתפרק לשרשרת קריאות עם מצב שמועבר ביניהן. פירוק עולה יותר אסימוני קלט בכל שלב, יותר קוד תזמור, ומודל כשל חדש בנקודות החיבור שבהן מקטע אחד מסתיים והבא מתחיל. אילוץ שני מחריף זאת: החומר של Anthropic עצמה מציב את הסף המעשי של Sonnet 5.5 לעבודה ארוכה ואמינה גבוה באופן מהותי, והתקרה של Gemini היא ההדוקה מבין השתיים פי שניים. אם הארטיפקט הארוך ביותר שלך הוא 40,000 אסימונים, הקטע הזה לא רלוונטי ועליך להשוות לפי עלות למשימה. אם הוא 100,000, התקרה כבר קיבלה את ההחלטה עבורך.
מודאליות, הציר היחיד ש-Gemini שולט בו לחלוטין
Gemini 3.1 Pro מקבל וידאו ואודיו; Claude Sonnet 5.5 מקבל טקסט, תמונות וקבצים ואינו יכול לקלוט לא וידאו ולא אודיו. עבור עומס עבודה שנבנה סביב מדיה — הקלטות שיחות, צילומי מסך, וידאו מוצר, אודיו של פגישות — אין תחליף זמין בשילוב הזה, והשוואת המחירים חסרת משמעות משום שרק אחד משני הקצוות יכול לקלוט את הקלט בכלל. עבור עומסי עבודה של טקסט ותמונה, מערכי היכולות חופפים וחישוב המחירים שלמעלה הוא הקובע.
המספר התפעולי הנוסף של Gemini ראוי לציון משום שקל להחמיץ אותו בעמוד שמדגיש בינה: הקטלוג שלנו מודד השהיית טוקן ראשון חציונית של 10,000 ms ב-p50 וקצב פלט של קרוב ל-1,283 טוקנים לשנייה, עם שיעור שגיאות של 56.8% על פני שבעה ימים. זהו מודל מהיר במיוחד עם שיעור כשלים נצפה גבוה מאוד — שילוב שמתאים לעבודת אצווה עם תקציבי ניסיונות חוזרים נדיבים הרבה יותר מאשר לכל דבר שמשתמש ממתין לו. Claude Sonnet 5.5 הוא הפרופיל האיטי והיציב יותר בהשוואה. שיעור השגיאות אינו מופיע בעמוד הנחיתה של אף אחד מהספקים; זהו סוג של נתון שמופיע רק כאשר המועמדים נמצאים מאחורי נקודת קצה אחת שמודדת אותם, וזו אחת הסיבות להעריך את שניהם ממקום אחד ולא משתי לוחות מחוונים.
מה לנתב לאן
שלח/י אותו ל-Claude Sonnet 5.5 כאשר העבודה היא טקסט או תמונה, כאשר רף האיכות גבוה מספיק כדי שפער של עשרים ושישה נקודות במדד יהיה משמעותי, כאשר תוצרי הפלט ארוכים מספיק כדי להזדקק לתקרה של 128,000 טוקנים, או כאשר עומס העבודה הוא אינטראקטיבי ושיעור שגיאה של 56.8% אינו מקובל. במשימות מובנות ותחומות, קנס המילוליות שמייצר את הנתון של $7.60 מתנדף במידה רבה, והיתרון לכל טוקן הופך לכסף אמיתי.
שלח אותו אל Gemini 3.1 Pro כאשר הקלט מכיל וידאו או אודיו, כאשר הפרומפטים נשארים מתחת ל-200,000 טוקנים והנפח גבוה, כאשר אתה כותב מטמונים גדולים בתדירות גבוהה וכתיבת המטמון ב-$0.375 מצטברת, או כאשר המשימה היא בצורת אצווה והעלות לכל משימה היא העמודה היחידה שמשנה — במחיר של $0.67 למשימה לעומת $7.60 אתה יכול להרשות לעצמך כמות גדולה מאוד של ניסיונות חוזרים.
שניהם ניתנים לניתוב ב-OrcaRouter היום. google/gemini-3.1-pro-preview וanthropic/claude-sonnet-5 שניהם רשומות קטלוג פעילות על הרשאה אחת במחיר המחירון של הספק עם 0% תוספת, מה שאומר שהחלוקה שלמעלה יכולה לבוא לידי ביטוי ככלל ניתוב ולא כשתי אינטגרציות — הבקשות בתצורת מדיה לנקודת קצה אחת, ובקשות הטקסט והתמונה לאחרת, עם מעבר אוטומטי במקרה של תקלה אם אחת מהן מתחילה להחזיר שגיאות. Claude Sonnet 5.5 אינו עדיין נתיב בפלטפורמה שלנו; כשהוא יופיע ברשימה, אותו כלל יכסה אותו בלי צורך במפתח חדש.
הפסיקה הכנה עבור התמודדות זו: Claude Sonnet 5.5 הוא המודל הטוב יותר בפער עצום והזול יותר לכל טוקן, ו-Gemini 3.1 Pro זול פי אחד עשר בערך לכל משימה מוגמרת בעבודה פתוחה, זול פי שישה לכתיבת מטמון, והיחיד מבין השניים שיכול לראות וידאו. כל מי שמצטט לך את המחירון מתאר השוואה שלא קיימת; זו שכן קיימת עוסקת בשאלה אילו בקשות אפשר לתחום.



השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
