נוצר כרטיס כותרת הירו עבור Claude Sonnet 5.5 מול Gemini 3.1 Pro, עם כתובית משנה "זול יותר לכל טוקן, יקר פי אחד עשר לכל משימה", המציג $2.00 ו-$10.00 למיליון טוקנים לעומת $2.00 ו-$12.00, עם תקרת פלט של 65,536 טוקנים מצוינת מימין, והלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

Claude Sonnet 5.5 מול Gemini 3.1 Pro: זול יותר לכל טוקן, יקר פי אחד עשר לכל משימה

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

בלוח המחירים, Claude Sonnet 5.5 הוא המודל הזול יותר, וביכולות אין בכלל מה להשוות. הוא הגיע לזמינות כללית ב-28 בספטמבר 2026 במחיר של $2.00 למיליון טוקני קלט ו-$10.00 למיליון טוקני פלט; Gemini 3.1 Pro, שהוכרז ב-19 בפברואר 2026 ועדיין מוגש מנקודת קצה של תצוגה מקדימה, עולה $2.00 ו-$12.00. Sonnet 5.5 גם מקבל ציון 56 במדד Intelligence Index v4.3 של Artificial Analysis לעומת 30 של Gemini 3.1 Pro Preview — פער של עשרים ושישה נקודות בהרנס בודד. חלון ההקשר של 1,048,576 טוקנים של Gem​ini הוא הנתון הכותרתי היחיד שבו הוא מנצח באופן מובהק. עם זאת, אותו מעריך מדווח שסיום משימה פתוחה אחת עולה $0.67 במודל של Goog​le ו-$7.60 במודל של Anthro​pic, כלומר פי אחד עשר בכיוון ההפוך. שני המספרים נכונים, והסיבה שהם מתקיימים זה לצד זה — תקרת פלט של 65,536 טוקנים בצד אחד ובעיית עודף מלל בצד השני — היא כל מהות ההשוואה הזו.

מהי כל נקודת קצה למעשה

תקנו את הזהויות לפני החישוב. הנושא כאן הוא anthropic/claude-sonnet-5.5, שוחרר ב-28 בספטמבר 2026, קלט טקסט, תמונה וקבצים, הקשר של 1,000,000 טוקנים, פלט מרבי של 128,000 טוקנים, חשיבה מסתגלת עם פרמטר מאמץ שברירת המחדל שלו היא high בפלטפורמת Claude. היריב הוא google/gemini-3.1-pro-preview, שוחרר ב-19 בפברואר 2026, קלט טקסט, תמונה, וידאו, אודיו וקבצים, הקשר של 1,048,576 טוקנים, פלט מרבי של 65,536 טוקנים. אחד משני השמות האלה נושא מילה שהשני אינו נושא, והיא אינה קישוט.

סיומת ה-preview מחוברת מזה שבעה חודשים. גוגל הוציאה כמה מהדורות Flash בתוך החלון הזה, ולא יורש לשכבת ה-Pro; המודל ש-3.1 Pro החליף רשום כמושבת. שום דבר מכל זה אינו פגם במודל — הוא היה פעיל, יציב ומתומחר נכון כל הזמן — אבל זה כן אומר שנקודת הקצה שאתה מבצע מולה אינטגרציה אינה מכוסה בהתחייבות מחזור חיים של זמינות כללית, והמשפחה הזו כבר הוציאה מכלל שימוש מודל Pro אחד. התייחס לכך כסעיף קבוע ולא כהערת שוליים, כי זה משנה את העלות של החלטת ארכיטקטורה רב-שנתית אם תטעה.

שני מספרים שמצביעים בכיוונים מנוגדים

ההשוואה לפי טוקן קודם, כי היא זו שכולם מריצים והיא מעדיפה את המודל החדש יותר.

• קלט — $2.00 למיליון בשניהם; שוויון מוחלט בתעריף המוצהר

• פלט — $10.00 עבור Claude Sonnet 5.5 לעומת $12.00 עבור Gemini 3.1 Pro; המודל של Anthropic זול ב-17%

• קריאה מהמטמון — $0.20 למיליון, בשניהם מתחת לגבול השכבה

• כתיבת מטמון — $2.50 למיליון עבור חלון של חמש דקות ב-Claude Sonnet 5.5 לעומת $0.375 ב-Gemini 3.1 Pro; כתיבת רשומת מטמון עם Google זולה פי כשבעה

• הקשר — 1,000,000 לעומת 1,048,576; הבדל ללא השלכה מעשית

• פלט מקסימלי — 128,000 טוקנים לעומת 65,536; למודל של Anthropic יש תקרה גבוהה כמעט פי שניים

• מודאליות קלט — טקסט, תמונה וקובץ מול טקסט, תמונה, וידאו, אודיו וקובץ

ואז ההשוואה לכל משימה, מאותו מעריך, באותו שבוע, בתצורה של מאמץ מרבי בשני הצדדים: 7.60 דולר עבור Claude Sonnet 5.5 לעומת 0.67 דולר עבור Gemini 3.1 Pro. פי אחד עשר. המנגנון מתועד באותו עמוד ולא מוסק — Sonnet 5.5 ייצר 410 מיליון טוקנים בכל מערך המדדים לעומת חציון של 88 מיליון בתחום, שאותו המעריך מתאר כוורבוזי מאוד, בעוד ש-Gemini 3.1 Pro מתואר כתמציתי למדי. כשמודל אחד כותב פי כמה מהאחר, יתרון של 17% בתעריף הפלט לא שורד מפגש עם החשבונית.

הלקח חורג משני המודלים האלה: כרטיס תעריפים מתמחר טוקן, ואתה מחויב על עבודה גמורה. כל השוואה שעוצרת בגיליון המחירים מודדת את הכמות הלא נכונה.

גבול הדרגה ב-200,000 טוקנים

התמחור של Gemini 3.1 Pro אינו אחיד, והקפיצה גדולה מספיק כדי להפוך חלקים מההשוואה שלעיל. מתחת לפרומפט של 200,000 טוקנים התעריפים הם $2.00 קלט ו-$12.00 פלט עם קריאת מטמון של $0.20. מעל לקו הזה הקריאה כולה מתומחרת מחדש ב-$4.00 קלט, $18.00 פלט ו-$0.40 קריאת מטמון — תעריף הקלט מוכפל לכדי פי שניים בדיוק מזה של Claude Sonnet 5.5, והפלט עובר מ-17% זול יותר בצד של Anthropic ל-80% יקר יותר בצד של Google.

הגבול אינו אקזוטי. פרומפט של 200,000 טוקנים הוא בסיס קוד קטן, אוסף חוזים ארוך, כמה שעות של תמלול, או סוכן שפועל כבר זמן מה. עבודה עם הקשר ארוך היא בדיוק מה שחלון של 1M טוקנים נמכר למענו, ולכן הדרגה שהחלון משתלם בה ביותר היא גם הדרגה שבה יתרון המחיר נעלם. אם הפרומפטים שלך עוברים באופן שגרתי את 200,000 הטוקנים, בחן את Gemini 3.1 Pro בתעריפים של $4.00 ו-$18.00, ולא לפי התעריפים שבעמוד הנחיתה.

כתיבות מטמון ראויות למשפט משלהן, כי הן מתהפכות בכיוון השני ושורדות את שינוי המדרג. ב-$0.375 למיליון לעומת $2.50, Gemini זול בהרבה לאכלס באמצעותו מטמון, והתעריף הזה לא זז כשחוצים את הגבול. עבור סוכן שבונה מחדש קידומת גדולה בכל תור במקום לעשות שימוש חוזר באחת, השורה הבודדת הזו יכולה להיות יתרון מבני גדול יותר מתעריף הקלט — והיא השורה היחידה בהשוואה הזו שאף גבול מדרג לא נוגע בה.

תקרת 65,536 הטוקנים, ומדוע היא מכריעה את הארכיטקטורה

הנתון שהכי משנה את מה שאפשר לבנות הוא הפלט המקסימלי: 65,536 טוקנים ב-Gemini 3.1 Pro לעומת 128,000 ב-Claude Sonnet 5.5. תקרה אינה מדד ביצועים; היא מגבלה על השאלה אם משימה נכנסת בקריאה אחת.

כל דבר שפולט ארטיפקט גדול — קובץ מקור מלא, דוח ארוך, מסמך מלא, מערך נתונים מובנה — מעל 65,536 אסימונים במקרה של Gemini, חייב להתפרק לשרשרת קריאות עם מצב שמועבר ביניהן. פירוק עולה יותר אסימוני קלט בכל שלב, יותר קוד תזמור, ומודל כשל חדש בנקודות החיבור שבהן מקטע אחד מסתיים והבא מתחיל. אילוץ שני מחריף זאת: החומר של Anthropic עצמה מציב את הסף המעשי של Sonnet 5.5 לעבודה ארוכה ואמינה גבוה באופן מהותי, והתקרה של Gemini היא ההדוקה מבין השתיים פי שניים. אם הארטיפקט הארוך ביותר שלך הוא 40,000 אסימונים, הקטע הזה לא רלוונטי ועליך להשוות לפי עלות למשימה. אם הוא 100,000, התקרה כבר קיבלה את ההחלטה עבורך.

מודאליות, הציר היחיד ש-Gemini שולט בו לחלוטין

Gemini 3.1 Pro מקבל וידאו ואודיו; Claude Sonnet 5.5 מקבל טקסט, תמונות וקבצים ואינו יכול לקלוט לא וידאו ולא אודיו. עבור עומס עבודה שנבנה סביב מדיה — הקלטות שיחות, צילומי מסך, וידאו מוצר, אודיו של פגישות — אין תחליף זמין בשילוב הזה, והשוואת המחירים חסרת משמעות משום שרק אחד משני הקצוות יכול לקלוט את הקלט בכלל. עבור עומסי עבודה של טקסט ותמונה, מערכי היכולות חופפים וחישוב המחירים שלמעלה הוא הקובע.

המספר התפעולי הנוסף של Gemini ראוי לציון משום שקל להחמיץ אותו בעמוד שמדגיש בינה: הקטלוג שלנו מודד השהיית טוקן ראשון חציונית של 10,000 ms ב-p50 וקצב פלט של קרוב ל-1,283 טוקנים לשנייה, עם שיעור שגיאות של 56.8% על פני שבעה ימים. זהו מודל מהיר במיוחד עם שיעור כשלים נצפה גבוה מאוד — שילוב שמתאים לעבודת אצווה עם תקציבי ניסיונות חוזרים נדיבים הרבה יותר מאשר לכל דבר שמשתמש ממתין לו. Claude Sonnet 5.5 הוא הפרופיל האיטי והיציב יותר בהשוואה. שיעור השגיאות אינו מופיע בעמוד הנחיתה של אף אחד מהספקים; זהו סוג של נתון שמופיע רק כאשר המועמדים נמצאים מאחורי נקודת קצה אחת שמודדת אותם, וזו אחת הסיבות להעריך את שניהם ממקום אחד ולא משתי לוחות מחוונים.

מה לנתב לאן

שלח/י אותו ל-Claude Sonnet 5.5 כאשר העבודה היא טקסט או תמונה, כאשר רף האיכות גבוה מספיק כדי שפער של עשרים ושישה נקודות במדד יהיה משמעותי, כאשר תוצרי הפלט ארוכים מספיק כדי להזדקק לתקרה של 128,000 טוקנים, או כאשר עומס העבודה הוא אינטראקטיבי ושיעור שגיאה של 56.8% אינו מקובל. במשימות מובנות ותחומות, קנס המילוליות שמייצר את הנתון של $7.60 מתנדף במידה רבה, והיתרון לכל טוקן הופך לכסף אמיתי.

שלח אותו אל Gemini 3.1 Pro כאשר הקלט מכיל וידאו או אודיו, כאשר הפרומפטים נשארים מתחת ל-200,000 טוקנים והנפח גבוה, כאשר אתה כותב מטמונים גדולים בתדירות גבוהה וכתיבת המטמון ב-$0.375 מצטברת, או כאשר המשימה היא בצורת אצווה והעלות לכל משימה היא העמודה היחידה שמשנה — במחיר של $0.67 למשימה לעומת $7.60 אתה יכול להרשות לעצמך כמות גדולה מאוד של ניסיונות חוזרים.

שניהם ניתנים לניתוב ב-OrcaRouter היום. google/gemini-3.1-pro-preview וanthropic/claude-sonnet-5 שניהם רשומות קטלוג פעילות על הרשאה אחת במחיר המחירון של הספק עם 0% תוספת, מה שאומר שהחלוקה שלמעלה יכולה לבוא לידי ביטוי ככלל ניתוב ולא כשתי אינטגרציות — הבקשות בתצורת מדיה לנקודת קצה אחת, ובקשות הטקסט והתמונה לאחרת, עם מעבר אוטומטי במקרה של תקלה אם אחת מהן מתחילה להחזיר שגיאות. Claude Sonnet 5.5 אינו עדיין נתיב בפלטפורמה שלנו; כשהוא יופיע ברשימה, אותו כלל יכסה אותו בלי צורך במפתח חדש.

הפסיקה הכנה עבור התמודדות זו: Claude Sonnet 5.5 הוא המודל הטוב יותר בפער עצום והזול יותר לכל טוקן, ו-Gemini 3.1 Pro זול פי אחד עשר בערך לכל משימה מוגמרת בעבודה פתוחה, זול פי שישה לכתיבת מטמון, והיחיד מבין השניים שיכול לראות וידאו. כל מי שמצטט לך את המחירון מתאר השוואה שלא קיימת; זו שכן קיימת עוסקת בשאלה אילו בקשות אפשר לתחום.

A two-column scoreboard for Claude Sonnet 5.5 and Gemini 3.1 Pro Preview across eight rows. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, input modality text, image and file, AA Intelligence Index v4.3 score 56, $7.60 per task on the index run. Right column Gemini 3.1 Pro Preview: input $2.00 rising to $4.00 over 200K tokens, output $12.00 rising to $18.00, cache read $0.20, cache write $0.375, 1,048,576-token context with a 65,536-token max output, input modality text, image, video, audio and file, AA Intelligence Index v4.3 score 30, $0.67 per task on the index run. The card heading reads "Cheaper per token, eleven times dearer per finished task", and a footer line notes that Gemini 3.1 Pro remains a preview endpoint seven months after its February 19, 2026 announcement.Screenshot of the OrcaRouter model page for Google Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview), showing the model header, the 1,048,576-token context window, the 65,536-token maximum output, audio, file, image, text and video input, the Vision, Audio, Tools, JSON and Reasoning capability tags, a 10.00-second p50 time to first token, a "Public benchmarks by Google · 2026-02-19" line, and the $2.00 input and $12.00 output prices per million tokens.Screenshot of Artificial Analysis's model page for Gemini 3.1 Pro Preview, marked a proprietary model and released February 2026, showing In $2.00 and Out $12.00 with a 90% cache discount, the Intelligence Index score of 30, an output rate of 114 tokens per second, the $0.67 average cost per task, and 67M output tokens described as fairly concise against a median of 88M.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית