
Gemini 4 Argon: מה הודיעה Google, ולמה מחובר השם הזה
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
Gemini 4 Argon הוא ה-Gemini 4 היחיד שקיים. המשפט הזה נשמע מובן מאליו עד שמתמחרים אותו, והתמחור הוא מטרתו של העמוד הזה. Google הכריזה על Gemini 4 Argon ב-30 בספטמבר 2026, בפוסט של DeepMind המיוחס ל-Koray Kavukcuoglu; זהו שם מודל אמיתי בעמוד ראשוני אמיתי, הוא נמדד על ידי Artificial Analysis במדד אינטליגנציה של 52.56 בגרסת v4.3.2, והוא נמצא במרחק של פחות מחצי נקודה מ-GPT-6 Astra עם 52.67 ומ-Claude Fable 5.1 עם 53.35 — בעוד שהוא נמצא חמש נקודות מתחת ל-Claude Opus 5.5 עם 57.62 ול-Claude Sonnet 5.5 עם 56.00, ובמרחק של נקודה אחת מ-GPT-6.1 Sol עם 51.83. מה שאין לו הוא הדבר שיש לכל אחד מהמתחרים האלה: מזהה מודל שאפשר לשים בבקשה.
אז התשובה הכנה בשורה אחת ל"מה זה Gemini 4 Argon" היא שזהו מודל ש-Google הכריזה עליו והריצה עליו בנצ'מרקים אך טרם הפכה אותו לזמין לקריאה, שהשם מחובר להשקה מדורגת עם גישה מוגבלת ולא למוצר, וש"Gemini 4" לבדו אינו מחובר לשום דבר בכלל. שני חצאיו של המשפט הזה ניתנים לבדיקה ממסוף, ולכן הדף הזה בודק אותם במקום להצהיר עליהם.
השם אמיתי. המוצר לא.
נתחיל במה שבדיקת ישות מחזירה בפועל. נכון ל-8 באוקטובר 2026, עמוד המשפחה של Google בכתובת deepmind.google/models/gemini/ מציג את Gemini 4 Argon ככרטיס המוביל שלו, תחת הסלוגן "העידן הבא שלנו של בינה בחזית", עם נוסח יכולות המציין הנדסת תוכנה, עבודת ידע ארגונית במשפטים ובפיננסים, ואבטחת סייבר הגנתית. פוסט ההכרזה נמצא בblog.google/innovation-and-ai/models-and-research/gemini-models/ בנתיב. יש עמוד משפחת מודלים. יש טבלת בנצ'מרקים של ספקים בת תשע עשרה שורות. יש קובץ PDF של מתודולוגיית הערכות בן חמישה עמודים. זהו שובל מסמכים משמעותי, וזה יותר ממה שהדלפה מקבלת.
עכשיו רשום מה חסר בו, כי רשימת החסר היא המאמר.
• מזהה מודל — רשימת המודלים של Gemini API מכילה אפס מופעים של "argon" ואפס מופעים של "gemini-4". המזהים החדשים ביותר שהתיעוד של Google מכיר הם משפחת 3.8.
• נקודת קצה או מחיר שניתן לחייב אותך בגינם — התעריף של 2$ לקלט / 10$ לפלט למיליון טוקנים בהודעה הוא תעריף היכרות עבור השקה שטרם הגיעה ללקוחות משלמים.
• כרטיס מודל או כרטיס מערכת — לאינדקס כרטיסי המודל של DeepMind אין שורה של Argon, ונתיב כרטיס המודל של המשפחה מחזיר 404.
• חלון הקשר — גוגל פרסמה מגבלת פלט של מיליון טוקנים, לעומת תקרה קודמת של 64K, ולא פרסמה את צד הקלט של הצמד הזה. Artificial Analysis מתעדת 1M עבור המודל שהיא מדדה.
• תאריך זמינות כללית — ההודעה מתארת פריסה מדורגת, ללא תאריכים באף שלב לאחר הראשון.
• מספר פרמטרים, ש-Google לא פרסמה עבור שום Gemini.
הפריסה ש-Google מתארת מתנהלת בשלושה שלבים שמשכם לא צוין. ראשית, קבוצה בעלת שם של מגיני סייבר דרך תוכנית Fairwind. שנית, לקוחות API בתשלום ומנויי Google AI Ultra. שלישית, מפתחים, ארגונים וצרכנים. רק השלב הראשון פעיל בכל מובן שקורא יכול לאמת, ו-Google לא מציינת תאריך לשלבים השני והשלישי. זו לא הערת שוליים. זה ההבדל בין מודל לספירה לאחור.

מה שהטבלה של גוגל עצמה טוענת, ומי בעצם מדד את זה
עמוד המשפחה של Google מכיל טבלת בנצ'מרק בת ארבעה טורים עם Gemini 4 Argon, GPT-6 Astra, Claude Fable 5.1 ו-Claude Opus 5.5. כדאי לקרוא אותה, וכדאי לקרוא אותה כשהמקור לנגד עיניים, מפני ש-Google חושפת את המקור הזה ב-PDF של המתודולוגיה, והחשיפה משנה את מידת המשקל שהטבלה יכולה לשאת.
הטענות, המסומנות כטענות של Google: Argon מוביל ב-Vals Index עם 68.9 מול 67.0 של Opus 5.5 ו-65.8 של Fable 5.1; ב-AutomationBench עם 51.3 מול 42.5, 31.4 ו-41.4; ב-Vals Finance Agent v2 עם 65.4; ב-Harvey’s Legal Agent Benchmark עם 19.6 מול 3.8, 6.7 ו-5.4 — פער של פי ארבעה עד חמישה; ב-DeepSWE v1.1 עם 77.9 מול 74.2, 67.4 ו-74.1; ב-Vibe Code Bench עם 91.9, מרווח של 1.6 נקודות; ב-LABBench 2 עם 88.8 מול 73.1, 68.6 ו-85.4; ב-RiemannBench עם 76.0; בשתי השורות של GraphWalks, 99.7 ב-≤128k ו-84.2 ב-256k–1M; ב-Agent’s Last Exam עם 39.5; ב-Terminal-Bench Science 0.1 עם 57.6; ב-Chartography עם 71.6; וב-LVBench עם 91.7 כביצועים המתקדמים ביותר.
והוא מפסיד, בעמוד של Google עצמה: FrontierSWE v2 עם 55.0 לעומת 65.5 של Astra ו-62.3 של Opus 5.5; Terminal-bench 4.0 עם 57.4 לעומת 66.4 של Opus 5.5; PostTrainBench עם 45.3 לעומת 49.3 של Opus 5.5; ו-OSWorld-2.0 עם 69.2 לעומת 72.6 של Astra. CWE-bench v1 הוא תיקו על 68.0 עם Astra.
שורת המקור חשובה יותר מכל שורה בודדת. המתודולוגיה של גוגל מציינת שהתוצאות הן pass@1, ניסיון בודד, בהגדרות החשיבה הגבוהות ביותר, ובאופן קריטי — שהנתונים שאינם של Gemini באותה טבלה הם המספרים שדיווחו הספקים בעצמם, כאשר GPT-6 Astra, Claude Fable 5.1 ו-Claude Opus 5.5 נלקחו במצב חשיבה מקסימלי כשזה היה זמין. טבלת ספק שעמודות המתחרים שלה הן הודעות לעיתונות של המתחרים היא מסמך שימושי, אבל היא לא השוואה מבוקרת. כל אחת מהשורות האלה מדווחת על ידי גוגל, וחלקן הן גוגל שמדווחת את מה שמישהו אחר דיווח. התייחסו לשוליים, לא רק לערכים, בהתאם.
מודל אחד, שלושה מספרי אינדקס, ולמה כולם נכונים
המעמד העצמאי של Argon מעניין יותר מנתון בודד, משום שהנתון משתנה בהתאם למקום שבו קוראים אותו, והתנועה אינה טעות.
Artificial Analysis מודדת את Gemini 4 Argon (High) ב-52.56 במהדורת v4.3.2 של מדד האינטליגנציה שלה. אותו מדד מציב את Claude Opus 5.5 ב-57.62, את Claude Sonnet 5.5 ב-56.00, את Claude Fable 5.1 ב-53.35, את GPT-6 Astra ב-52.67, את GPT-6.1 Sol ב-51.83 ואת Gemini 3.8 Flash ב-40.93. בסדר המוצג בלוח הדירוג, כעשרת המודלים המובילים מצטופפים לטווח של כשש נקודות מדד, ו-Argon נוחת בתוך אותה קבוצה צפופה ולא מתחתיה.
ואז הקורא רואה מספר שני — 53 — בתצוגה המעוגלת של טבלת הדירוג, ומספר שלישי אם ישווה מול תצורה שונה של דגם אחות, ומסיק שאחד המקורות שגוי. אף אחד מהם אינו שגוי. ה-53 המעוגל הוא אותה מדידה בדיוק כמו 52.56. מה ששונה בין תצורות הוא מאמץ החשיבה: Artificial Analysis מודדת כל דגם במספר רמות מאמץ, ואותו דגם ברמת מאמץ גבוהה יותר יכול להיות במרחק של כמה נקודות. זו הסיבה שטבלת הדירוג מפרטת את Opus 5.5 ארבע פעמים נפרדות, ב-58, 56, 54 ו-51. Argon מופיע פעם אחת, במאמץ גבוה, מפני שזו התצורה היחידה ש-Google העמידה לרשות המדידה. אם Google תוציא רמה של Argon במאמץ חשיבה מקסימלי, השורה הזו תזוז, והדבר ההגון לומר עליה היום הוא שהיא עדיין לא זזה.
עוד שלושה נתונים עצמאיים של Argon שווים אזכור, כולם מ-Artificial Analysis וכולם נמדדו על (גבוה) תצורה. מהירות הפלט היא 60.69 טוקנים לשנייה בחציון. זמן עד לטוקן התשובה הראשון הוא 2.92 שניות בחציון. עלות לכל משימת Intelligence Index — ציון המדד המנורמל כנגד הוצאת הטוקנים שנדרשת כדי להשיגו — היא $1.99. המספר האחרון הזה הוא זה שכדאי לזכור, כי כאן עמדתו של Argon נעשית לא נוחה: Opus 5.5 מקבל ציון גבוה יותר בחמש נקודות ועולה $5.98 לכל משימת Index, כך ש-Argon זול פי שלושה ליחידת יכולת מדודה. אבל GPT-6.1 Sol מקבל ציון נמוך יותר בחצי נקודה ועולה $0.72, שהם בערך שליש מהנתון של Argon. Argon אינו בחירת הערך בטווח המדד של עצמו. הוא באמצע שלו.
קיימות עוד שתי קריאות עצמאיות שקריאה זהירה לא צריכה לבלבל ביניהן. Artificial Analysis רושם את הנתון של Argon ב-AutomationBench כציון חלקי של 0.7751 בסולם 0–1, בעוד שהטבלה של Google מדווחת על 51.3 מתוך 100 בלוח AutomationBench. אלה אינם אותו מדד, והצבתם זו לצד זו היא בדיוק סוג ההשוואה שמייצרת מספר מומצא. אותה זהירות חלה על קיבוצי עבודת הידע בטבלת הספק: “הובלה בעבודת ידע” היא הסיכום של Google את הטבלה של Google עצמה.
איזה עמוד "Gemini 4" אתה בעצם מחפש
זהו הבלבול שהשם יוצר, וכדאי ליישב אותו במקום אחד, כי הבלוג כבר כתב על חמישה דברים שונים של „Gemini 4” והם אינם וריאציות של מאמר אחד.
• אם אתם רוצים את תאריך השחרור וציר הזמן של הפריסה — מתי הוכרז Argon, מהי הפריסה המדורגת, ומה לוחות הארנה עשו עם זה — זהו המאמר על תאריך השחרור, היצירה שמחזיקה את ציר הזמן ואת קריאות Text Arena ו-Code Arena.
• אם אתם רוצים “האם Gemini 4 Argon הוא דרגה או דגם”, והאם קיים Gemini 4 Ultra — הקטע על מיצוב הדרגות, שקורא את סולם הדרגות מהנתיבים של Google עצמה ומסביר מדוע נתיב ה-Ultra מוביל לעמוד מנוי.
• אם אתה רוצה את שאלת השמות עצמה, הטיעון שלפיו מבין „Gemini 4” ו„Gemini 4 Argon” בדיוק אחד הוא מודל ואחד הוא קידומת דור בלי מזהה מודל, בלי נקודת קצה ובלי מחיר — זה העימות הישיר בין שני השמות של Google.
• אם אתם רוצים את תוצאת המקום השלישי של FrontierSWE v2 ואת התצפית על הביקורתיות העצמית שנלוותה אליה, זהו קטע ההערכה של FrontierSWE.
• אם אתה רוצה את Argon מול מתחרה ספציפי במספרים, יש שלושה עשר עמודי השוואה באתר המכסים את טווח הקצה, והם המקום הנכון לקריאה השוואתית של שני דגמים.
מה שאף אחד מהם אינו, ומה שהדף הזה הוא, הוא עמוד התווך: המקום היחיד שאומר מהי הישות, מה כל נתון המשויך אליה כן אומר ומה הוא אינו אומר, ומה אתה יכול למעשה לעשות איתה היום. הדף הקשור “Gemini 4 vs Gemini 4 Argon” כבר מציג את טיעון השמות במלואו, והדף הזה לא יחזור עליו. כל מה שלהלן חדש.

הלחץ שעדיין לא סיפר לנו דבר
שניים מהאותות החזקים ביותר בסיפור של Argon מצביעים על מהדורת מפתחים שממשמשת ובאה, ואף אחד מהם אינו ראיה לכך שמהדורת מפתחים כבר יצאה.
הראשון הוא שמשטחי ה-API של Google עצמה התקדמו ללא Argon. הערך החדש ביותר ביומן השינויים של Gemini API הוא 6 באוקטובר 2026 — Gemini Nano Banana 2.1 זמין באופן כללי, תחת המזהה gemini-nano-banana-2.1. במילים אחרות, בשמונת הימים מאז שהוכרז Argon, Google בחרה מוסכמת שמות למודל Gemini בייצור והשיקה מזהה GA למודל אחר, ומרחב השמות של gemini-4 עדיין ריק. מודל שהשקתו אמיתית משאיר חותם ביומן השינויים. זה לא השאיר כזה.
השני הוא המסגור הביטחוני-לאומי. גוגל מצהירה שהיא "מעורבת באופן פעיל בתהליך הוולונטרי של ממשלת ארה"ב לגישה למודל לפני שחרורו", והשלב הראשון של ההשקה הוא קבוצה מוגדרת של מגני סייבר. זה עקבי עם שחרור מדורג שבו קהל בעל יכולות חזית מקבל את המודל לפני שה-API הציבורי מקבל אותו, וזה עקבי באותה מידה עם כך שהמודל פשוט אינו מוכן לתעבורה כללית. שום דבר במסגור לא אומר לך איזו מהן. כל מי שאומר שכן קורא בעלי תה, וגוגל לא קבעה תאריך לשלב ה-API כדי להכריע בכך.
מה אתה יכול לכנות היום, ומה אתה לא יכול
זהו החלק של הדף שמתיישן הכי מהר, ולכן הוא נושא את תאריכו. נכון ל-8 באוקטובר 2026, ה-API של המודלים של OrcaRouter מחזיר HTTP 404 עבור google/gemini-4-argon. הוא לא נמצא בנתיבים שלנו. גם לא google/gemini-4, וגם לא google/gemini-4-argon-high, וגם לא google/gemini-4-pro — אף אחד מהמזהים האלה אינו נפתר, מכיוון שאף אחד מהם אינו קיים כמודל הניתן לקריאה בשום מקום.
מה יש לנו היום במסלולים, מאותו ספק, וכמה עולה כל אחד מהם במחיר המחירון של הספק:
• google/gemini-3.8-flash — שוחרר ב-2026-09-02, עם חלון הקשר של 1,048,576 טוקנים ופלט מקסימלי של 65,536 טוקנים, במחיר של $0.75 לקלט ו-$3.75 לפלט למיליון טוקנים. זהו המודל שאליו יושווה Argon בסופו של דבר על ידי אנשים שיש להם כרטיס אשראי, וזה הדבר הקרוב ביותר לעומס עבודה בסגנון Argon שתוכלו להריץ היום אחר הצהריים.
• google/gemini-3.6-flash — שוחרר ב-2026-07-21, במחיר $0.75 ו-$3.75.
• google/gemini-3.5-flash — שוחרר ב-2026-05-23, במחיר $1.50 ו-$9.00.
• google/gemini-3.5-flash-lite — שוחרר ב-2026-07-21, במחיר $0.30 ו-$2.50.
• google/gemini-3.1-flash-lite — ב-$0.25 ו-$1.50.
• google/gemini-3.1-pro-preview — שוחרר ב-2026-02-19, במחיר $2.00 ו-$12.00. זהו ה-Gemini היחיד בחריץ ה-Pro שאפשר לקרוא לו, והוא שלוש וחצי דורות מאחורי הדגם החדש ביותר בקו ה-Flash.
כל אלה פועלים על אותו מפתח כמו מודלי החזית של Claude ו-OpenAI באותה רצועת אינדקס — Claude Opus 5.5, Claude Sonnet 5.5, Claude Fable 5.1, GPT-6 Astra ו-GPT-6.1 Sol נמצאים כולם על אותם מסלולים — מה שאומר שהדבר המעניין במיקום של Argon ניתן לבדיקה בלי Argon. אם אתה רוצה לדעת איך מרגישות בערך 52 נקודות אינדקס של עבודת ידע בחמישית מהמחיר, אתה יכול למדוד את זה היום מול google/gemini-3.8-flash ב-40.93, ואם אתה רוצה את ראש הרצועה אתה יכול למדוד את Claude Opus 5.5 ב-57.62 באותו יום, באותו חשבון, בלי חוזה שני ובלי שינוי קוד. זו הצורה המעשית של כל המאמר: API אחד ל-200+ מודלים, 0% תוספת על מחיר המחירון של הספק כפי שהוא מועבר, כך שהוזלת מחיר מצד ספק מגיעה אליך באותו יום שבו היא נוחתת, ו-מעבר אוטומטי בין ספקים ליום שבו מודל שאתה תלוי בו מפסיק לענות. אנחנו מתארים את זה כאן כי זה נכון לגבי Gemini 3.8 Flash שאתה יכול לקרוא לו, לא משום שזה אומר משהו על Argon. Argon אינו אחד מהם.
אם אתם רוצים את Argon עצמו, האפשרויות שלכם היום הן מחזור ה-cyber-defender של Fairwind והמתנה. ה-API של Google עצמו לא מספק אותו, וגם אנחנו לא, ושום מסלול של צד שלישי לא יכול לספק מודל שאין לו מזהה להפנות אליו.
השאלות הפתוחות, ובדיוק מה שיסגור אותן
ארבעה דברים נותרו בלתי פתורים, ולכל אחד מהם יש טריגר ספציפי שניתן לבדוק. לשמור על הרשימה הזו קצרה — זו הנקודה: עמוד כמו זה מועיל רק כל עוד ניתן להפריכו.
• האם Argon מקבל מזהה Gemini API? שים לב לרשימת מודלי ה-API לכל מזהה עם קידומת gemini-4. ברגע שאחד מופיע, שאלת התמחור הופכת לממשית, ותעריף ההיכרות של $2 / $10 הופך למספר שניתן לחייב עליו, ולא לנתון בפוסט בבלוג. כמו כן, שים לב אם תעריף ההיכרות שורד כלל לשלב ה-API, ואם הוא עולה ל-$4 / $20 או למשהו אחר.
• האם התצורה הנמדדת משתנה? Argon נמדד ברמת חשיבה אחת ומקבל ציון 52.56. אם Google תחשוף תצורה במאמץ גבוה יותר, השורה הזו תזוז; העמיתים שהוא רודף אחריהם רשומים כולם בשתיים עד ארבע רמות מאמץ, כך ש-Argon שמופיע פעם אחת הוא עובדה לגבי זמינות, לא לגבי תקרת היכולת של המודל.
• האם הטענות המשפטיות והפיננסיות שורדות הרצה עצמאית?Harvey’s Legal Agent Benchmark עם 19.6 לעומת 3.8 של מתחרה, ו-Vals Finance Agent v2 עם 65.4 שמוביל את התחום, הם שני הפערים היחסיים הגדולים ביותר בטבלה של Google. הם גם שתי השורות שסביר ביותר שיורצו מחדש על ידי מישהו שלא עובד ב-Google. פער של פי ארבעה עד חמישה בבנצ'מרק תחומי הוא או המשפט החשוב ביותר בהודעה, או הבדל ברתמת הבדיקות, והדרך לגלות היא לעקוב אחרי ריצה שנייה.
• האם יש אח? פוסט ההכרזה של Argon אינו נוקב בשם של משפחה, אינו מציג תצוגה מקדימה של Pro ואינו מציג תצוגה מקדימה של Ultra. gemini-4-* נתיב שני, עמודה שנייה, או רשומת כרטיס דגם — כל אחד מהם היה הופך את הפרשנות הזו בתוך יום. המאמר על מיצוב הדרגות מפרט את כל המפריכים במלואם.
השורה התחתונה
Gemini 4 Argon הוא מודל חזית אמיתי עם טבלת בנצ'מרק אמיתית וציון מדד אמיתי של 52.56 מ-Artificial Analysis — והוא אינו מוצר, במובן המדויק שאין עבורו מזהה מודל, נקודת קצה, כרטיס מודל, חלון הקשר או תאריך זמינות כללית, וגם התיעוד של גוגל עצמה וגם שירותי המדידה של צד שלישי מסכימים שספק אחד בדיוק מארח אותו. ה־"Gemini 4" בשמו הוא תווית דור; ה־"Argon" הוא החלק שאליו מחובר המודל. אם אתם בוחרים במה לבנות החודש, ההחלטה אינה נוגעת ל-Argon: היא נוגעת ל-Gemini 3.8 Flash שאפשר לקרוא לו היום במחיר $0.75 / $3.75 ולמודלי החזית באותה רצועת מדד שנמצאים תחת אותו מפתח. קראו שוב את הדף הזה כאשר gemini-4 מופיע כמזהה ברשימת ה-API. עד אז, כל מה שקשור ל-Argon הוא טענה שגוגל השמיעה על מודל שאף אחד מחוץ לקבוצה הראשונה לא יכול לפנות אליו.

השוואות במאמר הזה3
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
