
Agora-2 לעומת MiniMax M3: GPU אחד לכל משתתף, או 13 סנט למיליון טוקנים
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 36 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 181 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
שתי דרכים להריץ המון סוכנים, במחיר בשני מטבעות שונים. MiniMax M3 עולה $0.30 למיליון טוקני קלט ו-$1.20 למיליון פלט — תעריף שהופך ניסוי של אלף סוכנים לסעיף שורה ולא לסבב גיוס. Agora-2, מודל העולם הרב-סוכני Odyssey שהוצג בתצוגה מקדימה ב-21 בספטמבר 2026, עולה כרטיס NVIDIA RTX PRO 4500 אחד לכל תצוגת משתתף: הפעלה של ארבעה שחקנים רצה על ארבעה GPUs, כאשר מודל רינדור אחד לכל כרטיס מייצר את נקודת המבט בגודל 640×480 של אותו שחקן, ואחד מארבעת הכרטיסים האלה גם נושא את הסימולציה המשותפת ואת שש-עשרה מדיניות הסוכנים האוטונומיות. המספר של MiniMax M3 הוא לפי טוקן ומשתנה בהתאם לכמה שהסוכנים שלך חושבים. המספר של Agora-2 הוא לפי עין ומשתנה בהתאם לכמה משתתפים בו-זמניים אתה מכניס לעולם. להשוות ביניהם זה להשוות תקציב חשיבה לתקציב רינדור, ולמי שמתכנן מחקר רב-סוכני ב-2026, מסתבר שזה הדבר המועיל לעשות.
צד הטוקן בספר החשבונות
MiniMax M3 הוא דגם הדגל במשקולות פתוחות של MiniMax, שיצא ב-31 במאי 2026: תערובת מומחים דלילה בעלת 428 מיליארד פרמטרים, עם כ-23 מיליארד פרמטרים פעילים לכל טוקן, חלון הקשר של 1,048,576 טוקנים — שמתוכו MiniMax מבטיחה 512K שמישים — קלט טקסט, תמונה וווידאו, וציון של 29 במדד Artificial Analysis Intelligence Index v4.3.2. הוא מדווח על 83.5 ב-BrowseComp ועל 76.1 ב-BankerToolBench לפי נתוני הספק — המספרים של MiniMax עצמה, שלא שוחזרו כאן — ו-Artificial Analysis מודדת אותו ב-145 טוקני פלט בשנייה, המודל העשירי במהירותו בלוח הזה.
המספר הרלוונטי עבור ציי סוכנים, עם זאת, הוא שיעור הקריאה מהמטמון: $0.06 למיליון טוקנים במטמון, חמישית ממחיר הקלט. לולאות סוכנים נשלטות על ידי קידומת — אותו פרומפט מערכת, אותן סכמות כלים, אותה היסטוריה מצטברת, הנשלחות מחדש בכל תור — ולכן העלות האפקטיבית של לולאה קרובה הרבה יותר ל-$0.06 מאשר ל-$0.30 עבור עיקר הטוקנים שלה. זו האריתמטיקה שהופכת הרצה של 1,200 סוכנים, מהסוג ש-METR תיעדה בתוך הערכת ExploitGym של OpenAI מיולי 2026, למשהו שקבוצת מחקר יכולה למעשה לשחזר ולא רק לקרוא עליו.
צד ה-GPU של ספר החשבונות
מבנה העלויות של Agora-2 נחשף בנספח המימוש שלה, והוא קונקרטי באופן מרענן. RTX PRO 4500 Blackwell Server Edition אחד לכל תצוגה. ארבעה עבור סשן של ארבעה שחקנים. הכרטיסים האלה מייצרים את התצוגה של כל משתתף ביעד של חמישה עשר עדכוני לטנט ושלושים פריימים מוצגים בשנייה ברזולוציית 640×480, והסימולציה מתקדמת בטיק של 30 Hz. הדוח גם מספק את היקף האימון של העבודה הנלווית: אצווה גלובלית אפקטיבית של 128 על פני 32 מעבדים גרפיים B200.
בתרגום ליחידה זהה לזו של MiniMax M3, כלומר GPU אחד במרכז נתונים לכל משתתף בו-זמני, ובנוסף הסימולציה המשותפת רוכבת על אחד מהם. זו עלות קבועה שלא אכפת לה כמה זמן הסוכנים שלך מתלבטים ולא יורדת כשהם שותקים. מכאן נובעות שתי מסקנות, והן מצביעות בכיוונים מנוגדים. במספרי משתתפים נמוכים עם הסקה כבדה לכל סוכן, מודל הטוקנים זול בבירור — אתה משלם סנטים על חשיבה וכלום על הסוכן השני בחדר. במספרי משתתפים גבוהים עם אינטראקציה צפופה, החשבון מתהפך: עשרים משתתפים בו-זמניים בעולם משותף הם עשרים GPUs, מספר שלא גדל עם מספר הטוקנים שכל אחד מהם מוציא.
• יחידת עלות — Agora-2: RTX PRO 4500 אחד לכל צפייה של משתתף לעומת MiniMax M3 $0.30/$1.20 לכל מיליון טוקנים
• קריאות מהמטמון — Agora-2 לא רלוונטי, אין חיוב על טוקנים לעומת MiniMax M3 $0.06 לכל 1M במטמון
• ציון עצמאי — Agora-2: לא פורסם, לעומת MiniMax M3 AA Intelligence Index 29 (v4.3.2)
• הקשר — מצב משותף של Agora-2 בתוספת היסטוריה חסומה לכל תצוגה לעומת MiniMax M3 1,048,576 טוקנים, 512K מובטחים
• פלט — וידאו Agora-2 640×480 ביעד של 30 fps לעומת טקסט MiniMax M3
• גישה — תצוגה מקדימה בדפדפן של Agora-2, ללא API, ללא משקולות לעומת MiniMax M3 עם משקולות פתוחות, רישיון קהילתי, API


מדוע שתי העלויות אינן תחליפים
מפתה לקרוא את זה כבחירה בין שניים, אבל זה לא. MiniMax M3 הוא מוח של מדיניות: הוא קורא מצב שנצפה חלקית, מנמק, קורא לכלים ומוציא פעולה. Agora-2 הוא סביבה שבה לפעולות יש השלכות הנראות למשתתפים אחרים — מודל סימולציה שחוזה כיצד פעולות משולבות משנות מצב משותף, שרת עולם שמיישם אותן, ומרנדרים לפי תצוגה כך שכל משתתף רואה את אותו עולם מנקודת המבט שלו. שש-עשרה הישויות האוטונומיות של Odyssey אינן מונעות על ידי שום מודל שפה; הן מדיניויות רקורסיביות סקלריות ומרחביות שאומנו בלמידת חיזוק, צורכות היסטוריית תצפיות בת שש-עשרה ופועלות כל ארבעה טיקים של סימולציה. בחירת העיצוב הזו היא הסימן המסגיר. בקצב של שלושים טיקים בשנייה, ההחלטה מה לעשות היא בעיית בקרה, ובעיות בקרה נפתרות על ידי אימון מדיניות קטנה ולא על ידי קריאה ל-API.
אז ההצגה הכנה לצוות שמתכנן עבודה רב-סוכנית היא שאלה נמצאים בשכבות שונות וצריך תקציב לכל אחת. שכבת ההיסק זולה וגמישה ואפשר לקנות אותה. שכבת הסביבה, אם אתה רוצה משהו שאינו מנוע משחקים, נמצאת כרגע בתצוגת מחקר מוקדמת עם טביעת רגל עתירת GPU וללא API מפורסם. שתי העובדות חדשות מספיק — M3 מאז מאי, Agora-2 מאז ספטמבר — כך שכמעט לאף אחד אין עדיין מודל עלויות לשילוב.
מה מאומת ומהו יעד
הציון העצמאי של MiniMax M3, חלון ההקשר, המודאליות והמחיר הם עובדות שפורסמו, שאפשר לבדוק היום. הנתונים של BrowseComp ו-BankerToolBench הם דיווחי ספק, ויש לתייג אותם ככאלה בכל פעם שאתם מצטטים אותם.
המספרים של Agora-2 מגיעים כולם מהדוח הטכני של Team Odyssey, ואף אחד מחוץ לחברה לא שחזר אותם. תוצאת הרינדור שלה — 30.11 dB PSNR עבור הרנדרר עם קידומת מובנית לעומת 20.67 dB עבור בייסליין VAE על שלושים קליפי ניטור — היא השוואה בין מערכות שלמות עם תקציבי אימון שאינם תואמים, כפי שמציין הדוח עצמו. הפחתת זמן הדנואיזר שלה בשיעור 45.8% לעומת תשומת-לב מוצלבת נובעת מדנואיזרים מאותחלים באקראי על קלטים סינתטיים, ומודדת עלות הרצה ולא איכות תמונה. ובסעיף המגבלות שלה נאמר בפשטות שקצבי חמישה-עשר עדכונים לשנייה ושלושים פריימים לשנייה הם יעדים; שקצב פריימים מתמשך והשהיה מקלט לתצוגה במהלך אינטראקציה חיה בין כמה סוכנים "לא הוערכו כמותית"; שאיכות חזותית לטווח ארוך, הסכמה בין נקודות מבט ועמידה בפעולות מקצה-לקצה נותרו ללא הערכה; שהסביבה זקוקה למנוע עם מכשור, גיאומטריה מפורשת ואוצר מילים קבוע למראה; ושההעברה מחוץ לתחום האימון לא נבדקה. כל מי שבונה מודל עלות על GPU אחד לכל מבט צריך לקרוא את הסעיף הזה קודם, כי התפוקה ל-GPU היא בדיוק מה שלא נמדד.
השיחה
אם אתה בונה ציי סוכנים — מודלים רבים, לולאות ארוכות, קריאות לכלים, ללא רינדור — MiniMax M3 הוא הדרך האמינה והזולה ביותר לעשות זאת בקנה מידה גדול, ושיעור קריאת המטמון הוא המספר שמכריע את החשבון שלך. הוא מנותב ב-OrcaRouter במחיר המחירון של MiniMax עצמו ללא תוספת, כך ששיעור המטמון של $0.06 הוא מה שאתה משלם, עם מעבר אוטומטי בין ספקים אם נקודת קצה נפגעת באמצע הריצה. עבור ציים במיוחד, ההעברה הישירה חשובה יותר מהרגיל: מרווח של מפיץ על טוקנים במטמון הוא מרווח המוכפל בכל תור של כל סוכן.

Agora-2 אינו משהו שאפשר לנתב אליו — אין API, אין מחיר ואין משקלים, רק תצוגה מקדימה בדפדפן של Odyssey — ואנחנו לא מארחים אותו. מה שכן, זהו הסימולטור הראשון של עולם משותף שנבנה במיוחד כדי שניתן יהיה לצפות במשתתפים רבים, אנושיים ומלאכותיים, מקיימים אינטראקציה בתנאים מבוקרים, והדו"ח הנלווה אליו הוא ישיר באופן יוצא דופן לגבי עד כמה הוא רחוק כרגע מלהיות מוצר. אם הבעיה שלך היא הסקה בהיקף גדול, MiniMax M3 זמין כעת וזול. אם הבעיה שלך היא מה קורה כאשר אלף מאותם מנועי הסקה חולקים עולם, Odyssey בנתה את הזירה והשאירה את המדידות הקשות למישהו אחר להריץ.
