כרטיס כותרת שנוצר עם הכיתוב GPT-6 Sol נגד Tencent HY4 Preview, הדגם הזול יותר נושא בתעבורה, עם כרטיסי נתונים המציגים מחיר פלט 10.00$ לעומת 2.50$ למיליון, משקלים סגורים לעומת משקלים פתוחים Apache 2.0, משטח קלט: טקסט, תמונה, קובץ לעומת טקסט בלבד, וכותרת תחתונה עם הכיתוב: תעריפי GPT-6 Sol לפי כרטיס התעריפים של OpenAI; התעריף והמהירות של Tencent HY4 Preview לפי הקטלוג של OrcaRouter, רשימת ספקים 6 / 18 יואן למיליון.
Guides & Insights

GPT-6 Sol מול Tencent HY4 Preview: המודל הזול יותר נושא פי שש מאות תעבורה

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

השוואות בין מודל חזיתי למודל זול בדרך כלל מסתיימות בטבלת המחירים, ולזו יש סוף טוב יותר שזמין. Tencent HY4 Preview ו-GPT-6 Sol מנותבים שניהם על ידי OrcaRouter, מה שאומר שאותה טלמטריה מכסה את שניהם, ובמהלך אותו חלון מתגלגל של שבעה ימים העביר מודל HY4 Preview בערך 2.4 מיליארד טוקנים לעומת כ-3.9 מיליון של GPT-6 Sol. זה לא מדד וזה לא פסק דין; זה חלון מתגלגל של התעבורה של פלטפורמה אחת, והוא ייראה אחרת בשבוע הבא. אבל זה אות אמיתי לגבי מה שאנשים שבונים דברים באמת בוחרים להשתמש בו כשמודל חזק עם משקולות פתוחות עולה רבע מהמודל הסגור, וזה מסוג המספרים שדף מפרט לא יכול להפיק.

שני המודלים גם ממחישים מה בנצ'מרק יכול לספר לך ומה הוא לא יכול. ל-GPT-6 Sol, שיצא ב-22 בספטמבר 2026 כדרגה האמצעית של דור GPT-6 של OpenAI, יש ציון עצמאי ב-Intelligence Index. ל-HY4 Preview, ששוחרר והופץ כקוד פתוח על ידי Tencent ב-28 באוגוסט 2026, אין עמוד מודל ב-Artificial Analysis, אין מדד של צד שלישי, ואין כלל נתון עלות עצמאי לכל משימה. כל מה שפורסם על ביצועיו הוא מדידה עצמית של Tencent. אי-הסימטריה הזו לא הופכת את HY4 Preview למודל החלש יותר. היא הופכת אותו למודל הפחות מבוקר, ואלה טענות שונות.

המפרטים, כולל השניים שקובעים את רוב הפריסות

• מחיר פלט — GPT-6 Sol $10.00 למיליון לעומת Tencent HY4 Preview $2.50 למיליון
• מחיר קלט — GPT-6 Sol $2.00 למיליון לעומת Tencent HY4 Preview $0.83 למיליון
• קלט במטמון — GPT-6 Sol $0.20 למיליון לעומת Tencent HY4 Preview $0.04 למיליון
• משקולות — GPT-6 Sol סגור, API בלבד לעומת HY4 Preview בקוד פתוח תחת Apache 2.0
• מודאליות קלט — GPT-6 Sol טקסט, תמונה וקובץ לעומת HY4 Preview טקסט בלבד
• חלון הקשר — GPT-6 Sol 1,050,000 טוקנים לעומת HY4 Preview 1,048,576 טוקנים
• פלט מקסימלי — GPT-6 Sol 128,000 טוקנים לעומת HY4 Preview 64,000 טוקנים
• מדרגת בקשה ארוכה — GPT-6 Sol מתמחר מחדש את כל הבקשה מעל 272,000 טוקני קלט ל-$4.00 / $15.00 לעומת HY4 Preview, שאין לה מדרגה בכרטיס התמחור שלה
• ארכיטקטורה — GPT-6 Sol לא נחשפה לעומת HY4 Preview 770B פרמטרים בסך הכול, 49B פעילים, 78 שכבות, 256 מומחים מנותבים ועוד אחד משותף, שכבת חיזוי רב-טוקנים מקורית
• ציון בלתי תלוי — GPT-6 Sol 47.6 Intelligence Index לעומת HY4 Preview לא פורסם
• מהירות פלט מדודה — GPT-6 Sol כ-244 טוקנים לשנייה לעומת HY4 Preview כ-54, שניהם נתונים מתגלגלים של שבעה ימים

שתי השורות שמכריעות ברוב הפריסות האמיתיות הן דווקא אלה שנמצאות בתחתית. הראשונה היא ש-HY4 Preview אינו מקבל קלט של תמונות או קבצים, מה שמוציא אותו מכל תהליך עיבוד שצריך לבחון משהו. השנייה היא תקרת הפלט: 64,000 טוקנים הם מחצית מה-128,000 של GPT-6 Sol, ובמודל שמטרתו המוצהרת היא סוכני קוד ושרשראות ארוכות של שימוש בכלים, זו המגבלה שצוות נתקל בה ראשונה — לא האיכות, אלא הנקודה שבה קובץ שנוצר כבר אינו נכנס בתגובה אחת.

לעומתם, רבע ממחיר הפלט וחמישית ממחיר הקלט השמור במטמון קונים הרבה מאוד ניסיונות חוזרים. והארכיטקטורה של HY4 Preview מתועדת באופן שזו של GPT-6 Sol אינה מתועדת: Tencent פרסמה את מספר הפרמטרים, את מספר השכבות, את פריסת המומחים ואת שכבת הפענוח הספקולטיבי, מה שאומר שמאפייני השירות ניתנים לפחות חלקית לניבוי מתוך המאמר ולא רק לצפייה דרך ה-API.

Generated comparison scoreboard titled GPT-6 Sol vs Tencent HY4 Preview, the scoreboard, with six matched rows. GPT-6 Sol: input $2.00 per million, output $10.00 per million, modalities text image file, weights closed, context window 1,050,000 tokens, Intelligence Index 47.6. Tencent HY4 Preview: input $0.83 per million, output $2.50 per million, modality text only, weights Apache 2.0 open, context window 1,048,576 tokens, no independent score published. A footer reads Tencent HY4 Preview rates per OrcaRouter's catalogue against a vendor list of 6 / 18 yuan per million; GPT-6 Sol figures per Artificial Analysis v4.3.2 and OpenAI.

מהי למעשה טבלת הבנצ'מרקים של HY4 Preview

המספרים שפרסמה Tencent חזקים, וכולם מגיעים מהספק עצמו. ב-Terminal-Bench 2.1 המודל רושם 85.4; ב-DeepSWE,‏ 64.3; ובהערכה עיוורת פנימית על פני 203 משימות הנדסיות הוא השיג ממוצע של 2.99 לעומת 2.92 של GLM-5.3 ו-2.94 של Kimi K3 — יתרון של שבע מאיות הנקודה בסולם של עשר נקודות, במחקר ש-Tencent עיצבה. הוא גם הופיע לראשונה בלוח הדירוג של WebDev Arena, שם Tencent מדווחת שהוא מגיע לסביבות המקום החמישי בכללי והשלישי מבין המודלים במשקולות פתוחות. תוצאת הזירה מבוססת על הצבעת קהל ולא על ניקוד של הספק, והיא הראיה העצמאית ביותר בקבוצה; השאר הוא טענה, וטענה עדיין שווה קריאה כל עוד היא מסומנת ככזו.

הפער שמשנה אינו שהמספרים האלה עשויים להיות נדיבים — מערכות ההערכה של ספקים בדרך כלל כאלה, בשני הכיוונים. הוא שאין מדידה שנייה להשוות אותם אליה. מודל שיש לו דף ב-Artificial Analysis אפשר לבדוק; מודל שאין לו לא, וההבדל מתגלה חודשים אחר כך כשמישהו מגלה שמספר ראשי נמדד במערכת הערכה שאיש אחר אינו יכול לשחזר. שום דבר כאן לא מרמז שזה קרה ל-HY4 Preview. זה רק אומר שהחלטת אימוץ שנשענת על 85.4 נשענת על מקור אחד.

המשמעות המעשית היא שיש להעריך את HY4 Preview על התנועה שלך, ולא על הטבלה, ומבנה העלויות הופך את זה לזול לביצוע — ברבע מקצב הפלט של GPT-6 Sol, שבוע של תעבורת צל מול הפרומפטים האמיתיים שלך עולה פחות מסקירת דרג API אחת. זו צורת בדיקת הנאותות הנכונה עבור מודל שאינו נמדד מספיק, והיא הצורה שכמעט אף אחד לא באמת מיישם.

שאלת המשקולות הפתוחות, שהיא קו ההפרדה האמיתי

HY4 Preview הוא בקוד פתוח תחת Apache 2.0 עם בילד FP8 ברישיון מתירני לצד הצ'קפוינט הבסיסי. GPT-6 Sol סגור ואין לו קובץ רישיון כי אין מה להעניק ברישיון. כל השאר בהשוואה הזו הוא פשרה; זה הבדל קטגוריאלי.

מה שזה קונה לך הוא לא בעיקר חשבון זול יותר — במחיר של 2.50 דולר למיליון טוקנים של פלט, ה-API המתארח כבר נמוך מהעלות של רוב הצוותים להריץ מודל עם 770 מיליארד פרמטרים, ואם העלות הייתה כל הטיעון, הרישיון המתירני היה לא רלוונטי. מה שזה קונה הוא פריסה שאינה תלויה בנקודת הקצה של אף אחד: משקלים שלא ניתן להגביל את הקצב שלהם, צ'קפוינט שאפשר לבצע עליו קוונטיזציה כדי שיתאים לחומרה שברשותך, מודל שניתן לכוונן, ותעבורה שיכולה להישאר בתוך גבול רשת. התשובה של GPT-6 Sol לכל ארבעת הדברים האלה היא שלא אמורים להזדקק לאף אחד מהם, וזה טיעון אמיתי עבור קבוצה אמיתית של צוותים וטיעון לא רלוונטי עבור הצוותים שכן זקוקים להם.

הפיצול בין המודאליות וקו הרישיון מצביעים לאותו כיוון, וזה ראוי לתשומת לב. מודל שקורא רק טקסט ומופץ תחת Apache 2.0 בנוי להיות רכיב — משהו שמניחים בתוך צינור עיבוד שאתם שולטים בו, ומזינים אותו בטקסט שכבר יישבתם. מודל שקורא טקסט, תמונות וקבצים ונגיש רק דרך API בנוי להיות נקודת הכניסה, שלוקחת ישירות את הקלט המבולגן. אלה תפקידים שונים, והשוואה שמדרגת אותם לפי אינדקס אחד עונה על שאלה שאף אחד מהספקים לא שאל.

OrcaRouter model page for Tencent Hy4 preview (tencent/hy4-preview) by Tencent, dated 2026-08-28, tagged Tools, JSON and Reasoning, describing it as Tencent's latest mixture-of-experts flagship with 770 billion total parameters, 49 billion activated per token, 78 layers, 256 routed experts plus one shared expert and a 1M-token context window, text-only, with a list price of $0.83 per million input and $2.50 per million output and a p50 time to first token of 6.18 seconds.

הגשתם יחד, ומה שמשתמע ממספר התעבורה

שני המודלים נמצאים מאחורי מפתח OrcaRouter אחד יחד עם יותר מ-200 אחרים, וצורת הניתוב שהצירוף הזה מרמז עליה היא ההופכית מזו המובנת מאליה. שימו את HY4 Preview ראשון — הוא המודל הזול יותר פי ארבעה בפלט, הוא זה עם הארכיטקטורה המתועדת, ובמסלולים שלנו הוא זה שנושא בעומס — והשאירו את GPT-6 Sol מאחוריו עבור הבקשות שדורשות קריאת תמונה, או שדורשות לפלוט יותר מ-64,000 טוקנים, או שנכשלות בבדיקת איכות. ההרכב מבוטא ב-DSL של הניתוב ולא בקוד היישום, כך שהגבול בין השניים הוא כלל שאפשר לערוך בלי פריסה.

נתוני המהירות ראויים להסתייגות ואחר כך למסקנה. HY4 Preview נמדד במהירות של כ-54 אסימוני פלט בשנייה בחלון המתגלגל שלנו, לעומת כ-244 של GPT-6 Sol, ושניהם תצפיות בתשתית משותפת ולא בנצ'מרק מבוקר — הנתון של Tencent בפרט משקף מודל עם מספר פרמטרים פעילים גדול מאוד, ו-49 מיליארד פעילים לכל אסימון הם הרבה מאוד חישוב לכל אסימון פלט. אז המודל הזול הוא האיטי יותר בפער גדול, וזה בדיוק העסקה שצינור אצווה שמח לבצע וצינור אינטראקטיבי לא. גרסת האירוח של Tencent קיבלה גם אופטימיזציית ביצועים ב-7 בספטמבר 2026, שלדברי הספק מפחיתה סבבי הסקה וצריכת אסימונים לכל משימה באותה איכות משימה — נתון נוסף מטעם הספק, אבל כזה שמנבא חשבון נמוך יותר ולא זרם מהיר יותר.

מעבר כשל הוא מה שהופך את הזיווג לבטוח בכל סדר. מודל במשקלים פתוחים עם 770 מיליארד פרמטרים מוגש על ידי יותר מספק תשתיות אחד, ומסלול שיכול לעבור לגיבוי פירושו שמארח במצב ירוד הוא ניסיון חוזר ולא השבתה. הקטלוג שלנו מעביר את מחירי המחירון של הספקים ללא תוספת, מה גם שאין צורך להמתין לשער הספק הנקוב במטבע: Tencent מפרטת את HY4 Preview ב-6 יואן לקלט ו-18 יואן לפלט למיליון, והנתון בדולרים שהעמוד שלנו מציג הוא השער הזה לאחר המרה, ולא מרווח של מוכר מחדש.

Artificial Analysis model page for GPT-6 Sol (Max), a proprietary OpenAI model released September 2026, carrying a banner noting the model is deprecated and that OpenAI has launched a newer release, GPT-6.1 Sol. The page shows an Intelligence Index of 48, an output speed of 87.9 tokens per second, $2.00 per million input and $10.00 per million output, a 90% cache discount, and a 1M-token context window.

בשביל מה הזוג הזה באמת מיועד

קח את Tencent HY4 Preview לנפח, לתהליכי עיבוד טקסט בלבד שאתה שולט בהם, לכל דבר שצריך לרוץ על החומרה שלך, ולכל עומס עבודה שבו אפשר לתפוס תשובה שגויה ולנסות שוב — המחיר הופך את הניסיון החוזר למנוף האיכות הזול ביותר שיש לך. קח את GPT-6 Sol כשהקלט הוא תמונה או קובץ, כשתשובה אחת צריכה לשאת יותר מ-64,000 טוקנים, או כשהתשובה מיועדת לאדם שיפעל לפיה בלי לבדוק. קח את שניהם אם התעבורה שלך מכילה קצת מכל אחד, וזה כמעט בוודאות המצב.

שתי בדיקות מסכמות. HY4 Preview עדיין מסומן כתצוגה מקדימה ונשאר המודל החדש ביותר של Tencent בקטלוג שלנו, כך שהשם מדויק ולא מיושן — אבל תצוגה מקדימה עלולה להשתנות לך מתחת לרגליים, וצ'קפוינט בעל רישיון מתירני עלול להיות מוחלף במהדורה הסופית של עצמו בלי אזהרה. וגם GPT-6 Sol כבר הוחלף ב-GPT-6.1 Sol בתעריפים זהים להקשר קצר, כאשר קלט במטמון הופחת בחצי מ-$0.20 ל-$0.10, ועמוד המודל של OpenAI עצמה מפנה כעת את הקוראים לשם. אם הסיבה שאתה שוקל את Sol ולא את המודל של Tencent היא האינטגרציה בת שמונת הימים, זה עדיין תקף. אם זו היכולת, היורש הוא מה שאתה רוצה לתמחר.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית