כרטיס כותרת ראשי שעליו כתוב "722 כתבי היד במתמטיקה של OpenAI" עם כותרת המשנה "למודל שמאחוריהם אין שם, אין מחיר ואין API", תג בצבע ענבר שעליו כתוב "מודל שטרם שוחרר - תוצאות בלבד", ושלושה כרטיסים: "מה שוחרר: 722 כתבי יד, 372 משפחות", "מה לא שוחרר: אין כרטיס מודל, אין מזהה, אין תאריך", ו"מה מוסרת OpenAI: פועלת לשחרר את המודל".
Guides & Insights

722 כתבי היד המתמטיים של OpenAI: למודל שמאחוריהם אין שם, אין מחיר ואין API

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

ב-21:47 UTC ב-6 באוקטובר 2026, מאגר בשם openai/math הופיע ב-GitHub ללא תיאור ועם קומיט ראשוני. ארבע עשרה דקות לאחר מכן OpenAI פרסמה אותו ב-X והעלתה עמוד נלווה, "שיתוף התקדמות ה-AI במתמטיקה." יחד, שני הדברים האלה מתארים אירוע חסר תקדים: 722 כתבי יד מתמטיים, מקובצים ל-372 משפחות, שהופקו על ידי מודל חזית פנימי ש-OpenAI לא נתנה לו שם, לא קבעה לו מחיר, ואי אפשר להפעיל אותו מאף API. המודלים שמעליהם הוא נמצא הם אלה שאפשר להגיע אליהם היום בפועל — GPT-6 Astra במחיר $10 / $50 למיליון טוקנים ו-GPT-6.1 Sol במחיר $2 / $10 — ואף אחד מהם לא כתב את המאמרים האלה. OpenAI אומרת שהמודל שעשה זאת עדיין באימון, ושהיא עובדת על "שחרור באחריות" שלו. זה מה שאומת עד כה, מה שלא, והשאלה האחת שקורא צריך לקחת ממנו.

נתחיל במה שהפרסום הזה אינו. הוא לא השקת מודל: אין כרטיס מודל, אין מזהה, אין חלון הקשר, אין טבלת בנצ'מרקים, אין תאריך. הוא לא מאמר: שום דבר כאן לא עבר ביקורת עמיתים, ו-OpenAI אומרת בפשטות שתוצאות ללא פורמליזציה ב-Lean "עלולות להיות בעיות". והוא לא הדלפה — הסיבה שהטקסט הזה כתוב במסגור של מה שאנחנו יודעים עד כה היא לא שהחומר סודי, אלא שהנושא עצמו, המודל, טרם פורסם. כל השאר בהמשך ניתן לבדיקה מול המאגר, הפוסט של OpenAI עצמה, וקבוצת הייעוץ ש-OpenAI אומרת שהתייעצה איתה.

מה בעצם נחת ב-6 באוקטובר?

המאגר ציבורי, ברישיון Apache-2.0, וכתוב ב-Lean. ה-README שלו מציין שהקטלוג "מכיל 722 כתבי יד המאורגנים ב-372 משפחות," כאשר משפחה מקבצת תוצאה עיקרית עם טיעונים נלווים, מסקנות או הוכחות חלופיות. מפת כתבי היד מפורטת מספיק כדי לבצע ביקורת: 372 משפחות, שלכל אחת תוצאה עיקרית, רשומות עם המאמרים המרכיבים אותן, ובמידת האפשר, קישור לפורמליזציה ב-Lean.

הפוסט של OpenAI מוסיף את נתוני המקור, שהם שלה ולא עברו ביקורת בלתי תלויה:

• בעיות שהוצגו — כ-4,000, שמתוכן נבחרו המשפחות ששוחררו

• חישוב לכל תוצאה — בממוצע, שווה ערך לבערך שלוש שעות של חשיבת ChatGPT Pro

• סיכומי חשיבה — 10 פורסמו, המכסים משפחות הכוללות את מעריך האי-רציונליות של π, השערות מלר הסימטרית והכללית, השערת הסופיות הישירה של קפלנסקי במאפיין 2, נוסחת מזאר–פריזי לזכוכיות ספין מדוללות, והמערכת הוולסוב–מקסוול הרלטיביסטית התלת-ממדית

• מדיניות עדכונים — גרסאות חדשות מפורסמות לצורך תיקונים, בעוד גרסאות קודמות נשארות נגישות

הנושאים משתרעים על כל המפה: תורת המספרים, גאומטריה אלגברית ומורכבת, קומבינטוריקה, מדעי המחשב התאורטיים, אלגברות אופרטורים, הסתברות ופיזיקה מתמטית. חלק מכותרות המשפחה הן לכאורה טענות גדולות מאוד — דוגמה נגדית להשערת הכיסוי של רייזר, כפל שלמים מתחת ל-n log n, כפל מטריצות עם מעריך לכל היותר 9/4, השערות מהלר, דוגמאות נגדיות לבאום–קונס ולקדיסון–קפלנסקי. האם טענה נתונה מתקיימת היא בדיוק השאלה שהמהדורה הזו אינה מכריעה עבורך.

Screenshot of the GitHub repository page for openai/math, created October 6, 2026, showing the README statement that the repository contains mathematical manuscripts and supporting proof artifacts produced by an internal OpenAI model, the description of 722 manuscripts organized into 372 families, and the list of ten released reasoning summaries.

המודל ללא שם, טרם שוחרר, ו-OpenAI אומרת שהוא בדרך

קובץ ה-README אינו משתמע לשתי פנים לגבי המחבר: "כתבי יד מתמטיים וחפצי הוכחה תומכים שנוצרו על ידי מודל OpenAI פנימי," כאשר הרוב המכריע הושג "באמצעות מודל OpenAI פנימי שטרם שוחרר." אין שם, אין שם קוד, אין גודל. שמות שמסתובבים בסיקורים אחרים לא אושרו על ידי OpenAI, ואנחנו לא נספק שם כזה.

מה שניתן לתארך הוא ציר הזמן שסביבו. ב-28 באוגוסט 2026, לפי העמוד של OpenAI על קבוצת הייעוץ המתמטית שלה, החברה "החלה לאמן מודל פנימי חדש" שאמנם? לא. "שמאז פתר את בעיית פרס המילניום של נאוויה–סטוקס ולפי הספירה של OpenAI עצמה, יותר מ-100 בעיות פתוחות ותיקות. תוצאת נאוויה–סטוקס הוכרזה בנפרד ב-8 בספטמבר 2026, שם OpenAI תיארה את המודל שמאחוריה כ"בעל יכולת משמעותית גבוהה יותר מ-GPT-6 Astra" ואמרה שהאימון עדיין בעיצומו. שניים מכתבי היד באוסף של השבוע חורגים מהנוהל הסטנדרטי, מה שראוי לציון משום שזה אומר שהפרסום אינו צינור אחיד אחד: עבודה על אזור נטול אפסים של פונקציית הזטה של רימן והוכחה להשערת הודג' עבור יריעות אבליות מסוג CM טופלו באופן שונה, ו-OpenAI אומרת שהטקסט על הזטה נערך בידי אדם כדי שיהיה קריא.

ואז המשפט שחשוב לכל מי שמתכנן בהתבסס על זה: OpenAI כותבת שהיא "פועלת לשחרר באחריות את המודל שהפיק את התוצאות האלה". זו הצהרת כוונות, לא תאריך. עד שהוא ישוחרר, המודלים היחידים של OpenAI שמפתח יכול לקרוא להם הם אלה שכבר נמצאים במחירון.

מה המשמעות של "אימות" כאן — והיכן הוא נגמר

זהו החלק שרוב הסיקור של הפרסום דוחס למשפט אחד, וזהו החלק שקובע כמה משקל יש להעניק לכל מאמר בודד.

OpenAI מציינת במפורש ש"אוסף זה כולל תוצאות בשלבים שונים של אימות". צורת הראיות החזקה ביותר בחבילה היא פורמליזציה ב־Lean, שמאפשרת למחשב, ולא לאדם, לבדוק את ההוכחה. מניפסט הפורמליזציה של המאגר עצמו — הקטלוג של מאמרים עם תוצאה עיקרית מפורמלת — מפרט 162 ערכים, כך שבערך אחד מכל חמישה מבין 722 כתבי היד נתמך בהוכחה הניתנת לבדיקה על ידי מכונה בעץ הציבורי. OpenAI אומרת שעוד יתווספו "ככל שנשיג אותם".

הרוב הגדול הנותר אינו מאומת במובן הזה, ו-OpenAI אינה מעמידה פנים אחרת לגבי כלל האוסף: "חלק מהתוצאות שאינן מפורמלות עשויות להיות בעייתיות. נשתדל לתקן בעיות כאלה במהירות." שני פרטים מבניים מחזקים את הרושם שמדובר בשחרור מנוהל ולא בשחרור פתוח — הנושאים (issues) מושבתים במאגר, ובקשות המשיכה (pull requests) מוגבלות למשתפי פעולה. אין נתיב ציבורי לערער על הוכחה במקומה.

אז הקריאה הכנה צרה יותר ממה שמספר הכותרת מרמז:

• מאומת במכונה — 162 כתבי יד עם תוצאה עיקרית מפורמלת בעץ Lean הציבורי

• לא נבדק על ידי מכונה — השאר, ש-OpenAI בעצמה מסמנת כעלול להכיל שגיאות

• אחריות אנושית — לא צוין איש; הניסוח של OpenAI עצמה הוא שאיש אינו מבין את הטיעונים שמאחורי רוב מה שהופק

• הערכה בלתי תלויה — לא פורסמה אף אחת; הבחירה אילו תוצאות היו "משמעותיות" מספיק כדי לכלול אותן נעשתה על ידי OpenAI

שום דבר מזה לא אומר שהעבודה שגויה. זה אומר שלעת עתה, "OpenAI שחררה 722 הוכחות" ו"722 הוכחות נבדקו" הם משפטים שונים, ורק הראשון נכון היום.

Three-column infographic titled "How much of the 722 is actually checked", contrasting "Machine-checked: 162 manuscripts, formalized main result, in the public Lean tree", "Not machine-checked: the remaining majority, no Lean formalization, OpenAI says could contain issues", and "Human or independent review: none named, none published, selection made by OpenAI", with a footer reading "Figures per OpenAI's repository and post, October 6 2026".

קבוצת הייעוץ הצמידה תנאי, והוא מתועד רשמית.

הפוסט של OpenAI אומר שהוא התייעץ עם קבוצת הייעוץ העצמאית למתמטיקה ובינה מלאכותית במכון למחקר מתקדם ונעזר ב"עצותיהם ובהמלצותיהם הפומביות". המלצות אלה פורסמו ב-29 בספטמבר 2026, לאחר שהקבוצה קיבלה יותר מ-600 תגובות מהקהילה המתמטית, וכדאי לקרוא אותן ישירות, משום שהקבוצה אינה חותמת גומי.

אותו מסמך נפתח בהצהרה שהקבוצה אינה תומכת בנוהג הזה כלל: "כמה ממעבדות ה-AI המובילות בודקות בעיות מתמטיות מתקדמות על מודלים קנייניים שנשארים בלתי נגישים לקהילה המדעית הרחבה... אנו לא תומכים בנוהג הזה, ואנו מבקשים מהם להפסיק." הקבוצה גם מתארת את עצמה כפועלת באופן עצמאי, כשהחברים אינם מתוגמלים ואין להם סמכות לקבל החלטות בנוגע ל-OpenAI — תיאור של מערכת היחסים שמהדהד גם בפוסט של OpenAI עצמה.

המקום שבו ההמלצות של הקבוצה והמהדורה הזו מתיישבות הוא בתהליך: סקירת ספרות יסודית עם ציטוטים לעבודות שהציגו את הרעיונות, כתיבת הוכחות בסגנון סטנדרטי ולא פלט גולמי של מודל, וגרסאות שמשמרות מהדורות קודמות. המקום שבו הן אינן מתיישבות הוא בחלק שהקבוצה מכנה מרכזי — שמעבדה שמפרסמת תוצאות שאיש אינו מבין צריכה לממן את ההבנה האנושית שצריכה לבוא בעקבותיהן, באמצעות סדנאות, כנסים ותוכניות, ושעבודה זו תישאר בהובלת הקהילה ולא בניהול המעבדה. OpenAI התחייבה לממן "סדרה של סדנאות, כנסים ותוכניות מיוחדות סביב ההבנה של תוצאות מרכזיות שנוצרו על ידי בינה מלאכותית" ואומרת שהפרטים יגיעו בהמשך. זה הפריט הפתוח, וזה הדבר שיש לדרוש מהם לעמוד בו.

מה אפשר לקרוא היום, ולשם מה נועד ניתוב כאן בעצם

אין דרך לשלוח בקשה למודל שהפיק את כתבי היד האלה, ואף פלטפורמה של צד שלישי לא יכולה לנתב אותה — כל רשומה שטוענת אחרת מתארת מודל שאינו קיים בקטלוג של אף אחד. המודלים של OpenAI שבשימוש הם קו ה-GPT-6 החי, והמספרים שלהם מופיעים במחירון ולא מוסקים:

• GPT-6 Astra — $10 / $50 למיליון טוקנים, $1 לקריאה מהמטמון; שכבת הקשר ארוך מעל 272K טוקני פרומפט במחיר $20 / $75; הקשר של 1.05M טוקנים, פלט מקסימלי של 128K

• GPT-6.1 Sol — $2 / $10 למיליון טוקנים, $0.10 לקריאה מהמטמון; אותן דרגות מחיר להקשר ארוך ב-$4 / $15; הקשר של 1.05M טוקנים, פלט מקסימלי של 128K

שניהם נמצאים בקטלוג של OrcaRouter, וזו הנקודה המעשית לכל מי שקורא את ההודעה הזו כאות על יכולות: המודלים שמותר לך להשתמש בהם היום הם גם המודלים שהפרומפטים שלך כבר מעוצבים סביבם, והפער בינם לבין המודל הפנימי הוא בדיוק הפער ש-OpenAI מבקשת ממתמטיקאים לעזור לה לסגור.

הפער הזה הוא גם סיבה להשאיר את חשבון הניסויים נפרד מנתיב הייצור. כאשר OpenAI אכן תצמיד שם ומחיר למודל הזה, השבוע הראשון יהיה מבול של טענות בנצ'מרק לא מאומתות והמון עבודת אינטגרציה מחדש בבהלה — הטיעון בעד ניתוב עבור פלטפורמה כמו שלנו הוא שלנסות מודל לא מוכח אז עולה לך מחרוזת מודל, לא מיגרציה. GPT-6 Astra עומד על $10 / $50 ו-GPT-6.1 Sol הוא $2 / $10 למיליון טוקנים, מועברים במחיר מחירון עם 0% תוספת, כך ששינוי מחיר של ספק נכנס לתוקף באותו יום שבו הוא נוחת. מעבר אוטומטי לגיבוי אומר שמודל חדש יכול לשאת חלק מהתעבורה ולהוציא מכלל שימוש בלי להפיל איתו את נתיב הבקשות, וה-DSL לניתוב מאפשר לך להרכיב כמה מודלים לקריאה אחת אם אתה רוצה חוות דעת שנייה על גזירה ארוכה במקום תשובה אחת. שום דבר מזה לא חל על מודל שטרם שוחרר — אבל זו בדיוק התשתית שאתה רוצה שתהיה במקום לפני שהבא ישוחרר.

Screenshot of the OrcaRouter model page for OpenAI GPT-6.1 Sol, showing a 1.05M-token context window, 128K max output, a base pricing tier of $2.00 per million input tokens and $10.00 per million output tokens with a $0.100 cache read and $2.50 cache write, a long-context tier above 272K prompt tokens at $4.00 / $15.00 with $0.200 cache read and $5.00 cache write, plus live performance and benchmark panels.

מה לצפות בהמשך

ארבעה דברים, לפי הסדר שבו סביר שהם יהיו חשובים. ספירת הפורמליזציות, מפני שזהו המספר היחיד בפרסום הזה שיכול לעבור מ"OpenAI אומרת" ל"מכונה בדקה אותו", והוא פומבי. ההערכה הראשונה שהיא באמת בלתי־תלויה של תוצאה בעלת שם — מתמטיקאי מחוץ ל-OpenAI שמנתח מאמר מסוים בפומבי, ולא סיכום של האוסף. המאגר המתארח בקהילה, ש-OpenAI אומרת שהיא עדיין בוחנת, ואשר יעביר את התוצר מחשבונה של OpenAI עצמה לידי התחום. וההשחרור של המודל עצמו, ש-OpenAI התחייבה לו אך לא קבעה לו מועד.

האם 722 כתבי היד אומרים ש-AI פתר את הבעיות האלה?

עבור תת־קבוצה, אם המתמטיקה מחזיקה: האוסף טוען לדוגמאות נגדיות ולהוכחות סביב בעיות פתוחות ידועות, ול-162 מהמאמרים יש פורמליזציה הניתנת לבדיקה על ידי מכונה מאחורי התוצאה העיקרית שלהם. עבור היתר, הטענה היא שמודל הפיק כתב יד על הבעיה, שזו הצהרה חלשה יותר מפתרון מאומת, ו-OpenAI עצמה מזהירה שתוצאות לא מפורמלות עלולות להכיל שגיאות. ההבחנה בין "הפיק הוכחה" ל"יש הוכחה" היא כל הסיפור של השחרור הזה.

האם משהו מזה שמיש במוצר היום?

לא. כתבי היד הם קובצי PDF, מקורות Lean ותקצירי הסקה — ממצאי מחקר, לא שירות. אין מזהה מודל, אין נקודת קצה, אין מחיר ואין טופס בקשת גישה. החלק השימושי למעשה של השחרור עבור מפתח הוא האישור שלשל-OpenAI יש מודל שהוא מהותית מעבר ל-GPT-6 Astra באימון, וזה אות תכנוני לשנים-עשר החודשים הקרובים ולא משהו שאפשר לקרוא לו השבוע.

מדוע OpenAI פרסמה תוצאות במקום את המודל?

מכיוון שלשני אלה פרופילי סיכון שונים. פרסום כתבי יד הוא הפיך — OpenAI שומרת גרסאות קודמות ואומרת שתתקן בעיות — בעוד שהשקת המודל אינה הפיכה. OpenAI מצהירה שהיא פועלת לשחררו באחריות, והמלצות קבוצת הייעוץ, שלדברי החברה היא התבססה עליהן, בנויות בדיוק סביב הרצף הזה: להביא את התוצאות לידי אנשי התחום עם ציטוטים וניהול גרסאות, ואז לממן את ההבנה האנושית שחייבת לבוא לאחר מכן.

הגרסה בת שורה אחת למי שמעיין במהירות: מכלול חסר תקדים באמת של מתמטיקה שנוצרה בידי בינה מלאכותית פורסם ב-6 באוקטובר, כחמישית ממנו נבדקה במכונה, אף לא חלק אחד ממנו עבר ביקורת עמיתים, וכולו קשור למודל שאינך יכול להשתמש בו. השאלה המעניינת אינה אם המודל מסוגל — שלוש שעות של מחשוב חשיבה בחזית לכל תוצאה על פני 4,000 בעיות עונות על כך, ו-OpenAI אומרת שהמודל מסוגל באופן משמעותי יותר מ-GPT-6 Astra — אלא אם האימות וההבנה האנושית ישיגו את הפער לפני שהגרסה הבאה תהפוך את זו למיושנת.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית