OpenAI פרסמה 722 כתבי יד מתמטיים שהופקו על ידי מודל גבול פנימי שלא פורסם, והציבו את האוסף המלא במאגר GitHub ציבורי תחת רישיון Apache-2.0. המהדורה, שהוכרזה בפוסט מחקר שכותרתו "שיתוף התקדמות בינה מלאכותית במתמטיקה" ב-6 באוקטובר 2026, היא בין השלכות היחידות הגדולות ביותר של תוצאות מתמטיות שנוצרו על ידי בינה מלאכותית עד כה, והיא מגיעה עם בדיקות רשמיות של הוכחת Lean, סיכומי נימוקים מקוצרים ופירוט יוצא דופן לגבי כמות החישוב שנצרכה כל תוצאה.
המהלך נוחת בשדה שכבר נמצא בקצה. הניו יורק טיימס דיווח כי המהדורה הסעירה עוד יותר קהילה מתמטית שבילתה חודשים בהתמודדות עם מערכות בינה מלאכותית שהפיקו תוצאות מחקר רציניות, בעוד שסיינטיפיק אמריקן תיארה את OpenAI כמשחררת "עוד מאות תוצאות מתמטיות על תחום שכבר היה בהלם". לקוראים העוקבים אחר פיתוחי המחקר העדכניים ביותר של AI, המהדורה היא מקרה מבחן לאופן שבו מעבדות גבול חולקות מדע שנוצר על ידי מכונה מבלי להצית מחלוקות אשראי.
מה נמצא בתוך המאגר
האוסף חי במאגר ה-openai/מתמטיקה ב-GitHub. על פי ה-README שלה, התכנים הם כתבי יד מתמטיים וחפצי הוכחה תומכים המיוצרים על ידי מודל OpenAI פנימי, המורכב כחלק מהערכות לפיתוח מודלים על בעיות מחקר פתוחות. הקטלוג הנוכחי מכיל 722 כתבי יד המאורגנים ב-372 משפחות, כאשר משפחה מקבצת מאמרים הקשורים שעשויים לכלול תוצאה עיקרית, טיעונים נלווים, השלכות או הוכחות חלופיות, כל אחד מסווג לפי דיסציפלינה מתמטית.
ספריית הדפסות מוקדמות מכילה קובצי PDF, קובצי מקור והוראות ציטוט ובנייה לכל כתב יד. ספריית Lean מקטלגת את ההוכחות הפורמליות לצד המסמכים ותצורות האימות הקשורות אליהן. לא כל כתב יד עבר רשמי: תוצאות רבות נושאות פורמליזציות נלוות ב-Lean, שפת התכנות המשמשת לאפשר למחשבים לבדוק הגהות שורה אחר שורה, אבל ה-README מזהיר שכמה תוצאות לא פורמליות עלולות להכיל בעיות. OpenAI אומרת שהיא תתקן בעיות כאלה במהירות, והיא מתחייבת לשמר את היסטוריית השחרורים הציבורית של האוסף, להקליט תיקונים ותיקונים כגרסאות חדשות תוך שמירה על גרסאות קודמות נגישות. כל ספריית כתבי יד נושאת גם בלוק BibTeX לציטוט.
כיצד התקבלו התוצאות
הרוב המכריע של התוצאות הגיע מהליך יחיד וקבוע באמצעות מודל OpenAI פנימי שלא פורסם. במהלך ההערכה, הוצגו למודל כ-4,000 בעיות. OpenAI מדווחת שהתוצאה הממוצעת שפורסמה צרכה בערך שלוש שעות של מחשוב חשיבה ChatGPT Pro, רמה של שקיפות שעדיין נדירה בתעשייה. החברה אומרת שהיא הרחיבה את ההערכות הללו לאחר שהביצועים על אמות המידה המתמטיות הקיימות שלה רוויות, ושחלק מהתפוקות מבוססות על תוצאות קודמות שהפיקו המודלים שלה. דרישה לרמה מתאימה של משמעות וצירוף תפוקה גולמית למשפחות וכתבי יד הפיק את הקטלוג שפורסם.
שני חריגים בשם יצאו מהנוהל הזה: עבודה על הקמת אזור ללא אפס עבור פונקציית הזטה של Riemann, כאשר הכתיבה מכסה את האזור Re(s) > 11/12 נערך על ידי אדם לקריאות, והוכחה להשערת Hodge עבור זני CM abelian. שניהם הם מתמטיקה מיינסטרים רצינית, ושניהם יעמדו כעת בפני ביקורת קהילתית.
כמו כן מתפרסמים עשרה סיכומים מקוצרים של הנמקת המודל. הם מכסים תוצאות הכוללות את מערך האי-רציונליות של pi, ההשערות הסימטריות והכלליות של מאהלר, האיזומורפיזם של גורמי קבוצה חופשית, גבולות קוואסי-פולינומיים להתקדמות אריתמטית, השערת הסופיות הישירה של קפלנסקי במאפיין שני, נוסחת Mezard-Parisi עבור ספין מדוללת בכוסות הספין הספונטניות ובמגנטום הספונטני של היינסנברג, מערכת יחסיות תלת מימדית של Vlasov-Maxwell.
קבוצת ייעוץ עזרה לעצב את השחרור
OpenAI אומרת שהיא התייעצה עם קבוצת הייעוץ העצמאית למתמטיקה ובינה מלאכותית במכון ללימודים מתקדמים תוך פיתוח שיטות עבודה מומלצות לשיתוף תוצאות. הקבוצה הזו פרסמה את המלצותיה לפרסום אחראי ב-29 בספטמבר 2026, לאחר שקיבלה יותר מ-600 תשובות מהקהילה המתמטית. ההמלצות הן בוטה: "איננו תומכים בנוהג זה, ואנו מבקשים מהם להפסיק לבדוק בעיות מתמטיות מתקדמות במודלים קנייניים". הקבוצה דוחקת במעבדות להפקיד תוצאות במאגרים מדעיים שאף מעבדת בינה מלאכותית לא שולטת בהם, להקצות מזהים ניתנים לציטוט מתמשכים, לחשוף את שם הדגם, ההנחיות בהן נעשה שימוש ושרשראות סיכום של הנמקה, ולהימנע מלהתייחס לשחרור תוצאות כאל כלי שיווק.
השחרור של OpenAI הוא ללא ספק ניסיון לציית למסגרת הזו במקום להתריס נגדה. האם הקהילה מקבלת את זה זו שאלה אחרת. הסקר של הקבוצה המייעצת שאל במיוחד על תרחיש שבו מעבדה מכריזה על קיומן של תוצאות רבות מבלי לספק פרטים, וההמלצות שעלו משקפות דאגה עמוקה לגבי הודעות שעולות על האימות.
נטל האימות עובר למתמטיקאים
האתגר המעשי שייך כעת למתמטיקאים עובדים. ניתן לבדוק הוכחות Lean רשמיות בצורה מכנית, ונוכחותן מורידה את הסיכון לטעות באופן משמעותי. אבל כתבי יד ללא פורמליזציות, שה-README עצמו מסמן כפגומים, דורשים ביקורת עמיתים מסורתית, ו-722 כתבי יד הם הרבה מעבר למה שהקהילה יכולה לקלוט במהירות. ישנה גם שאלת העדיפות והקרדיט: מתמטיקאים שבילו שנים בצמוד לבעיות הללו ירצו לדעת בדיוק מה המודל נשאל, מה ניתן לו, והאם שולבה תוצאה אנושית כלשהי. הפרסום של OpenAI של סיכומי הנחיות וסטטיסטיקות חישוב נועד לענות על כמה מהשאלות הללו מראש.
המהדורה גם קובעת תבנית שניתן ללחוץ על המתחרים לעקוב. Anthropic, Google DeepMind ומעבדות אחרות עם מודלים חזיתיים המסוגלים למתמטיקה ברמת מחקר עומדות כעת בפני נורמה דה פקטו, שנוסחה על ידי קבוצת הייעוץ, לפיה יש לפרסם תוצאות מוסתרות במודלים קנייניים עם מקור מלא או לא להקניט כלל.
לעת עתה, המאגר פעיל, מאמץ הפורמליזציה נמשך ותיקונים מנוסחים בפומבי. אם זה יהפוך לספר המשחקים הסטנדרטי למתמטיקה שנוצרת בינה מלאכותית, או עוד נקודת הבזק בקונפליקט מתרחב בין מעבדות לקהילות המחקר שהן מסתמכות עליהן, תלוי איך יעברו השבועות הבאים של הבדיקה.
הישאר לפני עקומת הבינה המלאכותית
המדע שנוצר בינה מלאכותית עובר מהודעה לעיתונות לביקורת עמיתים. עקוב אחר חדשות AI ב-aibuzzwire.news לסיקור של כל מהדורת מחקר מרכזית, השקת מודל ושינוי במדיניות.
קרא עוד חדשות AI →