יום אחד בלבד לאחר ש-OpenAI הפכה את הדגם החזק ביותר שלה לזמין באופן כללי, החברה אומרת שהמערכת הפיקה הוכחה מלאה להשערת ה-Cycle Double Cover - בעיה פתוחה ידועה בתורת הגרפים שהתנגדה למתמטיקאים במשך כחצי מאה.
חוקר OpenAI, איתן נייט, הכריז על התוצאה ב-10 ביולי 2026, ופרסם ש-GPT-5.6 Sol Ultra "הפיק הוכחה להשערת ה-Cycle Double Cover בת ה-50, תוך שימוש ב-64 סוכני משנה תוך קצת פחות משעה". הטענה עלתה במהירות לראש האקר ניוז, וגררה מאות הערות של מתמטיקאים ומהנדסים שהתלבטו אם ההוכחה עומדת.
לכל מי שעוקב אחר פיתוחי הבינה המלאכותית העדכניים ביותר, התוצאה היא הדגמה בולטת לאן הולכים דגמי הגבול - ותזכורת לכך שעדיין יש לבדוק את הטענות המתמטיות שלהם בדרך המיושנת.
מהי השערת הכיסוי הכפול של מחזור?
ההשערה יושבת בענף של מתמטיקה שנקרא תורת הגרפים. במילים פשוטות, הוא שואל שאלה פשוטה ומטעה: האם הקצוות של כל גרף "ללא גשרים" - כזה ללא קצה שהסרתו תפצל אותו - תמיד מכוסים באוסף של מחזורים כך שכל קצה בודד יופיע בדיוק פעמיים?
הבעיה הוצגה באופן עצמאי על ידי כמה מתמטיקאים במהלך השנים, כולל פול סימור ב-1979 וג'ורג' סקרס ב-1973, עם שורשים מוקדמים יותר בעבודתם של W.T. Tutte ושל אלון איתי ומייקל רודה. למרות האמירה הפשוטה שלה, היא הפכה לאחת הבעיות הבלתי פתורות המוכרות ביותר בתחום, ותוצאות חלקיות היו ידועות רק עבור מחלקות מיוחדות של גרפים.
לפי הערת ההוכחה ש-OpenAI פרסמה, הטיעון מפחית את הבעיה לגרפים מעוקבים חסרי לולאה, ואז נשען על תוצאה קלאסית - משפט זרימת אין-מקום-אפס על קבוצת F32 (שווה ערך למשפט 8-זרימות של Tutte) - ושלב מפתח אלגברה ליניארי הממיר תיוג קצה למבנה הדרוש למחזור כפול. הכתבה היא באורך של כמה עמודים בלבד, ובמיוחד, היא משתמשת ב"אין מתמטיקה שפותחה ב-30 השנים האחרונות", כפי שציין מגיב אחד של האקר ניוז.
איך GPT-5.6 Sol Ultra התקרב אליו
מה שמייחד את התוצאה הזו מתשובות צ'אטבוט רגילות הוא איך המודל נפרס. GPT-5.6 Sol Ultra רץ במצב "multiagent v2" של OpenAI, ופיתח מערכת של עד 64 תת-סוכנים ששיתפו פעולה שחקרו אסטרטגיות הוכחה שונות במקביל. OpenAI פרסמה את ההנחיה המלאה לצד ההוכחה, ומציעה מבט נדיר בהוראות שניתנו למערכת.
ההנחיה הנחתה את המודל "להשתמש ב-multiagent v2 בצורה אגרסיבית ודינמית", כדי לשמור על "פורטפוליו מגוון של גישות", ולפרוס סוכנים יריבים לבדיקת כל הוכחה מועמדת למלכודות נפוצות - כמו שבילים סגורים המתחזה למחזוריות או נימוקים מעגליים מקריים. היא אפילו אמרה למערכת "להשקיע בזה לפחות 8 שעות לפני שתחשוב אפילו לחזור או לוותר", אם כי לפי הדיווחים, הריצה האחרונה הסתיימה תוך פחות משעה.
בסעיף "הצהרה על שימוש בבינה מלאכותית" של הערת ההוכחה, OpenAI מפורשת: "ההוכחה בהערה זו נובעת לחלוטין מ-GPT 5.6 Sol Ultra והכתיבה עם Codex (עם GPT 5.6 Sol)."
עדיין לא כולם השתכנעו
הקהילה המתמטית הגיבה בתערובת של התרגשות וזהירות - והספקנות הזו ממוקמת היטב. נכון לפרסום, ההוכחה לא אומתה רשמית בעוזרת הוכחה כמו Lean, וגם לא עברה ביקורת עמיתים מסורתית.
ב-Hacker News, מספר מגיבים ציינו כי הוכחות קצרות ואלגנטיות להשערות מפורסמות ראויות לבדיקה קפדנית במיוחד. "זו הוכחה קצרה מאוד שלא משתמשת במתמטיקה שפותחה ב-30 השנים האחרונות", כתב משתמש אחד. "מה שלא בהכרח הופך את זה לא נכון, אבל בהיעדר מיכון ב-Lean או ביקורת עמיתים ראויה, אני חושב שזה מוקדם לפרסם את זה".
אחרים הצביעו על כך שספריות ההוכחה הפורמליות המובילות של תורת הגרפים עדיין לא בשלות מספיק כדי לבדוק תוצאות ברמת המחקר מהסוג הזה, כלומר, ייתכן שאימות צריך להגיע ממומחים אנושיים הקוראים את הטיעון שורה אחר שורה. OpenAI עצמה מסגרה את ההכרזה כחלק מדפוס רחב יותר: "יותר מחשוב בזמן מבחן מוביל לאינטליגנציה גדולה יותר", אמרה החברה, וסימנה כי גישת ריבוי הסוכן - לא התוצאה היחידה הזו - היא הסיפור האמיתי שהיא רוצה לספר.
למה זה חשוב
גם אם ההוכחה של Cycle Double Cover זקוקה בסופו של דבר לתיקון, הפרק מסמן שינוי משמעותי במה שמודלים של שפות גדולות יכולים לעשות במתמטיקה טהורה. מערכות בינה מלאכותית של Frontier הניבו בעבר תוצאות מחקר חדשות בתחומים מיוחדים - כולל טענות אחרונות אחרות על בעיות שנפתרו בגיאומטריה ובקומבינטוריקה - אבל תקיפת השערה בעלת שם, בת עשרות שנים עם נחיל מתואם של סוכני חשיבה מעלה את הרף במידה ניכרת.
עבור חוקרים, הטייק אווי הוא כפול. ראשית, נראה שהמתכון הרב-סוכני - ניסיונות עצמאיים רבים, האבקה צולבת של רעיונות וביקורת יריבות - הוא תבנית שימושית באמת לפתרון בעיות קשה. שנית, צוואר הבקבוק של האימות הוא כעת רק על בני אדם: המודל יכול לייצר הוכחות מועמדים מהר יותר ממה שהקהילה יכולה לבדוק אותן.
המתח הזה עשוי להגדיר את השלב הבא של מתמטיקה בסיוע בינה מלאכותית. כפי שניסח זאת אחד המגיבים, אם ההוכחה הזו מחזיקה מעמד, "מישהו עומד להתחיל רשימה" של בעיות ארוכות שנים אחרות להטיל על הדור הבא של הדגמים.
לעת עתה, מתמטיקאים יקראו בעיון את ההערה בת שלושה עמודים - עיפרון ביד - בעוד שאר תעשיית הבינה המלאכותית צופה כדי לראות אם המאמץ בן השעה של GPT-5.6 הופך לחלק מהשיא המתמטי הקבוע.
הישאר לפני AI
למידע נוסף על פריצות דרך של מודלים גבוליים וסיקור מחקר בינה מלאכותית, בקר בדף הבית של AI Buzz Wire.
קרא עוד חדשות AI →



