OpenAI צמצמה בשקט את חלון ההקשר לעבודה עבור סוכן הקידוד שלה ב-Codex ומשפחת הדגמים הבסיסית של GPT-5.6, וקיצצה את המגבלה השמישה מכ-372,000 אסימונים ל-272,000 אסימונים. השינוי, שהופיע באמצעות בקשת משיכה ממוזגת במאגר הקוד הפתוח של החברה, גרר תגובות חריפות ממפתחים המסתמכים על הקשרים גדולים כדי לנתח בסיסי קוד שלמים במעבר אחד.

ההתאמה משקפת מתח מוכר בתעשיית הבינה המלאכותית, שבה חברות מאזנות את העלות של מסקנות ארוכות הקשר מול הנוחות שהיא מציעה למשתמשים. עבור סיקור תעשיית הבינה המלאכותית, המהלך מדגיש כיצד אפילו שינויים קטנים במטא-נתונים של המודל יכולים להסתבך במיליוני זרימות עבודה של מפתחים.

מה השתנה והיכן הוא זוהה

ההפחתה הפכה לגלויה בקובץ המטא-נתונים של המודל המצורף של מאגר Codex, `codex-rs/models-manager/models.json`. בקשת משיכה שכותרתה "Backport refreshed bundled metadata to 0.144", שנכתבה על ידי מהנדס OpenAI sayan-oai והתמזגה ב-18 ביולי 2026, ריעננה את המטא נתונים שבהם משתמשים לקוחות Codex יציבים כדי להבין את היכולות של כל דגם.

הקובץ הנוכחי מציג ערך `context_window` של 272,000 אסימונים על פני מערך ה-GPT-5.6, כולל גרסאות GPT-5.6-Sol, GPT-5.6-Terra ו-GPT-5.6-Luna, כמו גם ערכים ישנים יותר של GPT-5.5 ו-GPT-5.2. לפי דיון ב-Hacker News, שבו השינוי גרר יותר מ-350 הצבעות בעד, מגבלת העבודה הקודמת עמדה על כ-372,000 אסימונים. דגמים מסוימים שומרים על `max_context_window` גבוה יותר של עד מיליון אסימונים, אך חלון ברירת המחדל שלקוחות מבקשים למעשה מגיע ל-272,000.

ההבחנה הזו חשובה. חלון ההקשר המקסימלי מייצג את מה שהמודל יכול לקבל באופן תיאורטי, בעוד ש-`context_window` הפועל הוא מה שלקוח Codex מוגדר לשלוח כברירת מחדל. בפועל, זה אומר שמפתחים שהזינו בעבר את הסוכן במאות אלפי אסימונים של קוד מקור יגיעו כעת לתקרה מוקדם יותר.

מדוע אורך ההקשר חשוב עבור סוכני קידוד

עבור סוכן קידוד כמו Codex, חלון ההקשר אינו מדד יהירות. הוא קובע כמה ממאגר יכול המודל "לראות" בבת אחת כאשר הוא חושב על באג, יצירת תכונה או עיבוד מחדש של מודול. ירידה של 100,000 אסימונים פירושה בערך 75,000 פחות מילים של קוד, הערות ותיעוד נטענים בהנחיה אחת.

במונחים של העולם האמיתי, זה יכול להיות ההבדל בין סוכן שמבין מיקרו-שירות שלם מקצה לקצה לבין צורך לפעול עם ראייה חלקית וקצוצה. מפתחים שעובדים על יחידות אחסון גדולות או מבצעים העברות גורפות בין קבצים הם המושפעים ביותר, מכיוון שהמשימות שלהם תלויות בהחזקת קבצים רבים בהקשר בו-זמנית.

השינוי מגיע כשכלי קידוד סוכן מתחרים באגרסיביות על כמות ההקשר שהם יכולים להתמודד. יריבים שיווקו חלונות הקשר עצומים כנקודת מכירה מרכזית, וממסגרים את היכולת להטמיע בסיסי קוד שלמים כדרך להנדסת תוכנה אוטונומית אמיתית. הנסיגה של OpenAI מצמצמת את הפער הזה ברמת ברירת המחדל.

עלות, איכות והכלכלה של הקשר ארוך

המניע הסביר הוא עלות. הקשרים ארוכים יותר יקרים באופן דרמטי לעיבוד, הן בחישוב והן בהשהיה, מכיוון שהמודל חייב להשתתף בכל אסימון בקלט. שיעורי כישלון גבוהים של "מחט בערימת שחת" נוטים גם לזחול פנימה ככל שהקשרים נמתחים, כלומר דוגמנים מפספסים לפעמים מידע שקבור עמוק בתוך הנחיה ארוכה. מכסת חלון ברירת המחדל יכולה להפחית את בעיות הדיוק הללו תוך חיתוך הוצאות ההסקות.

OpenAI לא פרסמה הודעה נפרדת המסבירה את ההפחתה. השינוי עבר רק דרך רענון המטא נתונים והחזרה לקו השחרור 0.144, שהוא הסניף שנשלח לרוב המשתמשים שאינם אלפא Codex. ההשקה הזו בפרופיל נמוך בולטת בעצמה: החלטה שמשפיעה ישירות על פרודוקטיביות המפתחים הועברה באמצעות הבדל קוד ולא פוסט בבלוג או יומן שינויים.

עבור צוותים, המשמעות המעשית היא פשוטה. משימות שהשתלבו בעבר במעבר הקשר בודד עשויות לדרוש כעת פיצול עבודה לנתחים קטנים יותר, אחזור קבצים רלוונטיים בצורה סלקטיבית יותר, או קבלה שלסוכן יש שדה ראייה צר יותר. מפתחים מסוימים עשויים לנתב את המגבלה על ידי הסתמכות על 'חלון_ההקשר_מקסימלי' הגבוה יותר, היכן שהוא זמין, אם כי פעולה זו דורשת בדרך כלל תצורה מפורשת.

דפוס רחב יותר של התאמות שקטות

חיתוך ההקשר של Codex מתאים לדפוס ענף רחב יותר שבו מעבדות בינה מלאכותית מכוונות את הפרמטרים של המודלים שלהן בין השקות לכותרות. גדלי חלונות, מגבלות תעריפים והתנהגויות ברירת מחדל מותאמות לעתים קרובות באמצעות עדכוני תשתית שלעולם אינם מגיעים להודעה לעיתונות. מפתחים התלויים במערכות אלו צופים יותר ויותר במאגרים הבסיסיים ובתגובות ה-API לאיתותים מוקדמים.

המהלך של OpenAI גם מדגיש את הפער בין השיווק למציאות. מודל עשוי לתמוך באורך ההקשר של הכותרת, אך החלון האפקטיבי שהמוצרים חושפים בפועל יכול להיות קטן בהרבה, מעוצב על ידי החלטות עלות שספקים מקבלים בשם המשתמשים.

הישאר לפני AI

פרמטרי המודל משתנים ללא הרף, והכלים שמפתחים תלויים בהם יכולים להשתנות בן לילה. לדיווח בזמן על מהדורות, שינויים ביכולות והכלכלה של בינה מלאכותית, עקוב אחר חדשות הבינה המלאכותית ב-AI Buzz Wire.

קרא עוד חדשות AI →