מה השתנה
על פי כרטיס התעריפים ויומן השינויים של OpenAI שפורסם, המחירים הסטנדרטיים למיליון אסימון נכתבים כעת:
- GPT-5.6 Luna: קלט של 20 סנט ופלט של $1.20, ירידה מ-$1 ו-$6 - הפחתה של 80%
- GPT-5.6 Terra: $2 ו-$12, ירידה מ-$2.50 ו-$15 - קיצוץ של 20%
- GPT-5.6 Sol (ספינת הדגל): $5 ו-$30, ללא שינוי
כל שלושת השכבות הושקו לזמינות כללית ב-9 ביולי 2026 בתעריפים הגבוהים יותר, מה שהציב את התמחור מחדש רק 21 יום לחיים המסחריים של המשפחה. רויטרס ו-CNBC אישרו שתיהן את הקיצוצים, ו-Axios דיווחו שהירידה התלולה ביותר נפלה על דגם לונה.
קיצוצים זורמים בכל שכבת שירות
ההנחות אינן מוגבלות לתמחור כותרות. הם עוברים דרך כל אפשרות בכרטיס התעריף:
- עיבוד אצווה ו-Flex, שניהם חצי מהמחיר הסטנדרטי, מעמידים את לונה ב-10 סנט קלט ו-60 סנט פלט למיליון אסימונים.
- קלט במטמון קורא, בהנחה של 90%, ירידה לשני סנט למיליון אסימונים בלונה ו-20 סנט בטרה.
- בקשות עם הקשר ארוך, מחויבות בשיעור קלט כפול ופי 1.5 מהפלט, נוחתות ב-40 סנט ו-$1.80 עבור לונה.
עבור צוותים שכבר מנתבים סיווג בכמות גדולה, חילוץ או לולאות סוכנים ארוכות דרך השכבות הזולות יותר, אותן שיחות עולות כעת שבריר ממה שעשו יום קודם לכן.
איך הקיצוצים משתווים לאנתרופי
ב-20 סנט פנימה ו-1.20 דולר בחוץ, לונה חותרת כעת את הדגם הזול ביותר שפורסם של Anthropic, Haiku 4.5, בערך פי חמישה בקלט ופי 4 בפלט, לפי עמוד התמחור של Anthropic. התעריף החדש של טרה נמצא מתחת ל-3 ו-15 דולר שקלוד סונט 5 אמור לגבות לאחר שהתמחור ההקדמה שלו יפוג ב-31 באוגוסט 2026.
בחלק העליון של שני ההרכבים, סול עדיין עולה יותר בתפוקה מאשר ה-Opus 5 של Anthropic, שמתומחר ב-$5 ו-$25.
עיבוד עדיפות הופך למצב מהיר
אותו ערך יומן שינויים פרש את "עיבוד עדיפות" והחליף אותו ב"מצב מהיר". עבור דגם הדגל Sol, OpenAI אומר שמצב מהיר פועל עד פי 2.5 מהמהירות הרגילה במחיר כפול, והמתג תואם לאחור - בקשות שכבר מתויגות לנתיב עדיפות למצב מהיר ללא שינוי קוד.
תעריפי מצב מהיר הם $10 ו-$60 לסול, 4$ ו-$24 לטרה, ו-40 סנט ו-$2.40 ללונה. יש לציין כי Anthropic מוכרת את אותו מוצר תחת אותו שם ובאותם תנאים, ושני כרטיסי התעריפים מתכנסים כעת גם בהסקת אזורים: OpenAI גובה העלאה של 10% על דגמים שיצאו ב-5 במרץ 2026 או לאחר מכן כאשר לקוח דורש תושבות נתונים, בעוד שאנתרופיק מחייבת את התעריף הסטנדרטי שלו רק בארה"ב ב-11.
מדוע השכבות הזולות הפכו זולות יותר
יום לפני הקיצוץ, OpenAI פרסמה פוסט הנדסי המתאר אופטימיזציות בכל ערימת ההסקות שלה. חמישה חברים מהצוות הטכני של החברה כתבו שסול, הפועלת בתוך כלי הקידוד שלה Codex, כתבה מחדש את גרעיני ה-GPU של הייצור - עבודה לפי OpenAI הורידה את עלויות ההגשה מקצה לקצה ב-20%. המודל גם עיצב מחדש את מודל טיוטת הפענוח הספקולטיבי שלו על פני מאות ניסויים, שינוי שנחשב להעלאת יעילות יצירת האסימונים ביותר מ-15%.
אלה הנתונים של OpenAI עצמה עבור המחסנית שלה, אבל הם מצביעים על אותו מרכז עלות כתובות הפחתת המחירים: רתמת הסוכן מאחורי Codex ו-ChatGPT. OpenAI מגביל את פלט הכלים ב-10,000 אסימונים כברירת מחדל ושומר על הוספה של היסטוריית מודל גלויה בלבד, כך שלולאת סוכן ששולחת מחדש את ההוראות שלה בכל שלב פוגעת במטמון ההנחיות במקום לשלם תעריפי קלט מלאים. החברה סגרה את הפוסט בהתחייבות להעביר "שיפורים מתחת למכסה המנוע בחזרה למשתמשים שלנו בצורה של מודיעין זמין יותר וחסכוני יותר". כרטיס התעריף הגיע יום לאחר מכן.
שותפים בענן וחיוב
OpenAI ציינה כי קונים המנתבים תעבורה דרך Amazon Bedrock מחויבים על ידי AWS, והתעריפים הללו יכולים להיות שונים מהכרטיס שפורסם. ככל שיותר ארגונים מרכזים את הגישה למודלים באמצעות ספק ענן יחיד, הפער בין התמחור הישיר של OpenAI לבין מה שהלקוחות משלמים בפועל באמצעות מתווכים יהיה חשוב כמו מספרי הכותרות עצמם.
שוק שסופר כל אסימון
הקיצוצים נוחלים כאשר רוכשי ארגונים מבקרים מסקנות מקרוב יותר מאי פעם. מוקדם יותר השבוע, דיווח תיעד כיצד עידן ה"טוקןמקס" חסר המעצורים - דחיפה של נפח ללא צפייה בעלויות - הולך ודועך כאשר חשבונות הבינה המלאכותית הארגונית עולים על פני הפלטפורמות הגדולות. ההחלטה של OpenAI להעביר את החיסכון בהוצאות הפנימיות שלה ללקוחות, במקום לבנק את המרווח, היא איתות ברור היכן היא מאמינה שהקרב התחרותי מתנהל כעת: לא בגבול, שם סול עדיין מחזיקה בתמחור פרימיום, אלא בשכבות הזולות, בנפח גבוה, שבהן רוב תעבורת הייצור נמצאת בפועל.
עם המחיר של סול ללא שינוי, ההחלטה החיה למפתחים נשארת בדיוק היכן ש-OpenAI שמה אותה מאז שהמשפחה נשלחה: איזו רמה דורשת כל בקשה. ההבדל הוא שהעלות של קבלת החלטה שגויה זה עתה ירדה באופן דרמטי.
---
הישאר לפני AIקבל את החדשות, הניתוחים ופריצות הדרך האחרונות של AI - הכל במקום אחד.
קרא עוד חדשות AI →