ה-Gemini 3.5 Pro המתעכב של גוגל צץ שוב ושוב בתוך מאגר הבדיקות העיוורות של LMSYS Chatbot Arena, ושלח איתות ברור לקהילת המפתחים שפרסום פומבי של מודל הדגל עשוי להיות סוף סוף קרוב. בעוד שהקו הרשמי של החברה נותר שהמודל "נמצא כרגע בבדיקות שותפים", שורה של תצפיות בקהילה, חריגות בקצה האחורי ותגובות חזקות בצורה יוצאת דופן, כולם מצביעים על בדיקות A/B בשלב מאוחר לפני השקה רחבה יותר.
התצפיות חשובות מכיוון שהופעות בצ'טבוט ארנה הן לעתים רחוקות מקריות. כאשר דגמים בלתי מוצהרים מופיעים בקרבות ההעדפות העיוורות של הפלטפורמה, זה בדרך כלל משמש כשלב בדיקת לחץ אחרון לקראת השקת API ציבורית והשקת אינטרנט. למידע נוסף על האופן שבו מחזורי השחרור הללו מעצבים את השוק, עקוב אחר [סיקור מודל AI] שלנו (https://aibuzzwire.news).
מה שמפתחים רואים
על פי תצפיות קהילתיות שדווחו על ידי NokiaPowerUser ב-2 באוגוסט 2026, בודקים ברחבי X ו-Discord תיארו נתקלים במודל מהיר ומוכשר ביותר המזהה את עצמו כיצירת DeepMind תחת המזהה gemini-3.5-pro. הופיעו מספר דפוסים:
- הופעות חוזרות של בדיקות עיוורות: הדגם ממשיך להופיע בהשוואות האנונימיות הראש בראש של Chatbot Arena, סוג החשיפה שגוגל שומרת בדרך כלל לדגמים שהיא עומדת לשלוח.
- אותות בדיקת A/B פעילים: עדכוני ממשק ועדכונים עורפיים זוהו בכל פלטפורמות מפתחים, דפוס תואם את שלבי הפריסה שלפני ההשקה.
- חריגות "Flash": משתמשים מרובים תיעדו תגובות חריגות מדגמי Flash סטנדרטיים שהציגו נימוקים עמוקים בצורה יוצאת דופן, מה שמציע ניתוב צל למודל שלא פורסם, ברמה גבוהה יותר במהלך הערכה חיה.
Google DeepMind טוענת כי אימות השותפים עדיין נמשך. אבל כפי ש-NokiaPowerUser ציין, ההיסטוריה מראה שהשלב הזה עובר במהירות לזמינות כללית ברגע שמתחיל בימוי ארנה.
דגם שכבר איחר
התצפיות בארנה מגיעות לאחר חודשים של תסכול עבור ענקית החיפוש. בכנס המפתחים שלה ב-Google I/O במאי 2026, גוגל השיקה דגם קל משקל Gemini 3.5 Flash לשימוש יומיומי, והמנכ"ל סונדאר פיצ'אי אמר בתדרוך מדיה לפני הכנס שגרסת ה-Pro תגיע ביוני. "אנחנו גם נרגשים לקראת 3.5 Pro", אמר פיצ'אי, לפי Mashable. "אנחנו משתמשים בו באופן פנימי. זה מראה שיפורים גדולים".
יוני בא והלך ללא שחרור. עד אמצע יולי דיווח בלומברג כי העיכוב גרם לתסכול בקרב מהנדסי גוגל, חוקרי בינה מלאכותית ומנהלים המודאגים מכך שהחברה מסתכנת לאבד את היתרון שלה למתחרות Anthropic ו-OpenAI. Mashable, שאישרה את הדיווח של בלומברג ב-17 ביולי, ציינה שגוגל סיפקה רק הצהרה מעורפלת לגבי "משלוח מהיר במגוון רחב של דגמים".
עבור גוגל, ההימור משתרע מעבר לזכויות התרברבות. הדלפות מוקדמות יותר הציעו מאבקים של Gemini 3.5 Pro בתחומים מרכזיים כמו חשיבה מתקדמת, קידוד וביצוע משימות לטווח ארוך, והציבו אותו מאחורי מתחרים כמו Fable 5 של Anthropic ו-GPT-5.6 של OpenAI בכמה מדדים.
מדוע פער הקידוד חשוב
העיתוי של כל השקה הוא קריטי. בעוד שחרורים אחרונים כמו Gemini 3.6 Flash סיפקו יעילות אסימון מוצק והשהייה נמוכה יותר, משוב למפתחים מצביע על כך שדגמים קלים עדיין נופלים במהלך משימות הנדסת תוכנה מורכבות עם אופק ארוך. מפתחים מחפשים ספינת דגל המסוגלת לשחזר בדרגה ארגונית, ניפוי באגים אוטונומי וביצוע היגיון מורכב מבלי ליפול ללולאות הזיה.
בהתבסס על אינטראקציות קהילתיות מוקדמות ודפוסי השחרור האחרונים של גוגל, תחומי ההתמקדות הצפויים עבור Gemini 3.5 Pro כוללים קידוד סוכן מתקדם, אינטגרציה עמוקה יותר של כלים והנמקה ברמת הגבול - בדיוק היכולות שבהן דגמים קלים לא הכריעו.
הלחץ התחרותי גובר
גוגל לא פועלת בחלל ריק. שוק הדגמים הרחב יותר נסחף על ידי תחרות מחירים אגרסיבית וגל של מהדורות עם משקל פתוח מסוגל, במיוחד ממפתחים סיניים. Kimi K3 של DeepSeek ו-Moonshot AI הורידו את העלויות וצמצמו את פער הביצועים, בעוד ש-Anthropic ו-OpenAI ממשיכות לפעול במהירות על הצעות הגבול שלהן.
בסביבה זו, עיכוב ממושך מסתכן יותר מאשר מבוכה. כל שבוע ללא ספינת דגל תחרותית הוא שבוע שמפתחים וארגונים שוקלים חלופות - וחלק מהחלופות הללו הן כעת זולות יותר ובמשימות ספציפיות, מהירות יותר. התצפיות בזירה מרמזות שגוגל יודעת שהשעון מתקתק.
אם Gemini 3.5 Pro סוגר את פער הקידוד ומשתיק את החששות לגבי יכולות ההגיון שלו יתברר רק ברגע שהוא יעבור מבדיקה עיוורת לידיים של מפתחים. אבל אחרי קיץ של מועדים שהוחמצו, הופעת הדגם במאגר הבדיקות של LMSYS היא האות החזק ביותר עד כה שהשקה קרובה.
הישאר לפני AI
המירוץ לשלוח את דגם החזית הבא לעולם לא מאט. AI Buzz Wire עוקב אחר כל מהדורה, דליפה ומדידה בזמן שהם מתרחשים.
חקור את הפיתוחים האחרונים של AI →