גוגל הכריזה ביום שלישי על Gemini 4 Argon, דגם החזית החדש ביותר שלה שנבנה לעבודה מקצועית ארוכת טווח בהנדסת תוכנה, משימות ידע ארגוניות והגנת סייבר. כשכתב בבלוג הרשמי של גוגל, Koray Kavukcuoglu, סמנכ"ל Google DeepMind ו-Chief AI Architect, אמר כי המודל יוצא בתחילה לקבוצה של מגיני סייבר מהימנים באמצעות תוכנית Fairwind של גוגל, עם גישה רחבה יותר לעקוב אחרי חיזוק מעקות הבטיחות.
ההכרזה נוחתת במהלך אחת הקטעים העמוסים ביותר של השנה עבור מהדורות AI גבוליות. לסיקור רציף של השקות מודלים, מאבקי מדיניות וסבבי מימון, AI Buzz Wire עוקב אחר ההתפתחויות החשובות בזמן שהן מתרחשות.
השקה מדורגת שעוצבה בזהירות
שלא כמו השקה טיפוסית של דגם גדול, רוב המשתמשים לא יכולים לנסות את ארגון היום. גוגל מסרה כי היא עוסקת בתהליך התנדבותי של ממשלת ארה"ב לגישה לדגמי טרום-שחרור ותרחיב בהדרגה את הזמינות כאשר משוב מבוחנים מוקדמים יעצב את מעקות הבטיחות שלה. רויטרס דיווחה שספינת הדגל מגיעה לאחר חודשים של עיכובים, ו-VentureBeat ציינה כי אסטרטגיית ההפצה המוגבלת עדיין מאפשרת לגוגל לטעון להובלה מחודשת על פני OpenAI ו-Anthropic. בלומברג דיווחה על ספקנות מדידה לגבי המודל החדש בקרב עובדי גוגל עצמה לפני ההשקה.
כשתגיע גישה רחבה יותר, גוגל אמרה שהיא תתחיל עם לקוחות API בתשלום ומנויי Google AI Ultra.
מה שגוגל אומרת שארגון יכול לעשות
שינוי יכולת הכותרת הוא סיבולת. מגבלת אסימון הפלט של ארגון הורחבה למיליון אסימון מוביל בתעשייה, לעומת 64K הקודמים. גוגל טוענת כי מתן מרחב ראש למודל להגיב על פני מאות אלפי אסימונים במסלול אחד מאפשר לו לפתור בעיות קשות במעבר אחד ולא לפצל עבודה בין הפעלות.
גוגל פרסמה תוצאות בנצ'מרק כדי לתמוך בטענת הגבול:
- DeepSWE v1.1: 77.9% - מצב חדש במדד הנדסת תוכנה בעולם האמיתי
- מדד Vals: מס' 1 - ביצועים מובילים בתחומי הפיננסים, הקידוד, המשפטים והמיסוי משוקלל לפי תרומה לתמ"ג בארה"ב
- AutomationBench: 51.3% - מקום ראשון במדד הביצוע העסקי של Zapier מקצה לקצה
- LVBench: 91.7% - עדכנית בהבנת וידאו ארוך
- CWE-bench v1: 68% - במקום הראשון בתיקון פגיעות אבטחה
בתוך זרימות העבודה של גוגל
ארגון כבר מניע את העבודה הפנימית בגוגל, והחברה הציעה דוגמאות קונקרטיות בצורה יוצאת דופן. בתחום המחשוב הקוונטי, המודל אופטימיזציה של משאבי חלל-זמן עבור תתי-שגרות צוואר בקבוק, והביס את קו הבסיס שפורסם ב-40% תוך דקות. בניתוח טלמטריית פרופילים בצי, צוותים של סוכני ארגון זיהו ויישמו אופטימיזציות של זיכרון במרכזי הנתונים של גוגל ששחררו יותר מ-300 TiB ברגע שהושלמו, עם חיסכון כולל של 500 TiB עד 1 PiB.
המודל מניע גם העברות קוד בקנה מידה גדול מ-C/C++ ל-Rust, תוך קנה מידה מעשרות אלפי שורות בספריות ליבה כמו re2 ו-libgav1 עד ליותר מ-800,000 שורות בליבת Fuchsia Zircon. עבור libgav1, מפענח הווידאו הפתוח של גוגל, סוכני ארגון החליפו 32,000 שורות של קוד SIMD ב-Rust בטוח הידידותי למהדר, ויצרו מפענח בטוח בזיכרון שפועל מהר פי 2.7 מיציאת Rust הקודם עם פלט זהה.
הגנת סייבר קודמת לכל
ארגון הוכשר באופן מפורש לעבודת סייבר הגנתית: איתור, אימות ותיקון אוטונומי של פרצות תוכנה קריטיות. למגנים מהימנים ולצוותים הפנימיים של גוגל, החברה תשחרר את הדגם ללא מעקות סייבר כדי שהמגנים יקבלו יכולת מלאה. ב-CWE-bench v1, שמודד תיקון נקודות תורפה, ארגון זוכה למקום הראשון ב-68%, בהתבסס על ביצועי החזית של 3.8 Flash Cyber, וגוגל טוענת ש-Argon השיגה ביצועים טובים יותר במודל זה בגילוי משטח התקפה ויצירת הוכחת קונספט על מדד בדיקות החדירה הפנימי של הקופסה השחורה של Wiz.
חברת האבטחה Wiz כבר משתמשת בארגון באמצעות היוזמה שלה Scan for Good, המגנה בחינם על תשתית ציבורית קריטית. בהדגמה מוקדמת, גוגל טוענת שהמודל חשף פגיעות קריטית שחושפת מידע אישי רגיש על פני תוכנות בריאות המשמשות בתי חולים ברחבי העולם - סיכון שדגמי חזית קודמים החמיצו.
ארבע שכבות של הגנה על גבולות
לפני זמינות רחבה, גוגל מחזקת אמצעי הגנה בארבעה תחומים. נגד שימוש לרעה, ארגון נועד לסרב לבקשות התקפות סייבר ו-CBRN תוך שמירה על מחקר לגיטימי לשימוש כפול, עם טכניקות חדשות המנטרות את ההפעלות הפנימיות של המודל כדי לזהות שימוש לרעה. כנגד הזרקה מיידית, הכשרה יריבות הפכה את ארגון לדגם הגמיש ביותר של גוגל עד כה, המובילה במדד ההזרקה העקיפה של גריי סוואן.
עבור חוסר התאמה, גוגל פורסת אמצעי מניעה המנטרים את שרשרת המחשבות והפעולות של ארגון, עוצרות את הביצוע בעת הצורך, עם התראות המועברות לצוות תגובה ייעודי לאירועים. החברה גם הקשיחה את סביבות ההדרכה וההערכה שלה בארגז חול, ואטמה אותן לפני ריצות בסיכון גבוה. יש לציין שגוגל דחקה בשאר התעשייה לשמור על שקיפות ההיגיון כך שמחשבות המודל יישארו שימושיות לאבחון חוסר התאמה.
תמחור וזמינות
ארגון תושק במחיר היכרות של 2 דולר למיליון אסימוני קלט ו-10 דולר למיליון אסימוני פלט, עם אסימוני קלט במטמון ב-95% הנחה ממחיר הקלט. לאחר תקופת ההיכרות, התמחור עולה ל-4 דולר למיליון אסימוני קלט ו-20 דולר למיליון אסימוני פלט - הממצב את ארגון בצורה אגרסיבית מול הצעות גבול מתחרות.
הופעת הבכורה המבוימת משקפת מציאות חדשה עבור מהדורות גבולות: היכולת היא כעת הימור על השולחן, והמבדיל מפגין שליטה. גוגל מהמרת שמגני סייבר, תוכנות לבתי חולים והגירות של חלודה הם חלון הראווה הנכון - ושהשקה ציבורית איטית יותר עולה פחות מאירוע בטיחות אחר. מפתחים וארגונים צריכים לצפות בחלון הגישה בתשלום של API ו-AI Ultra, שלדברי גוגל ייפתח ברגע שבדיקת מעקה הבטיחות תאפשר.
---
הישאר לפני AIקבל את החדשות, הניתוחים ופריצות הדרך האחרונות של AI - הכל במקום אחד.
קרא עוד חדשות AI →