Google DeepMind הפכה את השימוש במחשב לכלי מובנה בתוך Gemini 3.5 Flash, מה שנותן למפתחים דרך מקורית לבנות סוכני בינה מלאכותית שיכולים לקיים אינטראקציה עם תוכנות על פני פלטפורמות מבלי להתברג במסגרות של צד שלישי.
ההכרזה, שפורסמה ב-24 ביוני 2026 בבלוג מילות המפתח הרשמי של גוגל, ממצבת את Gemini 3.5 Flash כמתחרה בשוק הנע במהירות עבור סוכנים שיכולים לראות מסך, להזיז סמן, ללחוץ ולהקליד - יכולות שעד לאחרונה דרשו הנדסה מותאמת אישית משמעותית. For more context on this story, see our ongoing AI trends.
"שימוש במחשב הוא כעת כלי מובנה ב-Gemini 3.5 Flash לבניית סוכנים שיכולים לקיים אינטראקציה בין פלטפורמות", כתבה החברה. הפוסט נכתב על ידי Mateo Quiros, מנהל מוצר ב-Google DeepMind.
איך זה עובד
שימוש במחשב מאפשר למודל להפעיל מחשב בדומה לאדם: על ידי פירוש מה שמופיע על המסך וביצוע פעולות כמו לחיצה, גלילה והזנת טקסט. על ידי אפיית היכולת ישירות לתוך Gemini 3.5 Flash במקום להציע אותה כמוצר נפרד, גוגל מורידה את המחסום עבור מפתחים שרוצים לבנות סוכנים שמנווטים ביישומים, אתרים ומערכות הפעלה אמיתיות.
לפי הפוסט בבלוג, מפתחים וארגונים יכולים להתחיל להשתמש במחשב ב-3.5 Flash דרך ה-API של Gemini ופלטפורמת ה-Gemini Enterprise Agent Platform, הסביבה הייעודית של גוגל לבנייה ופריסה של סוכנים בקנה מידה.
גוגל הדגימה את היכולת עם מקרי שימוש קונקרטיים. בדוגמה אחת, Gemini 3.5 Flash השתמש בשימוש במחשב כדי לנתח את אפליקציית Gemini עצמה ולהחזיר רשימה מסווגת של תכונות. באחר, המודל בדק את התיעוד שלו לבעיות נגישות - משימה בהתייחסות עצמית שרומזת כיצד סוכנים המשתמשים במחשב עשויים יום אחד לעזור לתחזק את המערכות האקולוגיות של התוכנה שעליהן הם פועלים.
בטיחות: אימון יריב וגישת 'הגנה לעומק'
החלק המשמעותי ביותר של המהדורה עשוי להיות מה שגוגל אמרה על בטיחות. סוכנים הפועלים בסביבות חיות פגיעות באופן ייחודי להזרקה מיידית - התקפות שבהן הוראות נסתרות המוטמעות בדף אינטרנט, בדוא"ל או במסמך חוטפות את הסוכן לבצע פעולות לא מכוונות.
גוגל אמרה שהיא השתמשה באימון יריב ממוקד לשימוש במחשב ב-Gemini 3.5 Flash כדי להפחית את הסיכונים הללו. היא גם משחררת שתי מערכות הגנה ארגוניות אופציונליות שלדבריה מאפשרות לארגונים לשלוט טוב יותר במה שהסוכנים שלהם יכולים לעשות.
בגישה של "הגנה לעומק", עודדה גוגל מפתחים לשלב את התכונות הללו עם ארגז חול מאובטח, אימות אנושי בלולאה ובקרות גישה קפדניות. החברה פרסמה הנחיות נוספות בתיעוד השיטות המומלצות שלה עבור התכונה.
המסגור הזה חשוב. השימוש במחשב נתפס כאחת מיכולות הסוכן המסוכנות יותר לפריסה, מכיוון שסוכן שנפגע יכול לבצע פעולות בעולם האמיתי בתוך החשבונות והמערכות של המשתמש. על ידי הובלת אימון יריב ואמצעי הגנה רבדים, גוגל מנסה להרגיע קונים ארגוניים שהיססו להעביר את השליטה בסמן ל-AI.
מדוע השימוש במחשב הופך לשדה קרב
השימוש במחשב של Gemini 3.5 פלאש מגיע כאשר מעבדות הבינה המלאכותיות הגדולות מרוץ ליצור סוכנים שיכולים לעשות עבודה מועילה במקום רק לענות על שאלות. Anthropic הציגה כלי שימוש במחשב עבור קלוד בסוף 2024, ומוצרי המפעיל והסוכן של OpenAI דחפו לאותו כיוון. הפיכת היכולת לדגם מהיר וחסכוני כמו פלאש - במקום לשריין אותו לשכבת פרימיום - מאותתת שגוגל רוצה להמציא את שליטת הסוכנים במהירות.
הבחירה בפלאש בולטת בפני עצמה. פלאש הוא מודל שכבת היעילות של גוגל, מותאם למהירות ולעלות. הטמעת השימוש במחשב שם, ולא רק במודל ה-Pro הגדול יותר, מעידה על כך שגוגל מצפה לעומסי עבודה של סוכנים רגישים בנפחים גבוהים - מהסוג שממכן משימות שחוזרות על עצמן בכל תוכנות עסקיות בקנה מידה גדול.
גוגל אמרה שהיא כבר רואה את הלקוחות מביאים ערך באמצעות שימוש במחשב, אם כי הפוסט בבלוג לא ציין פריסות מסחריות ספציפיות או כימת את התוצאות.
ההימור התחרותי
עבור מפתחים, הערעור של כלי מובנה לשימוש במחשב הוא פשוט: פחות אינטגרציות לתחזוקה וספק יחיד אחראי הן על המודל והן על השכבה הסוכנת. אבל זה גם מעמיק את התלות בפלטפורמה של גוגל, פשרה שארגונים ישקלו מול הגמישות של מסגרות סוכנים אגנוסטיות.
השחרור גם מחדד מתח רחב יותר בכלכלת הסוכנים. שערי סוכנים שפותחו באופן עצמאי, כמו מסגרת Lightport שהופכת ספקי LLM מרובים לתואמים OpenAI, מראים כמה ביקוש קיים לתשתית סוכנים ניידים. ההימור של גוגל הוא שכלי צד ראשון מוגן בטיחות לשימוש במחשב ינצח מפתחים שאחרת היו מחברים כלים של צד שלישי. ככל שדגמים זוכים ליכולת לפעול על מסכים, הגבול בין עוזר בינה מלאכותית למפעיל אוטונומי ממשיך לטשטש - וכך גם הגבול בין פריצת דרך בפרודוקטיביות לחבות אבטחה. התשובה של גוגל למתח הזה היא אמצעי הגנה מרובדים והכשרה יריבות. אם זה מספיק כדי לספק ארגונים שונאי סיכונים יקבע באיזו מהירות יעברו סוכנים המשתמשים במחשב מהדגמות לשימוש יומיומי.
עם Gemini 3.5 Flash, גוגל עשתה הימור ברור: העתיד של AI הוא לא רק מודלים שעונים, אלא מודלים שפועלים - והיא רוצה שמפתחים יבנו את המודלים הפועלים האלה על הפלטפורמה שלה.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →


