בזמן שהבינה המלאכותית עוברת מצ'טבוטים עם סיבוב בודד לסוכנים אוטונומיים הפועלים ברציפות, NVIDIA מרחיבה את מערך הדגמים הפתוחים שלה כדי לעמוד ברגע. ב-11 באוגוסט, 2026, חשפה החברה את Nemotron 3.5 Lightning, דגם של 30 מיליארד פרמטרים של תערובת של מומחים שהיא מכנה המודל היעיל ביותר במחלקתו לעומסי עבודה פעילים בינה מלאכותית ארוכת טווח. המהדורה, המפורטת בבלוג NVIDIA מאת Kari Briski, מגיעה לצד NeMo Switchyard, ספריית ניתוב בקוד פתוח שנועדה לכוון כל משימה לדגם המסוגל והחסכוני ביותר באופן אוטומטי. לקבלת [סיקור תעשיית הבינה המלאכותית] (https://aibuzzwire.news) העדכנית ביותר, עקבו אחרי ערימת הבינה המלאכותית הסוכנת מתגבשת.
דגם שנבנה עבור סוכנים תמיד
מערכות אגנטיות מודרניות פועלות יותר ויותר כמו מה ש-NVIDIA מתארת כ"מערכות של מודלים" או הרכבי מודל. מודל חשיבה גבולית כגון Nemotron 3 Ultra או GPT-5.6 עשוי לתכנן ולתזמן זרימת עבודה, בעוד שדגמים מיוחדים קטנים יותר מטפלים במשימות ממוקדות כמו סקירת קוד, שימוש בכלים, ניטור התראות אבטחה או מענה לשאלות חיוב. Nemotron 3.5 Lightning נבנה ייעודי עבור אותו נדבך שני: משימות מיוחדות בנפח גבוה המניעות סוכנים שפועלים תמיד.
לפי NVIDIA, הדגם מספק עד מהירות פלט מהירה פי 4, מה שמוביל לביצוע משימה אנטימית מהירה ב-30% בערך** בהשוואה לדגמים אחרים בכיתה שלו. לפי הדיווחים, מדדי PinchBench של NVIDIA מדגימים כי Nemotron 3.5 Lightning שומר על דיוק ברמת הגבול תוך השלמת משימות מהר יותר מאשר עמיתיו. המודל פותח עם תרומות מקואליציית נמוטרון, שחבריה סיפקו מתודולוגיות הערכה, תוכנות להסקת מסקנות ומערכי נתונים כדי לסייע בקידום המודל.
מכיוון שהוא פתוח וניתן להתאמה אישית, ארגונים יכולים לאחר אימון Nemotron 3.5 Lightning עם NVIDIA NeMo על נתוני התחום, הכלים וזרימות העבודה שלהם כדי לשפר את הדיוק עבור משימות מיוחדות. NVIDIA משחררת גם את Nemotron-RL-Agentic-Terminal-Pivot, מערך למידה של חיזוק סוכן המשמש לאחר אימון המודל ליכולות קידוד של סוכנים.
ריצה בכל מקום, מקצה ועד ענן
אחת מנקודות המכירה המרכזיות של Nemotron 3.5 Lightning היא גמישות הפריסה. המודל יכול לרוץ על מערכות בינה מלאכותית מקומיות - כולל מחשבי NVIDIA RTX, NVIDIA DGX Spark, NVIDIA DGX Station ו-NVIDIA Jetson - מה שמאפשר לארגונים למקסם את ההשקעות הקיימות בתשתית. זה יכול גם להתרחב בין התקני AI קצה, תחנות עבודה של NVIDIA RTX PRO, מרכזי נתונים וסביבות ענן עבור מקרי שימוש ארגוניים. הגמישות הזו חשובה לארגונים המטפלים בנתונים רגישים שחייבים להישאר במקום.
כמו בכל השקה של Nemotron, NVIDIA אומרת שהיא מפרסמת חלק גדול מנתוני ההדרכה והטכניקות כמו היתרי רישוי, מה שמאפשר מעקב, ביקורת והדרכה של דגמים אחרים. המחויבות הזו לשקיפות הפכה למבדיל תחרותי כאשר ארגונים שוקלים מודלים פתוחים מול חלופות קנייניות שמציעות פחות נראות לגבי האופן שבו הם נבנו.
NeMo Switchyard: ניתוב חכם עבור מערכות של דגמים
אם Nemotron 3.5 Lightning הוא סוס העבודה, NeMo Switchyard הוא השולח. מסלולי ספריית הקוד הפתוח פונים למודל המסוגל והיעיל ביותר עבור כל שלב של זרימת עבודה של סוכן באופן אוטומטי, בהתבסס על צרכים ספציפיים. חלק מהדגמים טובים יותר לקידוד, חלקם להנמקה, חלקם למשימות קלות משקל, וחלקם מותאמים להפעלה מקומית לצורך פרטיות ויעילות רבה יותר. הסתמכות על מודל ברירת מחדל בודד עשויה להיות הוצאת יתר או הקרבה של איכות; ניהול ניתוב ידני, בינתיים, הופך לעבודת אינטגרציה שיכולה להאט את הפריסה.
מפתחי יישומי סוכן יכולים לכוונן או לשנות את הנתב באמצעות אלגוריתמי ניתוב שונים כדי להתאים את העדיפויות שלהם, כגון דרישות איכות, חביון ועלות. המדדים הפנימיים של NVIDIA מראים ש-NeMo Switchyard שומרת על דיוק ברמת הגבול תוך הפחתת עלויות השלמת המשימות ל-כמעט שליש מ-Opus 4.8 בלבד - רווח בולט ליעילות עבור ארגונים המפעילים מספר רב של משימות סוכן.
החברה הדגישה שורה של שילובי שותפים. בומי דיווחה על דיוק של 100% ניתוב דומיינים ושלחה 59% מהתנועה לדגם מהיר יותר פי 5. Cadence שיפרה את היעילות ב-9.9% במקרה של שימוש באימות רשמי. Cognition שילבה את Switchyard ב-Devin Desktop, והשיגה ביצועים קרובים לגבול ב-FrontierCode Main תוך קיצוץ עלויות ממוצעות ב-28%. LangChain דיווחה על עלות נמוכה יותר ב-74% על פני 145 משימות Deep Agents מרובי פניות, על ידי ניתוב רק 7% מהשיחות למודל חזיתי. LiteLLM מוסיפה את NeMo Switchyard כפלאגין לשכבת ה-proxy שלה, וקונג מספקת כעת ניתוב מקורי דרך Kong AI Gateway. יש לציין כי Nous Research שילבה את NeMo Switchyard ב-Hermes כדי לתת למפתחים מערכת ניתוב קלה להגדרה ליעילות סוכנים.
אימוץ בתעשייה והתמונה הגדולה יותר
מובילי בינה מלאכותית בכל תעשיות כבר מתאימים את Nemotron 3.5 Lightning עבור עומסי העבודה שלהם. CrowdStrike מיישם אותו על אבטחת סייבר, הארווי משתמש בו לשירותים משפטיים, ו- CodeRabbit פורס אותו לבדיקת קוד. Lila Sciences עוזרת לשפר את יכולות החשיבה עבור משימות סוכניות על פני מדעי הפיזיקה והחיים, בעוד Fastino Labs התאימה את המודל ודיווחה על דיוקים מובילים לפיתוח תוכנה, פיננסים ועומסי עבודה בתחום הבריאות.
המהדורה מדגישה מגמה רחבה יותר בתעשייה: עם התבגרות בינה מלאכותית, אף דגם בודד לא יכול לעשות הכל טוב במחיר מקובל. העתיד שייך להרכבים - מתכנני חזית המתאמים ציים של עובדים מיוחדים - והכלים שקושרים אותם יחד. ההימור של NVIDIA הוא שמודלים פתוחים וניתוב אינטליגנטי יאפשרו לארגונים להרכיב את המערכות הללו מבלי להינעל בערימה של ספק אחד.
הישאר לפני AI
Nemotron 3.5 Lightning ו- NeMo Switchyard של NVIDIA מאותתים לאן בינה מלאכותית מובילה: מהיר יותר, זול יותר, שקוף יותר וניתן לפריסה בכל מקום. כדי להתעדכן במהדורות המודל והכלים הארגוניים המעצבים מחדש את הנוף, חקור את [חדשות הבינה המלאכותית] שלנו (https://aibuzzwire.news).
קרא עוד חדשות AI →