סוג חדש של מודל AI הופיע לראשונה השבוע, והוא עושה משהו יוצא דופן עבור מודל הבנוי על ארכיטקטורת שנאים: הוא אף פעם לא מייצר מילה של טקסט. Jev, ששוחרר על ידי הסטארט-אפ TypeSafe AI בן השנתיים, מוציא במקום הסתברויות מכוילות - מה שהחברה מכנה החלטות מכוילות - ממצב את עצמו כחלופה זולה ומהירה למודלים של שפות גדולות לעבודות סיווג, ניתוב ואוטומציה, לפי TechCrunch.

החברה הוקמה על ידי Diogo Almeida, חוקר OpenAI שסייע בבניית ChatGPT ותרם להמצאת למידה חיזוקית ממשוב אנושי (RLHF), טכניקת האימון שזוכה לזכותה נרחבת בעיצוב הדור הנוכחי של עוזרי AI. הביקוש לדגם החדש היה חזק מספיק כדי ש-TypeSafe איבדה לזמן קצר את היכולת לשרת חלק ממשתמשי ה-API לאחר ההשקה. For more context on this story, see our ongoing AI industry coverage.

למה שפה נטושה של ChatGPT Pioneer

המסלול של Almeida למודל ללא טקסט התחיל באכזבה ב-OpenAI. "יש לנו ברק בבקבוק, ובכל זאת הוא לא שימושי", אמר אלמיידה ל-TechCrunch, ותיאר את התסכול שלו מכך שלמרות היכולות של ChatGPT, הטכנולוגיה לא עמדה באוטומציה אמיתית. "מאז נאבקתי בבעיה הזו. לקח לי זמן להגיע למסקנה: הבעיה היא שאנחנו עושים אופטימיזציה לשפה אנושית... אנחנו סופר טובים בשפה אנושית כבר ארבע שנים, אבל זה לא שימושי לאוטומציה כי מחשבים מדברים בשפה אחרת".

לפני שנתיים, Almeida עזב את OpenAI כדי לייסד את TypeSafe AI ולהמשיך את התזה הזו. התוצאה היא Jev, מודל מבוסס שנאי שהחברה מתעקשת שהוא לא מודל שפה גדול. כאשר LLM מייצר טקסט פתוח, Jev מחזיר הסתברויות על פני קבוצה של פלטים שהמשתמש מגדיר מראש - עיצוב שלדבריה הופך את ההזיה לבלתי אפשרית מבחינה מבנית, מכיוון שהמודל יכול לענות רק עם האפשרויות שניתנו לו.

רווחי היעילות הם חלק מרכזי במגרש. אסימוני פלט מ-Jev הם בחינם, ואסימוני קלט נמדדים במיליארד ולא במיליון, לפי TechCrunch. החברה מתארת ​​את Jev כ"מודל של System One", המתמקד באינטואיציה ולא בהיגיון, ואומרת שהוא הוכשר אך ורק על נתונים סינתטיים תוך שימוש בטכניקה שמכנה אלמיידה למידה של חיזוק מהחלטות מכוילות.

TypeSafe שמרה על הארכיטקטורה של Jev בסתר, אם כי משקיפים מבחוץ חושדים שהמערכת בנויה על גבי LLM בעל משקל פתוח. "חצי מהחברה שלנו היא מעבדה שמחזיקה בעצם את כל תת התחום הזה של נתונים סינתטיים מובנים סטטיסטית, וזו עכשיו שמחת החיים שלי", אמר אלמיידה ל-TechCrunch.

תוצאות מפתח מוקדמות: מהירות וזול יותר

מאמצים מוקדמים דיווחו על הישגים בולטים בבדיקות. פראנית שארמה, מהנדסת תוכנה ב-Vercel, אמרה ל-TechCrunch שהחברה שלו השתמשה ב-ChatGPT Luna 5.6 של OpenAI כדי להפעיל מסווג שסוקר פקודות ליתר בטיחות. לאחר שהחלפת עומס העבודה הזה ל-Jev, Vercel ראתה תוצאות פי 5 עד 18 מהר יותר ובדיוק רב יותר.

Nikhil Mudholkar, CTO של Bryo AI, ניהל השוואה אחרת: סיווג אימיילים עסקיים עם Jev לעומת Gemini של גוגל. במבחן שלו, תאומים היה מעט יותר מדויק, אך יקר פי 10 עד 20. עבור מודולקר, הרכוש היקר ביותר של ג'ב היה הטיפול בחוסר הוודאות שלו. "זהו היחיד שמחזיר הסתברות אמיתית מה שהופך אותו לאידיאלי עבור אוטומציה של זרימות עבודה", אמר ל-TechCrunch.

סוכנים צופים בסוכנים, ללא החשבון

מעבר להחלפת LLMs במשימות סיווג, TypeSafe טוען ש-Jev יכול לשלוט עליהם. השימוש בסוכני בינה מלאכותית לניטור סוכנים אחרים הופך ליקר במהירות, אך Almeida טוענת שפרופיל המהירות והעלות של Jev הופכים את זה למעשי לעקוב אחר עקבות סוכני LLM ולמנוע פריצות לכלא בזמן אמת.

ארמין רונאצ'ר, CTO של Earendil ובונה של רתמת מודל הקוד הפתוח Pi, אמר ל-TechCrunch שהגישה מעבירה את האחריות לאי הוודאות למפתח. "זה מאציל מעט את בעיית ההזיה למשתמש", אמר רונאצ'ר. "המשתמש צריך לומר, בסדר, אם זה יחזור רק עם הסתברות של 50%, אולי זו הטלת מטבע, ואני מתעלם מזה. אבל אם זה 95%, בטח, אז אני יכול לעשות עם זה משהו."

Ronacher גם סימן את ניתוב המודל כמקרה שימוש מבטיח: חיזוי אם עומס עבודה נתון דורש מודל ספציפי ויקר יותר. ביצוע המיון הזה עם LLM יהיה יקר, אבל זמן האחזור והמחיר הנמוכים של Jev יכולים להפוך את הניתוב בזמן אמת לכדאי.

שם שהושאל מכלכלה

המודל נקרא על שמו של וויליאם סטנלי ג'בונס, הכלכלן מהמאה ה-19 מאחורי פרדוקס ג'בונס - ההבחנה שככל שסחורה הופכת זולה יותר, הצריכה שלו נוטה לעלות. ההימור של Almeida הוא שירידת העלויות של מודיעין בדרגת החלטה תוביל לפריסתו בכל מקום, לא רק בצ'אטבוטים מובילים.

"אנחנו חושבים שפשוט תהיינה תוכנות חכמות בכל מקום בצורה שתופיע ומופצת... הרבה יותר כמו האינטרנט המוקדם ממה שאתה מכיר כמו מגה אפליקציות שאנשים מנסים לבנות עכשיו", אמר אלמיידה ל-TechCrunch.

האם המתחרים עוקבים נותרה שאלה פתוחה. "היינו צריכים לראות את זה מוקדם יותר במובנים רבים, אבל ככל הנראה בגלל שה-LLMs כל כך זולים ומסובסדים, אתה לעתים קרובות לא צריך להיות יצירתי עדיין", אמר רונאצ'ר ל-TechCrunch. TypeSafe מתכננת גרסאות נוספות של Jev באופנים חדשים.

באשר לשאלה האם TypeSafe נחשבת כמעבדת גבול, אלמיידה הציע תשובה נוקבת: "התוצר העיקרי של מעבדות גבול הוא פחד או הייפ. הייתי רוצה שהמוצר העיקרי שלנו יהיה מודיעין... [אבל אנחנו] לא מעבדה במובן של, אתה יודע, כמו הימור על עושר אינסופי, או דת, או בניית אלוהים במרכז נתונים, או מה שזה לא יהיה הדבר של היום".

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →