סטנדרט חדש למשמעות "פתוח" בבינה מלאכותית נקבע ביום חמישי. המכון למודלים של יסוד (IFM), מכון בינה מלאכותית מבוסס אבו דאבי, הוציא את K2 Horizon, צי מחובר של שישה דגמי שפות שמגיעים עם כל דבר, החל ממשקולות סופיות ועד לנתוני אימון, נקודות ביניים, קוד אימון ויומנים עדינים - חבילה שרויטרס תיארה כמודלים בקוד פתוח לחלוטין ששוחררו עם נתוני האימון והקוד שלהם.
רוב השחרורים במשקל פתוח עדיין נעצרים במשקולות, ומשאירים מבחוץ לנחש כיצד הדגמים באמת נבנו. K2 Horizon נוקט בגישה ההפוכה, והגעתו היא רגע משמעותי עבור כל מי שעוקב אחר דגמי AI בעלי משקל פתוח ברחבי התעשייה.
שישה דגמים, משעון ועד לארגון
הצי משתרע על פני שישה גדלים: 375B-A23B, 36B-A4B, 32B, 7B, 3.7B ו-0.9B. על פי הודעת IFM, הדגמים מתוכננים כמערכת אחת מחוברת ולא שש מהדורות לא קשורות.
הדגם הקטן ביותר מכוון לסביבות מוגבלות מאוד כמו שעונים ומשקפיים, בעוד שדגמי 3.7B ו-7B ממוקמים עבור טלפונים ויישומים אחרים במכשיר. דגם ה-32B הצפוף ודגם ה-36B-A4B הדליל מכוונים לתחנות עבודה מקומיות ולשירות יעיל, וספינת הדגל 375B-A23B נושאת את היכולות החזקות ביותר של הצי לפריסות ארגוניות תובעניות. כל ששת הדגמים נשלחים עם תמיכת קוונטיזציה.
המודלים חולקים ארכיטקטורת ליבה, אוצר מילים, מתודולוגיית הדרכה, ממשקים, תשתית הערכה וכלי פריסה, כאשר מודל 0.9B משתמש באוצר מילים קטן יותר. IFM אומר שהעקביות מקלה על מעבר בין גדלים, ניתוב עבודה דינמית על פני הצי, וללמוד כיצד היכולות מתרחבות.
מה ש"פתוח לגמרי" מכסה בעצם
זה המקום שבו K2 Horizon יוצא מהנורמה בתעשייה. עבור כל דגם בצי, IFM טוענת שהיא פותחת את מחזור החיים של האימון מהאימון המקדים דרך החשיבה ואחרי אימון סוכן.
המהדורה כוללת נקודות ביניים, נתוני אימון או מתכונים מפורטים לבניית נתונים, תיעוד ארכיטקטורה פתוחה, הרכבי תערובת, קוד אימון, תצורות, יומני אימונים עדינים, תוצאות הערכה ומשקולות סופיות. הדגמים והקוד משוחררים תחת רישיון Apache 2.0, אחד המתירנים ביותר בשימוש מסחרי. מערכי נתונים משוחררים תחת הרישיונות הרלוונטיים שלהם, כגון ODC-BY, ו-IFM מתחייבת לחשוף כיצד הנתונים נבנו וערבבו במקרים בהם הפצה מחדש אינה אפשרית.
IFM גם מסגרת את המהדורה כמשפחת המודלים הפתוחים הראשונה שחושפת את תהליך הפיתוח המלא באמצעות פוסט-אימון סוכן. בפועל, זה אומר שחוקרים יכולים ללמוד כיצד חשיבה, שימוש בכלים, תכנון והתנהגויות סוכניות מופיעות במהלך האימון, לשחזר את השיטות ולהתאים אותן לכלים ולתחומים חדשים - עבודה שבדרך כלל בלתי אפשרית כאשר רק משקלים סופיים מתפרסמים.
הביצועים טוען
IFM טוענת כי הדגמים הקטנים יותר של הצי הציבו תוצאות חדשות מתקדמות בקנה מידה שלהם. לפי הדיווחים, המודלים 0.9B, 3.7B ו-7B מובילים את כיתות הגודל שלהם על פני מתמטיקה, חשיבה, יכולת כללית, קידוד ומשימות אגנטיות.
כמה פרטים מההכרזה: K2 Horizon 0.9B מקבל ציונים מעל 48 ב-AIME 2026, אמת מידה למתמטיקה של תחרות שנשאר אכזרי עבור דגמים קטנים כל כך. דגמי 3.7B ו-7B מודגשים עבור תוצאות חזקות של ספסל SWE ו-BrowseComp, ומצביעים על יכולת הנדסת תוכנה וגלישה מרובת שלבים, יוצאת דופן בגודלם. מודל 36B-A4B מציג מנגנון חדש של תערובת של ערך-תשומת לב (MoVA), אשר IFM זוכה בזכות יכולת העולה על מה שמציעה ספירת הפרמטרים הפעילים שלו. דגמי 32B ו-375B-A23B מתוארים כמדורגים בין הדגמים המובילים במעמדם.
כמו בכל הערכה שפורסמה במעבדה, הנתונים הללו מדווחים על עצמם ואימות עצמאי ייקח זמן. אבל אם המספרים יחזיקו מעמד, השכבות הבסיסיות והבינוניות של הצי עלולות לעצב מחדש את מה שמפתחים מצפים מדגמים הפועלים על חומרה לצרכן.
מדוע אבו דאבי ממשיכה להופיע ב-AI פתוח
המהדורה מחזקת את טביעת הרגל ההולכת וגוברת של איחוד האמירויות הערביות בפיתוח מודלים פתוחים. מערכת ה-AI של אבו דאבי - מעוגנת על ידי מוסדות כולל MBZUAI, שהשיקה את מערכת החשיבה K2 Think עם G42 בשנת 2025 - מיקמה בעקביות את הפרסום הפתוח כמבדיל אסטרטגי, דפוס שרויטרס לכדה בסיקור הפרסום שלה ביום חמישי.
העיתוי נוחת גם בשוק מתחלף עבור דגמים פתוחים. ההסכמה של Nvidia לרכישת Hugging Face תמורת כ-12.9 מיליארד דולר, שהוכרזה השבוע, הדגישה עד כמה ערך מסחרי צבר סביב פלטפורמות הפצה של מודלים פתוחים. מכשירי Hyperscaler הצטרפו בינתיים לרישיון דגמים בעלי משקל פתוח ממעבדות סיניות, וחברות בינה מלאכותית מערביות פרסמו מכתב המזהיר מפני הגבלות מוקדמות על משקלים פתוחים.
על רקע זה, צי צמוד לגבול שמפרסם את כל צינור ההכשרה שלו נותן לחוקרים, סטארט-אפים וממשלות אלטרנטיבה להתלות בממשקי API סגורים של קומץ ספקים בארה"ב.
במה לצפות בהמשך
שלוש שאלות יקבעו אם K2 Horizon משנה מעבר לכותרות. ראשית, האם ניתן לשחזר את תוצאות המדד על ידי מעריכים בלתי תלויים, במיוחד עבור המודלים הזעירים שבהם הטענות הבולטות ביותר? שנית, עד כמה רישיונות מערך הנתונים מתירנים בפועל, בהתחשב בכך ש-IFM מכירה בכך שחלק מהנתוני הכשרה אינם ניתנים להפצה מחדש ומתועדים לפי מתכון במקום זאת? שלישית, האם ארגונים אכן יפרסו מודל דל של 375B מחוץ לענן גדול, או האם ההשפעה המעשית תתרכז בשכבת 7B ומטה שפועלת בטלפונים ומחשבים ניידים?
ההשפעה המיידית ככל הנראה היא על שקיפות המחקר. עם מחסומים, יומנים ומתכוני נתונים ציבוריים, K2 Horizon נותן לשטח דוגמה מלאה לאופן שבו נבנית משפחת דגמים מודרנית של חשיבה וסוכנים - משהו שמעולם לא היה לקהילה בקנה מידה כזה.
הישאר לפני כל פיתוח AI מרכזי
שחרור הדגמים מגיע מהר יותר מדי חודש. התעדכן בכל השקה וכל מדד לפני שזה משנה.
---
הישאר לפני AIקבל את החדשות, הניתוחים ופריצות הדרך האחרונות של AI - הכל במקום אחד.
קרא עוד חדשות AI →