הערכה ראשונית משותפת של מכוני בטיחות בינה מלאכותית של ממשלת ארה"ב ובריטניה הגיעה למסקנה שדגם ה-Kimi K3 במשקל פתוח של Moonshot AI עוקב אחר דגמי הגבול בארה"ב בפער רחב במשימות סייבר התקפיות. הממצא, שפורסם ב-25 ביולי 2026, מוסיף נקודת נתונים קונקרטית לוויכוח מתגבר על האופן שבו יש להתייחס למערכות בינה מלאכותית שפותחו בסין כשהן זוכות לאימוץ בתוך ארצות הברית.

ההערכה פורסמה על ידי מכון בטיחות AI האמריקאי השוכן ב-NIST, המכונה CAISI, יחד עם AISI של בריטניה. הוא מייצג את אחת ההערכות המערביות הרשמיות הראשונות של Kimi K3 המתמקדות במיוחד בתחום הסייבר. לקוראים שעוקבים אחר הנוף המהיר של חדשות בינה מלאכותית, התוצאה בולטת פחות עבור כל ציון בנצ'מרק בודד מאשר עבור מה שהוא מאותת על התפקיד המתרחב שמעבדות ממשלתיות ממלאות כעת בבדיקת מודלים זרים לפני שהם נפרסים באופן נרחב.

מה נמדדה ההערכה

Kimi K3, ששוחרר על ידי Moonshot AI מבוסס בייג'ינג, הוא דגם גדול במשקל פתוח שמשך במהירות תשומת לב עולמית לביצועים חזקים לשימוש כללי לאחר השקתו. ההפצה הפתוחה שלו פירושה שחוקרים ומפתחים יכלו להוריד ולבדוק את המשקולות ישירות, מה שבתורו הפך אותו למועמד טבעי לבדיקות בטיחות חיצוניות.

הדו"ח הראשוני החדש מתרכז בשאלה צרה ורגישה יותר: עד כמה מסוגל המודל בפעולות סייבר התקפיות, מסוג המשימות החשובות ביותר לסוכנויות הביטחון הלאומי? במקום להעריך את Kimi K3 על בסיס ידע רחב או היגיון, המכונים בדקו האם הוא יכול לסייע בביצוע התקפות סייבר, לנצל פרצות תוכנה או לסייע בדרך אחרת בפעולות מחשב זדוניות.

המספרים: בערך 32% לעומת 76%

תוצאת הכותרת היא פער חד. בהערכת יכולת הסייבר, Kimi K3 השיגה ציון של כ-32%, בעוד שהדגמים המובילים בארה"ב הגיעו לכ-76%, על פי הדיווח על ההערכה. בתרגום למילים פשוטות, המכונים בארה"ב מצאו שהמודל הסיני יכול להשלים רק כשליש ממשימות הסייבר ההתקפיות בהן טיפלו דוגמניות מערביות מובילות.

שקעים מרובים המכסים את השחרור מסגרו את הפער בעקביות. ה-South China Morning Post דיווח ש-Kimi K3 יושבת "הרבה מאחורי יריבות ארה"ב ביכולת התקפות סייבר", בעוד ש"הנדסה מעניינת* הדגישה את הפריסה של 76% לעומת 32% על מדדי סייבר. ההערכה מתוארת כראשונית, כלומר המכונים מאותתים כי צפויות בדיקות נוספות לפני הסקת מסקנות סופיות.

מדוע ייתכן שהפער קיים

מודל שמציג ביצועים חזקים על אמות מידה כלליות אך חלש על עבירות סייבר מציג חידה מעניינת, ואנליסטים כבר החלו לשקול. בכתבו ב-The Decoder, פרשנים ציינו כי זיקוק עשוי להסביר חלק מהפער.

זיקוק היא טכניקת אימון שבה מודל לומד על ידי חיקוי התפוקות של מודל "מורה" מסוגל יותר במקום לבנות כל יכולת מאפס. אם Kimi K3 פותח בחלקו באמצעות זיקוק, טוענים אנליסטים, הוא יכול לרשת תקרה על היכולות שלו שנקבע על ידי כל מודל שימש כמורה שלו, מה שעלול להגביל את הביצועים במשימות הקשות ביותר כמו פעולות סייבר התקפיות מתוחכמות.

ההשערה הזו נשארת בדיוק זו, השערה. הדו"ח המקדמי אינו קובע מדוע קיים הפער, רק שהוא קיים. גורמים אפשריים נוספים כוללים הגבלות יכולת מכוונות, הבדלים בנתוני אימון או פשרות שנעשו כדי לשמור על המודל יעיל מספיק כדי לרוץ על חומרה זמינה נרחבת.

רקע פוליטי טעון

ההערכה נוחתת באמצע דחיפה רחבה יותר של ארה"ב לבדיקת מערכות AI סיניות. מוקדם יותר ביולי, ממשל טראמפ החיה מחדש את המאמצים להגביל את השימוש במודלים של AI שפותחו בסין בתוך ארצות הברית, תוך ציון חששות של אבטחת סייבר, כאשר קימי K3 נקראה שוב ושוב בדיון זה. מחוקקים בארה"ב לחצו בנפרד על חברות אמריקאיות בנוגע להשלכות אבטחת הנתונים של שילוב מודלים זרים במוצרים שלהן.

על רקע זה, ממשלה שמצאה כי המודל הסיני בעל המשקל הפתוח הבולט ביותר מניב ביצועים נמוכים בעבירות קיצוץ בשני כיוונים. לאלו הטוענים להגבלות, הוא מספק ראיות רשמיות לכך שהדגם זוכה ליחס רציני מספיק כדי להיבדק. עבור אלה שנזהרים מהשגת יתר, ציון סייבר נמוך יחסית מסבך גם את הנרטיב שכל דגם סיני מייצג איום סייבר מיידי.

מה המשמעות של אימוץ במשקל פתוח

התוצאה גם מובילה לוויכוח נפרד על AI במשקל פתוח בצורה רחבה יותר. התומכים במודלים בעלי משקל פתוח טוענים שמשקולות הניתנות להורדה חופשית מאפשרות בדיקות בטיחות עצמאיות בדיוק כמו ש-CAISI ו-AISI בבריטניה ערכו, מה שהופך את ההפצה הפתוחה לחיובית נטו לביטחון. המבקרים טוענים כי אותה פתיחות מורידה את המחסום בפני שחקנים זדוניים לשנות או להשתמש לרעה במערכות מסוגלות.

במקרה של Kimi K3, זמינות המשקל הפתוח היא בדיוק מה שאיפשר את ההערכה הממשלתית העצמאית הזו. האם ציון הסייבר הצנוע יחסית מרגיע או מזהיר את קובעי המדיניות, צפוי להיות תלוי פחות במספר עצמו ויותר באופן שבו סוכנויות בארה"ב ובבריטניה בוחרות למסגר אותו בשבועות הקרובים.

לעת עתה, ההערכה המוקדמת עומדת כנקודת התייחסות: המדידה המערבית הרשמית הראשונה של יכולות הסייבר ההתקפיות של Kimi K3, וכזו שממקמת אותה הרבה מאחורי הדגמים האמריקניים הגבוליים שהיא מושווה אליהם לעתים קרובות כל כך.

הישאר לפני AI

ציוני יכולת סייבר הם רק חזית אחת בתחרות גדולה בהרבה על בטיחות בינה מלאכותית, רגולציה ותחרות גלובלית. נוף המדיניות משתנה מדי שבוע, והחמצה של הערכה בודדת עשויה להיות החמצה של ההקשר מאחורי הכותרת הבאה. קרא עוד חדשות בינה מלאכותית על AI Buzz Wire כדי להתעדכן בכל מהדורת מודל, פסיקת ממשלה והערכת בטיחות שחשובה.

הישאר לפני מירוץ AI - בקר ב-AI Buzz Wire