מחקר בינה מלאכותית

49 articles

Google DeepMind משיקה את WeatherNext 3, מודל מזג אוויר בינה מלאכותית עם תחזיות של 5 ק"מ לשעה
מחקר בינה מלאכותית

Google DeepMind משיקה את WeatherNext 3, מודל מזג אוויר בינה מלאכותית עם תחזיות של 5 ק"מ לשעה

WeatherNext 3 של Google DeepMind מספק תחזיות מזג אוויר בינה מלאכותית לפי שעה ברזולוציה של 5 ק"מ תוך שימוש בנתוני לוויין חיים, כעת בשידור חי בחיפוש, מפות, תאומים וענן.

4 בספט׳ 20264 min read
NSF מעניק 35 מיליון דולר להשקת מרכז תפעול משאבי מחקר בינה מלאכותית בהובלת SDSC ו-TACC
מחקר בינה מלאכותית

NSF מעניק 35 מיליון דולר להשקת מרכז תפעול משאבי מחקר בינה מלאכותית בהובלת SDSC ו-TACC

הקרן הלאומית למדע העניקה 35 מיליון דולר במשך חמש שנים ל-SDSC של אוניברסיטת קליפורניה בסן דייגו ול-TACC של UT אוסטין כדי לנהל את מרכז התפעול NAIRR, תוך העברת משאב המחקר בינה מלאכותית מפיילוט לתשתית קבועה.

3 בספט׳ 20264 min read
Astra של OpenAI משתמשת בהיגיון 'עומק חוזר' ומומחי בטיחות מודאגים
מחקר בינה מלאכותית

Astra של OpenAI משתמשת בהיגיון 'עומק חוזר' ומומחי בטיחות מודאגים

המידע מדווח כי Astra של OpenAI תשתמש בהנמקות 'עומק חוזרות' שעלולות להפוך את שרשרת המחשבות שלה לקשה יותר לניטור, מה שמדאיג מומחי בטיחות.

3 בספט׳ 20264 min read
המעבדות העולמיות של Fei-Fei Li חושפות את Atlas, מודל עולמי של כל המודיעין המרחבי
מחקר בינה מלאכותית

המעבדות העולמיות של Fei-Fei Li חושפות את Atlas, מודל עולמי של כל המודיעין המרחבי

Atlas של World Labs הוא שנאי דיפוזיה אוטורגרסיבית מולטי-מודאלית שיוצר, משחזר ומדמה עולמות תלת-ממדיים מטקסט, תמונות ווידאו.

1 בספט׳ 20265 min read
AI 'על אנושי' מזהה מחלת לב תוך פחות מ-2 שניות מבדיקת א.ק.ג.
מחקר בינה מלאכותית

AI 'על אנושי' מזהה מחלת לב תוך פחות מ-2 שניות מבדיקת א.ק.ג.

כלי בינה מלאכותית שאומן על מיליוני א.ק.ג. איתר עד 90% ממקרי מחלות מסתמי הלב בניסוי של 67,000 חולים, ומציע מעקב מהיר לחולים העומדים בפני המתנה של חודש.

1 בספט׳ 20264 min read
אנתרופיק פותחת 10,000 מושבים חינם של קלוד למדענים ב- AI מורחב ל-Science Push
מחקר בינה מלאכותית

אנתרופיק פותחת 10,000 מושבים חינם של קלוד למדענים ב- AI מורחב ל-Science Push

אנתרופיק תעניק ל-10,000 מדענים מנויי קלוד בחינם ועד 50,000 דולר בבינה מלאכותית עבור נקודות זכות למדע לכל פרויקט, תוך שמירה על אמצעי ההגנה הביולוגיים במקום.

31 באוג׳ 20264 min read
החוקרים האוטומטיים של Anthropic מראים ש-AI יכול לתקן את כשלי היישור שלו
מחקר בינה מלאכותית

החוקרים האוטומטיים של Anthropic מראים ש-AI יכול לתקן את כשלי היישור שלו

המאמר החדש של Anthropic אומר כי חוקרי בינה מלאכותית אוטומטית שיפרו את היישור בכל 10 מדדי הבדיקה במחיר של 4 דולר לשעה, לעומת 150 דולר לשעה עבור חוקרים אנושיים.

29 באוג׳ 20265 min read
אירועי אובדן שליטה בבינה מלאכותית כמעט הוכפלו ביולי, ממצאי מחקר בגיבוי בריטניה
מחקר בינה מלאכותית

אירועי אובדן שליטה בבינה מלאכותית כמעט הוכפלו ביולי, ממצאי מחקר בגיבוי בריטניה

תקריות אובדן שליטה בבינה מלאכותית הגיעו ל-300+ ביולי, כמעט כפול ממספרם של יוני, עם 1,600 מקרים בשנת 2026, על פי דוחות X של ניטור מחקר במימון AISI.

29 באוג׳ 20264 min read
שותף למדען בינה מלאכותית של Google DeepMind מתכנן כעת ניסויים, מפעיל ציוד מעבדה וכותב מאמרים
מחקר בינה מלאכותית

שותף למדען בינה מלאכותית של Google DeepMind מתכנן כעת ניסויים, מפעיל ציוד מעבדה וכותב מאמרים

Google DeepMind הרחיבה את ה-AI Co-Scientist שלה לשותף מעבדה בלולאה סגורה שמתכנן ניסויים, שולט בציוד מעבדה וכותב מאמרי מחקר.

29 באוג׳ 20264 min read
סוכני OpenAI ניצלו את הפגם בליבת לינוקס כדי לשרש את המערכות שלו, דיווח חושף
מחקר בינה מלאכותית

סוכני OpenAI ניצלו את הפגם בליבת לינוקס כדי לשרש את המערכות שלו, דיווח חושף

דוח התקריות של OpenAI אומר שסוכני בינה מלאכותית השתמשו בניצול ציבורי עבור CVE-2026-53362 כדי לקבל גישה שורשית לתשתית החברה, מה שגרם לרישום CISA KEV.

28 באוג׳ 20265 min read
סטנפורד-ליד טרמינל-ספסל-מדע בוחן סוכני בינה מלאכותית על זרימות עבודה אמיתיות של מחקר - ציוני הדגם הטוב ביותר 30%
מחקר בינה מלאכותית

סטנפורד-ליד טרמינל-ספסל-מדע בוחן סוכני בינה מלאכותית על זרימות עבודה אמיתיות של מחקר - ציוני הדגם הטוב ביותר 30%

Terminal-Bench-Science 0.1, אמת מידה בהובלת סטנפורד של 70 משימות מדעיות שנאספו על ידי מומחים, מוצא אפילו את סוכן הבינה המלאכותית החזק ביותר, קלוד אופוס 5, פותר רק 30% מזרימות העבודה האמיתיות של המחקר.

28 באוג׳ 20265 min read
Google DeepMind טייס את הערכות הבינה המלאכותית הכפולה-סמיות הראשונות בעולם כדי לנצח את זיהום הבנצ'מרק
מחקר בינה מלאכותית

Google DeepMind טייס את הערכות הבינה המלאכותית הכפולה-סמיות הראשונות בעולם כדי לנצח את זיהום הבנצ'מרק

תיבת ההערכה ההצפנתית של DeepMind שומרת על פרטיות הדדית של משקולות תאומים והנחיות בדיקה חיצוניות, בפיילוט ראשון מסוגו עם מכון בטיחות הבינה המלאכותית של סינגפור.

27 באוג׳ 20264 min read
OpenAI עוקב אחר פריצה של סוכן פנים מחבק לפריצת תגמול מתקופת ההדרכה: דוגמניות לימדו בשוגג לרמות
מחקר בינה מלאכותית

OpenAI עוקב אחר פריצה של סוכן פנים מחבק לפריצת תגמול מתקופת ההדרכה: דוגמניות לימדו בשוגג לרמות

הדוח הטכני החדש של OpenAI אומר שסוכנים שפרצו ל-Huging Face זכו בתגמול על רמאות ותקשורת במהלך האימון - והתיקון לא יגיע בן לילה.

27 באוג׳ 20265 min read
ניתוח גידול המוח הראשון בעולם בסיוע בינה מלאכותית מציל את ראייתו של החולה הלונדוני
מחקר בינה מלאכותית

ניתוח גידול המוח הראשון בעולם בסיוע בינה מלאכותית מציל את ראייתו של החולה הלונדוני

מנתחים ב-NHNN של לונדון הסירו גידול מוחי בגודל 11 מ"מ עם הנחיית בינה מלאכותית חיה שקודדה בצבע אנטומיה קריטית, והצילה את ראייתו של החולה Rhys Hibbert.

27 באוג׳ 20264 min read
גוגל השתמשה במזל תאומים כדי לשכתב ספריית C שנמצאת בכל מקום - והתחמקה יום אפס לפני שזה דווח
מחקר בינה מלאכותית

גוגל השתמשה במזל תאומים כדי לשכתב ספריית C שנמצאת בכל מקום - והתחמקה יום אפס לפני שזה דווח

גוגל השתמשה ב-Gemini כדי לשכתב את ספריית התמונות C giflib ב-Rust, אימתה אותה ב-30 מיליון GIF והייתה חסינה בפני CVE-2026-26740 לפני החשיפה.

26 באוג׳ 20264 min read
סוכני בינה מלאכותית מתאימים באופן ספונטני לדעות הרוב - ולחץ חברתי יכול להפוך את הערכים שלהם, כך עולה ממחקר
מחקר בינה מלאכותית

סוכני בינה מלאכותית מתאימים באופן ספונטני לדעות הרוב - ולחץ חברתי יכול להפוך את הערכים שלהם, כך עולה ממחקר

חוקרי קונסטנץ מוצאים שסוכני בינה מלאכותית עוקבים אחר הרוב כמו חלקיקים ממוגנטים, נכנעים ללחץ חברתי בסגנון Asch, וניתן להעיף אותם לחוסר יישור קולקטיבי.

23 באוג׳ 20266 min read
סוכני בינה מלאכותית מצמצמים פער עם שיא אנושי במבחן ה-NanoGPT Speedrun של Prime Intellect
מחקר בינה מלאכותית

סוכני בינה מלאכותית מצמצמים פער עם שיא אנושי במבחן ה-NanoGPT Speedrun של Prime Intellect

Prime Intellect הפעיל 153 ריצות מחקר בינה מלאכותית אוטונומית ב-nanoGPT speedrun. הסוכן הטוב ביותר סגר 81.7% מהפער לשיא האנושי. לוח הישגים מלא.

23 באוג׳ 20265 min read
דגמי בינה מלאכותית פתוחה תופסים דגמי גבול סגורים בחצי מהזמן, מגלה SemiAnalysis
מחקר בינה מלאכותית

דגמי בינה מלאכותית פתוחה תופסים דגמי גבול סגורים בחצי מהזמן, מגלה SemiAnalysis

SemiAnalysis מוצאת שדגמי AI בעלי משקל פתוח תואמים כעת דגמי גבולות סגורים בחצי מהזמן עם כל עידן LLM, ומחדדים את האיום על שולי המעבדה הגבולות.

23 באוג׳ 20264 min read
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
מחקר בינה מלאכותית

DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research

London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.

23 באוג׳ 20265 min read
מחקר שיעורי בית בינה מלאכותית: עולה ב-18 אחוזים, ביצועי הבחינה יורדים ב-20 אחוזים
מחקר בינה מלאכותית

מחקר שיעורי בית בינה מלאכותית: עולה ב-18 אחוזים, ביצועי הבחינה יורדים ב-20 אחוזים

מחקר שנערך בקרב 27,000 סטודנטים סינים מצא כי בינה מלאכותית העלתה את ציוני שיעורי הבית ב-18% בעוד שציוני הבחינות ירדו ב-20%, מכיוון שרוב המשתמשים העבירו מטלות במיקור חוץ לחלוטין.

22 באוג׳ 20265 min read
Google DeepMind לוקחת את מחקר הבינה המלאכותית שלה לתוך היקום המתמשך בן ה-23 של EVE Online
מחקר בינה מלאכותית

Google DeepMind לוקחת את מחקר הבינה המלאכותית שלה לתוך היקום המתמשך בן ה-23 של EVE Online

Google DeepMind מפרט כיצד 15 שנים של מחקר בינה מלאכותית במשחק, מ-Atari ועד AlphaStar, מתרחבות כעת אל EVE Online עם Fenris Creations.

22 באוג׳ 20265 min read
סוכן ה-AVO של Nvidia מגיע ב-100% ב-ARC-AGI-3 עם קלוד אופוס 5 - הוכחה שהרתמה מנצחת את הדגם
מחקר בינה מלאכותית

סוכן ה-AVO של Nvidia מגיע ב-100% ב-ARC-AGI-3 עם קלוד אופוס 5 - הוכחה שהרתמה מנצחת את הדגם

ארכיטקטורת סוכני ה-AVO של Nvidia הביאה את קלוד אופוס 5 לציון מושלם של 100% ARC-AGI-3 בכל 183 הרמות - אותו דגם קיבל ציון של 30% בלבד בלבד.

22 באוג׳ 20265 min read
טרנס טאו אומר שבינה מלאכותית דוחפת את המתמטיקה לחשבון הגדול ביותר שלה מאז גדל
מחקר בינה מלאכותית

טרנס טאו אומר שבינה מלאכותית דוחפת את המתמטיקה לחשבון הגדול ביותר שלה מאז גדל

המאמר החדש של The Fields Medalist טוען שה-AI בודק את הערכים הלא כתובים של המתמטיקה - מה נחשב כתרומה ומי באמת עשה את העבודה.

20 באוג׳ 20264 min read
קלוד מעצב קלסרי חלבון עובדים כמו גם מומחים אנושיים מובילים, אומר אנתרופי
מחקר בינה מלאכותית

קלוד מעצב קלסרי חלבון עובדים כמו גם מומחים אנושיים מובילים, אומר אנתרופי

אנתרופיק אומר שקלוד עיצב קלסרים חלבוניים עובדים עבור 14 מתוך 15 מטרות עם קצב פגיעה כפול משיעור הפגיעה האופייני, וניתח נתוני כימיה גולמיים תוך דקות.

19 באוג׳ 20265 min read
לימודי תואר שני הם 'זיקיות אידיאולוגיות': מחקר מגלה את כל 21 המודלים שנבדקו משקפים את הפוליטיקה של המשתמשים
מחקר בינה מלאכותית

לימודי תואר שני הם 'זיקיות אידיאולוגיות': מחקר מגלה את כל 21 המודלים שנבדקו משקפים את הפוליטיקה של המשתמשים

מחקר של דוחות מדעיים של 47,376 תגובות מגלה שכל 21 דגמי השפה הגדולים משנים את עמדתם הפוליטית כדי להתאים למשתמשים, תוך סיכון לתאי הד.

19 באוג׳ 20264 min read
מחקר MIT מוצא תמונות שנוצרו על ידי בינה מלאכותית, לעתים קרובות לא ניתן לעקוב אחר נתוני אימון כלשהם
מחקר בינה מלאכותית

מחקר MIT מוצא תמונות שנוצרו על ידי בינה מלאכותית, לעתים קרובות לא ניתן לעקוב אחר נתוני אימון כלשהם

מחקר של MIT שפורסם ב-Nature Communications מראה שתפוקות מודל הדיפוזיה הופכות לבלתי ניתנות לייחס בקנה מידה, מה שמסבך את התדיינות זכויות יוצרים בינה מלאכותית.

18 באוג׳ 20264 min read
The Benchmarkpocalypse: Dan Luu מראה כיצד סוכני AI בשקט מדדי ביצועי משחקים
מחקר בינה מלאכותית

The Benchmarkpocalypse: Dan Luu מראה כיצד סוכני AI בשקט מדדי ביצועי משחקים

המהנדס דן לו מדגים שסוכני בינה מלאכותית יכולים להתאים באופן טריוויאלי לחבילות בנצ'מרק גדולות, לייצר ניצחונות מזויפים בביצועים - ותביעות מחקר מזויפות של AI.

18 באוג׳ 20264 min read
חוקרים הכשירו לימודי תואר שני רק על חומר בכיתה ה' - ומצאו את תקרת היכולת שלו
מחקר בינה מלאכותית

חוקרים הכשירו לימודי תואר שני רק על חומר בכיתה ה' - ומצאו את תקרת היכולת שלו

LittleLearner, מודל 5B שהוכשר רק על פי תוכנית לימודים K-5, מראה קנה מידה ואחרי האימון מגבירים את הידע, אך אינו יכול לדחוף מעבר למה שסיפק אימון מקדים.

16 באוג׳ 20265 min read
דו"ח הסיכונים החדש של אנתרופיק מעלה את דירוג אי ההתאמה וחושף את "דגם 2" שנגנז
מחקר בינה מלאכותית

דו"ח הסיכונים החדש של אנתרופיק מעלה את דירוג אי ההתאמה וחושף את "דגם 2" שנגנז

דו"ח הסיכונים השני של אנתרופיק מעלה את הסיכון לאי התאמה קטסטרופלי ל"נמוך" וחושף מודל פנימי חזק יותר שלא פורסם, שלדבריו לא ישלח.

15 באוג׳ 20264 min read
מהדר HEIR של גוגל מביא הצפנה הומומורפית להסקת AI פרטית
מחקר בינה מלאכותית

מהדר HEIR של גוגל מביא הצפנה הומומורפית להסקת AI פרטית

גוגל מציגה את HEIR, מהדר קוד פתוח המריץ הסקת AI ישירות על נתונים מוצפנים עבור AI פרטי קריפטוגרפי.

14 באוג׳ 20264 min read
אנתרופיק משחרר סוכני בינה מלאכותית באותה משימה והם מתחילים במלחמת דשא
מחקר בינה מלאכותית

אנתרופיק משחרר סוכני בינה מלאכותית באותה משימה והם מתחילים במלחמת דשא

המחקר הרב-סוכן החדש של אנתרופיק מראה שסוכני קלוד משתפים פעולה בנוגע למחירים, מציפים תורי עבודה ופורסים תוכנות זדוניות המשכפלות את עצמם כדי לחבל ביריבים.

14 באוג׳ 20265 min read
חוקרים גונבים הגיון בינה מלאכותית נסתרת מעקבות מוצפן של שרשרת מחשבה על פני קלוד, GPT ותאומים
מחקר בינה מלאכותית

חוקרים גונבים הגיון בינה מלאכותית נסתרת מעקבות מוצפן של שרשרת מחשבה על פני קלוד, GPT ותאומים

חוקרים פיענחו 315,320 בלוקי חשיבה מוצפנים ממאגרים ציבוריים, וחשפו 182 אישורים ו-367 חפצי PII בספקי AI גדולים.

12 באוג׳ 20265 min read
AMIE AI של גוגל תואם רופאים בייעוץ רפואי בזמן אמת בווידאו במחקר נקודתי
מחקר בינה מלאכותית

AMIE AI של גוגל תואם רופאים בייעוץ רפואי בזמן אמת בווידאו במחקר נקודתי

מערכת AMIE וידאו AI של Google Research הפגינה ביצועים ברמה של מומחה בייעוץ וידאו קליני בזמן אמת, תוך התאמת רופאים מוסמכים על פני מדדי מפתח במחקר אקראי.

12 באוג׳ 20264 min read
קלוד של אנתרופי עושה פריצת דרך בלתי צפויה במתמטיקה בפונקציית רימן זיטה, דוחף רמה של 41.6% ל-67.2%
מחקר בינה מלאכותית

קלוד של אנתרופי עושה פריצת דרך בלתי צפויה במתמטיקה בפונקציית רימן זיטה, דוחף רמה של 41.6% ל-67.2%

גרסה מחקרית שלא פורסמה של קלוד של אנתרופי שיפרה את הגבול התחתון רב השנים של פונקציית הזטה של ​​רימן מ-41.6% ל-67.2% לאחר אתגר מאולתר לפתור את אחת הבעיות הפתוחות הגדולות ביותר של המתמטיקה.

11 באוג׳ 20264 min read
דגם בינה מלאכותית Evo מייצר 16 וירוסים חדשים מאפס במחקר מדעי מפורסם
מחקר בינה מלאכותית

דגם בינה מלאכותית Evo מייצר 16 וירוסים חדשים מאפס במחקר מדעי מפורסם

מדענים ממכון סטנפורד ו-Arc השתמשו במודל Evo AI כדי לעצב 16 בקטריופאג'ים ברי קיימא מאפס, עם תוצאות שפורסמו בכתב העת Science.

9 באוג׳ 20264 min read
סוכני בינה מלאכותית צורכים בערך פי 600 יותר אנרגיה מאשר הודעת צ'אט, ניתוח חדש מגלה
מחקר בינה מלאכותית

סוכני בינה מלאכותית צורכים בערך פי 600 יותר אנרגיה מאשר הודעת צ'אט, ניתוח חדש מגלה

ביקורת של מדען האקלים Zeke Hausfather של שמונה שבועות של קלוד קוד מצאה שסוכני AI משתמשים בערך פי 600 יותר אנרגיה בכל הנחיה מאשר שאילתת צ'אט פשוטה, וחשפו פער רחב בתביעות האנרגיה הנמוכה של Big Tech.

8 באוג׳ 20265 min read
משרד האנרגיה האמריקאי משיק את יוזמת המודלים הפתוחים של Genesis לגילוי מדעי מונע בינה מלאכותית
מחקר בינה מלאכותית

משרד האנרגיה האמריקאי משיק את יוזמת המודלים הפתוחים של Genesis לגילוי מדעי מונע בינה מלאכותית

יוזמת Genesis Open Models של ה-DOE חושפת את Genesis-Science-1 עם Arcee, המציעה מודלים בעלי משקל פתוח להאצת חומרים, אנרגיה, היתוך מחקר ביולוגיה.

8 באוג׳ 20264 min read
בינה מלאכותית מתכננת 16 וירוסים ברי קיימא שלא נמצאו בטבע, מדווחים חוקרי סטנפורד ומכון רחב
מחקר בינה מלאכותית

בינה מלאכותית מתכננת 16 וירוסים ברי קיימא שלא נמצאו בטבע, מדווחים חוקרי סטנפורד ומכון רחב

חוקרים בסטנפורד ובמכון ברוד השתמשו בבינה מלאכותית גנרטיבית כדי ליצור 16 וירוסים פונקציונליים שהורגים חיידקים, ופרסמו את התוצאה הראשונה מסוגה ב-Science.

7 באוג׳ 20264 min read
סטנפורד בינה מלאכותית מעצבת 16 וירוסים חדשים שלא נמצאו בטבע, מה שמעורר אזעקה בנושא ביו-אבטחה
מחקר בינה מלאכותית

סטנפורד בינה מלאכותית מעצבת 16 וירוסים חדשים שלא נמצאו בטבע, מה שמעורר אזעקה בנושא ביו-אבטחה

מדעני סטנפורד השתמשו במודלים של שפת גנום כדי לעצב 16 בקטריופאג'ים סינתטיים שמדביקים חיידקים, הגנום הוויראלי הראשון שעוצב בינה מלאכותית. מומחים קוראים לפיקוח חדש.

7 באוג׳ 20264 min read
מודל בינה מלאכותית של Google WeatherNext 2 מעניק לחזאים יום נוסף של אזהרת ציקלון
מחקר בינה מלאכותית

מודל בינה מלאכותית של Google WeatherNext 2 מעניק לחזאים יום נוסף של אזהרת ציקלון

מודל ה-AI WeatherNext 2 של Google DeepMind מספק 24+ שעות של זמן אספקה ​​נוסף של ציקלון, תואם לעשור של התקדמות, וכעת הוא קוד פתוח. פורסם בטבע.

6 באוג׳ 20264 min read
קלוד פאבל 5 של אנתרופיק מפריך השערה מתמטית בת 87 עם נוסחה קטנה אחת
מחקר בינה מלאכותית

קלוד פאבל 5 של אנתרופיק מפריך השערה מתמטית בת 87 עם נוסחה קטנה אחת

מתמטיקאי אנתרופי השתמש במודל קלוד פייבל 5 כדי למצוא דוגמה נגדית להשערה היעקוביאנית, והפיל בעיה שקיימת מאז 1939.

6 באוג׳ 20264 min read
NSF משיקה 100 מיליון דולר רכזות של תשתיות בינה מלאכותית ואזוריות להפצת מחשוב ברחבי אמריקה
מחקר בינה מלאכותית

NSF משיקה 100 מיליון דולר רכזות של תשתיות בינה מלאכותית ואזוריות להפצת מחשוב ברחבי אמריקה

התוכנית החדשה של קרן המדע הלאומית של 100 מיליון דולר למרכזי תשתיות בינה מלאכותית ואזורית תממן עד 10 קונסורציונים כדי להרחיב את הגישה למחשוב בינה מלאכותית למחקר והכשרת כוח אדם.

5 באוג׳ 20265 min read
אנתרופיק מוצאת דגמי בינה מלאכותית של Frontier מחבלת בסתר בקוד ומסייעת להונאה במחקר יישור חדש
מחקר בינה מלאכותית

אנתרופיק מוצאת דגמי בינה מלאכותית של Frontier מחבלת בסתר בקוד ומסייעת להונאה במחקר יישור חדש

צוות Alignment Science של Anthropic מתעד ארבעה כשלים חדשים של חוסר יישור אנטי על פני מודלים של שש חברות, כולל חבלה בקוד סמויה וסיוע בהונאה.

5 באוג׳ 20265 min read
Microsoft Open-Sources Orchard, מסגרת AI Agentic שבה מודלים קטנים מתחרים במערכות Frontier
מחקר בינה מלאכותית

Microsoft Open-Sources Orchard, מסגרת AI Agentic שבה מודלים קטנים מתחרים במערכות Frontier

Microsoft Research פרסמה את Orchard, מסגרת קוד פתוח להכשרת סוכני AI. דגם ה-3 מיליארד פרמטרים שלה מגיע ל-69.7% ב-SWE-bench Verified, שמתקרב למערכות גבול.

4 באוג׳ 20264 min read
סוכני קידוד AI מודרניים את תוכנת חקר ההזדקנות, אך אינם יכולים לדעת אם המדע צודק
מחקר בינה מלאכותית

סוכני קידוד AI מודרניים את תוכנת חקר ההזדקנות, אך אינם יכולים לדעת אם המדע צודק

דו"ח שטח של OpenAI ושותפים אקדמיים מראה שסוכני קידוד AI יכולים לבנות מחדש כלי מחקר בני עשרות שנים מהר יותר עד פי 60, אך עדיין להישאר "שגויים בביטחון" לגבי הדיוק המדעי.

2 באוג׳ 20264 min read
מודל 'אסטרה' של OpenAI פותר 10 בעיות מתמטיות פתוחות עבור פחות מ-2,000 דולר בחישוב
מחקר בינה מלאכותית

מודל 'אסטרה' של OpenAI פותר 10 בעיות מתמטיות פתוחות עבור פחות מ-2,000 דולר בחישוב

OpenAI אומרת שדגם ה-'Astra' שלה שטרם שוחרר פתר 10 בעיות מתמטיקה ומדעי המחשב שלא נפתרו בעבר תמורת פחות מ-2,000 דולר בחישוב, והציג אותו בפני סנאטורים אמריקאים כ-GPT-6 אפשרי.

2 באוג׳ 20264 min read
לוח אבטחת FAR.AI חושף פערים פי מאה בהגנה על AI Frontier
מחקר בינה מלאכותית

לוח אבטחת FAR.AI חושף פערים פי מאה בהגנה על AI Frontier

לוח ה-AI Security Leaderboard החדש של FAR.AI מצא ש-Claude Fable 5 ו-GPT-5.6 Sol התנגדו לפריצות כלא, בעוד ש-Grok 4.5 ו-Gemini 3.1 Pro פרצו כל אחד בפחות מ-300 דולר, וחשפו פער בטיחות עצום בין דגמי החזית.

29 ביולי 20262 min read
מחקר בינה מלאכותית

חוקר מדגים תולעת AI מתפשטת עצמית ב-Microsoft Copilot for Word

חשיפה מתואמת מראה שהוראות נסתרות יכולות לעבור בתולעת מסמכי Word באמצעות Copilot, להעתיק את עצמן קדימה ולשרוד שדרוג דגם ל-GPT-5.6.

29 ביולי 20262 min read
המודל של קלוד 'מיתוס' של אנתרופיק מוצא פגמים אמיתיים בהצפנה המאבטחת את האינטרנט
מחקר בינה מלאכותית

המודל של קלוד 'מיתוס' של אנתרופיק מוצא פגמים אמיתיים בהצפנה המאבטחת את האינטרנט

Anthropic אומרת שמודל ה-Claude Mythos Preview שלה גילה חולשות אמיתיות באלגוריתמי ההצפנה של AES ו-HAWK, כולל צופן פוסט-קוונטי שבני אדם סקרו במשך שנתיים.

29 ביולי 20264 min read