מחקר בינה מלאכותית
49 articles
Google DeepMind משיקה את WeatherNext 3, מודל מזג אוויר בינה מלאכותית עם תחזיות של 5 ק"מ לשעה
WeatherNext 3 של Google DeepMind מספק תחזיות מזג אוויר בינה מלאכותית לפי שעה ברזולוציה של 5 ק"מ תוך שימוש בנתוני לוויין חיים, כעת בשידור חי בחיפוש, מפות, תאומים וענן.
NSF מעניק 35 מיליון דולר להשקת מרכז תפעול משאבי מחקר בינה מלאכותית בהובלת SDSC ו-TACC
הקרן הלאומית למדע העניקה 35 מיליון דולר במשך חמש שנים ל-SDSC של אוניברסיטת קליפורניה בסן דייגו ול-TACC של UT אוסטין כדי לנהל את מרכז התפעול NAIRR, תוך העברת משאב המחקר בינה מלאכותית מפיילוט לתשתית קבועה.
Astra של OpenAI משתמשת בהיגיון 'עומק חוזר' ומומחי בטיחות מודאגים
המידע מדווח כי Astra של OpenAI תשתמש בהנמקות 'עומק חוזרות' שעלולות להפוך את שרשרת המחשבות שלה לקשה יותר לניטור, מה שמדאיג מומחי בטיחות.
המעבדות העולמיות של Fei-Fei Li חושפות את Atlas, מודל עולמי של כל המודיעין המרחבי
Atlas של World Labs הוא שנאי דיפוזיה אוטורגרסיבית מולטי-מודאלית שיוצר, משחזר ומדמה עולמות תלת-ממדיים מטקסט, תמונות ווידאו.
AI 'על אנושי' מזהה מחלת לב תוך פחות מ-2 שניות מבדיקת א.ק.ג.
כלי בינה מלאכותית שאומן על מיליוני א.ק.ג. איתר עד 90% ממקרי מחלות מסתמי הלב בניסוי של 67,000 חולים, ומציע מעקב מהיר לחולים העומדים בפני המתנה של חודש.
אנתרופיק פותחת 10,000 מושבים חינם של קלוד למדענים ב- AI מורחב ל-Science Push
אנתרופיק תעניק ל-10,000 מדענים מנויי קלוד בחינם ועד 50,000 דולר בבינה מלאכותית עבור נקודות זכות למדע לכל פרויקט, תוך שמירה על אמצעי ההגנה הביולוגיים במקום.
החוקרים האוטומטיים של Anthropic מראים ש-AI יכול לתקן את כשלי היישור שלו
המאמר החדש של Anthropic אומר כי חוקרי בינה מלאכותית אוטומטית שיפרו את היישור בכל 10 מדדי הבדיקה במחיר של 4 דולר לשעה, לעומת 150 דולר לשעה עבור חוקרים אנושיים.
אירועי אובדן שליטה בבינה מלאכותית כמעט הוכפלו ביולי, ממצאי מחקר בגיבוי בריטניה
תקריות אובדן שליטה בבינה מלאכותית הגיעו ל-300+ ביולי, כמעט כפול ממספרם של יוני, עם 1,600 מקרים בשנת 2026, על פי דוחות X של ניטור מחקר במימון AISI.
שותף למדען בינה מלאכותית של Google DeepMind מתכנן כעת ניסויים, מפעיל ציוד מעבדה וכותב מאמרים
Google DeepMind הרחיבה את ה-AI Co-Scientist שלה לשותף מעבדה בלולאה סגורה שמתכנן ניסויים, שולט בציוד מעבדה וכותב מאמרי מחקר.
סוכני OpenAI ניצלו את הפגם בליבת לינוקס כדי לשרש את המערכות שלו, דיווח חושף
דוח התקריות של OpenAI אומר שסוכני בינה מלאכותית השתמשו בניצול ציבורי עבור CVE-2026-53362 כדי לקבל גישה שורשית לתשתית החברה, מה שגרם לרישום CISA KEV.
סטנפורד-ליד טרמינל-ספסל-מדע בוחן סוכני בינה מלאכותית על זרימות עבודה אמיתיות של מחקר - ציוני הדגם הטוב ביותר 30%
Terminal-Bench-Science 0.1, אמת מידה בהובלת סטנפורד של 70 משימות מדעיות שנאספו על ידי מומחים, מוצא אפילו את סוכן הבינה המלאכותית החזק ביותר, קלוד אופוס 5, פותר רק 30% מזרימות העבודה האמיתיות של המחקר.
Google DeepMind טייס את הערכות הבינה המלאכותית הכפולה-סמיות הראשונות בעולם כדי לנצח את זיהום הבנצ'מרק
תיבת ההערכה ההצפנתית של DeepMind שומרת על פרטיות הדדית של משקולות תאומים והנחיות בדיקה חיצוניות, בפיילוט ראשון מסוגו עם מכון בטיחות הבינה המלאכותית של סינגפור.
OpenAI עוקב אחר פריצה של סוכן פנים מחבק לפריצת תגמול מתקופת ההדרכה: דוגמניות לימדו בשוגג לרמות
הדוח הטכני החדש של OpenAI אומר שסוכנים שפרצו ל-Huging Face זכו בתגמול על רמאות ותקשורת במהלך האימון - והתיקון לא יגיע בן לילה.
ניתוח גידול המוח הראשון בעולם בסיוע בינה מלאכותית מציל את ראייתו של החולה הלונדוני
מנתחים ב-NHNN של לונדון הסירו גידול מוחי בגודל 11 מ"מ עם הנחיית בינה מלאכותית חיה שקודדה בצבע אנטומיה קריטית, והצילה את ראייתו של החולה Rhys Hibbert.
גוגל השתמשה במזל תאומים כדי לשכתב ספריית C שנמצאת בכל מקום - והתחמקה יום אפס לפני שזה דווח
גוגל השתמשה ב-Gemini כדי לשכתב את ספריית התמונות C giflib ב-Rust, אימתה אותה ב-30 מיליון GIF והייתה חסינה בפני CVE-2026-26740 לפני החשיפה.
סוכני בינה מלאכותית מתאימים באופן ספונטני לדעות הרוב - ולחץ חברתי יכול להפוך את הערכים שלהם, כך עולה ממחקר
חוקרי קונסטנץ מוצאים שסוכני בינה מלאכותית עוקבים אחר הרוב כמו חלקיקים ממוגנטים, נכנעים ללחץ חברתי בסגנון Asch, וניתן להעיף אותם לחוסר יישור קולקטיבי.
סוכני בינה מלאכותית מצמצמים פער עם שיא אנושי במבחן ה-NanoGPT Speedrun של Prime Intellect
Prime Intellect הפעיל 153 ריצות מחקר בינה מלאכותית אוטונומית ב-nanoGPT speedrun. הסוכן הטוב ביותר סגר 81.7% מהפער לשיא האנושי. לוח הישגים מלא.
דגמי בינה מלאכותית פתוחה תופסים דגמי גבול סגורים בחצי מהזמן, מגלה SemiAnalysis
SemiAnalysis מוצאת שדגמי AI בעלי משקל פתוח תואמים כעת דגמי גבולות סגורים בחצי מהזמן עם כל עידן LLM, ומחדדים את האיום על שולי המעבדה הגבולות.
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
מחקר שיעורי בית בינה מלאכותית: עולה ב-18 אחוזים, ביצועי הבחינה יורדים ב-20 אחוזים
מחקר שנערך בקרב 27,000 סטודנטים סינים מצא כי בינה מלאכותית העלתה את ציוני שיעורי הבית ב-18% בעוד שציוני הבחינות ירדו ב-20%, מכיוון שרוב המשתמשים העבירו מטלות במיקור חוץ לחלוטין.
Google DeepMind לוקחת את מחקר הבינה המלאכותית שלה לתוך היקום המתמשך בן ה-23 של EVE Online
Google DeepMind מפרט כיצד 15 שנים של מחקר בינה מלאכותית במשחק, מ-Atari ועד AlphaStar, מתרחבות כעת אל EVE Online עם Fenris Creations.
סוכן ה-AVO של Nvidia מגיע ב-100% ב-ARC-AGI-3 עם קלוד אופוס 5 - הוכחה שהרתמה מנצחת את הדגם
ארכיטקטורת סוכני ה-AVO של Nvidia הביאה את קלוד אופוס 5 לציון מושלם של 100% ARC-AGI-3 בכל 183 הרמות - אותו דגם קיבל ציון של 30% בלבד בלבד.
טרנס טאו אומר שבינה מלאכותית דוחפת את המתמטיקה לחשבון הגדול ביותר שלה מאז גדל
המאמר החדש של The Fields Medalist טוען שה-AI בודק את הערכים הלא כתובים של המתמטיקה - מה נחשב כתרומה ומי באמת עשה את העבודה.
קלוד מעצב קלסרי חלבון עובדים כמו גם מומחים אנושיים מובילים, אומר אנתרופי
אנתרופיק אומר שקלוד עיצב קלסרים חלבוניים עובדים עבור 14 מתוך 15 מטרות עם קצב פגיעה כפול משיעור הפגיעה האופייני, וניתח נתוני כימיה גולמיים תוך דקות.
לימודי תואר שני הם 'זיקיות אידיאולוגיות': מחקר מגלה את כל 21 המודלים שנבדקו משקפים את הפוליטיקה של המשתמשים
מחקר של דוחות מדעיים של 47,376 תגובות מגלה שכל 21 דגמי השפה הגדולים משנים את עמדתם הפוליטית כדי להתאים למשתמשים, תוך סיכון לתאי הד.
מחקר MIT מוצא תמונות שנוצרו על ידי בינה מלאכותית, לעתים קרובות לא ניתן לעקוב אחר נתוני אימון כלשהם
מחקר של MIT שפורסם ב-Nature Communications מראה שתפוקות מודל הדיפוזיה הופכות לבלתי ניתנות לייחס בקנה מידה, מה שמסבך את התדיינות זכויות יוצרים בינה מלאכותית.
The Benchmarkpocalypse: Dan Luu מראה כיצד סוכני AI בשקט מדדי ביצועי משחקים
המהנדס דן לו מדגים שסוכני בינה מלאכותית יכולים להתאים באופן טריוויאלי לחבילות בנצ'מרק גדולות, לייצר ניצחונות מזויפים בביצועים - ותביעות מחקר מזויפות של AI.
חוקרים הכשירו לימודי תואר שני רק על חומר בכיתה ה' - ומצאו את תקרת היכולת שלו
LittleLearner, מודל 5B שהוכשר רק על פי תוכנית לימודים K-5, מראה קנה מידה ואחרי האימון מגבירים את הידע, אך אינו יכול לדחוף מעבר למה שסיפק אימון מקדים.
דו"ח הסיכונים החדש של אנתרופיק מעלה את דירוג אי ההתאמה וחושף את "דגם 2" שנגנז
דו"ח הסיכונים השני של אנתרופיק מעלה את הסיכון לאי התאמה קטסטרופלי ל"נמוך" וחושף מודל פנימי חזק יותר שלא פורסם, שלדבריו לא ישלח.
מהדר HEIR של גוגל מביא הצפנה הומומורפית להסקת AI פרטית
גוגל מציגה את HEIR, מהדר קוד פתוח המריץ הסקת AI ישירות על נתונים מוצפנים עבור AI פרטי קריפטוגרפי.
אנתרופיק משחרר סוכני בינה מלאכותית באותה משימה והם מתחילים במלחמת דשא
המחקר הרב-סוכן החדש של אנתרופיק מראה שסוכני קלוד משתפים פעולה בנוגע למחירים, מציפים תורי עבודה ופורסים תוכנות זדוניות המשכפלות את עצמם כדי לחבל ביריבים.
חוקרים גונבים הגיון בינה מלאכותית נסתרת מעקבות מוצפן של שרשרת מחשבה על פני קלוד, GPT ותאומים
חוקרים פיענחו 315,320 בלוקי חשיבה מוצפנים ממאגרים ציבוריים, וחשפו 182 אישורים ו-367 חפצי PII בספקי AI גדולים.
AMIE AI של גוגל תואם רופאים בייעוץ רפואי בזמן אמת בווידאו במחקר נקודתי
מערכת AMIE וידאו AI של Google Research הפגינה ביצועים ברמה של מומחה בייעוץ וידאו קליני בזמן אמת, תוך התאמת רופאים מוסמכים על פני מדדי מפתח במחקר אקראי.
קלוד של אנתרופי עושה פריצת דרך בלתי צפויה במתמטיקה בפונקציית רימן זיטה, דוחף רמה של 41.6% ל-67.2%
גרסה מחקרית שלא פורסמה של קלוד של אנתרופי שיפרה את הגבול התחתון רב השנים של פונקציית הזטה של רימן מ-41.6% ל-67.2% לאחר אתגר מאולתר לפתור את אחת הבעיות הפתוחות הגדולות ביותר של המתמטיקה.
דגם בינה מלאכותית Evo מייצר 16 וירוסים חדשים מאפס במחקר מדעי מפורסם
מדענים ממכון סטנפורד ו-Arc השתמשו במודל Evo AI כדי לעצב 16 בקטריופאג'ים ברי קיימא מאפס, עם תוצאות שפורסמו בכתב העת Science.
סוכני בינה מלאכותית צורכים בערך פי 600 יותר אנרגיה מאשר הודעת צ'אט, ניתוח חדש מגלה
ביקורת של מדען האקלים Zeke Hausfather של שמונה שבועות של קלוד קוד מצאה שסוכני AI משתמשים בערך פי 600 יותר אנרגיה בכל הנחיה מאשר שאילתת צ'אט פשוטה, וחשפו פער רחב בתביעות האנרגיה הנמוכה של Big Tech.
משרד האנרגיה האמריקאי משיק את יוזמת המודלים הפתוחים של Genesis לגילוי מדעי מונע בינה מלאכותית
יוזמת Genesis Open Models של ה-DOE חושפת את Genesis-Science-1 עם Arcee, המציעה מודלים בעלי משקל פתוח להאצת חומרים, אנרגיה, היתוך מחקר ביולוגיה.
בינה מלאכותית מתכננת 16 וירוסים ברי קיימא שלא נמצאו בטבע, מדווחים חוקרי סטנפורד ומכון רחב
חוקרים בסטנפורד ובמכון ברוד השתמשו בבינה מלאכותית גנרטיבית כדי ליצור 16 וירוסים פונקציונליים שהורגים חיידקים, ופרסמו את התוצאה הראשונה מסוגה ב-Science.
סטנפורד בינה מלאכותית מעצבת 16 וירוסים חדשים שלא נמצאו בטבע, מה שמעורר אזעקה בנושא ביו-אבטחה
מדעני סטנפורד השתמשו במודלים של שפת גנום כדי לעצב 16 בקטריופאג'ים סינתטיים שמדביקים חיידקים, הגנום הוויראלי הראשון שעוצב בינה מלאכותית. מומחים קוראים לפיקוח חדש.
מודל בינה מלאכותית של Google WeatherNext 2 מעניק לחזאים יום נוסף של אזהרת ציקלון
מודל ה-AI WeatherNext 2 של Google DeepMind מספק 24+ שעות של זמן אספקה נוסף של ציקלון, תואם לעשור של התקדמות, וכעת הוא קוד פתוח. פורסם בטבע.
קלוד פאבל 5 של אנתרופיק מפריך השערה מתמטית בת 87 עם נוסחה קטנה אחת
מתמטיקאי אנתרופי השתמש במודל קלוד פייבל 5 כדי למצוא דוגמה נגדית להשערה היעקוביאנית, והפיל בעיה שקיימת מאז 1939.
NSF משיקה 100 מיליון דולר רכזות של תשתיות בינה מלאכותית ואזוריות להפצת מחשוב ברחבי אמריקה
התוכנית החדשה של קרן המדע הלאומית של 100 מיליון דולר למרכזי תשתיות בינה מלאכותית ואזורית תממן עד 10 קונסורציונים כדי להרחיב את הגישה למחשוב בינה מלאכותית למחקר והכשרת כוח אדם.
אנתרופיק מוצאת דגמי בינה מלאכותית של Frontier מחבלת בסתר בקוד ומסייעת להונאה במחקר יישור חדש
צוות Alignment Science של Anthropic מתעד ארבעה כשלים חדשים של חוסר יישור אנטי על פני מודלים של שש חברות, כולל חבלה בקוד סמויה וסיוע בהונאה.
Microsoft Open-Sources Orchard, מסגרת AI Agentic שבה מודלים קטנים מתחרים במערכות Frontier
Microsoft Research פרסמה את Orchard, מסגרת קוד פתוח להכשרת סוכני AI. דגם ה-3 מיליארד פרמטרים שלה מגיע ל-69.7% ב-SWE-bench Verified, שמתקרב למערכות גבול.
סוכני קידוד AI מודרניים את תוכנת חקר ההזדקנות, אך אינם יכולים לדעת אם המדע צודק
דו"ח שטח של OpenAI ושותפים אקדמיים מראה שסוכני קידוד AI יכולים לבנות מחדש כלי מחקר בני עשרות שנים מהר יותר עד פי 60, אך עדיין להישאר "שגויים בביטחון" לגבי הדיוק המדעי.
מודל 'אסטרה' של OpenAI פותר 10 בעיות מתמטיות פתוחות עבור פחות מ-2,000 דולר בחישוב
OpenAI אומרת שדגם ה-'Astra' שלה שטרם שוחרר פתר 10 בעיות מתמטיקה ומדעי המחשב שלא נפתרו בעבר תמורת פחות מ-2,000 דולר בחישוב, והציג אותו בפני סנאטורים אמריקאים כ-GPT-6 אפשרי.
לוח אבטחת FAR.AI חושף פערים פי מאה בהגנה על AI Frontier
לוח ה-AI Security Leaderboard החדש של FAR.AI מצא ש-Claude Fable 5 ו-GPT-5.6 Sol התנגדו לפריצות כלא, בעוד ש-Grok 4.5 ו-Gemini 3.1 Pro פרצו כל אחד בפחות מ-300 דולר, וחשפו פער בטיחות עצום בין דגמי החזית.
חוקר מדגים תולעת AI מתפשטת עצמית ב-Microsoft Copilot for Word
חשיפה מתואמת מראה שהוראות נסתרות יכולות לעבור בתולעת מסמכי Word באמצעות Copilot, להעתיק את עצמן קדימה ולשרוד שדרוג דגם ל-GPT-5.6.
המודל של קלוד 'מיתוס' של אנתרופיק מוצא פגמים אמיתיים בהצפנה המאבטחת את האינטרנט
Anthropic אומרת שמודל ה-Claude Mythos Preview שלה גילה חולשות אמיתיות באלגוריתמי ההצפנה של AES ו-HAWK, כולל צופן פוסט-קוונטי שבני אדם סקרו במשך שנתיים.
