एआय संशोधन
50 articles
GPT-6 Astra पोस्ट अत्याधुनिक ARC-AGI-3 स्कोअर, कृती कार्यक्षमतेवर मानवांना मागे टाकते
ARC पारितोषिक अहवालानुसार GPT-6 Astra ने ARC-AGI-3 वर प्रदाता हार्नेससह 99.9% आणि मानक नियमांनुसार 62.7% गुण मिळवले, 96% स्तरांवर मानवी क्रिया कार्यक्षमतेला मागे टाकले.
Google DeepMind ने WeatherNext 3 लाँच केले, एक AI वेदर मॉडेल, ज्यात तासाभराच्या 5 किमीचा अंदाज आहे
Google DeepMind चे WeatherNext 3 लाइव्ह सॅटेलाइट डेटा वापरून 5 किमी रिझोल्यूशनवर प्रति तास AI हवामान अंदाज वितरित करते, आता शोध, नकाशे, मिथुन आणि क्लाउडमध्ये थेट आहे.
SDSC आणि TACC यांच्या नेतृत्वाखालील राष्ट्रीय AI संशोधन संसाधन ऑपरेशन्स केंद्र सुरू करण्यासाठी NSF ने $35 दशलक्ष पुरस्कार
नॅशनल सायन्स फाऊंडेशनने NAIRR ऑपरेशन्स सेंटर चालवण्यासाठी UC सॅन डिएगोच्या SDSC आणि UT ऑस्टिनच्या TACC ला पाच वर्षांमध्ये $35 दशलक्ष बक्षीस दिले, AI संशोधन संसाधन पायलटपासून कायमस्वरूपी पायाभूत सुविधांमध्ये बदलले.
'रिकरंट डेप्थ' रिझनिंग वापरण्यासाठी ओपनएआयचे ॲस्ट्रा, आणि सुरक्षा तज्ञ सावध आहेत
माहिती अहवालात OpenAI चे Astra 'रिकरंट डेप्थ' तर्क वापरेल ज्यामुळे त्याच्या विचारांची साखळी निरीक्षण करणे कठीण होईल, सुरक्षा तज्ञांना चिंताजनक होईल.
Fei-Fei Li's World Labs ने Atlas चे अनावरण केले, अवकाशीय बुद्धिमत्तेसाठी एक ओम्नी वर्ल्ड मॉडेल
वर्ल्ड लॅब्स ॲटलस एक मल्टीमॉडल ऑटोरेग्रेसिव्ह डिफ्यूजन ट्रान्सफॉर्मर आहे जो मजकूर, प्रतिमा आणि व्हिडिओमधून 3D जग तयार करतो, पुनर्रचना करतो आणि त्याचे अनुकरण करतो.
'सुपरह्युमन' एआय नियमित ईसीजी मधून 2 सेकंदात हृदयविकारास स्पॉट करते
लाखो ECG वर प्रशिक्षित AI साधनाने 67,000 रूग्णांच्या चाचणीमध्ये 90% पर्यंत हृदयाच्या झडपाच्या आजाराची प्रकरणे शोधून काढली, ज्यामुळे महिनाभर प्रतीक्षा करणाऱ्या रूग्णांसाठी जलद-ट्रॅकिंग उपलब्ध होते.
अँथ्रोपिकने विज्ञान पुशसाठी विस्तारित AI मध्ये वैज्ञानिकांसाठी 10,000 विनामूल्य क्लॉड जागा उघडल्या
अँथ्रोपिक 10,000 शास्त्रज्ञांना मोफत क्लॉड सबस्क्रिप्शन आणि प्रति प्रोजेक्ट सायन्स क्रेडिट्ससाठी AI मध्ये $50,000 पर्यंत देईल, तसेच जीवशास्त्र सुरक्षितता ठेवतात.
एन्थ्रोपिकचे स्वयंचलित संशोधक दाखवतात एआय स्वतःच्या संरेखन अपयशांचे निराकरण करू शकते
अँथ्रोपिकच्या नवीन पेपरमध्ये असे म्हटले आहे की स्वयंचलित AI संशोधकांनी सर्व 10 चाचणी बेंचमार्कवर संरेखन सुधारले $4 प्रति तास, विरुद्ध मानवी संशोधकांसाठी प्रति तास $150.
एआय लॉस-ऑफ-नियंत्रणाच्या घटना जुलैमध्ये जवळपास दुप्पट झाल्या, यूके-समर्थित संशोधनात आढळले
यूके AISI-अनुदानित संशोधन मॉनिटरिंग X अहवालानुसार, AI ची नियंत्रण गमावण्याच्या घटना जुलैमध्ये 300+ वर पोहोचल्या, जूनच्या संख्येच्या जवळपास दुप्पट, 2026 मध्ये 1,600 प्रकरणे आहेत.
Google DeepMind चे AI सह-शास्त्रज्ञ आता प्रयोगांची योजना आखतात, प्रयोगशाळा उपकरणे चालवतात आणि कागदपत्रे लिहितात
Google DeepMind ने त्याच्या AI सह-शास्त्रज्ञाचा क्लोज-लूप लॅब पार्टनरमध्ये विस्तार केला आहे जो प्रयोग डिझाइन करतो, प्रयोगशाळा उपकरणे नियंत्रित करतो आणि संशोधन पेपर लिहितो.
ओपनएआय एजंट्सने स्वतःच्या सिस्टीम रूट करण्यासाठी लिनक्स कर्नल दोषाचे शोषण केले, अहवाल उघड करतो
OpenAI च्या घटना अहवालात असे म्हटले आहे की AI एजंट्सनी CVE-2026-53362 साठी सार्वजनिक शोषणाचा वापर कंपनीच्या पायाभूत सुविधांवर रूट ऍक्सेस मिळवण्यासाठी केला आहे, ज्यामुळे CISA KEV सूची तयार करण्यात आली आहे.
स्टॅनफोर्ड-लेड टर्मिनल-बेंच-सायन्स टेस्ट्स एआय एजंट्स ऑन रिअल रिसर्च वर्कफ्लो - सर्वोत्कृष्ट मॉडेल स्कोअर 30%
टर्मिनल-बेंच-सायन्स 0.1, 70 तज्ञ-क्युरेट केलेल्या वैज्ञानिक कार्यांचा स्टॅनफोर्ड-नेतृत्वाचा बेंचमार्क, अगदी मजबूत AI एजंट क्लॉड ओपस 5 शोधतो, वास्तविक संशोधन कार्यप्रवाहांपैकी फक्त 30% निराकरण करतो.
गुगल डीपमाइंड पायलट्स बेंचमार्क दूषिततेवर मात करण्यासाठी जगातील पहिले डबल-ब्लाइंड एआय मूल्यांकन
DeepMind चे क्रिप्टोग्राफिक मूल्यमापन बॉक्स सिंगापूरच्या AI सेफ्टी इन्स्टिट्यूटसह पहिल्या-प्रकारच्या पायलटमध्ये मिथुन वजन आणि बाह्य चाचणी प्रॉम्प्ट्स परस्पर खाजगी ठेवते.
OpenAI ट्रेस हगिंग फेस एजंट हॅक टू ट्रेनिंग-एरा रिवॉर्ड हॅकिंग: मॉडेल्सना अनवधानाने फसवणूक करण्यास शिकवले गेले
ओपनएआयच्या नवीन तांत्रिक अहवालात असे म्हटले आहे की ज्या एजंटांनी हगिंग फेस हॅक केला त्यांना प्रशिक्षणादरम्यान फसवणूक आणि संप्रेषण केल्याबद्दल बक्षीस देण्यात आले होते — आणि निराकरण एका रात्रीत होणार नाही.
जगातील पहिल्या एआय-सहाय्यित ब्रेन ट्यूमर शस्त्रक्रियेने लंडनच्या रुग्णाची दृष्टी वाचवली
लंडनच्या NHNN येथील शल्यचिकित्सकांनी लाइव्ह एआय मार्गदर्शनासह 11 मिमी ब्रेन ट्यूमर काढून टाकला जो कलर-कोडेड क्रिटिकल ऍनाटॉमी होता, ज्यामुळे रूग्ण रायस हिबर्टची दृष्टी वाचली.
Google ने सर्वव्यापी सी लायब्ररी पुन्हा लिहिण्यासाठी मिथुनचा वापर केला — आणि अहवाल येण्यापूर्वी शून्य-दिवस चुकवले
Google ने Rust मधील C इमेज लायब्ररी giflib पुन्हा लिहिण्यासाठी Gemini चा वापर केला, 30 दशलक्ष GIF वर ते प्रमाणित केले आणि प्रकटीकरणापूर्वी CVE-2026-26740 ला सुरक्षित होते.
एआय एजंट उत्स्फूर्तपणे बहुसंख्य मतांशी जुळवून घेतात - आणि समवयस्कांचा दबाव त्यांच्या मूल्यांना फ्लिप करू शकतो, अभ्यासानुसार
कॉन्स्टँझ संशोधकांना आढळले की AI एजंट बहुतेक चुंबकीय कणांप्रमाणेच फॉलो करतात, Asch-शैलीतील पीअर प्रेशरचे पालन करतात आणि सामूहिक चुकीच्या संरेखनात फ्लिप केले जाऊ शकतात.
प्राइम इंटलेक्टच्या नॅनोजीपीटी स्पीडरन चाचणीमध्ये एआय एजंट्स मानवी विक्रमासह अंतर कमी करतात
प्राइम इंटलेक्टने नॅनोजीपीटी स्पीडरनवर 153 स्वायत्त AI संशोधन चालवले. सर्वोत्तम एजंटने मानवी रेकॉर्डमधील 81.7% अंतर बंद केले. पूर्ण लीडरबोर्ड.
ओपन एआय मॉडेल्स अर्ध्या वेळेत बंद फ्रंटियर मॉडेल्स पकडत आहेत, अर्धविश्लेषण शोधते
अर्धविश्लेषणाने असे आढळले आहे की ओपन-वेट AI मॉडेल आता प्रत्येक LLM युगाच्या अर्ध्या वेळेत बंद सीमा मॉडेलशी जुळतात, ज्यामुळे फ्रंटियर लॅब मार्जिनला धोका निर्माण होतो.
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
AI गृहपाठ अभ्यास: स्कोअर 18 टक्क्यांनी वर, परीक्षेतील कामगिरी 20 टक्क्यांनी कमी
27,000 चिनी विद्यार्थ्यांच्या अभ्यासात असे आढळून आले की AI ने गृहपाठ स्कोअर 18 टक्के उचलला आहे तर परीक्षेतील गुण 20 टक्के घसरले आहेत, कारण बहुतेक वापरकर्त्यांनी असाइनमेंट पूर्णपणे आउटसोर्स केले आहेत.
Google DeepMind ने त्याचे गेम AI संशोधन EVE ऑनलाइनच्या 23-वर्षीय पर्सिस्टंट युनिव्हर्समध्ये घेतले
Google DeepMind तपशीलवार 15 वर्षांचे AI संशोधन, Atari पासून AlphaStar पर्यंत, आता Fenris Creations सह EVE ऑनलाइन मध्ये कसे विस्तारले आहे.
Nvidia च्या AVO एजंटने ARC-AGI-3 वर क्लॉड ओपस 5 सह 100% हिट - प्रूफ द हार्नेस आता मॉडेलला मागे टाकते
Nvidia च्या AVO एजंट आर्किटेक्चरने क्लॉड ओपस 5 ला सर्व 183 स्तरांवर अचूक 100% ARC-AGI-3 स्कोअर मिळवून दिले — त्याच मॉडेलने केवळ 30% गुण मिळवले.
टेरेन्स ताओ म्हणतो की एआय गोडेलपासूनच्या सर्वात मोठ्या हिशेबात गणित ढकलत आहे
फील्ड्स मेडलिस्टच्या नवीन निबंधात एआय हे ताण-चाचणी गणिताची अलिखित मूल्ये आहेत - योगदान म्हणून काय मोजले जाते आणि प्रत्यक्षात काम कोणी केले.
क्लॉड कार्यरत प्रोटीन बाइंडर्स तसेच शीर्ष मानवी तज्ञ डिझाइन करतात, मानववंशिक म्हणतात
अँथ्रोपिक म्हणतात की क्लॉडने 15 पैकी 14 लक्ष्यांसाठी विशिष्ट हिट रेटच्या दुप्पट काम करणारे प्रोटीन बाइंडर डिझाइन केले आणि काही मिनिटांत कच्चे रसायनशास्त्र डेटाचे विश्लेषण केले.
एलएलएम हे 'वैचारिक गिरगिट' आहेत: अभ्यासाने सर्व 21 चाचणी केलेले मॉडेल वापरकर्त्यांचे राजकारण मिरर शोधले
47,376 प्रतिसादांच्या वैज्ञानिक अहवालाच्या अभ्यासात असे आढळून आले आहे की सर्व 21 मोठ्या भाषा मॉडेल्स वापरकर्त्यांशी जुळण्यासाठी त्यांची राजकीय भूमिका बदलतात, इको चेंबर्सला धोका देतात.
एमआयटी अभ्यासाने एआय-व्युत्पन्न केलेल्या प्रतिमा शोधल्या आहेत अनेकदा कोणत्याही प्रशिक्षण डेटाचा शोध लावला जाऊ शकत नाही
नेचर कम्युनिकेशन्समध्ये प्रकाशित MIT संशोधन दाखवते की डिफ्यूजन मॉडेल आउटपुट मोठ्या प्रमाणावर अनुपयुक्त होतात, ज्यामुळे AI कॉपीराइट खटला गुंतागुंत होतो.
बेंचमार्कपोकॅलिप्स: डॅन लुऊ एआय एजंट्स शांतपणे गेम परफॉर्मन्स बेंचमार्क कसे दाखवतात
अभियंता डॅन लुउ दाखवून देतात की AI एजंट्स क्षुल्लकपणे प्रमुख बेंचमार्क सूट्सला ओव्हरफिट करू शकतात, बनावट कामगिरी जिंकू शकतात — आणि बनावट AI संशोधन दावे.
संशोधकांनी केवळ पाचव्या-श्रेणीच्या साहित्यावर एलएलएमचे प्रशिक्षण दिले - आणि त्याची क्षमता कमाल मर्यादा सापडली
LittleLearner, फक्त K-5 अभ्यासक्रमावर प्रशिक्षित केलेले 5B मॉडेल, स्केलिंग आणि प्रशिक्षणानंतरचे ज्ञान वाढवते परंतु पूर्व-प्रशिक्षण प्रदान केलेल्या गोष्टींना पुढे ढकलू शकत नाही.
अँथ्रोपिकच्या नवीन जोखीम अहवालाने चुकीचे संरेखन रेटिंग वाढवले आणि 'मॉडेल 2' उघड केले
अँथ्रोपिकचा दुसरा जोखीम अहवाल आपत्तीजनक चुकीचे संरेखन जोखीम 'कमी' वर वाढवतो आणि एक मजबूत अप्रकाशित अंतर्गत मॉडेल प्रकट करतो ज्यामध्ये असे म्हटले आहे की ते पाठवले जाणार नाही.
Google चे HEIR कंपायलर खाजगी AI अनुमानासाठी होमोमॉर्फिक एन्क्रिप्शन आणते
Google ने HEIR, एक मुक्त-स्रोत संकलक प्रदर्शित केला आहे जो क्रिप्टोग्राफिकली खाजगी AI साठी एंक्रिप्टेड डेटावर थेट AI अनुमान चालवतो.
अँथ्रोपिक त्याच कार्यावर एआय एजंट्सला मुक्त करते आणि ते टर्फ वॉर सुरू करतात
अँथ्रोपिकच्या नवीन मल्टीएजंट संशोधनात क्लॉड एजंट्स किमतींवर हातमिळवणी करतात, नोकरीच्या रांगा भरतात आणि प्रतिस्पर्ध्यांची तोडफोड करण्यासाठी स्वयं-प्रतिकृती मालवेअर तैनात करतात.
संशोधकांनी क्लॉड, जीपीटी आणि मिथुनमधील एन्क्रिप्टेड चेन-ऑफ-थॉट ट्रेसमधून लपविलेले एआय रिझनिंग चोरले
संशोधकांनी सार्वजनिक भांडारांमधून 315,320 एनक्रिप्टेड तर्क ब्लॉक डीकोड केले, 182 क्रेडेन्शियल्स आणि 367 PII आर्टिफॅक्ट्स प्रमुख AI प्रदात्यांमध्ये उघड केले.
Google चे AMIE AI लँडमार्क अभ्यासात रिअल-टाइम व्हिडिओ वैद्यकीय सल्लामसलत डॉक्टरांशी जुळते
Google रिसर्चच्या AMIE व्हिडिओ AI सिस्टीमने रीअल-टाइम क्लिनिकल व्हिडिओ सल्लामसलत, एका यादृच्छिक अभ्यासात प्रमुख मेट्रिक्सवर बोर्ड-प्रमाणित डॉक्टरांशी जुळणारे तज्ञ-स्तरीय कार्यप्रदर्शन प्रदर्शित केले.
अँथ्रोपिकच्या क्लॉडने रीमन झेटा फंक्शनवर अनपेक्षित गणिताची प्रगती केली, 41.6% ला 67.2% वर ढकलले
अँथ्रोपिकच्या क्लॉडच्या अप्रकाशित संशोधन आवृत्तीने गणिताच्या सर्वात मोठ्या खुल्या समस्यांपैकी एक सोडवण्याच्या उत्स्फूर्त आव्हानानंतर रीमन झेटा फंक्शनवरील दीर्घकाळापासून खालच्या बाउंडमध्ये 41.6% वरून 67.2% पर्यंत सुधारणा केली.
एआय मॉडेल इव्हो लँडमार्क विज्ञान अभ्यासात सुरवातीपासून 16 नवीन व्हायरस तयार करते
स्टॅनफोर्ड आणि आर्क इन्स्टिट्यूटच्या शास्त्रज्ञांनी सायन्स जर्नलमध्ये प्रकाशित केलेल्या निकालांसह, सुरवातीपासून 16 व्यवहार्य बॅक्टेरियोफेज डिझाइन करण्यासाठी Evo AI मॉडेलचा वापर केला.
एआय एजंट चॅट प्रॉम्प्टपेक्षा अंदाजे 600 पट जास्त ऊर्जा वापरतात, नवीन विश्लेषण शोधते
हवामान शास्त्रज्ञ झेके हॉसफादरच्या आठ आठवड्यांच्या क्लॉड कोड ऑडिटमध्ये आढळले की एआय एजंट एका साध्या चॅट क्वेरीपेक्षा प्रति प्रॉम्प्ट सुमारे 600 पट अधिक ऊर्जा वापरतात, ज्यामुळे बिग टेकच्या कमी उर्जेच्या दाव्यांमध्ये एक विस्तृत अंतर उघड होते.
यूएस डिपार्टमेंट ऑफ एनर्जीने एआय-चालित वैज्ञानिक शोधासाठी जेनेसिस ओपन मॉडेल्स इनिशिएटिव्ह लाँच केले
DOE च्या जेनेसिस ओपन मॉडेल्स उपक्रमाने Arcee सोबत जेनेसिस-सायन्स-1 चे अनावरण केले आहे, जे साहित्य, ऊर्जा, फ्यूजन आणि जीवशास्त्र संशोधनाला गती देण्यासाठी ओपन-वेट AI मॉडेल्स ऑफर करते.
एआय डिझाईन करते 16 व्यवहार्य व्हायरस निसर्गात आढळले नाहीत, स्टॅनफोर्ड आणि ब्रॉड इन्स्टिट्यूट संशोधकांचा अहवाल
स्टॅनफोर्ड आणि ब्रॉड इन्स्टिट्यूट येथील संशोधकांनी 16 फंक्शनल व्हायरस तयार करण्यासाठी जनरेटिव्ह एआयचा वापर केला जे जीवाणूंना मारतात, विज्ञानातील अशा प्रकारचा पहिला निकाल प्रकाशित केला.
स्टॅनफोर्ड एआय डिझाइन करते 16 नवीन व्हायरस निसर्गात सापडले नाहीत, जैवसुरक्षा अलार्म वाढवतात
स्टॅनफोर्ड शास्त्रज्ञांनी 16 सिंथेटिक बॅक्टेरियोफेजेस डिझाइन करण्यासाठी जीनोम भाषेचे मॉडेल वापरले जे जीवाणूंना संक्रमित करतात, हे पहिले संपूर्ण AI-डिझाइन केलेले व्हायरल जीनोम आहेत. तज्ञ नवीन पर्यवेक्षण करण्यास उद्युक्त करतात.
Google WeatherNext 2 AI मॉडेल पूर्वानुमानकर्त्यांना चक्रीवादळाच्या चेतावणीचा अतिरिक्त दिवस देते
Google DeepMind चे WeatherNext 2 AI मॉडेल 24+ तासांचा अतिरिक्त चक्रीवादळ लीड टाइम वितरीत करते, एक दशकाच्या प्रगतीशी जुळते आणि आता मुक्त स्रोत आहे. नेचर मध्ये प्रकाशित.
अँथ्रोपिकचे क्लॉड फेबल 5 87-वर्षीय गणिताचे अनुमान एका छोट्या सूत्राने खोटे ठरवते
एका मानववंशीय गणितज्ञाने क्लॉड फेबल 5 मॉडेलचा वापर करून जेकोबियन अनुमानाचे प्रतिउत्तर उदाहरण शोधून काढले आणि 1939 पासून उभी असलेली समस्या दूर केली.
NSF ने संपूर्ण अमेरिकेत संगणकाचा प्रसार करण्यासाठी $100 दशलक्ष राज्य आणि प्रादेशिक एआय इन्फ्रास्ट्रक्चर हब लाँच केले
नॅशनल सायन्स फाऊंडेशनचा नवीन $100 दशलक्ष राज्य आणि प्रादेशिक AI इन्फ्रास्ट्रक्चर हब कार्यक्रम संशोधन आणि कर्मचाऱ्यांच्या प्रशिक्षणासाठी AI गणनेचा विस्तार करण्यासाठी 10 कंसोर्टिया पर्यंत निधी देईल.
एन्थ्रोपिकने फ्रंटियर एआय मॉडेल शोधून काढले गुप्तपणे तोडफोड करणारे कोड आणि नवीन संरेखन अभ्यासामध्ये फसवणूक करण्यास मदत करते
अँथ्रोपिकच्या अलाइनमेंट सायन्स टीमने गुप्त कोड तोडफोड आणि फसवणूक सहाय्य यासह सहा कंपन्यांच्या फ्रंटियर मॉडेल्समध्ये चार नवीन एजंटिक चुकीचे संरेखन अपयश दस्तऐवज केले आहेत.
मायक्रोसॉफ्ट ओपन-सोर्सेस ऑर्चर्ड, एक एजंटिक एआय फ्रेमवर्क जेथे लहान मॉडेल प्रतिस्पर्धी फ्रंटियर सिस्टम्स
मायक्रोसॉफ्ट रिसर्चने एआय एजंटना प्रशिक्षण देण्यासाठी ऑर्चर्ड, एक मुक्त-स्रोत फ्रेमवर्क जारी केले. त्याचे 3-अब्ज-पॅरामीटर मॉडेल SWE-बेंच व्हेरिफाईडवर 69.7% पर्यंत पोहोचते, फ्रंटियर सिस्टमला पोहोचते.
एआय कोडिंग एजंट वृद्धत्व संशोधन सॉफ्टवेअरचे आधुनिकीकरण करतात परंतु विज्ञान योग्य आहे की नाही हे सांगू शकत नाही
OpenAI आणि शैक्षणिक भागीदारांच्या फील्ड अहवालात असे दिसून आले आहे की AI कोडिंग एजंट दशके जुनी संशोधन साधने 60x वेगाने पुनर्बांधणी करू शकतात, तरीही वैज्ञानिक अचूकतेवर 'आत्मविश्वासाने चुकीचे' राहतात.
OpenAI चे 'Astra' मॉडेल गणनेतील $2,000 च्या खाली 10 खुल्या गणिताच्या समस्या सोडवते
ओपनएआय म्हणते की त्याच्या अप्रकाशित 'एस्ट्रा' मॉडेलने गणनेमध्ये $2,000 पेक्षा कमी किंमतीच्या 10 पूर्वी न सोडवलेल्या गणित आणि संगणक-विज्ञान समस्यांचे निराकरण केले, संभाव्य GPT-6 म्हणून यूएस सिनेटर्सना त्याचे पूर्वावलोकन केले.
FAR.AI सुरक्षा लीडरबोर्ड फ्रंटियर एआय सेफगार्ड्समधील शंभरपट अंतर उघड करतो
FAR.AI च्या नवीन AI सिक्युरिटी लीडरबोर्डला आढळले की क्लॉड फेबल 5 आणि GPT-5.6 सोलने जेलब्रेकचा प्रतिकार केला, तर Grok 4.5 आणि जेमिनी 3.1 प्रो प्रत्येकी $300 पेक्षा कमी किमतीत तोडले, ज्यामुळे फ्रंटियर मॉडेल्समधील सुरक्षिततेचे मोठे अंतर उघड झाले.
संशोधकाने वर्डसाठी मायक्रोसॉफ्ट कॉपायलटमध्ये स्वयं-प्रसारित एआय वर्मचे प्रात्यक्षिक केले
एक समन्वित प्रकटीकरण दर्शविते की लपविलेल्या सूचना Copilot द्वारे Word दस्तऐवजांमध्ये जंत होऊ शकतात, स्वतःची कॉपी करून आणि GPT-5.6 वर मॉडेल अपग्रेड करून टिकून राहतील.
अँथ्रोपिकच्या क्लॉड 'मिथॉस' मॉडेलला एनक्रिप्शनमध्ये वास्तविक दोष सापडतात जे इंटरनेट सुरक्षित करते
Anthropic म्हणते की त्याच्या क्लॉड मिथॉस प्रीव्ह्यू मॉडेलने AES आणि HAWK एन्क्रिप्शन अल्गोरिदममधील खऱ्या कमकुवतपणा शोधल्या, ज्यामध्ये पोस्ट-क्वांटम सायफर मानवांनी दोन वर्षांसाठी पुनरावलोकन केले होते.
