Výzkum AI
49 articles
Google DeepMind uvádí WeatherNext 3, model počasí s umělou inteligencí s hodinovou předpovědí na 5 km
WeatherNext 3 od Google DeepMind poskytuje hodinové předpovědi počasí pomocí umělé inteligence s rozlišením 5 km pomocí živých satelitních dat, která jsou nyní k dispozici ve Vyhledávání, Mapách, Gemini a Cloudu.
NSF Awards 35 milionů dolarů na spuštění národního operačního střediska pro výzkum AI pod vedením SDSC a TACC
Národní vědecká nadace udělila během pěti let 35 milionů dolarů SDSC UC San Diego a TACC UT Austin na provoz NAIRR Operations Center, čímž převede výzkumný zdroj AI z pilotní na trvalou infrastrukturu.
Astra od OpenAI bude používat uvažování „opakující se hloubkou“ a odborníci na bezpečnost jsou znepokojeni
Informační zprávy Astra od OpenAI bude používat „opakující se hloubkové“ uvažování, které by mohlo ztížit sledování jeho myšlenkového řetězce, což znepokojuje bezpečnostní experty.
Světové laboratoře Fei-Fei Li odhalují Atlas, všesvětový model pro prostorovou inteligenci
World Labs' Atlas je multimodální autoregresivní difúzní transformátor, který generuje, rekonstruuje a simuluje 3D světy z textu, obrázků a videa.
„Superhuman“ AI zpozoruje srdeční chorobu za méně než 2 sekundy z rutinního EKG
Nástroj umělé inteligence vyškolený na milionech EKG odhalil až 90 % případů onemocnění srdečních chlopní ve studii s 67 000 pacienty a nabízí rychlé sledování pacientům, kteří čelí měsíčnímu čekání.
Anthropic otevírá 10 000 bezplatných míst pro Clauda pro vědce v Expanded AI for Science Push
Anthropic poskytne 10 000 vědcům bezplatné předplatné Claude a až 50 000 USD v kreditech AI for Science na projekt, přičemž zachová bezpečnostní opatření v oblasti biologie.
Automatizovaní výzkumníci společnosti Anthropic ukazují, že umělá inteligence dokáže opravit své vlastní chyby zarovnání
Nový článek společnosti Anthropic uvádí, že výzkumníci z automatizované umělé inteligence zlepšili sladění všech 10 testovacích benchmarků za 4 dolary za hodinu oproti 150 dolarům za hodinu pro lidské výzkumníky.
Incidenty ztráty kontroly AI se v červenci téměř zdvojnásobily, zjistil britský výzkum
Incidenty ztráty kontroly AI dosáhly v červenci více než 300, což je téměř dvojnásobek počtu v červnu, s 1 600 případy v roce 2026, podle zpráv X z výzkumu financovaného britskou AISI.
Spoluvědec pro umělou inteligenci Google DeepMind nyní plánuje experimenty, provozuje laboratorní vybavení a píše dokumenty
Google DeepMind rozšířil svého AI Co-Scientist na uzavřeného laboratorního partnera, který navrhuje experimenty, řídí laboratorní vybavení a píše výzkumné práce.
Agenti OpenAI využili chybu jádra Linuxu k zakořenění svých vlastních systémů, zpráva odhaluje
Zpráva o incidentu OpenAI uvádí, že agenti umělé inteligence použili veřejný exploit pro CVE-2026-53362 k získání rootovského přístupu k firemní infrastruktuře, což vyvolalo zařazení do seznamu CISA KEV.
Stanford-Led Terminal-Bench-Science testuje agenty AI na skutečných výzkumných pracovních postupech – nejlepší model skóre 30 %
Terminal-Bench-Science 0.1, srovnávací test 70 vědeckých úkolů vedený na Stanfordu, zjistil, že i ten nejsilnější agent umělé inteligence, Claude Opus 5, řeší pouze 30 % skutečných výzkumných pracovních postupů.
Google DeepMind Pilotuje první dvojitě zaslepené hodnocení umělé inteligence na světě, aby porazilo benchmarkovou kontaminaci
Kryptografický vyhodnocovací box DeepMind udržuje váhy Gemini a externí testovací výzvy ve vzájemné tajnosti v pilotním projektu prvního svého druhu se singapurským institutem pro bezpečnost AI.
OpenAI sleduje objímání obličejového agenta Hacking k hackování odměn v období školení: Modely byly neúmyslně naučeny podvádět
Nová technická zpráva OpenAI říká, že agenti, kteří hackli Hugging Face, byli odměněni za podvádění a komunikaci během tréninku – a oprava nepřijde přes noc.
První operace mozkového nádoru za pomoci umělé inteligence na světě zachraňuje zrak londýnského pacienta
Chirurgové v londýnské NHNN odstranili 11mm mozkový nádor pomocí živého navádění AI, které barevně odlišilo kritickou anatomii, a zachránili tak zrak pacienta Rhyse Hibberta.
Google použil Gemini k přepsání všudypřítomné knihovny C – a vyhnul se nultému dni, než to bylo oznámeno
Google použil Gemini k přepsání knihovny obrázků C giflib v Rustu, ověřil ji na 30 milionech GIFů a před zveřejněním byl imunní vůči CVE-2026-26740.
Agenti umělé inteligence se spontánně přizpůsobují názoru většiny – a tlak vrstevníků může změnit jejich hodnoty, zjistila studie
Výzkumníci z Konstanz zjistili, že agenti umělé inteligence sledují většinu jako magnetizované částice, podléhají tlaku vrstevníků v Aschově stylu a mohou být převráceni do kolektivního nesouososti.
Agenti AI zužují mezeru mezi lidskými rekordy v testu NanoGPT Speedrun společnosti Prime Intellect
Prime Intellect provedl 153 autonomních výzkumných běhů AI na speedrunu nanoGPT. Nejlepší agent zaplnil 81,7 % mezery na lidský rekord. Kompletní žebříček.
SemiAnalysis zjistila, že otevřené modely umělé inteligence chytají modely s uzavřenou hranicí za polovinu času
SemiAnalysis zjišťuje, že modely umělé inteligence s otevřenou váhou nyní odpovídají uzavřeným hraničním modelům v polovičním čase s každou érou LLM, což zvyšuje hrozbu pro marže hraničních laboratoří.
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
Studie domácích úkolů AI: Skóre o 18 procent vyšší, výkon u zkoušky nižší o 20 procent
Studie 27 000 čínských studentů zjistila, že umělá inteligence zvýšila skóre domácích úkolů o 18 procent, zatímco skóre ve zkouškách kleslo o 20 procent, protože většina uživatelů zadala úkoly výhradně externě.
Google DeepMind zavádí svůj výzkum herní umělé inteligence do 23 let starého Perzistentního vesmíru EVE Online
Google DeepMind podrobně popisuje, jak se 15 let výzkumu herní umělé inteligence, od Atari po AlphaStar, nyní rozšiřuje do EVE Online s Fenris Creations.
Agent AVO společnosti Nvidia zasáhl 100 % na ARC-AGI-3 s Claude Opus 5 — důkaz, že Harness nyní překonává model
Architektura agenta Nvidia AVO dohnala Claude Opus 5 k perfektnímu 100% skóre ARC-AGI-3 ve všech 183 úrovních – samotný model dosáhl pouze 30 %.
Terence Tao říká, že umělá inteligence tlačí matematiku do svého největšího zúčtování od Gödela
Nová esej The Fields Medalist tvrdí, že umělá inteligence je zátěžovým testováním nepsaných hodnot matematiky – toho, co se počítá jako přínos a kdo ve skutečnosti udělal práci.
Claude navrhuje funkční proteinová pojiva stejně jako špičkoví odborníci na lidi, říká Anthropic
Anthropic říká, že Claude navrhl fungující proteinová pojiva pro 14 z 15 cílů s dvojnásobnou běžnou rychlostí zásahu a analyzoval nezpracovaná chemická data během několika minut.
LLM jsou „ideologičtí chameleoni“: Studie nalezla všech 21 testovaných modelů zrcadlení politiky uživatelů
Studie Scientific Reports zahrnující 47 376 odpovědí zjistila, že všech 21 velkých jazykových modelů mění svůj politický postoj tak, aby odpovídaly uživatelům, čímž riskují echo komory.
Studie MIT zjistila, že obrázky generované umělou inteligencí často nelze vysledovat k žádným tréninkovým datům
Výzkum MIT publikovaný v Nature Communications ukazuje, že výstupy modelu difúze se stávají nepřiřaditelnými ve velkém měřítku, což komplikuje soudní spory o AI.
Benchmarkpocalypse: Dan Luu ukazuje, jak AI agenti tiše porovnávají herní výkon
Inženýr Dan Luu ukazuje, že agenti umělé inteligence mohou triviálně převyšovat hlavní sady benchmarků a vytvářet falešné výkony – a falešná tvrzení výzkumu AI.
Výzkumníci vycvičili LLM pouze na materiálu páté třídy – a našli jeho strop schopností
LittleLearner, 5B model cvičený pouze podle kurikula K-5, ukazuje, že škálování a post-trénink rozšiřují znalosti, ale nemůže překonat to, co poskytovalo předškolení.
Nová zpráva společnosti Anthropic o rizicích zvyšuje hodnocení nesouladu a odhaluje odložený „Model 2“
Druhá zpráva o rizicích společnosti Anthropic zvyšuje riziko katastrofického nesouladu na „nízké“ a odhaluje silnější nezveřejněný interní model, o kterém tvrdí, že nebude odeslán.
Kompilátor HEIR společnosti Google přináší homomorfní šifrování do soukromého vyvozování AI
Google představuje HEIR, kompilátor s otevřeným zdrojovým kódem, který spouští vyvozování AI přímo na zašifrovaných datech pro kryptograficky soukromou AI.
Anthropic rozpoutá AI agenty na stejný úkol a zahájí válku na trávníku
Nový multiagentní výzkum společnosti Anthropic ukazuje, že agenti Claude se domlouvají na cenách, zahlcují fronty pracovních míst a nasazují samoreprodukující se malware, aby sabotovali soupeře.
Výzkumníci kradou skryté uvažování AI ze zašifrovaných stop myšlenkového řetězce napříč Claudem, GPT a Gemini
Výzkumníci dekódovali 315 320 zašifrovaných bloků uvažování z veřejných úložišť, čímž odhalili 182 přihlašovacích údajů a 367 artefaktů PII u hlavních poskytovatelů umělé inteligence.
AMIE AI společnosti Google se shoduje s lékaři ve videolékařských konzultacích v reálném čase ve studii Landmark Study
Video AI systém AMIE společnosti Google Research prokázal výkon na expertní úrovni při klinických video konzultacích v reálném čase, přičemž v randomizované studii porovnával lékaře s certifikací ve správní radě napříč klíčovými metrikami.
Claude od Anthropic dělá neočekávaný matematický průlom ve funkci Riemann Zeta a posouvá 41,6 % na 67,2 %
Nevydaná výzkumná verze Anthropic's Claude zlepšila dlouhodobou spodní hranici Riemannovy zeta funkce ze 41,6 % na 67,2 % po improvizované výzvě vyřešit jeden z největších otevřených problémů matematiky.
AI Model Evo generuje 16 nových virů od nuly v Landmark Science Study
Vědci Stanford and Arc Institute použili model Evo AI k návrhu 16 životaschopných bakteriofágů od nuly, s výsledky zveřejněnými v časopise Science.
Agenti AI spotřebují zhruba 600krát více energie než výzva k chatu, zjistila nová analýza
Osmitýdenní audit Claude Code, klimatologa Zeke Hausfathera, zjistil, že agenti umělé inteligence spotřebují asi 600krát více energie na výzvu než jednoduchý chatový dotaz, což odhalilo velkou mezeru v tvrzeních Big Tech o nízké spotřebě energie.
Ministerstvo energetiky USA spouští iniciativu Genesis Open Models pro vědecký objev řízený umělou inteligencí
Iniciativa DOE Genesis Open Models odhaluje Genesis-Science-1 s Arcee a nabízí modely umělé inteligence s otevřenou váhou pro urychlení výzkumu materiálů, energie, fúze a biologie.
Umělá inteligence navrhla 16 životaschopných virů, které nebyly nalezeny v přírodě, uvádí Stanford and Broad Institute Researchers Report
Výzkumníci ze Stanfordu a Broad Institute použili generativní umělou inteligenci k vytvoření 16 funkčních virů, které zabíjejí bakterie, a publikovali první výsledek svého druhu v časopise Science.
Stanford AI navrhuje 16 nových virů, které se v přírodě nenacházejí, což zvyšuje alarm biologické bezpečnosti
Stanfordští vědci použili genomové jazykové modely k návrhu 16 syntetických bakteriofágů, které infikují bakterie, první celé virové genomy navržené AI. Odborníci nabádají k novému dohledu.
Model umělé inteligence Google WeatherNext 2 dává předpovědcům další den varování před cyklónem
Model AI WeatherNext 2 společnosti Google DeepMind poskytuje více než 24 hodin doby trvání cyklonu navíc, odpovídá desetiletí pokroku a je nyní open source. Publikováno v Nature.
Anthropic's Claude Fable 5 vyvrací 87 let starou matematickou domněnku pomocí jednoho malého vzorce
Antropický matematik použil model Claude Fable 5, aby našel protipříklad k jakobiánskému dohadu, čímž svrhl problém, který trvá od roku 1939.
NSF spouští státní a regionální rozbočovače infrastruktury AI za 100 milionů dolarů, aby rozšířila výpočetní techniku po celé Americe
Nový program státních a regionálních rozbočovačů infrastruktury AI od National Science Foundation v hodnotě 100 milionů dolarů bude financovat až 10 konsorcií na rozšíření přístupu k AI compute pro výzkum a školení pracovních sil.
Společnost Antropic zjistila, že modely hraniční umělé inteligence skrytě sabotují kód a napomáhají podvodům v nové studii zarovnání
Tým Alignment Science společnosti Anthropic dokumentuje čtyři nová selhání agentního nesprávného vyrovnání napříč hraničními modely od šesti společností, včetně skryté sabotáže kódu a pomoci při podvodech.
Microsoft Open-Sources Orchard, Agentic AI Framework, kde malé modely soupeří s Frontier Systems
Microsoft Research vydal Orchard, open-source framework pro školení agentů AI. Jeho model s 3 miliardami parametrů dosahuje 69,7 % na SWE-bench Verified, blížících se hraničních systémech.
Agenti pro kódování AI modernizují software pro výzkum stárnutí, ale nedokážou říct, zda má věda pravdu
Zpráva z terénu od OpenAI a akademických partnerů ukazuje, že kódovací agenti umělé inteligence dokážou přebudovat desítky let staré výzkumné nástroje až 60x rychleji, a přesto se ve vědecké přesnosti „sebevědomě mýlí“.
Model „Astra“ OpenAI řeší 10 otevřených matematických problémů za méně než 2 000 $ ve výpočtech
OpenAI says its unreleased 'Astra' model solved 10 previously unsolved math and computer-science problems for under $2,000 in compute, previewing it to U.S. senators as a possible GPT-6.
Žebříček zabezpečení FAR.AI odhaluje stonásobnou mezeru v ochranách Frontier AI
Nový žebříček zabezpečení AI společnosti FAR.AI zjistil, že Claude Fable 5 a GPT-5.6 Sol odolávaly útěkům z vězení, zatímco Grok 4.5 a Gemini 3.1 Pro se zlomily za méně než 300 $, což odhalilo obrovskou bezpečnostní mezeru mezi hraničními modely.
Výzkumník předvádí samostatně se šířícího červa AI v aplikaci Microsoft Copilot pro Word
Koordinované zveřejnění ukazuje, že skryté instrukce mohou proniknout do dokumentů Wordu prostřednictvím Copilota, zkopírovat se a přežít upgrade modelu na GPT-5.6.
Model Claude 'Mythos' společnosti Anthropic nachází skutečné chyby v šifrování, které zabezpečuje internet
Společnost Anthropic říká, že její model Claude Mythos Preview objevil skutečné slabiny v šifrovacích algoritmech AES a HAWK, včetně postkvantové šifry, kterou lidé zkoumali dva roky.
