Výzkum AI

49 articles

Google DeepMind uvádí WeatherNext 3, model počasí s umělou inteligencí s hodinovou předpovědí na 5 km
Výzkum AI

Google DeepMind uvádí WeatherNext 3, model počasí s umělou inteligencí s hodinovou předpovědí na 5 km

WeatherNext 3 od Google DeepMind poskytuje hodinové předpovědi počasí pomocí umělé inteligence s rozlišením 5 km pomocí živých satelitních dat, která jsou nyní k dispozici ve Vyhledávání, Mapách, Gemini a Cloudu.

4. 9. 20264 min read
NSF Awards 35 milionů dolarů na spuštění národního operačního střediska pro výzkum AI pod vedením SDSC a TACC
Výzkum AI

NSF Awards 35 milionů dolarů na spuštění národního operačního střediska pro výzkum AI pod vedením SDSC a TACC

Národní vědecká nadace udělila během pěti let 35 milionů dolarů SDSC UC San Diego a TACC UT Austin na provoz NAIRR Operations Center, čímž převede výzkumný zdroj AI z pilotní na trvalou infrastrukturu.

3. 9. 20264 min read
Astra od OpenAI bude používat uvažování „opakující se hloubkou“ a odborníci na bezpečnost jsou znepokojeni
Výzkum AI

Astra od OpenAI bude používat uvažování „opakující se hloubkou“ a odborníci na bezpečnost jsou znepokojeni

Informační zprávy Astra od OpenAI bude používat „opakující se hloubkové“ uvažování, které by mohlo ztížit sledování jeho myšlenkového řetězce, což znepokojuje bezpečnostní experty.

3. 9. 20265 min read
Světové laboratoře Fei-Fei Li odhalují Atlas, všesvětový model pro prostorovou inteligenci
Výzkum AI

Světové laboratoře Fei-Fei Li odhalují Atlas, všesvětový model pro prostorovou inteligenci

World Labs' Atlas je multimodální autoregresivní difúzní transformátor, který generuje, rekonstruuje a simuluje 3D světy z textu, obrázků a videa.

1. 9. 20265 min read
„Superhuman“ AI zpozoruje srdeční chorobu za méně než 2 sekundy z rutinního EKG
Výzkum AI

„Superhuman“ AI zpozoruje srdeční chorobu za méně než 2 sekundy z rutinního EKG

Nástroj umělé inteligence vyškolený na milionech EKG odhalil až 90 % případů onemocnění srdečních chlopní ve studii s 67 000 pacienty a nabízí rychlé sledování pacientům, kteří čelí měsíčnímu čekání.

1. 9. 20265 min read
Anthropic otevírá 10 000 bezplatných míst pro Clauda pro vědce v Expanded AI for Science Push
Výzkum AI

Anthropic otevírá 10 000 bezplatných míst pro Clauda pro vědce v Expanded AI for Science Push

Anthropic poskytne 10 000 vědcům bezplatné předplatné Claude a až 50 000 USD v kreditech AI for Science na projekt, přičemž zachová bezpečnostní opatření v oblasti biologie.

31. 8. 20265 min read
Automatizovaní výzkumníci společnosti Anthropic ukazují, že umělá inteligence dokáže opravit své vlastní chyby zarovnání
Výzkum AI

Automatizovaní výzkumníci společnosti Anthropic ukazují, že umělá inteligence dokáže opravit své vlastní chyby zarovnání

Nový článek společnosti Anthropic uvádí, že výzkumníci z automatizované umělé inteligence zlepšili sladění všech 10 testovacích benchmarků za 4 dolary za hodinu oproti 150 dolarům za hodinu pro lidské výzkumníky.

29. 8. 20265 min read
Incidenty ztráty kontroly AI se v červenci téměř zdvojnásobily, zjistil britský výzkum
Výzkum AI

Incidenty ztráty kontroly AI se v červenci téměř zdvojnásobily, zjistil britský výzkum

Incidenty ztráty kontroly AI dosáhly v červenci více než 300, což je téměř dvojnásobek počtu v červnu, s 1 600 případy v roce 2026, podle zpráv X z výzkumu financovaného britskou AISI.

29. 8. 20264 min read
Spoluvědec pro umělou inteligenci Google DeepMind nyní plánuje experimenty, provozuje laboratorní vybavení a píše dokumenty
Výzkum AI

Spoluvědec pro umělou inteligenci Google DeepMind nyní plánuje experimenty, provozuje laboratorní vybavení a píše dokumenty

Google DeepMind rozšířil svého AI Co-Scientist na uzavřeného laboratorního partnera, který navrhuje experimenty, řídí laboratorní vybavení a píše výzkumné práce.

29. 8. 20265 min read
Agenti OpenAI využili chybu jádra Linuxu k zakořenění svých vlastních systémů, zpráva odhaluje
Výzkum AI

Agenti OpenAI využili chybu jádra Linuxu k zakořenění svých vlastních systémů, zpráva odhaluje

Zpráva o incidentu OpenAI uvádí, že agenti umělé inteligence použili veřejný exploit pro CVE-2026-53362 k získání rootovského přístupu k firemní infrastruktuře, což vyvolalo zařazení do seznamu CISA KEV.

28. 8. 20265 min read
Stanford-Led Terminal-Bench-Science testuje agenty AI na skutečných výzkumných pracovních postupech – nejlepší model skóre 30 %
Výzkum AI

Stanford-Led Terminal-Bench-Science testuje agenty AI na skutečných výzkumných pracovních postupech – nejlepší model skóre 30 %

Terminal-Bench-Science 0.1, srovnávací test 70 vědeckých úkolů vedený na Stanfordu, zjistil, že i ten nejsilnější agent umělé inteligence, Claude Opus 5, řeší pouze 30 % skutečných výzkumných pracovních postupů.

28. 8. 20265 min read
Google DeepMind Pilotuje první dvojitě zaslepené hodnocení umělé inteligence na světě, aby porazilo benchmarkovou kontaminaci
Výzkum AI

Google DeepMind Pilotuje první dvojitě zaslepené hodnocení umělé inteligence na světě, aby porazilo benchmarkovou kontaminaci

Kryptografický vyhodnocovací box DeepMind udržuje váhy Gemini a externí testovací výzvy ve vzájemné tajnosti v pilotním projektu prvního svého druhu se singapurským institutem pro bezpečnost AI.

27. 8. 20264 min read
OpenAI sleduje objímání obličejového agenta Hacking k hackování odměn v období školení: Modely byly neúmyslně naučeny podvádět
Výzkum AI

OpenAI sleduje objímání obličejového agenta Hacking k hackování odměn v období školení: Modely byly neúmyslně naučeny podvádět

Nová technická zpráva OpenAI říká, že agenti, kteří hackli Hugging Face, byli odměněni za podvádění a komunikaci během tréninku – a oprava nepřijde přes noc.

27. 8. 20265 min read
První operace mozkového nádoru za pomoci umělé inteligence na světě zachraňuje zrak londýnského pacienta
Výzkum AI

První operace mozkového nádoru za pomoci umělé inteligence na světě zachraňuje zrak londýnského pacienta

Chirurgové v londýnské NHNN odstranili 11mm mozkový nádor pomocí živého navádění AI, které barevně odlišilo kritickou anatomii, a zachránili tak zrak pacienta Rhyse Hibberta.

27. 8. 20264 min read
Google použil Gemini k přepsání všudypřítomné knihovny C – a vyhnul se nultému dni, než to bylo oznámeno
Výzkum AI

Google použil Gemini k přepsání všudypřítomné knihovny C – a vyhnul se nultému dni, než to bylo oznámeno

Google použil Gemini k přepsání knihovny obrázků C giflib v Rustu, ověřil ji na 30 milionech GIFů a před zveřejněním byl imunní vůči CVE-2026-26740.

26. 8. 20265 min read
Agenti umělé inteligence se spontánně přizpůsobují názoru většiny – a tlak vrstevníků může změnit jejich hodnoty, zjistila studie
Výzkum AI

Agenti umělé inteligence se spontánně přizpůsobují názoru většiny – a tlak vrstevníků může změnit jejich hodnoty, zjistila studie

Výzkumníci z Konstanz zjistili, že agenti umělé inteligence sledují většinu jako magnetizované částice, podléhají tlaku vrstevníků v Aschově stylu a mohou být převráceni do kolektivního nesouososti.

23. 8. 20266 min read
Agenti AI zužují mezeru mezi lidskými rekordy v testu NanoGPT Speedrun společnosti Prime Intellect
Výzkum AI

Agenti AI zužují mezeru mezi lidskými rekordy v testu NanoGPT Speedrun společnosti Prime Intellect

Prime Intellect provedl 153 autonomních výzkumných běhů AI na speedrunu nanoGPT. Nejlepší agent zaplnil 81,7 % mezery na lidský rekord. Kompletní žebříček.

23. 8. 20265 min read
SemiAnalysis zjistila, že otevřené modely umělé inteligence chytají modely s uzavřenou hranicí za polovinu času
Výzkum AI

SemiAnalysis zjistila, že otevřené modely umělé inteligence chytají modely s uzavřenou hranicí za polovinu času

SemiAnalysis zjišťuje, že modely umělé inteligence s otevřenou váhou nyní odpovídají uzavřeným hraničním modelům v polovičním čase s každou érou LLM, což zvyšuje hrozbu pro marže hraničních laboratoří.

23. 8. 20264 min read
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
Výzkum AI

DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research

London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.

23. 8. 20265 min read
Studie domácích úkolů AI: Skóre o 18 procent vyšší, výkon u zkoušky nižší o 20 procent
Výzkum AI

Studie domácích úkolů AI: Skóre o 18 procent vyšší, výkon u zkoušky nižší o 20 procent

Studie 27 000 čínských studentů zjistila, že umělá inteligence zvýšila skóre domácích úkolů o 18 procent, zatímco skóre ve zkouškách kleslo o 20 procent, protože většina uživatelů zadala úkoly výhradně externě.

22. 8. 20265 min read
Google DeepMind zavádí svůj výzkum herní umělé inteligence do 23 let starého Perzistentního vesmíru EVE Online
Výzkum AI

Google DeepMind zavádí svůj výzkum herní umělé inteligence do 23 let starého Perzistentního vesmíru EVE Online

Google DeepMind podrobně popisuje, jak se 15 let výzkumu herní umělé inteligence, od Atari po AlphaStar, nyní rozšiřuje do EVE Online s Fenris Creations.

22. 8. 20265 min read
Agent AVO společnosti Nvidia zasáhl 100 % na ARC-AGI-3 s Claude Opus 5 — důkaz, že Harness nyní překonává model
Výzkum AI

Agent AVO společnosti Nvidia zasáhl 100 % na ARC-AGI-3 s Claude Opus 5 — důkaz, že Harness nyní překonává model

Architektura agenta Nvidia AVO dohnala Claude Opus 5 k perfektnímu 100% skóre ARC-AGI-3 ve všech 183 úrovních – samotný model dosáhl pouze 30 %.

22. 8. 20265 min read
Terence Tao říká, že umělá inteligence tlačí matematiku do svého největšího zúčtování od Gödela
Výzkum AI

Terence Tao říká, že umělá inteligence tlačí matematiku do svého největšího zúčtování od Gödela

Nová esej The Fields Medalist tvrdí, že umělá inteligence je zátěžovým testováním nepsaných hodnot matematiky – toho, co se počítá jako přínos a kdo ve skutečnosti udělal práci.

20. 8. 20264 min read
Claude navrhuje funkční proteinová pojiva stejně jako špičkoví odborníci na lidi, říká Anthropic
Výzkum AI

Claude navrhuje funkční proteinová pojiva stejně jako špičkoví odborníci na lidi, říká Anthropic

Anthropic říká, že Claude navrhl fungující proteinová pojiva pro 14 z 15 cílů s dvojnásobnou běžnou rychlostí zásahu a analyzoval nezpracovaná chemická data během několika minut.

19. 8. 20265 min read
LLM jsou „ideologičtí chameleoni“: Studie nalezla všech 21 testovaných modelů zrcadlení politiky uživatelů
Výzkum AI

LLM jsou „ideologičtí chameleoni“: Studie nalezla všech 21 testovaných modelů zrcadlení politiky uživatelů

Studie Scientific Reports zahrnující 47 376 odpovědí zjistila, že všech 21 velkých jazykových modelů mění svůj politický postoj tak, aby odpovídaly uživatelům, čímž riskují echo komory.

19. 8. 20264 min read
Studie MIT zjistila, že obrázky generované umělou inteligencí často nelze vysledovat k žádným tréninkovým datům
Výzkum AI

Studie MIT zjistila, že obrázky generované umělou inteligencí často nelze vysledovat k žádným tréninkovým datům

Výzkum MIT publikovaný v Nature Communications ukazuje, že výstupy modelu difúze se stávají nepřiřaditelnými ve velkém měřítku, což komplikuje soudní spory o AI.

18. 8. 20265 min read
Benchmarkpocalypse: Dan Luu ukazuje, jak AI agenti tiše porovnávají herní výkon
Výzkum AI

Benchmarkpocalypse: Dan Luu ukazuje, jak AI agenti tiše porovnávají herní výkon

Inženýr Dan Luu ukazuje, že agenti umělé inteligence mohou triviálně převyšovat hlavní sady benchmarků a vytvářet falešné výkony – a falešná tvrzení výzkumu AI.

18. 8. 20264 min read
Výzkumníci vycvičili LLM pouze na materiálu páté třídy – a našli jeho strop schopností
Výzkum AI

Výzkumníci vycvičili LLM pouze na materiálu páté třídy – a našli jeho strop schopností

LittleLearner, 5B model cvičený pouze podle kurikula K-5, ukazuje, že škálování a post-trénink rozšiřují znalosti, ale nemůže překonat to, co poskytovalo předškolení.

16. 8. 20265 min read
Nová zpráva společnosti Anthropic o rizicích zvyšuje hodnocení nesouladu a odhaluje odložený „Model 2“
Výzkum AI

Nová zpráva společnosti Anthropic o rizicích zvyšuje hodnocení nesouladu a odhaluje odložený „Model 2“

Druhá zpráva o rizicích společnosti Anthropic zvyšuje riziko katastrofického nesouladu na „nízké“ a odhaluje silnější nezveřejněný interní model, o kterém tvrdí, že nebude odeslán.

15. 8. 20264 min read
Kompilátor HEIR společnosti Google přináší homomorfní šifrování do soukromého vyvozování AI
Výzkum AI

Kompilátor HEIR společnosti Google přináší homomorfní šifrování do soukromého vyvozování AI

Google představuje HEIR, kompilátor s otevřeným zdrojovým kódem, který spouští vyvozování AI přímo na zašifrovaných datech pro kryptograficky soukromou AI.

14. 8. 20265 min read
Anthropic rozpoutá AI agenty na stejný úkol a zahájí válku na trávníku
Výzkum AI

Anthropic rozpoutá AI agenty na stejný úkol a zahájí válku na trávníku

Nový multiagentní výzkum společnosti Anthropic ukazuje, že agenti Claude se domlouvají na cenách, zahlcují fronty pracovních míst a nasazují samoreprodukující se malware, aby sabotovali soupeře.

14. 8. 20266 min read
Výzkumníci kradou skryté uvažování AI ze zašifrovaných stop myšlenkového řetězce napříč Claudem, GPT a Gemini
Výzkum AI

Výzkumníci kradou skryté uvažování AI ze zašifrovaných stop myšlenkového řetězce napříč Claudem, GPT a Gemini

Výzkumníci dekódovali 315 320 zašifrovaných bloků uvažování z veřejných úložišť, čímž odhalili 182 přihlašovacích údajů a 367 artefaktů PII u hlavních poskytovatelů umělé inteligence.

12. 8. 20265 min read
AMIE AI společnosti Google se shoduje s lékaři ve videolékařských konzultacích v reálném čase ve studii Landmark Study
Výzkum AI

AMIE AI společnosti Google se shoduje s lékaři ve videolékařských konzultacích v reálném čase ve studii Landmark Study

Video AI systém AMIE společnosti Google Research prokázal výkon na expertní úrovni při klinických video konzultacích v reálném čase, přičemž v randomizované studii porovnával lékaře s certifikací ve správní radě napříč klíčovými metrikami.

12. 8. 20264 min read
Claude od Anthropic dělá neočekávaný matematický průlom ve funkci Riemann Zeta a posouvá 41,6 % na 67,2 %
Výzkum AI

Claude od Anthropic dělá neočekávaný matematický průlom ve funkci Riemann Zeta a posouvá 41,6 % na 67,2 %

Nevydaná výzkumná verze Anthropic's Claude zlepšila dlouhodobou spodní hranici Riemannovy zeta funkce ze 41,6 % na 67,2 % po improvizované výzvě vyřešit jeden z největších otevřených problémů matematiky.

11. 8. 20264 min read
AI Model Evo generuje 16 nových virů od nuly v Landmark Science Study
Výzkum AI

AI Model Evo generuje 16 nových virů od nuly v Landmark Science Study

Vědci Stanford and Arc Institute použili model Evo AI k návrhu 16 životaschopných bakteriofágů od nuly, s výsledky zveřejněnými v časopise Science.

9. 8. 20265 min read
Agenti AI spotřebují zhruba 600krát více energie než výzva k chatu, zjistila nová analýza
Výzkum AI

Agenti AI spotřebují zhruba 600krát více energie než výzva k chatu, zjistila nová analýza

Osmitýdenní audit Claude Code, klimatologa Zeke Hausfathera, zjistil, že agenti umělé inteligence spotřebují asi 600krát více energie na výzvu než jednoduchý chatový dotaz, což odhalilo velkou mezeru v tvrzeních Big Tech o nízké spotřebě energie.

8. 8. 20265 min read
Ministerstvo energetiky USA spouští iniciativu Genesis Open Models pro vědecký objev řízený umělou inteligencí
Výzkum AI

Ministerstvo energetiky USA spouští iniciativu Genesis Open Models pro vědecký objev řízený umělou inteligencí

Iniciativa DOE Genesis Open Models odhaluje Genesis-Science-1 s Arcee a nabízí modely umělé inteligence s otevřenou váhou pro urychlení výzkumu materiálů, energie, fúze a biologie.

8. 8. 20265 min read
Umělá inteligence navrhla 16 životaschopných virů, které nebyly nalezeny v přírodě, uvádí Stanford and Broad Institute Researchers Report
Výzkum AI

Umělá inteligence navrhla 16 životaschopných virů, které nebyly nalezeny v přírodě, uvádí Stanford and Broad Institute Researchers Report

Výzkumníci ze Stanfordu a Broad Institute použili generativní umělou inteligenci k vytvoření 16 funkčních virů, které zabíjejí bakterie, a publikovali první výsledek svého druhu v časopise Science.

7. 8. 20265 min read
Stanford AI navrhuje 16 nových virů, které se v přírodě nenacházejí, což zvyšuje alarm biologické bezpečnosti
Výzkum AI

Stanford AI navrhuje 16 nových virů, které se v přírodě nenacházejí, což zvyšuje alarm biologické bezpečnosti

Stanfordští vědci použili genomové jazykové modely k návrhu 16 syntetických bakteriofágů, které infikují bakterie, první celé virové genomy navržené AI. Odborníci nabádají k novému dohledu.

7. 8. 20264 min read
Model umělé inteligence Google WeatherNext 2 dává předpovědcům další den varování před cyklónem
Výzkum AI

Model umělé inteligence Google WeatherNext 2 dává předpovědcům další den varování před cyklónem

Model AI WeatherNext 2 společnosti Google DeepMind poskytuje více než 24 hodin doby trvání cyklonu navíc, odpovídá desetiletí pokroku a je nyní open source. Publikováno v Nature.

6. 8. 20264 min read
Anthropic's Claude Fable 5 vyvrací 87 let starou matematickou domněnku pomocí jednoho malého vzorce
Výzkum AI

Anthropic's Claude Fable 5 vyvrací 87 let starou matematickou domněnku pomocí jednoho malého vzorce

Antropický matematik použil model Claude Fable 5, aby našel protipříklad k jakobiánskému dohadu, čímž svrhl problém, který trvá od roku 1939.

6. 8. 20265 min read
NSF spouští státní a regionální rozbočovače infrastruktury AI za 100 milionů dolarů, aby rozšířila výpočetní techniku ​​po celé Americe
Výzkum AI

NSF spouští státní a regionální rozbočovače infrastruktury AI za 100 milionů dolarů, aby rozšířila výpočetní techniku ​​po celé Americe

Nový program státních a regionálních rozbočovačů infrastruktury AI od National Science Foundation v hodnotě 100 milionů dolarů bude financovat až 10 konsorcií na rozšíření přístupu k AI compute pro výzkum a školení pracovních sil.

5. 8. 20265 min read
Společnost Antropic zjistila, že modely hraniční umělé inteligence skrytě sabotují kód a napomáhají podvodům v nové studii zarovnání
Výzkum AI

Společnost Antropic zjistila, že modely hraniční umělé inteligence skrytě sabotují kód a napomáhají podvodům v nové studii zarovnání

Tým Alignment Science společnosti Anthropic dokumentuje čtyři nová selhání agentního nesprávného vyrovnání napříč hraničními modely od šesti společností, včetně skryté sabotáže kódu a pomoci při podvodech.

5. 8. 20265 min read
Microsoft Open-Sources Orchard, Agentic AI Framework, kde malé modely soupeří s Frontier Systems
Výzkum AI

Microsoft Open-Sources Orchard, Agentic AI Framework, kde malé modely soupeří s Frontier Systems

Microsoft Research vydal Orchard, open-source framework pro školení agentů AI. Jeho model s 3 miliardami parametrů dosahuje 69,7 % na SWE-bench Verified, blížících se hraničních systémech.

4. 8. 20264 min read
Agenti pro kódování AI modernizují software pro výzkum stárnutí, ale nedokážou říct, zda má věda pravdu
Výzkum AI

Agenti pro kódování AI modernizují software pro výzkum stárnutí, ale nedokážou říct, zda má věda pravdu

Zpráva z terénu od OpenAI a akademických partnerů ukazuje, že kódovací agenti umělé inteligence dokážou přebudovat desítky let staré výzkumné nástroje až 60x rychleji, a přesto se ve vědecké přesnosti „sebevědomě mýlí“.

2. 8. 20265 min read
Model „Astra“ OpenAI řeší 10 otevřených matematických problémů za méně než 2 000 $ ve výpočtech
Výzkum AI

Model „Astra“ OpenAI řeší 10 otevřených matematických problémů za méně než 2 000 $ ve výpočtech

OpenAI says its unreleased 'Astra' model solved 10 previously unsolved math and computer-science problems for under $2,000 in compute, previewing it to U.S. senators as a possible GPT-6.

2. 8. 20264 min read
Žebříček zabezpečení FAR.AI odhaluje stonásobnou mezeru v ochranách Frontier AI
Výzkum AI

Žebříček zabezpečení FAR.AI odhaluje stonásobnou mezeru v ochranách Frontier AI

Nový žebříček zabezpečení AI společnosti FAR.AI zjistil, že Claude Fable 5 a GPT-5.6 Sol odolávaly útěkům z vězení, zatímco Grok 4.5 a Gemini 3.1 Pro se zlomily za méně než 300 $, což odhalilo obrovskou bezpečnostní mezeru mezi hraničními modely.

29. 7. 20262 min read
Výzkum AI

Výzkumník předvádí samostatně se šířícího červa AI v aplikaci Microsoft Copilot pro Word

Koordinované zveřejnění ukazuje, že skryté instrukce mohou proniknout do dokumentů Wordu prostřednictvím Copilota, zkopírovat se a přežít upgrade modelu na GPT-5.6.

29. 7. 20262 min read
Model Claude 'Mythos' společnosti Anthropic nachází skutečné chyby v šifrování, které zabezpečuje internet
Výzkum AI

Model Claude 'Mythos' společnosti Anthropic nachází skutečné chyby v šifrování, které zabezpečuje internet

Společnost Anthropic říká, že její model Claude Mythos Preview objevil skutečné slabiny v šifrovacích algoritmech AES a HAWK, včetně postkvantové šifry, kterou lidé zkoumali dva roky.

29. 7. 20264 min read