Koalice vedená Biohubem, americkým ministerstvem energetiky a National Institutes of Health oznámila závazek ve výši 1,8 miliardy dolarů na vytváření a otevřené sdílení dat potřebných k trénování prediktivních biologických modelů umělé inteligence – což výzkumníci nazývají hledání „virtuální buňky“.

Oznámení, které bylo učiněno ve středu v Redwood City v Kalifornii, spojuje federální agentury, filantropii a tři z nejvýznamnějších světových organizací AI v tom, co Biohub popisuje jako největší koordinovaný závazek k generování biologických dat připravených pro AI k dnešnímu dni. For more context on this story, see our ongoing more AI stories.

Kdo za co platí

Hodnota 1,8 miliardy dolarů kombinuje peníze, data, výpočty a nové technologie měření od několika partnerů:

  • Biohub ukotvuje úsilí svým zakládajícím závazkem 500 milionů dolarů. Z toho 400 milionů dolarů podporuje nové technologie měření, které rozšiřují to, co mohou biologové skutečně pozorovat: kryo-elektronovou tomografii, která rozlišuje téměř atomové detaily uvnitř buňky, spolu s pokročilou mikroskopií určenou k zobrazování buněk v měřítcích a rychlostech, kterým se současné laboratorní pracovní postupy nemohou přiblížit.
  • Ministerstvo energetiky investuje více než 500 milionů dolarů během pěti let do laboratorního měření, modelování a výpočtů prostřednictvím svého Úřadu pro vědu.
  • NIH bude koordinovat příspěvek datových sad, úložišť a znalostních bází vyvinutých prostřednictvím předchozí federální investice více než 500 milionů USD, přičemž Biohub bude spolupracovat s agenturou na standardizaci těchto datových sad pro školení modelů AI.
– Google DeepMind, Isomorphic Labs a Meta společně investují 300 milionů dolarů do iniciativy Virtual Biology Initiative, mezinárodního úsilí – poprvé oznámeného v dubnu 2026 – které dnešní rozšíření formalizuje.

Výsledkem bude otevřený zdroj pro globální výzkumnou komunitu, nikoli proprietární datový soubor uzamčený uvnitř jedné společnosti.

Expanze, ne začátek

Dnešní oznámení formalizuje a rozšiřuje iniciativu Virtual Biology Initiative, která byla poprvé oznámena v dubnu 2026 s mandátem koordinovat generování dat napříč institucemi a vědeckými obory. Dubnové spuštění vytvořilo rámec; nové závazky jej naplní federálními penězi, federálními údaji a investicemi soukromého sektoru.

Na dělbě práce záleží. DOE přináší výpočetní kapacitu světové třídy a národní laboratorní vybavení. NIH přináší standardizované soubory dat nashromážděné během desetiletí federálně financovaného výzkumu – druh kurátorských, podélných biologických dat, která žádná laboratoř nebo společnost nedokázala regenerovat. Biohub, výzkumná organizace podporovaná technologickou filantropií, funguje jako integrační centrum, které normalizuje tyto zdroje do formátů, na kterých mohou modely umělé inteligence skutečně trénovat.

Velká výzva „Virtuální buňka“.

Deklarovaným cílem iniciativy je umožnit vědcům provádět experimenty digitálně: předpovídat, jak buňka reaguje na lék, genetickou poruchu nebo chorobný stav, než se dotknou pipety.

"Přesný prediktivní model biologie by mohl dramaticky urychlit vědecké objevy tím, že by vědcům umožnil provádět experimenty digitálně," řekl Alex Rives, vedoucí vědy společnosti Biohub, v oznámení. "Pohledy, které z toho plynou, by mohly odemknout mnohem větší porozumění nemocem a otevřít zcela nové cesty k léčbě."

"Vzhledem k tomuto potenciálu je vytvoření virtuální buňky jednou z nejdůležitějších výzev pro příští éru vědy," dodal Rives. "Bude to vyžadovat koordinované úsilí při vytváření dat v národním i mezinárodním měřítku, a proto se tito partneři scházejí."

Proč jsou úzkým hrdlem data, nejen modely

Umělá inteligence v biologii přinesla přelomové výsledky – rodina AlphaFold společnosti DeepMind prokázala, že neuronové sítě dokážou předpovídat proteinové struktury s experimentální přesností – ale tyto systémy byly trénovány na základě desetiletí upravovaných veřejných dat. Hraniční problémy, od předpovídání toho, jak celé buňky reagují na zásahy, až po modelování buněčných interakcí, vyžadují data, která z velké části ještě neexistují ve formě připravené pro AI.

To je mezera, na kterou se iniciativa zaměřuje. Namísto vydání dalšího modelu partneři financují neokoukanou infrastrukturu vědy: rozšiřování dat buněčné odezvy na zásahy v mnohem větším počtu typů buněk a podmínek, než bylo dosud studováno, vytváření a ověřování technologií pro studium buněk a jejich interakcí ve větším měřítku, rychlosti a přesnosti a sestavování sdílených úložišť, která mohou skutečně používat mimo laboratoře.

Expanze má i obranný rozměr. V Hacker News, kde oznámení vzbudilo značnou pozornost, komentátoři stavěli závazek k otevřeným datům do protikladu s tím, že současná americká administrativa odstranila dříve veřejné výzkumné datové soubory z vládních serverů – napětí mezi otevřenou vědou na hranicích a omezením jinde.

Co to znamená pro umělou inteligenci při objevování drog

Pro farmaceutický a biotechnologický průmysl je poselstvím, že základní data se stávají sdílenou veřejnou službou. Isomorphic Labs, společnost Alphabet zabývající se návrhem léků, a Meta – která má svůj vlastní základní výzkum AI a práci na proteinové struktuře – oba sází na to, že lépe sdílená data urychlí modely všech, včetně jejich vlastních.

Pokud bude iniciativa úspěšná, budou nejbližšími výstupy rozšířené datové sady buněčné odezvy pokrývající mnohem více typů buněk a podmínek, plus ověřená technologie měření, která zkracuje cestu od hypotézy k vysoce kvalitním tréninkovým datům. Dlouhodobou cenou je simulace dostatečně dobrá na digitální třídění kandidátů na léky před prvním experimentem v mokré laboratoři.

Vědecká komunita je výslovně pozvána k účasti: Oznámení Biohubu končí otevřenou výzvou pro „celosvětovou vědeckou komunitu“, aby se k projektu připojila.

Další informace o tom, jak strojové učení přetváří vědy o živé přírodě, najdete ve výzkumu AI Buzz Wire společnosti AI.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →