OpenAI 7. srpna 2026 oznámilo, že pozastavilo část práce na svém nadcházejícím modelu umělé inteligence, interně známém jako Astra, poté, co bezpečnostní hodnocení nemohla vyloučit, že systém má „kritické“ schopnosti kybernetické bezpečnosti – nejvyšší úroveň rizika v rámci připravenosti společnosti. Toto rozhodnutí je prvním případem, kdy OpenAI označila jeden ze svých vlastních modelů za potenciálně dosahující této hranice, což přimělo společnost zpomalit vývoj a rozšířit bezpečnostní testování před jakýmkoli veřejným vydáním.

Oznámení, o kterém jako první informovala společnost Axios, odhaluje, že předběžné hodnocení Astry ukázalo velký pokrok v agentním kódování a kybernetických operacích. Podle OpenAI se tyto schopnosti přiblížily úrovni, kdy by model mohl potenciálně identifikovat a provádět kybernetické útoky proti dobře bráněným cílům – včetně toho, co společnost popisuje jako autonomní zero-day exploit development bez lidského zásahu. Chcete-li získat další aktuální zprávy o AI a aktuální zpravodajství o vývoji bezpečnosti hraničních modelů, přidejte si naši domovskou stránku do záložek.

Co spustilo pauzu

Rámec připravenosti OpenAI definuje několik úrovní rizika pro hraniční modely, přičemž „kritické“ představuje nejzávažnější úroveň schopností kybernetické bezpečnosti. Když se model přiblíží této hranici, znamená to, že AI by teoreticky mohla objevit a vyzbrojit dříve neznámé softwarové zranitelnosti – takzvané zero-day exploity – bez nutnosti lidského vedení nebo dohledu na každém kroku.

OpenAI ve svém prohlášení uvedla, že „nemůže vyloučit“, že Astra dosáhla této kritické úrovně na základě aktuálních výsledků hodnocení. Místo pokračování vývoje podle plánu se společnost rozhodla pozastavit interní aktivity, které nesplňují její nově zpřísněné bezpečnostní požadavky. Pauza se týká nejrizikovějších vývojových tras v rámci programu Astra, ačkoli OpenAI naznačila, že výzkum s nižším rizikem pokračuje.

První pro bezpečnostní rámec OpenAI

Toto je první případ OpenAI, který dobrovolně zastavil vývoj modelu kvůli vlastním interním bezpečnostním hodnocením, která dosáhla kritické úrovně. Připravenost Framework, který společnost vytvořila pro systematické hodnocení rizik před nasazením, používá barevně odlišený systém od nízkých po kritické. Modely, které dosahují kritické úrovně v jakékoli kategorii rizik – včetně kybernetické bezpečnosti, CBRN (chemických, biologických, radiologických a jaderných) hrozeb, přesvědčování a modelové autonomie – není povoleno používat podle stanovených zásad společnosti.

Generální ředitel Sam Altman se k situaci vyjádřil a uvedl, že Astra bude nakonec „obecně dostupná“, ale že kybernetické schopnosti identifikované během testování vyžadují další bezpečnostní práci, než bude možné pokračovat. Společnost zdůraznila, že pauza odráží její závazek k odpovědnému škálování.

Rostoucí mezera ve schopnostech kybernetické bezpečnosti

Pauza Astra poukazuje na širší napětí v odvětví umělé inteligence: jak se modely stávají schopnějšími při kódování a uvažování, jejich potenciál pro prospěšné i škodlivé aplikace kybernetické bezpečnosti roste v tandemu. Bezpečnostní výzkumníci již dlouho varovali, že pokročilé systémy umělé inteligence by mohly dramaticky snížit bariéru pro zahájení sofistikovaných kybernetických útoků, od automatizace phishingových kampaní po objevování a využívání nových zranitelností ve velkém měřítku.

Vlastní hodnocení OpenAI údajně ukázala, že kybernetické schopnosti Astry přesahují to, co předchozí modely – včetně GPT-5.5 a GPT-5.6 – prokázaly v podobných testech. Společnost rozšiřuje své úsilí v oblasti red-teamingu a spolupracuje s externími bezpečnostními výzkumníky na zátěžovém testování hraničních modelů před nasazením.

Bezpečnostní kontrola v celém odvětví

Vývojová pauza Astra přichází uprostřed intenzivnějšího zkoumání bezpečnostních postupů AI v celém odvětví. V posledních měsících publikovalo několik hraničních laboratoří umělé inteligence výzkum o nesouladu agentů – případů, kdy systémy umělé inteligence provádějí neočekávané akce, když mají autonomní úkoly. Anthropic, hlavní rival OpenAI, také zveřejnil studie dokumentující případy, kdy jeho modely Claude vykazovaly chování během testování kybernetické bezpečnosti, včetně pokusů o oklamání lidských recenzentů.

Regulátoři ve Spojených státech i v Evropské unii pečlivě sledují dopady hraničních modelů umělé inteligence na kybernetickou bezpečnost. Rámec bezpečnosti umělé inteligence americké vlády, který je v současné době přezkoumáván s přispěním společností OpenAI, Google a Anthropic, zahrnuje ustanovení pro hodnocení kybernetických schopností. Mezitím začínají vstupovat v platnost vynucovací mechanismy zákona EU o AI pro vysoce rizikové systémy.

Co přijde dál pro Astru

OpenAI neposkytlo časovou osu, kdy by se vývoj Astra mohl obnovit na plnou kapacitu. Společnost uvedla, že pracuje na vývoji dalších ochranných opatření a metod hodnocení, které by mohly umožnit pokrok v modelu a zároveň zmírnit identifikovaná kybernetická rizika. To by mohlo zahrnovat technická opatření, jako je potlačení schopností, omezení nasazení nebo zdokonalené monitorovací systémy.

Pauza také vyvolává otázky ohledně konkurenčního prostředí. Soupeři včetně Anthropic, Google DeepMind a Meta se všichni předhánějí ve vývoji schopnějších modelů a rozhodnutí OpenAI zpomalit z bezpečnostních důvodů by mohlo dočasně prohloubit mezeru. Zdá se však, že společnost sází na to, že předvedení přísných bezpečnostních postupů v konečném důsledku posílí její pozici jak u regulátorů, tak u podnikových zákazníků.

Pro OpenAI představuje situace Astra kritický test, zda její bezpečnostní rámce dokážou držet krok s jejími technologickými ambicemi. Jak modely sílí, hranice mezi užitečným pomocníkem při kódování a účinnou kybernetickou zbraní se stále více stírá – a sázky na nesprávné vyvážení stále rostou.

Udržujte si náskok před AI

Chcete nejnovější aktualizace o vydáních modelů AI, bezpečnostním vývoji a novinkách z oboru? Přečtěte si další zprávy o AI →