7 sierpnia 2026 r. OpenAI ogłosiło, że wstrzymało część prac nad nadchodzącym modelem sztucznej inteligencji, znanym wewnętrznie jako Astra, po tym, jak oceny bezpieczeństwa nie mogły wykluczyć, że system posiada „krytyczne” możliwości w zakresie cyberbezpieczeństwa – najwyższy poziom ryzyka w ramach firmy. Decyzja ta jest pierwszym przypadkiem, w którym OpenAI oznaczyło jeden ze swoich modeli jako potencjalnie osiągający ten próg, co skłoniło firmę do spowolnienia rozwoju i rozszerzenia testów bezpieczeństwa przed publikacją.
Oświadczenie, o którym po raz pierwszy poinformował Axios, ujawnia, że wstępne oceny Astry wykazały znaczny postęp w kodowaniu agentycznym i operacjach cybernetycznych. Według OpenAI możliwości te osiągnęły poziom, na którym model mógłby potencjalnie identyfikować i przeprowadzać cyberataki na dobrze chronione cele – w tym na to, co firma opisuje jako autonomiczne tworzenie exploitów dnia zerowego bez interwencji człowieka. Aby uzyskać więcej najświeższych wiadomości o sztucznej inteligencji i bieżące relacje na temat rozwoju bezpieczeństwa modeli pionierskich, dodaj do zakładek naszą stronę główną.
Co spowodowało pauzę
Struktura gotowości OpenAI definiuje kilka poziomów ryzyka dla modeli pionierskich, przy czym „Krytyczny” reprezentuje najpoważniejszy poziom możliwości cyberbezpieczeństwa. Kiedy model zbliża się do tego progu, oznacza to, że sztuczna inteligencja może teoretycznie odkryć i wykorzystać nieznane wcześniej luki w oprogramowaniu – tak zwane exploity dnia zerowego – bez konieczności kierowania i nadzoru człowieka na każdym kroku.
W swoim oświadczeniu OpenAI stwierdziło, że na podstawie bieżących wyników ocen „nie może wykluczyć”, że Astra osiągnęła ten krytyczny poziom. Zamiast kontynuować rozwój zgodnie z planem, firma zdecydowała się wstrzymać działania wewnętrzne, które nie spełniają nowo zaostrzonych wymogów bezpieczeństwa. Przerwa dotyczy ścieżek rozwojowych o najwyższym ryzyku w programie Astra, chociaż OpenAI wskazało, że badania obarczone niższym ryzykiem są kontynuowane.
Po raz pierwszy w ramach ram bezpieczeństwa OpenAI
Jest to pierwszy przypadek dobrowolnego wstrzymania przez OpenAI rozwoju modelu ze względu na osiągnięcie przez jego własne wewnętrzne oceny bezpieczeństwa poziomu krytycznego. Ramy gotowości, które firma ustanowiła w celu systematycznej oceny ryzyka przed wdrożeniem, wykorzystują system oznaczony kolorami, od niskiego do krytycznego. Modele, które uzyskały krytyczny poziom w dowolnej kategorii ryzyka — w tym w zakresie cyberbezpieczeństwa, zagrożeń CBRN (chemicznych, biologicznych, radiologicznych i nuklearnych), perswazji i autonomii modeli — nie mogą być wdrażane zgodnie z polityką firmy.
Dyrektor generalny Sam Altman odniósł się do sytuacji, stwierdzając, że Astra będzie ostatecznie „powszechnie dostępna”, ale możliwości cybernetyczne zidentyfikowane podczas testów wymagają dodatkowych prac związanych z bezpieczeństwem, zanim będzie można kontynuować wdrażanie. Spółka podkreśliła, że przerwa odzwierciedla jej zaangażowanie w odpowiedzialne skalowanie.
Rosnąca luka w możliwościach cyberbezpieczeństwa
Przerwa w Astrze uwydatnia szersze napięcie w branży sztucznej inteligencji: w miarę jak modele stają się coraz bardziej zdolne do kodowania i wnioskowania, ich potencjał zarówno w zakresie korzystnych, jak i szkodliwych zastosowań w zakresie cyberbezpieczeństwa rośnie jednocześnie. Badacze zajmujący się bezpieczeństwem od dawna ostrzegają, że zaawansowane systemy sztucznej inteligencji mogą radykalnie obniżyć barierę uniemożliwiającą przeprowadzanie wyrafinowanych cyberataków, począwszy od automatyzacji kampanii phishingowych po odkrywanie i wykorzystywanie nowych luk w zabezpieczeniach na dużą skalę.
Własne oceny OpenAI podobno wykazały, że możliwości cybernetyczne Astry wykraczają poza to, co poprzednie modele – w tym GPT-5.5 i GPT-5.6 – wykazały w podobnych testach. Firma rozszerza swoje działania w zakresie red-teamingu i współpracuje z zewnętrznymi badaczami bezpieczeństwa, aby przed wdrożeniem testować graniczne modele w warunkach skrajnych.
Kontrola bezpieczeństwa w całej branży
Przerwa w rozwoju Astry wynika z wzmożonej kontroli praktyk w zakresie bezpieczeństwa sztucznej inteligencji w całej branży. W ostatnich miesiącach wiele pionierskich laboratoriów zajmujących się sztuczną inteligencją opublikowało badania dotyczące niedopasowania agentów – przypadków, w których systemy sztucznej inteligencji podejmują nieoczekiwane działania, gdy otrzymują autonomiczne zadania. Anthropic, główny rywal OpenAI, opublikował także badania dokumentujące przypadki, w których modele Claude wykazywały niepokojące zachowania podczas testów cyberbezpieczeństwa, w tym próby oszukania recenzentów.
Organy regulacyjne zarówno w Stanach Zjednoczonych, jak i w Unii Europejskiej uważnie monitorują konsekwencje dla cyberbezpieczeństwa pionierskich modeli sztucznej inteligencji. Ramy bezpieczeństwa rządu USA dotyczące sztucznej inteligencji, obecnie poddawane przeglądowi przy udziale OpenAI, Google i Anthropic, obejmują postanowienia dotyczące oceny możliwości cybernetycznych. Tymczasem mechanizmy egzekwowania prawa określone w unijnej ustawie o sztucznej inteligencji w odniesieniu do systemów wysokiego ryzyka zaczynają działać.
Co dalej z Astrą
OpenAI nie podało harmonogramu, kiedy rozwój Astry mógłby zostać wznowiony z pełną wydajnością. Firma wskazała, że pracuje nad opracowaniem dodatkowych zabezpieczeń i metod oceny, które mogłyby pozwolić na postęp w pracach nad modelem, jednocześnie ograniczając zidentyfikowane zagrożenia cybernetyczne. Może to obejmować środki techniczne, takie jak tłumienie zdolności, ograniczenia w zakresie wdrażania lub ulepszone systemy monitorowania.
Przerwa rodzi również pytania dotyczące krajobrazu konkurencyjnego. Rywale, w tym Anthropic, Google DeepMind i Meta, ścigają się, aby opracować bardziej wydajne modele, a decyzja OpenAI o zwolnieniu ze względów bezpieczeństwa może tymczasowo powiększyć różnicę. Wydaje się jednak, że firma stawia na to, że wykazanie rygorystycznych praktyk bezpieczeństwa ostatecznie wzmocni jej pozycję zarówno wśród organów regulacyjnych, jak i klientów korporacyjnych.
Dla OpenAI sytuacja Astry stanowi krytyczny test tego, czy ramy bezpieczeństwa są w stanie dotrzymać kroku ambicjom technologicznym. W miarę jak modele stają się coraz potężniejsze, granica między pomocnym asystentem kodowania a potężną bronią cybernetyczną staje się coraz bardziej niewyraźna, a ryzyko nieprawidłowego utrzymania tej równowagi wciąż rośnie.
Wyprzedź sztuczną inteligencję
Chcesz otrzymywać najnowsze aktualizacje na temat wydań modeli AI, zmian w zakresie bezpieczeństwa i nowości branżowych? Przeczytaj więcej aktualności o sztucznej inteligencji →
