OpenAI odsłoniło kurtynę Astry, niewydanego jeszcze systemu, który nazywa „naszym kolejnym głównym modelem”, po tym jak wersja wewnętrzna przyniosła dziesięć znaczących postępów w matematyce i informatyki teoretycznej. Firma umieściła ogłoszenie w poście badawczym dokumentującym wyniki matematyczne, co wzbudziło zarówno ekscytację, jak i wnikliwą uwagę badaczy, którzy uważnie śledzą najświeższe wiadomości o sztucznej inteligencji.

W przypadku problemów, które Astra pomogła rozwiązać, „nie zaobserwowano żadnego postępu w zakresie głównych wyników przez co najmniej dekadę, a w większości przypadków znacznie dłużej” – napisała OpenAI. Wyniki obejmują takie dziedziny, jak geometria wielowymiarowa, teoria kodowania, złożoność obwodów arytmetycznych, teoria grup, złożoność kwantowa, kryptografia sieciowa i kombinatoryka ekstremalna – obszar, w którym postęp zwykle mierzy się latami, a nie pojedynczymi badaniami.

Zweryfikowane dowody, nie tylko odpowiedzi

Tym, co odróżnia wyniki Astry od chatbota zgadującego matematykę, jest weryfikacja. OpenAI stwierdziło, że badacze wykorzystali ten sam model do przygotowania argumentów w postaci rękopisów, a następnie Astra sformalizowała każdy argument jako certyfikat Lean. Lean to asystent sprawdzający o otwartym kodzie źródłowym, który może maszynowo sprawdzać argumenty matematyczne, co oznacza, że ​​inni matematycy nie muszą przyjmować wyników na wiarę — mogą one zostać niezależnie zweryfikowane przez oprogramowanie w ciągu kilku sekund.

To rozróżnienie ma znaczenie. Model językowy może stworzyć wiarygodnie wyglądający dowód zawierający subtelny, krytyczny błąd. Tłumacząc każdy argument na Lean, OpenAI przekształciło twierdzenie marketingowe w sprawdzalny artefakt. Według BleepingComputer, który podał szczegóły, konkretne postępy obejmują dowód potwierdzający istnienie grup niefizycznych, rozwiązujący główną otwartą kwestię w teorii grup; obalenie hipotezy Connesa o sztywności; nowe granice pakowania kul wielkowymiarowych; i rozwiązuje kilka problemów pierwotnie postawionych przez płodnego matematyka Paula Erdősa.

OpenAI zauważyło, że całkowita liczba tokenów wymaganych do znalezienia tych rozwiązań będzie kosztować około 2000 dolarów przy obecnych stawkach API – co stanowi uderzający punkt danych na temat śladu obliczeniowego współczesnych odkryć matematycznych i taki, który sprawia, że ​​pionierskie badania są w zasięgu dobrze finansowanych zespołów akademickich, a nie tylko samych laboratoriów.

Matematycy reagują

Thomas Bloom, matematyk z Uniwersytetu w Manchesterze, który prowadzi witrynę informacyjną dotyczącą problemów Erdősa erdosproblems.com, według The Decoder nazwał wyniki „ważną wiadomością” na temat X. Ocenił je jako bardziej istotne niż kontrprzykład dla opublikowanej w maju hipotezy o odległości jednostkowej. „Być może nie byłby większy niż dowód odległości jednostkowej, ale z punktu widzenia konstrukcji jest duży” – napisał Bloom.

Bloom sprzeciwił się także twierdzeniu, że sztuczna inteligencja zastępuje matematyków, argumentując, że twierdzenie to nie ma większego sensu, skoro system czerpie z teorii ponad stuletniej, został zbudowany przez matematyków i był szkolony we wszystkim, co matematycy kiedykolwiek napisali.

Noam Brown, badacz odpowiedzialny za technologię wnioskowania w czasie testów, na której opiera się Astra, był bardziej wyważony. „Niestety, nie ma (jeszcze) żadnych problemów związanych z Nagrodą Milenijną” – zamieścił post w serwisie X, odnosząc się do siedmiu słynnych problemów, za które Clay Mathematics Institute oferuje po milion dolarów każdy – tylko jeden został rozwiązany od czasu ogłoszenia nagród w 2000 roku.

Nie wszyscy byli pod wrażeniem. Krytyk sztucznej inteligencji, Gary Marcus, nazwał ten model „niesamowitym, ale znacznie wyprzedanym” w poście Substack, co jest znaną linią sceptycyzmu, ilekroć pionierskie laboratorium ogłasza kamień milowy. Napięcie pomiędzy prawdziwymi osiągnięciami technicznymi a oprawą promocyjną prawdopodobnie określi odbiór Astry.

Nowa rodzina modeli do długich zadań

Informacje niezależnie potwierdziły, że Astra to nowa rodzina modeli stworzona z myślą o długotrwałych obciążeniach. OpenAI opisuje go jako system, który umożliwia wielu agentom sztucznej inteligencji współpracę nad różnymi częściami większego problemu — projekt ukierunkowany bezpośrednio na zadania, które zajmują godziny lub dni, a nie sekundy, takie jak udowodnienie twierdzenia lub refaktoryzacja dużej bazy kodu.

BleepingComputer poinformował, że OpenAI nie zdecydowało, czy model będzie dostarczany jako GPT-5.7, GPT-6, czy pod inną nazwą. Dyrektor generalny Sam Altman zaprezentował już Astrę w Waszyngtonie, jak podaje The Decoder, sygnalizując, że firma uważa system za wystarczająco dojrzały, aby można go było zaprezentować decydentom.

Przeszkoda w przeglądzie rządowym

Być może najważniejszym szczegółem są przepisy. Według The Decoder Astra będzie jednym z pierwszych modeli, które przejdą zaplanowany proces przeglądu przez rząd USA, który wymaga oficjalnego zatwierdzenia przed publikacją. Dodaje to do harmonogramu premiery warstwę niepewności politycznej, z którą nie miały nigdy wcześniej do czynienia wcześniejsze flagowe modele – i podnosi stawkę dla tego, jak OpenAI charakteryzuje możliwości Astry.

Debiut następuje także w trakcie zaciętego wyścigu w wadze otwartej. Kilka dni wcześniej laboratorium Thinking Machines wypuściło model Inkling-Small z otwartą wagą, a chińskie laboratoria w dalszym ciągu rozwijają pionierskie systemy z otwartą wagą. Astra sygnalizuje, że OpenAI zakłada, że ​​zastrzeżone rozumowanie na dużą skalę — weryfikowane za pomocą narzędzi takich jak Lean — pozostaje drogą do największych przełomów.

Na razie Astra pozostaje niewydana. Jednak jego matematyczny debiut zmienił już ramy dyskusji na temat tego, jakie pionierskie systemy sztucznej inteligencji mogą wnieść do czystej nauki i jak uważnie opinia publiczna powinna analizować towarzyszące im twierdzenia.

Wyprzedź sztuczną inteligencję

Chcesz być na bieżąco z wydarzeniami takimi jak Astra i szerszym wyścigiem modeli pionierskich? Dodaj do zakładek nasze centrum z najnowszymi osiągnięciami AI.

Przeczytaj więcej aktualności o sztucznej inteligencji →