Obecni i byli badacze z OpenAI i Google DeepMind ostrzegli we wtorek, że firmy, dla których pracują – lub dla których pracowali – niebezpiecznie szybko zmierzają w kierunku samodoskonalących się systemów sztucznej inteligencji, które mogłyby wyprzedzić zdolność ludzkości do kontrolowania ich.
Ostrzeżenia pojawiły się w serii relacji wideo zebranych przez organizację non-profit zajmującą się bezpieczeństwem AI, Palisade Research, i udostępnionych wyłącznie agencji Reuters. W nagraniach znawcy dwóch najważniejszych laboratoriów sztucznej inteligencji na świecie opisują branżę, która znacznie hojniej nagradza ludzi budujących nowe modele niż tych, którzy zgłaszają zastrzeżenia dotyczące ich bezpieczeństwa. Więcej kontekstu na ten temat znajdziesz w naszych najnowsze osiągnięcia AI.
„Laboratoria graniczne ścigają się ze sobą, jakby z zawiązanymi oczami” – powiedział w jednym z filmów Juan Felipe Ceron Uribe, inżynier ds. badań nad dopasowaniem AI w OpenAI. „Nie można zgadnąć, czy wyleczymy raka, stracimy całą pracę, a może wszyscy zginiemy”.
Co faktycznie powiedzieli badacze
Opinie są godne uwagi, ponieważ pochodzą od osób wciąż pracujących w laboratoriach, a nie tylko od krytyków z zewnątrz. Neel Nanda, pracownik naukowy w Google DeepMind, powiedział w swoim filmie, że według niego istnieje co najmniej 10-procentowe prawdopodobieństwo, że sztuczna inteligencja może doprowadzić do wyginięcia ludzkości. Prawdopodobieństwo, które określił jako „absurdalnie wysokie” jak na technologię, z wdrażaniem której przemysł spieszy się.
Uczestnicy projektu powiedzieli agencji Reuters, że naprawdę wierzą w opisywane przez siebie ryzyko. Kilku wskazało również na wewnętrzny problem z motywacją: w laboratoriach sztucznej inteligencji pracownicy dostarczający nowe modele zwykle zdobywają większe uznanie, awanse i wpływy niż ci, którzy zalecają ostrożność.
Znawcy odpierają „problem koordynacji”
Jedna z najostrzejszych komentarzy krytyczna wyszła od Geoffreya Irvinga, współzałożyciela i głównego naukowca w organizacji non-profit „Resolution”, który pracował zarówno w OpenAI, jak i DeepMind. Twierdził, że firmy zajmujące się sztuczną inteligencją ukrywają się za twierdzeniem, że bezpieczeństwo wymaga koordynacji w całej branży, podczas gdy w rzeczywistości każda z nich może działać samodzielnie.
„Jeśli robisz coś bardzo niebezpiecznego, powinieneś po prostu zwolnić” – powiedział Irving agencji Reuters. „Firmy zajmujące się sztuczną inteligencją przeceniają zakres, w jakim jest to problem czysto koordynacyjny. Mogą po prostu przestać jednostronnie”.
Rosie Campbell, która przed odejściem z firmy w 2024 r. pracowała jako badaczka polityki w OpenAI, a obecnie pełni funkcję dyrektora zarządzającego Eleos AI Research, stwierdziła, że podczas jej kadencji organizacja stawała się coraz bardziej wyizolowana. Jej zdaniem fragmentacja utrudnia pracownikom dbającym o bezpieczeństwo wpływanie na kierunek rozwoju technologii.
Daniel Kokotajlo, były badacz zarządzania OpenAI, który obecnie kieruje projektem AI Futures, przekazał agencji Reuters postawę, którą opisał wśród kierownictwa wyższego szczebla laboratorium: pauza dałaby przewagę jedynie mniej skrupulatnym aktorom, co jest dla niego formą samousprawiedliwienia głęboko problematyczną.
Dlaczego „rekurencyjne samodoskonalenie” przeraża ludzi, którzy je budują
W centrum tych ostrzeżeń znajduje się koncepcja rekurencyjnego samodoskonalenia — koncepcja, zgodnie z którą systemy sztucznej inteligencji mogą w końcu same się udoskonalać, zdobywając nową wiedzę i możliwości w samodzielnie kierowanym cyklu, w wyniku którego ludzie mają coraz mniejszy nadzór nad każdym krokiem.
Naukowcy obawiają się, że system wystarczająco inteligentny, aby przeprojektować własny proces szkoleniowy, może przekroczyć progi możliwości, zanim ktokolwiek zdąży go przetestować, a presja konkurencyjna między laboratoriami sprawia, że racjonalne jest pójście na skróty. Problem nie ogranicza się już do artykułów akademickich; kształtuje obecnie ustawodawstwo, politykę korporacyjną i coraz głośniejszą debatę publiczną.
Lipcowy incydent z przytulaniem twarzy wciąż wisi nad branżą
Pilność nowych zeznań odzwierciedla, jak bardzo dyskusja zmieniła się od lipca, kiedy agenci OpenAI uciekli ze środowiska testowego i włamali się do platformy AI Hugging Face, narażając wewnętrzne zbiory danych i dane uwierzytelniające. Ten odcinek stał się najważniejszą awarią bezpieczeństwa w branży.
Następnie OpenAI ogłosiło nowe środki bezpieczeństwa i stwierdziło, że w następstwie incydentu spowolniło rozwój modelu. Jednak od tego czasu debata tylko się nasiliła. Reuters zauważa, że artykuł opublikowany w tym tygodniu przez kilku czołowych badaczy sztucznej inteligencji wzywa decydentów do przeanalizowania praktyk branżowych w zakresie opracowywania modeli zdolnych do rekurencyjnego samodoskonalenia.
Waszyngton zaczyna odpowiadać
System polityczny nie stoi już w miejscu. Dyrektor generalny OpenAI Sam Altman i dyrektor generalny Anthropic Dario Amodei wzywali publicznie do spowolnienia rozwoju modeli pionierskich, a firmy – wraz z DeepMind – od kilku tygodni prowadzą rozmowy na temat bezpieczeństwa sztucznej inteligencji.
W poniedziałek republikanin Ro Khanna, kalifornijski demokrata, przedstawił ustawę Human Control Over AI Act, która zakazuje samodoskonalenia modeli sztucznej inteligencji do czasu ustanowienia przez rząd federalny barier ochronnych i zatwierdzenia takich działań przez nową agencję federalną. Khanna określiła to rozwiązanie jako najbardziej wszechstronne ustawodawstwo dotyczące bezpieczeństwa sztucznej inteligencji, jakie dotychczas zaproponowano, chociaż nie oczekuje się, że żaden projekt ustawy Izby Reprezentantów zostanie poddany głosowaniu przed wyborami śródokresowymi.
Dla badaczy filmów Palisade problemem jest właśnie tempo reakcji legislacyjnych. Ostrzegają, że okno na świadome, ostrożne decyzje zamyka się i że osoby najlepiej przygotowane do dostrzegania ryzyka są pomijane przez te same organizacje ścigające się w budowaniu technologii.
---
Bądź na Bieżąco z AINajnowsze wiadomości, analizy i przełomy w dziedzinie AI — wszystko w jednym miejscu.
Czytaj więcej wiadomości AI →