Według nowego testu porównawczego przeprowadzonego przez organizację non-profit zajmującą się bezpieczeństwem FAR.AI, modele Frontier AI znacznie różnią się pod względem tego, jak trudno je złamać, a różnica jest znacznie większa, niż wielu przypuszczało.
29 lipca FAR.AI uruchomiło ranking bezpieczeństwa AI, testując zabezpieczenia czterech wiodących modeli w identycznych warunkach. Organizacja stwierdziła, że modele Claude Fable 5 firmy Anthropic i GPT-5.6 Sol firmy OpenAI wytrzymały ataki, podczas gdy Grok 4.5 firmy xAI i Gemini 3.1 Pro firmy Google osiągnęły cenę poniżej 300 dolarów – podała organizacja. FAR.AI określiło różnicę między najbardziej i najmniej solidnymi modelami jako „stukrotną lukę” w zabezpieczeniach. Więcej kontekstu na ten temat znajdziesz w naszych trendy AI.
Oprócz tabeli liderów, FAR.AI wprowadziło tak zwany Minimalny Standard Zabezpieczeń, wspólny poziom bazowy bezpieczeństwa złożony w całości z zabezpieczeń, które programiści współpracujący już uruchomili w środowisku produkcyjnym. Celem jest zapewnienie laboratoriom betonowej podłogi do spełnienia i uwidocznienie słabych zabezpieczeń.
Wyniki odzwierciedlają wcześniejsze testy warunków skrajnych przeprowadzone przez FAR.AI. Z majowego raportu wynika, że zabezpieczenia DeepSeek-V4-Pro „zawaliły się prawie całkowicie”, a osoby atakujące o niskich umiejętnościach omijały mechanizmy bezpieczeństwa w 98–100% przypadków w każdej testowanej domenie. Publicznie dostępny jailbreak zbudowany dla poprzednika modelu działał bez ani jednej modyfikacji, co sugeruje, że znane luki nie zostały załatane.
WIRED, zamieszczając swoje raporty na tablicy wyników, stwierdził, że „przerażająco łatwo jest jailbreakować niektóre pionierskie modele sztucznej inteligencji”. W miarę jak agenci podejmują się bardziej wrażliwych zadań, rozbieżności rodzą palące pytania dotyczące tego, które systemy można bezpiecznie wdrożyć.
Aby na bieżąco relacjonować badania nad bezpieczeństwem i ochroną sztucznej inteligencji, czytelnicy mogą śledzić AI Buzz Wire.
---
Bądź na Bieżąco z AINajnowsze wiadomości, analizy i przełomy w dziedzinie AI — wszystko w jednym miejscu.
Czytaj więcej wiadomości AI →