Τα μοντέλα Frontier AI διαφέρουν πολύ ως προς το πόσο δύσκολο είναι να σπάσουν, σύμφωνα με ένα νέο σημείο αναφοράς από τον μη κερδοσκοπικό οργανισμό ασφάλειας FAR.AI — και το χάσμα είναι πολύ μεγαλύτερο από ό,τι πολλοί υποθέτουν.
Στις 29 Ιουλίου, η FAR.AI παρουσίασε το Leaderboard για την ασφάλεια AI, δοκιμάζοντας τις διασφαλίσεις τεσσάρων κορυφαίων μοντέλων υπό τις ίδιες συνθήκες. Το Claude Fable 5 της Anthropic και το GPT-5.6 Sol του OpenAI αντιμετώπισαν σταθερά τις επιθέσεις, ενώ το Grok 4.5 της xAI και το Gemini 3.1 Pro της Google έσπασαν το καθένα για κάτω από 300 δολάρια, είπε ο οργανισμός. Η FAR.AI περιέγραψε τη διαφορά μεταξύ των πιο στιβαρών και των λιγότερο στιβαρών μοντέλων ως «εκατονταπλάσιο χάσμα» στις διασφαλίσεις. For more context on this story, see our ongoing AI news.
Παράλληλα με το leaderboard, η FAR.AI εισήγαγε αυτό που αποκαλεί Minimal Standard for Safeguards, μια κοινή γραμμή βάσης ασφαλείας που συναρμολογείται εξ ολοκλήρου από άμυνες που ήδη τρέχουν στην παραγωγή οι ομότιμοι προγραμματιστές. Ο στόχος είναι να δοθεί στα εργαστήρια ένα τσιμεντένιο δάπεδο για να συναντηθούν — και να γίνουν ορατές οι αδύναμες προστασίες.
Τα ευρήματα απηχούν προηγούμενα stress tests του FAR.AI. Μια αναφορά του Μαΐου διαπίστωσε ότι οι διασφαλίσεις του DeepSeek-V4-Pro είχαν «καταρρεύσει σχεδόν εντελώς», με τους εισβολείς χαμηλής ικανότητας να παρακάμπτουν τους μηχανισμούς ασφαλείας 98–100% των περιπτώσεων σε κάθε τομέα που ελέγχεται. Ένα δημοσίως διαθέσιμο jailbreak που δημιουργήθηκε για τον προκάτοχο του μοντέλου λειτούργησε χωρίς καμία τροποποίηση, υποδηλώνοντας ότι τα γνωστά τρωτά σημεία δεν επιδιορθώθηκαν.
Το WIRED, αναφέροντας στον πίνακα κατάταξης, κατέληξε στο συμπέρασμα ότι παραμένει «τρομακτικά εύκολο να κάνεις jailbreak ορισμένα μοντέλα τεχνητής νοημοσύνης συνόρων». Καθώς οι πράκτορες αναλαμβάνουν πιο ευαίσθητες εργασίες, η ανισότητα εγείρει πιεστικά ερωτήματα σχετικά με τα συστήματα που είναι ασφαλή για ανάπτυξη.
Για συνεχή κάλυψη της έρευνας για την ασφάλεια και την ασφάλεια της τεχνητής νοημοσύνης, οι αναγνώστες μπορούν να ακολουθήσουν το AI Buzz Wire.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →