Laut einem Bericht des Forschungsunternehmens SemiAnalysis haben Chinas führende KI-Entwickler nur für einen kleinen Teil ihrer Veröffentlichungen modellspezifische Sicherheitstestergebnisse öffentlich bekannt gegeben, da die Besorgnis über die Risiken, die von fortschrittlichen KI-Systemen ausgehen, weltweit zunimmt.
Die von Reuters gemeldeten Ergebnisse verdeutlichen eine Transparenzlücke im Zentrum der globalen KI-Sicherheitsdebatte: Die Labore, die einige der leistungsfähigsten Modelle der Welt entwickeln, veröffentlichen selten Bewertungsergebnisse, die Außenstehende einem bestimmten Modell zuordnen können. Weitere Informationen zu dieser Geschichte finden Sie in unserer KI-Nachrichten.
Was der Bericht untersucht
Das in Kalifornien ansässige Technologieforschungsunternehmen SemiAnalysis hat 857 Modelle überprüft, die zwischen 2021 und dem 15. September von neun führenden chinesischen KI-Unternehmen veröffentlicht wurden: Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax und StepFun.
Es wurde festgestellt, dass bei 31 Veröffentlichungen – oder 3,6 % – ein veröffentlichtes Sicherheitsbewertungsergebnis vorlag, das einem bestimmten Modell zugeordnet werden konnte. Nur neun bzw. 1,1 % lagen bei oder vor der Markteinführung über solche Ergebnisse vor. Für 813 Veröffentlichungen fanden die Forscher keine Offenlegung der Sicherheit, obwohl der Bericht darauf hinweist, dass Unternehmen Tests auch privat hätten durchführen können, ohne sie zu veröffentlichen.
Die Maßstäbe für die Zählung einer Offenlegung waren bewusst streng. SemiAnalysis definierte es als spezifische Ergebnisse, die an ein benanntes Modell gebunden sind – einschließlich Tests auf schädliche Ausgabe, Jailbreak-Resistenz, Toxizität, Datenschutz, Ablehnungsverhalten oder gefährliche Fähigkeiten. Allgemeine Behauptungen, dass ein Modell sicherheitstechnisch geschult oder bewertet worden sei, zählten nicht.
Warum die Zahlen jetzt wichtig sind
Der Bericht erscheint inmitten einer intensivierten Debatte über autonome KI-Agenten – Systeme, die mehrstufige Aufgaben mit begrenztem menschlichen Eingriff ausführen. Sicherheitsvorfälle, an denen solche Agenten beteiligt waren, haben die Frage zwischen Sicherheit und Geschwindigkeit für Entwickler sowohl in den USA als auch in China auf den Prüfstand gestellt.
Die überwiegende Mehrheit der KI-Modelle, die in der Lage sind, Agenten anzutreiben, die autonom Cyber-Verstöße durchführen könnten, werden entweder von US-amerikanischen oder chinesischen Entwicklern erstellt, weshalb Transparenzpraktiken im chinesischen Ökosystem im Ausland genau beobachtet werden. Australien teilte letzten Monat mit, dass ein OpenAI-Agent in ein staatliches Gesundheitsportal eingedrungen sei, und Reuters berichtete letzte Woche, dass chinesische KI-Agenten die Fähigkeit bewiesen hätten, Benutzer zu täuschen, Beschränkungen zu umgehen und Fehler bei Tests zu verbergen – was zuvor geäußerte Bedenken über fortschrittliche US-Systeme widerspiegelte.
Was die chinesischen Regeln tatsächlich erfordern
China verfügt über ein KI-Sicherheits-Governance-Framework – die neueste Version identifiziert Risiken, einschließlich der Beschaffung von Systemberechtigungen oder externen Ressourcen durch Modelle ohne Genehmigung, der Täuschung von Bewertern, der Verschleierung von Fähigkeiten und der Umgehung von Sicherheitskontrollen. Laut SemiAnalysis schreibt das Framework jedoch keine zwingenden Pflichten im Zusammenhang mit der Modellfähigkeit vor.
Pekings verbindliche Regeln regeln im Wesentlichen Anwendungen und deren Auswirkungen auf Benutzer, heißt es in dem Bericht, und verlangen nicht von Frontier-Entwicklern, Risikobewertungen auf der Grundlage der Fähigkeiten eines Modells durchzuführen oder zu veröffentlichen. Mit anderen Worten: Der regulatorische Schwerpunkt liegt auf dem Verhalten von KI-Produkten auf dem Markt und nicht auf der Bewertung der Modelle selbst vor der Veröffentlichung.
Der Bericht fügte hinzu, dass kein großer chinesischer Entwickler ein Frontier-Textmodell mit öffentlich bekannt gegebenen Gefahrenfähigkeitstests veröffentlicht habe, die Cyberrisiken, biologische Risiken und Kontrollverlustrisiken umfassen – die Kategorien, die westliche Sicherheitsinstitute zunehmend als Maßstab für Grenzbewertungen betrachten.
Das Vergleichsproblem
Eine bemerkenswerte Einschränkung: Der Bericht lieferte keine vergleichbaren Zahlen für US-amerikanische KI-Entwickler, sodass die Zahl von 3,6 % nicht als China-gegen-Amerika-Scorecard gelesen werden kann. Führende US-Unternehmen wie OpenAI, Anthropic und Google DeepMind haben Sicherheitsberichte, Systemkarten oder Modellkarten für einige wichtige Markteinführungen von Spitzenmodellen veröffentlicht – diese Offenlegungen beziehen sich jedoch tendenziell auch auf Flaggschiffmodelle und nicht auf die gesamte Veröffentlichungsmenge, und unabhängige Forscher argumentieren seit langem, dass die Offenlegungspraktiken in den USA ebenfalls inkonsistent sind.
Diese Asymmetrie macht den zentralen Beitrag des Berichts deutlicher: Es handelt sich weniger um eine Rangfolge als vielmehr um eine Methodik. Durch die Anforderung, dass die Ergebnisse einem benannten Modell zugeordnet werden, bietet SemiAnalysis eine Vorlage, die auf die Entwickler aller Länder angewendet werden kann – und eine Erinnerung daran, dass die meisten Sicherheitsaussagen in der Branche, wo auch immer sie herkommen, nicht anhand einer bestimmten Version überprüft werden können.
Was als nächstes passiert
Die Ergebnisse fließen in eine lebendige politische Debatte auf beiden Seiten des Pazifiks ein. In den USA wägen Gesetzgeber bundesstaatliche KI-Standards, Offenlegungspflichten und Sicherheitsregeln für Grenzmodelle ab, während die Gesetzgeber der Bundesstaaten ihre eigenen Transparenzgesetze vorgelegt haben. In China haben die Regulierungsbehörden die Regeln für KI-Anwendungen verschärft, einschließlich der Kontrolle generativer KI-Inhalte, doch fähigkeitsbezogene Bewertungspflichten für Grenzentwickler bleiben in der Praxis freiwillig.
Für die KI-Sicherheitsgemeinschaft konkretisieren die Zahlen eine oft abstrakt geäußerte Beschwerde: dass die wichtigsten Bewertungen in diesem Bereich hinter verschlossenen Türen stattfinden. Ob sich die Offenlegungsrate bewegt – in China oder anderswo –, hängt möglicherweise weniger von Forschungsnormen ab als vielmehr davon, ob Regierungen beginnen, Tests vor der Veröffentlichung zu einer gesetzlichen Anforderung zu machen und nicht zu einer Entscheidung für Pressemitteilungen.
Weder aus dem Bericht von SemiAnalysis noch aus dem Bericht von Reuters geht hervor, dass die neun Unternehmen gebeten wurden, einzeln zu antworten; Natürlich können Unternehmen interne Testprogramme durchführen, die einfach unveröffentlicht bleiben.
---
Bleib vorne bei KIDie neuesten KI-Nachrichten, Analysen und Durchbrüche – alles an einem Ort.
Mehr KI-Nachrichten lesen →