Een Amerikaanse startup genaamd Abliteration.ai heeft een van de meest controversiële open source AI-technieken omgezet in een commerciële dienst, door browser- en API-toegang te verkopen aan populaire open-weight-modellen zonder veiligheidstraining - inclusief Z.ai's onlangs uitgebrachte GLM-5.3, een van de meest capabele open modellen die momenteel beschikbaar zijn.
Het bedrijf ontleent zijn naam aan ‘abliteration’, een methode die de neiging van een model om schadelijke verzoeken te weigeren wegneemt. Onderzoekers en hobbyisten gebruiken de techniek al jaren, en Hugging Face herbergt duizenden vernietigde modellen. Wat nieuw is, is de verpakking: Abliteration.ai host aangepaste modellen op zijn eigen infrastructuur, zodat iedereen met een webbrowser ze kan opvragen zonder gewichten te downloaden of GPU's te huren. TechCrunch rapporteerde de ontwikkeling op 3 september en heeft sindsdien aandacht gekregen van veiligheidsonderzoekers die het debat over open gewichten volgen dat we volgen in onze [AI-nieuwsverslaggeving] (https://aibuzzwire.news).
Van ondergrondse techniek tot kant-en-klaar platform
Abliteration.ai werd eind vorig jaar opgericht en officieel opgericht in maart en verplaatst de praktijk van een doe-het-zelf open source-niche naar een gepolijst commercieel product. Door de modellen zelf te hosten, neemt het bedrijf twee knelpunten tegelijk weg: gebruikers hebben niet langer de technische vaardigheden nodig om een model te ablateren, noch de rekenkracht om er een uit te voeren.
Mede-oprichter Devon – TechCrunch heeft op zijn verzoek zijn achternaam verborgen gehouden omdat hij bij een ander bedrijf blijft werken – zei dat het bedrijf deals heeft gesloten met verschillende grote cloudproviders en volledig wordt gefinancierd uit klantinkomsten. De startup heeft geen durfkapitaal opgehaald, hoewel hij zei dat er gesprekken gaande zijn.
Wat de test van TechCrunch heeft gevonden
Het bedrijf zegt dat het zijn doel is om ‘offensief cyber-, red-teaming- en agenttestwerk mogelijk te maken dat andere modellen weigeren te doen’. TechCrunch heeft dat op de proef gesteld met een gratis account, waarbij via een webbrowser een verwijderde versie van GLM-5.3 werd opgevraagd. De verslaggevers vroegen het model een Python-programma te schrijven dat opgeslagen Chrome-wachtwoorden steelt, en een gedetailleerd protocol op te stellen voor het thuis kweken van een gevaarlijke menselijke ziekteverwekker. Volgens het rapport heeft het land aan beide verzoeken voldaan.
Dat experiment vormt de kern van het verhaal: taken die reguliere frontier-modellen categorisch weigeren, zijn nu kosteloos beschikbaar achter een aanmeldingsformulier op een browsertabblad.
Het verdedigingsargument van het Rode Team
Devons pleidooi voor het bedrijfsleven is het klassieke veiligheidsargument: je kunt je niet verdedigen tegen gedrag dat je niet kunt reproduceren. Een model dat weigert werkende exploitcode te schrijven, heeft weinig nut voor een rood team dat echte aanvallers probeert te begrijpen.
"Het grote beeld van geablitereerde modellen is dat ze slechte acteurs kunnen modelleren", vertelde hij aan TechCrunch. "Het voordeel is dat de verdedigers nu zo snel mogelijk kunnen bewegen... Ik denk dat het de cyberveiligheid zal versnellen, wat een soort contra-intuïtief punt is."
Tot de klanten van het bedrijf behoren onder meer startende red-teaming startups in Groot-Brittannië en Europa die de veiligheid van banken, luchtvaartmaatschappijen en andere exploitanten van kritieke infrastructuur testen. Eén grote klant, zei Devon, was een team van bankagenten en kon dat werk niet uitvoeren met ongewijzigde commerciële modellen.
'Een model dat een sociopaat wordt'
Veiligheidsonderzoekers zien hetzelfde vermogen heel anders. Andrew Yoon, hoofd onderzoek bij de AI-veiligheidsnon-profitorganisatie CivAI, vertelde TechCrunch dat je met abliteratie 'het model kunt aanpassen zodat het een sociopaat wordt'.
"Je kunt hier letterlijk alles intypen, en het zal eraan voldoen", zei Yoon, eraan toevoegend dat hij verwacht dat "bewerkte, vernietigde modellen in de nabije toekomst zullen worden gebruikt om schade aan te richten."
In een recent opiniestuk betoogde Yoon dat als het verwijderen van vangrails realistisch gezien niet kan worden voorkomen, overheden van providers zouden moeten eisen dat ze classificatoren gebruiken die schadelijke cyber- en biowapenactiviteiten detecteren en blokkeren, en van bedrijven die directe toegang tot geavanceerde GPU's huren, zouden moeten eisen dat ze de identiteit van klanten verifiëren en diensten weigeren wanneer gevaarlijk misbruik wordt vermoed.
Dunne vangrails en geen identiteitscontroles
Voorlopig zijn de eigen veiligheidsmaatregelen van Abliteration.ai minimaal. Het platform biedt klanten een optionele moderatielaag zodat ze alle beperkingen kunnen toevoegen die ze willen, en de site zelf handhaaft enkele kleine limieten – TechCrunch kon het model niet zover krijgen zelfmoordinstructies te produceren, en Devon zei dat hij werkt aan aanvullende maatregelen om geweld te voorkomen.
Het bedrijf voert geen ken-uw-klant-screening uit, afgezien van het registreren van de creditcard die voor de betaling is gebruikt. "Je wilt niet de persoon zijn die verantwoordelijk is voor iemand die iets geks doet... dus waar trek je de grens van wat je verantwoordelijkheid is als bedrijf?" zei Devon. "We zijn nog bezig om dat te definiëren."
Een vraag die de industrie niet kan ontwijken
Niet elke beveiligingsprofessional is het ermee eens dat geablitereerde modellen zelfs het beste hulpmiddel zijn voor offensieve tests. Ahmed Aly, CEO van het agent red-teaming-bedrijf Fabraix, vertelde TechCrunch dat zijn bedrijf meer afhankelijk is van het verfijnen van open-weight-modellen, die al met weinig weigeringen worden geleverd – en merkt op dat abliteratie de onderliggende capaciteiten van een model kan aantasten.
De meeste door TechCrunch geraadpleegde experts zijn het over één ding eens: de praktijk kan niet worden gestopt. Dankzij downloadbare gewichten kan iedereen weigeringen lokaal verwijderen, zoals een commentaar uit 2026 van het Combating Terrorism Center in West Point over misbruik van ‘abliteratie’ onderstreepte. De open vraag die Abliteration.ai-krachten stelt is of het verlagen van de toegangskosten voor iedereen – zowel verdedigers als aanvallers – het internet veiliger of gevaarlijker maakt.
Blijf AI een stap voor
AI-veiligheid evolueert dagelijks. Ontvang de nieuwste AI-ontwikkelingen op één plek.
Lees meer AI-nieuws →