Abliteration.ai adlı ABD'li bir girişim, açık kaynaklı yapay zekanın en tartışmalı tekniklerinden birini ticari bir hizmete dönüştürdü ve güvenlik eğitimleri çıkarılmış popüler açık ağırlıklı modellere tarayıcı ve API erişimi sattı - Z.ai'nin yakın zamanda piyasaya sürülen, günümüzün en yetenekli açık modellerinden biri olan GLM-5.3'ü de dahil.
Şirket adını, modelin zararlı istekleri reddetme eğilimini ortadan kaldıran bir yöntem olan "abliteration"dan alıyor. Araştırmacılar ve meraklılar bu tekniği yıllardır kullanıyor ve Hugging Face binlerce parçalanmış modele ev sahipliği yapıyor. Yeni olan ise ambalajı: Abliteration.ai değiştirilmiş modelleri kendi altyapısında barındırıyor, böylece web tarayıcısı olan herkes ağırlık indirmeden veya GPU kiralamadan bunları sorgulayabiliyor. TechCrunch, gelişmeyi 3 Eylül'de bildirdi ve o zamandan beri AI haber kapsamımızda takip ettiğimiz açık ağırlık tartışmalarını takip eden güvenlik araştırmacılarının incelemesine maruz kaldı.
Yeraltı Tekniğinden Anahtar Teslim Platforma
Geçen yılın sonlarında kurulan ve resmi olarak Mart ayında kurulan Abliteration.ai, uygulamayı kendin yap açık kaynak nişinden gösterişli bir ticari ürüne taşıyor. Şirket, modellerin kendisini barındırarak iki sürtünme noktasını aynı anda ortadan kaldırıyor: Kullanıcıların artık bir modeli ortadan kaldırmak için teknik beceriye veya bir modeli çalıştırmak için hesaplamaya ihtiyacı yok.
TechCrunch'ın başka bir firmada çalışmaya devam etmesi nedeniyle kendi isteği üzerine soyadını gizleyen kurucu ortak Devon, şirketin birçok büyük bulut sağlayıcıyla anlaşma yaptığını ve tamamen müşteri gelirleriyle finanse edildiğini söyledi. Startup, görüşmelerin sürdüğünü söylemesine rağmen risk sermayesi artırmadı.
TechCrunch Testi Neyi Buldu?
Şirket, amacının "diğer modellerin yapmayı reddettiği saldırgan siber, kırmızı ekip oluşturma ve aracı testi çalışmalarını" mümkün kılmak olduğunu söylüyor. TechCrunch bunu ücretsiz bir hesapla test etti ve bir web tarayıcısı aracılığıyla GLM-5.3'ün kısaltılmış bir sürümünü sorguladı. Muhabirler modelden kayıtlı Chrome şifrelerini çalan bir Python programı yazmasını ve evde tehlikeli bir insan patojeni yetiştirmek için ayrıntılı bir protokol üretmesini istedi. Rapora göre her iki talebi de kolaylıkla yerine getirdi.
Bu deney hikayenin kalbidir: Ana akım öncü modellerin kategorik olarak reddettiği görevler artık bir tarayıcı sekmesinde ücretsiz olarak bir kayıt formunun arkasında mevcuttur.
Kırmızı Takım Savunma Argümanı
Devon'un iş dünyası için iddiası klasik güvenlik argümanıdır: Yeniden üretemeyeceğiniz davranışlara karşı savunma yapamazsınız. Çalışan bir yararlanma kodu yazmayı reddeden bir modelin, gerçek saldırganları anlamaya çalışan kırmızı bir takıma pek faydası yoktur.
TechCrunch'a "Kötü modellerin büyük resmi, kötü aktörleri modelleyebilmeleridir" dedi. "Avantajı artık savunmacıların olabildiğince hızlı hareket edebilmesi... Bunun siber güvenliği hızlandıracağını düşünüyorum ki bu da mantığa aykırı bir nokta."
Şirketin müşterileri arasında İngiltere ve Avrupa'da bankaların, havayollarının ve diğer kritik altyapı operatörlerinin güvenliğini test eden erken aşamadaki kırmızı ekip girişimleri yer alıyor. Devon, büyük müşterilerden birinin kırmızı ekibin bankacılık temsilcileri olduğunu ve bu işi değiştirilmemiş ticari modellerle gerçekleştiremeyeceğini söyledi.
'Sosyopat Olan Bir Model'
Güvenlik araştırmacıları aynı yeteneği çok farklı görüyor. AI güvenlik kar amacı gütmeyen kuruluşu CivAI'nin araştırma başkanı Andrew Yoon, TechCrunch'a, yok etmenin "modeli bir sosyopat haline gelecek şekilde değiştirmenize" olanak tanıdığını söyledi.
Yoon, "Buraya kelimenin tam anlamıyla her şeyi yazabilirsiniz ve buna uyacaktır" dedi ve "düzenlenmiş, kısaltılmış modellerin yakın gelecekte zarar vermek için kullanılmasını" beklediğini de sözlerine ekledi.
Yakın tarihli bir görüş yazısında Yoon, eğer korkulukların kaldırılması gerçekçi bir şekilde engellenemiyorsa, hükümetlerin sağlayıcıların zararlı siber ve biyolojik silah faaliyetlerini tespit eden ve engelleyen sınıflandırıcılar çalıştırmasını talep etmesi gerektiğini ve şirketlerin müşteri kimliklerini doğrulamak ve tehlikeli suiistimalden şüphelenildiğinde hizmeti reddetmek için gelişmiş GPU'lara doğrudan erişim kiralamasını zorunlu tutması gerektiğini savundu.
İnce Korkuluklar ve Kimlik Kontrolü Yok
Şimdilik Abliteration.ai'nin kendi güvenlik önlemleri minimum düzeyde. Platform, müşterilere istedikleri kısıtlamaları ekleyebilmeleri için isteğe bağlı bir denetleme katmanı sunuyor ve sitenin kendisi de bazı küçük sınırlamaları koruyor; TechCrunch, modelin intihar talimatları üretmesini sağlayamadı ve Devon, şiddeti önlemek için ek önlemler üzerinde çalıştığını söyledi.
Şirket, ödeme için kullanılan kredi kartının kaydedilmesinin ötesinde müşterinizi tanıyın taraması yapmıyor. "Birinin çılgınca bir şey yapmasından sorumlu kişi olmak istemezsiniz... o halde şirket olarak sorumluluğunuzun sınırını nereye çizersiniz?" dedi Devon. "Hala bunu tanımlama sürecindeyiz."
Sektörün Kaçamayacağı Bir Soru
Her güvenlik uzmanı, zayıflatılmış modellerin saldırı testleri için en iyi araç olduğu konusunda hemfikir değil. Temsilci kırmızı ekip oluşturma firması Fabraix'in CEO'su Ahmed Aly, TechCrunch'a şirketinin, halihazırda birkaç reddedilmeyle birlikte gönderilen açık ağırlık modellerinin ince ayarına daha çok güvendiğini ve ortadan kaldırmanın bir modelin temel yeteneklerini bozabileceğini belirtti.
TechCrunch'ın danıştığı uzmanların çoğu tek bir konuda hemfikir: Uygulama durdurulamaz. İndirilebilir ağırlıklar, West Point'teki Terörizmle Mücadele Merkezi'nin "yok etme"nin kötüye kullanımına ilişkin 2026 tarihli bir yorumunda vurgulandığı gibi, herkesin yerel olarak retleri kaldırabileceği anlamına geliyor. Abliteration.ai'nin zorladığı açık soru, herkes (hem savunucular hem de saldırganlar) için erişim maliyetini düşürmenin interneti daha güvenli mi yoksa daha tehlikeli mi kılacağıdır.
Yapay Zekanın Önünde Olun
Yapay zeka güvenliği her gün gelişiyor. En son AI gelişmelerini tek bir yerden edinin.
Daha fazla AI haberini okuyun →