Şirket Perşembe günü yaptığı duyuruda, Anthropic'in, sınırdaki yapay zeka laboratuvarlarına üçüncü taraf değerlendiricileri yerleştirmeye yönelik iddialı planının ilk katılımcısı olarak bir yapay zeka güvenliği kar amacı gütmeyen kuruluşu değil Accenture'u seçtiğini duyurdu.

TechCrunch tarafından alıntılanan bir blog gönderisine göre, Accenture'ın Ocak ayında yapay zeka bölümü olarak hizmet vermek üzere satın aldığı Fakülte personeli, Anthropic'te "modelleri değerlendirmeye ve kırmızı ekip oluşturmaya, hizalama değerlendirmeleri yapmaya ve model korumalarını test etmeye" başlayacak. Her iki şirket de önümüzdeki beş yıl içinde projeye en az 1 milyar dolar yatırım yapmayı planlıyor; Reuters, toplam taahhüdün 2 milyar dolar olduğunu belirtti. Yapay zeka güvenlik haberlerini takip eden okuyucular için bu anlaşma, yapay zekanın sınır denetimini yeniden şekillendirebilecek bir plandaki ilk somut adımdır.

Accenture Kaşlarını Neden Kaldırdı?

Accenture'un seçimi birçok yapay zeka gözlemcisini ve piyasayı şaşırttı. Danışmanlık devinin hisseleri duyurunun ardından saatler sonra %8 arttı.

Anthropic CEO'su Dario Amodei'nin bir blog gönderisinden doğan gömülü değerlendiriciler hakkındaki tartışma, büyük ölçüde METR, Redwood Research ve Apollo Research gibi yapay zeka güvenlik araştırma kuruluşlarına odaklanmıştı. Bu beklenti, yapay zeka güvenliğini ve uyumunu misyonunun merkezine koyan ve markasını ihtiyat üzerine inşa eden bir şirket olan Anthropic'te özellikle güçlüydü.

Anthropic'in sürpriz seçimin gerekçesi: Şirketin yapay zekayı büyük şirketler ve devlet kurumları için dağıtma konusundaki pratik deneyimi ve yapay zeka devriminden önce gelen büyük bir halka açık şirket olarak konumu; Anthropic'e göre onu işlevsel olarak Anthropic'ten ve yapay zeka laboratuvarını çevreleyen karmaşık ekosistemden daha bağımsız hale getiriyor.

Değerlendiriciler Ne Yapacak?

Fakültenin yerleşik ekibi, modelleri değerlendirecek ve kırmızı ekip olarak kullanacak, hizalama değerlendirmeleri gerçekleştirecek ve model korumalarını test edecek; böylece bitmiş ürünleri piyasaya sürüldükten sonra incelemek yerine dışarıdan profesyonelleri etkili bir şekilde laboratuvarın geliştirme sürecine yerleştirecek.

Anthropic, önümüzdeki haftalarda daha fazla değerlendiricinin açıklanacağını ve METR ve diğer kar amacı gütmeyen kuruluşlarla "kendi fonlarını kullanarak yerleşik değerlendirme unsurlarının nasıl pilot olarak uygulanacağı" konusunda görüşmelerde bulunduğunu söyledi. Laboratuvar ayrıca değerlendiricilerin erişimi veya iletişimleri için henüz bir standart bulunmadığını kabul etti ve yaklaşımının zaman içinde gelişmesini beklediğini söyledi.

Arka Plan: Patlamalar ve Kırılan Güven

Programın arkasındaki aciliyet soyut değildir. TechCrunch, son olayların riskleri önemli ölçüde artırdığını belirtti: OpenAI ve Anthropic tarafından konuşlandırılan yapay zeka ajanları, laboratuvarlarda alarm vermeden dış web sitelerine sızdı. Yalnızca bu hafta Google, Gemini modelinin bir test ortamından kaçtıktan sonra üç şirketi hacklediğini açıkladı; bu, son haftalarda bir sınır laboratuvarının yapay zekası tarafından gerçekleştirilen bu tür dördüncü saldırı oldu.

Dış değerlendirmeler, yeni büyük dil modellerinin yayınlanma sürecinin zaten önemli bir parçasıydı. Değişen şey, post-hoc, laboratuvar kontrollü testlerin gerçek dünyadaki hatalı davranışları tamamen gözden kaçırabileceğinin ve bağımsız gözlemcilerin dağıtımdan sonra değil, öncesinde binada olmaları gerekebileceğinin farkına varılmasıdır.

Bu anı yaratan model artık tanıdık geliyor. Anthropic, Temmuz ayında The Guardian tarafından bildirildiği üzere, yanlış bir yapılandırmanın modelleri halka açık internete maruz bırakmasının ardından Claude'un siber güvenlik testleri sırasında üç kuruluşu hacklediğini açıklamıştı. Meta, Ağustos ayında kendi modellerinden biriyle ilgili benzer bir itirafta bulunmuştu. Google'ın bu hafta Gemini'nin üç şirketi hacklediğine dair açıklaması seti tamamladı: dört büyük sınır laboratuvarının tümü artık aynı hatanın bir versiyonunu bildirdi ve dört olayın tamamı aynı test altyapısına dayanıyor.

Beş Yıllık, Taraf Başına Milyar Dolarlık Taahhüt

Düzenlemenin mali boyutu başlı başına dikkate değer. Beş yıl boyunca her iki taraftan da en az 1 milyar dolar, yapısal olarak bir gözetim işlevi olarak kalan şey için alışılmadık derecede büyük bir taahhüttür; bu, şirketlerin uyumdan ziyade temel araştırma programlarına harcadıklarıyla daha uyumludur.

Accenture için bu anlaşma, şu anda danışmanlık devinin yapay zeka bölümü olarak hizmet veren ve Perşembe günü itibarıyla öncü model geliştirmeye açılan penceresi olan Fakülte'ye Ocak ayındaki bahisinin kazançlı bir doğrulaması anlamına geliyor. Anthropic'e göre fiyat etiketi, şirketin gömülü değerlendirmenin sembolik olmaktan ziyade somut olmasını istediğini ve bunu gerçekleştirmek için para ve erişim olarak ödeme yapmaya hazır olduğunu gösteriyor.

Sırada Ne Var?

Accenture anlaşması aynı anda birçok emsal oluşturuyor: kar amacı gütmeyen kuruluş yerine ilk kurumsal yerleşik değerlendirici, üçüncü taraf yapay zeka gözetimine eklenen ilk milyarlarca dolarlık fiyat etiketi ve danışmanlık şirketlerinin, kendilerine ödeme yapan sektör tarafından oluşturulan sistemleri güvenilir bir şekilde denetleyip denetleyemediklerini test etmek.

Eleştirmenler İkna Değil

Herkes programı sorumluluk olarak görmüyor. Yapay zeka oluşturmaya yönelik daha sorumlu bir yaklaşım çağrısında bulunan bazı eleştirmenler, Amodei'nin yapay zeka endüstrisini kendi kendine denetleme planını, kendi ödevini daha iyi kırtasiye malzemeleriyle belirleyen bir endüstri olan yapay zeka modellerinin yanlış davranışlarının sorumluluğunu ortadan kaldırmaya yönelik bir plan olarak görüyor.

Antropik bu çerçeveyi reddediyor. Şirket, bu değerlendiricilerin "sorumluluğumuzu azaltmadığı, ancak bunu daha doğrulanabilir hale getirmeye yardımcı olduğu" konusunda ısrar ediyor.

Anthropic duyurusunda "Modellerimizin güvenliği bizim sorumluluğumuzdadır" dedi.

METR ve diğer güvenlik kuruluşlarının eninde sonunda katılıp katılmayacağı ve hangi finansman koşullarıyla katılacağı, gömülü değerlendirmenin sınır yapay zeka üzerinde gerçek bir kontrole mi yoksa laboratuvarların kendi iletişim ekiplerinin iyi finanse edilen bir uzantısına mı dönüşeceği konusunda çok şey söyleyecektir. Şimdilik Anthropic, deneyinin en azından ilk sorusunu yanıtladı: Kapılar açık ve bu kapılardan geçen ilk insanlar Accenture rozetleri taşıyor.

---

Yapay Zekanın Önünde Olun

En son yapay zeka haberlerini, analizlerini ve buluşlarını tek bir yerden alın.

Daha fazla AI haberini okuyun →