Google DeepMind, yapay genel zeka hakkındaki tartışmayı genişletmeye adanmış yeni bir enstitü başlattı ve açılış makaleleri, kullanıma sunulmadan önce sınır yapay zeka modellerini değerlendirecek ABD liderliğindeki bir kurum için Demis Hassabis'in somut bir teklifini içeriyor.
Çarşamba günü Google ve Google DeepMind araştırmacıları tarafından başlatılan DeepMind Enstitüsü, TechCrunch'a göre DeepMind kurucu ortağı Shane Legg'i yönetici editörü olarak, Google yöneticisi James Manyika ve Google DeepMind başkanı Demis Hassabis'i de yönetici olarak listeliyor. For more context on this story, see our ongoing artificial intelligence updates.
Katılmıyorum
Enstitünün belirtilen amacı, Google'ın kendi içindekiler de dahil olmak üzere gerçek anlaşmazlıkları ortaya çıkarmaktır. Duyuruda, "Her zaman aynı fikirde olmayacaklar ve hızla ilerleyen sınırda daha fazla veri ve bilgi gün ışığına çıktıkça muhtemelen fikirlerini değiştirecekler" deniyor.
İlk koleksiyonu, olası YGZ kesintilerini yönetmeye yönelik ekonomi politikalarını, insan tarafından okunabilir model mantığını, insanın gelişmesine yönelik ilkeleri ve öncü yapay zeka modellerini değerlendirmeye yönelik bir çerçeveyi kapsayan dört makaleden oluşuyor.
Açık anlaşmazlığın kurumsallaştırılması, genel mesajlaşmanın sıkı bir şekilde kontrol edildiği kurumsal bir yapay zeka laboratuvarı için alışılmadık bir harekettir. Enstitü, tasarımı gereği Google araştırmacılarına, şirketin ticari çıkarlarıyla veya birbirlerinin ticari çıkarlarıyla çatışabilecek pozisyonları tartışabilecekleri bir alan sağlıyor.
Şeffaflık Denemesi: 'Opak Seri Derinliğini' İzleyin
DeepMind güvenlik araştırmacıları Rohin Shah ve Anca Dragan tarafından yazılan dört makaleden biri, yeni mimariler en güçlü modellerin izlenmesini zorlaştırsa bile yapay zekanın daralan şeffaflık penceresinin (bir modelin adım adım mantığını görme ve kontrol etme yeteneği) kaçınılmaz olmadığını savunuyor.
Yazarlar, geliştiricilerin ve düzenleyicilerin güvenlikle ilgili ödünleşimlerle doğrudan yüzleşmesi gerektiğini söylüyor. Somut olarak bu, "opak seri derinlik" olarak adlandırdıkları şeyin (bir modelin okunabilir bir akıl yürütme izi üretmeden gerçekleştirebileceği sıralı hesaplama miktarının) sınırlandırılması veya geliştiricilerin daha az şeffaf sistemlerin yorumlanabilir sistemler kadar izlenebilir kaldığını göstermelerini gerektirmesi anlamına gelebilir.
Teklif, yorumlanabilirlik kaybını ölçeğin kaçınılmaz bir sonucu olarak değil, bir tasarım ve politika tercihi olarak ele alması ve düzenlemeye yazılabilecek gereksinimlere kapı açması nedeniyle dikkate değerdir.
Hassabis'in Önerisi: ABD Sınır Standartları Kurumu
En önemli makale Hassabis'inki olabilir. Kendisi, en gelişmiş yapay zeka modellerini değerlendirmekle görevli, ABD öncülüğünde bir sınır yapay zeka standartları organı öneriyor. Çerçeve kapsamında, geliştiriciler başlangıçta modelleri gönüllü olarak yayınlanmadan 30 gün öncesine kadar incelenmek üzere göndereceklerdi. Değerlendirme sisteminin etkili olduğu kanıtlandığında, testlerini geçmek Amerika Birleşik Devletleri'nde öncü modellerin uygulanması için bir gereklilik haline gelebilir.
Organ, yapay zeka şirketlerine danışarak değerlendirmeler tasarlayarak başlayacak, ancak sonunda laboratuvarların modellerini, kamu değerlendirme rejimlerinin iyi belgelenmiş bir başarısızlık modu olan bilinen kriterlere göre uyarlamasını önlemek için bağımsız, açıklanmayan değerlendirmeler (yazının "uzun süreli" testler olarak adlandırdığı) geliştirecektir.
Hassabis aynı zamanda gerilimi tırmandırmaya da açık kapı bıraktı: Çerçeve, "durumun ciddiyeti gerektiriyorsa hızlandırılabilir" ve potansiyel olarak sınırdaki yapay zeka geliştiricileri arasında koordineli bir yavaşlama da dahil olabilir.
Diğer İki Deneme Neden Önemli?
Geriye kalan iki makale (YGZ kesintilerini yönetmeye yönelik ekonomik politikalar ve insanlığın gelişmesi için ilkeler üzerine) YGZ'yi tamamen teknik bir sorun olmaktan ziyade toplum çapında bir sorun olarak ele alan bir derlemeyi tamamlıyor. Ekonomik yer değiştirme, uzun zamandır gelişmiş yapay zekayla ilgili en somut kamu kaygısı olmuştur ve bunu değerlendirme politikası ve yorumlanabilirlik ile birlikte çerçevelemek, enstitünün politika yapıcıların parçaları ayrı tartışmalardan ziyade tek bir gündem olarak görmesini istediğini göstermektedir.
Bu genişlik aynı zamanda Google'ın konumlandırmasının da bir sinyalidir. Şirket, kurumsal müşteriler ve devlet sözleşmeleri için rekabet ederken, aynı zamanda sınır sistemlerinin dışarıdan incelemeye ihtiyaç duyduğunu da savunuyor. Gerginliği yumuşatmak yerine yayınlamak enstitünün temel ilkesidir.
Endişeden Somut Önerilere
Makaleler, sektördeki güvenlik tartışmasının geniş endişe açıklamalarından spesifik mekanizmalara doğru kaymasıyla birlikte geliyor: açıklama gereklilikleri, dışarıdan inceleme ve - eğer önlemler geride kalırsa - koordineli yavaşlamalar. Bu değişim, TechCrunch'a göre endüstri liderlerinin Anthropic CEO'su Dario Amodei'nin yapay zeka gelişimini "hızlandırma" yönündeki çağrısının unsurlarını onaylamasıyla bu hafta hızlandı.
Zamanlama önemlidir. Atlantik'in her iki yakasındaki hükümetler, yetenekleri değerlendirme altyapısından daha hızlı gelişen sistemleri nasıl denetleyeceklerini değerlendiriyor. Önde gelen bir yapay zeka laboratuvarından gelen ve yayın öncesi diş incelemesini içeren bir teklif, politika yapıcılara sektörün kendisinin nominal olarak desteklediği ve tarihsel olarak anlamlı yapay zeka düzenlemesi için bir ön koşul olan bir şablon sunuyor.
Ne İzlemeli
Enstitünün Google'dan editoryal bağımsızlığı ilk test olacak. Eğer makaleler Google'ın ticari yol haritasına ters düşen pozisyonları içermeye devam ederse (şeffaflık makalesinin tartışmasız yaptığı gibi), mekan YGZ politikası tartışmasına ciddi bir katkıda bulunabilir. Kurumsal mesajlaşmaya yönelirse kalabalık bir alanda bir PR kanalı daha olacak.
Her iki durumda da, konu artık masada: yayın öncesi değerlendirme gereklilikleri, ertelenen testler ve hatta koordineli bir yavaşlama bile yapay zekanın en güçlü isimlerinden biri tarafından kamuoyu önünde tartışılıyor. Sorun artık sınır modellerinin bağımsız olarak değerlendirilip değerlendirilmemesi gerektiği değil, değerlendirmeyi kimin ve hangi zaman çizelgesinde yapacağıdır.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →