Anthropic, bu hafta kendi geliştirme hattına türünün ilk örneği olan bir bakış yayınladı ve Claude modelinin şu anda şirketteki yapay zeka araştırma ve geliştirme çalışmalarının %26'sına "öncülük ettiğini" açıkladı; bu oran Şubat 2026'da %1'in altındaydı. Rakamlar, 17 Eylül'de Anthropic tarafından yayınlanan ve Reuters, The Washington Post ve diğer yayın organları tarafından bildirilen "Sınır laboratuvarlarında yapay zeka gelişiminin hızını anlamak için ölçümler" başlıklı bir şirket blog yazısında yer aldı.

Gönderi kısmen bir şeffaflık egzersizi ve kısmen de bir argüman: Anthropic, diğer öncü laboratuvarların da aynı türde sayıları yayınlamasını istiyor, böylece halk ve hükümetler, yapay zeka oluşturmanın anahtarlarının yapay zekaya ne kadar hızlı teslim edildiğini takip edebilir. For more context on this story, see our ongoing latest AI developments.

Yapay Zeka Gelişimini Takip Etmek İçin Üç Numara

Şirket, öncü laboratuvarlardaki gelişim hızını aydınlattığını söylediği üç ölçüm önerdi: Yapay Zeka Ar-Ge'sinin ne kadarı yapay zeka tarafından gerçekleştiriliyor, yapay zeka temsilcilerinin eylemleri ne kadar iyi denetleniyor ve bilgi işlemin yetenek çalışması ile güvenlik çalışması arasında nasıl tahsis edildiği.

Başlık numarası Anthropic'in Ar-Ge Otomasyon Endeksi adını verdiği şeyden geliyor. Şirket, şirkette gerçekleştirilen her türlü yapay zeka Ar-Ge çalışmasını katalogladı, her görevin şu anda ne kadar otomatikleştirildiğini derecelendirdi ve Epoch AI araştırma grubu tarafından geliştirilen bir ölçeği kullanarak sonuçları bir araya getirdi. Ölçek, AL0'dan (Yapay Zeka katılımı yok) AL5'e (Yapay Zeka döngüde hiçbir insan olmadan, tamamen özerk bir şekilde çalışır) kadar uzanır; AL3, AI'nın büyük iş parçaları üzerinde yakın insan yönetimi altında "işbirliği yaptığı" anlamına gelir ve AL4, AI "liderlik eder" anlamına gelir ve bir insan denetlerken bir görevin çoğunu üst düzey bir komuttan uçtan uca tamamlar.

Anthropic'in bildirdiğine göre, Ağustos 2026 itibarıyla Claude, şirketin yapay zeka Ar-Ge çalışmalarının %26'sına liderlik ediyor. "Yapay zeka işbirliği yapıyor" düzeyinde veya üzerinde işlerin payı %90'ın üzerindedir. Claude, AI Ar-Ge çalışmalarının ölçülmüş herhangi bir alt kümesi için tamamen özerk bir şekilde çalışmamaktadır.

30.000 Temsilci, Tek Monitör

İkinci ölçüm gözetimle ilgilidir. Anthropic, Ağustos 2026 itibarıyla şirkette herhangi bir zamanda en çok kullanılan dahili platformda araştırma ve mühendislik çalışmaları yapan yaklaşık 30.000 temsilcinin bulunduğunu açıkladı.

Gönderiye göre, bu temsilcilerin gerçekleştirdiği her eylem, genellikle birkaç saniye içinde yürütülmeden önce çevrimiçi bir monitörden geçiyor. Anthropic, Ağustos ayında araştırma ve mühendislik temsilcilerinden alınan bir milyardan fazla kararı analiz ettiğini ve monitörler tarafından engellenen veya iletilen faaliyetlerin payının %0,002 olduğunu bulduğunu söyledi.

Üçüncü ölçüm olan bilgi işlem tahsisinde şirket, incelenen hafta boyunca AI Ar-Ge'ye giden hesaplamanın yaklaşık %6'sının güvenliğe tahsis edildiğini söyledi.

Kendi Halefini İnşa Etmek — İnsanların Denetlemesiyle

Figürler kadar çerçeveleme de önemlidir. Anthropic'in modelleri, araştırmacıların özyinelemeli kişisel gelişim olarak adlandırdığı ve The Washington Post'un manşetinin daha açık bir şekilde "kendi halefini oluşturma işini devralan bir sohbet robotu" olarak tanımladığı aynı modellerin yeni neslinin oluşturulmasına giderek daha fazla katılıyor.

Antropik, "Yapay Zeka öncü olur" ve "Yapay Zeka yerini alır" arasına bir çizgi çizmeye dikkat ediyor. AL4'te bir insan hâlâ denetleyebilir ve müdahale edebilir; şirket, AR-GE çalışmalarının ölçülen hiçbir alt kümesinin AL5'te yürütülmediğini açıkça bildirdi. Ancak gidişat dik: Yaklaşık yedi ayda yüzde 1'in altından yüzde 26'ya çıkmak, mevcut eğilimler devam ederse, yapay zeka liderliğindeki çalışmaların payının on yıl sonuna kadar yarı yarıya geçebileceğini gösteriyor.

Metodolojinin gerçek sınırları var ve Anthropic bunu söylüyor. Otomasyon derecelendirmeleri, Slack mesajları ve dahili belgeler de dahil olmak üzere şirketin kendi çalışma kayıtlarının örneklenmesiyle ve hem insanların hem de bir yargıç modelinin her görevin ne kadar otomatik olduğunu değerlendirmesiyle oluşturuldu. Kör bir testte personel, modellerin hangi kanıtları topladığını bilmeden görevleri derecelendirdi. Şirket, model yargıcının insanlarla, insanların birbirleriyle anlaştıkları sıklıkta aynı fikirde olduğunu bildirdi: modelden insana tam uyum %59 iken, insandan insana uyum yalnızca %35 idi ve model ile insan derecelendirmeleri, zamanın %97'sinde birbirinin aynı düzeyine indi.

Şirket aynı zamanda kendine referans verme riskini kendi metodolojisinde de kabul etti: Anthropic, sistemlerini değerlendirmeye yardımcı olmak için kendi modellerini kullandı; bu, yargıç modelinin kontrol ettiği modelle aynı türde hatalar yaptığı anlamına gelebilir. Üçüncü taraf doğrulamanın gerçek cevap olduğunu ileri sürüyor.

Dışarıdaki Gözler Geliyor

Bu amaçla Anthropic, birden fazla kuruluştan bağımsız üçüncü taraf değerlendiricileri şirket içine yerleştirmeyi ve onlara dahili risk değerlendirme ekiplerinin sahip olduğuyla karşılaştırılabilir dahili süreçlere, sistemlere ve verilere erişim sağlamayı planladığını söylüyor. Harici AI araştırma kar amacı gütmeyen METR, daha önce Anthropic'in çevrimdışı izleme platformunu bir araya getirmişti.

Açıklama, hız konusunda artan bir tartışmanın ortasında geldi. Anthropic CEO'su Dario Amodei, sınırın yavaşlatılması konusunda koordinasyon çağrısında bulundu ve şirket, böyle bir koordinasyonun mevcut olması durumunda kendi sayılarının değişmesinin beklendiğini belirtti. Bu hafta Anthropic ve OpenAI, güvenlik uzmanlarının laboratuvarların gerçekten bağımsız güvenlik değerlendiricilerine ihtiyaç duyduğunu savunan kamuya açık bir mektubuna da konu oldu.

Rakiplerin Anthropic'in liderliğini takip edip etmeyeceği açık bir soru. Şirket, herhangi bir öncü geliştiricinin bu önlemleri halka açık bir metodoloji kullanarak düzenli olarak yayınlayabileceğini savunuyor. Onlar bunu yapana kadar, yapay zekanın ne kadar hızlı inşa ettiğine dair halka açık rakamlar yalnızca laboratuvarlardan geliyor.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →