Anthropic menerbitkan pandangan pertama seumpamanya di dalam saluran pembangunannya sendiri minggu ini, mendedahkan bahawa model Claudenya kini "mengetuai" 26% daripada kerja penyelidikan dan pembangunan AI di syarikat itu — meningkat daripada di bawah 1% pada Februari 2026. Angka-angka itu muncul dalam catatan blog syarikat bertajuk "Pengukuran untuk memahami kepantasan pembangunan AI di dalam 17 September," yang dilaporkan oleh Reuters dan Anthropic. The Washington Post, dan cawangan lain.
Siaran itu sebahagiannya merupakan latihan ketelusan dan sebahagian lagi hujah: Anthropic mahu makmal sempadan lain menerbitkan jenis nombor yang sama, supaya orang ramai dan kerajaan dapat menjejaki seberapa cepat AI diserahkan kunci untuk membina AI. For more context on this story, see our ongoing more AI stories.
Tiga Nombor untuk Menjejaki Pembangunan AI
Syarikat itu mencadangkan tiga ukuran yang dikatakan menerangi kepantasan pembangunan di dalam makmal sempadan: berapa banyak R&D AI dilakukan oleh AI sendiri, sejauh mana tindakan ejen AI diawasi, dan cara pengiraan diperuntukkan antara kerja keupayaan dan kerja keselamatan.
Nombor tajuk datang daripada apa yang Anthropic panggil Indeks Automasi R&Dnya. Syarikat itu mengkatalogkan setiap jenis kerja R&D AI yang dilakukan di syarikat, menilai tahap automatik setiap tugasan pada masa ini, dan mengagregatkan keputusan menggunakan skala yang dibangunkan oleh kumpulan penyelidikan Epoch AI. Skala bermula dari AL0 (tiada penglibatan AI) kepada AL5 (AI beroperasi sepenuhnya secara autonomi, tanpa manusia dalam gelung), dengan AL3 bermaksud AI "berkolaborasi" pada sebahagian besar kerja di bawah arahan manusia yang rapat dan AL4 bermaksud AI "memimpin," menyelesaikan kebanyakan tugas hujung ke hujung daripada gesaan peringkat tinggi semasa manusia menyelia.
Sehingga Ogos 2026, Anthropic melaporkan, Claude mengetuai 26% daripada kerja R&D AI syarikat. Bahagian kerja pada atau melebihi tahap "AI bekerjasama" adalah melebihi 90%. Claude tidak beroperasi sepenuhnya secara autonomi untuk mana-mana subset terukur kerja R&D AI.
30,000 Ejen, Satu Monitor
Pengukuran kedua melibatkan pengawasan. Anthropic mendedahkan bahawa sehingga Ogos 2026 terdapat kira-kira 30,000 ejen melakukan penyelidikan dan kerja kejuruteraan di syarikat pada satu-satu masa pada platform dalaman yang paling banyak digunakan.
Setiap tindakan yang diambil oleh ejen tersebut melalui pemantau dalam talian sebelum ia dilaksanakan, biasanya dalam beberapa saat, menurut siaran itu. Anthropic berkata ia menganalisis lebih satu bilion keputusan daripada ejen penyelidikan dan kejuruteraannya sepanjang Ogos dan mendapati bahagian aktiviti yang disekat atau meningkat oleh pemantau adalah 0.002%.
Mengenai peruntukan pengiraan, ukuran ketiga, syarikat itu berkata sepanjang minggu yang diperiksa kira-kira 6% daripada pengiraan yang pergi ke R&D AI diperuntukkan untuk keselamatan.
Membina Penggantinya Sendiri — Dengan Penyeliaan Manusia
Pembingkaian penting sama seperti angka. Model Anthropic semakin mengambil bahagian dalam membina generasi seterusnya bagi model yang sama itu — apa yang dipanggil oleh penyelidik sebagai pembaikan diri secara rekursif, dan apa yang diterangkan oleh tajuk The Washington Post dengan lebih terang sebagai chatbot "mengambil alih kerja membina penggantinya sendiri."
Anthropic berhati-hati untuk membuat garis antara "AI petunjuk" dan "AI menggantikan." Di AL4, manusia masih mengawasi dan boleh campur tangan; syarikat secara eksplisit melaporkan bahawa tiada subset terukur bagi kerja R&Dnya berjalan di AL5. Tetapi trajektorinya adalah curam: daripada di bawah 1% kepada 26% dalam kira-kira tujuh bulan menunjukkan bahagian kerja yang diterajui AI boleh melepasi separuh sebelum penghujung dekad jika trend semasa kekal.
Metodologi mempunyai had sebenar, dan Anthropic berkata demikian. Penarafan automasinya dihasilkan dengan mengambil sampel rekod kerja syarikat sendiri — termasuk mesej Slack dan dokumentasi dalaman — dan mempunyai kedua-dua manusia dan model hakim menilai betapa automatik setiap tugasan. Dalam ujian buta, kakitangan menilai tugas tanpa mengetahui bukti yang telah dikumpulkan oleh model. Syarikat itu melaporkan bahawa hakim modelnya bersetuju dengan manusia sekerap mana manusia bersetuju antara satu sama lain: perjanjian model-ke-manusia yang tepat ialah 59%, manakala perjanjian manusia dengan manusia hanya 35%, dan penarafan model dan manusia mendarat dalam satu tahap antara satu sama lain 97% pada masa itu.
Syarikat itu juga mengakui risiko rujukan kendiri dalam metodologinya sendiri: Anthropic menggunakan modelnya sendiri untuk membantu menilai sistemnya, yang boleh bermakna model hakim membuat jenis kesilapan yang sama seperti model yang sedang diperiksa. Pengesahan pihak ketiga, menurutnya, adalah jawapan sebenar.
Mata Luar Datang
Untuk itu, Anthropic berkata ia merancang untuk membenamkan penilai pihak ketiga bebas daripada berbilang organisasi di dalam syarikat, memberikan mereka akses kepada proses dalaman, sistem dan data yang setanding dengan apa yang dimiliki oleh pasukan penilaian risiko dalaman. METR bukan untung penyelidikan AI luaran sebelum ini telah menggandingkan platform pemantauan luar talian Anthropic.
Pendedahan itu tiba di tengah-tengah perdebatan yang semakin meningkat tentang pacing. Ketua Pegawai Eksekutif Anthropic Dario Amodei telah meminta penyelarasan untuk memperlahankan sempadan, dan syarikat itu menyatakan bahawa nombornya sendiri akan dijangka berubah jika penyelarasan sedemikian wujud. Minggu ini, Anthropic dan OpenAI juga menjadi subjek surat awam daripada pakar keselamatan yang berhujah bahawa makmal memerlukan penilai keselamatan yang benar-benar bebas.
Sama ada pesaing mengikuti petunjuk Anthropic adalah persoalan terbuka. Syarikat itu berhujah mana-mana pemaju sempadan boleh menerbitkan langkah-langkah ini dengan kerap menggunakan metodologi awam. Sehingga mereka melakukannya, satu-satunya nombor awam tentang seberapa pantas AI membina AI datang daripada makmal itu sendiri.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →