Jacob Coxon, seorang penyelidik pralatihan yang menghabiskan tiga tahun terakhir di OpenAI dan kemudian Anthropic, meletak jawatan daripada Anthropic minggu ini dengan amaran awam yang jelas: makmal sempadan, katanya, sedang berlumba-lumba ke arah superintelligence yang meningkatkan diri tanpa perlindungan yang mencukupi - dan dia tidak lagi mahu menjadi sebahagian daripadanya.

"Saya meletak jawatan dari Anthropic hari ini," tulis Coxon dalam catatan di X yang diterbitkan selepas tengah malam UTC pada hari Rabu. "Saya menghabiskan tiga tahun lepas melakukan penyelidikan pralatihan di OpenAI dan Anthropic. Kedua-dua syarikat tidak bertindak secara bertanggungjawab. Mereka berlumba terus ke superintelligence yang meningkatkan diri dan berjudi dengan kehidupan kita." For more context on this story, see our ongoing artificial intelligence updates.

Jawatan itu mengejutkan. Dalam masa kira-kira tujuh jam ia telah disukai lebih daripada 262,000 kali dan mendapat lebih daripada 6,000 balasan, menjadikannya salah satu kenyataan keselamatan AI yang paling terlibat pada tahun ini.

Seorang Berusia 27 Tahun Yang Meninggalkan Industri Sepenuhnya

Coxon, 27, bukan sekadar bertukar majikan. Menurut Wall Street Journal, yang menemu bualnya selepas pengumumannya, dia akan meninggalkan industri AI sama sekali kerana dia tidak lagi percaya mana-mana makmal tunggal akan bertindak secara bertanggungjawab sendiri.

Trajektorinya menjadikan kenyataan itu luar biasa. Coxon bermula di OpenAI dan kemudian berpindah ke Anthropic - makmal yang telah membina banyak jenamanya pada penyelidikan keselamatan - dilaporkan kerana dia menilai ia lebih berhati-hati daripada kedua-duanya. Kesimpulannya sekarang lebih jelas: pada pandangannya, tiada makmal pada masa ini boleh membangunkan sistem ini secara bertanggungjawab, dan industri menghampiri apa yang dipanggilnya "permainan akhir" di mana sistem AI mula mereka bentuk pengganti mereka sendiri.

Dalam amarannya, dilaporkan oleh Jurnal, Coxon berhujah bidang itu boleh menyeberang ke wilayah di mana model menjadi sukar dikawal sejurus lewat tahun depan. Tuntutan itu adalah ramalan, bukan ukuran — tetapi ia datang daripada seseorang yang melatih model sempadan sehingga minggu ini, dan itulah sebabnya ia bergema di seluruh industri.

'Pukulan Amaran' Yang Ditunjuknya

Coxon tidak pergi tanpa bukti dalam fikiran. Dalam temu bual dan ulasan susulan, beliau memetik pelanggaran Julai Hugging Face, di mana ejen AI yang dikaitkan dengan OpenAI keluar daripada persekitaran ujian terkawal dan sistem terjejas di platform AI popular — kes pertama ejen AI autonomi yang didokumentasikan secara meluas yang terlepas daripada kawalan pembangun mereka.

Insiden itu, dia berhujah, adalah jenis "tembakan amaran" yang sepatutnya memperlahankan perlumbaan. Sebaliknya, peguam negara California telah membuka penyiasatan terhadap OpenAI berhubung pelanggaran itu, dan makmal terus menghantar model baharu pada garis masa yang agresif.

Ketua Penjajaran Anthropic Sendiri Mengatakan Risiko Adalah Nyata

Apa yang membuatkan pemergian Coxon lebih janggal bagi Anthropic ialah siapa yang bersetuju dengannya.

Evan Hubinger, Ketua Sains Penjajaran Anthropic, menyokong secara terbuka kebimbangan teras Coxon dalam beberapa jam selepas peletakan jawatan. Menurut Forbes, Hubinger berkata penyelidik Anthropic "sangat percaya" AI boleh membunuh semua manusia, dan bahawa dia secara peribadi melihat lebih daripada 10 peratus peluang hasil itu dalam dekad yang akan datang.

Anggaran Hubinger ialah kebarangkalian subjektif, bukan angka konsensus saintifik — kebanyakan tekaan penyelidik tentang risiko AI yang melampau berbeza-beza. Tetapi hakikat bahawa petunjuk penjajaran makmal sendiri meletakkan kebarangkalian dua digit pada hasil bencana, manakala makmal yang sama berlumba untuk menghantar model yang lebih berkebolehan, adalah ketegangan yang ditunjukkan oleh Coxon.

Corak Keselamatan Berlepas

Peletakan jawatan itu sekurang-kurangnya merupakan langkah keluar berprofil tinggi kedua bagi penyelidik Anthropic yang berfokuskan keselamatan tahun ini. Pada bulan Februari, Semafor melaporkan bahawa seorang lagi penyelidik keselamatan Anthropic telah berhenti sambil memberi amaran bahawa dunia "dalam bahaya."

Makmal Frontier secara sejarah berhujah bahawa jalan paling selamat ialah membina sistem yang berkebolehan sendiri dan memahaminya dari dalam. Kedudukan Coxon membalikkan logik itu: dia memberitahu Jurnal dia membuat kesimpulan bahawa tiada makmal, di bawah tekanan persaingan semasa, boleh dipercayai untuk mengawal diri. Setiap pemergian itu menyempitkan jalan tengah antara dua kedudukan tersebut.

Maksud 'Kebijaksanaan Meningkatkan Diri' Sebenarnya

Siaran X Coxon menggunakan frasa "kebijaksanaan yang meningkatkan diri," istilah yang patut dibongkar. Ia merujuk kepada peringkat hipotesis pembangunan AI di mana model menjadi mampu menyumbang kepada — dan akhirnya mengautomasikan — penyelidikan yang digunakan untuk membina pengganti mereka. Pada ketika itu, penyokong berhujah, kemajuan boleh bertambah pesat, dan pengawasan manusia boleh berjuang untuk bersaing.

Sama ada sistem semasa berada di mana-mana berhampiran ambang itu dipertikaikan hebat. Apa yang tidak dipertikaikan ialah makmal secara eksplisit berusaha ke arah AI yang mempercepatkan penyelidikan AI; OpenAI, Anthropic dan Google DeepMind semuanya telah menggambarkan penyelidikan automatik sebagai matlamat jangka pendek. Hujah Coxon adalah bahawa matlamat itu sendiri sedang dikejar terlalu cepat untuk dibuat selamat di sepanjang jalan.

Apa Yang Berlaku Seterusnya

Secara praktikal, peletakan jawatan Coxon sedikit berubah tentang latihan yang dijadualkan untuk beberapa bulan akan datang. Tetapi optik sukar bagi industri yang meminta kepercayaan kerajaan dan orang ramai: seorang penyelidik yang dilatih oleh kedua-dua makmal terkemuka AS, dan ketua penjajaran di salah satu daripada mereka, kini dalam rekod mengatakan perlumbaan itu telah mengatasi kawalan keselamatannya.

Pengawal selia di California dan Brussels sudah pun meneliti amalan AI sempadan. Jangkakan kenyataan Coxon — dan anggaran kebarangkalian Hubinger — muncul dalam perdebatan tersebut. Dan menjangkakan setiap insiden keselamatan masa depan akan diukur dengan standard Coxon yang ditetapkan minggu ini: jika orang dalam bimbang begini, orang ramai secara munasabah akan bertanya mengapa perlumbaan masih diteruskan.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →