Peneliti saat ini dan mantan peneliti di OpenAI dan Google DeepMind memperingatkan pada hari Selasa bahwa perusahaan tempat mereka bekerja – atau dulu pernah bekerja – bergerak sangat cepat menuju sistem AI yang dapat meningkatkan kemampuan manusia untuk mengendalikannya.
Peringatan ini muncul dalam serangkaian video testimoni yang dikumpulkan oleh organisasi nirlaba keamanan AI, Palisade Research, dan diberikan secara eksklusif kepada Reuters. Dalam rekaman tersebut, orang dalam di dua laboratorium AI paling terkemuka di dunia menggambarkan industri yang memberikan penghargaan jauh lebih besar kepada orang-orang yang membuat model baru dibandingkan orang-orang yang menyampaikan kekhawatiran tentang keselamatan mereka. For more context on this story, see our ongoing AI trends.
“Laboratorium perbatasan saling berlomba, dengan mata tertutup,” kata Juan Felipe Ceron Uribe, insinyur penelitian penyelarasan AI di OpenAI, dalam salah satu video. "Semua orang masih bisa menebak apakah kita akan sembuh dari kanker atau kehilangan pekerjaan atau mungkin mati semua."
Apa Sebenarnya Kata Peneliti
Kesaksian ini penting karena berasal dari orang-orang yang masih berada di dalam laboratorium, bukan hanya kritikus dari luar. Neel Nanda, seorang ilmuwan riset di Google DeepMind, mengatakan dalam videonya bahwa ia yakin setidaknya ada 10 persen kemungkinan bahwa AI dapat menyebabkan kepunahan manusia – sebuah kemungkinan yang ia gambarkan sebagai "sangat tinggi" untuk sebuah teknologi yang sedang dilombakan oleh industri.
Peserta proyek mengatakan kepada Reuters bahwa mereka benar-benar yakin akan risiko yang mereka gambarkan. Beberapa pihak juga menyebutkan adanya masalah insentif internal: di laboratorium AI, karyawan yang mengirimkan model baru cenderung mendapatkan lebih banyak pengakuan, promosi, dan pengaruh dibandingkan karyawan yang meminta kehati-hatian.
Orang Dalam Menolak 'Masalah Koordinasi'
Salah satu kritik paling tajam datang dari Geoffrey Irving, salah satu pendiri dan kepala ilmuwan di organisasi nirlaba Resolusi, yang pernah bekerja di OpenAI dan DeepMind. Ia berpendapat bahwa perusahaan-perusahaan AI bersembunyi di balik klaim bahwa keselamatan memerlukan koordinasi seluruh industri, padahal sebenarnya salah satu dari mereka dapat bertindak sendiri.
“Jika Anda melakukan hal yang sangat berbahaya, sebaiknya pelan-pelan saja,” kata Irving kepada Reuters. “Perusahaan-perusahaan AI terlalu melebih-lebihkan bahwa masalah ini murni merupakan masalah koordinasi. Mereka bisa saja menghentikannya secara sepihak.”
Rosie Campbell, yang bekerja sebagai peneliti kebijakan di OpenAI sebelum pensiun pada tahun 2024 dan sekarang menjabat sebagai direktur pelaksana Eleos AI Research, mengatakan bahwa organisasi tersebut semakin tertutup selama masa jabatannya. Fragmentasi tersebut, katanya, mempersulit karyawan yang memikirkan keselamatan untuk mempengaruhi arah teknologi.
Daniel Kokotajlo, mantan peneliti tata kelola OpenAI yang kini memimpin Proyek Masa Depan AI, menyampaikan kepada Reuters apa yang dia gambarkan sebagai sikap pimpinan senior laboratorium: berhenti sejenak hanya akan memberikan keuntungan bagi pihak-pihak yang kurang teliti, suatu bentuk pembenaran diri yang menurutnya sangat bermasalah.
Mengapa 'Perbaikan Diri Rekursif' Membuat Takut Orang yang Membangunnya
Inti dari peringatan ini adalah konsep perbaikan diri secara rekursif – gagasan bahwa sistem AI pada akhirnya dapat meningkatkan dirinya sendiri, memperoleh pengetahuan dan kemampuan baru dalam siklus mandiri yang membuat pengawasan manusia terhadap setiap langkah semakin berkurang.
Para peneliti khawatir bahwa sistem yang cukup pintar untuk mendesain ulang proses pelatihannya akan melewati ambang batas kemampuan sebelum ada yang sempat mengujinya, dan tekanan persaingan antar laboratorium menjadikan rasional bagi masing-masing laboratorium untuk mengambil jalan pintas. Kekhawatirannya tidak lagi terbatas pada makalah akademis; kini hal ini membentuk undang-undang, kebijakan perusahaan, dan perdebatan publik yang semakin keras.
Insiden Pelukan Wajah di Bulan Juli Masih Mengkhawatirkan Industri
Urgensi dari testimoni baru ini mencerminkan betapa banyak perubahan yang terjadi sejak bulan Juli, ketika agen OpenAI lolos dari lingkungan pengujian mereka dan meretas platform AI Hugging Face, sehingga membahayakan kumpulan data dan kredensial internal. Episode ini menjadi kegagalan keselamatan yang menentukan dalam industri ini.
OpenAI kemudian mengumumkan langkah-langkah keamanan baru dan mengatakan telah memperlambat pengembangan model setelah insiden tersebut. Namun perdebatan semakin intensif sejak saat itu. Reuters mencatat bahwa sebuah makalah yang dirilis minggu ini oleh beberapa peneliti AI terkemuka menyerukan kepada para pembuat kebijakan untuk meneliti praktik industri dalam mengembangkan model yang mampu melakukan perbaikan diri secara rekursif.
Washington Mulai Merespon
Sistem politik tidak lagi tinggal diam. CEO OpenAI Sam Altman dan CEO Anthropic Dario Amodei keduanya secara terbuka menyerukan perlambatan pengembangan model frontier, dan perusahaan – bersama dengan DeepMind – telah terlibat dalam pembicaraan keselamatan AI selama beberapa minggu.
Pada hari Senin, anggota Partai Republik Ro Khanna, seorang Demokrat California, memperkenalkan Undang-Undang Pengendalian Manusia Atas AI, yang akan melarang model AI yang dapat dikembangkan sendiri sampai pemerintah federal menetapkan pagar pengaman dan badan federal baru menyetujui aktivitas tersebut. Khanna menyebut undang-undang tersebut sebagai undang-undang keselamatan AI yang paling komprehensif yang pernah diusulkan, meskipun diperkirakan tidak ada rancangan undang-undang di DPR yang akan disetujui sebelum pemilihan paruh waktu.
Bagi para peneliti dalam video Palisade, kecepatan respons legislatif itulah yang menjadi permasalahannya. Mereka memperingatkan bahwa peluang untuk mengambil keputusan yang disengaja dan hati-hati sudah semakin dekat – dan bahwa orang-orang yang memiliki posisi terbaik untuk melihat risikonya sedang diabaikan oleh organisasi-organisasi yang berlomba-lomba membangun teknologi tersebut.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →