Syarikat itu mula-mula memperkenalkan versi ujian mod auto pada Mac 2026, mengemukakannya sebagai cara untuk mengimbangi kelajuan dan kawalan semasa pengekodan agen. Untuk konteks yang lebih luas tentang cara alatan AI membentuk semula pembangunan perisian, lihat [perkembangan AI terkini] kami(https://aibuzzwire.news).
Cara mod auto berfungsi
Apabila Kod Claude beroperasi dalam mod auto, ia tidak lagi memberikan gesaan meminta kelulusan manusia pada setiap langkah. Sebaliknya, ejen meneruskan sendiri melainkan tindakan ditentukan sebagai "tidak dapat dipulihkan, merosakkan atau ditujukan di luar persekitaran anda."
Ini bermakna pengeditan rutin, operasi fail dan tugas baris perintah mengalir tanpa gangguan, manakala sistem direka bentuk untuk berhenti seketika sebelum apa-apa yang boleh menyebabkan kerosakan sebenar — seperti memadamkan data, menjalankan perintah yang merosakkan atau menghubungi sistem di luar persediaan setempat pembangun.
Anthropic merangka peralihan itu sebagai tindak balas praktikal terhadap cara orang sebenarnya menggunakan alat tersebut.
Data di sebalik keputusan
Perincian yang paling menarik dalam pengumuman Anthropic ialah kajian yang dijalankan oleh syarikat dengan 1,053 penguji berbayar. Menurut syarikat itu, mod auto menangkap 89% daripada tindakan berbahaya, manakala semakan manusia manual menangkap hanya 13.6%.
Penjelasan, Anthropic mencadangkan, adalah bahawa kewaspadaan manusia merosot dengan cepat semasa sesi pengekodan berulang. Syarikat itu menyatakan bahawa pengguna meluluskan kira-kira 97% gesaan kebenaran dalam Kod Claude — bermakna gesaan itu sebahagian besarnya menjadi setem getah dan bukannya pemeriksaan keselamatan yang bermakna.
"Apabila semakan manual menjadi kebiasaan, ia berhenti menjadi pelindung," tersirat penemuan syarikat itu. Dengan mengautomasikan sempadan keselamatan dengan peraturan yang menentukan dan bukannya bergantung pada pembangun yang mengklik "ya" untuk kali keseratus, Anthropic berpendapat ia sebenarnya boleh mengurangkan risiko.
Pengadang keselamatan baharu
Di samping suis lalai, Anthropic berkata ia telah menambah ciri keselamatan baharu pada Kod Claude, termasuk:
- Pemeriksaan suntikan segera, direka bentuk untuk mengesan percubaan untuk memanipulasi ejen melalui arahan berniat jahat yang dibenamkan dalam kod atau dokumentasi.
- Peraturan penafian keras boleh disesuaikan, yang membenarkan organisasi menyekat kategori tindakan tertentu secara langsung — seperti exfiltration data atau menulis ke direktori sensitif.
Kawalan ini bertujuan untuk memberi pasukan cara untuk menetapkan sempadan tegas yang ejen tidak boleh mengatasi, walaupun dalam mod auto.
Pertaruhan pada pengekodan agen
Ketua Kod Claude Boris Cherny berkata dalam siaran di X bahawa pasukan itu telah menggunakan mod auto secara eksklusif selama berbulan-bulan. "Saya tidak dapat membayangkan untuk kembali ke gesaan kebenaran," tulisnya.
Perubahan lalai mencerminkan pertaruhan industri yang lebih luas bahawa masa depan pembangunan perisian adalah agentik — dengan ejen AI mengendalikan tugas berbilang langkah dengan pegangan tangan yang minimum. OpenAI, Meta, dan lain-lain semuanya telah bergerak ke arah yang sama, membina ejen pengekodan yang direka bentuk untuk beroperasi secara lebih autonomi di dalam repositori dan terminal.
Menjadikan mod auto sebagai lalai ialah peningkatan bermakna bagi pertaruhan itu. Ia memindahkan operasi autonomi daripada percubaan ikut serta kepada pengalaman standard untuk pelanggan yang membayar Anthropic, populasi yang merangkumi pembangun individu dan pasukan perusahaan besar.
Landskap kompetitif menjadi agen
Anthropic tidak bersendirian dalam mendorong agen pengekodan ke arah autonomi yang lebih besar. Meta baru-baru ini melancarkan Muse Code, ejen pengekodan AI yang direka untuk berfungsi di terminal merentasi repositori besar. OpenAI dan beberapa syarikat permulaan telah membina alat serupa yang bertujuan untuk membenarkan ejen membaca, mengedit dan menjalankan kod dengan mengurangkan campur tangan manusia. Trajektori yang dikongsi adalah jelas: industri sedang beralih daripada bantuan gaya autolengkap ke arah sistem yang boleh mengambil tindakan yang bermakna bagi pihak pembangun.
Apa yang membezakan langkah Anthropic ialah kesediaan untuk menjadikan autonomi sebagai lalai dan bukannya ikut serta. Kebanyakan alat yang bersaing masih memerlukan pengguna untuk aktif mendayakan mod paling lepas tangan mereka. Dengan menukar suis untuk semua akaun berbayar, Anthropic membuat dakwaan yakin bahawa pagarnya cukup teguh untuk dipercayai di luar kotak — dan mengumpul data dunia sebenar untuk membuktikan atau menafikan dakwaan itu secara berskala.
Soalan amanah
Peralihan itu juga menimbulkan persoalan tentang berapa banyak pengawasan yang sanggup diserahkan oleh pembangun. Walaupun data Anthropic mencadangkan pagar automatik mengatasi semakan manusia terbiasa, pengkritik telah memberi amaran bahawa tingkah laku lalai membentuk — dan lalai yang menganggap autonomi secara senyap-senyap boleh menormalkan tahap risiko yang belum diperhitungkan sepenuhnya oleh pasukan.
Hujah balas Anthropic ialah alternatif — gesaan kebenaran yang hampir semua orang abaikan — adalah teater keselamatan yang lebih teruk daripada sistem automatik dengan peraturan yang jelas dan boleh dikuatkuasakan.
Buat masa ini, syarikat itu meletakkan wangnya pada mesin. Mulai 14 Ogos, Claude Code akan mempercayai pertimbangannya sendiri atas klik refleksif pembangun yang letih.
Kekal Mendahului AI
Dapatkan liputan industri AI terkini →Alat pengekodan AI berkembang pesat. Baca lebih banyak berita AI →
