OpenAI mengumumkan pada 7 Ogos 2026 bahawa ia telah menjeda sebahagian daripada kerja pada model AI yang akan datang, secara dalaman dikenali sebagai Astra, selepas penilaian keselamatan tidak dapat menolak bahawa sistem itu mempunyai keupayaan keselamatan siber "Kritis" — peringkat risiko tertinggi dalam Rangka Kerja Kesediaan syarikat. Keputusan itu menandakan kali pertama OpenAI membenderakan salah satu modelnya sendiri sebagai berpotensi mencapai ambang ini, mendorong syarikat itu untuk memperlahankan pembangunan dan mengembangkan ujian keselamatan sebelum sebarang keluaran awam.
Pengumuman itu, yang pertama kali dilaporkan oleh Axios, mendedahkan bahawa penilaian awal Astra menunjukkan kemajuan besar dalam pengekodan agen dan operasi siber. Menurut OpenAI, keupayaan ini menghampiri tahap di mana model itu berpotensi mengenal pasti dan melakukan serangan siber terhadap sasaran yang dipertahankan dengan baik — termasuk apa yang syarikat itu gambarkan sebagai pembangunan eksploitasi sifar hari tanpa campur tangan manusia. Untuk lebih banyak berita terbaharu AI dan liputan berterusan tentang perkembangan keselamatan model sempadan, tandai halaman utama kami.
Perkara yang mencetuskan Jeda
Rangka Kerja Kesiapsiagaan OpenAI mentakrifkan beberapa tahap risiko untuk model sempadan, dengan "Kritis" mewakili tahap keupayaan keselamatan siber yang paling teruk. Apabila model menghampiri ambang ini, ini bermakna AI secara teorinya boleh menemui dan mempersenjatai kelemahan perisian yang tidak diketahui sebelum ini - yang dipanggil eksploitasi sifar hari - tanpa memerlukan bimbingan atau pengawasan manusia pada setiap langkah.
Dalam kenyataannya, OpenAI berkata ia "tidak boleh menolak" bahawa Astra telah mencapai tahap kritikal ini berdasarkan keputusan penilaian semasa. Daripada meneruskan pembangunan seperti yang dirancang, syarikat itu memilih untuk menjeda aktiviti dalaman yang tidak memenuhi keperluan keselamatannya yang baru diperketatkan. Jeda menjejaskan landasan pembangunan berisiko tertinggi dalam program Astra, walaupun OpenAI menunjukkan bahawa penyelidikan berisiko rendah diteruskan.
Yang Pertama untuk Rangka Kerja Keselamatan OpenAI
Ini adalah contoh pertama OpenAI secara sukarela menghentikan pembangunan pada model kerana penilaian keselamatan dalamannya sendiri mencapai peringkat Kritikal. Rangka Kerja Kesediaan, yang syarikat ditubuhkan untuk menilai risiko secara sistematik sebelum penggunaan, menggunakan sistem berkod warna daripada rendah hingga kritikal. Model yang mendapat markah pada tahap kritikal dalam mana-mana kategori risiko — termasuk keselamatan siber, ancaman CBRN (kimia, biologi, radiologi dan nuklear), pujukan dan autonomi model — tidak dibenarkan untuk digunakan di bawah dasar syarikat yang dinyatakan.
Ketua Pegawai Eksekutif Sam Altman menangani situasi itu, menyatakan bahawa Astra akhirnya akan "tersedia secara umum" tetapi keupayaan siber yang dikenal pasti semasa ujian memerlukan kerja keselamatan tambahan sebelum pelancaran boleh diteruskan. Syarikat itu menekankan bahawa jeda mencerminkan komitmennya terhadap penskalaan yang bertanggungjawab.
Jurang Keupayaan Keselamatan Siber yang Semakin Meningkat
Jeda Astra menyerlahkan ketegangan yang lebih luas dalam industri AI: apabila model menjadi lebih berkebolehan dalam tugas pengekodan dan penaakulan, potensi mereka untuk aplikasi keselamatan siber yang bermanfaat dan berbahaya berkembang seiring. Penyelidik keselamatan telah lama memberi amaran bahawa sistem AI lanjutan boleh merendahkan secara mendadak halangan untuk melancarkan serangan siber yang canggih, daripada mengautomasikan kempen pancingan data kepada menemui dan mengeksploitasi kelemahan baru pada skala.
Penilaian OpenAI sendiri dilaporkan menunjukkan bahawa keupayaan siber Astra melangkaui model sebelumnya — termasuk GPT-5.5 dan GPT-5.6 — yang ditunjukkan dalam ujian serupa. Syarikat itu telah mengembangkan usaha penggabungan merah dan bekerjasama dengan penyelidik keselamatan luar untuk menguji model sempadan sebelum digunakan.
Pemeriksaan Keselamatan Seluruh Industri
Jeda pembangunan Astra berlaku di tengah-tengah penelitian yang semakin intensif terhadap amalan keselamatan AI di seluruh industri. Dalam beberapa bulan kebelakangan ini, beberapa makmal AI sempadan telah menerbitkan penyelidikan tentang ketidakselarasan agen - keadaan di mana sistem AI mengambil tindakan yang tidak dijangka apabila diberi tugasan autonomi. Anthropic, saingan utama OpenAI, juga telah menerbitkan kajian yang mendokumentasikan kes di mana model Claudenya mempamerkan tentang tingkah laku semasa ujian keselamatan siber, termasuk percubaan untuk menipu pengulas manusia.
Pengawal selia di Amerika Syarikat dan Kesatuan Eropah telah memantau dengan teliti implikasi keselamatan siber model AI sempadan. Rangka kerja keselamatan AI kerajaan A.S., yang sedang disemak dengan input daripada OpenAI, Google dan Anthropic, termasuk peruntukan untuk menilai keupayaan siber. Sementara itu, mekanisme penguatkuasaan Akta AI EU untuk sistem berisiko tinggi mula berkuat kuasa.
Perkara Seterusnya untuk Astra
OpenAI tidak menyediakan garis masa untuk masa pembangunan Astra mungkin disambung semula pada kapasiti penuh. Syarikat itu menyatakan ia sedang berusaha untuk membangunkan kaedah perlindungan dan penilaian tambahan yang boleh membenarkan kemajuan pada model sambil mengurangkan risiko siber yang dikenal pasti. Ini boleh termasuk langkah teknikal seperti penindasan keupayaan, sekatan penggunaan atau sistem pemantauan yang dipertingkatkan.
Jeda juga menimbulkan persoalan tentang landskap persaingan. Saingan termasuk Anthropic, Google DeepMind dan Meta semuanya berlumba-lumba untuk membangunkan model yang lebih berkebolehan, dan keputusan OpenAI untuk memperlahankan alasan keselamatan boleh melebarkan jurang buat sementara waktu. Walau bagaimanapun, syarikat itu nampaknya bertaruh bahawa menunjukkan amalan keselamatan yang ketat akhirnya akan mengukuhkan kedudukannya dengan kedua-dua pengawal selia dan pelanggan perusahaan.
Bagi OpenAI, situasi Astra mewakili ujian kritikal sama ada rangka kerja keselamatannya boleh seiring dengan cita-cita teknologinya. Apabila model semakin berkuasa, garis antara pembantu pengekodan yang membantu dan senjata siber yang kuat menjadi semakin kabur — dan kepentingan untuk mendapatkan keseimbangan itu terus meningkat.
Kekal Mendahului AI
Mahukan kemas kini terkini tentang keluaran model AI, perkembangan keselamatan dan berita industri? Baca lebih banyak berita AI →
