GPT-6 Astra OpenAI telah menambah trofi luar biasa pada rekodnya: permainan penuh Portal kusut orang pertama ikonik Valve, disiapkan secara autonomi dalam masa kurang dari 24 jam dengan jumlah kos pengiraan $571.18. The Verge melaporkan peristiwa penting pada 6 September 2026, mengkreditkan pengguna yang dikenali sebagai cozyblaze, yang menghubungkan model sempadan ke permainan dan membiarkannya memikirkan selebihnya.

Portal ialah ujian yang mencabar untuk ejen AI walaupun umurnya. Dikeluarkan oleh Valve pada tahun 2007, permainan ini memerlukan pemain untuk membuat alasan tentang teka-teki spatial menggunakan pistol portal — mencipta bukaan bersambung di dinding, lantai dan siling untuk bergerak melalui ruang ujian yang secara rutin menentang gerak hati. Tiada kerinduan tempur untuk bersandar dan tiada penanda pencarian untuk diikuti; setiap ruang pada dasarnya adalah teka-teki fizik. Bagi pembaca yang mengikuti cara model sempadan sedang diuji tekanan, larian ini merupakan entri yang jelas dalam [liputan perkembangan AI] kami (https://aibuzzwire.news).

Daripada Video Demo kepada Penyiapan Penuh

Larian itu bukan entah dari mana. Terdahulu pada 6 September, video YouTube yang menunjukkan GPT-6 Astra bermain Portal diedarkan di Berita Hacker, dan siaran susulan menyatakan bahawa model itu telah "menyiapkan secara autonomi" permainan itu menarik perhatian ketika hari berlalu. Laporan The Verge mengesahkan butiran: permainan penuh, dipukul dalam masa kurang dari 24 jam, dengan pengiraan kurang daripada $600 — dengan video pekat larian diterbitkan untuk orang yang ragu-ragu.

The Verge tidak dapat menahan pengiraan bahagian alam sekitar rang undang-undang, dengan menyatakan larian itu mungkin menggunakan kira-kira air kolam renang yang kecil dalam penyejukan pusat data. Ini adalah peringatan yang menyedihkan bahawa larian permainan agenik adalah murah untuk pengguna tetapi tidak percuma untuk planet ini.

Mengapa Penukar 2007 Merupakan Penanda Aras yang Serius

Mengalahkan Portal bukanlah penanda aras berjadual seperti ARC-AGI atau SWE-bench, dan itulah sebabnya ia bergema. Permainan ini menuntut kemahiran yang secara sejarah telah memisahkan manusia daripada sistem AI:

  • Penaakulan spatial. Penyelesaian memerlukan ramalan di mana pintu keluar portal akan melancarkan badan pemain — penaakulan fizik tiga dimensi yang telah menghalang ejen selama bertahun-tahun.
  • Perancangan ufuk panjang. Chambers merantai beberapa langkah; gagal pada langkah terakhir biasanya bermaksud membuat semula urutan dari mula.
  • Belajar daripada kegagalan tanpa pegangan tangan. Tiada petunjuk. Ejen mesti membuat kesimpulan peraturan permainan melalui percubaan dan kesilapan, kemudian menggeneralisasikannya ke ruang baharu.

Awal tahun ini, GPT-6 Astra OpenAI mendahului penanda aras ARC-AGI-3 yang memfokuskan pada penaakulan agen, dan model itu telah menarik perhatian untuk keupayaan penggunaan komputer — keupayaan untuk mengendalikan antara muka perisian seperti yang dilakukan oleh seseorang. Larian Portal ialah demonstrasi yang menyeronokkan tetapi tulen bagi set kemahiran yang sama: persepsi, perancangan dan kawalan, dibuka selama berjam-jam tanpa campur tangan manusia.

Sebahagian daripada Gelombang Yang Lebih Luas

Larian ini juga merupakan tanda di mana permainan AI telah mendarat pada tahun 2026. Markah penanda aras kini berkongsi ruang dengan pencapaian budaya: model mengarang nyanyian Bach, menewaskan ujian pengecaman pembetulan tulisan tangan dan melengkapkan permainan yang pernah mewakili frasa "komputer tidak akan melakukan ini." Setiap pas melegakan kepastian lama dan menimbulkan persoalan tentang apa yang akan berlaku seterusnya.

Terdapat implikasi praktikal juga. Gelung yang sama yang membolehkan persediaan cozyblaze mengemudi Portal — tangkapan skrin masuk, keputusan keluar, dengan kos beberapa ratus dolar — ialah gelung yang dihasilkan untuk ujian perisian, robotik dan pembantu penggunaan komputer. Model yang boleh mengingati fizik permainan untuk permainan penuh ialah model yang boleh, pada dasarnya, mengisar melalui tugas perisian yang panjang dan tidak kemas yang mengalahkan sistem konteks yang lebih pendek.

Buat masa ini, walaupun, bawa pulang adalah lebih mudah. AI mengalahkan salah satu teka-teki permainan yang paling digemari, mula selesai, untuk kira-kira harga deposit GPU baharu — dan menyiarkan video itu. Bilik ujian Sains Aperture direka untuk membuatkan manusia berasa bijak. Hujung minggu ini, mereka membuat model kelihatan lancar.

Bagaimana Larian Diterima

Sambutan menjejaki arka pencapaian permainan AI secara amnya: tidak percaya dahulu, kemudian video, kemudian penerimaan. Pada Hacker News, larian itu menarik aliran pengulas yang berterusan membedah cara persediaan itu berfungsi dan apa yang tersirat tentang AI ejenik - dengan beberapa menyatakan bahawa jumlah bil adalah lebih rendah daripada yang diandaikan kos larian sedemikian. Video ringkas penyiapan memberi orang yang ragu-ragu cara untuk mengesahkan tuntutan itu sendiri, yang lebih daripada kebanyakan tawaran hasil penanda aras.

Ia juga mengundang perbandingan dengan pencapaian yang berlaku sebelum ini. Permainan telah berkhidmat selama beberapa dekad sebagai medan ujian awam lapangan, daripada permainan papan kepada strategi masa nyata kepada kotak pasir terbuka. Setiap kali permainan jatuh, hujah berubah: skeptik hari ini menegaskan pencapaian itu adalah sempit, khusus atau khusus dalam beberapa cara yang tidak boleh digeneralisasikan. Apa yang menjadikan Portal terkenal dalam sejarah itu ialah betapa biasa persediaan itu — model sempadan yang tersedia secara komersial, permainan pengguna dan beberapa ratus dolar pengiraan, bukannya sistem penyelidikan yang ditempah khas yang dilatih khusus untuk permainan itu.

---

Kekal Mendahului AI

Dapatkan berita, analisis dan penemuan terkini AI — semuanya di satu tempat.

Baca lebih banyak berita AI →