OpenAI telah membetulkan tiga kecacatan yang dikatakan menjelaskan seminggu aduan pengguna bahawa GPT-6 Astra, model sempadan terbaharunya, telah menjadi bodoh sejak dilancarkan — dan ia menetapkan semula had penggunaan untuk pelanggan Codex sebagai permohonan maaf. Kemas kini itu datang daripada ketua produk Codex Tibo Sottiaux, yang berkata pasukan itu bekerja dengan pengguna untuk mengesan kerosakan, kemudian menghantar pembaikan dan tetapan semula penggunaan penuh sebelum tengah malam waktu tempatan, menurut kemas kini yang diterbitkan pada hari Sabtu.
Kemasukan menutup hamparan kasar untuk apa yang OpenAI telah dibilkan sebagai model yang paling berkebolehan setakat ini. Sejak Astra mencapai ketersediaan yang luas pada awal September, pembangun pada X telah menjalankan gesaan yang sama terhadap Astra hari pelancaran dan versi semasa, memastikan setiap tetapan sama, dan menyiarkan perbandingan sebelah menyebelah yang kelihatan menunjukkan model yang lemah secara senyap-senyap. Untuk mengetahui lebih lanjut tentang model yang mendorong perdebatan ini, lihat perkembangan AI terkini kami.
Tiga Kecacatan, Dinamakan
Menurut Sottiaux, punca pertama ialah kemahiran — fail pantas yang ditulis untuk model terdahulu yang terlalu kerap dicetuskan di bawah Astra, kadangkala menghalang model daripada menyemak kerjanya sendiri. Yang kedua ialah percubaan pengurusan konteks pilihan yang boleh membuat model berhenti awal atau membalas mesej lapuk. OpenAI melumpuhkan percubaan selepas kira-kira 4,000 hingga 5,000 pengguna terjejas, kata syarikat itu.
Kecacatan ketiga melibatkan infrastruktur dan bukannya model itu sendiri: beberapa enjin inferens telah dikonfigurasikan secara tidak betul dan kualiti terdegradasi yang boleh diukur pada trafik ekor yang melaluinya. OpenAI mengalih keluar enjin tersebut dan membuat beberapa pembaikan yang lebih kecil. Sottiaux menulis bahawa model itu kini menjejaki mesej terbaharu pengguna dengan lebih tepat — mengangguk kepada aduan bahawa Astra telah menjawab soalan yang telah dilalui pengguna.
Pembangun Sudah Bergerak
Aduan yang dibina sepanjang minggu. Pembangun Pranjal Paliwal, yang telah memuji Astra beberapa hari sebelumnya, kembali dan membaca kod yang ditulis untuknya, kemudian memanggil hasilnya sebagai regresi dan bukannya kemajuan. Dax Raad, yang membina alat pengekodan Opencode, memindahkan pasukannya kembali ke GPT-5.6 Sol yang lebih lama selepas membelanjakan Astra meningkat dua kali ganda kerana kelemahan yang dia anggap tidak berbaloi. Satu poster forum menggambarkan Astra kini setaraf dengan Sol dalam tugasan yang sama, dengan percubaan semula yang sama.
Tidak semua orang menerima bacaan itu. Seorang pengguna samaran menulis sebagai Antikythera berhujah model itu sentiasa malas dan gemar mata peluru, dan bahawa pengguna hanya berhenti terpesona. Percanggahan pendapat itu menggambarkan betapa sukarnya tuntutan kualiti model untuk diselesaikan: gesaan yang sama, keputusan yang berbeza.
Masalah Kapasiti di Latar Belakang
Barisan kualiti mendarat sementara kapasiti telah membayangi pelancaran. OpenAI telah mengurangkan had penggunaan Astra untuk pengguna ChatGPT yang berat mengikut laporan pengguna, dan menjeda langganan $200 Pro baharu — satu langkah yang disahkan oleh Sottiaux pada 10 September, memetik permintaan. Model ini masih berharga $10 setiap juta token input dan $50 setiap juta token keluaran, iaitu 2.5 kali ganda harga yang dicaj oleh Sol semasa ia dilancarkan.
Terdapat juga preseden yang tidak selesa: ini adalah perdana OpenAI kedua dalam masa dua bulan untuk menarik tuduhan yang sama daripada pengguna yang membayar. Pada bulan Julai, pengguna berkata mod penaakulan teratas Sol telah menjadi cetek dalam sekelip mata. Sottiaux menafikan melemahkannya dengan sengaja pada masa itu, sambil mengesahkan syarikat itu telah bereksperimen dengan usaha penaakulan. Kitaran berulang "model menjadi lebih teruk" diikuti dengan "kami mendapati kecacatan" menjadi corak yang perlu diuruskan oleh syarikat — ketelusan membantu, tetapi begitu juga dengan kestabilan.
Nasihat OpenAI Sendiri: Gunakan Kurang Pengawal
Di samping pembetulan, OpenAI menerbitkan panduan penghijrahan daripada jurutera Eric Provencher yang merupakan cadangan berlawanan dengan intuitif: model yang lebih berkebolehan memerlukan kurang pegangan tangan. Penerangan kemahiran yang terlalu panjang, keperluan membaca menyeluruh dan peraturan kelulusan yang tegar boleh menghalang Astra, kata panduan itu. Arahan yang telah bertimbun dari semasa ke semasa boleh memakan konteks atau menyebabkan model berhenti berfungsi terlalu awal.
Provencher mengesyorkan agar pasukan menyemak kemahiran mereka, fail AGENTS.md dan gesaan tugas apabila mereka menukar model, mengikat arahan dengan ketat pada tugasan tertentu dan menentukan dengan jelas apabila sesuatu kerja selesai — kerana walaupun tanpa sekatan, Astra mungkin berhenti lebih awal daripada GPT-5.6 Sol. Pasukan yang mengunci perkara selepas model terdahulu menjadi penyangak harus menyemak semula peraturan tersebut: Astra mempunyai pertimbangan yang lebih baik, kata siaran itu, tetapi ia boleh mentafsir sekatan lama secara literal sehingga ia berhenti apabila anda mahu ia diteruskan.
Apa Yang Berlaku Seterusnya
Tetapan semula penggunaan memberikan pelanggan Codex satu jadual yang bersih untuk menilai semula model, dan OpenAI akan menonton ujian sebelah menyebelah yang sama dijalankan oleh penggunanya. Persoalan yang lebih mendalam ialah kepercayaan: pembangun berbayar yang melihat kemerosotan perdana dalam masa seminggu selepas pelancaran kini mempunyai penjelasan yang didokumenkan, tiga kecacatan yang dinamakan dan tetapan semula — tetapi juga alasan baharu untuk menanda aras setiap kemas kini model terhadap hari ia dihantar.
Kekal Mendahului AI
Pelancaran model, bedah siasat kecacatan dan alat membentuk semula perisian berfungsi — dijejaki setiap hari.
Baca lebih banyak berita AI →