OpenAI wis mbenerake telung cacat sing ujar nerangake keluhan pangguna seminggu yen GPT-6 Astra, model perbatasan paling anyar, wis dadi bodho wiwit diluncurake - lan ngreset watesan panggunaan kanggo pelanggan Codex minangka njaluk ngapura. Pembaruan kasebut teka saka pimpinan produk Codex Tibo Sottiaux, sing ujar manawa tim kasebut kerja bareng karo pangguna kanggo nglacak kesalahan, banjur ngirim perbaikan lan reset panggunaan lengkap sadurunge tengah wengi wektu lokal, miturut update sing diterbitake Sabtu.
Diakoni nutup babagan apa sing dianggep OpenAI minangka model sing paling apik nganti saiki. Wiwit Astra tekan kasedhiya ing awal September, pangembang ing X wis mbukak pituduh sing padha karo Astra dina peluncuran lan versi saiki, supaya saben setelan padha, lan ngirim mbandhingake sisih-by-side sing katon nuduhake model sing rada ringkih. Kanggo luwih akeh babagan model sing nyopir debat iki, deleng pangembangan AI paling anyar jangkoan.
Cacat Telung, Dijenengi
Miturut Sottiaux, panyebab pisanan yaiku katrampilan - file cepet sing ditulis kanggo model sadurunge sing asring banget ing Astra, kadhangkala mandheg model kasebut mriksa karyane dhewe. Kapindho yaiku eksperimen manajemen konteks opsional sing bisa nggawe model mandheg awal utawa mbales pesen basi. OpenAI mateni eksperimen kasebut sawise kira-kira 4,000 nganti 5,000 pangguna kena pengaruh, ujare perusahaan kasebut.
Cacat katelu kalebu infrastruktur tinimbang model kasebut dhewe: sawetara mesin inferensi wis dikonfigurasi kanthi ora bener lan kualitas sing bisa diukur ing lalu lintas buntut sing dilewati. OpenAI mbusak mesin kasebut lan nggawe sawetara ndandani sing luwih cilik. Sottiaux nulis manawa model kasebut saiki nglacak pesen pangguna paling anyar kanthi luwih akurat - manthuk kanggo keluhan yen Astra wis mangsuli pitakon sing wis ditindakake pangguna.
Pangembang Wis Wis Pindhah
Keluhan dibangun liwat minggu. Pangembang Pranjal Paliwal, sing wis ngalem Astra dina sadurunge, bali lan maca kode sing ditulis kanggo dheweke, banjur disebut asil regresi tinimbang kemajuan. Dax Raad, sing mbangun alat coding Opencode, dipindhah tim bali menyang GPT-5.6 Sol lawas sawise mbuwang ing Astra tikel kaping pindho kanggo downsides kang dianggep ora worth dhuwit. Siji poster forum nggambarake Astra saiki level karo Sol ing tugas sing padha, kanthi nyoba maneh sing padha.
Ora saben wong nampa wacan kasebut. Pangguna jeneng samaran sing nulis minangka Antikythera ujar manawa model kasebut mesthi kesed lan seneng karo titik peluru, lan pangguna mung mandheg kaget. Perselisihan kasebut nggambarake kepiye tuntutan kualitas model sing angel ditindakake: pituduh sing padha, putusan sing beda.
Masalah Kapasitas ing Latar mburi
Baris kualitas ndharat nalika kapasitas wis shadowed rollout. OpenAI wis ngethok watesan panggunaan Astra kanggo pangguna ChatGPT sing abot miturut laporan pangguna, lan ngaso langganan Pro $ 200 anyar - langkah sing dikonfirmasi Sottiaux ing 10 September, nyatakake permintaan. Model isih biaya $ 10 saben yuta token input lan $ 50 saben yuta token output, kang 2,5 kaping apa Sol nalika dibukak.
Ana uga preseden sing ora nyenengake: iki minangka kapal penggedhe OpenAI kaping pindho sajrone rong wulan kanggo nggambar tuduhan sing padha saka pangguna sing mbayar. Ing Juli, kedhaftar ngandika mode alesan ndhuwur Sol wis dadi cethek sewengi. Sottiaux nolak weakening iku sengaja ing wektu, nalika konfirmasi perusahaan wis èkspèrimèn karo gaweyan pertimbangan. Siklus bola-bali "model dadi luwih elek" diikuti "kita nemokake cacat" dadi pola sing kudu ditindakake perusahaan - transparansi mbantu, nanging uga stabilitas.
Saran OpenAI Sendiri: Gunakake Guardrails Kurang
Saliyane mbenakake, OpenAI nerbitake pandhuan migrasi saka insinyur Eric Provencher sing dadi rekomendasi counterintuitive: model sing luwih mumpuni mbutuhake kurang tangan. Katrangan skill sing dawa banget, syarat maca kemul lan aturan persetujuan sing kaku bisa ditindakake dening Astra, ujare pandhuan kasebut. Instructions sing wis numpuk liwat wektu bisa mangan konteks utawa nimbulaké model kanggo mungkasi karya banget awal.
Provencher nyaranake supaya tim nyemak katrampilan, file AGENTS.md lan panjaluk tugas nalika padha ngalih model, ngubungake instruksi kanthi rapet kanggo tugas tartamtu, lan nemtokake kanthi jelas nalika tugas wis rampung - amarga sanajan tanpa watesan, Astra bisa mandheg luwih awal tinimbang GPT-5.6 Sol. Tim sing ngunci barang sawise model sadurunge dadi nakal kudu mriksa maneh aturan kasebut: Astra duwe pertimbangan sing luwih apik, kiriman kasebut mbantah, nanging bisa menehi interpretasi watesan lawas kanthi harfiah supaya mandheg yen sampeyan pengin terus maju.
Apa Kelakon Sabanjure
Reset panggunaan menehi pelanggan Codex slate sing resik kanggo ngevaluasi maneh model kasebut, lan OpenAI bakal nonton tes sisih-by-side sing padha ditindakake pangguna. Pitakonan sing luwih jero yaiku kapercayan: pangembang sing mbayar sing ndeleng degradasi kapal penggedhe sajrone seminggu diluncurake saiki duwe panjelasan sing didokumentasikake, telung cacat sing dijenengi, lan reset - nanging uga alesan anyar kanggo menehi pathokan saben nganyari model ing dina sing dikirim.
Tetep Ahead of AI
Peluncuran model, post-mortem cacat, lan piranti lunak sing bisa digunakake maneh - dilacak saben dina.
Waca liyane warta AI →