OpenAI ngeculake GPT-6.1 Sol tanggal 29 September, pensiun GPT-6 Sol mung pitung dina sawise debut model kasebut, miturut analisis buatan perusahaan benchmarking independen. Pertukaran kasebut bertepatan karo konferensi pangembang DevDay perusahaan, ing ngendi CNET nglaporake manawa para rawuh bisa miwiti nggunakake GPT-6.1 Sol langsung bebarengan karo agen Dots sing mentas diluncurake lan owah-owahan langganan.
Panggantos unggulan-kanggo-kapal penggedhe pitung dina ora biasa sanajan standar sing dipercepat ing taun 2026, lan pathokan kasebut nuduhake kenapa OpenAI pindhah kanthi cepet. Kanggo jangkoan terus-terusan babagan peluncuran model, gelut patokan, lan perang rega ing ngisore, AI Buzz Wire nglacak perkembangan sing penting nalika kedadeyan.
Lompat sing bisa diukur sajrone pitung dina
Analisis Ponggawa nglaporake manawa GPT-6.1 Sol entuk 4 poin ing Indeks Intelijen perusahaan liwat GPT-6 Sol, lan 5 poin liwat GPT-5.6 Sol, lan mung 1 poin ing ngisor GPT-6 Astra, model OpenAI sing paling apik. Evaluasi perusahaan kasebut nggabungake nalar, kerja pengetahuan, matematika, lan tugas agen dadi skor komparatif tunggal.
Sub-skor nuduhake ngendi hasil musataken. GPT-6.1 Sol apik 4 TCTerms ing AA-Briefcase v1.1 lan 5 TCTerms ing GDPval-AA v2.1, loro kang test karya kawruh agen. Lompat 12-titik ing Terminal-Bench 4.0 TCTerms kanggo kinerja materially luwih apik ing lingkungan terminal nyata, nalika Ujian Terakhir Kemanusiaan mundhak 5 poin lan GDP.pdf mundhak 6.
Siji nomer stands metu kanggo sapa waé sing nggunakake model kanggo riset: akurasi ing AA-Omniscience menek 8 TCTerms nalika tingkat halusinasi mudhun saka 60 persen kanggo 54 persen. Kaloro tokoh kasebut tetep dhuwur ing syarat mutlak, nanging arah perjalanan penting kanggo alur kerja ing ngendi jawaban salah sing yakin luwih elek tinimbang ora ana jawaban.
Rega stiker padha, luwih murah ing laku
Ing rega, GPT-6.1 Sol tetep kertu tarif GPT-6 Sol $ 2 saben yuta input token lan $ 10 saben yuta output token, nanging cache maca diskon mundhak saka 90 persen kanggo 95 persen. Analisis Ponggawa nyathet yen rega campuran GPT-6.1 Sol kanggo beban kerja agen rada luwih murah tinimbang GPT-6 Sol, ndawakake potongan rega efektif sing diwiwiti nalika GPT-6 Sol diluncurake kanthi diskon 50 persen kanggo GPT-5.6 Sol.
Lintasan rega minangka crita nyata ing kene. Sajrone rong rilis, OpenAI wis kira-kira nyuda setengah biaya efektif saka garis perbatasan tingkat tengah kaping pindho, nalika nambah kualitas saben wektu.
Biaya saben tugas: $0.72 versus $3.26
Biaya saben tugas ing ngendi celah karo GPT-6 Astra dadi cetha. Ing maksimum efforts , Analisis Ponggawa pancing GPT-6.1 Sol ing $ 0,72 saben tugas Intelligence Index, kurang saka seprapat saka GPT-6 Astra $ 3,26. Marang leluhur dhewe tabungan 31 persen ($ 1,05 kanggo GPT-6 Sol), lan marang GPT-5,6 Sol tekan 64 persen ($ 1,99).
Miturut tenan, saben tingkat efforts GPT-6.1 Sol nyurung metu biaya-efficiency Pareto wates - tegese kanggo tingkat tartamtu saka Intelligence, ora ana pilihan sing luwih murah ing antarane model trek. Gambar token-efisiensi luwih campuran: GPT-6.1 Sol nganggo kira-kira 10 kanggo 30 persen token output luwih saka GPT-6 Sol antarane tingkat gaweyan, sanadyan setelan gaweyan kurang lan medium tetep Pareto-optimal kanggo efficiency token sawise Intelligence sing luwih dhuwur wis factored ing. Ing coding, model gained 3 TCTerms liwat GPT-6 Sol ing gaweyan maksimum ing indeks Agen.
Apa sebabe puteran pitung dina penting
Slate DevDay sing luwih akeh nguatake gambar sing padha. Laporan CNET nggawe konferensi babagan telung perkara sing bisa digunakake para pangembang langsung - GPT-6.1 Sol, agen Dots, lan rencana langganan sing digarap maneh - tinimbang pratinjau riset sing adoh. Pesen kanggo pangembang kasedhiya saiki, dudu kemungkinan sesuk.
Flagship cadences sinyal singkat iki sing alangan competitive wis pindah saka latihan mlaku kanggo post-training refinement lan layanan infrastruktur. Nganyarke tingkat titik sing dikirim sajrone seminggu katon luwih kaya pos papriksan sing dioptimalake lan lembar rega anyar tinimbang model pondasi saka awal, lan para pesaing tumindak kanthi cara sing padha: Google ngumumake Gemini 4 Argon tanggal 30 September, model perbatasan sing wiwitane nggayuh pembela cyber sing dipercaya liwat Program Fairwind kanthi tingkat token $ 2 / $ 10 saben yuta sing padha.
Kanggo pangembang, telung takeaways praktis tindakake saka nomer diverifikasi. Kaping pisanan, beban kerja agen kanthi nggunakake cache sing abot entuk manfaat langsung saka diskon cache 95 persen. Kapindho, anggaran kudu nggawe model konsumsi token output sing luwih dhuwur sadurunge migrasi, amarga rega saben token ora owah sanajan model kasebut mikir maneh. Katelu, Astra tetep dadi langit-langit kanggo tugas ing endi titik intelijen pungkasan regane premium biaya 4x - kasus GPT-6.1 Sol yaiku kanggo umume karya, ora.
Caveat sing kudu diulang: angka kasebut asale saka evaluator independen, nanging metodologi sing ketat, lan skor indeks menehi ganjaran campuran beban kerja tartamtu. Tim kanthi beban kerja sing nuntut kudu nindakake maneh evaluasi dhewe sadurunge ngarahake lalu lintas produksi.
---
Tetep Ahead of AIEntuk warta, analisis, lan terobosan AI paling anyar - kabeh ing sak panggonan.
Waca liyane AI warta →