OpenAI telah melancarkan ChatGPT Images 2.5, versi baharu model penjanaan imej yang dibina ke dalam ChatGPT, syarikat itu mengesahkan pada hari Selasa. Kemas kini memfokuskan pada tiga titik kesakitan yang berterusan bagi alatan imej AI: kelajuan penjanaan, kecenderungan suntingan kecil untuk mengacah keseluruhan imej dan kesukaran untuk menerangkan idea visual dalam teks.
Menurut OpenAI, Imej 2.5 menghasilkan butiran yang lebih tajam, pencahayaan yang lebih semula jadi dan tekstur yang lebih kaya daripada pendahulunya, dan melakukan tugas yang lebih baik untuk memelihara rupa manusia, haiwan peliharaan dan objek yang diambil daripada foto rujukan. Penjanaan sehingga 50% lebih pantas daripada Images 2.0, versi sebelumnya. For more context on this story, see our ongoing latest AI developments.
Pengeditan Yang Hanya Mengubah Perkara yang Anda Tanya
Aduan yang paling biasa tentang penjana imej AI ialah meminta satu perubahan kecil — latar belakang yang berbeza, baris teks yang diperbetulkan — selalunya melukis semula keseluruhan gambar. OpenAI berkata Imej 2.5 dibina untuk mengedit hanya perkara yang diminta oleh pengguna sambil membiarkan imej yang lain tidak disentuh, walaupun merentasi beberapa pusingan suntingan dalam perbualan yang panjang.
Axios, yang menerima akses awal kepada model, mengujinya dengan membuat sistem mereka bentuk tatu, menyemaknya daripada nota, dan mengulangi logo melalui beberapa pusingan tanpa kehilangan konsep asal — aliran kerja berbilang langkah yang biasanya memecahkan model imej terdahulu.
Lakaran, Templat dan Komen
Kemas kini memperkenalkan ciri yang dipanggil Sketch, yang membolehkan pengguna melukis coretan kasar secara terus dalam ChatGPT — susun atur bilik, bentuk pakaian — dan menggunakan lukisan itu sebagai panduan untuk imej akhir. Menaip "@Sketch" dalam perbualan membawa alat itu ke atas. Pertaruhan OpenAI ialah menunjuk dan melukis selalunya lebih pantas dan lebih tepat daripada menulis perenggan lain teks segera.
Di samping Sketch, OpenAI menambah templat untuk format biasa seperti poster dan barangan, keupayaan untuk meninggalkan komen secara langsung pada imej untuk menyasarkan suntingan tertentu dan pilihan untuk berkongsi gesaan tepat di sebalik penciptaan supaya orang lain boleh mengadunkannya semula dengan foto mereka sendiri.
Adele Li, peneraju produk OpenAI pada imej, memberitahu Axios matlamatnya adalah untuk memastikan orang ramai terlibat secara aktif dalam proses kreatif. "Alat lakaran dan templat ini adalah sejenis percubaan untuk menjadikan orang lebih terlibat dalam proses penciptaan, dan bukannya menjadi daya pasif," kata Li.
Dua Model API Baharu untuk Pembangun
Pembangun mendapat dua model baharu melalui OpenAI API. GPT-Image-2.5 Flare disasarkan kepada volum tinggi, generasi harian seperti kandungan sosial dan foto produk, mengutamakan kependaman yang lebih rendah. GPT-Image-2.5 Sunburst diletakkan sebagai pilihan yang lebih perlahan tetapi lebih tepat untuk kerja kempen yang digilap.
Perpecahan itu mencerminkan bagaimana OpenAI telah menyusun model teksnya, memberikan pasukan kejuruteraan pertukaran antara kos dan kelajuan di satu pihak dan kualiti output di pihak yang lain. Syarikat yang membina penjanaan imej ke dalam produk mereka sendiri kini boleh memilih antara kedua-duanya tanpa meninggalkan keluarga Images 2.5.
Tera air dan Asal Kekal Di Tempat
OpenAI berkata model baharu menyimpan semakan keselamatan yang digunakan oleh versi imej terdahulu, bersama bukti kelayakan kandungan C2PA dan tera air yang tidak kelihatan untuk membantu mengenal pasti imej yang dijana AI. Piawaian asal telah menjadi semakin penting apabila imejan yang dijana fotorealistik merebak ke seluruh platform sosial, dan OpenAI telah menghadapi tekanan berterusan daripada pengawal selia dan pemegang hak untuk menjadikan media sintetik dapat dikesan.
Padang Berdaya Saing dan Sesak
Pelancaran mendarat di pasaran penjanaan imej yang semakin ramai. TechRepublic menyatakan bahawa Canva telah menghantar lebih daripada 100 kemas kini Suite Visual pada tahun 2026 yang menyasarkan geseran aliran kerja kreatif, manakala saingan termasuk Google dan xAI terus mengulangi model imej mereka sendiri. Awal tahun ini, kedudukan arena menunjukkan tempat dagangan OpenAI GPT-Image-2 dan xAI's Imagine berhampiran bahagian atas papan pendahulu keutamaan manusia.
Untuk OpenAI, strategi dengan Images 2.5 adalah kurang mengenai skor penanda aras mentah dan lebih banyak mengenai reka bentuk interaksi: mengurangkan bilangan penulisan semula segera yang diperlukan untuk mendapatkan hasil yang boleh digunakan. Seperti yang dinyatakan oleh TechRepublic, kemas kini ini bertujuan untuk menjadikan penjanaan imej AI berasa kurang seperti menaip mantera ajaib ke dalam kotak dan lebih seperti membuat sesuatu.
Ketersediaan
Imej ChatGPT 2.5 dilancarkan kepada semua pengguna ChatGPT, ChatGPT Work dan Codex pada desktop, mudah alih dan web, menurut OpenAI. Model Flare dan Sunburst API tersedia kepada pembangun dengan serta-merta, dengan perincian harga pada halaman dokumentasi model OpenAI.
Untuk perniagaan kecil dan pencipta, kepentingan praktikalnya adalah mudah: kurang penjanaan semula untuk menetapkan label, tangan atau latar belakang bermakna pemulihan yang lebih pantas pada risalah, tangkapan produk dan siaran sosial di mana alat imej AI paling banyak digunakan. Penilaian TechRepublic adalah bahawa kemas kini itu merendahkan tahap kemahiran untuk mendapatkan hasil yang boleh digunakan, ditujukan tepat kepada orang yang tidak mahu menjadi pakar kejuruteraan segera hanya untuk menghasilkan risalah atau gambar produk yang baik. Sama ada sketsa dan pengeditan berasaskan ulasan menjadi cara lalai orang mengarahkan model imej — bukannya gesaan bentuk panjang — akan menjadi metrik untuk diperhatikan dalam beberapa bulan akan datang.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →