OpenAI telah mengurangkan harga pada dua model AI GPT-5.6nya, mengurangkan kos model yang lebih kecil sebanyak 80 peratus apabila perniagaan semakin sensitif terhadap bil kecerdasan buatan mereka. Pengurangan, yang diumumkan pada 31 Julai 2026, dan diperincikan dalam catatan blog syarikat bertajuk "Memajukan Sempadan Prestasi Harga dengan GPT-5.6," menandakan salah satu pergerakan harga paling curam daripada pembekal makmal sempadan tahun ini.

Pemotongan itu menyasarkan model OpenAI yang lebih kecil dan volum tinggi — termasuk Luna, yang harganya dilaporkan Axios telah dikurangkan secara khusus — meletakkannya untuk beban kerja berskala besar yang sensitif kos di mana setiap pecahan sen setiap kompaun token menjadi perbelanjaan operasi yang ketara. Untuk penjejakan berterusan perang penentuan harga yang membentuk semula industri AI, ikuti [berita terbaharu AI] kami(https://aibuzzwire.news).

Tekanan Harga Dari Semua Pihak

Pengurangan tiba dengan latar belakang kekecewaan perusahaan yang semakin meningkat dengan kos AI. Seperti yang dilaporkan Reuters, perniagaan semakin meneliti amaun yang mereka belanjakan untuk AI apabila penempatan beralih daripada projek perintis kepada pengeluaran secara berskala. CNBC menyatakan bahawa pemotongan berlaku "apabila syarikat semakin sensitif terhadap kos," manakala AI Business merangka langkah itu sebagai tindak balas langsung kepada "kebimbangan perusahaan tentang perbelanjaan AI."

OpenAI membingkai keputusan secara berbeza. Blog syarikat itu menyifatkan pemotongan itu sebagai usaha untuk memajukan "sempadan prestasi harga" — singkatan industri untuk pertukaran antara harga model AI untuk dijalankan dan sejauh mana ia mampu. Dengan menurunkan harga model yang lebih kecil yang mampu, OpenAI secara berkesan berhujah bahawa inferens berkualiti tinggi boleh menjadi cukup murah untuk menyokong aplikasi volum tinggi yang sebelum ini tidak ekonomik.

PYMNTS melaporkan bahawa matlamatnya adalah "untuk menjadikan kerja volum tinggi menjimatkan," mencadangkan OpenAI meminati pembangun membina aplikasi yang menjana sejumlah besar panggilan API — perkhidmatan pelanggan automatik, saluran paip penjanaan kandungan dan aliran kerja pemprosesan data berskala besar.

Mengapa Model Yang Lebih Kecil Penting

Model yang disasarkan oleh pemotongan bukanlah sistem OpenAI yang paling berkuasa tetapi variannya yang lebih ringan dan lebih pantas — kuda kerja yang menguasai sebahagian besar trafik API dunia sebenar. Model frontier seperti GPT-5.6 penuh kekal mahal secara perbandingan, dikhaskan untuk tugas yang menuntut keupayaan penaakulan maksimum. Model yang lebih kecil seperti Luna mengendalikan ekor panjang pertanyaan rutin di mana kelajuan dan kos lebih penting daripada kecerdasan puncak.

Pemotongan harga mereka sehingga 80 peratus, seperti yang dilaporkan Türkiye Today, boleh membentuk semula ekonomi unit untuk beribu-ribu pembangun. Aplikasi yang memproses berjuta-juta pertanyaan setiap bulan boleh melihat bil inferensnya menurun sebanyak ratusan ribu dolar apabila kos setiap token jatuh dengan mendadak — perbezaan antara produk yang kehilangan wang pada setiap panggilan dan produk yang menghasilkan keuntungan.

Pasaran Inferens Berdaya saing

Langkah OpenAI mencerminkan persaingan yang semakin sengit dalam pasaran inferens. Alternatif berwajaran terbuka dan kos lebih rendah daripada pembekal termasuk makmal Meta, Mistral dan China seperti DeepSeek dan keluarga Qwen Alibaba telah terus menghakis premium yang boleh dikenakan oleh pembekal sempadan proprietari untuk model yang mampu tetapi bukan sempadan. Apabila alternatif tersebut matang, syarikat seperti OpenAI menghadapi pilihan: mempertahankan harga tinggi dan berisiko kehilangan volum, atau memotong secara agresif untuk mengekalkan pembangun membina platform mereka.

Pembingkaian prestasi harga menunjukkan OpenAI telah memilih yang terakhir. Dengan menjadikan modelnya yang lebih kecil lebih murah secara mendadak, syarikat itu bertaruh bahawa pembangun akan terus membina timbunan OpenAI dan bukannya berhijrah kepada alternatif kos yang lebih rendah — dan volum yang terhasil akan lebih daripada mengimbangi margin setiap panggilan yang lebih rendah.

Perbualan Kos Semakin Rancak

Pemotongan itu juga memberi isyarat bahawa industri memasuki fasa yang lebih berdisiplin kewangan. Semasa ledakan AI generatif awal, banyak perusahaan menganggap perbelanjaan AI sebagai barisan belanjawan percubaan, bersedia untuk menyerap kos yang tinggi dalam mengejar keupayaan dan kebaharuan. Apabila penempatan telah matang, ketua pegawai maklumat dan pasukan kewangan telah mula menuntut pulangan pelaburan yang jelas, dan era perbelanjaan AI yang tidak kritikal nampaknya semakin berkurangan.

Analisis industri telah mendokumentasikan peralihan ini dalam beberapa bulan kebelakangan ini. Perniagaan AI melaporkan secara berasingan pada 31 Julai bahawa perusahaan sedang "bergelut dengan kos skala AI," yang menekankan bahawa jurang antara pelan hala tuju AI yang bercita-cita tinggi dan ekonomi unit yang mampan kekal sebagai cabaran utama bagi pengguna korporat.

Maksudnya untuk Pembangun

Bagi ekosistem pembangun, model yang lebih kecil yang lebih murah adalah berita baik yang jelas. Kos inferens yang lebih rendah mengembangkan julat aplikasi yang berdaya maju, menggalakkan percubaan dan merendahkan halangan kemasukan bagi syarikat pemula yang tidak mampu untuk mensubsidi panggilan API yang mahal. Persoalannya ialah sama ada saingan OpenAI akan sepadan dengan pemotongan, mencetuskan perang harga yang lebih luas yang memampatkan lagi margin merentasi pasaran inferens.

Buat masa ini, OpenAI telah membuat satu garis: AI yang berkebolehan tidak semestinya AI yang mahal. Sama ada mesej itu menang ke atas perusahaan yang mementingkan kos — dan sama ada syarikat itu boleh mengekalkan strategi dari segi kewangan — akan menjadi kisah yang menentukan bulan-bulan mendatang.

Kekal Mendahului AI

Keluaran model, peralihan harga dan dinamik kompetitif membentuk semula landskap AI setiap minggu. Tandai halaman AI Buzz Wire untuk liputan berterusan tentang platform dan dasar yang memacu industri.

Baca lebih banyak berita model AI →