Anthropic telah melancarkan Claude Opus 5, model AI baharu yang dikatakan syarikat itu menyampaikan kecerdasan berhampiran sempadan pada kira-kira separuh harga model Fable 5 peringkat teratasnya. Dikeluarkan pada 24 Julai 2026, Opus 5 kini merupakan model lalai pada Claude Max dan model terkuat yang tersedia pada Claude Pro, meletakkannya sebagai tenaga kerja harian Anthropic untuk pengekodan, ejen autonomi dan kerja pengetahuan profesional.
Pelancaran berlaku pada saat perniagaan sedang meneliti perbelanjaan AI. Menurut CNBC, model baharu itu "menyaingi Fable 5 dan lebih murah kerana perniagaan bimbang tentang kos," manakala Bloomberg mencirikannya sebagai "model yang lebih cekap kos untuk tugas harian." Untuk pasukan yang menjejaki [perkembangan AI] terbaharu(https://aibuzzwire.news), Opus 5 mewakili pertaruhan yang disengajakan bahawa medan pertempuran kompetitif seterusnya ialah nilai, bukan ketuanan penanda aras mentah.
Prestasi Penanda Aras: Tercanggih Baharu tentang Kerja Pengekodan dan Pengetahuan
Anthropic melaporkan bahawa Opus 5 menyiarkan hasil terkini mengenai pengekodan dan penilaian kerja pengetahuan termasuk Frontier-Bench dan GDPval-AA. Pada Frontier-Bench v0.1, syarikat itu berkata Opus 5 mengatasi semua model lain dan lebih daripada dua kali ganda prestasi pendahulunya, Opus 4.8, pada kos yang lebih rendah bagi setiap tugas.
Pada CursorBench 3.2, Opus 5 berada dalam 0.5% daripada skor puncak Fable 5 manakala kos separuh daripada setiap tugas, menurut penanda aras Anthropic sendiri. Decrypt menyatakan bahawa model itu "mengungguli Fable 5 pada kebanyakan penanda aras - pada separuh harga."
Keuntungan meluas kepada penilaian agen dan penyelesaian masalah:
- ARC-AGI 3: Opus 5 mendapat markah kira-kira tiga kali lebih tinggi daripada model terbaik seterusnya pada ujian penyelesaian masalah novel ini.
- Zapier AutomationBench: Kadar lulus kira-kira 1.5x model terbaik seterusnya untuk kos yang sama, mengukur penyiapan tugas perniagaan hujung ke hujung.
- OSWorld 2.0 (penggunaan komputer): Opus 5 mengatasi hasil terbaik Fable 5 dengan hanya lebih satu pertiga daripada kos.
Terutama, Anthropic mengakui bahawa Opus 5 "kekal di belakang Mythos 5 dalam tugas keselamatan siber," kawasan di mana model sempadan saingan mengekalkan peneraju.
Agensi yang Lebih Kuat dan Pengesahan Kendiri
Tema berulang dalam pengumuman itu ialah keupayaan Opus 5 yang dipertingkatkan untuk mengesahkan kerjanya sendiri dan berulang sehingga berjaya. Anthropic menerangkan beberapa contoh daripada ujian akses awal yang menyerlahkan autonomi ini.
Dalam satu tugasan Frontier-Bench, model itu diberi lukisan bahagian mesin dan diminta menulis kod untuk membinanya semula sebagai model FreeCAD 3D — tetapi sengaja tidak diberikan cara untuk melihat lukisan itu secara langsung. Opus 5 dilaporkan menulis saluran paip penglihatan komputernya sendiri untuk mengekstrak geometri daripada piksel mentah, kemudian membina semula bahagian penuh, berjaya berulang kali di mana tiada model bersaing dapat menyelesaikan tugas itu selepas lima percubaan.
Memandangkan pepijat sebenar dalam pengurus pakej sumber terbuka yang popular, Opus 5 menemui punca dan membetulkan kes kelebihan yang telah dilepaskan oleh tampung komuniti itu sendiri, manakala model bersaing hanya membetulkan gejala permukaan dan mengisytiharkan pepijat telah diselesaikan. Seorang jurutera di firma perdagangan dilaporkan menggunakan Opus 5 untuk membina suapan data pasaran untuk pertukaran baharu dalam satu sesi — satu tugas yang tidak dapat diselesaikan oleh model sebelumnya — dan, mendapati tiada suapan langsung untuk disahkan, model itu membina abah-abah ujiannya sendiri.
Penerimaan Pelanggan
Rakan kongsi akses awal menawarkan sebahagian besar penilaian positif. Scott Wu, Ketua Pegawai Eksekutif Cognition (pembuat ejen pengekodan Devin), berkata Opus 5 "mendekati prestasi peringkat Fable pada separuh kos" dan menunjukkan "kekuatan tertentu pada tugasan penyahpepijatan yang sukar dan analisis punca akar." Sualeh Asif, pengasas bersama Cursor, berkata model itu menyampaikan "berhampiran kecerdasan Fable 5 pada kelajuan dan kos Opus."
Wade Foster, Ketua Pegawai Eksekutif Zapier, melaporkan bahawa Opus 5 "mengungguli papan pendahulu AutomationBench Zapier tanpa membelanjakan lebih banyak token daripada model Claude sebelum ini," melengkapkan aliran kerja pencegahan churn sepenuhnya dari hujung ke hujung — membenderakan akaun berisiko, memaklumkan pemilik yang betul dan meringkaskan untuk pasukan pengekalan. Model terdahulu tidak lulus; Opus 5 mencapai 100%.
Keuntungan dalam Penyelidikan Saintifik
Anthropic juga menyerlahkan penambahbaikan Opus 5 untuk kerja saintifik. Model ini mengatasi Opus 4.8 pada setiap penilaian sains hayat Anthropic, meliputi biologi struktur, kimia organik dan bioinformatik. Syarikat itu menunjukkan peningkatan 10.2 mata peratusan pada penanda aras kimia organik dalaman (menyimpulkan struktur molekul daripada data spektroskopi) dan keuntungan 7.7 mata pada tugas ramalan fungsi protein. Seorang pelanggan genomik menyifatkan model itu sebagai berkelakuan "lebih seperti seorang saintis yang berhati-hati," mencapai ujian statistik yang betul dan menyemak silang keputusannya sendiri.
Strategi Harga
Dengan menetapkan harga Opus 5 pada tahap yang sama dengan Opus 4.8 sambil menghampiri kecerdasan Fable 5, Anthropic secara berkesan mengecilkan jurang antara tawaran peringkat pertengahan dan perdananya. VentureBeat merangka keluaran itu sebagai "model AI yang lebih murah untuk pengekodan, ejen dan aliran kerja perusahaan," dan Seeking Alpha memerhatikan bahawa Opus 5 adalah "lebih dekat & lebih murah kepada model sempadan Fable 5." Syarikat itu menawarkan tetapan "usaha" boleh laras yang membolehkan pelanggan menukar kecerdasan untuk kelajuan dan kos token yang lebih rendah, memperhalusi nisbah kos kepada prestasi setiap tugas.
Maksudnya untuk Perlumbaan AI
Opus 5 menekankan betapa cepatnya kos AI berhampiran sempadan menurun. Model yang datang dalam jarak yang ketara daripada sistem paling berkebolehan yang tersedia — pada separuh daripada harga token — menekan pesaing untuk mewajarkan penetapan harga premium untuk keuntungan kecil. Dengan Anthropic, OpenAI, Google dan lain-lain berlumba-lumba untuk menjadikan model berkemampuan cukup berpatutan untuk penggunaan harian berskala besar, persoalan untuk perusahaan beralih daripada "model mana yang paling bijak?" kepada "model yang manakah memberikan kecerdasan paling banyak bagi setiap dolar?"
Untuk Anthropic, mesejnya jelas: penaakulan mewah bukan lagi produk mewah. Opus 5 membawa keupayaan bersebelahan sempadan ke titik harga yang menjadikan penggunaan berterusan setiap hari realistik — dan itu mungkin menjadi perincian yang paling berbangkit daripada semua.
Kekal Mendahului AI
Claude Opus 5 tersedia mulai hari ini di Claude Pro, Claude Max, dan melalui API Anthropic. Untuk maklumat lanjut tentang cerita ini dan landskap kecerdasan buatan yang lebih luas, ikuti berita terkini AI semasa ia berlaku.
Baca lebih banyak berita AI →