Anthropic telah meluncurkan Claude Opus 5, model AI baru yang menurut perusahaan memberikan kecerdasan mendekati batas dengan harga sekitar setengah harga model Fable 5 papan atas. Dirilis pada 24 Juli 2026, Opus 5 kini menjadi model default di Claude Max dan model terkuat yang tersedia di Claude Pro, memposisikannya sebagai pekerja keras sehari-hari Anthropic untuk pengkodean, agen otonom, dan pekerjaan pengetahuan profesional.
Peluncuran ini dilakukan pada saat dunia usaha sedang meneliti pengeluaran AI. Menurut CNBC, model baru ini "menyaingi Fable 5 dan lebih murah karena bisnis mengkhawatirkan biaya," sementara Bloomberg mencirikannya sebagai "model yang lebih hemat biaya untuk tugas sehari-hari." Bagi tim yang memantau perkembangan AI, Opus 5 mewakili taruhan yang disengaja bahwa medan pertempuran kompetitif berikutnya adalah nilai, bukan supremasi tolok ukur mentah.
Kinerja Tolok Ukur: Pekerjaan Pengkodean dan Pengetahuan Tercanggih Baru
Anthropic melaporkan bahwa Opus 5 memposting hasil-hasil mutakhir dalam pengkodean dan evaluasi kerja pengetahuan termasuk Frontier-Bench dan GDPval-AA. Pada Frontier-Bench v0.1, perusahaan mengatakan Opus 5 melampaui semua model lainnya dan lebih dari dua kali lipat kinerja pendahulunya, Opus 4.8, dengan biaya per tugas yang lebih rendah.
Pada CursorBench 3.2, Opus 5 hadir dalam 0,5% dari skor puncak Fable 5 sementara biayanya setengah dari biaya per tugas, menurut tolok ukur Anthropic sendiri. Decrypt mencatat bahwa model tersebut "mengungguli Fable 5 pada sebagian besar tolok ukur — dengan setengah harga."
Keuntungannya mencakup evaluasi agen dan pemecahan masalah:
- ARC-AGI 3: Opus 5 mendapat skor sekitar tiga kali lebih tinggi dibandingkan model terbaik berikutnya dalam tes pemecahan masalah baru ini.
- Zapier AutomationBench: Tingkat kelulusan sekitar 1,5x model terbaik berikutnya dengan biaya yang sama, yang mengukur penyelesaian tugas bisnis menyeluruh.
- OSWorld 2.0 (penggunaan komputer): Opus 5 melampaui hasil terbaik Fable 5 hanya dengan sepertiga biayanya.
Khususnya, Anthropic mengakui bahwa Opus 5 “masih berada di belakang Mythos 5 dalam tugas-tugas keamanan siber,” suatu bidang di mana model frontier saingannya tetap memimpin.
Agensi yang Lebih Kuat dan Verifikasi Mandiri
Tema yang berulang dalam pengumuman ini adalah peningkatan kemampuan Opus 5 untuk memverifikasi pekerjaannya sendiri dan mengulanginya hingga berhasil. Anthropic menjelaskan beberapa contoh dari pengujian akses awal yang menyoroti otonomi ini.
Dalam salah satu tugas Frontier-Bench, model diberi gambar bagian mesin dan diminta menulis kode untuk merekonstruksinya menjadi model FreeCAD 3D — tetapi sengaja tidak diberi cara untuk melihat gambar tersebut secara langsung. Opus 5 dilaporkan menulis pipeline visi komputernya sendiri untuk mengekstraksi geometri dari piksel mentah, lalu membangun kembali seluruh bagiannya, berulang kali berhasil karena tidak ada model pesaing yang dapat menyelesaikan tugas tersebut setelah lima kali mencoba.
Mengingat bug nyata dalam manajer paket sumber terbuka yang populer, Opus 5 menemukan akar permasalahan dan memperbaiki kasus edge yang terlewatkan oleh patch komunitas, sedangkan model pesaing hanya memperbaiki gejala permukaan dan menyatakan bug telah teratasi. Seorang insinyur di sebuah perusahaan perdagangan dilaporkan menggunakan Opus 5 untuk membangun umpan data pasar untuk bursa baru dalam satu sesi – sebuah tugas yang tidak dapat diselesaikan sama sekali oleh model sebelumnya – dan, karena tidak menemukan umpan langsung untuk divalidasi, model tersebut membangun rangkaian pengujiannya sendiri.
Penerimaan Pelanggan
Mitra akses awal memberikan sebagian besar penilaian positif. Scott Wu, CEO Cognition (pembuat agen pengkodean Devin), mengatakan Opus 5 "mendekati kinerja tingkat Fable dengan setengah biaya" dan menunjukkan "kekuatan khusus pada tugas-tugas debugging dan analisis akar penyebab yang sulit." Sualeh Asif, salah satu pendiri Cursor, mengatakan model ini memberikan "kecerdasan mendekati Fable 5 dengan kecepatan dan biaya Opus."
Wade Foster, CEO Zapier, melaporkan bahwa Opus 5 "menduduki puncak papan peringkat AutomationBench Zapier tanpa menghabiskan lebih banyak token dibandingkan model Claude sebelumnya," menyelesaikan alur kerja pencegahan churn secara menyeluruh — menandai akun yang berisiko, memperingatkan pemilik yang tepat, dan membuat ringkasan untuk tim retensi. Model sebelumnya tidak lolos; Opus 5 mencapai 100%.
Keuntungan dalam Penelitian Ilmiah
Anthropic juga menyoroti peningkatan Opus 5 untuk karya ilmiah. Model ini mengungguli Opus 4.8 pada semua evaluasi ilmu hayati Anthropic, yang mencakup biologi struktural, kimia organik, dan bioinformatika. Perusahaan tersebut menunjukkan adanya peningkatan sebesar 10,2 poin persentase pada tolok ukur kimia organik internal (menyimpulkan struktur molekul dari data spektroskopi) dan peningkatan sebesar 7,7 poin pada tugas prediksi fungsi protein. Salah satu pelanggan genomik menggambarkan model tersebut berperilaku "lebih seperti ilmuwan yang berhati-hati", melakukan uji statistik yang tepat dan memeriksa ulang hasilnya sendiri.
Strategi Penetapan Harga
Dengan menetapkan harga Opus 5 pada level yang sama dengan Opus 4.8 dan mendekati kecerdasan Fable 5, Anthropic secara efektif mempersempit kesenjangan antara penawaran tingkat menengah dan unggulannya. VentureBeat membingkai rilis ini sebagai "model AI yang lebih murah untuk pengkodean, agen, dan alur kerja perusahaan," dan Seeking Alpha mengamati bahwa Opus 5 "lebih dekat & lebih murah dengan model terdepan Fable 5." Perusahaan ini menawarkan pengaturan "usaha" yang dapat disesuaikan yang memungkinkan pelanggan menukar kecerdasan demi kecepatan dan biaya token yang lebih rendah, menyempurnakan rasio biaya terhadap kinerja per tugas.
Apa Artinya bagi Perlombaan AI
Opus 5 menggarisbawahi betapa cepatnya penurunan biaya AI yang berada di dekat perbatasan (near-frontier AI). Model yang berada sangat dekat dengan sistem paling mumpuni yang ada – dengan setengah harga token – menekan pesaing untuk membenarkan penetapan harga premium demi keuntungan marjinal. Saat Anthropic, OpenAI, Google, dan lainnya berlomba untuk membuat model yang mampu dan cukup terjangkau untuk penerapan sehari-hari dalam skala besar, pertanyaan bagi perusahaan beralih dari “model mana yang paling cerdas?” hingga "model mana yang memberikan kecerdasan terbanyak per dolar?"
Bagi Anthropic, pesannya jelas: penalaran kelas atas bukan lagi produk mewah. Opus 5 menghadirkan kemampuan yang berdekatan dengan perbatasan ke titik harga yang menjadikan penerapan sehari-hari yang berkelanjutan menjadi realistis — dan ini mungkin terbukti menjadi detail yang paling penting dari semuanya.
Tetap Terdepan dalam AI
Claude Opus 5 tersedia mulai hari ini di Claude Pro, Claude Max, dan melalui API Anthropic. Untuk informasi lebih lanjut tentang kisah ini dan lanskap kecerdasan buatan yang lebih luas, ikuti terus berita AI terkini saat hal tersebut terjadi.
Baca berita AI selengkapnya →