Anthropic telah mengeluarkan Claude Sonnet 5, memanggilnya model kelas Sonnet paling ejen yang telah dibina oleh syarikat itu. Dilancarkan pada 30 Jun 2026, model baharu itu boleh membuat perancangan, menggunakan alatan seperti penyemak imbas dan terminal serta berjalan secara autonomi pada tahap yang, hanya beberapa bulan lalu, memerlukan model yang lebih besar dan jauh lebih mahal. Pelancaran itu berlaku pada ketika seluruh industri AI berlumba-lumba untuk menjadikan chatbots menjadi ejen berkebolehan yang boleh bertindak bagi pihak pengguna dan bukannya menjawab soalan semata-mata.

Bagi pembangun yang menjejaki perkembangan terkini, berita itu menambah kesibukan berita terkini AI yang telah membentuk semula landskap kompetitif. Anthropic membingkaikan Sonnet 5 apabila keupayaan agenik akhirnya tiba pada harga pertengahan, satu anjakan yang boleh mengubah cara pasukan membuat bajet untuk aliran kerja autonomi.

Prestasi yang Menyaingi Keutamaan

Menurut Anthropic, Sonnet 5 mengecilkan jurang antara barisan Sonnet pertengahan dan model Opus peringkat teratas syarikat. Prestasinya hampir sama dengan Opus 4.8, tetapi pada harga yang jauh lebih rendah, dan ia menunjukkan peningkatan yang ketara berbanding pendahulunya, Sonnet 4.6, dalam penaakulan, penggunaan alat, pengekodan dan kerja pengetahuan.

Keluk prestasi kos diterbitkan Anthropic membandingkan model dengan Sonnet 4.6 dan Opus 4.8 pada dua penilaian agen: BrowseComp, yang mengukur carian agen dan OSWorld-Verified, yang menguji penggunaan komputer. Syarikat itu berkata Sonnet 5 menawarkan pilihan prestasi kos yang lebih luas daripada Sonnet 4.6 dan, pada tahap usaha yang lebih tinggi, boleh memadankan Opus 4.8 pada beberapa tugas.

Harga Agresif untuk Ejen

Harga adalah pusat kepada padang. Claude Sonnet 5 dilancarkan dengan harga pengenalan $2 setiap juta token input dan $10 setiap juta token keluaran, tersedia sehingga 31 Ogos 2026. Selepas tetingkap itu, ia beralih kepada $3 setiap juta token input dan $15 setiap juta token keluaran.

Sebagai perbandingan, Opus 4.8 berharga $5 setiap juta token input dan $25 setiap juta token keluaran. Oleh kerana ejen membakar sejumlah besar token semasa mereka membuat alasan dan memanggil alatan melalui banyak langkah, jurang harga itu amat penting untuk belanjawan perusahaan. Penguji akses awal yang dipetik oleh Anthropic menerangkan Sonnet 5 menyelesaikan tugas yang kompleks di mana model Sonnet sebelumnya akan berhenti seketika, dan menyemak outputnya sendiri tanpa diminta secara jelas.

Ketersediaan Merentas Setiap Pelan

Claude Sonnet 5 tersedia di semua rancangan Anthropic dari hari pelancaran. Ia ialah model lalai untuk pengguna Percuma dan Pro, dan ia tersedia kepada pelanggan Maks, Pasukan dan Perusahaan. Pembangun boleh mengaksesnya melalui API Claude menggunakan pengecam model `claude-sonnet-5`, serta melalui Kod Claude dan Platform Claude.

Pelancaran yang meluas adalah ketara kerana ia meletakkan prestasi agen yang berkebolehan ke tangan pengguna percuma, bukan hanya pelanggan perusahaan yang membayar. Anthropic berkata barisan Sonnet dari segi sejarah adalah tempat era agenik bermula untuk banyak pembangun, menunjuk kepada Claude Sonnet 3.5, 3.6 dan 3.7 sebagai model pertama yang menunjukkan pengekodan yang kuat dan kemahiran penggunaan alat.

Kisah Keselamatan Terbina Dalam

Keselamatan adalah bahagian penting dalam pengumuman itu. Anthropic berkata penilaiannya mendapati bahawa Sonnet 5 menunjukkan kadar keseluruhan lebih rendah bagi tingkah laku yang tidak diingini daripada Sonnet 4.6 dan secara amnya lebih selamat digunakan dalam konteks agen. Syarikat itu juga menyatakan bahawa model itu mempunyai keupayaan yang jauh lebih rendah untuk melaksanakan tugas keselamatan siber berbanding model Opus semasanya, pilihan reka bentuk yang disengajakan yang mengurangkan risiko penyalahgunaan walaupun keupayaan umum meningkat.

Kad Sistem Claude Sonnet 5, yang dikeluarkan bersama model, melaporkan set penilaian yang lebih luas secara terperinci. Anthropic telah meletakkan ketelusan di sekitar ujian keselamatan sebagai pembeza kompetitif kerana pengawal selia di Amerika Syarikat dan Eropah meneliti keluaran model sempadan.

Detik Agentik Yang Lebih Luas

Pelancaran mendarat di tengah-tengah persaingan yang sengit. Saingan termasuk OpenAI, Google dan satu set makmal Cina yang bergerak pantas semuanya mendorong ke arah model yang boleh mengambil tindakan berbilang langkah dan bukannya menjana teks sahaja. Dengan menyampaikan keupayaan agenik bersebelahan Opus pada harga Sonnet, Anthropic bertaruh bahawa medan pertempuran seterusnya bukanlah markah penanda aras mentah tetapi kos menjalankan ejen dengan pasti dalam tugas yang panjang dan kompleks.

Dengan harga pengenalan yang dikunci sehingga penghujung Ogos, pembangun kini mempunyai tetingkap untuk menguji Sonnet 5 terhadap beban kerja ejen yang paling menuntut mereka sebelum kadar yang lebih tinggi berkuat kuasa.

Kekal Mendahului AI

Kepantasan keluaran model tidak menunjukkan tanda perlahan. Untuk liputan berterusan mengenai pelancaran baharu, pusingan pembiayaan dan anjakan dasar, lawati AI Buzz Wire untuk perkembangan AI terkini semasa ia berlaku.

Baca lebih banyak berita AI →