Anthropic merilis Claude Haiku 5.5 pada hari Selasa, menggambarkannya sebagai "model kecil termurah, tercepat, dan paling mampu yang pernah kami rilis." Peluncuran ini disertai dengan pemotongan harga dua tingkat yang menurunkan biaya input menjadi $0,10 per juta token untuk sebagian besar permintaan, sebuah langkah yang memberikan tekanan langsung pada GPT-6 Luna OpenAI di segmen model kecil dan memperpanjang perang harga selama berbulan-bulan di industri AI.

Pengumuman yang dipublikasikan di situs Anthropic pada 7 Oktober 2026 ini menempatkan Haiku 5.5 sebagai model ketiga dalam keluarga Claude 5.5, bersama Sonnet 5.5 dan Opus 5.5. Reuters mencirikan rilis tersebut sebagai Anthropic yang memperluas jajaran modelnya saat mempersiapkan IPO yang direncanakan, dan model tersebut sudah tersedia di GitHub Copilot, Amazon Web Services, Google Cloud, dan Microsoft Foundry. Peluncuran ini merupakan entri terbaru dalam sebulan berita AI terkini yang telah menyaksikan peluncuran model, pemotongan harga, dan pergerakan kebijakan hampir setiap hari.

Model Kecil yang Dibuat untuk Pekerjaan Bervolume Tinggi

Menurut Anthropic, Claude Haiku 5.5 dirancang untuk tugas-tugas bervolume tinggi dan sensitif terhadap biaya daripada penalaran tingkat batas. Perusahaan mengatakan itu "dengan andal menangani beban kerja yang cepat dan berulang" seperti ringkasan, pemadatan, kueri basis data, dan permintaan klasifikasi.

Anthropic juga memposisikan model baru ini sebagai pendamping sistem yang lebih besar: Haiku 5.5 "berpasangan dengan baik dengan Opus 5.5 dan Sonnet 5.5 sebagai subagen dalam pekerjaan pengkodean," memungkinkan pengembang mengarahkan subtugas yang murah dan cepat ke Haiku sambil memesan model yang lebih besar untuk alasan yang kompleks. Karena ini adalah model Anthropic tercepat hingga saat ini dengan kecepatan standar, perusahaan merekomendasikannya untuk aplikasi yang sensitif terhadap latensi seperti dukungan pelanggan langsung dan penggunaan browser. Satu catatan kaki menambahkan peringatan: model Opus Anthropic masih berjalan lebih cepat dalam Mode Cepat.

Harga: Hingga 90% Lebih Murah Dari Haiku 4.5

Perubahan utama adalah harga. Anthropic mengatakan Haiku 5.5 biaya pengoperasiannya sekitar 75% lebih murah dibandingkan rata-rata Haiku 4.5, dengan struktur berjenjang yang bergantung pada ukuran prompt.

Untuk permintaan dengan permintaan hingga 100,000 token — yang menurut Anthropic menyumbang sekitar 90% permintaan model Haiku sebelumnya — harga 90% lebih rendah dari Haiku 4.5. Permintaan lebih dari 100.000 token harganya 50% lebih murah.

Tabel harga per juta token dari pengumuman Anthropic menunjukkan skala pemotongan:

  • Token masukan: $0,10 (meminta hingga 100 ribu) atau $0,50 (lebih dari 100 ribu), turun dari $1,00 tetap untuk Haiku 4.5
  • Token keluaran: $0,50 atau $2,50, turun dari $5,00
  • Cache terbaca: $0,01 atau $0,05, turun dari $0,10
  • Cache menulis: $0,125 atau $0,625, turun dari $1,25

Pada tingkat sub-100K, hal ini menjadikan harga keluaran Haiku 5.5 seperlima dari token keluaran Sonnet 5.5 sebesar $10,00 per juta.

Anthropic mencatat satu detail teknis di balik angka-angka tersebut: Haiku 5.5 menggunakan tokenizer yang diperbarui, mirip dengan Sonnet 5.5 dan Opus 5.5, yang berarti ia menggunakan lebih banyak token per tugas daripada Haiku 4.5. Perusahaan mengatakan perhitungan biaya rata-rata menyumbang perbedaan tersebut.

Tolok Ukur: Mengungguli GPT-6 Luna di Baris Terbanyak

Anthropic menerbitkan tabel benchmark yang membandingkan Haiku 5.5 dengan Haiku 4.5, GPT-6 Luna, dan Sonnet 5.5. Pada sebagian besar evaluasi yang tercantum, model baru ini berada di depan Luna dan jauh di depan pendahulunya:

  • GDPval-AA v2.1 (pekerjaan pengetahuan): 1620 untuk Haiku 5.5, dibandingkan 735 untuk Haiku 4.5, 1437 untuk GPT-6 Luna, dan 1840 untuk Sonnet 5.5
  • AA-Briefcase v1.1: 1578, versus 614 untuk Haiku 4.5 dan 1336 untuk Luna
  • OSWorld 2.1, subset offline (penggunaan komputer): 72,4%, dibandingkan 15,7% untuk Haiku 4.5, 48,9% untuk Luna, dan 83,9% untuk Sonnet 5.5
  • Ujian Terakhir Kemanusiaan: 45,9% tanpa alat dan 57,4% dengan alat, dibandingkan 10,2% dan 18,7% untuk Haiku 4.5
  • Terminal-Bench 4.0 (pengkodean agen): 39,2%, dibandingkan 16,4% untuk Luna dan 70,6% untuk Sonnet 5.5
  • FrontierCode 1.1, Utama: 46,4%, lebih tinggi dari Luna yang 42,4%

Polanya konsisten: Haiku 5.5 menutup sebagian besar kesenjangan dengan GPT-6 Luna dan, dalam penggunaan komputer, langsung mengalahkannya, sementara Sonnet 5.5 milik Anthropic masih memimpin setiap kategori. Panduan Anthropic mencerminkan hierarki tersebut — perusahaan mengatakan Sonnet 5.5 dan Opus 5.5 "tetap menjadi pilihan yang lebih baik untuk tugas pengkodean agen yang kompleks seperti yang diukur dengan Terminal-Bench 4.0," sementara Haiku 5.5 menargetkan pekerjaan dengan cakupan sempit yang "mungkin akan memakan biaya mahal dengan versi Claude sebelumnya."

Haiku Pertama Dengan Panggilan Upaya

Haiku 5.5 juga merupakan model kelas Haiku pertama yang dikirimkan dengan pengaturan upaya yang dapat disesuaikan, kontrol biaya versus kecerdasan yang sebelumnya ditawarkan Anthropic pada model yang lebih besar. Pengguna dapat memilih berapa banyak komputasi yang digunakan setiap permintaan, dan bagan Anthropic menunjukkan skor tolok ukur pada setiap tingkat upaya dari Rendah hingga Maks.

Postur Keamanan: Lebih Ketat Dari Haiku 4.5, Lebih Longgar Dari Soneta

Mengenai keselamatan, Anthropic mengatakan Haiku 5.5 menunjukkan "peningkatan besar di hampir semua evaluasi penyelarasan kami dibandingkan dengan Haiku 4.5," dengan jauh lebih sedikit contoh perilaku tidak selaras dan kemauan yang lebih rendah untuk bekerja sama jika terjadi penyalahgunaan.

Perlindungan keamanan siber model ini lebih ketat dibandingkan Haiku 4.5, meskipun tidak seketat model Anthropic yang lebih besar baru-baru ini. Mereka mengizinkan tugas keamanan defensif yang lebih luas daripada perlindungan Sonnet 5.5 tetapi masih memblokir pengujian penetrasi dan teknik yang lebih mungkin digunakan oleh penyerang. Perlindungan biologi sesuai dengan Sonnet 5, Sonnet 5.5, dan Opus 5. Organisasi yang membutuhkan akses lebih luas dapat mengajukan permohonan ke Program Verifikasi Siber atau Ilmu Hayati Anthropic. Detail selengkapnya ada di kartu sistem Haiku 5.5.

Pengumuman Selebihnya: Soneta Lebih Murah, Kredit API Gratis

Peluncuran tersebut dikemas dengan beberapa perubahan lainnya. Pembacaan cache di Claude Sonnet 5.5 sekarang berharga $0,10 per juta token, bukan $0,20 — pemotongan sebesar 50% yang menurut Anthropic menjadikan Sonnet 5.5 sekitar 20% lebih murah di sebagian besar pekerjaan agen, karena pembacaan cache mendominasi konsumsi token dalam alur kerja agen.

Anthropic juga meluncurkan kredit API bulanan minggu ini untuk pelanggan berlangganan: $100 per bulan untuk maksimal 5x pengguna, $200 untuk maksimal 20x pengguna, dan hingga $500 dikumpulkan di seluruh pengguna untuk paket Tim, dapat digunakan pada model apa pun. Kredit ditujukan untuk pelanggan yang membuat alat dan agen di Platform Claude.

Pengembang juga mendapatkan pembaruan SDK: SDK Python dan TypeScript Anthropic sekarang mendukung penggunaan komputer dan penggunaan browser dalam versi beta, kemampuan yang menurut perusahaan sesuai dengan profil kecepatan-harga Haiku 5.5.

Perang Harga Tanpa Akhir yang Terlihat

Cakupan Decoder membingkai peluncuran tersebut sebagai bukti bahwa "perlombaan harga senjata AI masih jauh dari selesai," dan angka-angka mendukung hal tersebut. Pada bulan September, Anthropic dan OpenAI meluncurkan model andalan yang bersaing dalam waktu beberapa jam satu sama lain, lengkap dengan potongan harga yang bersaing. Haiku 5.5 memperluas persaingan tersebut ke pasar kelas bawah, di mana model kecil mendukung beban kerja dengan volume tertinggi dan paling sensitif terhadap harga.

Bagi pengembang, dampak langsungnya sangatlah mudah: inferensi model kecil pada platform Claude kini dimulai dari $0,10 per juta token masukan dan $0,50 per juta token keluaran, dengan GPT-6 Luna mengalahkan sebagian besar tolok ukur Anthropic yang diterbitkan pada titik harga tersebut. Apakah OpenAI merespons dengan pemotongan harga Luna — atau menunggu rilis model kecil berikutnya — akan menandakan seberapa tahan lama harga dasar ini sebenarnya.

Haiku 5.5 kini tersedia di aplikasi dan API pihak pertama Anthropic, Amazon Web Services, Google Cloud, dan Microsoft Foundry, dan sudah terintegrasi ke dalam GitHub Copilot.

Tetap Terdepan dalam AI Baca berita AI selengkapnya di AI Buzz Wire