Anthropic, şirketin üst düzey Fable 5 modelinin kabaca yarı fiyatına sınıra yakın istihbarat sağladığını söylediği yeni bir yapay zeka modeli olan Claude Opus 5'i tanıttı. 24 Temmuz 2026'da piyasaya sürülen Opus 5, artık Claude Max'in varsayılan modeli ve Claude Pro'da mevcut olan en güçlü model olup, Anthropic'in kodlama, otonom aracılar ve profesyonel bilgi çalışmaları için günlük iş gücü olarak konumlanıyor.

Lansman, işletmelerin yapay zeka harcamalarını inceledikleri bir zamanda gerçekleşiyor. CNBC'ye göre yeni model "Fable 5'e rakip oluyor ve işletmeler maliyetler konusunda endişelendiğinden daha ucuz", Bloomberg ise bunu "günlük işler için daha uygun maliyetli bir model" olarak nitelendiriyor. En son Yapay Zeka gelişmelerini takip eden ekipler için Opus 5, bir sonraki rekabetçi savaş alanının ham kıyaslama üstünlüğü değil, değer olduğuna dair bilinçli bir iddiayı temsil ediyor.

Karşılaştırmalı Performans: Kodlama ve Bilgi Çalışmasında Yeni Son Teknoloji

Anthropic, Opus 5'in Frontier-Bench ve GDPval-AA dahil olmak üzere kodlama ve bilgi çalışması değerlendirmelerine ilişkin son teknoloji sonuçları yayınladığını bildirdi. Frontier-Bench v0.1'de şirket, Opus 5'in diğer tüm modelleri geride bıraktığını ve görev başına daha düşük maliyetle selefi Opus 4.8'in performansını iki katından fazla artırdığını söylüyor.

CursorBench 3.2'de Opus 5, Anthropic'in kendi kriterlerine göre Fable 5'in en yüksek puanının %0,5'i kadar yakınken görev başına maliyetinin yarısı kadardır. Decrypt, modelin "çoğu kıyaslamada Fable 5'i yarı fiyatına geride bıraktığını" belirtti.

Kazanımlar, etkin ve problem çözme değerlendirmelerine kadar uzanır:

  • ARC-AGI 3: Opus 5, bu yeni problem çözme testinde bir sonraki en iyi modelden kabaca üç kat daha yüksek puan alıyor.
  • Zapier AutomationBench: Aynı maliyetle bir sonraki en iyi modelin yaklaşık 1,5 katı geçiş oranı, uçtan uca iş görevinin tamamlandığını ölçer.
  • OSWorld 2.0 (bilgisayar kullanımı): Opus 5, maliyetinin üçte birinden biraz fazla bir maliyetle Fable 5'in en iyi sonucunu geride bırakıyor.

Anthropic, Opus 5'in "siber güvenlik görevlerinde Mythos 5'in gerisinde kaldığını", yani rakip bir sınır modelinin liderliğini koruduğu bir alan olduğunu kabul ediyor.

Daha Güçlü Ajans ve Kendi Kendini Doğrulama

Duyuruda yinelenen bir tema, Opus 5'in kendi çalışmasını doğrulama ve başarılı olana kadar yineleme konusundaki gelişmiş yeteneğidir. Anthropic, erken erişim testlerinden bu özerkliği vurgulayan birkaç örnek açıkladı.

Frontier-Bench görevlerinden birinde, modele bir makine parçasının çizimi verildi ve onu 3D FreeCAD modeli olarak yeniden yapılandırmak için kod yazması istendi; ancak kasıtlı olarak çizimi doğrudan görüntülemesine hiçbir yol verilmedi. Opus 5'in, ham piksellerden geometriyi çıkarmak için kendi bilgisayarlı görüntü hattını yazdığı, ardından tüm parçayı yeniden oluşturduğu ve hiçbir rakip modelin beş denemeden sonra görevi çözemediği yerlerde defalarca başarılı olduğu bildirildi.

Popüler bir açık kaynaklı paket yöneticisindeki gerçek bir hata göz önüne alındığında, Opus 5 temel nedeni buldu ve topluluğun kendi yamasının gözden kaçırdığı bir uç durumu düzeltti; rakip bir model ise yalnızca yüzeydeki semptomu düzeltti ve hatanın çözüldüğünü bildirdi. Bir ticaret firmasındaki bir mühendisin, tek bir oturumda yeni bir borsa için piyasa veri akışı oluşturmak için Opus 5'i kullandığı (önceki modellerin hiçbir şekilde tamamlayamadığı bir görev) ve doğrulanacak canlı bir akış bulamayan modelin kendi test donanımını oluşturduğu bildirildi.

Müşteri Resepsiyonu

Erken erişim ortakları büyük ölçüde olumlu değerlendirmeler sundu. Cognition CEO'su (Devin kodlama aracısının yapımcısı) Scott Wu, Opus 5'in "maliyetin yarısı kadar Fable düzeyinde performansa yaklaştığını" ve "zor hata ayıklama ve kök neden analizi görevlerinde özellikle güç gösterdiğini" söyledi. Cursor'un kurucu ortağı Sualeh Asif, modelin "Opus hızında ve maliyetinde Fable 5'e yakın zeka" sunduğunu söyledi.

Zapier CEO'su Wade Foster, Opus 5'in "önceki Claude modellerine göre daha fazla token harcamadan Zapier'in AutomationBench liderlik sıralamasında zirveye çıktığını" ve risk altındaki hesapları işaretleyerek, doğru sahibi uyararak ve elde tutma ekipleri için özetleme yaparak uçtan uca tam bir kayıp önleme iş akışını tamamladığını bildirdi. Önceki modeller geçemedi; Opus 5 %100'e ulaştı.

Bilimsel Araştırmada Kazanımlar

Anthropic ayrıca Opus 5'in bilimsel çalışmalara yönelik iyileştirmelerine de dikkat çekti. Model, Anthropic'in yapısal biyoloji, organik kimya ve biyoinformatiği kapsayan yaşam bilimleri değerlendirmelerinin her birinde Opus 4.8'den daha iyi performans gösteriyor. Şirket, dahili organik kimya kıyaslamasında (spektroskopi verilerinden moleküler yapılar çıkarımı) yüzde 10,2 puanlık bir iyileşmeye ve protein fonksiyonu tahmin görevlerinde 7,7 puanlık bir kazanıma dikkat çekti. Bir genom bilimi müşterisi, modelin "daha dikkatli bir bilim insanı gibi" davrandığını, doğru istatistiksel testlere ulaştığını ve kendi sonuçlarını çapraz kontrol ettiğini belirtti.

Fiyatlandırma Stratejisi

Anthropic, Fable 5'in zekasına yaklaşırken Opus 5'i Opus 4.8 ile aynı seviyede fiyatlandırarak, orta seviye ve amiral gemisi teklifleri arasındaki boşluğu etkili bir şekilde daraltıyor. VentureBeat, sürümü "kodlama, aracılar ve kurumsal iş akışları için daha ucuz bir yapay zeka modeli" olarak çerçeveledi ve Seeking Alpha, Opus 5'in "sınır modeli Fable 5'e daha yakın ve daha ucuz" olduğunu gözlemledi. Şirket, müşterilerin hız ve daha düşük token maliyetleri için bilgi alışverişinde bulunmalarına ve görev başına maliyet-performans oranına ince ayar yapmalarına olanak tanıyan ayarlanabilir bir "çaba" ayarı sunuyor.

Yapay Zeka Yarışı İçin Ne İfade Ediyor?

Opus 5, sınıra yakın yapay zekanın maliyetinin ne kadar hızlı düştüğünün altını çiziyor. Mevcut en yetenekli sistemlere çarpıcı bir mesafede (token fiyatının yarısı kadar) gelen bir model, rakipleri marjinal kazançlar için premium fiyatlandırmayı haklı çıkarmaya zorluyor. Anthropic, OpenAI, Google ve diğerleri, yetenekli modelleri günlük, büyük ölçekli dağıtım için yeterince uygun maliyetli hale getirmek için yarışırken, işletmelerin sorusu "hangi model en akıllı?" sorusundan farklılaşıyor. "Hangi model dolar başına en fazla zekayı sağlıyor?"

Anthropic'e göre mesaj açık: Üst düzey akıl yürütme artık lüks bir ürün değil. Opus 5, sınıra komşu yeteneği, sürdürülebilir, günlük dağıtımı gerçekçi kılan bir fiyat noktasına getiriyor ve bu, tüm ayrıntılar arasında en önemli ayrıntı olabilir.

Yapay Zekanın Önünde Olun

Claude Opus 5, bugünden itibaren Claude Pro, Claude Max ve Anthropic'in API'si aracılığıyla edinilebilir. Bu hikaye ve daha geniş yapay zeka ortamı hakkında daha fazla bilgi edinmek için son dakika yapay zeka haberlerini takip edin.

Daha fazla AI haberini okuyun →