Google Salı günü, yazılım mühendisliği, kurumsal bilgi görevleri ve siber güvenlik savunması alanlarında uzun vadeli profesyonel çalışmalar için tasarlanan en yeni öncü modeli olan Gemini 4 Argon'u duyurdu. Resmi Google blogunda yazan Google DeepMind Kıdemli Başkan Yardımcısı ve Yapay Zeka Baş Mimarı Koray Kavukcuoğlu, modelin başlangıçta Google'ın Fairwind Programı aracılığıyla bir dizi güvenilir siber savunucuya sunulacağını ve korkuluklar güçlendirildiğinde daha geniş erişime sahip olacağını söyledi.
Duyuru, sınır yapay zeka sürümleri için yılın en yoğun zamanlarından birinde gerçekleşti. AI Buzz Wire, model lansmanlarının, politika mücadelelerinin ve finansman turlarının sürekli olarak yayınlanması için önemli olan gelişmeleri gerçekleştikleri anda takip ediyor.
Dikkatle şekillendirilen aşamalı bir dağıtım
Tipik bir ana model lansmanından farklı olarak çoğu kullanıcı bugün Argon'u deneyemez. Google, ABD hükümetinin yayın öncesi model erişimine yönelik gönüllü sürecine dahil olduğunu ve ilk test uzmanlarından gelen geri bildirimlerin korkulukları şekillendirmesi nedeniyle kullanılabilirliği kademeli olarak genişleteceğini söyledi. Reuters, amiral gemisinin aylarca süren gecikmelerden sonra geldiğini bildirdi ve VentureBeat, sınırlı sürüm stratejisinin Google'ın OpenAI ve Anthropic karşısında yeniden bir kıyaslama liderliği talep etmesine hala izin verdiğini belirtti. Bloomberg, lansman öncesinde Google'ın kendi çalışanları arasında yeni model hakkında ölçülebilir şüpheler olduğunu bildirdi.
Daha geniş erişim geldiğinde Google, bunun ücretli API müşterileri ve Google AI Ultra aboneleriyle başlayacağını söyledi.
Google, Argon'un neler yapabileceğini söylüyor
Başlıca yetenek değişikliği dayanıklılıktır. Argon'un çıkış token limiti, önceki 64K'dan sektör lideri 1 milyon token'a çıkarıldı. Google, bir modele tek bir yörüngede yüzbinlerce jeton arasında mantık yürütme olanağı vermenin, işi oturumlar arasında bölmek yerine zor sorunları tek geçişte çözmesine olanak sağladığını savunuyor.
Google, sınır iddiasını desteklemek için karşılaştırma sonuçlarını yayınladı:
- DeepSWE v1.1: %77,9 — gerçek dünyadaki yazılım mühendisliği kriterlerinde yeni bir teknoloji örneği
- Vals Endeksi: 1 numara — ABD GSYİH'sine katkıya göre ağırlıklandırılan finans, kodlama, hukuk ve vergi işlerinde lider performans
- AutomationBench: %51,3 — Zapier'in uçtan uca iş yürütme kıyaslamasında birincilik
- LVBench: %91,7 — uzun video anlamada son teknoloji
- CWE-bench v1: %68 — güvenlik açığının giderilmesinde birincilik elde etti
Google'ın kendi iş akışlarının içinde
Argon zaten Google'ın dahili çalışmalarına güç veriyor ve şirket alışılmadık derecede somut örnekler sundu. Kuantum hesaplamada model, darboğaz altprogramları için uzay-zaman kaynaklarını optimize etti ve yayınlanmış bir temel çizgiyi dakikalar içinde %40 oranında aştı. Argon temsilcilerinden oluşan ekipler, filo genelindeki profil oluşturma telemetrisini analiz ederek, Google'ın veri merkezlerinde kullanıma sunulduğunda 300 TiB'den fazla serbest bırakan ve tahmini olarak toplam 500 TiB ile 1 PiB arasında tasarruf sağlayan bellek optimizasyonlarını belirledi ve uyguladı.
Model aynı zamanda C/C++'dan Rust'a büyük ölçekli kod geçişlerini de destekliyor; re2 ve libgav1 gibi çekirdek kitaplıklardaki onbinlerce satırdan Fuchsia Zircon çekirdeğindeki 800.000'den fazla satıra kadar ölçekleniyor. Google'ın açık kaynaklı video kod çözücüsü libgav1 için Argon aracıları, 32.000 satırlık SIMD kodunu derleyici dostu güvenli Rust ile değiştirerek, aynı çıktıyla önceki Rust bağlantı noktasından 2,7 kat daha hızlı çalışan, bellek açısından güvenli bir kod çözücü üretti.
Siber güvenlik savunması önce gelir
Argon, savunma amaçlı siber çalışmalar için özel olarak eğitilmişti: kritik yazılım açıklarını bağımsız olarak bulmak, doğrulamak ve yamalamak. Güvenilir savunucular ve Google'ın dahili ekipleri için şirket, modeli siber korkuluklar olmadan yayınlayacak ve böylece savunmacılar tam kapasiteye sahip olacak. Güvenlik açığı iyileştirmesini ölçen CWE-bench v1'de Argon, 3.8 Flash Cyber'ın sınır performansını temel alarak %68 ile ilk sırada yer alıyor ve Google, Argon'un Wiz'in dahili kara kutu sızma testi kıyaslamasında saldırı yüzeyi keşfi ve kavram kanıtı oluşturma konusunda bu modelden daha iyi performans gösterdiğini söylüyor.
Güvenlik firması Wiz, kritik kamu altyapısını ücretsiz koruyan Scan for Good girişimi aracılığıyla Argon'u zaten kullanıyor. Google, erken bir tanıtımda, modelin dünya çapındaki hastaneler tarafından kullanılan sağlık yazılımı genelinde hassas kişisel bilgileri açığa çıkaran kritik bir güvenlik açığını ortaya çıkardığını söyledi; bu, önceki öncü modellerin gözden kaçırdığı bir riskti.
Dört katmanlı sınır koruması
Geniş kullanıma sunulmadan önce Google, dört alanda korumaları güçlendiriyor. Kötüye kullanıma karşı Argon, kötüye kullanımı tespit etmek için modelin dahili aktivasyonlarını izleyen yeni tekniklerle meşru çift kullanımlı araştırmayı korurken siber ve KBRN saldırı isteklerini reddedecek şekilde tasarlanmıştır. Anında enjeksiyona karşı çekişmeli eğitim, Argon Google'ın şimdiye kadarki en dayanıklı modeli haline geldi ve Gray Swan'ın Dolaylı İstemi Enjeksiyon kıyaslamasında lider oldu.
Yanlış hizalama için Google, Argon'un düşünce ve eylem zincirini izleyen, gerektiğinde yürütmeyi durduran ve uyarıların özel bir olay müdahale ekibine yönlendirildiği azaltıcı önlemler uyguluyor. Şirket aynı zamanda korumalı alan eğitim ve değerlendirme ortamlarını da güçlendirerek yüksek riskli çalıştırmalardan önce bunları mühürledi. Özellikle Google, sektörün geri kalanını muhakeme şeffaflığını korumaya teşvik etti, böylece model düşünceler yanlış hizalamanın teşhisinde yararlı olmaya devam edecek.
Fiyatlandırma ve stok durumu
Argon, bir milyon giriş tokenı başına 2 ABD doları ve bir milyon çıkış tokenı başına 10 dolarlık bir tanıtım fiyatıyla piyasaya sürülecek ve önbelleğe alınmış giriş tokenları, giriş fiyatından %95 indirimli olacak. Giriş döneminin ardından fiyatlandırma, milyon girdi tokenı başına 4 dolara ve milyon çıktı tokenı başına 20 dolara yükseliyor; bu da Argon'u rakip sınır tekliflerine karşı agresif bir şekilde konumlandırıyor.
Sahnelenen ilk sahne, sınır ötesi sürümler için yeni bir gerçekliği yansıtıyor: Yetenek artık masada ve farklılaştırıcı kontrol gösteriyor. Google, siber savunucuların, hastane yazılımlarının ve Rust geçişlerinin doğru vitrin olduğunu ve daha yavaş bir genel kullanıma sunma işleminin başka bir güvenlik olayından daha az maliyetli olduğunu düşünüyor. Geliştiriciler ve işletmeler, Google'ın korkuluk testleri izin verir vermez açılacağını söylediği ücretli API ve AI Ultra erişim penceresini takip etmelidir.
---
Yapay Zekanın Önünde OlunEn son yapay zeka haberlerini, analizlerini ve buluşlarını tek bir yerden alın.
Daha fazla AI haberini okuyun →