Çin yapay zeka laboratuvarı MiniMax, son sürümüne alışılmadık bir yaklaşım benimsedi: bunu zar zor kabul etti. 27 Eylül'de şirketin resmi hesabı, geliştiricilerin üründe zaten tespit ettiği şeyi doğruladı: M3.1-Flash-Preview adlı yeni bir model, şirketin kodlama asistanı MiniMax Code'un içinde kullanıma sunuldu. Lansmanın kapsamı bu kadardı: model kartı yok, kıyaslama tablosu yok, milyon token başına fiyat yok.
Startup Fortune'a göre X'teki Çinli yapay zeka gözlemcileri, onay öncesinde modelin üründe göründüğünü fark etmişti. Sessiz dağıtım, MiniMax'ın son amiral gemisini gönderme şekliyle çarpıcı bir tezat oluşturuyor. For more context on this story, see our ongoing AI industry coverage.
Kasıtlı Olarak Sessiz Bir Başlangıç
MiniMax Haziran ayında M3'ü piyasaya sürdüğünde şirket, mimari ayrıntılarını, SWE karşılaştırmalı puanlarını ve rakiplerinin %90'ını düşüren bir fiyat tablosu yayınladı. Bu kez, M3.1-Flash-Preview için API uç noktası kapalıdır ve modeli denemenin tek yolu, ana gözlemlenebilir sinyaller olarak akıl yürütme izleri ve davranışlarla birlikte MiniMax'ın kendi ürününün içindedir.
Düşük anahtar stratejisi, MiniMax'in piyasaya sürülmeyi bir manşet lansmanı gibi değil, daha çok bir deney gibi ele alabileceğini gösteriyor: Bir ürün özelliğini A/B testi ve internetin öğrenmesine izin vermek. Bu, geliştiriciler onu kullandığında modelin kendi adına konuşacağına olan güveni yansıtıyor olabilir - ya da sadece bu sürümün büyük bir sürüm değil, daha hızlı, daha ucuz bir yardımcı katman olduğuna dair güveni yansıtıyor olabilir.
Base M3 Bize Ne Anlatıyor?
Temel M3 modeli, MiniMax'ın ilgi istediğinde neler sunabileceğine dair bir fikir veriyor. Bu, token başına yaklaşık 23 milyar aktif parametreye, bir milyon token bağlam penceresine ve yerel görüntü ve video girişine sahip 428 milyar parametreli uzmanlardan oluşan bir modeldir. SWE-bench Verified'da MiniMax %80,5'lik bir puan bildirdi.
Flash, serinin günlük kodlamada hız ve fiyat avantajını artırmak için oluşturulmuş versiyonudur; hızlı hata düzeltmeleri ve küçük özellikli çalışmalar, amiral gemisi için ayrılan uzun vadeli ajans görevleri yerine, geliştiriciler günde onlarca kez çalıştırılır. Bir model serisini geniş bir sınır sürümü ve hızlı, ucuz bir yardımcıyla bu şekilde bölmek, geliştiricilerin fikir paylaşımı için yarışan Çin laboratuvarları arasında standart oyun kitabı haline geldi.
Kalabalık Bir Alana Gönderim
MiniMax sakin bir pazara sunulmuyor. Alibaba, 3 Ağustos'ta Qwen3.8-Max'i (milyon girdi tokenı başına 2 dolar fiyatla satılan 2,4 trilyon parametreli amiral gemisi) piyasaya sürdü ve ardından 12 Ağustos'ta Max katmanlı Qwen modelinin ilk açık ağırlık versiyonunu çıkardı. Zhipu'nun GLM-5.3'ü, kendine ait bir milyon jetonluk bağlam penceresiyle 14 Ağustos'ta indi.
Geliştiriciler, yetenekli ve ucuz seçeneklerin çokluğunu fark ettiler. CNBC'nin OpenRouter verilerine ilişkin raporuna göre, Çin modelleri, 14 Eylül'ü de içeren hafta boyunca platformdaki toplam token kullanımının %57 ila %67'sini oluşturdu; Şubat ayında bu oran sadece %6'dan %13'e çıktı. Vercel de benzer bir sıçrama gördü ve Çin modellerinin platformundaki kullanım payı Ağustos ayında %55'e yükseldi.
Washington İzliyor
Bu artış geliştirici toplulukların çok ötesinde dikkat çekti. Yeni Amerikan Güvenliği Merkezi'nin teknoloji ve ulusal güvenlik programında kıdemli bir uzman olan Daniel Remler, CNBC'ye Çin yapay zekasının "ABD için gerçek ekonomik ve güvenlik risklerini" temsil ettiğini söyleyerek Çin modellerinin kritik iş akışlarına entegre edilmesine karşı uyarıda bulundu.
Bu inceleme, MiniMax'in sessiz sürümüne bir karmaşıklık katmanı daha ekliyor. Model kartı, yayınlanmış değerlendirmeler veya fiyatlandırma olmadan gelen bir model, laboratuvarın ürünleri Amerikalı rakiplerine karşı gerçek kullanım payı kazansa bile, kalite ve güvenliği değerlendirirken bağımsız geliştiricilere daha az çalışma olanağı sağlar.
Sessiz Lansman Neden Stratejik Olabilir?
Bir şirketin kendi ürünü içinde yer alan önizleme modelleri tanıdık bir modeldir: daha geniş bir API sürümünden önce kullanım verileri ve geri bildirim üretirler, aynı zamanda modelin düşük performans göstermesi durumunda maruz kalmayı sınırlarlar. MiniMax için, M3.1-Flash-Preview'in sessiz çıkışı, daha büyük bir lansman için dikkatleri çekmenin bir yolu da olabilir - Startup Fortune tarafından alıntılanan rapora göre şirket, yeni bir amiral gemisi modeli hazırlarken satışları iki kattan fazla artırdı.
Geliştiriciler için pratik çıkarım basit: Çin'in önde gelen laboratuvarlarından birinden yeni bir hızlı kodlama katmanı şu anda MiniMax Code'da yayında ve normalde böyle bir sürümü çerçeveleyecek kıyaslamalar ve fiyatlandırma hala eksik. M3.1-Flash-Preview'ın Çin modellerini OpenRouter trafiğinin çoğunluğuna taşıyan ivmeyi genişletip genişletemeyeceği, geliştiriciler gerçek iş yüklerini bunun üzerinden geçirmeye başladığında nasıl performans göstereceğine bağlı olacaktır.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →