Alibaba'nın Qwen araştırma laboratuvarı, Apache 2.0 lisanslı, makul özelliklere sahip bir dizüstü bilgisayarda çalışan, vizyon özellikli büyük dil modeli olan Qwen 3.8 27B'yi Cuma günü piyasaya sürdü - ve laboratuvarın kendi kriterlerine göre, yalnızca önceki modelden değil, aynı zamanda Mayıs ayı gibi yakın bir tarihte Qwen'in en güçlüleri arasında yer alan kapalı ağırlık modelinden daha iyi performans gösteriyor.
Sürüm, geliştirici çevrelerinde ayın en çok tartışılan model lansmanlarından biri haline geldi. Önde gelen bağımsız yapay zeka araştırmacısı ve blog yazarı Simon Willison tarafından Pazar günü yayınlanan uygulamalı inceleme, Hacker News'in ön sayfasına yüzlerce olumlu oy alarak ulaştı ve okuyucular modelin yeteneklerini ve olağandışı varsayılan yapılandırmasını tartıştı. For more context on this story, see our ongoing AI trends.
Qwen 3.8 27B'deki Yenilikler
Model, Alibaba'nın açık ağırlık serisinin en sonuncusu olup, çok daha büyük olan Qwen 3.8 2.4T-A95B uzman karışımı sürümünden haftalar sonra geliyor. Qwen'in kendi bildirdiği kıyaslamalara göre 27B modeli, hem Qwen 3.6 27B'ye hem de kapalı ağırlık Qwen 3.7-Plus'a göre kazançlar gösteriyor; bu model, ismine rağmen Qwen'in bu yılın başlarında her boyuttaki en güçlü performans gösterenlerinden biri oldu.
Model, maksimum 262.144 jetonluk bağlam uzunluğunu destekler, vizyon girişlerini yönetir ve muhakeme derinliğini üç düzeyde ayarlayan bir "reasoning_effort" parametresi için resmi destekle birlikte gelir: "xhigh", "medium" ve "low".
Sürümün konuşma noktası haline gelen şey, fabrika varsayılanı olan "xhigh" olan ilk ayardır.
Aşırı Düşünme Sorunu
Modeli 128 GB MacBook Pro ve NVIDIA DGX Spark üzerinde LM Studio'nun 17 GB Q4_K_M nicemlenmiş yapısını kullanarak test eden Willison, varsayılan durumu "olağanüstü aşırı düşünme" üretmek olarak tanımladı.
Çarpıcı bir örnekte modelden bisiklete binen bir pelikanın SVG'sini çizmesini istedi. Varsayılan "xhigh" muhakeme çabasıyla model, 3.223 jeton çıktı üretmek için 22.276 muhakeme jetonu harcadı; bu, donanımında 21 dakika sürdü. Sonucun, yerel olarak çalışan, doğru bisiklet geometrisine sahip, çerçevenin her iki yanında bacaklar ve zevkli resimli bir arka plan bulunan bir modelle üretebildiği "açık ara en iyi pelikan SVG" olduğunu belirtti.
Denge açıktır: 21 dakika çoğu görev için pratik olmayan bir beklemedir. Aynı istemin akıl yürütme devre dışı bırakılarak yeniden çalıştırılması, benzer çıktı uzunluğunda 137 saniyede (zamanın onda birinden az) bir yanıt üretti.
Önemsiz derecede basit istemler bile davranışı tetikler. Modelin "bir dairenin svg'sini çizmesi" istendiğinde, palet seçeneklerinin, Bauhaus stilinin, katmanlı halkaların ve animasyon yaklaşımlarının tartılmasıyla akıl yürütme yolu açıldı; tek bir XML etiketi gerektiren bir şekil için birkaç dakikalık düşünme.
Willison'un kararı: Model mükemmel, ancak varsayılan konfigürasyon "modeli, özellikle de tüketici donanımında çalıştırmanın kesinlikle iyi bir yolu değil." Kullanıcılar "orta" veya "düşük" muhakeme çabasına geçebilir veya genişletilmiş düşünmeyi tamamen devre dışı bırakabilir.
Yerel Yapay Zekanın İvmesi
Sürüm, sınır bulut modelleri ile yerel olarak çalıştırılabilir açık modeller arasındaki yetenek farkının ne kadar hızlı daraldığının altını çiziyor. Dizüstü bilgisayarda çalışan 17 GB'lık bir dosya, artık belirli yaratıcı görevlerde, kısa süre önce gerekli olan veri merkezi ölçeğindeki modellerle rekabet edebilecek sonuçlar üretiyor.
Aynı zamanda Çin laboratuvarlarının 2026'yı belirleyen açık ağırlık momentumunu da sürdürüyor. Alibaba'nın Qwen ailesi, geliştiricilerin fikir paylaşımı için Meta, DeepSeek ve Moonshot AI sürümleriyle rekabet ederek bu yıl dünya çapında en çok indirilen model serileri arasında yer aldı. Qwen 3.8 27B için bağımsız kıyaslama sonuçları hala birikiyor ve Willison, laboratuvarın kendi bildirdiği rakamların üçüncü taraf doğrulamasını beklediği konusunda açıkça uyardı.
Kullanıcılar için Pratik Rehberlik
Modeli düşünen geliştiriciler ve meraklılar için, erken testlerde ortaya çıkan fikir birliği oldukça basit: Qwen 3.8 27B, vizyon veya uzun belgeler içeren yerel yapay zeka iş yükleri için güçlü bir varsayılan seçimdir ancak akıl yürütme çabası göreve göre ayarlanmalıdır. Karmaşık analiz 'xhigh'i haklı gösterebilir; günlük sorular ve hızlı taslaklar "orta" veya daha düşük seviyelerde daha hızlı ve daha ucuzdur.
Modeli LM Studio gibi araçlarla çalıştıran kullanıcılar aynı zamanda varsayılan bağlam penceresini 8.192 jetondan yükseltmelidir. Willison, modelin genişletilmiş düşünme biçiminin, modeli 262.144 jetonluk bağlamın tamamını yüklemeden önce sıradan sorunlarda bile bu bütçeyi tükettiğini buldu.
Daha büyük soru, sürümün açık model yarışının bir sonraki aşamasına ilişkin sinyallerinin ne olduğudur: Akıl yürütme tarzı modeller norm haline geldikçe, yapılandırma varsayılanları gerçek kullanılabilirlik sonuçlarıyla birlikte ürün kararlarına dönüşüyor - ve Qwen'in "xhigh" varsayılanı zaten en çok tartışılan örnektir.
Açık Ağırlıklar İçin Bir Dönüm Noktası
Bu sürüm aynı zamanda açık ağırlıklı laboratuvarların artık küçük ölçekte neler sunabileceği konusunda da bir dönüm noktasına işaret ediyor. Tüketici dizüstü bilgisayarına sığacak bir pakette görme yeteneği, 262.144 jetonlu bağlam penceresi ve rekabetçi akıl yürütme performansı, iki yıl önce Apache-2.0 lisanslı bir modelde düşünülemezdi. Veri gizliliği, gecikme veya çevrimdışı çalışmanın bulut API'lerini devre dışı bıraktığı durumlarda, yerel öncelikli uygulamalar geliştiren geliştiriciler için pratik seçenekler hızla gelişmeye devam ediyor.
Willison'un testi aynı zamanda ekosistem için bir olgunluk noktasını da vurguluyor: LM Studio'nun tek tıklamayla GGUF indirmelerinden yapılandırılabilir muhakeme parametrelerine kadar yerel modeller etrafındaki araçlar, bir modelin düşünme derinliğini ayarlamanın artık bir araştırma egzersizi olmaktan ziyade rutin bir kullanıcı kararı olmasını sağlayacak kadar ilerlemiştir. Önümüzdeki günlerde bağımsız kıyaslamalar biriktikçe, Qwen 3.8 27B'nin açık ve kapalı rakiplerine karşı tam olarak nerede olduğuna dair resim netleşecek; ancak erken kabul, Alibaba'yı dünyadaki en önemli açık model yayıncılarından biri haline getiren çizgide başka bir güçlü giriş olduğunu gösteriyor.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →