Laboratorium badawcze Qwen firmy Alibaba wypuściło w piątek Qwen 3.8 27B, wielojęzyczny model obsługujący technologię Apache 2.0, który działa na laptopie o rozsądnej specyfikacji i według własnych testów laboratoryjnych przewyższa nie tylko swojego poprzednika, ale także model o zamkniętej masie, który jeszcze w maju należał do najsilniejszych produktów Qwen.

Ta premiera stała się jedną z najczęściej omawianych premier miesiąca w kręgach programistów. Praktyczna recenzja opublikowana w niedzielę przez Simona Willisona, wybitnego niezależnego badacza i blogera AI, trafiła na pierwszą stronę Hacker News z setkami głosów pozytywnych, a czytelnicy debatowali nad możliwościami modelu i jego niezwykłą domyślną konfiguracją. Więcej kontekstu na ten temat znajdziesz w naszych wiadomości AI.

Co nowego w Qwen 3.8 27B

Model ten jest najnowszym modelem z linii ciężarków otwartych Alibaba, pojawiającym się kilka tygodni po znacznie większym wydaniu Qwen 3.8 2.4T-A95B, przygotowanym przez mieszankę ekspertów. Według testów porównawczych Qwen, które sama zgłaszała, model 27B wykazuje przewagę zarówno w porównaniu z Qwen 3.6 27B, jak i Qwen 3.7-Plus o masie zamkniętej — model, który pomimo swojej nazwy był jednym z najlepszych wyników Qwen niezależnie od wielkości na początku tego roku.

Model obsługuje maksymalną długość kontekstu wynoszącą 262 144 tokenów, obsługuje dane wejściowe wizyjne i jest dostarczany z oficjalną obsługą parametru „reasoning_effort”, który dostosowuje głębokość rozumowania na trzech poziomach: „xwysoki”, „średni” i „niski”.

To właśnie to pierwsze ustawienie — „xhigh”, domyślne ustawienie fabryczne — stało się głównym tematem wydania.

Problem nadmiernego myślenia

Willison, który testował ten model na MacBooku Pro 128 GB i procesorze NVIDIA DGX Spark przy użyciu skwantowanej wersji LM Studio Q4_K_M o pojemności 17 GB, opisał ustawienie domyślne jako powodujące „spektakularne przesadne myślenie”.

W jednym uderzającym przykładzie poprosił modelkę o narysowanie obrazu SVG przedstawiającego pelikana jadącego na rowerze. Przy domyślnym wysiłku wnioskowania „xhigh” model wydał 22 276 tokenów wnioskowania, aby wygenerować 3223 tokeny wyników, co na jego sprzęcie zajęło 21 minut. Zauważył, że w rezultacie powstał „zdecydowanie najlepszy pelikan SVG”, jaki udało mu się wygenerować na podstawie modelu poruszającego się lokalnie, z prawidłową geometrią roweru, nogami po obu stronach ramy i gustownie ilustrowanym tłem.

Kompromis jest oczywisty: 21 minut to niepraktyczny czas oczekiwania w przypadku większości zadań. Ponowne uruchomienie tego samego monitu z wyłączonym rozumowaniem dało odpowiedź w ciągu 137 sekund — w czasie krótszym niż jedna dziesiąta czasu — przy podobnej długości wyjściowej.

Nawet banalnie proste podpowiedzi wyzwalają określone zachowanie. Model poproszony o „narysowanie svg koła” rozpoczął proces rozumowania poprzez zważenie opcji palety, styl Bauhaus, warstwowe pierścienie i metody animacji — kilka minut namysłu nad kształtem wymagającym pojedynczego znacznika XML.

Werdykt Willisona: model jest doskonały, ale domyślna konfiguracja „absolutnie nie jest dobrym sposobem na uruchomienie modelu, szczególnie na sprzęcie konsumenckim”. Użytkownicy mogą przełączyć się na „średni” lub „niski” wysiłek rozumowania lub całkowicie wyłączyć myślenie rozszerzone.

Impet lokalnej sztucznej inteligencji

To wydanie podkreśla, jak szybko zmniejszyła się luka w możliwościach pomiędzy frontowymi modelami chmurowymi a lokalnie uruchamianymi modelami otwartymi. Plik o rozmiarze 17 GB działający na laptopie daje teraz wyniki, które w przypadku konkretnych zadań kreatywnych dorównują temu, czego jeszcze niedawno wymagały modele w skali centrum danych.

Kontynuuje także dynamikę ciężarów otwartych z chińskich laboratoriów, która zdefiniowała rok 2026. Rodzina Qwen firmy Alibaba znalazła się w tym roku wśród linii modeli najczęściej pobieranych na całym świecie, konkurując z wydaniami Meta, DeepSeek i Moonshot AI w zakresie udostępniania myśli programistom. Niezależne wyniki testów porównawczych dla Qwen 3.8 27B wciąż się gromadzą, a Willison wyraźnie przestrzegł, że raportowane przez laboratorium liczby oczekują na weryfikację przez stronę trzecią.

Praktyczne wskazówki dla użytkowników

Dla programistów i entuzjastów rozważających ten model konsensus wyłaniający się z wczesnych testów jest prosty: Qwen 3.8 27B to mocny domyślny wybór w przypadku lokalnych obciążeń AI, które obejmują wizję lub długie dokumenty, ale wysiłek w zakresie rozumowania powinien być dostosowany do zadania. Złożona analiza może uzasadniać „xhigh”; codzienne pytania i szybkie wersje robocze są szybsze i tańsze na poziomie „średnim” lub niższym.

Użytkownicy uruchamiający model za pomocą narzędzi takich jak LM Studio powinni również podnieść domyślne okno kontekstowe z 8192 tokenów — Willison stwierdził, że rozszerzone myślenie modelu wyczerpało budżet nawet w przypadku przyziemnych problemów, zanim załadował go pełnym kontekstem 262 144 tokenów.

Większe pytanie brzmi: co premiera sygnalizuje o następnej fazie wyścigu w modelach otwartych: w miarę jak modele oparte na rozumowaniu stają się normą, domyślne ustawienia konfiguracji zamieniają się w decyzje dotyczące produktu z realnymi konsekwencjami dotyczącymi użyteczności — a domyślna wartość „xhigh” Qwen jest już najczęściej omawianym przykładem.

Kamień milowy w otwartych ciężarach

Wydanie to stanowi także kamień milowy w zakresie tego, co laboratoria z otwartymi ciężarami mogą teraz dostarczać na małą skalę. Możliwości widzenia, okno kontekstowe zawierające 262 144 tokenów i wydajność rozumowania konkurencyjnego w pakiecie mieszczącym się na laptopie konsumenckim byłyby nie do pomyślenia w modelu z licencją Apache-2.0 dwa lata temu. Dla programistów tworzących aplikacje zorientowane lokalnie – gdzie prywatność danych, opóźnienia lub działanie w trybie offline wykluczają interfejsy API w chmurze – praktyczne opcje są stale ulepszane w błyskawicznym tempie.

Testy Willisona uwydatniają również punkt dojrzałości ekosystemu: narzędzia oparte na modelach lokalnych, od pobierania GGUF w LM Studio jednym kliknięciem po konfigurowalne parametry wnioskowania, są na tyle zaawansowane, że dostrajanie głębi myślenia modelu jest obecnie rutynową decyzją użytkownika, a nie zadaniem badawczym. W miarę gromadzenia się w nadchodzących dniach niezależnych testów porównawczych obraz tego, gdzie dokładnie plasuje się Qwen 3.8 27B na tle otwartych i zamkniętych konkurentów, ale wczesny odbiór sugeruje kolejne mocne wejście w linię, która uczyniła Alibaba jednym z najbardziej znaczących wydawców modelu otwartego na świecie.

---

Bądź na Bieżąco z AI

Najnowsze wiadomości, analizy i przełomy w dziedzinie AI — wszystko w jednym miejscu.

Czytaj więcej wiadomości AI →