O laboratório de pesquisa Qwen do Alibaba lançou o Qwen 3.8 27B na sexta-feira, um modelo de linguagem grande com capacidade de visão e licenciado pelo Apache 2.0 que roda em um laptop razoavelmente especificado - e, de acordo com os próprios benchmarks do laboratório, supera não apenas seu antecessor, mas um modelo de peso fechado que estava entre os mais fortes de Qwen em maio.

O lançamento se tornou um dos lançamentos de modelos mais discutidos do mês nos círculos de desenvolvedores. Uma análise prática publicada no domingo por Simon Willison, proeminente pesquisador independente de IA e blogueiro, chegou à primeira página do Hacker News com centenas de votos positivos, com leitores debatendo as capacidades do modelo e sua configuração padrão incomum. Para mais contexto sobre esta história, confira nossa cobertura da indústria de IA.

O que há de novo no Qwen 3.8 27B

O modelo é o mais recente na linha de pesos abertos do Alibaba, chegando semanas após o lançamento muito maior do Qwen 3.8 2.4T-A95B, uma mistura de especialistas. De acordo com os benchmarks auto-relatados de Qwen, o modelo 27B mostra ganhos sobre o Qwen 3.6 27B e o Qwen 3.7-Plus de peso fechado – um modelo que, apesar do nome, teve um dos desempenhos mais fortes de Qwen de qualquer tamanho no início deste ano.

O modelo suporta um comprimento máximo de contexto de 262.144 tokens, lida com entradas de visão e vem com suporte oficial para um parâmetro `reasoning_effort` que ajusta a profundidade do raciocínio em três níveis: `xhigh`, `medium` e `low`.

É essa primeira configuração — `xhigh`, o padrão de fábrica — que se tornou o assunto do lançamento.

O problema de pensar demais

Willison, que testou o modelo em um MacBook Pro de 128 GB e um NVIDIA DGX Spark usando a construção quantizada Q4_K_M de 17 GB do LM Studio, descreveu o padrão como produzindo “pensamento excessivo espetacular”.

Em um exemplo impressionante, ele pediu ao modelo que desenhasse um SVG de um pelicano andando de bicicleta. Com o esforço de raciocínio padrão `xhigh`, o modelo gastou 22.276 tokens de raciocínio para produzir 3.223 tokens de saída – um processo que levou 21 minutos em seu hardware. O resultado, observou ele, foi “de longe o melhor SVG pelicano” que ele conseguiu gerar com um modelo que funciona localmente, com geometria correta da bicicleta, pernas em ambos os lados do quadro e um fundo ilustrado de bom gosto.

A compensação é óbvia: 21 minutos é uma espera impraticável para a maioria das tarefas. Executar novamente o mesmo prompt com o raciocínio desativado produziu uma resposta em 137 segundos – menos de um décimo do tempo – com duração de saída semelhante.

Mesmo avisos trivialmente simples desencadeiam o comportamento. Solicitado a "desenhar um círculo SVG", o traço de raciocínio do modelo foi aberto ponderando opções de paleta, estilo Bauhaus, anéis em camadas e abordagens de animação - vários minutos de deliberação para uma forma que requer uma única tag XML.

Veredicto de Willison: o modelo é excelente, mas a configuração padrão “absolutamente não é uma boa maneira de executar o modelo, especialmente em hardware de consumo”. Os usuários podem mudar para esforço de raciocínio “médio” ou “baixo” ou desativar totalmente o pensamento estendido.

Impulso da IA local

O lançamento destaca a rapidez com que a lacuna de capacidades entre os modelos de nuvem de fronteira e os modelos abertos executáveis localmente diminuiu. Um arquivo de 17 GB executado em um laptop agora produz resultados que, em tarefas criativas específicas, rivalizam com o que exigiam modelos em escala de data center há pouco tempo.

Ele também dá continuidade ao impulso de peso aberto dos laboratórios chineses que definiu 2026. A família Qwen da Alibaba está entre as linhas de modelos mais baixadas globalmente este ano, competindo com lançamentos da Meta, DeepSeek e Moonshot AI pela participação dos desenvolvedores. Os resultados de benchmark independentes para Qwen 3.8 27B ainda estão se acumulando, e Willison advertiu explicitamente que os números relatados pelo próprio laboratório aguardam verificação de terceiros.

Orientação prática para usuários

Para desenvolvedores e entusiastas que consideram o modelo, o consenso emergente dos primeiros testes é direto: Qwen 3.8 27B é uma forte escolha padrão para cargas de trabalho locais de IA que envolvem visão ou documentos longos, mas o esforço de raciocínio deve ser ajustado à tarefa. A análise complexa pode justificar `xhigh`; perguntas do dia a dia e rascunhos rápidos são mais rápidos e baratos em `médio` ou abaixo.

Os usuários que executam o modelo por meio de ferramentas como o LM Studio também devem aumentar a janela de contexto padrão de 8.192 tokens – Willison descobriu que o pensamento estendido do modelo esgotou esse orçamento até mesmo em problemas mundanos antes de carregá-lo com o contexto completo de 262.144 tokens.

A grande questão é o que o lançamento sinaliza sobre a próxima fase da corrida do modelo aberto: à medida que os modelos de estilo de raciocínio se tornam a norma, os padrões de configuração estão se transformando em decisões de produto com consequências reais de usabilidade – e o padrão “xhigh” de Qwen já é o exemplo mais discutido.

Um marco para pesos abertos

O lançamento também marca um marco no que os laboratórios de peso aberto agora podem oferecer em pequena escala. Capacidade de visão, uma janela de contexto de 262.144 tokens e desempenho de raciocínio competitivo em um pacote que cabe em um laptop de consumo seriam impensáveis ​​em um modelo licenciado pelo Apache 2.0 há dois anos. Para os desenvolvedores que criam aplicativos locais – onde a privacidade dos dados, a latência ou a operação off-line excluem APIs na nuvem – as opções práticas continuam melhorando rapidamente.

Os testes de Willison também destacam um ponto de maturidade para o ecossistema: as ferramentas em torno de modelos locais, desde downloads GGUF com um clique do LM Studio até parâmetros de raciocínio configuráveis, avançaram o suficiente para que ajustar a profundidade de pensamento de um modelo seja agora uma decisão rotineira do usuário, em vez de um exercício de pesquisa. À medida que os benchmarks independentes se acumulam nos próximos dias, a imagem de onde exatamente o Qwen 3.8 27B chega em relação aos seus concorrentes abertos e fechados ficará mais nítida – mas a recepção inicial sugere outra entrada forte na linha que fez da Alibaba uma das editoras de modelo aberto mais importantes do mundo.

---

Fique à Frente da IA

As últimas notícias, análises e avanços em inteligência artificial — tudo em um só lugar.

Ler mais notícias de IA →