O laboratório de pesquisa Qwen do Alibaba lançou o Qwen 3.8 27B na sexta-feira, um modelo de linguagem grande com capacidade de visão e licenciado pelo Apache 2.0 que roda em um laptop razoavelmente especificado - e, de acordo com os próprios benchmarks do laboratório, supera não apenas seu antecessor, mas um modelo de peso fechado que estava entre os mais fortes de Qwen em maio.
O lançamento se tornou um dos lançamentos de modelos mais discutidos do mês nos círculos de desenvolvedores. Uma análise prática publicada no domingo por Simon Willison, proeminente pesquisador independente de IA e blogueiro, chegou à primeira página do Hacker News com centenas de votos positivos, com leitores debatendo as capacidades do modelo e sua configuração padrão incomum. Para mais contexto sobre esta história, confira nossa cobertura da indústria de IA.
O que há de novo no Qwen 3.8 27B
O modelo é o mais recente na linha de pesos abertos do Alibaba, chegando semanas após o lançamento muito maior do Qwen 3.8 2.4T-A95B, uma mistura de especialistas. De acordo com os benchmarks auto-relatados de Qwen, o modelo 27B mostra ganhos sobre o Qwen 3.6 27B e o Qwen 3.7-Plus de peso fechado – um modelo que, apesar do nome, teve um dos desempenhos mais fortes de Qwen de qualquer tamanho no início deste ano.
O modelo suporta um comprimento máximo de contexto de 262.144 tokens, lida com entradas de visão e vem com suporte oficial para um parâmetro `reasoning_effort` que ajusta a profundidade do raciocínio em três níveis: `xhigh`, `medium` e `low`.
É essa primeira configuração — `xhigh`, o padrão de fábrica — que se tornou o assunto do lançamento.
O problema de pensar demais
Willison, que testou o modelo em um MacBook Pro de 128 GB e um NVIDIA DGX Spark usando a construção quantizada Q4_K_M de 17 GB do LM Studio, descreveu o padrão como produzindo “pensamento excessivo espetacular”.
Em um exemplo impressionante, ele pediu ao modelo que desenhasse um SVG de um pelicano andando de bicicleta. Com o esforço de raciocínio padrão `xhigh`, o modelo gastou 22.276 tokens de raciocínio para produzir 3.223 tokens de saída – um processo que levou 21 minutos em seu hardware. O resultado, observou ele, foi “de longe o melhor SVG pelicano” que ele conseguiu gerar com um modelo que funciona localmente, com geometria correta da bicicleta, pernas em ambos os lados do quadro e um fundo ilustrado de bom gosto.
A compensação é óbvia: 21 minutos é uma espera impraticável para a maioria das tarefas. Executar novamente o mesmo prompt com o raciocínio desativado produziu uma resposta em 137 segundos – menos de um décimo do tempo – com duração de saída semelhante.
Mesmo avisos trivialmente simples desencadeiam o comportamento. Solicitado a "desenhar um círculo SVG", o traço de raciocínio do modelo foi aberto ponderando opções de paleta, estilo Bauhaus, anéis em camadas e abordagens de animação - vários minutos de deliberação para uma forma que requer uma única tag XML.
Veredicto de Willison: o modelo é excelente, mas a configuração padrão “absolutamente não é uma boa maneira de executar o modelo, especialmente em hardware de consumo”. Os usuários podem mudar para esforço de raciocínio “médio” ou “baixo” ou desativar totalmente o pensamento estendido.
Impulso da IA local
O lançamento destaca a rapidez com que a lacuna de capacidades entre os modelos de nuvem de fronteira e os modelos abertos executáveis localmente diminuiu. Um arquivo de 17 GB executado em um laptop agora produz resultados que, em tarefas criativas específicas, rivalizam com o que exigiam modelos em escala de data center há pouco tempo.
Ele também dá continuidade ao impulso de peso aberto dos laboratórios chineses que definiu 2026. A família Qwen da Alibaba está entre as linhas de modelos mais baixadas globalmente este ano, competindo com lançamentos da Meta, DeepSeek e Moonshot AI pela participação dos desenvolvedores. Os resultados de benchmark independentes para Qwen 3.8 27B ainda estão se acumulando, e Willison advertiu explicitamente que os números relatados pelo próprio laboratório aguardam verificação de terceiros.
Orientação prática para usuários
Para desenvolvedores e entusiastas que consideram o modelo, o consenso emergente dos primeiros testes é direto: Qwen 3.8 27B é uma forte escolha padrão para cargas de trabalho locais de IA que envolvem visão ou documentos longos, mas o esforço de raciocínio deve ser ajustado à tarefa. A análise complexa pode justificar `xhigh`; perguntas do dia a dia e rascunhos rápidos são mais rápidos e baratos em `médio` ou abaixo.
Os usuários que executam o modelo por meio de ferramentas como o LM Studio também devem aumentar a janela de contexto padrão de 8.192 tokens – Willison descobriu que o pensamento estendido do modelo esgotou esse orçamento até mesmo em problemas mundanos antes de carregá-lo com o contexto completo de 262.144 tokens.
A grande questão é o que o lançamento sinaliza sobre a próxima fase da corrida do modelo aberto: à medida que os modelos de estilo de raciocínio se tornam a norma, os padrões de configuração estão se transformando em decisões de produto com consequências reais de usabilidade – e o padrão “xhigh” de Qwen já é o exemplo mais discutido.
Um marco para pesos abertos
O lançamento também marca um marco no que os laboratórios de peso aberto agora podem oferecer em pequena escala. Capacidade de visão, uma janela de contexto de 262.144 tokens e desempenho de raciocínio competitivo em um pacote que cabe em um laptop de consumo seriam impensáveis em um modelo licenciado pelo Apache 2.0 há dois anos. Para os desenvolvedores que criam aplicativos locais – onde a privacidade dos dados, a latência ou a operação off-line excluem APIs na nuvem – as opções práticas continuam melhorando rapidamente.
Os testes de Willison também destacam um ponto de maturidade para o ecossistema: as ferramentas em torno de modelos locais, desde downloads GGUF com um clique do LM Studio até parâmetros de raciocínio configuráveis, avançaram o suficiente para que ajustar a profundidade de pensamento de um modelo seja agora uma decisão rotineira do usuário, em vez de um exercício de pesquisa. À medida que os benchmarks independentes se acumulam nos próximos dias, a imagem de onde exatamente o Qwen 3.8 27B chega em relação aos seus concorrentes abertos e fechados ficará mais nítida – mas a recepção inicial sugere outra entrada forte na linha que fez da Alibaba uma das editoras de modelo aberto mais importantes do mundo.
---
Fique à Frente da IAAs últimas notícias, análises e avanços em inteligência artificial — tudo em um só lugar.
Ler mais notícias de IA →