El laboratorio de investigación Qwen de Alibaba lanzó el viernes Qwen 3.8 27B, un modelo de lenguaje grande con capacidad de visión y licencia Apache 2.0 que se ejecuta en una computadora portátil con especificaciones razonables y, según los propios puntos de referencia del laboratorio, supera no sólo a su predecesor, sino también a un modelo de peso cerrado que estuvo entre los más fuertes de Qwen en mayo.
El lanzamiento se ha convertido en uno de los lanzamientos de modelos más comentados del mes en los círculos de desarrolladores. Una revisión práctica publicada el domingo por Simon Willison, el destacado investigador independiente de IA y bloguero, llegó a la portada de Hacker News con cientos de votos a favor, y los lectores debatieron las capacidades del modelo y su inusual configuración predeterminada. Para más contexto sobre esta historia, consulta nuestra actualidad de inteligencia artificial.
Novedades de Qwen 3.8 27B
El modelo es el último de la línea de pesos abiertos de Alibaba y llega semanas después del lanzamiento de una mezcla de expertos, mucho más grande, Qwen 3.8 2.4T-A95B. Según los puntos de referencia autoinformados por Qwen, el modelo 27B muestra ganancias sobre el Qwen 3.6 27B y el Qwen 3.7-Plus de peso cerrado, un modelo que, a pesar de su nombre, fue uno de los de mejor desempeño de Qwen de cualquier tamaño a principios de este año.
El modelo admite una longitud de contexto máxima de 262,144 tokens, maneja entradas de visión y se entrega con soporte oficial para un parámetro "reasoning_effort" que ajusta la profundidad del razonamiento en tres niveles: "xhigh", "medium" y "low".
Es esa primera configuración, `xhigh`, el valor predeterminado de fábrica, la que se ha convertido en el tema de conversación de la versión.
El problema del pensamiento excesivo
Willison, quien probó el modelo en una MacBook Pro de 128 GB y una NVIDIA DGX Spark utilizando la versión cuantificada Q4_K_M de 17 GB de LM Studio, describió el valor predeterminado como un "pensamiento excesivo espectacular".
En un ejemplo sorprendente, le pidió al modelo que dibujara un SVG de un pelícano andando en bicicleta. Con el esfuerzo de razonamiento predeterminado "xhigh", el modelo gastó 22.276 tokens de razonamiento para producir 3.223 tokens de salida, un proceso que tomó 21 minutos en su hardware. El resultado, señaló, fue "con diferencia, el mejor Pelican SVG" que ha podido generar con un modelo que se ejecuta localmente, con una geometría de bicicleta correcta, patas a ambos lados del cuadro y un fondo ilustrado con buen gusto.
La desventaja es obvia: 21 minutos es una espera poco práctica para la mayoría de las tareas. Volver a ejecutar el mismo mensaje con el razonamiento desactivado produjo una respuesta en 137 segundos (menos de una décima parte del tiempo) con una duración de salida similar.
Incluso las indicaciones trivialmente simples desencadenan el comportamiento. Cuando se le pidió "dibujar un svg de un círculo", el rastro de razonamiento del modelo se abrió sopesando las opciones de la paleta, el estilo Bauhaus, los anillos en capas y los enfoques de animación: varios minutos de deliberación para una forma que requiere una única etiqueta XML.
Veredicto de Willison: el modelo es excelente, pero la configuración predeterminada "no es en absoluto una buena manera de ejecutar el modelo, especialmente en hardware de consumo". Los usuarios pueden cambiar a un esfuerzo de razonamiento "medio" o "bajo", o desactivar por completo el pensamiento extendido.
El impulso de la IA local
El comunicado subraya lo rápido que se ha reducido la brecha de capacidades entre los modelos de nube fronteriza y los modelos abiertos ejecutables localmente. Un archivo de 17 GB que se ejecuta en una computadora portátil ahora produce resultados que, en tareas creativas específicas, rivalizan con lo que requerían los modelos a escala de centro de datos no hace mucho.
También continúa el impulso de los pesos abiertos de los laboratorios chinos que ha definido el año 2026. La familia Qwen de Alibaba ha estado entre las líneas de modelos más descargadas a nivel mundial este año, compitiendo con los lanzamientos de Meta, DeepSeek y Moonshot AI por la participación de los desarrolladores. Los resultados de referencia independientes para Qwen 3.8 27B todavía se están acumulando, y Willison advirtió explícitamente que las cifras autoinformadas por el laboratorio esperan verificación de terceros.
Orientación práctica para los usuarios
Para los desarrolladores y entusiastas que consideran el modelo, el consenso emergente de las primeras pruebas es sencillo: Qwen 3.8 27B es una opción predeterminada sólida para cargas de trabajo de IA locales que involucran visión o documentos largos, pero el esfuerzo de razonamiento debe adaptarse a la tarea. Un análisis complejo puede justificar "xhigh"; Las preguntas cotidianas y los borradores rápidos son más rápidos y económicos en "medio" o menos.
Los usuarios que ejecutan el modelo a través de herramientas como LM Studio también deberían aumentar la ventana de contexto predeterminada de 8,192 tokens: Willison descubrió que el pensamiento extendido del modelo agotó ese presupuesto incluso en problemas mundanos antes de cargarlo con el contexto completo de 262,144 tokens.
La pregunta más importante es qué indica el lanzamiento sobre la siguiente fase de la carrera por el modelo abierto: a medida que los modelos de estilo de razonamiento se convierten en la norma, los valores predeterminados de configuración se están convirtiendo en decisiones de producto con consecuencias reales de usabilidad, y el valor predeterminado "xhigh" de Qwen ya es el ejemplo más discutido.
Un hito para las pesas abiertas
El lanzamiento también marca un hito en lo que los laboratorios de pesas abiertas ahora pueden ofrecer a pequeña escala. La capacidad de visión, una ventana de contexto de 262.144 tokens y un rendimiento de razonamiento competitivo en un paquete que cabe en una computadora portátil de consumo habrían sido impensables en un modelo con licencia Apache-2.0 hace dos años. Para los desarrolladores que crean aplicaciones locales (donde la privacidad de los datos, la latencia o el funcionamiento fuera de línea descartan las API en la nube), las opciones prácticas siguen mejorando a un ritmo rápido.
Las pruebas de Willison también resaltan un punto de madurez para el ecosistema: las herramientas en torno a los modelos locales, desde las descargas GGUF con un solo clic de LM Studio hasta los parámetros de razonamiento configurables, han avanzado lo suficiente como para que ajustar la profundidad de pensamiento de un modelo sea ahora una decisión rutinaria del usuario en lugar de un ejercicio de investigación. A medida que se acumulen puntos de referencia independientes en los próximos días, la imagen de dónde exactamente aterrizará Qwen 3.8 27B frente a sus competidores abiertos y cerrados se agudizará, pero la recepción inicial sugiere otra entrada fuerte en la línea que ha convertido a Alibaba en uno de los editores de modelos abiertos más importantes del mundo.
---
Mantente al Día con la IALas últimas noticias, análisis y avances de inteligencia artificial, en un solo lugar.
Leer más noticias de IA →