Alibaba의 Qwen 연구소는 합리적인 사양의 노트북에서 실행되는 Apache 2.0 라이센스를 갖춘 비전 지원 대형 언어 모델인 Qwen 3.8 27B를 금요일에 출시했습니다. 연구소 자체 벤치마크에 따르면 이전 제품뿐만 아니라 최근 5월에 Qwen의 가장 강력한 모델 중 하나였던 폐쇄형 모델보다 성능이 뛰어납니다.
이번 출시는 개발자 집단에서 이번 달 가장 많이 논의되는 모델 출시 중 하나가 되었습니다. 저명한 독립 AI 연구원이자 블로거인 Simon Willison이 일요일에 발표한 실습 리뷰는 수백 개의 찬성 투표를 받아 Hacker News의 첫 페이지에 게재되었으며 독자들은 모델의 기능과 특이한 기본 구성에 대해 토론했습니다. 이 이야기에 대한 자세한 내용은 인공지능 뉴스를 참조하세요.
Qwen 3.8 27B의 새로운 기능
이 모델은 훨씬 더 큰 Qwen 3.8 2.4T-A95B 전문가 혼합 출시 후 몇 주 후에 출시된 Alibaba의 오픈 웨이트 라인의 최신 모델입니다. Qwen의 자체 보고 벤치마크에 따르면 27B 모델은 Qwen 3.6 27B와 폐쇄형 Qwen 3.7-Plus에 비해 향상된 성능을 보여줍니다. 이 모델은 이름에도 불구하고 올해 초 모든 규모에서 Qwen의 가장 강력한 성능을 발휘한 모델 중 하나였습니다.
이 모델은 최대 262,144개 토큰의 컨텍스트 길이를 지원하고 비전 입력을 처리하며 'xhigh', 'medium', 'low'의 세 가지 수준에서 추론 깊이를 조정하는 'reasoning_effort' 매개변수에 대한 공식 지원을 제공합니다.
릴리스의 화두가 된 것은 첫 번째 설정(공장 기본값인 `xhigh`)입니다.
지나치게 생각하는 문제
LM Studio의 17GB Q4_K_M 양자화 빌드를 사용하여 128GB MacBook Pro 및 NVIDIA DGX Spark에서 모델을 테스트한 Willison은 기본값이 "굉장한 과잉 사고"를 생성하는 것으로 설명했습니다.
한 가지 놀라운 예에서 그는 모델에게 자전거를 타는 펠리컨의 SVG를 그려달라고 요청했습니다. 기본 'xhigh' 추론 노력을 통해 모델은 3,223개의 출력 토큰을 생성하기 위해 22,276개의 추론 토큰을 사용했습니다. 이는 하드웨어에서 21분이 소요된 프로세스입니다. 그는 그 결과가 정확한 자전거 기하학, 프레임 양쪽의 다리, 멋진 일러스트레이션 배경을 갖춘 로컬로 실행되는 모델을 사용하여 생성할 수 있었던 "단연 최고의 펠리컨 SVG"라고 지적했습니다.
절충안은 분명합니다. 21분은 대부분의 작업에 있어서 비현실적인 대기 시간입니다. 추론을 비활성화한 상태에서 동일한 프롬프트를 다시 실행하면 비슷한 출력 길이에서 10분의 1 미만인 137초 만에 응답이 생성되었습니다.
사소하고 간단한 프롬프트라도 동작을 유발합니다. "원의 svg를 그리세요"라는 요청을 받은 모델의 추론 추적은 팔레트 옵션, 바우하우스 스타일, 레이어 링 및 애니메이션 접근 방식을 고려하여 열렸습니다. 단일 XML 태그가 필요한 모양에 대해 몇 분 동안 숙고했습니다.
Willison의 평결: 모델은 훌륭하지만 기본 구성은 "특히 소비자 하드웨어에서 모델을 실행하는 데 전혀 좋은 방법이 아닙니다." 사용자는 '중간' 또는 '낮은' 추론 노력으로 전환하거나 확장된 사고를 완전히 비활성화할 수 있습니다.
로컬 AI의 모멘텀
이번 릴리스는 프론티어 클라우드 모델과 로컬에서 실행 가능한 개방형 모델 간의 기능 격차가 얼마나 빨리 줄어들었는지 강조합니다. 이제 노트북에서 실행되는 17GB 파일은 특정 창의적 작업에서 얼마 전까지만 해도 데이터 센터 규모 모델이 필요했던 것과 맞먹는 결과를 만들어냅니다.
이는 또한 2026년을 정의한 중국 연구소의 공개 가중치 모멘텀을 이어갑니다. Alibaba의 Qwen 제품군은 개발자 마인드 공유를 위해 Meta, DeepSeek 및 Moonshot AI의 릴리스와 경쟁하면서 올해 전 세계적으로 가장 많이 다운로드된 모델 라인 중 하나였습니다. Qwen 3.8 27B에 대한 독립적인 벤치마크 결과는 여전히 누적되고 있으며 Willison은 연구소의 자체 보고 수치가 제3자 검증을 기다리고 있다고 명시적으로 경고했습니다.
사용자를 위한 실무 지침
모델을 고려하는 개발자와 매니아의 경우 초기 테스트에서 나타나는 합의는 간단합니다. Qwen 3.8 27B는 비전이나 긴 문서가 포함된 로컬 AI 워크로드에 대한 강력한 기본 선택이지만 추론 노력은 작업에 맞게 조정되어야 합니다. 복잡한 분석은 'xhigh'를 정당화할 수 있습니다. 일상적인 질문과 빠른 초안은 '중간' 이하에서 더 빠르고 저렴합니다.
LM Studio와 같은 도구를 통해 모델을 실행하는 사용자는 8,192개의 토큰에서 기본 컨텍스트 창을 높여야 합니다. Willison은 전체 262,144개의 토큰 컨텍스트를 로드하기 전에 모델의 확장된 사고로 인해 일상적인 문제에도 예산이 소진된다는 사실을 발견했습니다.
더 큰 질문은 공개 모델 경쟁의 다음 단계에 대한 출시 신호가 무엇인지입니다. 추론 스타일 모델이 표준이 되면서 구성 기본값이 실제 유용성 결과를 가져오는 제품 결정으로 바뀌고 있으며 Qwen의 'xhigh' 기본값은 이미 가장 많이 논의된 예입니다.
오픈 웨이트의 이정표
이 릴리스는 또한 개방형 가중치 실험실이 이제 소규모로 제공할 수 있는 것의 이정표를 표시합니다. 소비자 노트북에 맞는 패키지의 비전 기능, 262,144개 토큰 컨텍스트 창 및 경쟁력 있는 추론 성능은 2년 전 Apache-2.0 라이센스 모델에서는 상상할 수 없었을 것입니다. 데이터 개인 정보 보호, 대기 시간 또는 오프라인 작업이 클라우드 API를 배제하는 로컬 우선 애플리케이션을 구축하는 개발자의 경우 실용적인 옵션이 빠른 속도로 계속 개선됩니다.
Willison의 테스트는 또한 생태계의 성숙 지점을 강조합니다. LM Studio의 원클릭 GGUF 다운로드부터 구성 가능한 추론 매개변수에 이르기까지 로컬 모델을 중심으로 한 도구는 모델의 사고 깊이를 조정하는 것이 이제 연구 활동이 아닌 일상적인 사용자 결정이 될 만큼 충분히 발전했습니다. 앞으로 독립적인 벤치마크가 축적됨에 따라 Qwen 3.8 27B가 공개 및 비공개 경쟁업체에 비해 정확히 어디에 도달하는지에 대한 그림이 더욱 날카로워질 것입니다. 그러나 초기 수신은 알리바바를 세계에서 가장 중요한 공개 모델 게시자 중 하나로 만든 또 다른 강력한 진입을 시사합니다.
---
AI 최신 소식최신 AI 뉴스, 분석 및 혁신을 한 곳에서 확인하세요.
AI 뉴스 더 보기 →