Qwen3.8-27B 오픈소스 공개: 소비자 GPU에서 '오퍼스급' 에이전트 실행, 여러 벤치마크에서 클로드 제압
Alibaba/Qwen
Anthropic
알리바바의 Qwen3.8-27B가 공식적으로 오픈소스화되었으며, 270억 개의 매개변수, 네이티브 멀티모달 지원, 최대 100만 토큰의 컨텍스트를 갖추고 있습니다. 여러 소프트웨어 엔지니어링 및 에이전트 벤치마크에서 클로드 오퍼스 4.6 맥스를 능가하며, 고급 소비자 GPU에서 로컬 실행이 가능합니다. 이 모델은 조정 가능한 추론 노력과 긴 컨텍스트 작업을 위한 최적화를 포함합니다.
알리바바가 270억 개의 파라미터를 가진 오픈소스 모델 Qwen3.8-27B를 공개했다. 공식 벤치마크에서 이 모델은 소프트웨어 엔지니어링 및 에이전트 작업에서 Claude Opus 4.6 Max를 능가하는데, 예를 들어 SWE-bench Pro에서 8.3포인트, QwenSWEBench에서 15.2포인트 앞선다. 에이전트 평가에서는 CoWorkBench에서 70.7점을 기록해 Opus의 68.2점을 웃돌았고, 멀티모달 컴퓨터 및 휴대폰 조작 테스트에서는 OSWorld-Verified에서 84.3점, AndroidWorld에서 81.9점을 달성해 Opus의 72.7점과 62.0점을 크게 앞질렀다. 이 모델은 기본적인 멀티모달 이해, 262K 토큰의 기본 컨텍스트(최대 100만 토큰까지 확장 가능)를 지원하며, 추론 노력 조정(xhigh, medium, low) 및 에이전트 작업을 위한 preserve_thinking 기능을 포함한다. 아키텍처는 48개의 Gated DeltaNet 선형 어텐션 레이어와 16개의 전체 어텐션 레이어를 사용하여 긴 컨텍스트를 처리한다. Transformers, vLLM, SGLang, TokenSpeed와 호환되며, 양자화된 버전이 Hugging Face에서 제공되어 RTX 3090/4090 같은 소비자용 GPU나 Apple Mac에서도 배포할 수 있다. 커뮤니티 테스트는 코딩 및 멀티모달 능력, NVIDIA GH200에서의 높은 동시성 안정성, 긴 비디오 처리 등을 입증한다.
출처: QbitAI 量子位 —
원문
