Qwen3.8-Max: 2.4조 파라미터 괴물 모델 등장
Alibaba/Qwen
Moonshot AI
Anthropic
OpenAI
DeepSeek
알리바바가 2.4조 파라미터 규모의 혼합 전문가(Mixture-of-Experts) 모델 Qwen3.8-Max를 공개했다. 이 모델은 100만 토큰 컨텍스트를 지원하며, 코딩 및 자율 작업 분야에서 새로운 기준을 세웠다고 주장한다. 이번 발표에는 처음으로 Max급 모델의 가중치를 공개할 계획도 포함되어 있으며, 장시간 지속되는 자율 작업 수행 능력도 함께 시연됐다. 독립 테스트 결과, Intelligence Index 기준으로 Kimi K3에 근소하게 뒤지지만 가격 대비 성능은 매우 우수한 것으로 나타났다.
2026년 8월 3일, 알리바바의 큐원(Qwen) 팀은 2조 4천억 개의 파라미터를 가진 대규모 언어 모델인 Qwen3.8-Max를 출시했습니다. 다만 Mixture-of-Experts 아키텍처 덕분에 요청당 활성화되는 파라미터는 약 950억 개에 불과합니다. 이 모델은 100만 토큰의 컨텍스트 창을 지원하며, QwenCloud, Alibaba Cloud Model Studio, QwenWork 앱을 통해 사용할 수 있습니다. 회사는 8월 12일에 Qwen3.8-Max와 더 작은 Qwen3.8-27B의 오픈 가중치를 공개할 계획이며, 이는 Max급 모델의 가중치가 공개되는 첫 번째 사례가 될 것입니다. 데모 영상에서는 이 모델이 16일 동안 자체 업데이트되는 CLI 도구를 자율적으로 구축하고, 과학 논문을 재현 및 개선하며, 실제 대회에 참가하고, 암호화 칩을 설계하며, 시뮬레이션된 전자상거래 환경에서 거래하는 모습을 보여줍니다. Artificial Analysis의 독립적인 테스트에서 이 모델은 인텔리전스 지수에서 56점을 받아 Kimi K3에 1점 뒤졌으며, 작업당 비용은 더 높았습니다. 회사는 초기 점수가 낮은 이유를 API 과부하 탓으로 돌렸습니다. 벤치마크 결과는 엇갈립니다. PaperBench, IFBench, OSWorld-Verified에서는 선두를 달렸지만, SWE-bench Pro와 FrontierSWE에서는 뒤처졌습니다. 가격은 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 6달러로 많은 경쟁사보다 저렴합니다. 커뮤니티는 소비자 하드웨어에서 실행할 수 있는 컴팩트한 27B 모델을 기대하고 있습니다. 이번 출시는 모델을 둘러싼 하네스(또는 인프라)의 중요성이 점점 커지고 있음을 보여주는 추세를 강조하며, 알리바바는 Claude Code 및 Codex와 같은 다양한 하네스와의 호환성을 주장합니다.
출처: Habr — хаб ИИ —
원문
