알리바바 Qwen 팀, Apache-2.0 라이선스로 Qwen3.8 모델 오픈
Alibaba/Qwen
알리바바의 AI 팀 Qwen이 Qwen3.8의 오픈 모델 가중치를 공개했습니다. 핵심 모델인 Qwen3.8-27B는 270억 개의 파라미터를 가진 멀티모달 밀집 모델로, 특히 프로그래밍과 사무 작업에서 더 큰 Qwen3.7-Plus보다 많은 영역에서 뛰어납니다. 이 모델은 기본적으로 최대 262,000 토큰의 컨텍스트를 처리하며 YaRN 방법으로 백만 토큰까지 확장할 수 있습니다.
알리바바의 AI 팀 Qwen이 자사 Qwen3.8 모델의 오픈 가중치를 자유로운 Apache-2.0 라이선스 하에 공개했습니다. 플래그십 모델인 Qwen3.8-27B는 270억 개의 매개변수를 가진 멀티모달 밀집 모델로, 여러 분야에서 더 큰 규모의 Qwen3.7-Plus를 능가한다고 알려져 있으며, 특히 프로그래밍과 업무 관련 작업에서 그렇습니다. Qwen은 또한 향상된 에이전트 기능을 강조했는데, 이 모델은 더 독립적으로 계획을 세우고 작업을 더 안정적으로 완료합니다. 이 모델은 기본적으로 최대 262,000개의 토큰의 컨텍스트를 처리하며, YaRN 방법을 사용하면 100만 토큰까지 확장할 수 있습니다. 텍스트 외에도 이 모델은 다이어그램, 문서, 또는 몇 시간 분량의 동영상과 같은 이미지와 동영상을 이해합니다. 유연한 생각 모드가 기본적으로 활성화되어 있으며, 요청에 따라 비활성화하거나 깊이를 조정할 수도 있습니다. 또한 Qwen은 훨씬 더 큰 Qwen3.8-2.4T-A95B 모델의 가중치도 공개했는데, 이 모델은 최고급 성능을 목표로 합니다. 두 모델 모두 Hugging Face와 ModelScope에서 사용할 수 있습니다. 100만 토큰의 컨텍스트를 지원하는 호스팅 버전은 곧 알리바바의 AI 서비스인 Qwen Cloud를 통해 제공될 예정입니다.
출처: The Decoder (DE) —
원문
