모델비즈니스 및 시장 🇷🇺 10.08.2026 14:01

Qwen3.8 Max 출시: 에이전틱 인덱스에서 Claude Fable 5를 능가, 백만 토큰당 6달러

Alibaba/QwenAlibaba/Qwen AnthropicAnthropic
알리바바가 2.4조 개의 파라미터를 가진 멀티모달 모델이자 백만 토큰 컨텍스트를 지원하는 Qwen3.8 Max의 최종 버전을 출시했습니다. 독립적인 테스트 결과, 에이전틱 인덱스에서 Claude Fable 5를 능가하며, API 가격은 경쟁사보다 현저히 낮습니다. 그러나 오픈 웨이트는 아직 공개되지 않았습니다.
알리바바가 Qwen3.8 Max를 공식 출시했습니다. 이 모델은 2조 4천억 개의 파라미터를 가진 네이티브 멀티모달 전문가 혼합(MoE) 모델로, 텍스트, 이미지, 비디오 입력을 지원하고 텍스트를 출력하며, 최대 100만 토큰(추론 모드에서 입력 98만 3천, 출력 13만 1천 토큰)의 컨텍스트 창을 갖추고 있습니다. 이 모델은 기본적으로 하이브리드 추론, 함수 호출, 내장 도구를 지원하며, 프로그래밍 및 전문 에이전트 워크플로우용으로 홍보되고 있습니다. Artificial Analysis의 독립적인 테스트에 따르면 Qwen3.8 Max는 인텔리전스 지수에서 58.1점(Claude Fable 5는 62.1점), 에이전트 지수에서 58.4점(Claude Fable 5는 56.6점)을 기록했으며, 오직 두 개의 Claude Opus 5 모드만이 더 높은 순위를 차지했습니다. 가격은 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 6달러로 책정되었고, 캐시 읽기는 100만 토큰당 0.25달러입니다. 이는 입력 기준으로 Claude Fable 5보다 약 5배, 출력 기준으로 8.3배 저렴한 가격입니다. 그러나 이 모델은 장황한 편입니다. 전체 인텔리전스 지수 실행에서 약 1억 5천만 개의 토큰을 생성했는데, 이는 유사한 모델의 중앙값(6600만 개)의 약 2.3배입니다. 속도는 초당 약 82개의 출력 토큰이며, 첫 토큰 지연 시간은 약 2.8초입니다. 8월 10일 아침 현재 Qwen3.8 Max와 Qwen3.8-27B의 오픈 웨이트는 아직 공개되지 않았지만, 알리바바는 8월 3일 주에 공개하겠다고 약속했습니다. 대형 모델은 BF16 기준 약 4.8 TB, 4비트 기준 1.2 TB의 메모리가 필요하여 대부분의 경우 로컬 배포가 비현실적입니다. 이 기사는 Qwen3.8 Max가 에이전트 기반 코딩, 장문 문서 분석, 다단계 프로세스, 그리고 Claude의 백업으로 적합하다고 제안하지만, 전환 전에 자신의 작업에서 테스트해 볼 것을 권장합니다.
출처: Habr — хаб ИИ — 원문
관련 게시물 ↓
새로운 뉴스