QwQ: 미지의 경계에 대한 깊은 성찰
Alibaba/Qwen
알리바바의 Qwen 팀이 QwQ-32B-Preview를 출시했습니다. 이 실험적 추론 모델은 수학과 코딩에서 뛰어난 성능을 보이지만 언어 혼합 및 재귀 루프와 같은 한계가 있습니다.
알리바바의 Qwen 팀이 QwQ-32B-Preview를 출시했습니다. 이 모델은 깊이 사고하고 가정에 의문을 제기한 후 답변을 제공하는 실험적 추론 모델입니다. 강력한 벤치마크 점수를 기록했는데, GPQA에서 65.2%, AIME에서 50.0%, MATH-500에서 90.6%, LiveCodeBench에서 50.0%를 달성했습니다. 이 모델은 언어 혼합, 재귀적 추론 루프를 보이며, 향상된 안전 조치가 필요합니다. GitHub, Hugging Face 및 ModelScope에서 이용할 수 있습니다.
출처: Alibaba Qwen —
원문
