QwQ: Reflexión Profunda sobre los Límites de lo Desconocido
Alibaba/Qwen
El equipo Qwen de Alibaba ha lanzado QwQ-32B-Preview, un modelo de razonamiento experimental que sobresale en matemáticas y programación, pero tiene limitaciones como la mezcla de idiomas y bucles recursivos.
El equipo Qwen de Alibaba lanzó QwQ-32B-Preview, un modelo experimental de razonamiento diseñado para pensar profundamente y cuestionar supuestos antes de responder. Alcanza puntuaciones altas en pruebas de referencia: 65,2 % en GPQA, 50,0 % en AIME, 90,6 % en MATH-500 y 50,0 % en LiveCodeBench. El modelo presenta mezcla de idiomas, bucles de razonamiento recursivos y requiere medidas de seguridad mejoradas. Está disponible en GitHub, Hugging Face y ModelScope.
Fuente: Alibaba Qwen —
original
