ModelosInvestigación 🇨🇳 28.07.2026 00:03

Alibaba Qwen lanza QVQ-Max: modelo de razonamiento visual con demostraciones

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen lanza oficialmente QVQ-Max, su primera versión de un modelo de razonamiento visual. El modelo es capaz no solo de reconocer imágenes y videos, sino también de analizarlos, realizar razonamientos y ofrecer soluciones. En el punto de referencia MathVision, QVQ-Max demuestra una mejora constante en la precisión a medida que aumenta la longitud del proceso de pensamiento.
Alibaba ha presentado QVQ-Max, la primera versión de su modelo de razonamiento visual. El modelo puede analizar y razonar basándose en imágenes y vídeos, resolviendo tareas que van desde problemas matemáticos hasta cuestiones cotidianas. En el benchmark MathVision, que incluye diversas tareas multimodales de matemáticas, QVQ-Max muestra una precisión mejorada a medida que aumenta la longitud máxima de la cadena de pensamiento. Las capacidades clave del modelo incluyen observación detallada, razonamiento profundo y aplicación flexible. Los casos de uso incluyen asistencia en el trabajo, el aprendizaje y la vida diaria. Los planes futuros implican mejorar la precisión del reconocimiento, la ejecución de tareas de múltiples pasos y la interacción con otras modalidades.
Fuente: Alibaba Qwen — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas