ModelosPesquisa 🇨🇳 28.07.2026 00:03

Alibaba Qwen Lança QVQ-Max: Modelo de Raciocínio Visual com Provas

Alibaba/QwenAlibaba/Qwen
A Alibaba Qwen lança oficialmente o QVQ-Max, sua primeira versão de um modelo de raciocínio visual. O modelo é capaz não apenas de reconhecer imagens e vídeos, mas também de analisá-los, conduzir raciocínio e oferecer soluções. No benchmark MathVision, o QVQ-Max demonstra melhoria consistente de precisão à medida que o comprimento do processo de pensamento aumenta.
A Alibaba apresentou o QVQ-Max, sua primeira versão de um modelo de raciocínio visual. O modelo pode analisar e raciocinar com base em imagens e vídeos, resolvendo tarefas que vão desde problemas matemáticos até desafios cotidianos. No benchmark MathVision, que inclui diversas tarefas multimodais de matemática, o QVQ-Max demonstra maior precisão à medida que o comprimento máximo da cadeia de pensamento aumenta. As principais capacidades do modelo incluem observação detalhada, raciocínio profundo e aplicação flexível. Os casos de uso abrangem assistência no trabalho, aprendizado e vida diária. Os planos futuros envolvem melhorar a precisão do reconhecimento, a execução de tarefas com várias etapas e a interação com outras modalidades.
Fonte: Alibaba Qwen — original
Nossos posts anteriores sobre este tópico ↓
Notícias frescas