ModelleForschung 🇨🇳 28.07.2026 00:03

Alibaba Qwen veröffentlicht QVQ-Max: Visuelles Denkmodell mit Beweisführung

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen hat offiziell QVQ-Max veröffentlicht, die erste Version eines visuellen Denkmodells. Das Modell kann nicht nur Bilder und Videos erkennen, sondern auch analysieren, Schlussfolgerungen ziehen und Lösungen anbieten. Im MathVision-Benchmark zeigt QVQ-Max eine konsistente Genauigkeitsverbesserung mit zunehmender Länge des Denkprozesses.
Alibaba Qwen hat mit QVQ-Max die erste Version eines visuellen Reasoning-Modells vorgestellt. Das Modell kann Bilder und Videos analysieren und darauf basierend Schlussfolgerungen ziehen, was es ermöglicht, Aufgaben von mathematischen bis hin zu alltäglichen Problemen zu lösen. Im MathVision-Benchmark, der verschiedene multimodale Mathematikaufgaben umfasst, zeigt QVQ-Max eine verbesserte Genauigkeit mit zunehmender maximaler Denkkette. Zu den wichtigsten Fähigkeiten des Modells gehören detaillierte Beobachtung, tiefgehendes Reasoning und flexible Anwendung. Einsatzmöglichkeiten umfassen Unterstützung bei der Arbeit, beim Lernen und im Alltag. Zukünftige Pläne beinhalten die Verbesserung der Erkennungsgenauigkeit, die Ausführung mehrstufiger Aufgaben und die Interaktion mit anderen Modalitäten.
Quelle: Alibaba Qwen — Original
Unsere früheren Beiträge zu diesem Thema ↓
Aktuelle Nachrichten