ModellenOnderzoek 🇨🇳 28.07.2026 00:03

Alibaba Qwen brengt QVQ-Max uit: visueel redeneermodel met bewijzen

Alibaba/QwenAlibaba/Qwen
Alibaba Qwen heeft officieel QVQ-Max uitgebracht, de eerste versie van een visueel redeneermodel. Het model is niet alleen in staat om afbeeldingen en video's te herkennen, maar ook om ze te analyseren, redeneringen uit te voeren en oplossingen te bieden. In de MathVision-benchmark laat QVQ-Max een consistente verbetering van de nauwkeurigheid zien naarmate de denkproceslengte toeneemt.
Alibaba's Qwen heeft QVQ-Max geïntroduceerd, de eerste versie van een visueel redeneermodel. Het model kan afbeeldingen en video's analyseren en erover redeneren, waarbij het taken oplost variërend van wiskundige tot alledaagse problemen. In de MathVision-benchmark, die diverse multimodale wiskundetaken omvat, vertoont QVQ-Max een verbeterde nauwkeurigheid naarmate de maximale gedachteketenlengte toeneemt. Belangrijke mogelijkheden van het model zijn onder meer gedetailleerde observatie, diepgaand redeneren en flexibele toepassing. Gebruiksscenario's zijn onder meer ondersteuning bij werk, leren en het dagelijks leven. Toekomstige plannen omvatten het verbeteren van de herkenningsnauwkeurigheid, het uitvoeren van meerstapstaken en interactie met andere modaliteiten.
Bron: Alibaba Qwen — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws