Forschung RSS

Modelle 🇨🇳

QwQ-32B: Die Kraft des bestärkenden Lernens nutzen

Alibaba Qwen hat das Modell QwQ-32B mit 32 Milliarden Parametern vorgestellt, das durch skalierbares bestärkendes Lernen eine mit DeepSeek-R1 (671 Milliarden Parameter) vergleichbare Leistung erzielt. Das Modell wird unter der Apache-2.0-Lizenz als Open Source bereitgestellt und kombiniert Schlussfolgerungsfähigkeiten mit Agentenfunktionen.

Alibaba/QwenAlibaba/Qwen DeepSeekDeepSeek OpenAIOpenAI
Alibaba Qwen28.07 · 01:05
Aktuelle Nachrichten