QwQ: Tiefe Reflexion über die Grenzen des Unbekannten
Alibaba/Qwen
Alibabas Qwen-Team hat QwQ-32B-Preview veröffentlicht, ein experimentelles Reasoning-Modell, das in Mathematik und Programmierung hervorragende Leistungen erbringt, aber Einschränkungen wie Sprachmischung und rekursive Schleifen aufweist.
Das Qwen-Team von Alibaba hat QwQ-32B-Preview veröffentlicht, ein experimentelles Reasoning-Modell, das tief nachdenkt und Annahmen hinterfragt, bevor es antwortet. Es erzielt starke Benchmark-Ergebnisse: 65,2 % bei GPQA, 50,0 % bei AIME, 90,6 % bei MATH-500 und 50,0 % bei LiveCodeBench. Das Modell weist Sprachmischung und rekursive Reasoning-Schleifen auf und erfordert verbesserte Sicherheitsmaßnahmen. Es ist auf GitHub, Hugging Face und ModelScope verfügbar.
Quelle: Alibaba Qwen —
Original
