QwQ: تأمل عميق في حدود المجهول
Alibaba/Qwen
أفريغ فريق Qwen من Alibaba عن QwQ-32B-Preview، وهو نموذج استدلال تجريبي يتفوق في الرياضيات والبرمجة لكنه يواجه قيودًا مثل خلط اللغات والحلقات التكرارية.
أعلن فريق Qwen من شركة Alibaba عن إصدار QwQ-32B-Preview، وهو نموذج استدلال تجريبي مصمم للتفكير بعمق والتشكيك في الافتراضات قبل الإجابة. يحقق النموذج نتائج اختبارية قوية: 65.2% في GPQA، و50.0% في AIME، و90.6% في MATH-500، و50.0% في LiveCodeBench. يُظهر النموذج خلطًا لغويًا وحلقات استدلال متكررة، ويتطلب إجراءات أمان معززة. وهو متاح على GitHub وHugging Face وModelScope.
المصدر: Alibaba Qwen —
الأصلي
