Kuaishou

Dernières actualités, modèles et sorties d'IA de Kuaishou. ['KAT-Coder-V2.5', 'KAT-Coder-V2.5-Dev', 'Kling', 'Kling 3', 'SRPO-Qwen-32B']

Recherche 🇺🇸

SRPO : nouvelle méthode de RL de Kuaishou 10 fois plus efficace que GRPO pour l'entraînement des LLM

Des chercheurs de Kuaishou ont introduit SRPO, une méthode d'apprentissage par renforcement en deux étapes qui atteint les performances de DeepSeek-R1-Zero sur des tâches de mathématiques et de code en 1/10 des étapes d'entraînement. La méthode résout les problèmes de conflits inter-domaines et d'utilisation inefficace des échantillons inhérents à GRPO standard.

Synced27.07 · 18:04
Modèles 🇺🇸

L'équipe KwaiKAT lance KAT-Coder-V2.5 : un modèle agentiel pour la programmation entraîné sur plus de 100 000 dépôts vérifiables

L'équipe KwaiKAT de Kuaishou a publié KAT-Coder-V2.5, un modèle de codage agentiel conçu pour opérer dans des dépôts logiciels réels. Grâce à AutoBuilder, ils ont créé avec succès plus de 100 000 environnements vérifiables dans 12 langages. Le modèle mène le benchmark PinchBench avec un score de 94,9 et se classe deuxième sur SWE-Bench Pro (65,2). Une version ouverte, KAT-Coder-V2.5-Dev, est disponible sur Hugging Face.

AnthropicAnthropic
MarkTechPost26.07 · 14:01
Infos fraîches