Kuaishou

Neueste KI-Nachrichten, Modelle und Releases von Kuaishou. ['KAT-Coder-V2.5', 'KAT-Coder-V2.5-Dev', 'Kling', 'Kling 3', 'SRPO-Qwen-32B']

Forschung 🇺🇸

SRPO: Neue RL-Methode von Kuaishou 10x effizienter als GRPO für LLM-Training

Forscher von Kuaishou haben SRPO entwickelt, eine zweistufige Reinforcement-Learning-Methode, die mit 1/10 der Trainingsschritte DeepSeek-R1-Zero-Niveau bei Mathematik- und Codierungsaufgaben erreicht. Die Methode adressiert domänenübergreifende Konflikte und ineffiziente Sample-Nutzung, die GRPO inhärent sind.

Synced27.07 · 18:04
Modelle 🇺🇸

KwaiKAT-Team bringt KAT-Coder-V2.5 heraus: Ein agentisches Programmiermodell, trainiert auf über 100.000 überprüfbaren Repositories

Das KwaiKAT-Team von Kuaishou hat KAT-Coder-V2.5 veröffentlicht, ein agentisches Codierungsmodell, das für die Arbeit in realen Repositories trainiert wurde. Mit AutoBuilder erstellten sie erfolgreich über 100.000 überprüfbare Umgebungen in 12 Sprachen. Das Modell führt den PinchBench-Benchmark mit einer Punktzahl von 94,9 an und belegt den zweiten Platz bei SWE-Bench Pro (65,2). Eine offene Version, KAT-Coder-V2.5-Dev, ist auf Hugging Face verfügbar.

AnthropicAnthropic
MarkTechPost26.07 · 14:01
Aktuelle Nachrichten