PolyAI stellt Dialog-RSN-1 vor: ein Audio-natives Dialogmodell, das Repliksteuerung, Spracherkennung, Funktionsaufruf und Antwortgenerierung vereint
PolyAI hat Dialog-RSN-1 veröffentlicht, ein Audio-natives Dialogmodell, das Audio direkt verarbeitet und Repliksteuerung, Spracherkennung, Funktionsaufruf und Antwortgenerierung vereint. Das Modell wird bereits in der Produktion eingesetzt, liefert Antworten in weniger als 300 ms und verbessert die Kennzahlen zur Gesprächskontrolle um 11 Prozent und zur Latenz um 37 Prozent. Es ist nur über die PolyAI-Plattform verfügbar, ohne offene Gewichte und ohne öffentliche API.
PolyAI
OpenAI
Google/DeepMind
Alibaba/Qwen
Mistral
MarkTechPost31.07 · 09:02
