PolyAI présente Dialog-RSN-1 : un modèle de dialogue audio-natif qui combine la gestion des tours de parole, la reconnaissance vocale, l'appel de fonctions et la génération de réponses
PolyAI a publié Dialog-RSN-1, un modèle de dialogue audio-natif qui traite l'audio directement, en combinant la gestion des tours de parole, la reconnaissance vocale, l'appel de fonctions et la génération de réponses. Le modèle est déjà utilisé en production, fournissant des réponses en moins de 300 ms et améliorant les performances de 11 % sur la rétention et de 37 % sur la latence. Il n'est disponible que via la plateforme PolyAI, sans poids ouverts ni API publique.
PolyAI
OpenAI
Google/DeepMind
Alibaba/Qwen
Mistral
MarkTechPost31.07 · 09:02
