PolyAI apresenta Dialog-RSN-1: modelo de diálogo nativo de áudio que combina gerenciamento de turnos, reconhecimento de fala, chamada de funções e geração de respostas
A PolyAI lançou o Dialog-RSN-1, um modelo de diálogo nativo de áudio que processa áudio diretamente, combinando gerenciamento de turnos, reconhecimento de fala, chamada de funções e geração de respostas. O modelo já está em produção, fornecendo respostas em menos de 300 ms e melhorando as métricas em 11% na contenção e 37% na latência. Está disponível apenas através da plataforma PolyAI, sem pesos abertos e sem API pública.
PolyAI
OpenAI
Google/DeepMind
Alibaba/Qwen
Mistral
MarkTechPost31.07 · 09:02
