ModellenOpen Source 🇺🇸 27.07.2026 16:05

Mistral AI brengt Voxtral Transcribe 2 uit — spraakherkenningsmodellen met ultralage latentie

MistralMistral Mistral AIMistral AI
Mistral AI heeft Voxtral Transcribe 2 gelanceerd, een familie van spraak-naar-tekstmodellen, waaronder Voxtral Mini Transcribe V2 voor batchtranscriptie en Voxtral Realtime voor live toepassingen met een latentie van minder dan 200 milliseconden. Voxtral Realtime is open source onder Apache 2.0. Beide modellen ondersteunen 13 talen en bieden transcriptiekwaliteit van topklasse met sprekerdiarisatie.
Mistral AI heeft Voxtral Transcribe 2 uitgebracht, een nieuwe generatie spraak-naar-tekst-modelfamilie. Het omvat Voxtral Mini Transcribe V2 voor batchtranscriptie en Voxtral Realtime voor live transcriptie met instelbare latentie tot onder de 200 ms. Voxtral Realtime heeft open gewichten onder de Apache 2.0-licentie. Beide modellen ondersteunen 13 talen: Engels, Chinees, Hindi, Spaans, Arabisch, Frans, Portugees, Russisch, Duits, Japans, Koreaans, Italiaans en Nederlands. Voxtral Mini Transcribe V2 bereikt een woordfoutpercentage van ongeveer 4% op de FLEURS-benchmark tegen $0,003 per minuut, waarmee het concurrenten zoals GPT-4o mini Transcribe en Gemini 2.5 Flash overtreft. Het beschikt ook over sprekerdiarisatie, contextuele bias, woordniveau-tijdstempels, ruisbestendigheid en ondersteunt audio tot 3 uur. Voxtral Realtime, met een omvang van 4 miljard parameters, draait efficiënt op edge-apparaten en biedt bijna-offline nauwkeurigheid, zelfs bij een vertraging van 480 ms. Mistral heeft ook een audioplayground gelanceerd in Mistral Studio voor het testen van transcriptie met diarisatie en tijdstempels.
Bron: Mistral AI — origineel
Eerdere berichten over dit onderwerp ↓
Vers nieuws