النماذجمفتوح المصدر 🇺🇸 27.07.2026 16:05

ميسترال إيه آي تطلق Voxtral Transcribe 2 — نماذج التعرف على الكلام فائقة الانخفاض في زمن الاستجابة

MistralMistral Mistral AIMistral AI
أطلقت شركة Mistral AI عائلة نماذج تحويل الكلام إلى نص Voxtral Transcribe 2، والتي تشمل Voxtral Mini Transcribe V2 للنسخ الدفعي وVoxtral Realtime للتطبيقات الحية بزمن استجابة أقل من 200 ميلي ثانية. نموذج Voxtral Realtime هو مفتوح الأوزان بموجب ترخيص Apache 2.0. يدعم كلا النموذجين 13 لغة ويوفران جودة نسخ متطورة مع تمييز المتحدثين.
أعلنت شركة ميسترال إيه آي (Mistral AI) عن إطلاق Voxtral Transcribe 2، وهي عائلة جديدة من نماذج تحويل الكلام إلى نص من الجيل التالي. تشمل هذه العائلة نموذج Voxtral Mini Transcribe V2 للنسخ الدفعي، ونموذج Voxtral Realtime للنسخ المباشر مع زمن استجابة قابل للتعديل يصل إلى أقل من 200 مللي ثانية. يتوفر نموذج Voxtral Realtime بأوزان مفتوحة تحت رخصة أباتشي 2.0 (Apache 2.0). يدعم كلا النموذجين 13 لغة: الإنجليزية، الصينية، الهندية، الإسبانية، العربية، الفرنسية، البرتغالية، الروسية، الألمانية، اليابانية، الكورية، الإيطالية، والهولندية. يحقق نموذج Voxtral Mini Transcribe V2 معدل خطأ في الكلمات يبلغ حوالي 4% على معيار FLEURS وبتكلفة 0.003 دولار لكل دقيقة، متجاوزًا بذلك المنافسين مثل GPT-4o mini Transcribe و Gemini 2.5 Flash. كما يتميز النموذج بإمكانية تمييز المتحدثين، وتحيز السياق، والطوابع الزمنية على مستوى الكلمة، ومقاومة الضوضاء، ويدعم ملفات صوتية تصل مدتها إلى 3 ساعات. أما نموذج Voxtral Realtime، الذي يحتوي على 4 مليارات معلمة، فيعمل بكفاءة على الأجهزة الطرفية ويوفر دقة شبه دون اتصال حتى عند تأخير يبلغ 480 مللي ثانية. كما أطلقت ميسترال أيضًا بيئة تجربة صوتية (Audio Playground) في استوديو ميسترال (Mistral Studio) لاختبار النسخ مع تمييز المتحدثين والطوابع الزمنية.
المصدر: Mistral AI — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة