AudioToText: تحويل تسجيلات الاجتماعات إلى أداة لإدارة المتطلبات
MLX Whisper
يقدم المقال AudioToText، وهو مشروع شخصي يحول تسجيلات الاجتماعات إلى مادة منظمة لإدارة المتطلبات. يجمع بين التعرف على الكلام، وتقسيم المتحدثين، ومعالجة اللغة الطبيعية (NLP) لإنتاج ملخصات لكل اجتماع ومتحدث وكيان، مما يساعد في تحديد المتطلبات المتضاربة والحفاظ على سجل المناقشات.
نشأ مشروع AudioToText من ممارسة تنفيذ مشاريع ذكاء الأعمال، حيث يقوم المحللون بإجراء مقابلات مع أصحاب المصلحة من العملاء وجمع المتطلبات. ومن المشاكل الشائعة أن يعبّر أشخاص مختلفون عن متطلبات متضاربة لنفس الكيان، وفي غياب نهج منظم، غالبًا ما يتم تفويت هذه التناقضات، مما يؤدي إلى مواصفات فنية غير متسقة. يهدف AudioToText إلى تحويل تسجيلات الاجتماعات إلى أثر منظم يمكن مراجعته ومقارنته واستخدامه لمواءمة المتطلبات. يستخدم المشروع MLX Whisper للتعرف على الكلام، وترميز المتحدثين، ومعالجة اللغة الطبيعية، وواجهة ويب مبنية على Django لمراجعة النتائج وتصديرها. يقوم بتوليد ملخصات من منظور الاجتماع × المتحدث × الكيان، ويدعم التعليق اليدوي على الكيانات المسماة لتقييم الجودة. صُمم المشروع ليعمل محليًا على Apple Silicon للحفاظ على خصوصية البيانات الحساسة داخل المؤسسة. تتضمن الخطط المستقبلية استخدام PostgreSQL وpgvector للمقارنة الدلالية للملخصات للكشف التلقائي عن التعارضات في المتطلبات. كما يميز المشروع بين المستخدمين وأعضاء المشروع والمتحدثين، مع نموذج وصول قائم على الأدوار للمشاهدين والمحللين ومديري المشاريع.
المصدر: Habr — хаб ИИ —
الأصلي
