العواملمفتوح المصدر 🇺🇸 27.07.2026 16:04

اختبار ريلز على الطيار الآلي: وكيل ذكاء اصطناعي يكتب الاختبارات بدلاً من المطورين

MistralMistral
طورت شركة Mistral AI وكيلاً مستقلاً يعمل فوق مساعد البرمجة مفتوح المصدر الخاص بها Vibe، حيث يقرأ ملفات مصدر إطار العمل ريلز، ويُولد أو يُحسّن اختبارات RSpec، ويُشغّل في مسار التكامل المستمر/التسليم المستمر (CI/CD) دون تدخل بشري. حقق الوكيل معدل نجاح اختبارات وتغطية برمجية بنسبة 100% على قاعدة بيانات حقيقية مكونة من 275 ملفاً، مع درجة جودة بلغت 0.74 باستخدام نموذج اللغة كحَكَم، مقارنة بـ0.49 على الملفات التي كانت تحتوي أصلاً على اختبارات.
طورت شركة Mistral AI عميلًا ذاتيًا يعمل على إنشاء وتحسين اختبارات RSpec لتطبيقات Ruby on Rails. يعمل العميل فوق Vibe، مساعد Mistral مفتوح المصدر للبرمجة، ويتعامل مع خمسة أنواع رئيسية من الملفات: النماذج، المسلسلات، وحدات التحكم، البريد الإلكتروني، والمساعدات. تشمل التقنيات الرئيسية هندسة السياق عبر ملف AGENTS.md الذي يوفر خطة تنفيذ خطوة بخطوة وخطوة مراجعة ذاتية إجبارية، وملفات SKILLS متخصصة لكل نوع ملف، وأدوات مخصصة للتدقيق (RuboCop) وفحص التغطية (SimpleCov). صُمم العميل ليعمل بشكل متوازٍ، مع معالجة عدة ملفات في وقت واحد. في تجربة على مستودع يضم 275 ملفًا مصدريًا (نصفها بدون اختبارات)، حقق العميل نسبة نجاح اختبارات 100% وتغطية سطور 100%، مع عدم وجود أي انتهاكات لـ RuboCop. تحسنت درجة تقييم LLM-as-a-judge الإجمالية للملفات التي كانت تحتوي على اختبارات بالفعل من 0.49 إلى 0.74. سجلت النماذج أعلى درجة (0.81) ووحدات التحكم أدنى درجة (0.67). كان القرار الأكثر تأثيرًا هو دمج SimpleCov مع تنفيذ RSpec كخطوة أخيرة، مما أجبر العميل على تشغيل كل اختبار كتبه؛ في البداية، نجح ثلث الاختبارات فقط عند التشغيل الأول، لكن العميل صحح جميع حالات الفشل ذاتيًا.
المصدر: Mistral AI — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة