العوامل 🇷🇺 31.07.2026 18:02

مساعد الذكاء الاصطناعي: تدفق المهام المقبولة ينمو ثلاثة عشر ضعفًا

AnthropicAnthropic OpenAIOpenAI
في المشروع، تم تطبيق مساعد الذكاء الاصطناعي - وهو خط تجهيز من YouTrack إلى التحقق في واجهة المستخدم الرسومية. نما تدفق المهام المقبولة من أقل من 5 إلى حوالي 60 أسبوعيًا، مع إغلاق الذكاء الاصطناعي لثلاثة أرباعها. كما تضاعف عدد الطلبات الجديدة تقريبًا ثلاث مرات، وتتلقى نصف المهام أول إصلاح في أقل من يوم.
قام الفريق ببناء خط أنابيب طيار آلي للذكاء الاصطناعي ينقل المهام من YouTrack إلى التحقق في واجهة رسومية ثنائية/ثلاثية الأبعاد حية. قبل الطيار الآلي، كان المشروع يقبل أقل من 5 مهام أسبوعيًا؛ بعد ذلك، حوالي 60، مع تعامل الذكاء الاصطناعي مع ثلاثة أرباعها. كما زادت إيداعات التذاكر الجديدة بنحو ثلاثة أضعاف، جزئيًا لأن المستخدمين بدأوا في الإبلاغ عن المشكلات الآن بعد أن أصبحت الإصلاحات سريعة. انخفض متوسط الوقت حتى أول إصلاح من حوالي ثلاثة أيام إلى أقل من يوم واحد. قام الفريق بتصفية تراكم لأكثر من 700 مهمة، حيث استغرق 144 مهمة عمرها أكثر من تسعة أشهر، وتم قبول ما يقرب من ثلثيها. ومع ذلك، ارتفع معدل إعادة الفتح من حوالي 11% إلى مستويات أعلى، غالبًا لأن البراهين المولدة بواسطة الذكاء الاصطناعي كانت غير مقنعة. ردًا على ذلك، أدخلوا تمريرة تدقيق مستقلة، والتي رفضت العمل في حوالي ثلث العمليات واكتشفت مهام يساء فهمها. عمل النظام لمدة 869 ساعة عبر حوالي ثمانية أسابيع، أي ما يعادل حوالي 2.8 مهندس بدوام كامل. كانت تكلفة الاشتراك الشهري حوالي 500 دولار، بينما التسعير المكافئ القائم على الرموز سيكون حوالي 5700 دولار. كان Claude أرخص ولكنه أقل صرامة، بينما كان Codex أكثر تكلفة ولكنه أفضل في التحقق من الواجهة الرسومية. يخطط الفريق لنقل Codex إلى دور طيار للواجهة الرسومية واستخدام نموذج أبسط للتدقيق.
المصدر: Habr — хаб ИИ — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة