العواملالأبحاث 🇷🇺 10.08.2026 21:02

خمسة عشر شهرًا من التكنولوجيا المالية مع الوكلاء: منحنى الجودة عبر تاريخ المشروع

AnthropicAnthropic
يصف مطور بخبرة اثنتي عشرة عامًا في لغة Go كيف كتب وكلاء الذكاء الاصطناعي كود منتجه المالي منذ مايو 2025. وقد بنى دائرة جودة تتكون من 130 قاعدة فحص تلتقط الأخطاء الناتجة عن الوكلاء قبل وصولها إلى الالتزامات، وأصبح الكود المكتوب بواسطة الوكلاء الآن أنظف بست مرات من الكود الذي كتبه بنفسه. تتناول المقالة تطور نظام المراقبة هذا ونتائجه.
ألكسندر، مطوّر عن بُعد في شركة ناشئة تعمل في مجال التكنولوجيا المالية، يدير منتجًا ماليًا مغلقًا تكتب فيه وكلاء الذكاء الاصطناعي الكود البرمجي منذ مايو 2025، مع إضافة مشروع دفع ثانٍ في فبراير 2026. لاحظ أن وكلاء الذكاء الاصطناعي يُنتجون فئة مميزة من الأخطاء، مثل إخفاء الأخطاء، والعوائد الاحتياطية، وإرجاع البنيات الفارغة، والتي لا تكشفها أدوات الفحص التقليدية. كتب 50 محللًا مخصصًا داخل المشروع، ثم جمعها في أداة مفتوحة المصدر تُسمى glint، والتي تضم الآن 130 قاعدة. يُظهر منحنى جودة المشروع فترات ثبات وانخفاضًا، حيث يتوافق كل انخفاض مع أحداث محددة مثل عملية التنظيف في يناير (إزالة 140 ألف سطر من الكود الميت) وتحليل الكائن الضخم في أبريل. قام المطوّر بقياس كثافة النتائج الشديدة لكل ألف سطر من كود Go غير الخاص بالاختبارات، وانخفض المنحنى في أبريل 2026 إلى ما دون جودة الكود الذي كتبه بنفسه، ليصبح أنظف بست مرات. كما أجرى مشروع مجموعة تحكم (بدون حلقة الفحص) أظهر تدهورًا في الجودة، وكان لديه روبوت تداول للعملات المشفرة كتبه في عام 2024 بدون وكلاء، وبلغت كثافة النتائج الشديدة فيه 2.32 لكل ألف سطر، بما في ذلك تأكيدات أنواع غير آمنة وأموال في عقود JSON ذات النقاط العائمة. يعمل النظام ككل: قواعد الفحص تلتقط العيوب قبل الالتزام، وأول من يعلم بوجود خطأ هو المدقق وليس العميل. ومع ذلك، لا يلتقط الفحص كل شيء: خطأ حديث حيث تم خصم المال ولكن تم عرضه على أنه غير مخصوم تسلل عبر ثلاث طبقات من الحماية. يخلص المطوّر إلى أن الجودة الآن هي خاصية للبيئة التي يُكتب فيها الكود، وليست خاصية للكاتب.
المصدر: Habr — хаб ИИ — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة