من يقود فعليًا في التطوير الوكيلي؟ ليس من تظن

AnthropicAnthropic DeepSeekDeepSeek OpenAIOpenAI Google/DeepMindGoogle/DeepMind Alibaba/QwenAlibaba/Qwen
تجربة إنتاجية استمرت أسبوعين أجراها مطور واحد باستخدام البرمجة الوكيلية تحت حزمة حوكمة استهلكت 8.8 مليار رمز عبر 30,993 طلبًا. تكشف التكاليف عن فجوة سعرية تبلغ 72 ضعفًا بين نماذج Anthropic وDeepSeek، مدفوعة بتقنية ضغط ذاكرة التخزين المؤقت للمفاتيح والقيم بنسبة 93%، مما يجعل الحوكمة ميسورة التكلفة فقط مع بنية DeepSeek.
تقرير المقال أن تجربة إنتاج استمرت أسبوعين في يونيو 2026، حيث استخدم مطور واحد أدوات البرمجة الوكيلة مع حزمة حوكمة، استهلكت 8.82 مليار رمز في 30,993 طلبًا، مع نسبة 99.38% من الإصابات في ذاكرة التخزين المؤقت. يتراوح الحمل الزائد للسياق بسبب الحوكمة (السياسات، المهارات، مطالبات المراجعة) بين 70,000 و90,000 رمز لكل استدعاء. تختلف التكاليف بشكل كبير حسب النموذج: نموذج Sonnet 4.6 من Anthropic سيكلف 4,770 دولارًا لنفس عبء العمل مع نسبة إصابة واقعية تبلغ 92% في ذاكرة التخزين المؤقت، بينما كلف نموذج DeepSeek V4 Pro فقط 66.17 دولارًا، أي بفارق 72 مرة. ينبع هذا الفارق من آلية الانتباه الكامن متعدد الرؤوس (MLA) في DeepSeek، التي تضغط ذاكرة التخزين المؤقت KV بنسبة 93.3%، مما يجعل قراءات ذاكرة التخزين المؤقت شبه مجانية ويسمح ببقاء هذه الذاكرة لأيام على أقراص SSD التجارية عبر نظام 3FS، بينما تستخدم Anthropic وOpenAI وGoogle آليات GQA/MHA مع ذاكرات تخزين مؤقت تنتهي صلاحيتها خلال ساعة بسبب حدود ذاكرة HBM. كما يذكر المقال حوادث في شركات أوبر ومايكروسوفت وأمازون وبينتريست ومؤسسة غير مسماة، تُظهر تكاليف خارجة عن السيطرة بسبب الاستخدام غير المنضبط للوكلاء، ويجادل بأن الاختيار المعماري لـ DeepSeek يجعل الحوكمة مجدية اقتصاديًا، على عكس البدائل الأغلى ثمناً التي تدفع الفرق إلى تقليص تدابير السلامة.
المصدر: Habr — хаб ИИ — الأصلي
منشوراتنا السابقة حول هذا الموضوع ↓
أخبار جديدة