نفس الذكاء الاصطناعي، تكاليف مختلفة: اختيار الإطار يغيّر السعر تقريبًا ثلاثة أضعاف
Anthropic
OpenAI
DeepSeek
اختبرت Composio نموذج Deepseek V4 Flash عبر أربعة أطر عمل للوكلاء: Claude Code وCodex وOpenCode وOh My Pi. أظهرت النتائج فروقًا كبيرة في السعر والسرعة: كان OpenCode الأرخص، وClaude Code الأسرع لكنه الأغلى، وOh My Pi الأكثر دقة لكنه الأبطأ.
قامت شركة Composio، المتخصصة في أدوات الذكاء الاصطناعي، باختبار Deepseek V4 Flash في أربعة أطر عمل مختلفة للوكلاء الذكيين: Claude Code وCodex وOpenCode وOh My Pi. وقد نفذوا 30 مهمة باستخدام أدوات حقيقية مثل Gmail وGitHub وSlack وNotion. وكانت النتيجة: لم يتفوق أي إطار عمل في جميع الفئات. حقق Oh My Pi أعلى معدل نجاح (17 من أصل 30) لكنه كان الأبطأ (272 ثانية لكل مهمة). كان OpenCode الأقل تكلفة (0.073 دولارًا لكل مهمة ناجحة)، بينما كان Claude Code الأسرع (122 ثانية) لكنه الأغلى تكلفة (0.195 دولارًا)، على الرغم من استخدامه لأقل عدد من استدعاءات الأدوات ورموز الإخراج. نجحت سبع مهام أو فشلت اعتمادًا فقط على إطار العمل المستخدم. بشكل عام، كانت معدلات النجاح متقاربة، مع انخفاض طفيف في OpenCode حيث بلغ 14 من أصل 30. كانت أكبر الاختلافات في السعر والسرعة: حيث غيّر اختيار إطار العمل التكلفة بنحو ثلاثة أضعاف والسرعة بمقدار 2.2 مرة.
المصدر: The Decoder (DE) —
الأصلي
