معيار نماذج الذكاء الاصطناعي لتطوير 1C: التصنيف المحدث الإصدار 2
Anthropic
OpenAI
Moonshot AI
xAI
Cursor
DeepSeek
Alibaba/Qwen
MiniMax
تم إصدار معيار محدث لنماذج الذكاء الاصطناعي في تطوير 1C، يقارن نماذج مثل Claude Opus 5 وGPT 5.6 Sol وKimi K3. يصنف المعيار المهام ويقيس استخدام الرموز، مع تصدر Opus 5 بشكل عام ولكن تفوق GPT 5.6 Sol مع MCP. يقدم المؤلف توصيات شخصية لاختيار النموذج.
تم تحديث المعيار المرجعي لنماذج الذكاء الاصطناعي في تطوير 1C إلى الإصدار 2، ويشمل نماذج مثل Claude Opus 5 وClaude Fable 5 وGPT 5.6 Sol وKimi K3 وClaude Opus 4.8 وGrok 4.5 وComposer 2.5 وGPT 5.5 وDeepSeek v4 وGLM 5.2 وQwen 3.8 Max وClaude Sonnet 5 وMimi 2.5 وMiniMax M2.7. تُقسم المهام إلى فئات مثل الخوارزميات والهندسة المعمارية وآليات المنصة والأداء والعمل على البيانات الوصفية وتطوير النماذج. يتتبع المعيار المرجعي عدد الرموز المستهلكة (الإدخال + الإخراج) باستثناء ذاكرة التخزين المؤقت. تم اختبار النماذج في بيئات البائعين الخاصة بهم: Claude Code لـ Claude، وCodex لـ GPT، وKimi Code لـ Kimi، وCursor لـ Grok وComposer. كما تم تضمين متغير مع MCP والمهارات/القواعد. تم تنفيذ المعيار المرجعي بواسطة Hermes باستخدام GPT 5.6 Sol، مع بعض التصحيحات. Claude Opus 5 هو القائد العام، لكن GPT 5.6 Sol هو الأفضل مع MCP بسبب قدرته الأفضل على اتباع التعليمات. Kimi K3 واعد ولكنه بطيء. DeepSeek v4 وGLM 5.2 مناسبان فقط للاستخدام المحدود الميزانية. لا يُوصى بـ Qwen 3.8 وSonnet 5 وMimi 2.5 وMiniMax M2.7 لتطوير 1C. تشمل الحزمة الشخصية للمؤلف Cursor مع Claude Opus للمهام المعقدة، وGrok/Composer للعمل اليومي، وGPT 5.6 للمراجعة والعوامل المستقلة.
المصدر: Habr — хаб ИИ —
الأصلي
