Benchmark of AI Models for 1C Development: Updated Ranking v2
Anthropic
OpenAI
Moonshot AI
xAI
Cursor
DeepSeek
Alibaba/Qwen
MiniMax
An updated benchmark of AI models for 1C development is presented. The testing involves 14 models, including Claude Opus 5, GPT 5.6 Sol, Kimi K3, and others. The leader is recognized as Claude Opus 5, while GPT 5.6 Sol performs best with MCP and instructions.
1С डेवलपमेंट बेंचमार्क के लेखक ने अपनी मॉडल रैंकिंग को अपडेट करते हुए 14 मॉडलों को शामिल किया है: Claude Opus 5, Claude Fable 5, GPT 5.6 Sol, Kimi K3, Claude Opus 4.8, Grok 4.5, Composer 2.5, GPT 5.5, DeepSeek v4, GLM 5.2, Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5 और MiniMax M2.7। परीक्षण वेंडर एनवायरनमेंट (Claude Code, Codex, Kimi Code, Cursor आदि) में अधिकतम reasoning effort के साथ और 1C के लिए MCP सर्वर वाले एक अलग वेरिएंट में किया गया। कार्यों को श्रेणियों में बांटा गया है: एल्गोरिदम, आर्किटेक्चर, प्लेटफॉर्म मैकेनिज्म, परफॉर्मेंस, मेटाडेटा और फॉर्म डेवलपमेंट। बिना कैश के खर्च किए गए टोकन को ध्यान में रखा जाता है। परिणामों के अनुसार, Claude Opus 5 को कोडिंग के लिए सर्वश्रेष्ठ माना गया है, लेकिन यह MCP का उपयोग करते समय निर्देशों का पालन करने में GPT 5.6 Sol से पीछे है। Kimi K3 ने उच्च स्तर दिखाया, लेकिन गति धीमी थी। DeepSeek v4 और GLM 5.2 को केवल सख्त बचत की स्थिति में और MCP के साथ अनुशंसित किया गया है। Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5 और MiniMax M2.7 को 1C के लिए अनुशंसित नहीं किया गया है। योजना में समय माप, पूरी लागत और फंक्शनैलिटी सुधार के कार्यों को जोड़ना शामिल है। लेखक आर्किटेक्चर के लिए Claude Opus के साथ Cursor, मुख्य कार्यों के लिए Grok/Composer और रिव्यू और ऑटोनॉमस एजेंटों के लिए GPT 5.6 Sol का उपयोग करता है।
स्रोत: Habr — хаб ИИ —
मूल
