1C विकास के लिए AI मॉडल बेंचमार्क: अपडेटेड रैंकिंग v2
Anthropic
OpenAI
Moonshot AI
xAI
Cursor
DeepSeek
Alibaba/Qwen
MiniMax
1C विकास के लिए AI मॉडल का एक अपडेटेड बेंचमार्क जारी किया गया है, जो Claude Opus 5, GPT 5.6 Sol और Kimi K3 जैसे मॉडलों की तुलना करता है। बेंचमार्क कार्यों को श्रेणीबद्ध करता है और टोकन उपयोग को मापता है, जिसमें Opus 5 समग्र रूप से आगे है, लेकिन GPT 5.6 Sol MCP के साथ उत्कृष्ट प्रदर्शन करता है। लेखक मॉडल चयन के लिए व्यक्तिगत सिफारिशें प्रदान करता है।
1C डेवलपमेंट के लिए AI मॉडल का बेंचमार्क संस्करण 2 में अपडेट हो गया है, जिसमें Claude Opus 5, Claude Fable 5, GPT 5.6 Sol, Kimi K3, Claude Opus 4.8, Grok 4.5, Composer 2.5, GPT 5.5, DeepSeek v4, GLM 5.2, Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5 और MiniMax M2.7 जैसे मॉडल शामिल हैं। कार्यों को एल्गोरिदम, आर्किटेक्चर, प्लेटफ़ॉर्म मैकेनिज़्म, प्रदर्शन, मेटाडेटा कार्य और फॉर्म डेवलपमेंट जैसी श्रेणियों में बांटा गया है। बेंचमार्क में कैश को छोड़कर खर्च किए गए टोकन (इनपुट + आउटपुट) को ट्रैक किया जाता है। मॉडल का परीक्षण उनके विक्रेता वातावरण में किया गया: Claude के लिए Claude Code, GPT के लिए Codex, Kimi के लिए Kimi Code, Grok और Composer के लिए Cursor। MCP और स्किल्स/रूल्स के साथ एक वेरिएंट भी शामिल है। बेंचमार्क को GPT 5.6 Sol के साथ Hermes द्वारा निष्पादित किया गया, जिसमें कुछ सुधार किए गए। Claude Opus 5 समग्र नेता है, लेकिन GPT 5.6 Sol MCP के साथ सर्वश्रेष्ठ है क्योंकि यह निर्देशों का बेहतर पालन करता है। Kimi K3 आशाजनक है लेकिन धीमा है। DeepSeek v4 और GLM 5.2 केवल बजट उपयोग के लिए हैं। Qwen 3.8, Sonnet 5, Mimi 2.5 और MiniMax M2.7 को 1C डेवलपमेंट के लिए अनुशंसित नहीं किया गया है। लेखक के व्यक्तिगत स्टैक में जटिल कार्यों के लिए Cursor के साथ Claude Opus, रोज़मर्रा के काम के लिए Grok/Composer, और समीक्षा और स्वायत्त एजेंटों के लिए GPT 5.6 शामिल हैं।
स्रोत: Habr — хаб ИИ —
मूल
