Benchmark of AI Models for 1C Development: Updated Ranking v2
Anthropic
OpenAI
Moonshot AI
xAI
Cursor
DeepSeek
Alibaba/Qwen
MiniMax
An updated benchmark of AI models for 1C development is presented. The testing involves 14 models, including Claude Opus 5, GPT 5.6 Sol, Kimi K3, and others. The leader is recognized as Claude Opus 5, while GPT 5.6 Sol performs best with MCP and instructions.
1С geliştirme benchmark'ının yazarı, 14 modeli içeren güncellenmiş bir sıralama yayımladı: Claude Opus 5, Claude Fable 5, GPT 5.6 Sol, Kimi K3, Claude Opus 4.8, Grok 4.5, Composer 2.5, GPT 5.5, DeepSeek v4, GLM 5.2, Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5 ve MiniMax M2.7. Testler, satıcı ortamlarında (Claude Code, Codex, Kimi Code, Cursor ve diğerleri) maksimum reasoning çabası ve 1C için MCP sunucuları içeren ayrı bir varyantla gerçekleştirildi. Görevler şu kategorilere ayrıldı: algoritmalar, mimari, platform mekanizmaları, performans, meta veriler ve form geliştirme. Önbellek olmadan harcanan token'lar dikkate alındı. Sonuçlara göre Claude Opus 5 kodlama için en iyisi olarak kabul edildi, ancak MCP kullanırken talimat takibinde GPT 5.6 Sol'un gerisinde kaldı. Kimi K3 yüksek seviye gösterdi ancak yavaş hız sundu. DeepSeek v4 ve GLM 5.2 yalnızca sıkı bütçe ve MCP ile önerildi. Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5 ve MiniMax M2.7 1C için önerilmedi. Gelecek planlar arasında süre, toplam maliyet ölçümü ve işlevsellik iyileştirme görevleri eklemek yer alıyor. Yazar, mimari için Cursor ile Claude Opus, ana görevler için Grok/Composer ve inceleme ile otonom ajanlar için GPT 5.6 Sol kullanıyor.
Kaynak: Habr — хаб ИИ —
orijinal
