Benchmark of AI Models for 1C Development: Updated Ranking v2
Anthropic
OpenAI
Moonshot AI
xAI
Cursor
DeepSeek
Alibaba/Qwen
MiniMax
An updated benchmark of AI models for 1C development is presented. The testing involves 14 models, including Claude Opus 5, GPT 5.6 Sol, Kimi K3, and others. The leader is recognized as Claude Opus 5, while GPT 5.6 Sol performs best with MCP and instructions.
Автор бенчмарка для разработки на 1С обновил рейтинг моделей, включив 14 моделей: Claude Opus 5, Claude Fable 5, GPT 5.6 Sol, Kimi K3, Claude Opus 4.8, Grok 4.5, Composer 2.5, GPT 5.5, DeepSeek v4, GLM 5.2, Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5 и MiniMax M2.7. Тестирование проводилось в средах вендоров (Claude Code, Codex, Kimi Code, Cursor и др.) с максимальным reasoning effort и отдельным вариантом с MCP-серверами для 1С. Задачи разделены на категории: алгоритмы, архитектура, механизмы платформы, производительность, метаданные и разработка форм. Учитываются потраченные токены без кэша. По результатам Claude Opus 5 признан лучшим для кодинга, но уступает GPT 5.6 Sol в следовании инструкциям при использовании MCP. Kimi K3 показал высокий уровень, но медленную скорость. DeepSeek v4 и GLM 5.2 рекомендованы только при жёсткой экономии и с MCP. Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5 и MiniMax M2.7 не рекомендованы для 1С. В планах — добавить замер времени, полной стоимости и задачи на доработку функционала. Автор использует Cursor с Claude Opus для архитектуры, Grok/Composer для основных задач и GPT 5.6 Sol для ревью и автономных агентов.
出典: Habr — хаб ИИ —
原文
