Benchmark of AI Models for 1C Development: Updated Ranking v2
Anthropic
OpenAI
Moonshot AI
xAI
Cursor
DeepSeek
Alibaba/Qwen
MiniMax
An updated benchmark of AI models for 1C development is presented. The testing involves 14 models, including Claude Opus 5, GPT 5.6 Sol, Kimi K3, and others. The leader is recognized as Claude Opus 5, while GPT 5.6 Sol performs best with MCP and instructions.
Pembuat benchmark untuk pengembangan di 1С telah memperbarui peringkat model, dengan menyertakan 14 model: Claude Opus 5, Claude Fable 5, GPT 5.6 Sol, Kimi K3, Claude Opus 4.8, Grok 4.5, Composer 2.5, GPT 5.5, DeepSeek v4, GLM 5.2, Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5, dan MiniMax M2.7. Pengujian dilakukan di lingkungan vendor (Claude Code, Codex, Kimi Code, Cursor, dan lainnya) dengan upaya penalaran maksimal serta varian terpisah dengan server Model Context Protocol (MCP) untuk 1С. Tugas dibagi ke dalam kategori: algoritma, arsitektur, mekanisme platform, kinerja, metadata, dan pengembangan formulir. Token yang digunakan diperhitungkan tanpa cache. Berdasarkan hasil, Claude Opus 5 dianggap yang terbaik untuk coding, tetapi kalah dari GPT 5.6 Sol dalam mengikuti instruksi saat menggunakan MCP. Kimi K3 menunjukkan tingkat tinggi, tetapi kecepatan lambat. DeepSeek v4 dan GLM 5.2 hanya direkomendasikan jika anggaran sangat ketat dan dengan MCP. Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5, dan MiniMax M2.7 tidak direkomendasikan untuk 1С. Rencana ke depan adalah menambahkan pengukuran waktu, biaya total, dan tugas untuk perbaikan fungsionalitas. Penulis menggunakan Cursor dengan Claude Opus untuk arsitektur, Grok/Composer untuk tugas utama, dan GPT 5.6 Sol untuk peninjauan serta agen otonom.
Sumber: Habr — хаб ИИ —
asli
