Mô hìnhỨng dụng 🇷🇺 27.07.2026 05:02

Điểm chuẩn mô hình AI cho phát triển 1C: Xếp hạng cập nhật v2

AnthropicAnthropic OpenAIOpenAI Moonshot AIMoonshot AI xAIxAI CursorCursor DeepSeekDeepSeek Alibaba/QwenAlibaba/Qwen MiniMaxMiniMax
Một điểm chuẩn cập nhật cho các mô hình AI trong phát triển 1C đã được công bố, so sánh các mô hình như Claude Opus 5, GPT 5.6 Sol và Kimi K3. Điểm chuẩn phân loại các tác vụ và đo lường mức sử dụng token, với Opus 5 dẫn đầu tổng thể nhưng GPT 5.6 Sol vượt trội với MCP. Tác giả đưa ra các khuyến nghị cá nhân cho việc lựa chọn mô hình.
Bảng xếp hạng (benchmark) cho các mô hình AI trong phát triển 1C đã được cập nhật lên phiên bản 2, bao gồm các mô hình như Claude Opus 5, Claude Fable 5, GPT 5.6 Sol, Kimi K3, Claude Opus 4.8, Grok 4.5, Composer 2.5, GPT 5.5, DeepSeek v4, GLM 5.2, Qwen 3.8 Max, Claude Sonnet 5, Mimi 2.5 và MiniMax M2.7. Các tác vụ được chia thành các danh mục như thuật toán, kiến trúc, cơ chế nền tảng, hiệu năng, làm việc với metadata và phát triển biểu mẫu. Bảng xếp hạng theo dõi số token đã sử dụng (đầu vào + đầu ra), không bao gồm cache. Các mô hình được thử nghiệm trong môi trường của nhà cung cấp: Claude Code cho Claude, Codex cho GPT, Kimi Code cho Kimi, Cursor cho Grok và Composer. Một biến thể với MCP (Model Context Protocol) và kỹ năng/quy tắc cũng được đưa vào. Bảng xếp hạng được thực hiện bởi Hermes với GPT 5.6 Sol, có một số hiệu chỉnh. Claude Opus 5 dẫn đầu tổng thể, nhưng GPT 5.6 Sol tốt nhất với MCP nhờ khả năng tuân thủ hướng dẫn tốt hơn. Kimi K3 hứa hẹn nhưng chậm. DeepSeek v4 và GLM 5.2 chỉ dành cho các mục đích tiết kiệm ngân sách. Qwen 3.8, Sonnet 5, Mimi 2.5 và MiniMax M2.7 không được khuyến nghị cho phát triển 1C. Bộ công cụ cá nhân của tác giả bao gồm Cursor với Claude Opus cho các tác vụ phức tạp, Grok/Composer cho công việc hàng ngày và GPT 5.6 để xem xét và các tác nhân tự động.
Nguồn: Habr — хаб ИИ — bản gốc
Bài viết liên quan trước đây ↓
Tin mới