Независимое тестирование: Kimi K3 превосходит GPT-5.6 Sol в агентных сценариях
Независимое стороннее тестирование показало, что модель Kimi K3 от Moonshot AI превосходит GPT-5.6 Sol в агентных сценариях, что знаменует значительный сдвиг в конкурентной борьбе. Оценка была сосредоточена на выполнении реальных задач, где Kimi K3 продемонстрировала превосходное планирование, использование инструментов и адаптивное принятие решений по сравнению с конкурентом.
Как сообщает QQ News, независимые сторонние оценки показали, что в агентных сценариях модель Kimi K3 компании Moonshot AI превосходит GPT-5.6 Sol от OpenAI. Тесты были составлены так, чтобы сравнить способность моделей решать сложные многоэтапные задачи, требующие автономного планирования, выбора инструментов и динамической адаптации. Результаты показали, что Kimi K3 демонстрирует более высокую
Показать ещё ↓
Источник: Moonshot Kimi (GNews) —
оригинал
