двух из шести дисциплин и как минимум занимает третье место во всех остальных. В качестве универсального агента модель показывает себя ещё лучше, выигрывая три из шести тестов, хотя в целом лидирует Fable 5. Независимая оценка лаборатории Artificial Analysis дала схожие результаты: Kimi набрала 57 баллов по их индексу интеллекта (Intelligence Index), поднявшись с 17-го на 3-е место — всего на три балла отстав от Claude Fable 5 и на два балла от GPT-5.6 Sol. Особенно хорошо Kimi K3 показала себя в агентных задачах и задачах автоматизации, даже обойдя Fable 5 в автоматизации. Частота галлюцинаций у неё заметно выросла по сравнению с версией K2 (51%), однако у Fable 5 (55%) и GPT-5.6 Sol (85%) этот показатель оказался ещё хуже. Это происходит вслед за релизом DeepSeek в январе 2025 года, ставшим ещё одним фундаментальным вызовом для устоявшихся мультимодальных систем искусственного интеллекта (ИИ) от OpenAI, Google и Anthropic, и подтверждает, что модели с открытым исходным кодом способны конкурировать с передовыми западными моделями, несмотря на введённое США эмбарго на поставки чипов.