смешанное внимание по блокам), которая оптимизирует обработку длинных контекстов. Модель была обучена на 15,5 триллионах токенов, что обеспечивает высокую производительность в области кодирования, математики и научных задач. Kimi K2 превосходит такие модели, как GPT-4o и Claude 3.5 Sonnet, в различных тестах, при этом стоимость вывода в 7 раз ниже, чем у GPT-4o. Модель доступна для коммерческого использования в рамках лицензии с открытым исходным кодом, что позволяет разработчикам и предприятиям использовать её в коммерческих целях.