IA Chinesa de Peso Aberto: Kimi K3 Desafia os Modelos de Fronteira dos EUA
Moonshot AI
OpenAI
Anthropic
Meta
Mistral
DeepSeek
A startup chinesa Moonshot AI lançou o Kimi K3, um modelo de peso aberto com 2,8 trilhões de parâmetros, alegando desempenho superior em benchmarks. Testes independentes da Artificial Analysis o colocam em terceiro lugar em seu Índice de Inteligência, atrás apenas do Claude Fable 5 e do GPT-5.6 Sol. O Kimi K3 se destaca em tarefas agênticas e de automação, representando um desafio significativo para os modelos de fronteira dos EUA.
A startup chinesa Moonshot AI, apoiada pelo grupo chinês de internet e comércio Alibaba, lançou um modelo de pesos abertos chamado Kimi K3 com 2,8 trilhões de parâmetros. De acordo com benchmarks internos, ele tem um desempenho excepcional, ficando logo atrás das versões de alta qualidade dos concorrentes Claude Fable 5 e GPT-5.6 Sol. Em tarefas de codificação, o Kimi K3 vence em duas das seis disciplinas e fica pelo menos em terceiro lugar em todas as outras. Como agente universal, ele tem um desempenho ainda melhor, vencendo três dos seis testes, enquanto o Fable 5 lidera no geral. Uma avaliação independente do laboratório Artificial Analysis encontrou resultados semelhantes: o Kimi alcançou 57 pontos em seu Índice de Inteligência, saltando da 17ª para a 3ª posição, apenas três pontos atrás do Claude Fable 5 e dois atrás do GPT-5.6 Sol. O Kimi K3 teve um desempenho particularmente bom em tarefas agênticas e de automação, chegando até a superar o Fable 5 em automação. Sua taxa de alucinação aumentou significativamente em comparação com a versão K2 (51%), mas o Fable 5 (55%) e o GPT-5.6 Sol (85%) tiveram desempenho pior nessa métrica. Isso segue o lançamento do DeepSeek em janeiro de 2025 como outro desafio fundamental às IAs multimodais estabelecidas da OpenAI, Google e Anthropic, sugerindo que modelos de código aberto podem competir com modelos de fronteira ocidentais apesar do embargo de chips dos EUA.
Fonte: Heise online —
original
