⚡ ÚLTIMA HORA
Kimi K3: 2.8 billones de parámetros y lo que aún podemos aprender del benchmark Pelican
Moonshot AI
DeepSeek
Anthropic
OpenAI
Google/DeepMind
El laboratorio chino de IA Moonshot AI ha lanzado Kimi K3, un modelo de 2.8 billones de parámetros, afirmando que supera a Claude Opus 4.8 y GPT-5.5, pero se queda atrás de Claude Fable 5 y GPT-5.6 Sol. El modelo está disponible a través del sitio web y la API, con la promesa de pesos abiertos para el 27 de julio de 2026. Simon Willison lo probó con su benchmark SVG de un 'pelícano en bicicleta', notando un alto costo y un uso intensivo de tokens de razonamiento.
Moonshot AI ha anunciado Kimi K3, su modelo más potente con 2,8 billones de parámetros, ya disponible a través de su sitio web y API. El lanzamiento de pesos abiertos está previsto para el 27 de julio de 2026. Moonshot afirma que supera a Claude Opus 4.8 y GPT-5.5 en evaluaciones comparativas propias, pero pierde contra Claude Fable 5 y GPT-5.6 Sol. El precio es de 3 dólares por millón de tokens de entrada y 15 dólares por millón de tokens de salida, lo que lo convierte en el modelo de inteligencia artificial chino más caro hasta la fecha. Simon Willison probó K3 con su benchmark de SVG de pelícano a través de OpenRouter, pagando 0,25 dólares por la salida. El modelo utilizó 95 tokens de entrada y 16.658 tokens de salida (13.241 tokens de razonamiento). El SVG generado era de mala calidad visual, pero el texto alternativo era bueno. Willison señala que el benchmark del pelícano ya no es predictivo de la calidad general del modelo, pero sigue siendo útil para pruebas 'hola mundo', estimación de costos y verificación de capacidades básicas.
Fuente: Simon Willison —
original
