⚡ EN DIRECT
Kimi K3 : 2,8 billions de paramètres et ce que le benchmark du pélican peut encore nous apprendre
Moonshot AI
DeepSeek
Anthropic
OpenAI
Google/DeepMind
Le laboratoire chinois d’IA Moonshot AI a publié Kimi K3, un modèle de 2,8 billions de paramètres, affirmant qu’il surpasse Claude Opus 4.8 et GPT-5.5, mais reste en retrait face à Claude Fable 5 et GPT-5.6 Sol. Le modèle est disponible via site Web et API, avec des poids ouverts promis pour le 27 juillet 2026. Simon Willison l’a testé avec son benchmark SVG du « pélican sur une bicyclette », notant un coût élevé et une utilisation intensive de jetons de raisonnement.
Moonshot AI a annoncé Kimi K3, leur modèle le plus performant avec 2,8 billions de paramètres, disponible dès maintenant via leur site web et leur API. La publication en open-weight est prévue pour le 27 juillet 2026. Moonshot affirme qu'il surpasse Claude Opus 4.8 et GPT-5.5 selon leurs benchmarks internes, mais qu'il perd face à Claude Fable 5 et GPT-5.6 Sol. Le prix est de 3 dollars par million de tokens d'entrée et de 15 dollars par million de tokens de sortie, ce qui en fait le modèle d'IA chinois le plus cher à ce jour. Simon Willison a testé K3 avec son benchmark SVG du pélican via OpenRouter, payant 0,25 dollar pour la sortie. Le modèle a utilisé 95 tokens d'entrée et 16 658 tokens de sortie (dont 13 241 tokens de raisonnement). Le SVG généré était de mauvaise qualité visuelle, mais le texte alternatif était bon. Willison note que le benchmark du pélican n'est plus prédictif de la qualité globale du modèle, mais reste utile pour les tests 'hello world', l'estimation des coûts et la vérification des capacités de base.
Source: Simon Willison —
original
