Les modèles d'IA open-source chinois défient l'approche de la Silicon Valley
Moonshot AI
Alibaba/Qwen
DeepSeek
Anthropic
OpenAI
xAI
Des laboratoires chinois d'IA publient une série de modèles open-source puissants, tels que GLM 5.2, Kimi K3 et Qwen 3.8, qui sont presque au niveau des meilleurs équivalents occidentaux. Cela a suscité des inquiétudes à Washington, où des accusations de distillation technologique et des menaces de sanctions ont émergé. L'approche open-source de la Chine contraste avec la stratégie fermée des entreprises américaines, sapant la perception établie de la suprématie américaine et modifiant le paysage mondial de l'IA.
Les laboratoires chinois d'IA continuent leur offensive en publiant des modèles open source quasi à la pointe. Z.ai a lancé GLM 5.2 en juin, Moonshot AI a dévoilé Kimi K3 la semaine dernière, et Alibaba a présenté Qwen 3.8 ce lundi. Ces modèles, en particulier K3, ont suscité une réaction immédiate dans la Silicon Valley et à Washington. Le capital-risqueur et conseiller de Donald Trump pour l'IA, David Sacks, a qualifié la performance du modèle de Moonshot d'« alarmante ». Le secrétaire au Commerce, Scott Bessent, a envisagé la possibilité d'imposer des sanctions contre les entreprises chinoises d'IA. Le directeur du Bureau de la politique scientifique et technologique de la Maison-Blanche, Michael Kratsios, a affirmé que l'administration disposait d'« informations selon lesquelles Moonshot AI aurait distillé Fable d'Anthropic pour développer son modèle K3 », qualifiant cela de « vol de technologie américaine brevetée et de sape de la recherche américaine ». Moonshot AI n'a pas répondu à une demande de commentaire. Les modèles chinois partagent des caractéristiques communes : selon des tests tiers, ils rivalisent presque avec les meilleurs modèles occidentaux, sont optimisés pour les tâches d'agents en programmation, et sont ou seront publiés avec des poids ouverts. Cela rappelle la situation du lancement de DeepSeek R1 en janvier 2025, où l'approche ouverte de DeepSeek avait défié la domination des modèles fermés. Depuis, les laboratoires occidentaux continuent de se tourner vers encore plus de fermeture : Anthropic a restreint Mythos et Fable 5, OpenAI a retardé GPT 5.6 à la demande de la Maison-Blanche. Parallèlement, les startups et géants chinois ont misé davantage sur l'ouverture : leurs modèles peuvent être téléchargés, exécutés localement et modifiés. La plateforme Arena AI classe K3 comme le meilleur modèle pour le développement web et le quatrième pour les tâches d'agents, tandis qu'Artificial Analysis le place en troisième position de l'indice d'intelligence. Après la sortie de la version préliminaire de K3 le 16 juillet, la demande a été si forte que Moonshot a temporairement limité l'inscription de nouveaux utilisateurs. Certains commencent à douter de l'intérêt de payer pour OpenAI ou Anthropic. Le chercheur indépendant Nathan Lambert estime qu'Anthropic a exagéré les risques. Les modèles chinois ont déjà trouvé une application pratique : après que GPT-5.6 Sol a piraté le système Hugging Face, la plateforme a utilisé GLM 5.2 pour analyser l'attaque, car d'autres modèles refusaient d'aider en raison de leurs limitations intégrées. Bien que les modèles chinois soient moins chers par jeton, ils peuvent nécessiter plus de jetons pour résoudre des tâches, ce qui réduit l'écart de coût. L'ancien conseiller de la Maison-Blanche pour l'IA, Dean Ball, tout en louant K3, a noté que le modèle est « très gourmand en jetons » et a remis en question son réel faible coût. Néanmoins, ces modèles sapent l'hypothèse fondamentale selon laquelle des investissements infinis en calcul sont nécessaires pour créer les meilleurs modèles.
Source: Wired AI —
original
