Matériel et InférenceAgents 🇨🇳 05.08.2026 11:02

Un agent IA perce la forteresse CUDA de Nvidia en 10 heures

NVIDIANVIDIA
Une startup nommée Infinity a utilisé son agent IA Ignition pour développer une pile logicielle de type CUDA pour la startup de puces IA d-Matrix en seulement 10 heures. Cela met en évidence la menace croissante pour l'écosystème CUDA de Nvidia, en particulier sur le marché de l'inférence, mais les experts estiment qu'une véritable disruption est encore loin.
Jeremy Nixon, fondateur de la startup de logiciels d'IA Infinity et ancien chercheur chez Google Brain, a révélé que son équipe a mis seulement 10 heures pour que son agent d'IA Ignition développe un logiciel de type CUDA pour la startup de puces d'IA d-Matrix. Ignition génère des kernels GPU, exécute des tests, détecte les erreurs, mesure les performances et réécrit le code automatiquement, les humains ne fournissant que des orientations générales. Cette nouvelle met en lumière le fait que, bien que l'entraînement des modèles d'IA repose encore fortement sur CUDA, le marché de l'inférence devient un champ de bataille où la domination de CUDA est plus faible. Des entreprises comme d-Matrix, Rebellions et Cerebras ciblent cette brèche. Cependant, les experts avertissent que 10 heures de code généré ne sont pas équivalentes à 20 ans d'écosystème, de bibliothèques et d'outils de vérification de CUDA. Bing Xu, fondateur d'INT21, note que la vérification est le plus grand goulot d'étranglement, pas la génération de code. Chris Lattner de Modular affirme que les agents de codage apportent des améliorations incrémentales et que l'engouement est exagéré. Nvidia utilise également des agents d'IA pour développer CUDA plus rapidement, donc la course dépend de la capacité des concurrents à rattraper leur retard plus vite que Nvidia ne progresse.
Source: QbitAI 量子位 — original
Nos articles précédents sur ce sujet ↓
Infos fraîches