Baidu dévoile sa puce Kunlun Core M100 optimisée pour l'inférence des grands modèles de langage
Baidu
Baidu a présenté sa nouvelle puce Kunlun Core M100, spécialement conçue pour accélérer l'inférence des grands modèles de langage. La puce vise à améliorer l'efficacité et à réduire les coûts des charges de travail en intelligence artificielle.
Baidu a présenté son dernier processeur Kunlun Core M100, optimisé pour la phase d'inférence des grands modèles de langage. Cette puce s'inscrit dans la stratégie de Baidu visant à améliorer son infrastructure d'intelligence artificielle et à soutenir sa famille de modèles ERNIE. Le M100 devrait offrir des améliorations significatives des performances pour les tâches d'inférence des grands modèles de langage.
Source: Baidu ERNIE (GNews) —
original
