Résumé · 24h
- De CUDA à MLX : comment K-Search apporte des décennies d'expertise en optimisation de kernels aux puces Apple Silicon
Des chercheurs du UC Berkeley Sky Lab ont étendu le framework d'optimisation évolutionnaire de kernels K-Search avec un backend MLX pour Apple Silicon. Ils ont développé une couche de traduction structurée de CUDA vers MLX qui transfère des décennies d'expertise en optimisation CUDA aux GPU Apple, atteignant des performances quasi-expertes sur les kernels d'attention et de Mamba SSM.
Source: dnb66 · Résumé —
original
