Resumo · últimas 24h
- Do CUDA ao MLX: Como o K-Search Traz Décadas de Experiência em Kernels para o Apple Silicon
Pesquisadores do UC Berkeley Sky Lab estenderam o framework de otimização evolutiva de kernels K-Search com um backend MLX para Apple Silicon. Eles desenvolveram uma camada de tradução estruturada de CUDA para MLX que transfere décadas de experiência em otimização CUDA para GPUs da Apple, alcançando desempenho próximo ao de especialistas em kernels de atenção e Mamba SSM.
Fonte: dnb66 · Resumo —
original
