요약 · 24시간
- CUDA에서 MLX로: K-Search가 수십 년의 커널 전문성을 Apple Silicon에 가져오는 방법
UC Berkeley Sky Lab의 연구자들이 Apple Silicon을 위한 MLX 백엔드로 K-Search 진화적 커널 최적화 프레임워크를 확장했습니다. 이들은 구조화된 CUDA-to-MLX 변환 계층을 개발하여 수십 년의 CUDA 최적화 전문성을 Apple GPU로 전송했으며, 어텐션 및 Mamba SSM 커널에서 전문가 수준에 가까운 성능을 달성했습니다.
출처: dnb66 · 요약 —
원문
