Profil di PyTorch (Bagian 3): Profil adalah yang utama
Tulisan ini memprofil mekanisme attention di PyTorch, membandingkan attention naif, optimasi in-place, dan backend Scaled Dot Product Attention (SDPA). Hasilnya menunjukkan bahwa backend matematika SDPA lebih lambat daripada attention naif karena pemanfaatan Tensor Core yang kurang maksimal, rekonstruksi mask, dan overhead softmax aman.
PyTorch
NVIDIA
Hugging Face blog29.07 · 23:03

