Lecture 60: Optimizing Linear Attention @GPUMODE
Lecture 60: Optimizing Linear Attention  @GPUMODE
Uploaded June 2025 | Updated September 2026, 1 hour ago
Speaker: Songlin Yang
Lecture 60: Optimizing Linear AttentionLecture 8: CUDA Performance ChecklistLecture 16: On Hands ProfilingLecture 17: NCCLLecture 96: TLXLecture 113: Every Microsecond Matters: Achieving Near Speed-of-Light Latency in GPU CollectivesProduction Megakernels for Real-World InferenceLive Quartet 4 bit trainingLecture 24: Scan at the Speed of LightLecture 80: How FlashAttention 4 WorksLecture 39: TorchtitanCornserve: Easy, Fast and Scalable Multimodal AI
GPU MODE |

Lecture 60: Optimizing Linear Attention

SHARE TO X SHARE TO REDDIT SHARE TO FACEBOOK WALLPAPER