Optimizing Linear Attention in Triton @GPUMODE
Optimizing Linear Attention in Triton  @GPUMODE
Uploaded June 2025 | Updated September 2026, 1 day ago
Speaker: Songlin Yang
Optimizing Linear Attention in TritonLecture 101: Learning CUTLASS the hard wayReinforcement Learning, Agents & OpenEnvLecture 97: HipKittensTLX: Triton-Like Simplicity, a Clear Path to Peak Performance[Live] ScaleML Series Day 3 — Quantization in Large ModelsLecture 100: InferenceX Continuous OSS Inference BenchmarkingLecture 88: TinyTPUcuDNN[Live] ScaleML Series Day 4 — Positional Encodings and PaTH AttentionLecture 4 Compute and Memory BasicsLecture 112: Production Megakernels for Real-World Inference
GPU MODE |

Optimizing Linear Attention in Triton

SHARE TO X SHARE TO REDDIT SHARE TO FACEBOOK WALLPAPER