HC20-T2: Scalable Parallel Programming with CUDA @hotchipsvideos
HC20-T2: Scalable Parallel Programming with CUDA  @hotchipsvideos
Uploaded September 2013 | Updated September 2026, 3 weeks ago
Tutorial 2, Hot Chips 20 (2008), Sunday, August 24, 2008.

Introduction and Scaling Demonstrations
John Nickolls, Nvidia

Scalable Parallel Programming
Michael Garland, Nvidia

Toolkit and Libraries
Massimiliano Fatica, Nvidia

Performance Optimizations
Patrick Legresley, Nvidia

Application Development Experience
Wen-mei Hwu, University of Illinois

Directions
Ian Buck, Nvidia

Panel Discussion
HC20-T2: Scalable Parallel Programming with CUDAHC2025-S1: CPUsHC28-S6: Emerging EmbeddedHC29-S2: IOT/EmbeddedHC29-S5: FPGAsHC33-T2.2: Advanced Packaging, Part 2HC2025-R2: TCMM Awards and Closing RemarksHC30-K1: Spectre/MeltdownHC18-S3: Memory and StorageHC34-S3: AcademiaHC28-S1: GPUs and HPC ProcessorsHC30-S3: IoT/Edge Computing
hotchipsvideos |

HC20-T2: Scalable Parallel Programming with CUDA

SHARE TO X SHARE TO REDDIT SHARE TO FACEBOOK WALLPAPER