Uploaded December 2024 | Updated September 2026, 3 weeks ago
Hot Chips 2024, Tuesday, August 27, 2024.
Picasso: An Area/Energy-Efficient End-to-End Diffusion Accelerator with Hyper-Precision Data Type
Sungyeob Yoo, Geonwoo Ko, Seri Ham, Seeyeon Kim, Yi Chen & Joo-Young Kim; Korea Advanced Institute of Science and Technology
NeuGPU: A Neural Graphics Processing Unit for Instant Modeling and Real-Time Rendering for Mobile AR/VR Devices
Junha Ryu, Hankyul Kwon, Wonhoon Park, Zhiyong Li, Beomseok Kwon, Donghyeon Han, Dongseok Im, Sangyeob Kim, Hyungnam Joo, Minsung Kim & Hoi-Jun Yoo; Korea Advanced Institute of Science and Technology
Space-Mate: A 303.5mW Real-Time NeRF SLAM Processor with Sparse Mixture-of-Experts-based Acceleration
Gwangtae Park, Seokchan Song, Haoyang Sang, Dongseok Im, Donghyeon Han, Sangyeob Kim, Hongseok Lee & Hoi-Jun Yoo; Korea Advanced Institute of Science and Technology
A Low-power Large-Language-Model Processor with Big-Little Network and Implicit-Weight-Generation for On-device AI
Sangyeob Kim, Sangjin Kim, Wooyoung Jo, Soyeon Kim, Seongyon Hong, Nayeong Lee & Hoi-Jun Yoo; Korea Advanced Institute of Science and Technology
A 40-nm 13.88-TOPS/W FC-DNN Engine for 16-bit Intelligent Audio Processing Featuring Weight-Sharing and Approximate Computing
Tay-Jyi Lin, Ze Li, Yun-Cheng Chen, Chien-Tung Liu & Jinn-Shyan Wang; National Chung Cheng University, Taiwan
A Trusted Execution Environment RISC-V System on Chip
Binh Kieu-Do-Nguyen, Tuan-Kiet Dang, Khai-Duy Nguyen, Cong-Kha Pham & Trong-Thuc Hoang; University of Electro-Communications
A 1.19GHz 9.52Gsamples/sec Radix-8 FFT Hardware Accelerator in 28nm
Larry Tang, Siyuan Chen, Keshav Harisrikanth, Guanglin Xu, Franz Franchetti & Ken Mai; Carnegie Mellon University
PACE: A Scalable and Energy Efficient CGRA in a RISC-V SoC for Edge Computing Applications
Vishnu Nambiar, Yi Sheng Chong, Thilini Bandara, Dhananjaya Wijerathne, Zhaoying Li, Rohan Juneja, Li-Shiuan Peh, Tulika Mitra & Anh Tuan Do; Institute of Microelectronics, Agency for Science, Technology and Research (A*STAR) and National University of Singapore
LSPU: A 20.7ms Low-latency Point Neural Network-based 3D Perception and Semantic LiDAR SLAM System-on-Chip for Autonomous Driving System
Jueun Jung, Seungbin Kim, Bokyoung Seo, Wuyoung Jang, Sangho Lee, Jeongmin Shin, Donghyeon Han & Kyuho Lee; Ulsan National Institute of Science and Technology
RISC-V-based System-on-Chips for IoT Applications
Khai-Duy Nguyen, Tuan-Kiet Dang, Binh Kieu-Do-Nguyen, Cong-Kha Pham & Trong-Thuc Hoang; University of Electro-Communications (UEC), Tokyo, Japan
A Smart Cache for a SmartNIC! Scaling End-Host Networking to 400Gbps and Beyond
Annus Zulfiqar, Ali Imran, Venkat Kunaparaju, Ben Pfaff, Gianni Antichi & Muhammad Shahbaz; Purdue University
Towards True GPU Performance Scaling for OpenGPU
Blaise Tine & Hyesoon Kim; UCLA
CogniVision: A mW Power envelope SoC for Always-on Smart Vision in 40nm
Anuimesh Gupta, Japesh Vohra & Massimo Alioto; National University of Singapore
NeCTAr and RASoC: Tale of Two Class SoCs for Language Model Inference and Robotics in Intel 16
Viansa Schmulbach, Jason Kim, Ethan Gao, Nikhil Jha, Ethan Wu, Oliver Yu, Ben Oliveau, Xiangwei Kong, Brendan Roberts, Connor McMahon, Lixiang Yin, Vamber Yang, Brendan Brenner, George Moujaes, Boyu Hao, Lucy Revina, Kevin Anderson, Bryan Ngo, Yufeng Chi, Hongyi Huang, Reza Sajadiany, Raghav Gupta, Ella Schwarz, Jennifer Zhou, Ken Ho, Jerry Zhao, Anita Flynn and Borivoje Nikolić; University of California, Berkeley
Hot Chips 2024, Tuesday, August 27, 2024.
Picasso: An Area/Energy-Efficient End-to-End Diffusion Accelerator with Hyper-Precision Data Type
Sungyeob Yoo, Geonwoo Ko, Seri Ham, Seeyeon Kim, Yi Chen & Joo-Young Kim; Korea Advanced Institute of Science and Technology
NeuGPU: A Neural Graphics Processing Unit for Instant Modeling and Real-Time Rendering for Mobile AR/VR Devices
Junha Ryu, Hankyul Kwon, Wonhoon Park, Zhiyong Li, Beomseok Kwon, Donghyeon Han, Dongseok Im, Sangyeob Kim, Hyungnam Joo, Minsung Kim & Hoi-Jun Yoo; Korea Advanced Institute of Science and Technology
Space-Mate: A 303.5mW Real-Time NeRF SLAM Processor with Sparse Mixture-of-Experts-based Acceleration
Gwangtae Park, Seokchan Song, Haoyang Sang, Dongseok Im, Donghyeon Han, Sangyeob Kim, Hongseok Lee & Hoi-Jun Yoo; Korea Advanced Institute of Science and Technology
A Low-power Large-Language-Model Processor with Big-Little Network and Implicit-Weight-Generation for On-device AI
Sangyeob Kim, Sangjin Kim, Wooyoung Jo, Soyeon Kim, Seongyon Hong, Nayeong Lee & Hoi-Jun Yoo; Korea Advanced Institute of Science and Technology
A 40-nm 13.88-TOPS/W FC-DNN Engine for 16-bit Intelligent Audio Processing Featuring Weight-Sharing and Approximate Computing
Tay-Jyi Lin, Ze Li, Yun-Cheng Chen, Chien-Tung Liu & Jinn-Shyan Wang; National Chung Cheng University, Taiwan
A Trusted Execution Environment RISC-V System on Chip
Binh Kieu-Do-Nguyen, Tuan-Kiet Dang, Khai-Duy Nguyen, Cong-Kha Pham & Trong-Thuc Hoang; University of Electro-Communications
A 1.19GHz 9.52Gsamples/sec Radix-8 FFT Hardware Accelerator in 28nm
Larry Tang, Siyuan Chen, Keshav Harisrikanth, Guanglin Xu, Franz Franchetti & Ken Mai; Carnegie Mellon University
PACE: A Scalable and Energy Efficient CGRA in a RISC-V SoC for Edge Computing Applications
Vishnu Nambiar, Yi Sheng Chong, Thilini Bandara, Dhananjaya Wijerathne, Zhaoying Li, Rohan Juneja, Li-Shiuan Peh, Tulika Mitra & Anh Tuan Do; Institute of Microelectronics, Agency for Science, Technology and Research (A*STAR) and National University of Singapore
LSPU: A 20.7ms Low-latency Point Neural Network-based 3D Perception and Semantic LiDAR SLAM System-on-Chip for Autonomous Driving System
Jueun Jung, Seungbin Kim, Bokyoung Seo, Wuyoung Jang, Sangho Lee, Jeongmin Shin, Donghyeon Han & Kyuho Lee; Ulsan National Institute of Science and Technology
RISC-V-based System-on-Chips for IoT Applications
Khai-Duy Nguyen, Tuan-Kiet Dang, Binh Kieu-Do-Nguyen, Cong-Kha Pham & Trong-Thuc Hoang; University of Electro-Communications (UEC), Tokyo, Japan
A Smart Cache for a SmartNIC! Scaling End-Host Networking to 400Gbps and Beyond
Annus Zulfiqar, Ali Imran, Venkat Kunaparaju, Ben Pfaff, Gianni Antichi & Muhammad Shahbaz; Purdue University
Towards True GPU Performance Scaling for OpenGPU
Blaise Tine & Hyesoon Kim; UCLA
CogniVision: A mW Power envelope SoC for Always-on Smart Vision in 40nm
Anuimesh Gupta, Japesh Vohra & Massimo Alioto; National University of Singapore
NeCTAr and RASoC: Tale of Two Class SoCs for Language Model Inference and Robotics in Intel 16
Viansa Schmulbach, Jason Kim, Ethan Gao, Nikhil Jha, Ethan Wu, Oliver Yu, Ben Oliveau, Xiangwei Kong, Brendan Roberts, Connor McMahon, Lixiang Yin, Vamber Yang, Brendan Brenner, George Moujaes, Boyu Hao, Lucy Revina, Kevin Anderson, Bryan Ngo, Yufeng Chi, Hongyi Huang, Reza Sajadiany, Raghav Gupta, Ella Schwarz, Jennifer Zhou, Ken Ho, Jerry Zhao, Anita Flynn and Borivoje Nikolić; University of California, Berkeley










