| 2025 | DAC | SQ-DM: Accelerating Diffusion Models with Aggressive Quantization and Temporal Sparsity. | Zichen Fan, Steve Dai, Rangharajan Venkatesan, Dennis Sylvester, Brucek Khailany |
| 2023 | DAC | Efficient Transformer Inference with Statically Structured Sparse Attention. | Steve Dai, Hasan Genc, Rangharajan Venkatesan, Brucek Khailany |
| 2023 | DAC | Gamora: Graph Learning based Symbolic Reasoning for Large-Scale Boolean Networks. | Nan Wu, Yingjie Li, Cong Hao, Steve Dai, Cunxi Yu, Yuan Xie |
| 2022 | ICML | Optimal Clipping and Magnitude-aware Differentiation for Improved Quantization-aware Training. | Charbel Sakr, Steve Dai, Rangharajan Venkatesan, Brian Zimmer, William J. Dally, Brucek Khailany |
| 2021 | DAC | Softermax: Hardware/Software Co-Design of an Efficient Softmax for Transformers. | Jacob R. Stevens, Rangharajan Venkatesan, Steve Dai, Brucek Khailany, Anand Raghunathan |
| 2021 | FCCM | Clockwork: Resource-Efficient Static Scheduling for Multi-Rate Image Processing Applications on FPGAs. | Dillon Huff, Steve Dai, Pat Hanrahan |
| 2021 | FPGA | Clockwork: Resource-Efficient Static Scheduling for Multi-Rate Image Processing Applications on FPGAs. | Dillon Huff, Steve Dai, Pat Hanrahan |
| 2019 | DAC | Improving Scalability of Exact Modulo Scheduling with Specialized Conflict-Driven Learning. | Steve Dai, Zhiru Zhang |
| 2019 | ICCAD | MAGNet: A Modular Accelerator Generator for Neural Networks. | Rangharajan Venkatesan, Yakun Sophia Shao, Miaorong Wang, Jason Clemons, Steve Dai, Matthew Fojtik, Ben Keller, Alicia Klinefelter, Nathaniel Ross Pinckney, Priyanka Raina, Yanqing Zhang, Brian Zimmer, William J. Dally, Joel S. Emer, Stephen W. Keckler, Brucek Khailany |
| 2018 | FCCM | Fast and Accurate Estimation of Quality of Results in High-Level Synthesis with Machine Learning. | Steve Dai, Yuan Zhou, Hang Zhang, Ecenur Ustun, Evangeline F. Y. Young, Zhiru Zhang |
| 2018 | FPGA | A Scalable Approach to Exact Resource-Constrained Scheduling Based on a Joint SDC and SAT Formulation. | Steve Dai, Gai Liu, Zhiru Zhang |
| 2018 | FPGA | Rosetta: A Realistic High-Level Synthesis Benchmark Suite for Software Programmable FPGAs. | Yuan Zhou, Udit Gupta, Steve Dai, Ritchie Zhao, Nitish Kumar Srivastava, Hanchen Jin, Joseph Featherston, Yi-Hsiang Lai, Gai Liu, Gustavo Angarita Velasquez, Wenping Wang, Zhiru Zhang |
| 2018 | ICCAD | High-level synthesis with timing-sensitive information flow enforcement. | Zhenghong Jiang, Steve Dai, G. Edward Suh, Zhiru Zhang |
| 2017 | ACSSC | Enabling adaptive loop pipelining in high-level synthesis. | Steve Dai, Gai Liu, Ritchie Zhao, Zhiru Zhang |
| 2017 | FPGA | Dynamic Hazard Resolution for Pipelining Irregular Loops in High-Level Synthesis. | Steve Dai, Ritchie Zhao, Gai Liu, Shreesha Srinath, Udit Gupta, Christopher Batten, Zhiru Zhang |
| 2017 | FPGA | Accelerating Face Detection on Programmable SoC Using C-Based Synthesis. | Nitish Kumar Srivastava, Steve Dai, Rajit Manohar, Zhiru Zhang |
| 2015 | DAC | Area-efficient pipelining for FPGA-targeted high-level synthesis. | Ritchie Zhao, Mingxing Tan, Steve Dai, Zhiru Zhang |
| 2015 | FPGA | Mapping-Aware Constrained Scheduling for LUT-Based FPGAs. | Mingxing Tan, Steve Dai, Udit Gupta, Zhiru Zhang |
| 2015 | ICCAD | ElasticFlow: A Complexity-Effective Approach for Pipelining Irregular Loop Nests. | Mingxing Tan, Gai Liu, Ritchie Zhao, Steve Dai, Zhiru Zhang |
| 2014 | DAC | Flushing-Enabled Loop Pipelining for High-Level Synthesis. | Steve Dai, Mingxing Tan, Kecheng Hao, Zhiru Zhang |
| 2014 | ICCAD | Multithreaded pipeline synthesis for data-parallel kernels. | Mingxing Tan, Bin Liu, Steve Dai, Zhiru Zhang |