| 2024 | ASPLOS | Cocco: Hardware-Mapping Co-Exploration towards Memory Capacity-Communication Optimization. | Zhanhong Tan, Zijian Zhu, Kaisheng Ma |
| 2024 | HPCA | Gemini: Mapping and Architecture Co-exploration for Large-scale DNN Chiplet Accelerators. | Jingwei Cai, Zuotong Wu, Sen Peng, Yuchen Wei, Zhanhong Tan, Guiming Shi, Mingyu Gao, Kaisheng Ma |
| 2024 | ICCAD | LACO: A Latency-Constraint Offline Neural Network Scheduler towards Reliable Self-Driving Perception. | Kaisheng Ma, Zhanhong Tan, Zijian Zhu, Mengdi Wu |
| 2022 | DAC | YOLoC: deploy large-scale neural network by ROM-based computing-in-memory using residual branch on a chip. | Yiming Chen, Guodong Yin, Zhanhong Tan, Mingyen Lee, Zekun Yang, Yongpan Liu, Huazhong Yang, Kaisheng Ma, Xueqing Li |
| 2022 | ICML | Finding the Task-Optimal Low-Bit Sub-Distribution in Deep Neural Networks. | Runpei Dong, Zhanhong Tan, Mengdi Wu, Linfeng Zhang, Kaisheng Ma |
| 2021 | ISCA | NN-Baton: DNN Workload Orchestration and Chiplet Granularity Exploration for Multichip Accelerators. | Zhanhong Tan, Hongyu Cai, Runpei Dong, Kaisheng Ma |
| 2020 | DAC | PCNN: Pattern-based Fine-Grained Regular Pruning Towards Optimizing CNN Accelerators. | Zhanhong Tan, Jiebo Song, Xiaolong Ma, Sia Huat Tan, Hongyang Chen, Yuanqing Miao, Yifu Wu, Shaokai Ye, Yanzhi Wang, Dehui Li, Kaisheng Ma |