| 2026 | ISCA | Omni-LUT: Energy-Efficient LUT-Based Accelerator with Hardware-Aware KV Cache Quantization. | Cheng-Han Tsai, Kuan-Chen Chou, Yu-Hsin Wang, Chieh-Dun Wen, Tsung Tai Yeh |
| 2025 | HPCA | EDA: Energy-Efficient Inter-Layer Model Compilation for Edge DNN Inference Acceleration. | Bo Ren Pao, I-Chia Chen, En-Hao Chang, Tsung Tai Yeh |
| 2025 | ISCA | AQB8: Energy-Efficient Ray Tracing Accelerator through Multi-Level Quantization. | Yen-Chieh Huang, Chen-Pin Yang, Tsung Tai Yeh |
| 2024 | ASPDAC | WER: Maximizing Parallelism of Irregular Graph Applications Through GPU Warp EqualizeR. | En-Ming Huang, Bo-Wun Cheng, Meng-Hsien Lin, Chun-Yi Lee, Tsung Tai Yeh |
| 2024 | DATE | OC-DLRM: Minimizing the I/O Traffic of DLRM Between Main Memory and OCSSD. | Shang-Hung Ti, Tseng-Yi Chen, Tsung Tai Yeh, Shuo-Han Chen, Yu-Pei Liang |
| 2024 | HPCA | TinyTS: Memory-Efficient TinyML Model Compiler Framework on Microcontrollers. | Yu-Yuan Liu, Hong-Sheng Zheng, Yu Fang Hu, Chen-Fong Hsu, Tsung Tai Yeh |
| 2023 | ASPDAC | COLAB: Collaborative and Efficient Processing of Replicated Cache Requests in GPU. | Bo-Wun Cheng, En-Ming Huang, Chen-Hao Chao, Wei-Fang Sun, Tsung Tai Yeh, Chun-Yi Lee |
| 2021 | HPCA | Deadline-Aware Offloading for High-Throughput Accelerators. | Tsung Tai Yeh, Matthew D. Sinclair, Bradford M. Beckmann, Timothy G. Rogers |
| 2020 | ASPLOS | Dimensionality-Aware Redundant SIMT Instruction Elimination. | Tsung Tai Yeh, Roland N. Green, Timothy G. Rogers |
| 2017 | PPoPP | Pagoda: Fine-Grained GPU Resource Virtualization for Narrow Tasks. | Tsung Tai Yeh, Amit Sabne, Putt Sakdhnagool, Rudolf Eigenmann, Timothy G. Rogers |
| 2012 | UCC | CacheRAID: An Efficient Adaptive Write Cache Policy to Conserve RAID Disk Array Energy. | Tseng-Yi Chen, Tsung Tai Yeh, Hsin-Wen Wei, Yu-Xun Fang, Wei-Kuan Shih, Tsan-sheng Hsu |
| 2010 | GRC | Efficient Parallel Algorithm for Nonlinear Dimensionality Reduction on GPU. | Tsung Tai Yeh, Tseng-Yi Chen, Yen-Chiu Chen, Wei-Kuan Shih |