| 2025 | IasRT: Interference-Aware and SLO-Driven GPU Scheduling for Real-Time DNN Inference. | Heming Zhong, Jinhui Wei, Yujia Fu, Dan Huang, Yutong Lu |
| 2025 | Timing-Driven Global Placement with Entropy-Mobility Guided Pin-to-Pin Weighting. | Youzhi Zheng, Zhengjie Zhao, Linhao Lu, Xiaodong Zhu, Wenxin Yu, Jingwei Lu |
| 2025 | Hot-FV: A Semi-Formal Test Generation Framework for RTL Functional Coverage Using Warm Starting States. | Ziyue Zheng, Zhiyuan Yan, Xiangchen Meng, Guangyu Hu, Hongce Zhang, Yangdi Lyu |
| 2025 | ALPHA: A Scalable Lock-Free Partitioned Hash Index for Persistent Memory on NUMA Architectures. | Qiyang Zheng, Hao Hu, Hao Huang, Yanqi Pan, Yifeng Zhang, Wen Xia, Xiangrui Meng, Xudong Li |
| 2025 | RACE-IT: A Reconfigurable Analog Computing Engine for In-Memory Transformer Acceleration. | Lei Zhao, Aishwarya Natarajan, Luca Buonanno, Archit Gajjar, Ron M. Roth, Sergey Serebryakov, John Moon, Omar Eldash, Jim Ignowski, Giacomo Pedretti |
| 2025 | TensTFM: Efficient Total Focusing Method for Ultrasonic Array Imaging on Dataflow Accelerators. | Jieran Zhang, Bizhao Shi, Guojie Luo |
| 2025 | Security Evaluation of Quantum Circuit Split Compilation Under an Oracle-Guided Attack. | Hongyu Zhang, Yuntao Liu |
| 2025 | FlashMP: Fast Discrete Transform-Based Solver for Preconditioning Maxwell's Equations on GPUs. | Haoyuan Zhang, Yaqian Gao, Xinxin Zhang, Jialin Li, Runfeng Jin, Yidong Chen, Feng Zhang, Wu Yuan, Wenpeng Ma, Shan Liang, Jian Zhang, Zhonghua Lu |
| 2025 | TeraNOC: A Multi-Channel 32-Bit Fine-Grained, Hybrid Mesh-Crossbar Noc for Efficient Scale-Up of 1000+ Core Shared-L1-Memory Clusters. | Yichao Zhang, Zexin Fu, Tim Fischer, Yinrong Li, Marco Bertuletti, Luca Benini |
| 2025 | Repo: Proactive Swapping Exploiting Loop Patterns in Modern Applications. | Jiahui Zhang, Qiang Cao, Yekang Zhan, Yuchen Hu, Jie Yao |
| 2025 | A Co-Design Framework for Graph Processing on CPU-GPU Heterogeneous Platforms. | Yuan Zhang, Huawei Cao, Yiming Sun, Ming Dun, Jie Zhang, Xiaochun Ye |
| 2025 | In-DRAM True Random Number Generation Using Simultaneous Multiple-Row Activation: An Experimental Study of Real DRAM Chips. | Ismail Emir Yksel, Ataberk Olgun, F. Nisa Bostanci, Oguzhan Canpolat, Geraldo F. Oliveira, Mohammad Sadrosadati, A. Giray Yagliki, Onur Mutlu |
| 2025 | AICAWS: Arithmetic Intensity Based Cache-Conscious Adaptive Warp Scheduler. | Bo Yuan, Sheng Liu, Zekun Jiang, Jianfeng Cui, Yang Guo |
| 2025 | Threshold Voltage Tuning Technique for Leakage Power Recovery. | Jaejoon Yoon, Taewhan Kim |
| 2025 | Toward Lifelong-Sustainable Electronic-Photonic AI Systems via Extreme Efficiency, Reconfigurability, and Robustness. | Ziang Yin, Hongjian Zhou, Chetan Choppali Sudarshan, Vidya A. Chhabria, Jiaqi Gu |
| 2025 | MH-SpGEMM: Efficient Sparse General Matrix-Matrix Multiplication on Modern GPUs via Masking and Hashing Cooperative Optimization. | Shuang Yang, Yaobin Wang, Ling Li, Qian Peng, Qiong Yu |
| 2025 | Register Bridging: A Lightweight Microarchitectural Approach for Skipping Overhead Instructions in Distance-Based ISA Processors. | Fan Yang, Toru Koizumi, Jun Li, Shu Sugita, Yuriko Yamauchi, Ryota Shioya, Junichiro Kadomoto, Hidetsugu Irie |
| 2025 | ASMA: An Anisotropy Scaling Memristor-Based Accelerator for LLM Inference. | Zijian Xiong, Xiangrui Yang, Yuhang Zhang, Yue Zhou, Jianguo Yang, Yaoyu Tao, Xiangshui Miao, Yuhui He |
| 2025 | Thena: Torus Fully Homomorphic Encryption on Energy-Efficient Heterogeneous Architecture. | Yanze Wu, Md Tanvir Arafin |
| 2025 | A Dynamic Virtual Memory Management System for LLMs on AI Chips. | Gaolin Wei, Zhaorui Zhang, Jiaqi Xu, Chen Jason Zhang, Xin Yao, Benben Liu |
| 2025 | Ghidorah: Fast LLM Inference on Edge with Speculative Decoding and Hetero-Core Parallelism. | Jinhui Wei, Ye Huang, Yuhui Zhou, Jiazhi Jiang, Jiangsu Du |
| 2025 | NatSep: Little-to-No Overhead Data Separation for Log-Structured Storage Using Native Information. | Jinlong Wang, Zhipeng Tan, Yang Xiao, Wenjie Qi, Shikai Tan, Ying Yuan |
| 2025 | DHeLlam: General-Purpose, Automatic Micro-Batch Co-Execution for Distributed LLM Training. | Haiquan Wang, Chaoyi Ruan, Jia He, Jiaqi Ruan, Chengjie Tang, Xiaosong Ma, Cheng Li |
| 2025 | Adaptive ML-KEM: A Configurable HW-SW Architecture for Post-Quantum Cryptography. | Wenkai Wang, Chao Liu, Zhe Sun, Lei Ju, Zimeng Zhou |
| 2025 | Access Frequency-Aware Storage Reduction for Deep Learning Recommendation Model. | Chia-Chun Wang, Chuan-Yao Lai, Ren-Shuo Liu |