| 2025 | REACT3D: Real-time Edge Accelerator for Incremental Training in 3D Gaussian Splatting based SLAM Systems. | Hongyi Wang, Zhenhua Zhu, Tianchen Zhao, Yunfei Xiang, Zehao Wang, Jincheng Yu, Huazhong Yang, Yuan Xie, Yu Wang |
| 2025 | MCBP: A Memory-Compute Efficient LLM Inference Accelerator Leveraging Bit-Slice-enabled Sparsity and Repetitiveness. | Huizheng Wang, Zichuan Wang, Zhiheng Yue, Yousheng Long, Taiquan Wei, Jianxun Yang, Yang Wang, Chao Li, Shaojun Wei, Yang Hu, Shouyi Yin |
| 2025 | Security and Performance Implications of GPU Cache Eviction Priority Hints. | Qizhong Wang, Xiangyue Huang, Yanan Guo, Yuanchao Xu |
| 2025 | YOUTIAO: Hybrid Multiplexing with Dynamic Qubit Grouping for Low-cost and Scalable Quantum Wiring. | Wuwei Tian, Liqiang Lu, Siwei Tan, Shiyu Li, Hengyi Li, Tianyao Chu, Xuhong Zhang, Mingshuai Chen, Jianwei Yin |
| 2025 | Drishti: Do Not Forget Slicing While Designing Last-Level Cache Replacement Policies for Many-Core Systems. | Sweta, Prerna Priyadarshini, Biswabandan Panda |
| 2025 | FALA: Locality-Aware PIM-Host Cooperation for Graph Processing with Fine-Grained Column Access. | Changmin Shin, Jaeyong Song, Seongmin Na, Jun Sung, Hongsun Jang, Jinho Lee |
| 2025 | A Probabilistic Perspective on Tiling Sparse Tensor Algebra. | Ritvik Sharma, Zi Yu Xue, Nathan Zhang, Rubens Lacouture, Fredrik Kjolstad, Sara Achour, Mark Horowitz |
| 2025 | Citadel: Rethinking Memory Allocation to Safeguard Against Inter-Domain Rowhammer Exploits. | Anish Saxena, Walter Wang, Alexandros Daglis |
| 2025 | OmniSim: Simulating Hardware with C Speed and RTL Accuracy for High-Level Synthesis Designs. | Rishov Sarkar, Cong Hao |
| 2025 | RayN: Ray Tracing Acceleration with Near-memory Computing. | Mohammadreza Saed, Prashant J. Nair, Tor M. Aamodt |
| 2025 | Flexing RISC-V Instruction Subset Processors to Extreme Edge. | Alireza Raisiardali, Konstantinos Iordanou, Jedrzej Kufel, Kowshik Gudimetla, Kris Myny, Emre Ozer |
| 2025 | LongSight: Compute-Enabled Memory to Accelerate Large-Context LLMs via Sparse Attention. | Derrick Quinn, E. Ezgi Ycel, Jinkwon Kim, Jos F. Martnez, Mohammad Alian |
| 2025 | Optimizing All-to-All Collective Communication with Fault Tolerance on Torus Networks. | Le Qin, Junwei Cui, Weilin Cai, Meng Niu, Yan Yang, Jiayi Huang |
| 2025 | Symbiotic Task Scheduling and Data Prefetching. | Gilead Posluns, Mark C. Jeffrey |
| 2025 | GCC: A 3DGS Inference Architecture with Gaussian-Wise and Cross-Stage Conditional Processing. | Minnan Pei, Gang Li, Junwen Si, Zeyu Zhu, Zitao Mo, Peisong Wang, Zhuoran Song, Xiaoyao Liang, Jian Cheng |
| 2025 | EcoCore: Dynamic Core Management for Improving Energy Efficiency in Latency-Critical Applications. | Gyeongseo Park, Minho Kim, Ki-Dong Kang, Yunhyeong Jeon, Seulki Kim, Daehoon Kim |
| 2025 | A. Delegato: Locality-Aware Atomic Memory Operations on Chiplets. | Vctor Soria Pardos, Adri Armejach, Tiago Mck, Daro Surez Gracia, Jos A. Joao, Miquel Moret |
| 2025 | Empowering Vector Architectures for ML: The CAMP Architecture for Matrix Multiplication. | Mohammadreza Esmali Nojehdeh, Hossein Mokhtarnia, Julian Pavon, Narcs Rodas, Roger Figueras Bagu, Enrico Reggiani, Miquel Moret, Osman S. Unsal, Adrin Cristal, Eduard Ayguad |
| 2025 | One Flew over the Stack Engine's Nest: Practical Microarchitectural Attacks on the Stack Engine. | Silvan Niederer, Sandro Regge, Ali Hajiabadi, Kaveh Razavi |
| 2025 | Accurate Leakage Speculation for Quantum Error Correction. | Chaithanya Naik Mude, Swamit Tannu |
| 2025 | Boosting Task Scheduling Data Locality with Low-latency, HW-accelerated Label Propagation. | Lucas Morais, Juan Miguel De Haro Ruiz, Alfredo Goldman, Guido Araujo, Giacomo Pedretti, Jim Ignowski, Michael Frank, Xavier Martorell, Daniel Jimnez-Gonzlez, Carlos lvarez |
| 2025 | SymbFuzz: Symbolic Execution Guided Hardware Fuzzing. | Samit Shahnawaz Miftah, Amisha Srivastava, Hyunmin Kim, Shiyi Wei, Kanad Basu |
| 2025 | Efficient Security Support for CXL Memory through Adaptive Incremental Offloaded (Re-)Encryption. | Chuanhan Li, Jishen Zhao, Yuanchao Xu |
| 2025 | C3ache: Towards Hierarchical Cache-Centric Computing for Sparse Matrix Multiplication on GPGPUs. | Xiaojie Li, Mingyu Wang, Baiqing Zhong, Haiqiu Huang, Guangjie Cao, Zhiyi Yu |
| 2025 | Elk: Exploring the Efficiency of Inter-core Connected AI Chips with Deep Learning Compiler Techniques. | Yiqi Liu, Yuqi Xue, Noelle Crawford, Jilong Xue, Jian Huang |