| 2026 | ACL | EQUIP: EQUivariant preserving In-Place updates for Efficient Token Pruning. | Arun Ramachandran, R. Govindarajan, Murali Annavaram, Prakash Sathyanath Raghavendra |
| 2026 | ACL | DELTA: Dynamic Layer-Aware Token Attention for Efficient Long-Context Reasoning. | Hossein Entezari Zarch, Lei Gao, Chaoyi Jiang, Murali Annavaram |
| 2026 | ISCA | MXFFP: Microscaling Flexible Floating Point Format for Large-Scale AI Model Acceleration. | Sungwoo Kim, Sungbin Kim, Dongho Ha, Hyunwuk Lee, Junsung Kim, Seunghyun Lee, Mingu Jung, Murali Annavaram, Won Woo Ro |
| 2026 | ISCA | MC-ORAM: A Mask-Assisted and Counter-Based Non-Deterministic ORAM Inside VM-Based TEEs. | Yongqin Wang, Rachit Rajat, Jonghyun Lee, Mengyuan Li, Murali Annavaram |
| 2026 | SIGIR | HuffmanEmbed: Using Huffman Coding for Embedding Table Compression in Deep Learning Recommendation Models. | Chaoyi Jiang, Abdulla Alshabanah, Hossein Entezari Zarch, Keshav Balasubramanian, Murali Annavaram |
| 2026 | WSDM | SAGERec: Sampling and Gating for Enhanced Long-Tail Item Recommendations. | Abdulla Alshabanah, Yuxin Yang, Murali Annavaram |
| 2025 | ACL | Estimating Privacy Leakage of Augmented Contextual Knowledge in Language Models. | James Flemings, Bo Jiang, Wanrong Zhang, Zafar Takhirov, Murali Annavaram |
| 2025 | ACL | KVPR: Efficient LLM Inference with I/O-Aware KV Cache Partial Recomputation. | Chaoyi Jiang, Lei Gao, Hossein Entezari Zarch, Murali Annavaram |
| 2025 | EMNLP | Mind the Dialect: NLP Advancements Uncover Fairness Disparities for Arabic Users in Recommendation Systems. | Abdulla Alshabanah, Murali Annavaram |
| 2025 | EMNLP | MobiZO: Enabling Efficient LLM Fine-Tuning at the Edge via Inference Engines. | Lei Gao, Amir Ziashahabi, Yue Niu, Salman Avestimehr, Murali Annavaram |
| 2025 | NAACL | On Using Arabic Language Dialects in Recommendation Systems. | Abdulla Alshabanah, Murali Annavaram |
| 2025 | RecSys | LEAF: Lightweight, Efficient, Adaptive and Flexible Embedding for Large-Scale Recommendation Models. | Chaoyi Jiang, Abdulla Alshabanah, Murali Annavaram |
| 2025 | USENIX | HyCache: Hybrid Caching for Accelerating DNN Input Preprocessing Pipelines. | Keshav Vinayak Jha, Shweta Pandey, Murali Annavaram, Arkaprava Basu |
| 2024 | ACL | Differentially Private Knowledge Distillation via Synthetic Text Generation. | James Flemings, Murali Annavaram |
| 2024 | ASPLOS | MPC-Pipe: an Efficient Pipeline Scheme for Semi-honest MPC Machine Learning. | Yongqin Wang, Rachit Rajat, Murali Annavaram |
| 2024 | NAACL | Differentially Private Next-Token Prediction of Large Language Models. | James Flemings, Meisam Razaviyayn, Murali Annavaram |
| 2024 | NAACL | Ethos: Rectifying Language Models in Orthogonal Parameter Space. | Lei Gao, Yue Niu, Tingting Tang, Salman Avestimehr, Murali Annavaram |
| 2024 | RecSys | Biased User History Synthesis for Personalized Long-Tail Item Recommendation. | Keshav Balasubramanian, Abdulla Alshabanah, Elan Markowitz, Greg Ver Steeg, Murali Annavaram |
| 2023 | ISCA | LAORAM: A Look Ahead ORAM Architecture for Training Large Embedding Tables. | Rachit Rajat, Yongqin Wang, Murali Annavaram |
| 2023 | MICRO | SuperBP: Design Space Exploration of Perceptron-Based Branch Predictors for Superconducting CPUs. | Haipeng Zha, Swamit Tannu, Murali Annavaram |
| 2022 | AAAI | SpreadGNN: Decentralized Multi-Task Federated Learning for Graph Neural Networks on Molecular Data. | Chaoyang He, Emir Ceyani, Keshav Balasubramanian, Murali Annavaram, Salman Avestimehr |
| 2022 | HPCA | HiPerRF: A Dual-Bit Dense Storage SFQ Register File. | Haipeng Zha, Naveen Kumar Katam, Massoud Pedram, Murali Annavaram |
| 2022 | ICASSP | Enhancing Privacy Through Domain Adaptive Noise Injection For Speech Emotion Recognition. | Tiantian Feng, Hanieh Hashemi, Murali Annavaram, Shrikanth S. Narayanan |
| 2022 | ISPASS | Characterization of MPC-based Private Inference for Transformer-based Models. | Yongqin Wang, G. Edward Suh, Wenjie Xiong, Benjamin Lefaudeux, Brian Knott, Murali Annavaram, Hsien-Hsin S. Lee |
| 2022 | MICRO | PageORAM: An Efficient DRAM Page Aware ORAM Strategy. | Rachit Rajat, Yongqin Wang, Murali Annavaram |
| 2022 | NAACL | StATIK: Structure and Text for Inductive Knowledge Graph Completion. | Elan Markowitz, Keshav Balasubramanian, Mehrnoosh Mirtaheri, Murali Annavaram, Aram Galstyan, Greg Ver Steeg |
| 2022 | NSDI | Check-N-Run: a Checkpointing System for Training Deep Learning Recommendation Models. | Assaf Eisenman, Kiran Kumar Matam, Steven Ingram, Dheevatsa Mudigere, Raghuraman Krishnamoorthi, Krishnakumar Nair, Misha Smelyanskiy, Murali Annavaram |
| 2021 | MICRO | DarKnight: An Accelerated Framework for Privacy and Integrity Preserving Deep Learning Using Trusted Hardware. | Hanieh Hashemi, Yongqin Wang, Murali Annavaram |
| 2021 | RecSys | cDLRM: Look Ahead Caching for Scalable Training of Recommendation Models. | Keshav Balasubramanian, Abdulla Alshabanah, Joshua D. Choe, Murali Annavaram |
| 2021 | UCC | Jupiter: a networked computing architecture. | Pradipta Ghosh, Quynh Nguyen, Pranav K. Sakulkar, Jason A. Tran, Aleksandra Knezevic, Jiatong Wang, Zhifeng Lin, Bhaskar Krishnamachari, Murali Annavaram, Salman Avestimehr |
| 2020 | ICDCS | Collage Inference: Using Coded Redundancy for Lowering Latency Variation in Distributed Image Classification Systems. | Hema Venkata Krishna Giri Narra, Zhifeng Lin, Ganesh Ananthanarayanan, Salman Avestimehr, Murali Annavaram |
| 2019 | ISCA | GraphSSD: graph semantics aware SSD. | Kiran Kumar Matam, Gunjae Koo, Haipeng Zha, Hung-Wei Tseng, Murali Annavaram |
| 2019 | ISCA | Linebacker: preserving victim cache lines in idle register files of GPUs. | Yunho Oh, Gunjae Koo, Murali Annavaram, Won Woo Ro |
| 2019 | ICS | GPUGuard: mitigating contention based side and covert channel attacks on GPUs. | Qiumin Xu, Hoda Naghibijouybari, Shibo Wang, Nael B. Abu-Ghazaleh, Murali Annavaram |
| 2019 | SC | Slack squeeze coded computing for adaptive straggler mitigation. | Krishna Giri Narra, Zhifeng Lin, Mehrdad Kiamari, Salman Avestimehr, Murali Annavaram |
| 2018 | HPCA | G-TSC: Timestamp Based Coherence for GPUs. | Abdulaziz Tabbakh, Xuehai Qian, Murali Annavaram |
| 2017 | HPCA | Pilot Register File: Energy Efficient Partitioned Register File for GPUs. | Mohammad Abdel-Majeed, Alireza Shafaei, Hyeran Jeon, Massoud Pedram, Murali Annavaram |
| 2017 | HPCA | G-Scalar: Cost-Effective Generalized Scalar Execution Architecture for Power-Efficient GPUs. | Zhenhong Liu, Syed Zohaib Gilani, Murali Annavaram, Nam Sung Kim |
| 2017 | ISCA | Access Pattern-Aware Cache Management for Improving Data Utilization in GPU. | Gunjae Koo, Yunho Oh, Won Woo Ro, Murali Annavaram |
| 2017 | ISPASS | Docker characterization on high performance SSDs. | Qiumin Xu, Manu Awasthi, Krishna T. Malladi, Janki Bhimani, Jingpei Yang, Murali Annavaram |
| 2017 | MICRO | Summarizer: trading communication with computing near storage. | Gunjae Koo, Kiran Kumar Matam, Te I, H. V. Krishna Giri Narra, Jing Li, Hung-Wei Tseng, Steven Swanson, Murali Annavaram |
| 2016 | HPCA | Approximating warps with intra-warp operand value similarity. | Daniel Wong, Nam Sung Kim, Murali Annavaram |
| 2016 | HPCA | Warped-preexecution: A GPU pre-execution approach for improving latency hiding. | Keunsoo Kim, Sangpil Lee, Myung Kuk Yoon, Gunjae Koo, Won Woo Ro, Murali Annavaram |
| 2016 | ISCA | APRES: Improving Cache Efficiency by Exploiting Load Characteristics on GPUs. | Yunho Oh, Keunsoo Kim, Myung Kuk Yoon, Jong Hyun Park, Yongjun Park, Won Woo Ro, Murali Annavaram |
| 2016 | ISCA | Warped-Slicer: Efficient Intra-SM Slicing through Dynamic Resource Partitioning for GPU Multiprogramming. | Qiumin Xu, Hyeran Jeon, Keunsoo Kim, Won Woo Ro, Murali Annavaram |
| 2016 | ISCA | Virtual Thread: Maximizing Thread-Level Parallelism beyond GPU Scheduling Limit. | Myung Kuk Yoon, Keunsoo Kim, Sangpil Lee, Won Woo Ro, Murali Annavaram |
| 2016 | ICS | Origami: Folding Warps for Energy Efficient GPUs. | Mohammad Abdel-Majeed, Daniel Wong, Justin Kuang, Murali Annavaram |
| 2015 | DSN | Warped-RE: Low-Cost Error Detection and Correction in GPUs. | Mohammad Abdel-Majeed, Waleed Dweik, Hyeran Jeon, Murali Annavaram |
| 2015 | ISCA | Warped-compression: enabling power efficient GPUs through register compression. | Sangpil Lee, Keunsoo Kim, Gunjae Koo, Hyeran Jeon, Won Woo Ro, Murali Annavaram |
| 2015 | MICRO | GPU register file virtualization. | Hyeran Jeon, Gokul Subramanian Ravi, Nam Sung Kim, Murali Annavaram |
| 2014 | DATE | Reliability-Aware Exceptions: Tolerating intermittent faults in microprocessor array structures. | Waleed Dweik, Murali Annavaram, Michel Dubois |
| 2014 | DSN | Warped-Shield: Tolerating Hard Faults in GPGPUs. | Waleed Dweik, Mohammad Abdel-Majeed, Murali Annavaram |
| 2014 | HPCA | Implications of high energy proportional servers on cluster-wide energy proportionality. | Daniel Wong, Murali Annavaram |
| 2014 | ITC | Efficient RAS support for die-stacked DRAM. | Hyeran Jeon, Gabriel H. Loh, Murali Annavaram |
| 2013 | DSN | PHYS: Profiled-HYbrid Sampling for soft error reliability benchmarking. | Jinho Suh, Murali Annavaram, Michel Dubois |
| 2013 | HPCA | Warped register file: A power efficient register file for GPGPUs. | Mohammad Abdel-Majeed, Murali Annavaram |
| 2013 | MICRO | Warped gates: gating aware scheduling and power gating for GPGPUs. | Mohammad Abdel-Majeed, Daniel Wong, Murali Annavaram |
| 2012 | HPCA | MACAU: A Markov model for reliability evaluations of caches under Single-bit and Multi-bit Upsets. | Jinho Suh, Murali Annavaram, Michel Dubois |
| 2012 | MICRO | KnightShift: Scaling the Energy Proportionality Wall through Server-Level Heterogeneity. | Daniel Wong, Murali Annavaram |
| 2012 | MICRO | Warped-DMR: Light-weight Error Detection for GPGPU. | Hyeran Jeon, Murali Annavaram |
| 2012 | SECON | Semi-Markov state estimation and policy optimization for energy efficient mobile sensing. | Yi Wang, Bhaskar Krishnamachari, Murali Annavaram |
| 2011 | DSN | Cross-layer resilience using wearout aware design flow. | Bardia Zandian, Murali Annavaram |
| 2011 | HPCA | A case for guarded power gating for multi-core processors. | Niti Madan, Alper Buyuktosunoglu, Pradip Bose, Murali Annavaram |
| 2011 | ISCA | CPPC: correctable parity protected cache. | Mehrtash Manoochehri, Murali Annavaram, Michel Dubois |
| 2011 | SIGMETRICS | Soft error benchmarking of L2 caches with PARMA. | Jinho Suh, Mehrtash Manoochehri, Murali Annavaram, Michel Dubois |
| 2010 | DSN | WearMon: Reliability monitoring using adaptive critical path testing. | Bardia Zandian, Waleed Dweik, Suk Hun Kang, Thomas Punihaole, Murali Annavaram |
| 2010 | ISCA | KnightShift: Shifting the I/O Burden in Datacenters to Management Processor for Energy Efficiency. | Sabyasachi Ghosh, Mark Redekopp, Murali Annavaram |
| 2010 | ISCA | Guarded Power Gating in a Multi-core Setting. | Niti Madan, Alper Buyuktosunoglu, Pradip Bose, Murali Annavaram |
| 2010 | MICRO | Adaptive and Speculative Slack Simulations of CMPs on CMPs. | Jianwei Chen, Lakshmi Kumar Dabbiru, Daniel Wong, Murali Annavaram, Michel Dubois |
| 2009 | DCOSS | Optimal Allocation of Time-Resources for Multihypothesis Activity-Level Detection. | Gautam Thatte, Viktor Rozgic, Ming Li, Sabyasachi Ghosh, Urbashi Mitra, Shrikanth S. Narayanan, Murali Annavaram, Donna Spruijt-Metz |
| 2009 | ICPP | Exploiting Simulation Slack to Improve Parallel Simulation Speed. | Jianwei Chen, Murali Annavaram, Michel Dubois |
| 2009 | ITC | Tolerance of performance degrading faults for effective yield improvement. | Tong-Yu Hsieh, Melvin A. Breuer, Murali Annavaram, Sandeep K. Gupta, Kuen-Jong Lee |
| 2009 | Mobisys | A framework of energy efficient mobile sensing for automatic user state recognition. | Yi Wang, Jialiu Lin, Murali Annavaram, Quinn Jacobson, Jason I. Hong, Bhaskar Krishnamachari, Norman M. Sadeh |
| 2008 | Mobisys | Virtual trip lines for distributed privacy-preserving traffic monitoring. | Baik Hoh, Marco Gruteser, Ryan Herring, Jeff Ban, Daniel B. Work, Juan Carlos Herrera, Alexandre M. Bayen, Murali Annavaram, Quinn Jacobson |
| 2008 | MSWIM | Game theoretic approach to location sharing with privacy in a community-based mobile safety application. | Hua Liu, Bhaskar Krishnamachari, Murali Annavaram |
| 2007 | HPCA | Implications of Device Timing Variability on Full Chip Timing. | Murali Annavaram, Ed Grochowski, Paul Reed |
| 2006 | MICRO | Die Stacking (3D) Microarchitecture. | Bryan Black, Murali Annavaram, Ned Brekelbaum, John DeVale, Lei Jiang, Gabriel H. Loh, Don McCaule, Patrick Morrow, Donald W. Nelson, Daniel Pantuso, Paul Reed, Jeff Rupley, Sadasivan Shankar, John Paul Shen, Clair Webb |
| 2005 | ISCA | Mitigating Amdahl's Law through EPI Throttling. | Murali Annavaram, Ed Grochowski, John Paul Shen |
| 2004 | MICRO | The Fuzzy Correlation between Code and Performance Predictability. | Murali Annavaram, Ryan N. Rakvic, Marzia Polito, Jean-Yves Bouguet, Richard A. Hankins, Bob Davies |
| 2003 | MICRO | Scaling and Charact rizing Database Workloads: Bridging the Gap between Research and Practice. | Richard A. Hankins, Trung A. Diep, Murali Annavaram, Brian Hirano, Harald Eri, Hubert Nueckel, John Paul Shen |
| 2002 | ICCD | Branch Behavior of a Commercial OLTP Workload on Intel IA32 Processors. | Murali Annavaram, Trung A. Diep, John Paul Shen |
| 2001 | HPCA | Call Graph Prefetching for Database Applications. | Murali Annavaram, Jignesh M. Patel, Edward S. Davidson |
| 2001 | ISCA | Data prefetching by dependence graph precomputation. | Murali Annavaram, Jignesh M. Patel, Edward S. Davidson |
| 2000 | ISPASS | Instruction overhead and data locality effects in superscalar processors. | Murali Annavaram, Gary S. Tyson, Edward S. Davidson |