Esha Choukse
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
9
Active years
2016–2026
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | NSDI | Harvesting Spare CPU Resources in Container Systems. | Adam Hall, Anirudh Sarma, Esha Choukse, Umakishore Ramachandran, Sameh Elnikety |
| 2026 | NSDI | DroidSpeak: KV Cache Sharing Across Fine-tuned Model Variants. | Yuhan Liu, Yuyang Huang, Jiayi Yao, Shaoting Feng, Zhuohan Gu, Kuntai Du, Hanchen Li, Yihua Cheng, Junchen Jiang, Shan Lu, Madan Musuvathi, Esha Choukse |
| 2025 | ASPLOS | TAPAS: Thermal- and Power-Aware Scheduling for LLM Inference in Cloud Platforms. | Jovan Stojkovic, Chaojie Zhang, igo Goiri, Esha Choukse, Haoran Qiu, Rodrigo Fonseca, Josep Torrellas, Ricardo Bianchini |
| 2025 | CLOUD | ModServe: Modality- and Stage-Aware Resource Disaggregation for Scalable Multimodal Model Serving. | Haoran Qiu, Anish Biswas, Zihan Zhao, Jayashree Mohan, Alind Khare, Esha Choukse, igo Goiri, Zeyu Zhang, Haiying Shen, Chetan Bansal, Ramachandran Ramjee, Rodrigo Fonseca |
| 2025 | EMNLP | Slim-SC: Thought Pruning for Efficient Scaling with Self-Consistency. | Colin Hong, Xu Guo, Anand Chaanan Singh, Esha Choukse, Dmitrii Ustiugov |
| 2025 | HotOS | Towards Resource-Efficient Compound AI Systems. | Gohar Irfan Chaudhry, Esha Choukse, igo Goiri, Rodrigo Fonseca, Adam Belay, Ricardo Bianchini |
| 2025 | HPCA | DynamoLLM: Designing LLM Inference Clusters for Performance and Energy Efficiency. | Jovan Stojkovic, Chaojie Zhang, igo Goiri, Josep Torrellas, Esha Choukse |
| 2024 | ASPLOS | Characterizing Power Management Opportunities for LLMs in the Cloud. | Pratyush Patel, Esha Choukse, Chaojie Zhang, igo Goiri, Brijesh Warrier, Nithish Mahalingam, Ricardo Bianchini |
| 2024 | ISCA | DyLeCT: Achieving Huge-page-like Translation Performance for Hardware-compressed Memory. | Gagandeep Panwar, Muhammad Laghari, Esha Choukse, Xun Jian |
| 2024 | ISCA | Splitwise: Efficient Generative LLM Inference Using Phase Splitting. | Pratyush Patel, Esha Choukse, Chaojie Zhang, Aashaka Shah, igo Goiri, Saeed Maleki, Ricardo Bianchini |
| 2024 | ISCA | SmartOClock: Workload- and Risk-Aware Overclocking in the Cloud. | Jovan Stojkovic, Pulkit A. Misra, igo Goiri, Sam Whitlock, Esha Choukse, Mayukh Das, Chetan Bansal, Jason Lee, Zoey Sun, Haoran Qiu, Reed Zimmermann, Savyasachi Samal, Brijesh Warrier, Ashish Raniwala, Ricardo Bianchini |
| 2024 | ISCA | Designing Cloud Servers for Lower Carbon. | Jaylen Wang, Daniel S. Berger, Fiodar Kazhamiaka, Celine Irvene, Chaojie Zhang, Esha Choukse, Kali Frost, Rodrigo Fonseca, Brijesh Warrier, Chetan Bansal, Jonathan Stern, Ricardo Bianchini, Akshitha Sriraman |
| 2024 | MICRO | Memory Allocation Under Hardware Compression. | Muhammad Laghari, Yuqing Liu, Gagandeep Panwar, David Bears, Chandler Jearls, Raghavendra Srinivas, Esha Choukse, Kirk W. Cameron, Ali Raza Butt, Xun Jian |
| 2024 | MICRO | Mosaic: Harnessing the Micro-Architectural Resources of Servers in Serverless Environments. | Jovan Stojkovic, Esha Choukse, Enrique Saurez, igo Goiri, Josep Torrellas |
| 2024 | NSDI | Making Kernel Bypass Practical for the Cloud with Junction. | Joshua Fried, Gohar Irfan Chaudhry, Enrique Saurez, Esha Choukse, igo Goiri, Sameh Elnikety, Rodrigo Fonseca, Adam Belay |
| 2024 | SC | Input-Dependent Power Usage in GPUs. | Theo Gregersen, Pratyush Patel, Esha Choukse |
| 2022 | MICRO | Translation-optimized Memory Compression for Capacity. | Gagandeep Panwar, Muhammad Laghari, David Bears, Yuqing Liu, Chandler Jearls, Esha Choukse, Kirk W. Cameron, Ali Raza Butt, Xun Jian |
| 2020 | ISCA | Buddy Compression: Enabling Larger Memory for Deep Learning and HPC Workloads on GPUs. | Esha Choukse, Michael B. Sullivan, Mike O'Connor, Mattan Erez, Jeff Pool, David W. Nellans, Stephen W. Keckler |
| 2019 | SC | PruneTrain: fast neural network training by dynamic sparse model reconfiguration. | Sangkug Lym, Esha Choukse, Siavash Zangeneh, Wei Wen, Sujay Sanghavi, Mattan Erez |
| 2018 | MICRO | Compresso: Pragmatic Main Memory Compression. | Esha Choukse, Mattan Erez, Alaa R. Alameldeen |
| 2016 | ISCA | Bit-Plane Compression: Transforming Data for Better Compression in Many-Core Architectures. | Jungrae Kim, Michael B. Sullivan, Esha Choukse, Mattan Erez |