Gennady Pekhimenko
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
48
Venues
16
Active years
2013–2026
Best venue rank
A*
Where they publish
Papers
48 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ASPLOS | Tilus: A Tile-Level GPGPU Programming Language for Low-Precision Computation. | Yaoyao Ding, Bohan Hou, Xiao Zhang, Allan Lin, Tianqi Chen, Cody Hao Yu, Yida Wang, Gennady Pekhimenko |
| 2026 | CGO | Hexcute: A Compiler Framework for Automating Layout Synthesis in GPU Programs. | Xiao Zhang, Yaoyao Ding, Bolin Sun, Yang Hu, Tatiana Shpeisman, Gennady Pekhimenko |
| 2026 | EuroSys | LoRAFusion: Efficient LoRA Fine-Tuning for LLMs. | Zhanda Zhu, Qidong Su, Yaoyao Ding, Kevin Song, Shang Wang, Gennady Pekhimenko |
| 2026 | ISCA | DCC: Data-Centric Compilation of Machine Learning Kernels for Processing-In-Memory Architectures. | Peiming Yang, Sankeerth Durvasula, Ivan Fernandez, Mohammad Sadrosadati, Onur Mutlu, Gennady Pekhimenko, Christina Giannoula |
| 2025 | ACL | APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts. | Honghua Dong, Qidong Su, Yubo Gao, Zhaoyu Li, Yangjun Ruan, Gennady Pekhimenko, Chris J. Maddison, Xujie Si |
| 2025 | ASPLOS | HybridTier: an Adaptive and Lightweight CXL-Memory Tiering System. | Kevin Song, Jiacheng Yang, Zixuan Wang, Jishen Zhao, Sihang Liu, Gennady Pekhimenko |
| 2025 | ASPLOS | Tally: Non-Intrusive Performance Isolation for Concurrent Deep Learning Workloads. | Wei Zhao, Anand Jayarajan, Gennady Pekhimenko |
| 2025 | EuroSys | Mist: Efficient Distributed Training of Large Language Models via Memory-Parallelism Co-Optimization. | Zhanda Zhu, Christina Giannoula, Muralidhar Andoorveedu, Qidong Su, Karttikeya Mangalam, Bojian Zheng, Gennady Pekhimenko |
| 2025 | ICML | TypyBench: Evaluating LLM Type Inference for Untyped Python Repositories. | Honghua Dong, Jiacheng Yang, Xun Deng, Yuhe Jiang, Gennady Pekhimenko, Fan Long, Xujie Si |
| 2025 | SIGMETRICS | PyGim: An Efficient Graph Neural Network Library for Real Processing-In-Memory Architectures. | Christina Giannoula, Peiming Yang, Ivan Fernandez, Jiacheng Yang, Sankeerth Durvasula, Yu Xin Li, Mohammad Sadrosadati, Juan Gmez-Luna, Onur Mutlu, Gennady Pekhimenko |
| 2024 | EuroSys | Minuet: Accelerating 3D Sparse Convolutions on GPUs. | Jiacheng Yang, Christina Giannoula, Jun Wu, Mostafa Elhoushi, James Gleeson, Gennady Pekhimenko |
| 2024 | ICLR | Guaranteed Approximation Bounds for Mixed-Precision Neural Operators. | Renbo Tu, Colin White, Jean Kossaifi, Boris Bonev, Gennady Pekhimenko, Kamyar Azizzadenesheli, Anima Anandkumar |
| 2024 | ICS | Sylva: Sparse Embedded Adapters via Hierarchical Approximate Second-Order Information. | Baorun Mu, Christina Giannoula, Shang Wang, Gennady Pekhimenko |
| 2023 | APLAS | TorchProbe: Fuzzing Dynamic Deep Learning Compilers. | Qidong Su, Chuqin Geng, Gennady Pekhimenko, Xujie Si |
| 2023 | ASPLOS | Hidet: Task-Mapping Programming Paradigm for Deep Learning Tensor Programs. | Yaoyao Ding, Cody Hao Yu, Bojian Zheng, Yizhi Liu, Yida Wang, Gennady Pekhimenko |
| 2023 | ASPLOS | TiLT: A Time-Centric Approach for Stream Query Optimization and Parallelization. | Anand Jayarajan, Wei Zhao, Yudi Sun, Gennady Pekhimenko |
| 2023 | MICRO | Grape: Practical and Efficient Graphed Execution for Dynamic Deep Neural Networks on GPUs. | Bojian Zheng, Cody Hao Yu, Jie Wang, Yaoyao Ding, Yizhi Liu, Yida Wang, Gennady Pekhimenko |
| 2023 | USENIX | Arbitor: A Numerically Accurate Hardware Emulation Tool for DNN Accelerators. | Chenhao Jiang, Anand Jayarajan, Hao Lu, Gennady Pekhimenko |
| 2022 | CGO | Automatic Horizontal Fusion for GPU Kernels. | Ao Li, Bojian Zheng, Gennady Pekhimenko, Fan Long |
| 2022 | OSDI | ROLLER: Fast and Efficient Tensor Compilation for Deep Learning. | Hongyu Zhu, Ruofan Wu, Yijia Diao, Shanbin Ke, Haoyu Li, Chen Zhang, Jilong Xue, Lingxiao Ma, Yuqing Xia, Wei Cui, Fan Yang, Mao Yang, Lidong Zhou, Asaf Cidon, Gennady Pekhimenko |
| 2021 | ASPLOS | LifeStream: a high-performance stream processing engine for periodic streams. | Anand Jayarajan, Kimberly Hau, Andrew Goodwin, Gennady Pekhimenko |
| 2021 | ISCA | NVOverlay: Enabling Efficient and Scalable High-Frequency Snapshotting to NVM. | Ziqi Wang, Chul-Hwan Choo, Michael A. Kozuch, Todd C. Mowry, Gennady Pekhimenko, Vivek Seshadri, Dimitrios Skarlatos |
| 2021 | MICRO | FPRaker: A Processing Element For Accelerating Neural Network Training. | Omar Mohamed Awad, Mostafa Mahmoud, Isak Edo, Ali Hadi Zadeh, Ciaran Bannon, Anand Jayarajan, Gennady Pekhimenko, Andreas Moshovos |
| 2021 | USENIX | Habitat: A Runtime-Based Computational Performance Predictor for Deep Neural Network Training. | Geoffrey X. Yu, Yubo Gao, Pavel Golikov, Gennady Pekhimenko |
| 2020 | ISCA | MLPerf Inference Benchmark. | Vijay Janapa Reddi, Christine Cheng, David Kanter, Peter Mattson, Guenther Schmuelling, Carole-Jean Wu, Brian Anderson, Maximilien Breughe, Mark Charlebois, William Chou, Ramesh Chukka, Cody Coleman, Sam Davis, Pan Deng, Greg Diamos, Jared Duke, Dave Fick, J. Scott Gardner, Itay Hubara, Sachin Idgunji, Thomas B. Jablin, Jeff Jiao, Tom St. John, Pankaj Kanwar, David Lee, Jeffery Liao, Anton Lokhmotov, Francisco Massa, Peng Meng, Paulius Micikevicius, Colin Osborne, Gennady Pekhimenko, Arun Tejusve Raghunath Rajan, Dilip Sequeira, Ashish Sirasao, Fei Sun, Hanlin Tang, Michael Thomson, Frank Wei, Ephrem Wu, Lingjie Xu, Koichi Yamada, Bing Yu, George Yuan, Aaron Zhong, Peizhao Zhang, Yuchen Zhou |
| 2020 | ISCA | Echo: Compiler-based GPU Memory Footprint Reduction for LSTM RNN Training. | Bojian Zheng, Nandita Vijaykumar, Gennady Pekhimenko |
| 2020 | MICRO | TensorDash: Exploiting Sparsity to Accelerate Deep Neural Network Training. | Mostafa Mahmoud, Isak Edo, Ali Hadi Zadeh, Omar Mohamed Awad, Gennady Pekhimenko, Jorge Albericio, Andreas Moshovos |
| 2020 | UIST | Skyline: Interactive In-Editor Computational Performance Profiling for Deep Neural Network Training. | Geoffrey X. Yu, Tovi Grossman, Gennady Pekhimenko |
| 2020 | USENIX | Daydream: Accurately Estimating the Efficacy of Optimizations for DNN Training. | Hongyu Zhu, Amar Phanishayee, Gennady Pekhimenko |
| 2019 | ASPLOS | StreamBox-HBM: Stream Analytics on High Bandwidth Hybrid Memory. | Hongyu Miao, Myeongjae Jeon, Gennady Pekhimenko, Kathryn S. McKinley, Felix Xiaozhu Lin |
| 2019 | ISCA | Janus: optimizing memory and storage support for non-volatile memory systems. | Sihang Liu, Korakit Seemakhupt, Gennady Pekhimenko, Aasheesh Kolli, Samira Manabi Khan |
| 2018 | ISCA | Gist: Efficient Data Encoding for Deep Neural Network Training. | Animesh Jain, Amar Phanishayee, Jason Mars, Lingjia Tang, Gennady Pekhimenko |
| 2018 | ISCA | A Case for Richer Cross-Layer Abstractions: Bridging the Semantic Gap with Expressive Memory. | Nandita Vijaykumar, Abhilasha Jain, Diptesh Majumdar, Kevin Hsieh, Gennady Pekhimenko, Eiman Ebrahimi, Nastaran Hajinazar, Phillip B. Gibbons, Onur Mutlu |
| 2018 | USENIX | TerseCades: Efficient Data Compression in Stream Processing. | Gennady Pekhimenko, Chuanxiong Guo, Myeongjae Jeon, Peng Huang, Lidong Zhou |
| 2017 | HPCA | SoftMC: A Flexible and Practical Open-Source Infrastructure for Enabling Experimental DRAM Studies. | Hasan Hassan, Nandita Vijaykumar, Samira Manabi Khan, Saugata Ghose, Kevin K. Chang, Gennady Pekhimenko, Donghyuk Lee, Oguz Ergin, Onur Mutlu |
| 2017 | SIGMETRICS | Design-Induced Latency Variation in Modern DRAM Chips: Characterization, Analysis, and Latency Reduction Mechanisms. | Donghyuk Lee, Samira Manabi Khan, Lavanya Subramanian, Saugata Ghose, Rachata Ausavarungnirun, Gennady Pekhimenko, Vivek Seshadri, Onur Mutlu |
| 2017 | USENIX | StreamBox: Modern Stream Processing on a Multicore Machine. | Hongyu Miao, Heejin Park, Myeongjae Jeon, Gennady Pekhimenko, Kathryn S. McKinley, Felix Xiaozhu Lin |
| 2016 | HPCA | ChargeCache: Reducing DRAM latency by exploiting row access locality. | Hasan Hassan, Gennady Pekhimenko, Nandita Vijaykumar, Vivek Seshadri, Donghyuk Lee, Oguz Ergin, Onur Mutlu |
| 2016 | HPCA | A case for toggle-aware compression for GPU systems. | Gennady Pekhimenko, Evgeny Bolotin, Nandita Vijaykumar, Onur Mutlu, Todd C. Mowry, Stephen W. Keckler |
| 2016 | MICRO | Zorua: A holistic approach to resource virtualization in GPUs. | Nandita Vijaykumar, Kevin Hsieh, Gennady Pekhimenko, Samira Manabi Khan, Ashish Shrestha, Saugata Ghose, Adwait Jog, Phillip B. Gibbons, Onur Mutlu |
| 2016 | SIGMETRICS | Understanding Latency Variation in Modern DRAM Chips: Experimental Characterization, Analysis, and Optimization. | Kevin K. Chang, Abhijith Kashyap, Hasan Hassan, Saugata Ghose, Kevin Hsieh, Donghyuk Lee, Tianshi Li, Gennady Pekhimenko, Samira Manabi Khan, Onur Mutlu |
| 2015 | HPCA | Adaptive-latency DRAM: Optimizing DRAM timing for the common-case. | Donghyuk Lee, Yoongu Kim, Gennady Pekhimenko, Samira Manabi Khan, Vivek Seshadri, Kevin Kai-Wei Chang, Onur Mutlu |
| 2015 | HPCA | Exploiting compressed block size as an indicator of future reuse. | Gennady Pekhimenko, Tyler Huberty, Rui Cai, Onur Mutlu, Phillip B. Gibbons, Michael A. Kozuch, Todd C. Mowry |
| 2015 | ISCA | Page overlays: an enhanced virtual memory framework to enable fine-grained memory management. | Vivek Seshadri, Gennady Pekhimenko, Olatunji Ruwase, Onur Mutlu, Phillip B. Gibbons, Michael A. Kozuch, Todd C. Mowry, Trishul M. Chilimbi |
| 2015 | ISCA | A case for core-assisted bottleneck acceleration in GPUs: enabling flexible data compression with assist warps. | Nandita Vijaykumar, Gennady Pekhimenko, Adwait Jog, Abhishek Bhowmick, Rachata Ausavarungnirun, Chita R. Das, Mahmut T. Kandemir, Todd C. Mowry, Onur Mutlu |
| 2015 | WWW | PocketTrend: Timely Identification and Delivery of Trending Search Content to Mobile Users. | Gennady Pekhimenko, Dimitrios Lymberopoulos, Oriana Riva, Karin Strauss, Doug Burger |
| 2013 | MICRO | Linearly compressed pages: a low-complexity, low-latency main memory compression framework. | Gennady Pekhimenko, Vivek Seshadri, Yoongu Kim, Hongyi Xin, Onur Mutlu, Phillip B. Gibbons, Michael A. Kozuch, Todd C. Mowry |
| 2013 | MICRO | RowClone: fast and energy-efficient in-DRAM bulk data copy and initialization. | Vivek Seshadri, Yoongu Kim, Chris Fallin, Donghyuk Lee, Rachata Ausavarungnirun, Gennady Pekhimenko, Yixin Luo, Onur Mutlu, Phillip B. Gibbons, Michael A. Kozuch, Todd C. Mowry |