Skip to content

Gennady Pekhimenko

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

48

Venues

16

Active years

2013–2026

Best venue rank

A*

Where they publish

Papers

48 indexed papers, newest first.

YearVenueTitleAuthors
2026ASPLOSTilus: A Tile-Level GPGPU Programming Language for Low-Precision Computation.Yaoyao Ding, Bohan Hou, Xiao Zhang, Allan Lin, Tianqi Chen, Cody Hao Yu, Yida Wang, Gennady Pekhimenko
2026CGOHexcute: A Compiler Framework for Automating Layout Synthesis in GPU Programs.Xiao Zhang, Yaoyao Ding, Bolin Sun, Yang Hu, Tatiana Shpeisman, Gennady Pekhimenko
2026EuroSysLoRAFusion: Efficient LoRA Fine-Tuning for LLMs.Zhanda Zhu, Qidong Su, Yaoyao Ding, Kevin Song, Shang Wang, Gennady Pekhimenko
2026ISCADCC: Data-Centric Compilation of Machine Learning Kernels for Processing-In-Memory Architectures.Peiming Yang, Sankeerth Durvasula, Ivan Fernandez, Mohammad Sadrosadati, Onur Mutlu, Gennady Pekhimenko, Christina Giannoula
2025ACLAPPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts.Honghua Dong, Qidong Su, Yubo Gao, Zhaoyu Li, Yangjun Ruan, Gennady Pekhimenko, Chris J. Maddison, Xujie Si
2025ASPLOSHybridTier: an Adaptive and Lightweight CXL-Memory Tiering System.Kevin Song, Jiacheng Yang, Zixuan Wang, Jishen Zhao, Sihang Liu, Gennady Pekhimenko
2025ASPLOSTally: Non-Intrusive Performance Isolation for Concurrent Deep Learning Workloads.Wei Zhao, Anand Jayarajan, Gennady Pekhimenko
2025EuroSysMist: Efficient Distributed Training of Large Language Models via Memory-Parallelism Co-Optimization.Zhanda Zhu, Christina Giannoula, Muralidhar Andoorveedu, Qidong Su, Karttikeya Mangalam, Bojian Zheng, Gennady Pekhimenko
2025ICMLTypyBench: Evaluating LLM Type Inference for Untyped Python Repositories.Honghua Dong, Jiacheng Yang, Xun Deng, Yuhe Jiang, Gennady Pekhimenko, Fan Long, Xujie Si
2025SIGMETRICSPyGim: An Efficient Graph Neural Network Library for Real Processing-In-Memory Architectures.Christina Giannoula, Peiming Yang, Ivan Fernandez, Jiacheng Yang, Sankeerth Durvasula, Yu Xin Li, Mohammad Sadrosadati, Juan Gmez-Luna, Onur Mutlu, Gennady Pekhimenko
2024EuroSysMinuet: Accelerating 3D Sparse Convolutions on GPUs.Jiacheng Yang, Christina Giannoula, Jun Wu, Mostafa Elhoushi, James Gleeson, Gennady Pekhimenko
2024ICLRGuaranteed Approximation Bounds for Mixed-Precision Neural Operators.Renbo Tu, Colin White, Jean Kossaifi, Boris Bonev, Gennady Pekhimenko, Kamyar Azizzadenesheli, Anima Anandkumar
2024ICSSylva: Sparse Embedded Adapters via Hierarchical Approximate Second-Order Information.Baorun Mu, Christina Giannoula, Shang Wang, Gennady Pekhimenko
2023APLASTorchProbe: Fuzzing Dynamic Deep Learning Compilers.Qidong Su, Chuqin Geng, Gennady Pekhimenko, Xujie Si
2023ASPLOSHidet: Task-Mapping Programming Paradigm for Deep Learning Tensor Programs.Yaoyao Ding, Cody Hao Yu, Bojian Zheng, Yizhi Liu, Yida Wang, Gennady Pekhimenko
2023ASPLOSTiLT: A Time-Centric Approach for Stream Query Optimization and Parallelization.Anand Jayarajan, Wei Zhao, Yudi Sun, Gennady Pekhimenko
2023MICROGrape: Practical and Efficient Graphed Execution for Dynamic Deep Neural Networks on GPUs.Bojian Zheng, Cody Hao Yu, Jie Wang, Yaoyao Ding, Yizhi Liu, Yida Wang, Gennady Pekhimenko
2023USENIXArbitor: A Numerically Accurate Hardware Emulation Tool for DNN Accelerators.Chenhao Jiang, Anand Jayarajan, Hao Lu, Gennady Pekhimenko
2022CGOAutomatic Horizontal Fusion for GPU Kernels.Ao Li, Bojian Zheng, Gennady Pekhimenko, Fan Long
2022OSDIROLLER: Fast and Efficient Tensor Compilation for Deep Learning.Hongyu Zhu, Ruofan Wu, Yijia Diao, Shanbin Ke, Haoyu Li, Chen Zhang, Jilong Xue, Lingxiao Ma, Yuqing Xia, Wei Cui, Fan Yang, Mao Yang, Lidong Zhou, Asaf Cidon, Gennady Pekhimenko
2021ASPLOSLifeStream: a high-performance stream processing engine for periodic streams.Anand Jayarajan, Kimberly Hau, Andrew Goodwin, Gennady Pekhimenko
2021ISCANVOverlay: Enabling Efficient and Scalable High-Frequency Snapshotting to NVM.Ziqi Wang, Chul-Hwan Choo, Michael A. Kozuch, Todd C. Mowry, Gennady Pekhimenko, Vivek Seshadri, Dimitrios Skarlatos
2021MICROFPRaker: A Processing Element For Accelerating Neural Network Training.Omar Mohamed Awad, Mostafa Mahmoud, Isak Edo, Ali Hadi Zadeh, Ciaran Bannon, Anand Jayarajan, Gennady Pekhimenko, Andreas Moshovos
2021USENIXHabitat: A Runtime-Based Computational Performance Predictor for Deep Neural Network Training.Geoffrey X. Yu, Yubo Gao, Pavel Golikov, Gennady Pekhimenko
2020ISCAMLPerf Inference Benchmark.Vijay Janapa Reddi, Christine Cheng, David Kanter, Peter Mattson, Guenther Schmuelling, Carole-Jean Wu, Brian Anderson, Maximilien Breughe, Mark Charlebois, William Chou, Ramesh Chukka, Cody Coleman, Sam Davis, Pan Deng, Greg Diamos, Jared Duke, Dave Fick, J. Scott Gardner, Itay Hubara, Sachin Idgunji, Thomas B. Jablin, Jeff Jiao, Tom St. John, Pankaj Kanwar, David Lee, Jeffery Liao, Anton Lokhmotov, Francisco Massa, Peng Meng, Paulius Micikevicius, Colin Osborne, Gennady Pekhimenko, Arun Tejusve Raghunath Rajan, Dilip Sequeira, Ashish Sirasao, Fei Sun, Hanlin Tang, Michael Thomson, Frank Wei, Ephrem Wu, Lingjie Xu, Koichi Yamada, Bing Yu, George Yuan, Aaron Zhong, Peizhao Zhang, Yuchen Zhou
2020ISCAEcho: Compiler-based GPU Memory Footprint Reduction for LSTM RNN Training.Bojian Zheng, Nandita Vijaykumar, Gennady Pekhimenko
2020MICROTensorDash: Exploiting Sparsity to Accelerate Deep Neural Network Training.Mostafa Mahmoud, Isak Edo, Ali Hadi Zadeh, Omar Mohamed Awad, Gennady Pekhimenko, Jorge Albericio, Andreas Moshovos
2020UISTSkyline: Interactive In-Editor Computational Performance Profiling for Deep Neural Network Training.Geoffrey X. Yu, Tovi Grossman, Gennady Pekhimenko
2020USENIXDaydream: Accurately Estimating the Efficacy of Optimizations for DNN Training.Hongyu Zhu, Amar Phanishayee, Gennady Pekhimenko
2019ASPLOSStreamBox-HBM: Stream Analytics on High Bandwidth Hybrid Memory.Hongyu Miao, Myeongjae Jeon, Gennady Pekhimenko, Kathryn S. McKinley, Felix Xiaozhu Lin
2019ISCAJanus: optimizing memory and storage support for non-volatile memory systems.Sihang Liu, Korakit Seemakhupt, Gennady Pekhimenko, Aasheesh Kolli, Samira Manabi Khan
2018ISCAGist: Efficient Data Encoding for Deep Neural Network Training.Animesh Jain, Amar Phanishayee, Jason Mars, Lingjia Tang, Gennady Pekhimenko
2018ISCAA Case for Richer Cross-Layer Abstractions: Bridging the Semantic Gap with Expressive Memory.Nandita Vijaykumar, Abhilasha Jain, Diptesh Majumdar, Kevin Hsieh, Gennady Pekhimenko, Eiman Ebrahimi, Nastaran Hajinazar, Phillip B. Gibbons, Onur Mutlu
2018USENIXTerseCades: Efficient Data Compression in Stream Processing.Gennady Pekhimenko, Chuanxiong Guo, Myeongjae Jeon, Peng Huang, Lidong Zhou
2017HPCASoftMC: A Flexible and Practical Open-Source Infrastructure for Enabling Experimental DRAM Studies.Hasan Hassan, Nandita Vijaykumar, Samira Manabi Khan, Saugata Ghose, Kevin K. Chang, Gennady Pekhimenko, Donghyuk Lee, Oguz Ergin, Onur Mutlu
2017SIGMETRICSDesign-Induced Latency Variation in Modern DRAM Chips: Characterization, Analysis, and Latency Reduction Mechanisms.Donghyuk Lee, Samira Manabi Khan, Lavanya Subramanian, Saugata Ghose, Rachata Ausavarungnirun, Gennady Pekhimenko, Vivek Seshadri, Onur Mutlu
2017USENIXStreamBox: Modern Stream Processing on a Multicore Machine.Hongyu Miao, Heejin Park, Myeongjae Jeon, Gennady Pekhimenko, Kathryn S. McKinley, Felix Xiaozhu Lin
2016HPCAChargeCache: Reducing DRAM latency by exploiting row access locality.Hasan Hassan, Gennady Pekhimenko, Nandita Vijaykumar, Vivek Seshadri, Donghyuk Lee, Oguz Ergin, Onur Mutlu
2016HPCAA case for toggle-aware compression for GPU systems.Gennady Pekhimenko, Evgeny Bolotin, Nandita Vijaykumar, Onur Mutlu, Todd C. Mowry, Stephen W. Keckler
2016MICROZorua: A holistic approach to resource virtualization in GPUs.Nandita Vijaykumar, Kevin Hsieh, Gennady Pekhimenko, Samira Manabi Khan, Ashish Shrestha, Saugata Ghose, Adwait Jog, Phillip B. Gibbons, Onur Mutlu
2016SIGMETRICSUnderstanding Latency Variation in Modern DRAM Chips: Experimental Characterization, Analysis, and Optimization.Kevin K. Chang, Abhijith Kashyap, Hasan Hassan, Saugata Ghose, Kevin Hsieh, Donghyuk Lee, Tianshi Li, Gennady Pekhimenko, Samira Manabi Khan, Onur Mutlu
2015HPCAAdaptive-latency DRAM: Optimizing DRAM timing for the common-case.Donghyuk Lee, Yoongu Kim, Gennady Pekhimenko, Samira Manabi Khan, Vivek Seshadri, Kevin Kai-Wei Chang, Onur Mutlu
2015HPCAExploiting compressed block size as an indicator of future reuse.Gennady Pekhimenko, Tyler Huberty, Rui Cai, Onur Mutlu, Phillip B. Gibbons, Michael A. Kozuch, Todd C. Mowry
2015ISCAPage overlays: an enhanced virtual memory framework to enable fine-grained memory management.Vivek Seshadri, Gennady Pekhimenko, Olatunji Ruwase, Onur Mutlu, Phillip B. Gibbons, Michael A. Kozuch, Todd C. Mowry, Trishul M. Chilimbi
2015ISCAA case for core-assisted bottleneck acceleration in GPUs: enabling flexible data compression with assist warps.Nandita Vijaykumar, Gennady Pekhimenko, Adwait Jog, Abhishek Bhowmick, Rachata Ausavarungnirun, Chita R. Das, Mahmut T. Kandemir, Todd C. Mowry, Onur Mutlu
2015WWWPocketTrend: Timely Identification and Delivery of Trending Search Content to Mobile Users.Gennady Pekhimenko, Dimitrios Lymberopoulos, Oriana Riva, Karin Strauss, Doug Burger
2013MICROLinearly compressed pages: a low-complexity, low-latency main memory compression framework.Gennady Pekhimenko, Vivek Seshadri, Yoongu Kim, Hongyi Xin, Onur Mutlu, Phillip B. Gibbons, Michael A. Kozuch, Todd C. Mowry
2013MICRORowClone: fast and energy-efficient in-DRAM bulk data copy and initialization.Vivek Seshadri, Yoongu Kim, Chris Fallin, Donghyuk Lee, Rachata Ausavarungnirun, Gennady Pekhimenko, Yixin Luo, Onur Mutlu, Phillip B. Gibbons, Michael A. Kozuch, Todd C. Mowry