| 2026 | CCGRID | VeX: Scaling HNSW-Based Vector Search with DPU Memory and Parallelism. | Kihwan Kim, Hyungsun Yoo, Woojung Kim, Donghyun Min, Myungcheol Lee, Jihoon Yang, Weikuan Yu, Youngjae Kim |
| 2026 | ICDCS | Dual-Blade: Dual-Path NVMe-Direct KV-Cache Offloading for Edge LLM Inference. | Bodon Jeong, Hongsu Byun, Youngjae Kim, Weikuan Yu, Kyungkeun Lee, Jihoon Yang, Sungyong Park |
| 2026 | SP | 2FiA: Towards WiFi Sensing-Based Authentication with Unique Biometrics. | Bofan Li, Zhankai Ye, Weikuan Yu, Yongning Tang, Liu Xiu |
| 2025 | CCGRID | MEMORYBRIDGE: Leveraging Cloud Resource Characteristics for Cost-Efficient Disk-Based GNN Training via Two-Level Architecture. | Yoochan Kim, Weikuan Yu, Hong-Yeon Kim, Youngjae Kim |
| 2025 | CLOUD | Spatio-Temporal Resource Control for Cloud-Native GPU Provisioning. | Hyeon-Jun Jang, Sang-Jae Kim, Weikuan Yu, Hyun-Wook Jin |
| 2025 | ISVC | Spatial-ViLT: Enhancing Visual Spatial Reasoning Through Multi-task Learning. | Chashi Mahiul Islam, Oteo Mamo, Samuel Jacob Chacko, Xiuwen Liu, Weikuan Yu |
| 2024 | CLUSTER | Understanding Highly Configurable Storage for Diverse Workloads. | Olga Kogiou, Hariharan Devarajan, Chen Wang, Weikuan Yu, Kathryn Mohror |
| 2024 | SC | DFTracer: An Analysis-Friendly Data Flow Tracer for AI-Driven Workflows. | Hariharan Devarajan, Loc Pottier, Kaushik Velusamy, Huihuo Zheng, Izzet Yildirim, Olga Kogiou, Weikuan Yu, Anthony Kougkas, Xian-He Sun, Jae-Seung Yeom, Kathryn Mohror |
| 2023 | CLUSTER | I/O characterization and performance evaluation of large-scale storage architectures for heterogeneous workloads. | Olga Kogiou, Hariharan Devarajan, Chen Wang, Weikuan Yu, Kathryn Mohror |
| 2022 | CLUSTER | SVAGC: Garbage Collection with a Scalable Virtual Address Swapping Technique. | Ismail Ataie, Weikuan Yu |
| 2021 | CCGRID | Compression of Time Evolutionary Image Data through Predictive Deep Neural Networks. | Rupak Roy, Kento Sato, Subhadeep Bhattacharya, Xingang Fang, Yasumasa Joti, Takaki Hatsui, Toshiyuki Nishiyama Hiraki, Jian Guo, Weikuan Yu |
| 2021 | CLUSTER | O(1) Communication for Distributed SGD through Two-Level Gradient Averaging. | Subhadeep Bhattacharya, Weikuan Yu, Fahim Tahmid Chowdhury, Kathryn Mohror |
| 2021 | ICPP | ROBOTune: High-Dimensional Configuration Tuning for Cluster-Based Data Analytics. | Md. Muhib Khan, Weikuan Yu |
| 2020 | SC | Emulating I/O Behavior in Scientific Workflows on High Performance Computing Systems. | Fahim Chowdhury, Yue Zhu, Francesco Di Natale, Adam Moody, Elsa Gonsiorowski, Kathryn Mohror, Weikuan Yu |
| 2019 | CLUSTER | Efficient User-Level Storage Disaggregation for Deep Learning. | Yue Zhu, Weikuan Yu, Bing Jiao, Kathryn Mohror, Adam Moody, Fahim Chowdhury |
| 2019 | ICPP | I/O Characterization and Performance Evaluation of BeeGFS for Deep Learning. | Fahim Chowdhury, Yue Zhu, Todd Heer, Saul Paredes, Adam Moody, Robin Goldstone, Kathryn Mohror, Weikuan Yu |
| 2018 | CCGRID | SHMEMGraph: Efficient and Balanced Graph Processing Using One-Sided Communication. | Huansong Fu, Manjunath Gorentla Venkata, Shaeke Salman, Neena Imam, Weikuan Yu |
| 2018 | HPDC | Direct-FUSE: Removing the Middleman for High-Performance FUSE File System Support. | Yue Zhu, Teng Wang, Kathryn Mohror, Adam Moody, Kento Sato, Muhib Khan, Weikuan Yu |
| 2018 | MASCOTS | Entropy-Aware I/O Pipelining for Large-Scale Deep Learning on HPC Systems. | Yue Zhu, Fahim Chowdhury, Huansong Fu, Adam Moody, Kathryn Mohror, Kento Sato, Weikuan Yu |
| 2017 | CCGRID | High-Performance Key-Value Store On OpenSHMEM. | Huansong Fu, Manjunath Gorentla Venkata, Ahana Roy Choudhury, Neena Imam, Weikuan Yu |
| 2016 | SC | DISP: Optimizations towards Scalable MPI Startup. | Huansong Fu, Swaroop Pophale, Manjunath Gorentla Venkata, Weikuan Yu |
| 2016 | SC | An ephemeral burst-buffer file system for scientific applications. | Teng Wang, Kathryn Mohror, Adam Moody, Kento Sato, Weikuan Yu |
| 2015 | CLUSTER | TRIO: Burst Buffer Based I/O Orchestration. | Teng Wang, Sarp Oral, Michael Pritchard, Bin Wang, Weikuan Yu |
| 2015 | DATE | Eliminating intra-warp conflict misses in GPU. | Bin Wang, Zhuo Liu, Xinning Wang, Weikuan Yu |
| 2015 | ICS | DaCache: Memory Divergence-Aware GPU Cache Management. | Bin Wang, Weikuan Yu, Xian-He Sun, Xinning Wang |
| 2015 | MASCOTS | Preserving Row Buffer Locality for PCM Wear-Leveling under Massive Parallelism. | Xinning Wang, Bin Wang, Zhuo Liu, Weikuan Yu |
| 2015 | SC | A case study of MapReduce speculation for failure recovery. | Huansong Fu, Yue Zhu, Weikuan Yu |
| 2015 | SC | Performance evaluation and tuning of BioPig for genomic analysis. | Lizhen Shi, Zhong Wang, Weikuan Yu, Xiandong Meng |
| 2014 | SC | BPAR: a bundle-based parallel aggregation framework for decoupled I/O execution. | Teng Wang, Kevin Vasko, Zhuo Liu, Hui Chen, Weikuan Yu |
| 2014 | SIGMETRICS | Non-work-conserving effects in MapReduce: diffusion limit and criticality. | Jian Tan, Yandong Wang, Weikuan Yu, Li Zhang |
| 2013 | CCGRID | SLOAVx: Scalable LOgarithmic AlltoallV Algorithm for Hierarchical Multicore Systems. | Cong Xu, Manjunath Gorentla Venkata, Richard L. Graham, Yandong Wang, Zhuo Liu, Weikuan Yu |
| 2013 | CLUSTER | A case of system-wide power management for scientific applications. | Zhuo Liu, Jay F. Lofstead, Teng Wang, Weikuan Yu |
| 2013 | ICCCN | Profiling and Improving I/O Performance of a Large-Scale Climate Scientific Application. | Zhuo Liu, Bin Wang, Teng Wang, Yuan Tian, Cong Xu, Yandong Wang, Weikuan Yu, Carlos A. Cruz, Shujia Zhou, Tom Clune, Scott Klasky |
| 2013 | MASCOTS | A Versatile Performance and Energy Simulation Tool for Composite GPU Global Memory. | Bin Wang, Yizheng Jiao, Weikuan Yu, Xipeng Shen, Dong Li, Jeffrey S. Vetter |
| 2013 | SC | CooMR: cross-task coordination for efficient data management in MapReduce programs. | Xiaobing Li, Yandong Wang, Yizheng Jiao, Cong Xu, Weikuan Yu |
| 2012 | HPDC | A system-aware optimized data organization for efficient scientific analytics. | Yuan Tian, Scott Klasky, Weikuan Yu, Hasan Abbasi, Bin Wang, Norbert Podhorszki, Ray W. Grout, Matthew Wolf |
| 2012 | MASCOTS | PCM-Based Durable Write Cache for Fast Disk I/O. | Zhuo Liu, Bin Wang, Patrick Carpenter, Dong Li, Jeffrey S. Vetter, Weikuan Yu |
| 2012 | MASCOTS | SMART-IO: SysteM-AwaRe Two-Level Data Organization for Efficient Scientific Analytics. | Yuan Tian, Scott Klasky, Weikuan Yu, Hasan Abbasi, Bin Wang, Norbert Podhorszki, Ray W. Grout, Matthew Wolf |
| 2012 | SC | Classifying soft error vulnerabilities in extreme-scale scientific applications using a binary instrumentation tool. | Dong Li, Jeffrey S. Vetter, Weikuan Yu |
| 2011 | CCGRID | Network-Friendly One-Sided Communication through Multinode Cooperation on Petascale Cray XT5 Systems. | Xinyu Que, Weikuan Yu, Vinod Tipparaju, Jeffrey S. Vetter, Bin Wang |
| 2011 | CLUSTER | EDO: Improving Read Performance for Scientific Applications through Elastic Data Organization. | Yuan Tian, Scott Klasky, Hasan Abbasi, Jay F. Lofstead, Ray W. Grout, Norbert Podhorszki, Qing Liu, Yandong Wang, Weikuan Yu |
| 2011 | CLUSTER | BMF: Bitmapped Mass Fingerprinting for Fast Protein Identification. | Weikuan Yu, K. John Wu, Wei-Shinn Ku, Cong Xu, Juan Gao |
| 2011 | ICPP | Virtual Topologies for Scalable Resource Management and Contention Attenuation in a Global Address Space Model on the Cray XT5. | Weikuan Yu, Vinod Tipparaju, Xinyu Que, Jeffrey S. Vetter |
| 2011 | SC | Hadoop acceleration through network levitated merge. | Yandong Wang, Xinyu Que, Weikuan Yu, Dror Goldenberg, Dhiraj Sehgal |
| 2008 | CCGRID | Xen-Based HPC: A Parallel I/O Perspective. | Weikuan Yu, Jeffrey S. Vetter |
| 2008 | EuroPar | Empirical Analysis of a Large-Scale Hierarchical Storage System. | Weikuan Yu, Sarp Oral, Shane Canon, Jeffrey S. Vetter, Ramanan Sankaran |
| 2008 | ICPP | ParColl: Partitioned Collective I/O on the Cray XT. | Weikuan Yu, Jeffrey S. Vetter |
| 2008 | SC | Early evaluation of IBM BlueGene/P. | Sadaf R. Alam, Richard F. Barrett, M. Bast, Mark R. Fahey, Jeffery A. Kuehn, Collin McCurdy, James H. Rogers, Philip C. Roth, Ramanan Sankaran, Jeffrey S. Vetter, Patrick H. Worley, Weikuan Yu |
| 2008 | SC | Wide-area performance profiling of 10GigE and InfiniBand technologies. | Nageswara S. V. Rao, Weikuan Yu, William R. Wing, Stephen W. Poole, Jeffrey S. Vetter |
| 2007 | CCGRID | Exploiting Lustre File Joining for Effective Collective IO. | Weikuan Yu, Jeffrey S. Vetter, Shane Canon, Song Jiang |
| 2007 | ICPP | FlexFetch: A History-Aware Scheme for I/O Energy Saving in Mobile Computing. | Feng Chen, Song Jiang, Weisong Shi, Weikuan Yu |
| 2006 | ICPP | Application-Transparent Checkpoint/Restart for MPI Programs over InfiniBand. | Qi Gao, Weikuan Yu, Wei Huang, Dhabaleswar K. Panda |
| 2006 | ICPP | High Performance Block I/O for Global File System (GFS) with InfiniBand RDMA. | Shuang Liang, Weikuan Yu, Dhabaleswar K. Panda |
| 2005 | CLUSTER | Head-to-TOE Evaluation of High-Performance Sockets over Protocol Offload Engines. | Pavan Balaji, Wu-chun Feng, Qi Gao, Ranjit Noronha, Weikuan Yu, Dhabaleswar K. Panda |
| 2005 | ICS | High performance support of parallel virtual file system (PVFS2) over Quadrics. | Weikuan Yu, Shuang Liang, Dhabaleswar K. Panda |
| 2004 | CLUSTER | Scalable, high-performance NIC-based all-to-all broadcast over Myrinet/GM. | Weikuan Yu, Dhabaleswar K. Panda, Darius Buntinas |
| 2004 | HiPC | Fast and Scalable Startup of MPI Programs in InfiniBand Clusters. | Weikuan Yu, Jiesheng Wu, Dhabaleswar K. Panda |
| 2003 | HOTI | Micro-benchmark level performance comparison of high-speed cluster interconnects. | Jiuxing Liu, Balasubramanian Chandrasekaran, Weikuan Yu, Jiesheng Wu, Darius Buntinas, Sushmitha P. Kini, Pete Wyckoff, Dhabaleswar K. Panda |
| 2003 | ICPP | High Performance and Reliable NIC-Based Multicast over Myrinet/GM-2. | Weikuan Yu, Darius Buntinas, Dhabaleswar K. Panda |
| 2003 | SC | Performance Comparison of MPI Implementations over InfiniBand, Myrinet and Quadrics. | Jiuxing Liu, B. Chandrasekaran, Jiesheng Wu, Weihang Jiang, Sushmitha P. Kini, Weikuan Yu, Darius Buntinas, Pete Wyckoff, Dhabaleswar K. Panda |