| 2026 | AAAI | RCMoE: A Communication-Efficient Random Compression Framework for Resource-Constrained Mixture-of-Experts Training. | Donglei Wu, Xiao Cai, Jinglei Tan, Jinda Jia, Guangming Tan, Dingwen Tao, Wen Xia, Zhihong Tian |
| 2026 | ACL | WISCA: A Lightweight Model Transition Method to Improve LLM Training via Weight Scaling. | Jiacheng Li, Jianchao Tan, Zhidong Yang, Pingwei Sun, Feiye Huo, Jiayu Qin, Xiangyu Zhang, Maoxin He, Guangming Tan, Weile Jia, Xunliang Cai, Tong Zhao |
| 2026 | ASPLOS | T-Control: An Efficient Dynamic Tensor Rematerialization System for DNN Training. | Zehua Wang, Junmin Xiao, Xiaochuan Deng, Huibing Wang, Hui Ma, Mingyi Li, Yunfei Pang, Guangming Tan |
| 2026 | HPDC | TACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training. | Man Liu, Xingchen Liu, Xingjian Tian, Bing Lu, Shengkai Lyu, Shengquan Yin, Wenjing Huang, Zheng Wei, Hairui Zhao, Guangming Tan, Dingwen Tao |
| 2026 | HPDC | A Fully GPU-Accelerated Framework for High-Performance Configuration Interaction Selection with Neural Network Quantum States. | Daran Sun, Bowen Kan, Haoquan Long, Hairui Zhao, Haoxu Li, Yicheng Liu, Pengyu Zhou, Ankang Feng, Wenjing Huang, Yida Gu, Zhenyu Li, Honghui Shang, Yunquan Zhang, Dingwen Tao, Ninghui Sun, Guangming Tan |
| 2026 | ISCA | ENEC: A Lossless AI Model Compression Method Enabling Fast Inference on Ascend NPUs. | Jinwu Yang, Jiaan Wu, Zedong Liu, Xinyang Ma, Hairui Zhao, Yida Gu, Yuanhong Huang, Xingchen Liu, Wenjing Huang, Zheng Wei, Jing Xing, Yili Ma, Qingyi Zhang, Baoyi An, Zhongzhe Hu, Shaoteng Liu, Xia Zhu, Jiaxun Lu, Guangming Tan, Dingwen Tao |
| 2026 | ICS | EPLoN: Exploiting Efficient Parallelism with Selective Rematerialization for Lightning Attention on Ascend NPU. | Han Bao, Zhenfeng Su, Alexander Setyaev, Stanislav Kamenev, Alexander Gneushev, Kang Zhao, Junmin Xiao, Haoran Lin, Anastasiya Bistrigova, Sergey Buzykanov, Evgeny Tetin, Guangming Tan, Boxiao Liu, Xueyi Zou, Zhenhua Dong, Constantine Korikov, Xianzhi Yu, Zhongzhe Hu |
| 2026 | PPoPP | PRISM: An Efficient GPU-Based Lossy Compression Framework for Progressive Data Retrieval with Multi-Level Interpolation. | Bing Lu, Zedong Liu, Hairui Zhao, Dejun Luo, Wenjing Huang, Yida Gu, Jinyang Liu, Guangming Tan, Dingwen Tao |
| 2026 | PPoPP | CCL-D: A High-Precision Diagnostic System for Slow and Hang Anomalies in Large-Scale Model Training. | Yida Gu, Fakang Wang, Jianhao Fu, Zhenhang Sun, Qianyu Zhang, Hairui Zhao, Xingchen Liu, Yang Tian, Wenjing Huang, Zedong Liu, Yifan Chen, Jinwu Yang, Yueyuan Zhou, Qian Zhao, Haoxu Li, Tao Wang, Feng Yu, Zhan Wang, Guangming Tan, Dingwen Tao |
| 2026 | PPoPP | COCCL: A Collective Communication Library Supporting Easy Integration and Configuration of Customized Compression for Scalable LLM Training. | Xingchen Liu, Haoran Kong, Hairui Zhao, Shengkai Lyu, Zheng Wei, Man Liu, Xingjian Tian, Liyang Zhao, Zhuohan Chen, Fakang Wang, Zizhong Chen, Zhan Wang, Guangming Tan, Dingwen Tao |
| 2026 | PPoPP | Faster and Cheaper: Pushing the Sequence Alignment Throughput with Commercial CPUs. | Zhonghai Zhang, Yewen Li, Ke Meng, Chunming Zhang, Guangming Tan |
| 2026 | SIGCOMM | Credit-Guided Congestion Control on Wafer-Scale On-Chip Networks for Molecular Dynamics. | Tao Jiang, Shixiong Qi, Zhan Wang, Ning Kang, Fan Yang, Yuanzhe Wang, Zejun Li, Guanglei Chen, Jing Xu, Wenzhe Li, Guangming Tan, Guojun Yuan |
| 2026 | SIGCOMM | KVServe: Service-Aware KV Cache Compression for Communication-Efficient Disaggregated LLM Serving. | Zedong Liu, Xinyang Ma, Dejun Luo, Hairui Zhao, Bing Lu, Wenjing Huang, Yida Gu, Xingchen Liu, Zheng Wei, Jinyang Liu, Dingwen Tao, Guangming Tan |
| 2025 | ASPLOS | Optimizing Deep Learning Inference Efficiency through Block Dependency Analysis. | Zhanyuan Di, Leping Wang, En Shao, Zhaojia Ma, Ziyi Ren, Feng Hua, Lixian Ma, Jie Zhao, Guangming Tan, Ninghui Sun |
| 2025 | EuroSys | Jupiter: Pushing Speed and Scalability Limitations for Subgraph Matching on Multi-GPUs. | Zhiheng Lin, Ke Meng, Changjie Xu, Weichen Cao, Guangming Tan |
| 2025 | HPDC | TSUE: A Two-Stage Data Update Method for an Erasure Coded Cluster File System. | Zheng Wei, Jing Xing, Yida Gu, Wenjing Huang, Dong Dai, Guangming Tan, Dingwen Tao |
| 2025 | ICML | ELoRA: Low-Rank Adaptation for Equivariant GNNs. | Chen Wang, Siyu Hu, Guangming Tan, Weile Jia |
| 2025 | ICPADS | SaneKV: A Swift-Adaptive and NUMA-Enhanced Persistent Key-Value Store. | Shengquan Yin, Yili Ma, Jing Xing, Zheng Wei, Dingwen Tao, Guangming Tan |
| 2025 | ICPP | PISCES: Push-Pull Hybrid Optimization for Graph Pattern Matching. | Changjie Xu, Ke Meng, Zhiheng Lin, Guangming Tan |
| 2025 | ISCA | MD-pipe: A Strong Scaling Enhanced Pipeline Architecture for Ab Initio Accuracy Molecular Dynamics. | Ning Kang, Guojun Yuan, Zihan Yan, Beining Zhang, Boyang Li, Zeyu Li, Shuo Wang, Guanglei Chen, Jiayi Rao, Zhan Wang, Weile Jia, Ninghui Sun, Guangming Tan |
| 2025 | PPoPP | GLumin: Fast Connectivity Check Based on LUTs For Efficient Graph Pattern Mining. | Weichen Cao, Ke Meng, Zhiheng Lin, Guangming Tan |
| 2025 | PPoPP | Magneto: Accelerating Parallel Structures in DNNs via Co-Optimization of Operators. | Zhanyuan Di, Leping Wang, Ziyi Ren, En Shao, Jie Zhao, Siyuan Feng, Dingwen Tao, Guangming Tan, Ninghui Sun |
| 2025 | PPoPP | Mario: Near Zero-cost Activation Checkpointing in Pipeline Parallelism. | Weijian Liu, Mingzhen Li, Guangming Tan, Weile Jia |
| 2025 | PPoPP | COMPSO: Optimizing Gradient Compression for Distributed Training with Second-Order Optimizers. | Baixi Sun, Weijin Liu, J. Gregory Pauloski, Jiannan Tian, Jinda Jia, Daoce Wang, Boyuan Zhang, Mingkai Zheng, Sheng Di, Sian Jin, Zhao Zhang, Xiaodong Yu, Kamil A. Iskra, Pete Beckman, Guangming Tan, Dingwen Tao |
| 2025 | PPoPP | FastBWA: Practical and Cost-Efficient Genome Sequence Alignment Pipeline. | Zhonghai Zhang, Yewen Li, Ke Meng, Chunming Zhang, Guangming Tan |
| 2025 | SC | Deep Learning-Enabled Supercritical Flame Simulation at Detailed Chemistry and Real-Fluid Accuracy Towards Trillion-Cell Scale. | Zhuoqiang Guo, Runze Mao, Lijun Liu, Guangming Tan, Weile Jia, Zhi X. Chen |
| 2025 | SC | MANS: Efficient and Portable ANS Encoding for Multi-Byte Integer Data on CPUs and GPUs. | Wenjing Huang, Jinwu Yang, Shengquan Yin, Haoxu Li, Yida Gu, Zedong Liu, Xing Jing, Zheng Wei, Shiyuan Fu, Hao Hu, Guangming Tan, Dingwen Tao |
| 2025 | SC | COSMOS: Performance Portable Graph Pattern Matching with Domain-Specific Software Distributed Shared Memory. | Zhiheng Lin, Ke Meng, Changjie Xu, Weichen Cao, Guangming Tan |
| 2025 | USENIX | GeneralSparse: Bridging the Gap in SpMM for Pruned Large Language Model Inference on GPUs. | Yaoyu Wang, Xiao Guo, Junmin Xiao, De Chen, Guangming Tan |
| 2024 | ASPLOS | BeeZip: Towards An Organized and Scalable Architecture for Data Compression. | Ruihao Gao, Zhichun Li, Guangming Tan, Xueqi Li |
| 2024 | EuroPar | Accelerating Large-Scale Sparse LU Factorization for RF Circuit Simulation. | Guofeng Feng, Hongyu Wang, Zhuoqiang Guo, Mingzhen Li, Tong Zhao, Zhou Jin, Weile Jia, Guangming Tan, Ninghui Sun |
| 2024 | HPDC | ElasticRoom: Multi-Tenant DNN Inference Engine via Co-design with Resource-constrained Compilation and Strong Priority Scheduling. | Lixian Ma, Haoruo Chen, En Shao, Leping Wang, Quan Chen, Guangming Tan |
| 2024 | ICPP | FNCC: Fast Notification Congestion Control in Data Center Networks. | Jing Xu, Zhan Wang, Fan Yang, Ning Kang, Zhenlong Ma, Guojun Yuan, Guangming Tan, Ninghui Sun |
| 2024 | ICS | A Coordinated Strategy for GNN Combining Computational Graph and Operator Optimizations. | Mingyi Li, Junmin Xiao, Kewei Zhang, Zhiheng Lin, Chaoyang Shui, Ke Meng, Zehua Wang, Yunfei Pang, Guangming Tan |
| 2024 | NPC | AsymFB: Accelerating LLM Training Through Asymmetric Model Parallelism. | Jiawei Zhang, En Shao, Leping Wang, Guangming Tan, Ninghui Sun |
| 2024 | PPoPP | POSTER: Optimizing Sparse Tensor Contraction with Revisiting Hash Table Design. | Guofeng Feng, Weile Jia, Ninghui Sun, Guangming Tan, Jiajia Li |
| 2024 | PPoPP | Training one DeePMD Model in Minutes: a Step towards Online Learning. | Siyu Hu, Tong Zhao, Qiuchen Sha, Enji Li, Xiangyu Meng, Liping Liu, Lin-Wang Wang, Guangming Tan, Weile Jia |
| 2024 | PPoPP | Exploiting Fine-Grained Redundancy in Set-Centric Graph Pattern Mining. | Zhiheng Lin, Ke Meng, Chaoyang Shui, Kewei Zhang, Junmin Xiao, Guangming Tan |
| 2024 | PPoPP | POSTER: FineCo: Fine-grained Heterogeneous Resource Management for Concurrent DNN Inferences. | Lixian Ma, Haoruo Chen, En Shao, Leping Wang, Quan Chen, Guangming Tan |
| 2024 | SC | Scaling Molecular Dynamics with ab initio Accuracy to 149 Nanoseconds per Day. | Jianxiong Li, Boyang Li, Zhuoqiang Guo, Mingzhen Li, Enji Li, Lijun Liu, Guojun Yuan, Zhan Wang, Guangming Tan, Weile Jia |
| 2024 | SC | Mille-feuille: A Tile-Grained Mixed Precision Single-Kernel Conjugate Gradient Solver on GPUs. | Dechuang Yang, Yuxuan Zhao, Yiduo Niu, Weile Jia, En Shao, Weifeng Liu, Guangming Tan, Zhou Jin |
| 2023 | AAAI | RLEKF: An Optimizer for Deep Potential with Ab Initio Accuracy. | Siyu Hu, Wentao Zhang, Qiuchen Sha, Feng Pan, Lin-Wang Wang, Weile Jia, Guangming Tan, Tong Zhao |
| 2023 | HPCA | NvWa: Enhancing Sequence Alignment Accelerator Throughput via Hardware Scheduling. | Yewen Li, Xueqi Li, Ruihao Gao, Wanqi Liu, Guangming Tan |
| 2023 | ICA3PP | DeletePop: A DLT Execution Time Predictor Based on Comprehensive Modeling. | Yongzhe He, Yueyuan Zhou, En Shao, Guangming Tan, Ninghui Sun |
| 2023 | ICDCS | JetEsti: A New DLT Job Scheduling Simulator Based on Fine-Grained Process Modeling. | Yongzhe He, Yueyuan Zhou, En Shao, Guangming Tan, Ninghui Sun |
| 2023 | ICPADS | GraphPar: Efficient Workload-Aware Subgraph Matching System on Multiple GPUs. | Kewei Zhang, Junmin Xiao, Zhiheng Lin, Ke Meng, Chaoyang Shui, Mingyi Li, Guangming Tan |
| 2023 | ICS | Fast All-Pairs Shortest Paths Algorithm in Large Sparse Graph. | Shaofeng Yang, Xiandong Liu, Yunting Wang, Xin He, Guangming Tan |
| 2023 | SC | Enhance the Strong Scaling of LAMMPS on Fugaku. | Jianxiong Li, Tong Zhao, Zhuoqiang Guo, Shunchen Shi, Lijun Liu, Guangming Tan, Weile Jia, Guojun Yuan, Zhan Wang |
| 2023 | SC | Adaptive Workload-Balanced Scheduling Strategy for Global Ocean Data Assimilation on Massive GPUs. | Junmin Xiao, Chaoyang Shui, Di Cai, Kangyu Wang, Yunfei Pang, Mingyi Li, Hui Ma, Guangming Tan |
| 2022 | DAC | MetaZip: a high-throughput and efficient accelerator for DEFLATE. | Ruihao Gao, Xueqi Li, Yewen Li, Xun Wang, Guangming Tan |
| 2022 | ICCD | csRNA: Connection-Scalable RDMA NIC Architecture in Datacenter Environment. | Ning Kang, Zhan Wang, Fan Yang, Xiaoxiao Ma, Zhenlong Ma, Guojun Yuan, Guangming Tan |
| 2022 | ICPP | TileSpMSpV: A Tiled Algorithm for Sparse Matrix-Sparse Vector Multiplication on GPUs. | Haonan Ji, Huimin Song, Shibo Lu, Zhou Jin, Guangming Tan, Weifeng Liu |
| 2022 | IGARSS | CSAM: A Channel and Spatial Attention Mechanism for Impervious Surface Extraction in Difficult Areas. | Fangyuan Zhao, Xiaohua Wan, Sijia Li, Zhongchang Sun, Wenjing Zhang, Dehui Qiu, Fa Zhang, Xinyu Liu, Guangming Tan |
| 2022 | ICS | MegTaiChi: dynamic tensor-based memory management optimization for DNN training. | Zhongzhe Hu, Junmin Xiao, Zheye Deng, Mingyi Li, Kewei Zhang, Xiaoyang Zhang, Ke Meng, Ninghui Sun, Guangming Tan |
| 2022 | PPoPP | Extending the limit of molecular dynamics with | Zhuoqiang Guo, Denghui Lu, Yujin Yan, Siyu Hu, Rongrong Liu, Guangming Tan, Ninghui Sun, Wanrun Jiang, Lijun Liu, Yixiao Chen, Linfeng Zhang, Mohan Chen, Han Wang, Weile Jia |
| 2022 | PPoPP | A W-cycle algorithm for efficient batched SVD on GPUs. | Junmin Xiao, Qing Xue, Hui Ma, Xiaoyang Zhang, Guangming Tan |
| 2022 | SC | AlphaSparse: Generating High Performance SpMV Codes Directly from Sparse Matrices. | Zhen Du, Jiajia Li, Yinshan Wang, Xueqi Li, Guangming Tan, Ninghui Sun |
| 2022 | SC | 2.5 Million-Atom Ab Initio Electronic-Structure Simulation of Complex Metallic Heterostructures with DGDFT. | Wei Hu, Hong An, Zhuoqiang Guo, Qingcai Jiang, Xinming Qin, Junshi Chen, Weile Jia, Chao Yang, Zhaolong Luo, Jielan Li, Wentiao Wu, Guangming Tan, Dongning Jia, Qinglin Lu, Fangfang Liu, Min Tian, Fang Li, Yeqi Huang, Liyi Wang, Sha Liu, Jinlong Yang |
| 2022 | SC | W-Cycle SVD: A Multilevel Algorithm for Batched SVD on GPUs. | Junmin Xiao, Yunfei Pang, Qing Xue, Chaoyang Shui, Ke Meng, Hui Ma, Mingyi Li, Xiaoyang Zhang, Guangming Tan |
| 2021 | ICCD | WidePipe: High-Throughput Deep Learning Inference System on a Cluster of Neural Processing Units. | Lixian Ma, En Shao, Yueyuan Zhou, Guangming Tan |
| 2021 | ICPADS | Building Agile Workflow Microservice System for HPC Applications Based on Fast-start OSv. | Qiang Hu, Lixian Ma, En Shao, Guangming Tan |
| 2021 | ICPADS | Deep Reinforcement Agent for Failure-aware Job scheduling in High-Performance Computing. | Kang Yang, Rongyu Cao, Yueyuan Zhou, Jiawei Zhang, En Shao, Guangming Tan |
| 2021 | IGARSS | Spatio-Temporal Features Processing Network for Change Detection in Remote Sensing Images. | Zihao Yang, Zhaobin Cao, Xiaohua Wan, Fa Zhang, Guangming Tan |
| 2021 | PPoPP | I/O lower bounds for auto-tuning of convolutions in CNNs. | Xiaoyang Zhang, Junmin Xiao, Guangming Tan |
| 2020 | NPC | FEB | Wanqi Liu, Yewen Li, Dawei Zang, Guangming Tan |
| 2020 | PPoPP | Revisiting linpack algorithm on large-scale CPU-GPU heterogeneous systems. | Chaoyang Shui, Xianzhi Yu, Yujin Yan, Yinshan Wang, Ke Meng, Guangming Tan |
| 2020 | SPAA | Communication Lower Bounds of Convolutions in CNNs. | Xiaoyang Zhang, Junmin Xiao, Guangming Tan |
| 2019 | HPCC | OeIM: An Optoelectronic Interconnection Middleware for the Exascale Computer. | En Shao, Guangming Tan, Zhan Wang, Ninghui Sun |
| 2019 | ICCD | A New Traffic Offloading Method with Slow Switching Optical Device in Exascale Computer. | En Shao, Guangming Tan, Zhan Wang, Guojun Yuan, Ninghui Sun |
| 2019 | ICPADS | T2HT : Traffic-Driven Machine Learning Based Hierarchical Topology Generation Model. | Hongrui Zhu, Guojun Yuan, Guangming Tan, Zhan Wang, Tao Jiang, Xuejun An |
| 2019 | ICS | IA-SpGEMM: an input-aware auto-tuning framework for parallel sparse matrix-matrix multiplication. | Zhen Xie, Guangming Tan, Weifeng Liu, Ninghui Sun |
| 2019 | ISPA | A Variable Batch Size Strategy for Large Scale Distributed DNN Training. | Zhongzhe Hu, Junmin Xiao, Zhongbo Tian, Xiaoyang Zhang, Hongrui Zhu, Chengji Yao, Ninghui Sun, Guangming Tan |
| 2019 | ISPA | Tensor Layout Optimization of Convolution for Inference on Digital Signal Processor. | Xiaoyang Zhang, Junmin Xiao, Xiaobin Zhang, Zhongzhe Hu, Hongrui Zhu, Zhongbo Tian, Guangming Tan |
| 2019 | PPoPP | A pattern based algorithmic autotuner for graph processing on GPUs. | Ke Meng, Jiajia Li, Guangming Tan, Ninghui Sun |
| 2019 | PPoPP | S-EnKF: co-designing for scalable ensemble Kalman filter. | Junmin Xiao, Shijie Wang, Weiqiang Wan, Xuehai Hong, Guangming Tan |
| 2018 | ICPP | Accelerating FM-index Search for Genomic Data Processing. | Yuanrong Wang, Xueqi Li, Dawei Zang, Guangming Tan, Ninghui Sun |
| 2018 | ICPP | Communication-Avoiding for Dynamical Core of Atmospheric General Circulation Model. | Junmin Xiao, Shigang Li, Baodong Wu, He Zhang, Kun Li, Erlin Yao, Yunquan Zhang, Guangming Tan |
| 2018 | ISPA | Routing and Spectrum Allocation for Time Varying Traffic by Artificial Bee Colony Algorithm in Elastic Optical Networks. | Gang Xu, Xiaoxiao Li, Guojun Yuan, Zhan Wang, Guangming Tan, Xuejun An |
| 2018 | PPoPP | High-performance genomic analysis framework with in-memory computing. | Xueqi Li, Guangming Tan, Bingchen Wang, Ninghui Sun |
| 2018 | PPoPP | Register-based implementation of the sparse general matrix-matrix multiplication on GPUs. | Junhong Liu, Xin He, Weifeng Liu, Guangming Tan |
| 2017 | HPCC | Quantifying and Mitigating Computational Inefficiency of Genomics Data Analysis. | Xueqi Li, Guangming Tan, Chunming Zhang, Xu Li, Zhonghai Zhang, Ninghui Sun |
| 2017 | ICPADS | RING: NUMA-Aware Message-Batching Runtime for Data-Intensive Applications. | Ke Meng, Guangming Tan |
| 2017 | ICS | A performance analysis framework for exploiting GPU microarchitectural capability. | Keren Zhou, Guangming Tan, Xiuxia Zhang, Chaowei Wang, Ninghui Sun |
| 2017 | PPoPP | Understanding the GPU Microarchitecture to Achieve Bare-Metal Performance Tuning. | Xiuxia Zhang, Guangming Tan, Shuangbai Xue, Jiajia Li, Keren Zhou, Mingyu Chen |
| 2016 | ICA3PP | Locality of Computation for Stencil Optimization. | Lufeng Yuan, Junhong Liu, Yulong Luo, Guangming Tan |
| 2015 | CCGRID | A Reliable Distributed Convolutional Neural Network for Biology Image Segmentation. | Xiuxia Zhang, Guangming Tan, Mingyu Chen |
| 2015 | HiPC | Application Taxonomy via Algorithmic Commonality for Domain-Specific Architecture Desgin. | Yuanrong Wang, Qiangqiang Li, Guangming Tan |
| 2015 | HPCC | Implementation of Short Read Alignment Algorithm in OpenCL on Xeon Phi Coprocessor. | Xiquan Zhao, Chuang Liu, Guangming Tan |
| 2015 | ICPP | Study on Partitioning Real-World Directed Graphs of Skewed Degree Distribution. | Jie Yan, Guangming Tan, Ninghui Sun |
| 2015 | ICPP | Bit Flipping Errors in High Performance Linpack at Exascale and Beyond. | Erlin Yao, Guangming Tan |
| 2015 | ICS | FAST: A Fast Stencil Autotuning Framework Based On An Optimal-solution Space Model. | Yulong Luo, Guangming Tan, Zeyao Mo, Ninghui Sun |
| 2014 | FPGA | Accelerating massive short reads mapping for next generation sequencing (abstract only). | Chunming Zhang, Wen Tang, Guangming Tan |
| 2013 | CGO | Vlock: Lock virtualization mechanism for exploiting fine-grained parallelism in graph traversal algorithms. | Jie Yan, Guangming Tan, Xiuxia Zhang, Erlin Yao, Ninghui Sun |
| 2013 | HPCC | ParaInsight: An Assistant for Quantitatively Analyzing Multi-granularity Parallel Region. | Ran Ao, Guangming Tan, Mingyu Chen |
| 2013 | PLDI | SMAT: an input adaptive auto-tuner for sparse matrix-vector multiplication. | Jiajia Li, Guangming Tan, Mingyu Chen, Ninghui Sun |
| 2013 | TrustCom | A Study of Leveraging Memory Level Parallelism for DRAM System on Multi-core/Many-Core Architecture. | Licheng Chen, Yongbing Huang, Yungang Bao, Guangming Tan, Zehan Cui |
| 2012 | FCCM | Accelerating Millions of Short Reads Mapping on a Heterogeneous Architecture with FPGA Accelerator. | Wen Tang, Wendi Wang, Bo Duan, Chunming Zhang, Guangming Tan, Peiheng Zhang, Ninghui Sun |
| 2012 | FPGA | A coarse-grained stream architecture for cryo-electron microscopy images 3D reconstruction. | Wendi Wang, Bo Duan, Wen Tang, Chunming Zhang, Guangming Tan, Peiheng Zhang, Ninghui Sun |
| 2012 | ICS | An optimized large-scale hybrid DGEMM design for CPUs and ATI GPUs. | Jiajia Li, Xingjian Li, Guangming Tan, Mingyu Chen, Ninghui Sun |
| 2012 | ISPASS | A lightweight hybrid hardware/software approach for object-relative memory profiling. | Licheng Chen, Zehan Cui, Yungang Bao, Mingyu Chen, Yongbing Huang, Guangming Tan |
| 2011 | HiPC | Building algorithmically nonstop fault tolerant MPI programs. | Rui Wang, Erlin Yao, Mingyu Chen, Guangming Tan, Pavan Balaji, Darius Buntinas |
| 2011 | HPDC | Experience of parallelizing cryo-EM 3D reconstruction on a CPU-GPU heterogeneous system. | Linchuan Li, Xingjian Li, Guangming Tan, Mingyu Chen, Peiheng Zhang |
| 2011 | ICS | Poster: revisiting virtual channel memory for performance and fairness on multi-core architecture. | Licheng Chen, Yongbing Huang, Yungang Bao, Onur Mutlu, Guangming Tan, Mingyu Chen |
| 2011 | SC | Fast implementation of DGEMM on Fermi GPU. | Guangming Tan, Linchuan Li, Sean Triechle, Everett H. Phillips, Yungang Bao, Ninghui Sun |
| 2010 | EuroPar | Preliminary Investigation of Accelerating Molecular Dynamics Simulation on Godson-T Many-Core Processor. | Liu Peng, Guangming Tan, Rajiv K. Kalia, Aiichiro Nakano, Priya Vashishta, Dongrui Fan, Ninghui Sun |
| 2010 | ICPADS | Automatically Tuned Dynamic Programming with an Algorithm-by-Blocks. | Jiajia Li, Guangming Tan, Mingyu Chen |
| 2009 | EuroPar | High Performance Matrix Multiplication on Many Cores. | Nan Yuan, Yongbin Zhou, Guangming Tan, Junchao Zhang, Dongrui Fan |
| 2009 | ICPP | A Parallel Algorithm for Computing Betweenness Centrality. | Guangming Tan, Dengbiao Tu, Ninghui Sun |
| 2009 | ICS | Single-particle 3d reconstruction from cryo-electron microscopy images on GPU. | Guangming Tan, Ziyu Guo, Mingyu Chen, Dan Meng |
| 2009 | ISPA | Characterizing Betweenness Centrality Algorithm on Multi-core Architectures. | Dengbiao Tu, Guangming Tan |
| 2008 | PPoPP | Experience on optimizing irregular computation for memory hierarchy in manycore architecture. | Guangming Tan, Dongrui Fan, Junchao Zhang, Andrew Russo, Guang R. Gao |
| 2007 | SC | Implementation of the Smith-Waterman algorithm on a reconfigurable supercomputing platform. | Peiheng Zhang, Guangming Tan, Guang R. Gao |
| 2007 | SPAA | A parallel dynamic programming algorithm on a multi-core architecture. | Guangming Tan, Ninghui Sun, Guang R. Gao |
| 2006 | EuroPar | Load Balancing and Parallel Multiple Sequence Alignment with Tree Accumulation. | Guangming Tan, Liu Peng, Shengzhong Feng, Ninghui Sun |
| 2006 | SC | Biology - Locality and parallelism optimization for dynamic programming algorithm in bioinformatics. | Guangming Tan, Shengzhong Feng, Ninghui Sun |
| 2005 | ICCS | Exploiting Parallelization for RNA Secondary Structure Prediction in Cluster. | Guangming Tan, Shengzhong Feng, Ninghui Sun |
| 2005 | ICCS | An Efficient Dynamic Programming Algorithm and Implementation for RNA Secondary Structure Prediction. | Guangming Tan, Xinchun Liu, Ninghui Sun |
| 2005 | ICPADS | An Optimized Algorithm of High Spatial-temporal Efficiency for MegaBlast. | Guangming Tan, Lin Xu, Yishan Jiao, Shengzhong Feng, Dongbo Bu, Ninghui Sun |
| 2005 | ISPDC | Load Balancing Algorithm in Cluster-based RNA secondary structure Prediction. | Guangming Tan, Shengzhong Feng, Ninghui Sun |