Skip to content

Guangming Tan

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

119

Venues

35

Active years

2005–2026

Best venue rank

A*

Where they publish

Papers

119 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIRCMoE: A Communication-Efficient Random Compression Framework for Resource-Constrained Mixture-of-Experts Training.Donglei Wu, Xiao Cai, Jinglei Tan, Jinda Jia, Guangming Tan, Dingwen Tao, Wen Xia, Zhihong Tian
2026ACLWISCA: A Lightweight Model Transition Method to Improve LLM Training via Weight Scaling.Jiacheng Li, Jianchao Tan, Zhidong Yang, Pingwei Sun, Feiye Huo, Jiayu Qin, Xiangyu Zhang, Maoxin He, Guangming Tan, Weile Jia, Xunliang Cai, Tong Zhao
2026ASPLOST-Control: An Efficient Dynamic Tensor Rematerialization System for DNN Training.Zehua Wang, Junmin Xiao, Xiaochuan Deng, Huibing Wang, Hui Ma, Mingyi Li, Yunfei Pang, Guangming Tan
2026HPDCTACO: Efficient Communication Compression of Intermediate Tensors for Scalable Tensor-Parallel LLM Training.Man Liu, Xingchen Liu, Xingjian Tian, Bing Lu, Shengkai Lyu, Shengquan Yin, Wenjing Huang, Zheng Wei, Hairui Zhao, Guangming Tan, Dingwen Tao
2026HPDCA Fully GPU-Accelerated Framework for High-Performance Configuration Interaction Selection with Neural Network Quantum States.Daran Sun, Bowen Kan, Haoquan Long, Hairui Zhao, Haoxu Li, Yicheng Liu, Pengyu Zhou, Ankang Feng, Wenjing Huang, Yida Gu, Zhenyu Li, Honghui Shang, Yunquan Zhang, Dingwen Tao, Ninghui Sun, Guangming Tan
2026ISCAENEC: A Lossless AI Model Compression Method Enabling Fast Inference on Ascend NPUs.Jinwu Yang, Jiaan Wu, Zedong Liu, Xinyang Ma, Hairui Zhao, Yida Gu, Yuanhong Huang, Xingchen Liu, Wenjing Huang, Zheng Wei, Jing Xing, Yili Ma, Qingyi Zhang, Baoyi An, Zhongzhe Hu, Shaoteng Liu, Xia Zhu, Jiaxun Lu, Guangming Tan, Dingwen Tao
2026ICSEPLoN: Exploiting Efficient Parallelism with Selective Rematerialization for Lightning Attention on Ascend NPU.Han Bao, Zhenfeng Su, Alexander Setyaev, Stanislav Kamenev, Alexander Gneushev, Kang Zhao, Junmin Xiao, Haoran Lin, Anastasiya Bistrigova, Sergey Buzykanov, Evgeny Tetin, Guangming Tan, Boxiao Liu, Xueyi Zou, Zhenhua Dong, Constantine Korikov, Xianzhi Yu, Zhongzhe Hu
2026PPoPPPRISM: An Efficient GPU-Based Lossy Compression Framework for Progressive Data Retrieval with Multi-Level Interpolation.Bing Lu, Zedong Liu, Hairui Zhao, Dejun Luo, Wenjing Huang, Yida Gu, Jinyang Liu, Guangming Tan, Dingwen Tao
2026PPoPPCCL-D: A High-Precision Diagnostic System for Slow and Hang Anomalies in Large-Scale Model Training.Yida Gu, Fakang Wang, Jianhao Fu, Zhenhang Sun, Qianyu Zhang, Hairui Zhao, Xingchen Liu, Yang Tian, Wenjing Huang, Zedong Liu, Yifan Chen, Jinwu Yang, Yueyuan Zhou, Qian Zhao, Haoxu Li, Tao Wang, Feng Yu, Zhan Wang, Guangming Tan, Dingwen Tao
2026PPoPPCOCCL: A Collective Communication Library Supporting Easy Integration and Configuration of Customized Compression for Scalable LLM Training.Xingchen Liu, Haoran Kong, Hairui Zhao, Shengkai Lyu, Zheng Wei, Man Liu, Xingjian Tian, Liyang Zhao, Zhuohan Chen, Fakang Wang, Zizhong Chen, Zhan Wang, Guangming Tan, Dingwen Tao
2026PPoPPFaster and Cheaper: Pushing the Sequence Alignment Throughput with Commercial CPUs.Zhonghai Zhang, Yewen Li, Ke Meng, Chunming Zhang, Guangming Tan
2026SIGCOMMCredit-Guided Congestion Control on Wafer-Scale On-Chip Networks for Molecular Dynamics.Tao Jiang, Shixiong Qi, Zhan Wang, Ning Kang, Fan Yang, Yuanzhe Wang, Zejun Li, Guanglei Chen, Jing Xu, Wenzhe Li, Guangming Tan, Guojun Yuan
2026SIGCOMMKVServe: Service-Aware KV Cache Compression for Communication-Efficient Disaggregated LLM Serving.Zedong Liu, Xinyang Ma, Dejun Luo, Hairui Zhao, Bing Lu, Wenjing Huang, Yida Gu, Xingchen Liu, Zheng Wei, Jinyang Liu, Dingwen Tao, Guangming Tan
2025ASPLOSOptimizing Deep Learning Inference Efficiency through Block Dependency Analysis.Zhanyuan Di, Leping Wang, En Shao, Zhaojia Ma, Ziyi Ren, Feng Hua, Lixian Ma, Jie Zhao, Guangming Tan, Ninghui Sun
2025EuroSysJupiter: Pushing Speed and Scalability Limitations for Subgraph Matching on Multi-GPUs.Zhiheng Lin, Ke Meng, Changjie Xu, Weichen Cao, Guangming Tan
2025HPDCTSUE: A Two-Stage Data Update Method for an Erasure Coded Cluster File System.Zheng Wei, Jing Xing, Yida Gu, Wenjing Huang, Dong Dai, Guangming Tan, Dingwen Tao
2025ICMLELoRA: Low-Rank Adaptation for Equivariant GNNs.Chen Wang, Siyu Hu, Guangming Tan, Weile Jia
2025ICPADSSaneKV: A Swift-Adaptive and NUMA-Enhanced Persistent Key-Value Store.Shengquan Yin, Yili Ma, Jing Xing, Zheng Wei, Dingwen Tao, Guangming Tan
2025ICPPPISCES: Push-Pull Hybrid Optimization for Graph Pattern Matching.Changjie Xu, Ke Meng, Zhiheng Lin, Guangming Tan
2025ISCAMD-pipe: A Strong Scaling Enhanced Pipeline Architecture for Ab Initio Accuracy Molecular Dynamics.Ning Kang, Guojun Yuan, Zihan Yan, Beining Zhang, Boyang Li, Zeyu Li, Shuo Wang, Guanglei Chen, Jiayi Rao, Zhan Wang, Weile Jia, Ninghui Sun, Guangming Tan
2025PPoPPGLumin: Fast Connectivity Check Based on LUTs For Efficient Graph Pattern Mining.Weichen Cao, Ke Meng, Zhiheng Lin, Guangming Tan
2025PPoPPMagneto: Accelerating Parallel Structures in DNNs via Co-Optimization of Operators.Zhanyuan Di, Leping Wang, Ziyi Ren, En Shao, Jie Zhao, Siyuan Feng, Dingwen Tao, Guangming Tan, Ninghui Sun
2025PPoPPMario: Near Zero-cost Activation Checkpointing in Pipeline Parallelism.Weijian Liu, Mingzhen Li, Guangming Tan, Weile Jia
2025PPoPPCOMPSO: Optimizing Gradient Compression for Distributed Training with Second-Order Optimizers.Baixi Sun, Weijin Liu, J. Gregory Pauloski, Jiannan Tian, Jinda Jia, Daoce Wang, Boyuan Zhang, Mingkai Zheng, Sheng Di, Sian Jin, Zhao Zhang, Xiaodong Yu, Kamil A. Iskra, Pete Beckman, Guangming Tan, Dingwen Tao
2025PPoPPFastBWA: Practical and Cost-Efficient Genome Sequence Alignment Pipeline.Zhonghai Zhang, Yewen Li, Ke Meng, Chunming Zhang, Guangming Tan
2025SCDeep Learning-Enabled Supercritical Flame Simulation at Detailed Chemistry and Real-Fluid Accuracy Towards Trillion-Cell Scale.Zhuoqiang Guo, Runze Mao, Lijun Liu, Guangming Tan, Weile Jia, Zhi X. Chen
2025SCMANS: Efficient and Portable ANS Encoding for Multi-Byte Integer Data on CPUs and GPUs.Wenjing Huang, Jinwu Yang, Shengquan Yin, Haoxu Li, Yida Gu, Zedong Liu, Xing Jing, Zheng Wei, Shiyuan Fu, Hao Hu, Guangming Tan, Dingwen Tao
2025SCCOSMOS: Performance Portable Graph Pattern Matching with Domain-Specific Software Distributed Shared Memory.Zhiheng Lin, Ke Meng, Changjie Xu, Weichen Cao, Guangming Tan
2025USENIXGeneralSparse: Bridging the Gap in SpMM for Pruned Large Language Model Inference on GPUs.Yaoyu Wang, Xiao Guo, Junmin Xiao, De Chen, Guangming Tan
2024ASPLOSBeeZip: Towards An Organized and Scalable Architecture for Data Compression.Ruihao Gao, Zhichun Li, Guangming Tan, Xueqi Li
2024EuroParAccelerating Large-Scale Sparse LU Factorization for RF Circuit Simulation.Guofeng Feng, Hongyu Wang, Zhuoqiang Guo, Mingzhen Li, Tong Zhao, Zhou Jin, Weile Jia, Guangming Tan, Ninghui Sun
2024HPDCElasticRoom: Multi-Tenant DNN Inference Engine via Co-design with Resource-constrained Compilation and Strong Priority Scheduling.Lixian Ma, Haoruo Chen, En Shao, Leping Wang, Quan Chen, Guangming Tan
2024ICPPFNCC: Fast Notification Congestion Control in Data Center Networks.Jing Xu, Zhan Wang, Fan Yang, Ning Kang, Zhenlong Ma, Guojun Yuan, Guangming Tan, Ninghui Sun
2024ICSA Coordinated Strategy for GNN Combining Computational Graph and Operator Optimizations.Mingyi Li, Junmin Xiao, Kewei Zhang, Zhiheng Lin, Chaoyang Shui, Ke Meng, Zehua Wang, Yunfei Pang, Guangming Tan
2024NPCAsymFB: Accelerating LLM Training Through Asymmetric Model Parallelism.Jiawei Zhang, En Shao, Leping Wang, Guangming Tan, Ninghui Sun
2024PPoPPPOSTER: Optimizing Sparse Tensor Contraction with Revisiting Hash Table Design.Guofeng Feng, Weile Jia, Ninghui Sun, Guangming Tan, Jiajia Li
2024PPoPPTraining one DeePMD Model in Minutes: a Step towards Online Learning.Siyu Hu, Tong Zhao, Qiuchen Sha, Enji Li, Xiangyu Meng, Liping Liu, Lin-Wang Wang, Guangming Tan, Weile Jia
2024PPoPPExploiting Fine-Grained Redundancy in Set-Centric Graph Pattern Mining.Zhiheng Lin, Ke Meng, Chaoyang Shui, Kewei Zhang, Junmin Xiao, Guangming Tan
2024PPoPPPOSTER: FineCo: Fine-grained Heterogeneous Resource Management for Concurrent DNN Inferences.Lixian Ma, Haoruo Chen, En Shao, Leping Wang, Quan Chen, Guangming Tan
2024SCScaling Molecular Dynamics with ab initio Accuracy to 149 Nanoseconds per Day.Jianxiong Li, Boyang Li, Zhuoqiang Guo, Mingzhen Li, Enji Li, Lijun Liu, Guojun Yuan, Zhan Wang, Guangming Tan, Weile Jia
2024SCMille-feuille: A Tile-Grained Mixed Precision Single-Kernel Conjugate Gradient Solver on GPUs.Dechuang Yang, Yuxuan Zhao, Yiduo Niu, Weile Jia, En Shao, Weifeng Liu, Guangming Tan, Zhou Jin
2023AAAIRLEKF: An Optimizer for Deep Potential with Ab Initio Accuracy.Siyu Hu, Wentao Zhang, Qiuchen Sha, Feng Pan, Lin-Wang Wang, Weile Jia, Guangming Tan, Tong Zhao
2023HPCANvWa: Enhancing Sequence Alignment Accelerator Throughput via Hardware Scheduling.Yewen Li, Xueqi Li, Ruihao Gao, Wanqi Liu, Guangming Tan
2023ICA3PPDeletePop: A DLT Execution Time Predictor Based on Comprehensive Modeling.Yongzhe He, Yueyuan Zhou, En Shao, Guangming Tan, Ninghui Sun
2023ICDCSJetEsti: A New DLT Job Scheduling Simulator Based on Fine-Grained Process Modeling.Yongzhe He, Yueyuan Zhou, En Shao, Guangming Tan, Ninghui Sun
2023ICPADSGraphPar: Efficient Workload-Aware Subgraph Matching System on Multiple GPUs.Kewei Zhang, Junmin Xiao, Zhiheng Lin, Ke Meng, Chaoyang Shui, Mingyi Li, Guangming Tan
2023ICSFast All-Pairs Shortest Paths Algorithm in Large Sparse Graph.Shaofeng Yang, Xiandong Liu, Yunting Wang, Xin He, Guangming Tan
2023SCEnhance the Strong Scaling of LAMMPS on Fugaku.Jianxiong Li, Tong Zhao, Zhuoqiang Guo, Shunchen Shi, Lijun Liu, Guangming Tan, Weile Jia, Guojun Yuan, Zhan Wang
2023SCAdaptive Workload-Balanced Scheduling Strategy for Global Ocean Data Assimilation on Massive GPUs.Junmin Xiao, Chaoyang Shui, Di Cai, Kangyu Wang, Yunfei Pang, Mingyi Li, Hui Ma, Guangming Tan
2022DACMetaZip: a high-throughput and efficient accelerator for DEFLATE.Ruihao Gao, Xueqi Li, Yewen Li, Xun Wang, Guangming Tan
2022ICCDcsRNA: Connection-Scalable RDMA NIC Architecture in Datacenter Environment.Ning Kang, Zhan Wang, Fan Yang, Xiaoxiao Ma, Zhenlong Ma, Guojun Yuan, Guangming Tan
2022ICPPTileSpMSpV: A Tiled Algorithm for Sparse Matrix-Sparse Vector Multiplication on GPUs.Haonan Ji, Huimin Song, Shibo Lu, Zhou Jin, Guangming Tan, Weifeng Liu
2022IGARSSCSAM: A Channel and Spatial Attention Mechanism for Impervious Surface Extraction in Difficult Areas.Fangyuan Zhao, Xiaohua Wan, Sijia Li, Zhongchang Sun, Wenjing Zhang, Dehui Qiu, Fa Zhang, Xinyu Liu, Guangming Tan
2022ICSMegTaiChi: dynamic tensor-based memory management optimization for DNN training.Zhongzhe Hu, Junmin Xiao, Zheye Deng, Mingyi Li, Kewei Zhang, Xiaoyang Zhang, Ke Meng, Ninghui Sun, Guangming Tan
2022PPoPPExtending the limit of molecular dynamics withZhuoqiang Guo, Denghui Lu, Yujin Yan, Siyu Hu, Rongrong Liu, Guangming Tan, Ninghui Sun, Wanrun Jiang, Lijun Liu, Yixiao Chen, Linfeng Zhang, Mohan Chen, Han Wang, Weile Jia
2022PPoPPA W-cycle algorithm for efficient batched SVD on GPUs.Junmin Xiao, Qing Xue, Hui Ma, Xiaoyang Zhang, Guangming Tan
2022SCAlphaSparse: Generating High Performance SpMV Codes Directly from Sparse Matrices.Zhen Du, Jiajia Li, Yinshan Wang, Xueqi Li, Guangming Tan, Ninghui Sun
2022SC2.5 Million-Atom Ab Initio Electronic-Structure Simulation of Complex Metallic Heterostructures with DGDFT.Wei Hu, Hong An, Zhuoqiang Guo, Qingcai Jiang, Xinming Qin, Junshi Chen, Weile Jia, Chao Yang, Zhaolong Luo, Jielan Li, Wentiao Wu, Guangming Tan, Dongning Jia, Qinglin Lu, Fangfang Liu, Min Tian, Fang Li, Yeqi Huang, Liyi Wang, Sha Liu, Jinlong Yang
2022SCW-Cycle SVD: A Multilevel Algorithm for Batched SVD on GPUs.Junmin Xiao, Yunfei Pang, Qing Xue, Chaoyang Shui, Ke Meng, Hui Ma, Mingyi Li, Xiaoyang Zhang, Guangming Tan
2021ICCDWidePipe: High-Throughput Deep Learning Inference System on a Cluster of Neural Processing Units.Lixian Ma, En Shao, Yueyuan Zhou, Guangming Tan
2021ICPADSBuilding Agile Workflow Microservice System for HPC Applications Based on Fast-start OSv.Qiang Hu, Lixian Ma, En Shao, Guangming Tan
2021ICPADSDeep Reinforcement Agent for Failure-aware Job scheduling in High-Performance Computing.Kang Yang, Rongyu Cao, Yueyuan Zhou, Jiawei Zhang, En Shao, Guangming Tan
2021IGARSSSpatio-Temporal Features Processing Network for Change Detection in Remote Sensing Images.Zihao Yang, Zhaobin Cao, Xiaohua Wan, Fa Zhang, Guangming Tan
2021PPoPPI/O lower bounds for auto-tuning of convolutions in CNNs.Xiaoyang Zhang, Junmin Xiao, Guangming Tan
2020NPCFEBWanqi Liu, Yewen Li, Dawei Zang, Guangming Tan
2020PPoPPRevisiting linpack algorithm on large-scale CPU-GPU heterogeneous systems.Chaoyang Shui, Xianzhi Yu, Yujin Yan, Yinshan Wang, Ke Meng, Guangming Tan
2020SPAACommunication Lower Bounds of Convolutions in CNNs.Xiaoyang Zhang, Junmin Xiao, Guangming Tan
2019HPCCOeIM: An Optoelectronic Interconnection Middleware for the Exascale Computer.En Shao, Guangming Tan, Zhan Wang, Ninghui Sun
2019ICCDA New Traffic Offloading Method with Slow Switching Optical Device in Exascale Computer.En Shao, Guangming Tan, Zhan Wang, Guojun Yuan, Ninghui Sun
2019ICPADST2HT : Traffic-Driven Machine Learning Based Hierarchical Topology Generation Model.Hongrui Zhu, Guojun Yuan, Guangming Tan, Zhan Wang, Tao Jiang, Xuejun An
2019ICSIA-SpGEMM: an input-aware auto-tuning framework for parallel sparse matrix-matrix multiplication.Zhen Xie, Guangming Tan, Weifeng Liu, Ninghui Sun
2019ISPAA Variable Batch Size Strategy for Large Scale Distributed DNN Training.Zhongzhe Hu, Junmin Xiao, Zhongbo Tian, Xiaoyang Zhang, Hongrui Zhu, Chengji Yao, Ninghui Sun, Guangming Tan
2019ISPATensor Layout Optimization of Convolution for Inference on Digital Signal Processor.Xiaoyang Zhang, Junmin Xiao, Xiaobin Zhang, Zhongzhe Hu, Hongrui Zhu, Zhongbo Tian, Guangming Tan
2019PPoPPA pattern based algorithmic autotuner for graph processing on GPUs.Ke Meng, Jiajia Li, Guangming Tan, Ninghui Sun
2019PPoPPS-EnKF: co-designing for scalable ensemble Kalman filter.Junmin Xiao, Shijie Wang, Weiqiang Wan, Xuehai Hong, Guangming Tan
2018ICPPAccelerating FM-index Search for Genomic Data Processing.Yuanrong Wang, Xueqi Li, Dawei Zang, Guangming Tan, Ninghui Sun
2018ICPPCommunication-Avoiding for Dynamical Core of Atmospheric General Circulation Model.Junmin Xiao, Shigang Li, Baodong Wu, He Zhang, Kun Li, Erlin Yao, Yunquan Zhang, Guangming Tan
2018ISPARouting and Spectrum Allocation for Time Varying Traffic by Artificial Bee Colony Algorithm in Elastic Optical Networks.Gang Xu, Xiaoxiao Li, Guojun Yuan, Zhan Wang, Guangming Tan, Xuejun An
2018PPoPPHigh-performance genomic analysis framework with in-memory computing.Xueqi Li, Guangming Tan, Bingchen Wang, Ninghui Sun
2018PPoPPRegister-based implementation of the sparse general matrix-matrix multiplication on GPUs.Junhong Liu, Xin He, Weifeng Liu, Guangming Tan
2017HPCCQuantifying and Mitigating Computational Inefficiency of Genomics Data Analysis.Xueqi Li, Guangming Tan, Chunming Zhang, Xu Li, Zhonghai Zhang, Ninghui Sun
2017ICPADSRING: NUMA-Aware Message-Batching Runtime for Data-Intensive Applications.Ke Meng, Guangming Tan
2017ICSA performance analysis framework for exploiting GPU microarchitectural capability.Keren Zhou, Guangming Tan, Xiuxia Zhang, Chaowei Wang, Ninghui Sun
2017PPoPPUnderstanding the GPU Microarchitecture to Achieve Bare-Metal Performance Tuning.Xiuxia Zhang, Guangming Tan, Shuangbai Xue, Jiajia Li, Keren Zhou, Mingyu Chen
2016ICA3PPLocality of Computation for Stencil Optimization.Lufeng Yuan, Junhong Liu, Yulong Luo, Guangming Tan
2015CCGRIDA Reliable Distributed Convolutional Neural Network for Biology Image Segmentation.Xiuxia Zhang, Guangming Tan, Mingyu Chen
2015HiPCApplication Taxonomy via Algorithmic Commonality for Domain-Specific Architecture Desgin.Yuanrong Wang, Qiangqiang Li, Guangming Tan
2015HPCCImplementation of Short Read Alignment Algorithm in OpenCL on Xeon Phi Coprocessor.Xiquan Zhao, Chuang Liu, Guangming Tan
2015ICPPStudy on Partitioning Real-World Directed Graphs of Skewed Degree Distribution.Jie Yan, Guangming Tan, Ninghui Sun
2015ICPPBit Flipping Errors in High Performance Linpack at Exascale and Beyond.Erlin Yao, Guangming Tan
2015ICSFAST: A Fast Stencil Autotuning Framework Based On An Optimal-solution Space Model.Yulong Luo, Guangming Tan, Zeyao Mo, Ninghui Sun
2014FPGAAccelerating massive short reads mapping for next generation sequencing (abstract only).Chunming Zhang, Wen Tang, Guangming Tan
2013CGOVlock: Lock virtualization mechanism for exploiting fine-grained parallelism in graph traversal algorithms.Jie Yan, Guangming Tan, Xiuxia Zhang, Erlin Yao, Ninghui Sun
2013HPCCParaInsight: An Assistant for Quantitatively Analyzing Multi-granularity Parallel Region.Ran Ao, Guangming Tan, Mingyu Chen
2013PLDISMAT: an input adaptive auto-tuner for sparse matrix-vector multiplication.Jiajia Li, Guangming Tan, Mingyu Chen, Ninghui Sun
2013TrustComA Study of Leveraging Memory Level Parallelism for DRAM System on Multi-core/Many-Core Architecture.Licheng Chen, Yongbing Huang, Yungang Bao, Guangming Tan, Zehan Cui
2012FCCMAccelerating Millions of Short Reads Mapping on a Heterogeneous Architecture with FPGA Accelerator.Wen Tang, Wendi Wang, Bo Duan, Chunming Zhang, Guangming Tan, Peiheng Zhang, Ninghui Sun
2012FPGAA coarse-grained stream architecture for cryo-electron microscopy images 3D reconstruction.Wendi Wang, Bo Duan, Wen Tang, Chunming Zhang, Guangming Tan, Peiheng Zhang, Ninghui Sun
2012ICSAn optimized large-scale hybrid DGEMM design for CPUs and ATI GPUs.Jiajia Li, Xingjian Li, Guangming Tan, Mingyu Chen, Ninghui Sun
2012ISPASSA lightweight hybrid hardware/software approach for object-relative memory profiling.Licheng Chen, Zehan Cui, Yungang Bao, Mingyu Chen, Yongbing Huang, Guangming Tan
2011HiPCBuilding algorithmically nonstop fault tolerant MPI programs.Rui Wang, Erlin Yao, Mingyu Chen, Guangming Tan, Pavan Balaji, Darius Buntinas
2011HPDCExperience of parallelizing cryo-EM 3D reconstruction on a CPU-GPU heterogeneous system.Linchuan Li, Xingjian Li, Guangming Tan, Mingyu Chen, Peiheng Zhang
2011ICSPoster: revisiting virtual channel memory for performance and fairness on multi-core architecture.Licheng Chen, Yongbing Huang, Yungang Bao, Onur Mutlu, Guangming Tan, Mingyu Chen
2011SCFast implementation of DGEMM on Fermi GPU.Guangming Tan, Linchuan Li, Sean Triechle, Everett H. Phillips, Yungang Bao, Ninghui Sun
2010EuroParPreliminary Investigation of Accelerating Molecular Dynamics Simulation on Godson-T Many-Core Processor.Liu Peng, Guangming Tan, Rajiv K. Kalia, Aiichiro Nakano, Priya Vashishta, Dongrui Fan, Ninghui Sun
2010ICPADSAutomatically Tuned Dynamic Programming with an Algorithm-by-Blocks.Jiajia Li, Guangming Tan, Mingyu Chen
2009EuroParHigh Performance Matrix Multiplication on Many Cores.Nan Yuan, Yongbin Zhou, Guangming Tan, Junchao Zhang, Dongrui Fan
2009ICPPA Parallel Algorithm for Computing Betweenness Centrality.Guangming Tan, Dengbiao Tu, Ninghui Sun
2009ICSSingle-particle 3d reconstruction from cryo-electron microscopy images on GPU.Guangming Tan, Ziyu Guo, Mingyu Chen, Dan Meng
2009ISPACharacterizing Betweenness Centrality Algorithm on Multi-core Architectures.Dengbiao Tu, Guangming Tan
2008PPoPPExperience on optimizing irregular computation for memory hierarchy in manycore architecture.Guangming Tan, Dongrui Fan, Junchao Zhang, Andrew Russo, Guang R. Gao
2007SCImplementation of the Smith-Waterman algorithm on a reconfigurable supercomputing platform.Peiheng Zhang, Guangming Tan, Guang R. Gao
2007SPAAA parallel dynamic programming algorithm on a multi-core architecture.Guangming Tan, Ninghui Sun, Guang R. Gao
2006EuroParLoad Balancing and Parallel Multiple Sequence Alignment with Tree Accumulation.Guangming Tan, Liu Peng, Shengzhong Feng, Ninghui Sun
2006SCBiology - Locality and parallelism optimization for dynamic programming algorithm in bioinformatics.Guangming Tan, Shengzhong Feng, Ninghui Sun
2005ICCSExploiting Parallelization for RNA Secondary Structure Prediction in Cluster.Guangming Tan, Shengzhong Feng, Ninghui Sun
2005ICCSAn Efficient Dynamic Programming Algorithm and Implementation for RNA Secondary Structure Prediction.Guangming Tan, Xinchun Liu, Ninghui Sun
2005ICPADSAn Optimized Algorithm of High Spatial-temporal Efficiency for MegaBlast.Guangming Tan, Lin Xu, Yishan Jiao, Shengzhong Feng, Dongbo Bu, Ninghui Sun
2005ISPDCLoad Balancing Algorithm in Cluster-based RNA secondary structure Prediction.Guangming Tan, Shengzhong Feng, Ninghui Sun