Skip to content

Xulong Tang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

61

Venues

23

Active years

2012–2026

Best venue rank

A*

Where they publish

Papers

61 indexed papers, newest first.

YearVenueTitleAuthors
2026SIGGRAPHMACE-Dance: Motion-Appearance Cascaded Experts for Music-Driven Dance Video Generation.Kaixing Yang, Jiashu Zhu, Xulong Tang, Ziqiao Peng, Xiangyue Zhang, Puwei Wang, Jiahong Wu, Xiangxiang Chu, Hongyan Liu, Jun He
2026VRPersonalized Dance Synthesis Based on Physical and Cognitive Intensities.Xulong Tang, Eun Yeo, Ruiyu Mao, Xiaohu Guo, Rawan Alghofaili
2025ASPDACA Computation and Energy Efficient Hardware Architecture for SSL Acceleration.Huidong Ji, Sheng Li, Yue Cao, Chen Ding, Jiawei Xu, Qitao Tan, Jun Liu, Ao Li, Xulong Tang, Lirong Zheng, Geng Yuan, Zhuo Zou
2025ASPLOSCascade: A Dependency-aware Efficient Training Framework for Temporal Graph Neural Network.Yue Dai, Xulong Tang, Youtao Zhang
2025ASPLOSPruner: A Draft-then-Verify Exploration Mechanism to Accelerate Tensor Program Tuning.Liang Qiao, Jun Shi, Xiaoyu Hao, Xi Fang, Sen Zhang, Minfan Zhao, Ziqi Zhu, Junshi Chen, Hong An, Xulong Tang, Bing Li, Honghui Yuan, Xinyang Wang
2025HPCAOASIS: Object-Aware Page Management for Multi-GPU Systems.Yueqi Wang, Bingyao Li, Mohamed Tarek Ibn Ziad, Lieven Eeckhout, Jun Yang, Aamer Jaleel, Xulong Tang
2025ICCADSTMC: Small-Tile Multiple-Copy Compilation for Reliable Measurement-Based Quantum Computing.Rongchao Dong, Zewei Mo, Yingheng Li, Aditya Pawar, Jun Yang, Youtao Zhang, Xulong Tang
2025ICLRMutual Effort for Efficiency: A Similarity-based Token Pruning for Vision Transformers in Self-Supervised Learning.Sheng Li, Qitao Tan, Yue Dai, Zhenglun Kong, Tianyu Wang, Jun Liu, Ao Li, Ninghao Liu, Yufei Ding, Xulong Tang, Geng Yuan
2025ICMLMemFreezing: A Novel Adversarial Attack on Temporal Graph Neural Networks under Limited Future Knowledge.Yue Dai, Liang Liu, Xulong Tang, Youtao Zhang, Jun Yang
2025ISCAReinforcement Learning-Guided Graph State Generation in Photonic Quantum Computers.Yingheng Li, Yue Dai, Aditya Pawar, Rongchao Dong, Jun Yang, Youtao Zhang, Xulong Tang
2025ICSCIExplorer: Microarchitecture-Aware Exploration for Tightly Integrated Custom Instruction.Xiaoyu Hao, Sen Zhang, Liang Qiao, Qingcai Jiang, Jun Shi, Junshi Chen, Hong An, Xulong Tang, Hao Shu, Honghui Yuan
2025SCWAGES: Workload-Aware GPU Sharing System for Energy-Efficient Serverless LLM Serving.Tianyu Wang, Gourav Rattihalli, Aditya Dhakal, Xulong Tang, Dejan S. Milojicic
2024ASPLOSFMCC: Flexible Measurement-based Quantum Computation over Cluster State.Yingheng Li, Aditya Pawar, Zewei Mo, Youtao Zhang, Jun Yang, Xulong Tang
2024ASPLOSQRCC: Evaluating Large Quantum Circuits on Small Quantum Computers through Integrated Qubit Reuse and Circuit Cutting.Aditya Pawar, Yingheng Li, Zewei Mo, Yanan Guo, Xulong Tang, Youtao Zhang, Jun Yang
2024DACLOTUS: learning-based online thermal and latency variation management for two-stage detectors on edge devices.Yifan Gong, Yushu Wu, Zheng Zhan, Pu Zhao, Liangkai Liu, Chao Wu, Xulong Tang, Yanzhi Wang
2024DACFCM: A Fusion-aware Wire Cutting Approach for Measurement-based Quantum Computing.Zewei Mo, Yingheng Li, Aditya Pawar, Xulong Tang, Jun Yang, Youtao Zhang
2024HPCAGRIT: Enhancing Multi-GPU Performance with Fine-Grained Dynamic Page Placement.Yueqi Wang, Bingyao Li, Aamer Jaleel, Jun Yang, Xulong Tang
2024ICLRWaxing-and-Waning: a Generic Similarity-based Framework for Efficient Self-Supervised Learning.Sheng Li, Chao Wu, Ao Li, Yanzhi Wang, Xulong Tang, Geng Yuan
2024MICROSTAR: Sub-Entry Sharing-Aware TLB for Multi-Instance GPU.Bingyao Li, Yueqi Wang, Tianyu Wang, Lieven Eeckhout, Jun Yang, Aamer Jaleel, Xulong Tang
2023DACOrchestrating Measurement-Based Quantum Computation over Photonic Quantum Processors.Yingheng Li, Aditya Pawar, Mohadeseh Azari, Yanan Guo, Youtao Zhang, Jun Yang, Kaushik Parasuram Seshadreesan, Xulong Tang
2023DACOrchestrated Scheduling and Partitioning for Improved Address Translation in GPUs.Bingyao Li, Yueqi Wang, Xulong Tang
2023DACEP-ORAM: Efficient NVM-Friendly Path Eviction for Ring ORAM in Hybrid Memory.Mehrnoosh Raoufi, Jun Yang, Xulong Tang, Youtao Zhang
2023HPCACEGMA: Coordinated Elastic Graph Matching Acceleration for Graph Matching Networks.Yue Dai, Youtao Zhang, Xulong Tang
2023HPCATrans-FW: Short Circuiting Page Table Walk in Multi-GPU Systems via Remote Forwarding.Bingyao Li, Jieming Yin, Anup Holey, Youtao Zhang, Jun Yang, Xulong Tang
2023HPCAAB-ORAM: Constructing Adjustable Buckets for Space Reduction in Ring ORAM.Mehrnoosh Raoufi, Jun Yang, Xulong Tang, Youtao Zhang
2023ICCDFlexGM: An Adaptive Runtime System to Accelerate Graph Matching Networks on GPUs.Yue Dai, Xulong Tang, Youtao Zhang
2023ICLRSmartFRZ: An Efficient Training Framework using Attention-Based Layer Freezing.Sheng Li, Geng Yuan, Yue Dai, Youtao Zhang, Yanzhi Wang, Xulong Tang
2023MICROIDYLL: Enhancing Page Translation in Multi-GPUs via Light Weight PTE Invalidations.Bingyao Li, Yanan Guo, Yueqi Wang, Aamer Jaleel, Jun Yang, Xulong Tang
2023MICROSupeRBNN: Randomized Binary Neural Network Using Adiabatic Superconductor Josephson Devices.Zhengang Li, Geng Yuan, Tomoharu Yamauchi, Masoud Zabihi, Yanyue Xie, Peiyan Dong, Xulong Tang, Nobuyuki Yoshikawa, Devesh Tiwari, Yanzhi Wang, Olivia Chen
2022ECCVYou Already Have It: A Generator-Free Low-Precision DNN Training Framework Using Stochastic Rounding.Geng Yuan, Sung-En Chang, Qing Jin, Alec Lu, Yanyu Li, Yushu Wu, Zhenglun Kong, Yanyue Xie, Peiyan Dong, Minghai Qin, Xiaolong Ma, Xulong Tang, Zhenman Fang, Yanzhi Wang
2022HPCAQ-GPU: A Recipe of Optimizations for Quantum Circuit Simulation Using GPUs.Yilun Zhao, Yanan Guo, Yuan Yao, Amanda Dumi, Devin M. Mulvey, Shiv Upadhyay, Youtao Zhang, Kenneth D. Jordan, Jun Yang, Xulong Tang
2022ICCADFine-Granular Computation and Data Layout Reorganization for Improving Locality.Mahmut T. Kandemir, Xulong Tang, Jagadish Kotra, Mustafa Karaky
2022ICCDEnhancing GPU Performance via Neighboring Directory Table Based Inter-TLB Sharing.Yajuan Du, Mingyang Liu, Yuqi Yang, Mingzhe Zhang, Xulong Tang
2022WWWOptimizing Data Layout for Training Deep Neural Networks.Bingyao Li, Qi Xue, Geng Yuan, Sheng Li, Xiaolong Ma, Yanzhi Wang, Xulong Tang
2021AAAIYOLObile: Real-Time Object Detection on Mobile Devices via Compression-Compilation Co-Design.Yuxuan Cai, Hongjia Li, Geng Yuan, Wei Niu, Yanyu Li, Xulong Tang, Bin Ren, Yanzhi Wang
2021AAAIA Compression-Compilation Co-Design Framework Towards Real-Time Object Detection on Mobile Devices.Yuxuan Cai, Geng Yuan, Hongjia Li, Wei Niu, Yanyu Li, Xulong Tang, Bin Ren, Yanzhi Wang
2021ICCADScaleDNN: Data Movement Aware DNN Training on Multi-GPU.Weizheng Xu, Ashutosh Pattnaik, Geng Yuan, Yanzhi Wang, Youtao Zhang, Xulong Tang
2021ICCADAutomated Runtime-Aware Scheduling for Multi-Tenant DNN Inference on GPU.Fuxun Yu, Shawn Bray, Di Wang, Longfei Shangguan, Xulong Tang, Chenchen Liu, Xiang Chen
2021MICROImproving Address Translation in Multi-GPUs via Sharing and Spilling aware TLB Design.Bingyao Li, Jieming Yin, Youtao Zhang, Xulong Tang
2021PLDIFluid: a framework for approximate concurrency via controlled dependency relaxation.Huaipan Jiang, Haibo Zhang, Xulong Tang, Vineetha Govindaraj, Jack Sampson, Mahmut Taylan Kandemir, Danfeng Zhang
2021PLDIDistance-in-time versus distance-in-space.Mahmut Taylan Kandemir, Xulong Tang, Hui Zhao, Jihyun Ryoo, Mustafa Karaky
2021PPoPPCompiler support for near data computing.Mahmut Taylan Kandemir, Jihyun Ryoo, Xulong Tang, Mustafa Karaky
2021WWWParallelizing DNN Training on GPUs: Challenges and Opportunities.Weizheng Xu, Youtao Zhang, Xulong Tang
2021SIGMETRICSMix and Match: Reorganizing Tasks for Enhancing Data Locality.Xulong Tang, Mahmut Taylan Kandemir, Mustafa Karaky
2021RTASWork in Progress: Mobile or FPGA? A Comprehensive Evaluation on Energy Efficiency and a Unified Optimization Framework.Geng Yuan, Peiyan Dong, Mengshu Sun, Wei Niu, Zhengang Li, Yuxuan Cai, Jun Liu, Weiwen Jiang, Xue Lin, Bin Ren, Xulong Tang, Yanzhi Wang
2019HiPCArchitecture-Centric Bottleneck Analysis for Deep Neural Network Applications.Jihyun Ryoo, Mengran Fan, Xulong Tang, Huaipan Jiang, Meena Arunachalam, Sharada Naveen, Mahmut T. Kandemir
2019ISCAOpportunistic computing in GPU architectures.Ashutosh Pattnaik, Xulong Tang, Onur Kayiran, Adwait Jog, Asit K. Mishra, Mahmut T. Kandemir, Anand Sivasubramaniam, Chita R. Das
2019PLDICo-optimizing memory-level parallelism and cache-level parallelism.Xulong Tang, Mahmut Taylan Kandemir, Mustafa Karaky, Meenakshi Arunachalam
2019SIGMETRICSArchitecture-Aware Approximate Computing.Mustafa Karaky, Orhan Kislal, Xulong Tang, Mahmut Taylan Kandemir, Meenakshi Arunachalam
2019SIGMETRICSComputing with Near Data.Xulong Tang, Mahmut Taylan Kandemir, Hui Zhao, Myoungsoo Jung, Mustafa Karaky
2019SIGMETRICSQuantifying Data Locality in Dynamic Parallelism in GPUs.Xulong Tang, Ashutosh Pattnaik, Onur Kayiran, Adwait Jog, Mahmut Taylan Kandemir, Chita R. Das
2018MASCOTSQuantifying and Optimizing Data Access Parallelism on Manycores.Jihyun Ryoo, Orhan Kislal, Xulong Tang, Mahmut T. Kandemir
2018PLDIEnhancing computation-to-core assignment with physical location information.Orhan Kislal, Jagadish Kotra, Xulong Tang, Mahmut Taylan Kandemir, Myoungsoo Jung
2018PPoPPOversubscribed Command Queues in GPUs.Sooraj Puthoor, Xulong Tang, Joseph Gross, Bradford M. Beckmann
2017HPCAControlled Kernel Launch for Dynamic Parallelism in GPUs.Xulong Tang, Ashutosh Pattnaik, Huaipan Jiang, Onur Kayiran, Adwait Jog, Sreepathi Pai, Mohamed Assem Ibrahim, Mahmut T. Kandemir, Chita R. Das
2017MASCOTSDEMM: A Dynamic Energy-Saving Mechanism for Multicore Memories.Akbar Sharifi, Wei Ding, Diana R. Guttman, Hui Zhao, Xulong Tang, Mahmut T. Kandemir, Chita R. Das
2017MICROData movement aware computation partitioning.Xulong Tang, Orhan Kislal, Mahmut T. Kandemir, Mustafa Karaky
2016MICROImproving bank-level parallelism for irregular applications.Xulong Tang, Mahmut T. Kandemir, Praveen Yedlapalli, Jagadish Kotra
2015PLDIOptimizing off-chip accesses in multicores.Wei Ding, Xulong Tang, Mahmut T. Kandemir, Yuanrui Zhang, Emre Kultursay
2015SIGMETRICSMemory Row Reuse Distance and its Role in Optimizing Application Performance.Mahmut T. Kandemir, Hui Zhao, Xulong Tang, Mustafa Karaky
2012PPoPPFlexBFS: a parallelism-aware implementation of breadth-first search on GPU.Gu Liu, Hong An, Wenting Han, Xiaoqiang Li, Tao Sun, Wei Zhou, Xuechao Wei, Xulong Tang