Xulong Tang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
61
Venues
23
Active years
2012–2026
Best venue rank
A*
Where they publish
- A*HPCA7 papers
- A*MICRO6 papers
- A*DAC5 papers
- A*PLDI5 papers
- A*SIGMETRICS5 papers
- A*ASPLOS4 papers
- AICCAD4 papers
- A*ICLR3 papers
- BPPoPP3 papers
- A*ISCA2 papers
- CICCD2 papers
- A*WWW2 papers
- A*AAAI2 papers
- BMASCOTS2 papers
- A*SIGGRAPH1 paper
- A*VR1 paper
- BASPDAC1 paper
- A*ICML1 paper
- AICS1 paper
- ASC1 paper
- A*ECCV1 paper
- ARTAS1 paper
- NationalHiPC1 paper
Papers
61 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | SIGGRAPH | MACE-Dance: Motion-Appearance Cascaded Experts for Music-Driven Dance Video Generation. | Kaixing Yang, Jiashu Zhu, Xulong Tang, Ziqiao Peng, Xiangyue Zhang, Puwei Wang, Jiahong Wu, Xiangxiang Chu, Hongyan Liu, Jun He |
| 2026 | VR | Personalized Dance Synthesis Based on Physical and Cognitive Intensities. | Xulong Tang, Eun Yeo, Ruiyu Mao, Xiaohu Guo, Rawan Alghofaili |
| 2025 | ASPDAC | A Computation and Energy Efficient Hardware Architecture for SSL Acceleration. | Huidong Ji, Sheng Li, Yue Cao, Chen Ding, Jiawei Xu, Qitao Tan, Jun Liu, Ao Li, Xulong Tang, Lirong Zheng, Geng Yuan, Zhuo Zou |
| 2025 | ASPLOS | Cascade: A Dependency-aware Efficient Training Framework for Temporal Graph Neural Network. | Yue Dai, Xulong Tang, Youtao Zhang |
| 2025 | ASPLOS | Pruner: A Draft-then-Verify Exploration Mechanism to Accelerate Tensor Program Tuning. | Liang Qiao, Jun Shi, Xiaoyu Hao, Xi Fang, Sen Zhang, Minfan Zhao, Ziqi Zhu, Junshi Chen, Hong An, Xulong Tang, Bing Li, Honghui Yuan, Xinyang Wang |
| 2025 | HPCA | OASIS: Object-Aware Page Management for Multi-GPU Systems. | Yueqi Wang, Bingyao Li, Mohamed Tarek Ibn Ziad, Lieven Eeckhout, Jun Yang, Aamer Jaleel, Xulong Tang |
| 2025 | ICCAD | STMC: Small-Tile Multiple-Copy Compilation for Reliable Measurement-Based Quantum Computing. | Rongchao Dong, Zewei Mo, Yingheng Li, Aditya Pawar, Jun Yang, Youtao Zhang, Xulong Tang |
| 2025 | ICLR | Mutual Effort for Efficiency: A Similarity-based Token Pruning for Vision Transformers in Self-Supervised Learning. | Sheng Li, Qitao Tan, Yue Dai, Zhenglun Kong, Tianyu Wang, Jun Liu, Ao Li, Ninghao Liu, Yufei Ding, Xulong Tang, Geng Yuan |
| 2025 | ICML | MemFreezing: A Novel Adversarial Attack on Temporal Graph Neural Networks under Limited Future Knowledge. | Yue Dai, Liang Liu, Xulong Tang, Youtao Zhang, Jun Yang |
| 2025 | ISCA | Reinforcement Learning-Guided Graph State Generation in Photonic Quantum Computers. | Yingheng Li, Yue Dai, Aditya Pawar, Rongchao Dong, Jun Yang, Youtao Zhang, Xulong Tang |
| 2025 | ICS | CIExplorer: Microarchitecture-Aware Exploration for Tightly Integrated Custom Instruction. | Xiaoyu Hao, Sen Zhang, Liang Qiao, Qingcai Jiang, Jun Shi, Junshi Chen, Hong An, Xulong Tang, Hao Shu, Honghui Yuan |
| 2025 | SC | WAGES: Workload-Aware GPU Sharing System for Energy-Efficient Serverless LLM Serving. | Tianyu Wang, Gourav Rattihalli, Aditya Dhakal, Xulong Tang, Dejan S. Milojicic |
| 2024 | ASPLOS | FMCC: Flexible Measurement-based Quantum Computation over Cluster State. | Yingheng Li, Aditya Pawar, Zewei Mo, Youtao Zhang, Jun Yang, Xulong Tang |
| 2024 | ASPLOS | QRCC: Evaluating Large Quantum Circuits on Small Quantum Computers through Integrated Qubit Reuse and Circuit Cutting. | Aditya Pawar, Yingheng Li, Zewei Mo, Yanan Guo, Xulong Tang, Youtao Zhang, Jun Yang |
| 2024 | DAC | LOTUS: learning-based online thermal and latency variation management for two-stage detectors on edge devices. | Yifan Gong, Yushu Wu, Zheng Zhan, Pu Zhao, Liangkai Liu, Chao Wu, Xulong Tang, Yanzhi Wang |
| 2024 | DAC | FCM: A Fusion-aware Wire Cutting Approach for Measurement-based Quantum Computing. | Zewei Mo, Yingheng Li, Aditya Pawar, Xulong Tang, Jun Yang, Youtao Zhang |
| 2024 | HPCA | GRIT: Enhancing Multi-GPU Performance with Fine-Grained Dynamic Page Placement. | Yueqi Wang, Bingyao Li, Aamer Jaleel, Jun Yang, Xulong Tang |
| 2024 | ICLR | Waxing-and-Waning: a Generic Similarity-based Framework for Efficient Self-Supervised Learning. | Sheng Li, Chao Wu, Ao Li, Yanzhi Wang, Xulong Tang, Geng Yuan |
| 2024 | MICRO | STAR: Sub-Entry Sharing-Aware TLB for Multi-Instance GPU. | Bingyao Li, Yueqi Wang, Tianyu Wang, Lieven Eeckhout, Jun Yang, Aamer Jaleel, Xulong Tang |
| 2023 | DAC | Orchestrating Measurement-Based Quantum Computation over Photonic Quantum Processors. | Yingheng Li, Aditya Pawar, Mohadeseh Azari, Yanan Guo, Youtao Zhang, Jun Yang, Kaushik Parasuram Seshadreesan, Xulong Tang |
| 2023 | DAC | Orchestrated Scheduling and Partitioning for Improved Address Translation in GPUs. | Bingyao Li, Yueqi Wang, Xulong Tang |
| 2023 | DAC | EP-ORAM: Efficient NVM-Friendly Path Eviction for Ring ORAM in Hybrid Memory. | Mehrnoosh Raoufi, Jun Yang, Xulong Tang, Youtao Zhang |
| 2023 | HPCA | CEGMA: Coordinated Elastic Graph Matching Acceleration for Graph Matching Networks. | Yue Dai, Youtao Zhang, Xulong Tang |
| 2023 | HPCA | Trans-FW: Short Circuiting Page Table Walk in Multi-GPU Systems via Remote Forwarding. | Bingyao Li, Jieming Yin, Anup Holey, Youtao Zhang, Jun Yang, Xulong Tang |
| 2023 | HPCA | AB-ORAM: Constructing Adjustable Buckets for Space Reduction in Ring ORAM. | Mehrnoosh Raoufi, Jun Yang, Xulong Tang, Youtao Zhang |
| 2023 | ICCD | FlexGM: An Adaptive Runtime System to Accelerate Graph Matching Networks on GPUs. | Yue Dai, Xulong Tang, Youtao Zhang |
| 2023 | ICLR | SmartFRZ: An Efficient Training Framework using Attention-Based Layer Freezing. | Sheng Li, Geng Yuan, Yue Dai, Youtao Zhang, Yanzhi Wang, Xulong Tang |
| 2023 | MICRO | IDYLL: Enhancing Page Translation in Multi-GPUs via Light Weight PTE Invalidations. | Bingyao Li, Yanan Guo, Yueqi Wang, Aamer Jaleel, Jun Yang, Xulong Tang |
| 2023 | MICRO | SupeRBNN: Randomized Binary Neural Network Using Adiabatic Superconductor Josephson Devices. | Zhengang Li, Geng Yuan, Tomoharu Yamauchi, Masoud Zabihi, Yanyue Xie, Peiyan Dong, Xulong Tang, Nobuyuki Yoshikawa, Devesh Tiwari, Yanzhi Wang, Olivia Chen |
| 2022 | ECCV | You Already Have It: A Generator-Free Low-Precision DNN Training Framework Using Stochastic Rounding. | Geng Yuan, Sung-En Chang, Qing Jin, Alec Lu, Yanyu Li, Yushu Wu, Zhenglun Kong, Yanyue Xie, Peiyan Dong, Minghai Qin, Xiaolong Ma, Xulong Tang, Zhenman Fang, Yanzhi Wang |
| 2022 | HPCA | Q-GPU: A Recipe of Optimizations for Quantum Circuit Simulation Using GPUs. | Yilun Zhao, Yanan Guo, Yuan Yao, Amanda Dumi, Devin M. Mulvey, Shiv Upadhyay, Youtao Zhang, Kenneth D. Jordan, Jun Yang, Xulong Tang |
| 2022 | ICCAD | Fine-Granular Computation and Data Layout Reorganization for Improving Locality. | Mahmut T. Kandemir, Xulong Tang, Jagadish Kotra, Mustafa Karaky |
| 2022 | ICCD | Enhancing GPU Performance via Neighboring Directory Table Based Inter-TLB Sharing. | Yajuan Du, Mingyang Liu, Yuqi Yang, Mingzhe Zhang, Xulong Tang |
| 2022 | WWW | Optimizing Data Layout for Training Deep Neural Networks. | Bingyao Li, Qi Xue, Geng Yuan, Sheng Li, Xiaolong Ma, Yanzhi Wang, Xulong Tang |
| 2021 | AAAI | YOLObile: Real-Time Object Detection on Mobile Devices via Compression-Compilation Co-Design. | Yuxuan Cai, Hongjia Li, Geng Yuan, Wei Niu, Yanyu Li, Xulong Tang, Bin Ren, Yanzhi Wang |
| 2021 | AAAI | A Compression-Compilation Co-Design Framework Towards Real-Time Object Detection on Mobile Devices. | Yuxuan Cai, Geng Yuan, Hongjia Li, Wei Niu, Yanyu Li, Xulong Tang, Bin Ren, Yanzhi Wang |
| 2021 | ICCAD | ScaleDNN: Data Movement Aware DNN Training on Multi-GPU. | Weizheng Xu, Ashutosh Pattnaik, Geng Yuan, Yanzhi Wang, Youtao Zhang, Xulong Tang |
| 2021 | ICCAD | Automated Runtime-Aware Scheduling for Multi-Tenant DNN Inference on GPU. | Fuxun Yu, Shawn Bray, Di Wang, Longfei Shangguan, Xulong Tang, Chenchen Liu, Xiang Chen |
| 2021 | MICRO | Improving Address Translation in Multi-GPUs via Sharing and Spilling aware TLB Design. | Bingyao Li, Jieming Yin, Youtao Zhang, Xulong Tang |
| 2021 | PLDI | Fluid: a framework for approximate concurrency via controlled dependency relaxation. | Huaipan Jiang, Haibo Zhang, Xulong Tang, Vineetha Govindaraj, Jack Sampson, Mahmut Taylan Kandemir, Danfeng Zhang |
| 2021 | PLDI | Distance-in-time versus distance-in-space. | Mahmut Taylan Kandemir, Xulong Tang, Hui Zhao, Jihyun Ryoo, Mustafa Karaky |
| 2021 | PPoPP | Compiler support for near data computing. | Mahmut Taylan Kandemir, Jihyun Ryoo, Xulong Tang, Mustafa Karaky |
| 2021 | WWW | Parallelizing DNN Training on GPUs: Challenges and Opportunities. | Weizheng Xu, Youtao Zhang, Xulong Tang |
| 2021 | SIGMETRICS | Mix and Match: Reorganizing Tasks for Enhancing Data Locality. | Xulong Tang, Mahmut Taylan Kandemir, Mustafa Karaky |
| 2021 | RTAS | Work in Progress: Mobile or FPGA? A Comprehensive Evaluation on Energy Efficiency and a Unified Optimization Framework. | Geng Yuan, Peiyan Dong, Mengshu Sun, Wei Niu, Zhengang Li, Yuxuan Cai, Jun Liu, Weiwen Jiang, Xue Lin, Bin Ren, Xulong Tang, Yanzhi Wang |
| 2019 | HiPC | Architecture-Centric Bottleneck Analysis for Deep Neural Network Applications. | Jihyun Ryoo, Mengran Fan, Xulong Tang, Huaipan Jiang, Meena Arunachalam, Sharada Naveen, Mahmut T. Kandemir |
| 2019 | ISCA | Opportunistic computing in GPU architectures. | Ashutosh Pattnaik, Xulong Tang, Onur Kayiran, Adwait Jog, Asit K. Mishra, Mahmut T. Kandemir, Anand Sivasubramaniam, Chita R. Das |
| 2019 | PLDI | Co-optimizing memory-level parallelism and cache-level parallelism. | Xulong Tang, Mahmut Taylan Kandemir, Mustafa Karaky, Meenakshi Arunachalam |
| 2019 | SIGMETRICS | Architecture-Aware Approximate Computing. | Mustafa Karaky, Orhan Kislal, Xulong Tang, Mahmut Taylan Kandemir, Meenakshi Arunachalam |
| 2019 | SIGMETRICS | Computing with Near Data. | Xulong Tang, Mahmut Taylan Kandemir, Hui Zhao, Myoungsoo Jung, Mustafa Karaky |
| 2019 | SIGMETRICS | Quantifying Data Locality in Dynamic Parallelism in GPUs. | Xulong Tang, Ashutosh Pattnaik, Onur Kayiran, Adwait Jog, Mahmut Taylan Kandemir, Chita R. Das |
| 2018 | MASCOTS | Quantifying and Optimizing Data Access Parallelism on Manycores. | Jihyun Ryoo, Orhan Kislal, Xulong Tang, Mahmut T. Kandemir |
| 2018 | PLDI | Enhancing computation-to-core assignment with physical location information. | Orhan Kislal, Jagadish Kotra, Xulong Tang, Mahmut Taylan Kandemir, Myoungsoo Jung |
| 2018 | PPoPP | Oversubscribed Command Queues in GPUs. | Sooraj Puthoor, Xulong Tang, Joseph Gross, Bradford M. Beckmann |
| 2017 | HPCA | Controlled Kernel Launch for Dynamic Parallelism in GPUs. | Xulong Tang, Ashutosh Pattnaik, Huaipan Jiang, Onur Kayiran, Adwait Jog, Sreepathi Pai, Mohamed Assem Ibrahim, Mahmut T. Kandemir, Chita R. Das |
| 2017 | MASCOTS | DEMM: A Dynamic Energy-Saving Mechanism for Multicore Memories. | Akbar Sharifi, Wei Ding, Diana R. Guttman, Hui Zhao, Xulong Tang, Mahmut T. Kandemir, Chita R. Das |
| 2017 | MICRO | Data movement aware computation partitioning. | Xulong Tang, Orhan Kislal, Mahmut T. Kandemir, Mustafa Karaky |
| 2016 | MICRO | Improving bank-level parallelism for irregular applications. | Xulong Tang, Mahmut T. Kandemir, Praveen Yedlapalli, Jagadish Kotra |
| 2015 | PLDI | Optimizing off-chip accesses in multicores. | Wei Ding, Xulong Tang, Mahmut T. Kandemir, Yuanrui Zhang, Emre Kultursay |
| 2015 | SIGMETRICS | Memory Row Reuse Distance and its Role in Optimizing Application Performance. | Mahmut T. Kandemir, Hui Zhao, Xulong Tang, Mustafa Karaky |
| 2012 | PPoPP | FlexBFS: a parallelism-aware implementation of breadth-first search on GPU. | Gu Liu, Hong An, Wenting Han, Xiaoqiang Li, Tao Sun, Wei Zhou, Xuechao Wei, Xulong Tang |