| 2026 | PPoPP | MixFusion: A Patch-Level Parallel Serving System for Mixed-Resolution Diffusion Models. | Desen Sun, Zepeng Zhao, Yuke Wang |
| 2025 | AAAI | ScoreNet: Consistency-driven Framework with Multi-side Information Fusion for Session-based Recommendation. | Piao Tong, Qiao Liu, Zhipeng Zhang, Yuke Wang, Tian Lan |
| 2025 | OSDI | ZEN: Empowering Distributed Training with Sparsity-driven Data Synchronization. | Zhuang Wang, Zhaozhuo Xu, Jingyi Xi, Yuke Wang, Anshumali Shrivastava, T. S. Eugene Ng |
| 2025 | USENIX | GMI-DRL: Empowering Multi-GPU DRL with Adaptive-Grained Parallelism. | Yuke Wang, Boyuan Feng, Zheng Wang, Guyue Huang, Tony Tong Geng, Ang Li, Yufei Ding |
| 2025 | SOSP | Mercury: Unlocking Multi-GPU Operator Optimization for LLMs via Remote Memory Scheduling. | Yue Guan, Xinwei Qiang, Zaifeng Pan, Daniels Johnson, Yuanwei Fang, Keren Zhou, Yuke Wang, Wanlu Li, Yufei Ding, Adnan Aziz |
| 2025 | SOSP | HedraRAG: Co-Optimizing Generation and Retrieval for Heterogeneous RAG Workflows. | Zhengding Hu, Vibha Murthy, Zaifeng Pan, Wanlu Li, Xiaoyi Fang, Yufei Ding, Yuke Wang |
| 2024 | ASPLOS | ZENO: A Type-based Optimization Framework for Zero Knowledge Neural Network Inference. | Boyuan Feng, Zheng Wang, Yuke Wang, Shu Yang, Yufei Ding |
| 2024 | ASPLOS | RAP: Resource-aware Automated GPU Sharing for Multi-GPU Recommendation Model Training and Input Preprocessing. | Zheng Wang, Yuke Wang, Jiaqi Deng, Da Zheng, Ang Li, Yufei Ding |
| 2024 | IJCNN | Predicting Credit Spreads of Chinese Municipal Bonds: A Hybrid Model of Wavelet Transform, Random Forest, and SAM-GRU. | Yuke Wang, Jianwu Lin, Guangling Liu |
| 2024 | USENIX | OPER: Optimality-Guided Embedding Table Parallelization for Large-scale Recommendation Model. | Zheng Wang, Yuke Wang, Boyuan Feng, Guyue Huang, Dheevatsa Mudigere, Bharath Muthiah, Ang Li, Yufei Ding |
| 2023 | ISADS | Chinese named entity recognition based on Heterogeneous Graph and Dynamic Attention Network. | Yuke Wang, Ling Lu, Wu Yang, Yinong Chen |
| 2023 | ISCA | OneQ: A Compilation Framework for Photonic One-Way Quantum Computation. | Hezi Zhang, Anbang Wu, Yuke Wang, Gushu Li, Hassan Shapourian, Alireza Shabani, Yufei Ding |
| 2023 | OSDI | MGG: Accelerating Graph Neural Networks with Fine-Grained Intra-Kernel Communication-Computation Pipelining on Multi-GPU Platforms. | Yuke Wang, Boyuan Feng, Zheng Wang, Tong Geng, Kevin J. Barker, Ang Li, Yufei Ding |
| 2023 | USENIX | TC-GNN: Bridging Sparse GNN Computation and Dense Tensor Cores on GPUs. | Yuke Wang, Boyuan Feng, Zheng Wang, Guyue Huang, Yufei Ding |
| 2022 | PPoPP | QGTC: accelerating quantized graph neural networks via GPU tensor core. | Yuke Wang, Boyuan Feng, Yufei Ding |
| 2022 | SC | EL-Rec: Efficient Large-Scale Recommendation Model Training via Tensor-Train Embedding Table. | Zheng Wang, Yuke Wang, Boyuan Feng, Dheevatsa Mudigere, Bharath Muthiah, Yufei Ding |
| 2022 | USENIX | Faith: An Efficient Framework for Transformer Verification on GPUs. | Boyuan Feng, Tianqi Tang, Yuke Wang, Zhaodong Chen, Zheng Wang, Shu Yang, Yuan Xie, Yufei Ding |
| 2021 | AAAI | UAG: Uncertainty-aware Attention Graph Neural Network for Defending Adversarial Attacks. | Boyuan Feng, Yuke Wang, Yufei Ding |
| 2021 | CCGRID | TiAcc: Triangle-inequality based Hardware Accelerator for K-means on FPGAs. | Yuke Wang, Boyuan Feng, Gushu Li, Georgios Tzimpragos, Lei Deng, Yuan Xie, Yufei Ding |
| 2021 | CIKM | An Efficient Quantitative Approach for Optimizing Convolutional Neural Networks. | Yuke Wang, Boyuan Feng, Xueqiao Peng, Yufei Ding |
| 2021 | ICASSP | Saga: Sparse Adversarial Attack on EEG-Based Brain Computer Interface. | Boyuan Feng, Yuke Wang, Yufei Ding |
| 2021 | OSDI | GNNAdvisor: An Adaptive and Efficient Runtime System for GNN Acceleration on GPUs. | Yuke Wang, Boyuan Feng, Gushu Li, Shuangchen Li, Lei Deng, Yuan Xie, Yufei Ding |
| 2021 | PPoPP | EGEMM-TC: accelerating scientific computing on tensor cores with extended precision. | Boyuan Feng, Yuke Wang, Guoyang Chen, Weifeng Zhang, Yuan Xie, Yufei Ding |
| 2021 | SC | APNN-TC: accelerating arbitrary precision neural networks on ampere GPU tensor cores. | Boyuan Feng, Yuke Wang, Tong Geng, Ang Li, Yufei Ding |
| 2021 | USENIX | Palleon: A Runtime System for Efficient Video Processing toward Dynamic Class Skew. | Boyuan Feng, Yuke Wang, Gushu Li, Yuan Xie, Yufei Ding |
| 2020 | ICML | Boosting Deep Neural Network Efficiency with Dual-Module Inference. | Liu Liu, Lei Deng, Zhaodong Chen, Yuke Wang, Shuangchen Li, Jingwei Zhang, Yihua Yang, Zhenyu Gu, Yufei Ding, Yuan Xie |
| 2020 | ICTAI | SGQuant: Squeezing the Last Bit on Graph Neural Networks with Specialized Quantization. | Boyuan Feng, Yuke Wang, Xu Li, Shu Yang, Xueqiao Peng, Yufei Ding |
| 2019 | FCCM | KPynq: A Work-Efficient Triangle-Inequality Based K-Means on FPGA. | Yuke Wang, Zhaorui Zeng, Boyuan Feng, Lei Deng, Yufei Ding |
| 2008 | IV | Visualization of Clustered Directed Acyclic Graphs without Node Overlapping. | Pushpa Kumar, Kang Zhang, Yuke Wang |
| 2006 | GLOBECOM | A New Scalable Multicast Solution in MPLS Networks. | Lie Qian, Yiyan Tang, Yuke Wang, Bashar Bou-Diab, Wladek Olesinski |
| 2005 | Broadnets | Evaluation of burst retransmission in optical burst-switched networks. | Qiong Zhang, Vinod Vokkarane, Yuke Wang, Jason P. Jue |
| 2005 | GLOBECOM | A new fair bandwidth allocation algorithm for multimedia multicasting in DiffServ. | Lie Qian, Yiyan Tang, Yuke Wang, Bashar Bou-Diab, Wladek Olesinski |
| 2005 | GLOBECOM | Optimized software implementation of a full-rate IEEE 802.11a compliant digital baseband transmitter on a digital signal processor. | Yiyan Tang, Lie Qian, Yuke Wang |
| 2005 | GLOBECOM | Analysis of TCP over optical burst-switched networks with burst retransmission. | Qiong Zhang, Vinod Vokkarane, Yuke Wang, Jason P. Jue |
| 2004 | GLOBECOM | A new traffic model and statistical admission control algorithm for providing QoS guarantees to on-line traffic. | Lie Qian, Anand Krishnamurthy, Yuke Wang, Yiyan Tang, Philippe Dauchy, Alberto Conte |
| 2004 | GLOBECOM | A-Serv: a novel architecture providing scalable quality of service [Internet applications]. | Yuke Wang, Anand Krishnamurthy, Lie Qian, Philippe Dauchy, Alberto Conte |
| 2004 | GLOBECOM | A centralized key management scheme for hierarchical access control. | Qiong Zhang, Yuke Wang |
| 2003 | ICASSP | An efficient implementation of multi-prime RSA on DSP processor. | Anand Krishnamurthy, Yiyan Tang, Cathy Xu, Yuke Wang |
| 2003 | ICASSP | A method of generating uniformly distributed sequences over [0, K], where K+1 is not a power of two. | Richard Kuehnel, Yuke Wang |
| 2003 | ISCAS | A new memory reference reduction method for FFT implementation on DSP. | Yiyan Tang, Lie Qian, Yuke Wang, Yvon Savaria |
| 2003 | ISCAS | Low hardware complexity parallel turbo decoder architecture. | Zhongfeng Wang, Yiyan Tang, Yuke Wang |
| 2002 | ICASSP | A DSP-based turbo codec for 3G communication systems. | Yingtao Jiang, Yiyan Tang, Yuke Wang, Dian Zhou |
| 2002 | ICASSP | Reduce FFT memory reference for low power applications. | Yiyan Tang, Yingtao Jiang, Yuke Wang |
| 2002 | ICASSP | Optimized scheduling and mapping of logarithm and arctangent functions on TI TMS320C67X processor. | Mei Yang, Yuke Wang, Jinchu Wang, S. Q. Zheng |
| 2002 | ISCAS | A trace-back-free Viterbi decoder using a new survival path management algorithm. | Yingtao Jiang, Yiyan Tang, Yuke Wang, M. N. S. Swamy |
| 2001 | GLOBECOM | CAM-based label search engine for MPLS over ATM networks. | Yiyan Tang, Yingtao Jiang, Yuke Wang |
| 2000 | ICASSP | Explicit Cook-Toom algorithm for linear convolution. | Yuke Wang, Keshab K. Parhi |
| 1999 | ICASSP | A parallel residue-to-binary converter. | Wei Wang, M. N. S. Swamy, M. Omair Ahmad, Yuke Wang |
| 1999 | ISCAS | A high-speed residue-to-binary converter and a scheme for its VLSI implementation. | Wei Wang, M. N. S. Swamy, M. Omair Ahmad, Yuke Wang |
| 1999 | VLSID | Lossy Compression of Images Using Logic Minimization. | Jacob Augustine, William E. Lynch, Yuke Wang, Asim J. Al-Khalili |