| 2026 | EuroPar | TBF: A Tunable Blocking-and-Fusion Algorithm for Efficient GPU Symmetric Rank-2K Updates. | Lijuan Hu, Xinzhe Chen, Haowei Li, Hongyaoxing Gu, Wenjing Ma, Fangfang Liu, Cui Wang, Yuwen Zhao |
| 2024 | WWW | Uncertainty-Aware Pre-Trained Foundation Models for Patient Risk Prediction via Gaussian Process. | Jiaying Lu, Shifan Zhao, Wenjing Ma, Hui Shao, Xiao Hu, Yuanzhe Xi, Carl Yang |
| 2023 | ICPP | GFFT: a Task Graph Based Fast Fourier Transform Optimization Framework. | Qinglin Lu, Xinyu Wang, Wenjing Ma, Yuwen Zhao, Daokun Chen, Fangfang Liu |
| 2023 | SIGIR | HiPrompt: Few-Shot Biomedical Knowledge Fusion via Hierarchy-Oriented Prompting. | Jiaying Lu, Jiaming Shen, Bo Xiong, Wenjing Ma, Steffen Staab, Carl Yang |
| 2022 | ICPP | EasyView: Enabling and Scheduling Tensor Views in Deep Learning Compilers. | Lijuan Jiang, Ping Xu, Qianchao Zhu, Xiuhong Li, Shengen Yan, Xingcheng Zhang, Dahua Lin, Wenjing Ma, Zhouyang Li, Jun Liu, Jinming Ma, Minxi Jin, Chao Yang |
| 2018 | CCGRID | Extreme-Scale Realistic Stencil Computations on Sunway TaihuLight with Ten Million Cores. | Ying Cai, Chao Yang, Wenjing Ma, Yulong Ao |
| 2017 | ICPP | Towards Highly Efficient DGEMM on the Emerging SW26010 Many-Core Processor. | Lijuan Jiang, Chao Yang, Yulong Ao, Wanwang Yin, Wenjing Ma, Qiao Sun, Fangfang Liu, Rongfen Lin, Peng Zhang |
| 2016 | BMVC | Multi-Scale Fully Convolutional Network for Fast Face Detection. | Yancheng Bai, Wenjing Ma, Yucheng Li, Liangliang Cao, Wen Guo, Luwei Yang |
| 2016 | IJCNN | Online variational Bayesian Support Vector Regression. | Siqi Deng, Kan Gao, Changying Du, Wenjing Ma, Guoping Long, Yucheng Li |
| 2016 | PDP | HPSVM: Heterogeneous Parallel SVM with Factorization Based IPM Algorithm on CPU-GPU Cluster. | Tao Li, Xuechen Liu, Qiankun Dong, Wenjing Ma, Kai Wang |
| 2016 | TrustCom | Data-Oriented Runtime Scheduling Framework on Multi-GPUs. | Tao Li, Kezhao Zhao, Qiankun Dong, Jiabing Ling, Yulu Yang, Wenjing Ma |
| 2016 | WISE | Bridging Semantic Gap Between App Names: Collective Matrix Factorization for Similar Mobile App Recommendation. | Ning Bu, Shuzi Niu, Lei Yu, Wenjing Ma, Guoping Long |
| 2015 | ICA3PP | PE-TLD: Parallel Extended Tracking-Learning-Detection for Multi-target Tracking. | Chenggang Zhou, Qiankun Dong, Wenjing Ma, Guoping Long, Tao Li |
| 2012 | HiPC | GMProf: A low-overhead, fine-grained profiling approach for GPU programs. | Mai Zheng, Vignesh T. Ravi, Wenjing Ma, Feng Qin, Gagan Agrawal |
| 2012 | IGARSS | Water quality model parameters inversion based on improved stochastic optimization. | Junping Zhang, Wenjing Ma, Jiaguo Qi |
| 2012 | ICS | Data-driven fault tolerance for work stealing computations. | Wenjing Ma, Sriram Krishnamoorthy |
| 2012 | KDD | SHALE: an efficient algorithm for allocation of guaranteed display advertising. | Vijay Bharadwaj, Peiji Chen, Wenjing Ma, Chandrashekhar Nagarajan, John A. Tomlin, Sergei Vassilvitskii, Erik Vee, Jian Yang |
| 2011 | CC | Practical Loop Transformations for Tensor Contraction Expressions on Multi-level Memory Hierarchies. | Wenjing Ma, Sriram Krishnamoorthy, Gagan Agrawal |
| 2011 | ICS | An execution strategy and optimized runtime support for parallelizing irregular reductions on modern GPUs. | Xin Huo, Vignesh T. Ravi, Wenjing Ma, Gagan Agrawal |
| 2011 | SC | Poster: FOX: a fault-oblivious extreme scale execution environment. | Ronald G. Minnich, Curtis L. Janssen, Sriram Krishnamoorthy, Andres Marquez, Wenjing Ma, Maya B. Gokhale, Ponnuswamy Sadayappan, Eric Van Hensbergen, Jonathan Appavoo, Jim McKie |
| 2010 | CIKM | Pricing guaranteed contracts in online display advertising. | Vijay Bharadwaj, Wenjing Ma, Michael Schwarz, Jayavel Shanmugasundaram, Erik Vee, Jack Xie, Jian Yang |
| 2010 | CLUSTER | Acceleration of Streamed Tensor Contraction Expressions on GPGPU-Based Clusters. | Wenjing Ma, Sriram Krishnamoorthy, Oreste Villa, Karol Kowalski |
| 2010 | HiPC | Approaches for parallelizing reductions on modern GPUs. | Xin Huo, Vignesh T. Ravi, Wenjing Ma, Gagan Agrawal |
| 2010 | HiPC | An integer programming framework for optimizing shared memory use on GPUs. | Wenjing Ma, Gagan Agrawal |
| 2010 | ICDM | Parallelizing an Information Theoretic Co-clustering Algorithm Using a Cloud Middleware. | Venkatram Ramanathan, Wenjing Ma, Vignesh T. Ravi, Tantan Liu, Gagan Agrawal |
| 2010 | ICS | Compiler and runtime support for enabling generalized reduction computations on heterogeneous parallel configurations. | Vignesh T. Ravi, Wenjing Ma, David Chiu, Gagan Agrawal |
| 2010 | VTC | A Light-Size AKA Mechanism for Optimal Distributed AAA authorization Architecture. | Wenjing Ma, Mei Song |
| 2009 | ICS | A translation system for enabling data mining applications on GPUs. | Wenjing Ma, Gagan Agrawal |
| 2009 | KDD | Online allocation of display advertisements subject to advanced sales contracts. | Saeed Alaei, Esteban Arcaute, Samir Khuller, Wenjing Ma, Azarakhsh Malekian, John A. Tomlin |
| 2009 | PPoPP | A compiler and runtime system for enabling data mining applications on gpus. | Wenjing Ma, Gagan Agrawal |
| 2008 | APSCC | An Optimization Method to Develop AAA Architectures with MIPv6 Mobility Support. | Wenjing Ma, Mei Song, Yong Zhang, Xin Lin, Huan Zhang |