Skip to content

Minjia Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

56

Venues

30

Active years

2010–2026

Best venue rank

A*

Where they publish

Papers

56 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAITeaching Large Language Models to Maintain Contextual Faithfulness via Synthetic Tasks and Reinforcement Learning.Shuzheng Si, Haozhe Zhao, Cheng Gao, Yuzhuo Bai, Zhitong Wang, Bofei Gao, Kangyang Luo, Wenhao Li, Yufei Huang, Gang Chen, Fanchao Qi, Minjia Zhang, Baobao Chang, Maosong Sun
2026ACLHidden States as Early Signals: Step-level Trace Evaluation and Pruning for Efficient Test-Time Scaling.Zhixiang Liang, Beichen Huang, Zheng Wang, Minjia Zhang
2026ACLFaithLens: Detecting and Explaining Faithfulness Hallucination.Shuzheng Si, Qingyi Wang, Haozhe Zhao, Yuzhuo Bai, Guanqiao Chen, Kangyang Luo, Gang Chen, Fanchao Qi, Minjia Zhang, Baobao Chang, Maosong Sun
2026ACLA Goal Without a Plan Is Just a Wish: Efficient and Effective Global Planner Training for Long-Horizon Agent Task.Shuzheng Si, Haozhe Zhao, Kangyang Luo, Gang Chen, Fanchao Qi, Minjia Zhang, Baobao Chang, Maosong Sun
2026ACLMENTOR: Efficient Autoregressive Image Generation with Balanced Multimodal Control.Haozhe Zhao, Zefan Cai, Shuzheng Si, Liang Chen, Jiuxiang Gu, Wen Xiao, Minjia Zhang, Junjie Hu
2026ASPLOSSuperOffload: Unleashing the Power of Large-Scale LLM Training on Superchips.Xinyu Lian, Masahiro Tanaka, Olatunji Ruwase, Minjia Zhang
2025ACLMiniKV: Pushing the Limits of 2-Bit KV Cache via Compression and System Co-Design for Efficient Long Context Inference.Akshat Sharma, Hangliang Ding, Jianping Li, Neel Dani, Minjia Zhang
2025ACLMedCite: Can Language Models Generate Verifiable Text for Medicine?Xiao Wang, Mengjue Tan, Qiao Jin, Guangzhi Xiong, Yu Hu, Aidong Zhang, Zhiyong Lu, Minjia Zhang
2025EMNLPCache-of-Thought: Master-Apprentice Framework for Cost-Effective Vision Language Model Reasoning.Mingyuan Wu, Jize Jiang, Haozhen Zheng, Meitang Li, Zhaoheng Li, Beitong Tian, Bo Chen, Yongjoo Park, Minjia Zhang, ChengXiang Zhai, Klara Nahrstedt
2025EMNLPLooking Beyond Text: Reducing Language Bias in Large Vision-Language Models via Multimodal Dual-Attention and Soft-Image Guidance.Haozhe Zhao, Shuzheng Si, Liang Chen, Yichi Zhang, Maosong Sun, Baobao Chang, Minjia Zhang
2025HPCAVQ-LLM: High-performance Code Generation for Vector Quantization Augmented LLM Inference.Zihan Liu, Xinhao Luo, Junxian Guo, Wentao Ni, Yangjie Zhou, Yue Guan, Cong Guo, Weihao Cui, Yu Feng, Minyi Guo, Yuhao Zhu, Minjia Zhang, Chen Jin, Jingwen Leng
2025HPCABuffalo: Enabling Large-Scale GNN Training via Memory-Efficient Bucketization.Shuangyan Yang, Minjia Zhang, Dong Li
2025ICCVInstantEdit: Text-Guided Few-Step Image Editing with Piecewise Rectified Flow.Yiming Gong, Zhen Zhu, Minjia Zhang
2025ICSELarge Language Models as Configuration Validators.Xinyu Lian, Yinfang Chen, Runxiang Cheng, Jie Huang, Parth Thakkar, Minjia Zhang, Tianyin Xu
2025MICRONetZIP: Algorithm/Hardware Co-design of In-network Lossless Compression for Distributed Large Model Training.Jinghan Huang, Hyungyo Kim, Nachuan Wang, Jaeyoung Kang, Hrishi Shah, Eun Kyung Lee, Minjia Zhang, Fan Lai, Nam Sung Kim
2025SCX-MoE: Enabling Scalable Training for Emerging Mixture-of-Experts Architectures on HPC Platforms.Yueming Yuan, Ahan Gupta, Jianping Li, Sajal Dash, Feiyi Wang, Minjia Zhang
2025SENSYSToward Sensor-In-the-Loop LLM Agent: Benchmarks and Implications.Zhiwei Ren, Junbo Li, Minjia Zhang, Di Wang, Xiaoran Fan, Longfei Shangguan
2025USENIXUniversal Checkpointing: A Flexible and Efficient Distributed Checkpointing System for Large-Scale DNN Training with Reconfigurable Parallelism.Xinyu Lian, Sam Ade Jacobs, Lev Kurilenko, Masahiro Tanaka, Stas Bekman, Olatunji Ruwase, Minjia Zhang
2024AAAIDeepSpeed Data Efficiency: Improving Deep Learning Model Quality and Training Efficiency via Efficient Data Sampling and Routing.Conglong Li, Zhewei Yao, Xiaoxia Wu, Minjia Zhang, Connor Holmes, Cheng Li, Yuxiong He
2024ICLRModel Tells You What to Discard: Adaptive KV Cache Compression for LLMs.Suyu Ge, Yunan Zhang, Liyuan Liu, Minjia Zhang, Jiawei Han, Jianfeng Gao
2024NSDIParcae: Proactive, Liveput-Optimized DNN Training on Preemptible Instances.Jiangfei Duan, Ziang Song, Xupeng Miao, Xiaoli Xi, Dahua Lin, Harry Xu, Minjia Zhang, Zhihao Jia
2024PODCSystem Optimizations for Enabling Training of Extreme Long Sequence Transformer Models.Sam Ade Jacobs, Masahiro Tanaka, Chengming Zhang, Minjia Zhang, Reza Yazdani Aminadabi, Shuaiwen Leon Song, Samyam Rajbhandari, Yuxiong He
2023ASPLOSBetty: Enabling Large-Scale GNN Training with Batch-Level Graph Partitioning.Shuangyan Yang, Minjia Zhang, Wenqian Dong, Dong Li
2023ECAIRevisiting the Efficiency-Accuracy Tradeoff in Adapting Transformer Models via Adversarial Fine-Tuning.Minjia Zhang, Uma-Naresh Niranjan, Yuxiong He
2023ICLRMaximizing Communication Efficiency for Large-scale Training via 0/1 Adam.Yucheng Lu, Conglong Li, Minjia Zhang, Christopher De Sa, Yuxiong He
2023MOBICOMCost-effective On-device Continual Learning over Memory Hierarchy with Miro.Xinyue Ma, Suyeon Jeong, Minjia Zhang, Di Wang, Jonghyun Choi, Myeongjae Jeon
2023NSDIBamboo: Making Preemptible Instances Resilient for Affordable Training of Large DNNs.John Thorpe, Pengzhan Zhao, Jonathan Eyolfson, Yifan Qiao, Zhihao Jia, Minjia Zhang, Ravi Netravali, Guoqing Harry Xu
2023PPoPPiQAN: Fast and Accurate Vector Search with Efficient Intra-Query Parallelism on Multi-Core Architectures.Zhen Peng, Minjia Zhang, Kai Li, Ruoming Jin, Bin Ren
2022AAAIAdversarial Data Augmentation for Task-Specific Knowledge Distillation of Pre-trained Transformers.Minjia Zhang, Uma-Naresh Niranjan, Yuxiong He
2022DACCarM: hierarchical episodic memory for continual learning.Soobee Lee, Minindu Weerakoon, Jonghyun Choi, Minjia Zhang, Di Wang, Myeongjae Jeon
2022ICMLDeepSpeed-MoE: Advancing Mixture-of-Experts Inference and Training to Power Next-Generation AI Scale.Samyam Rajbhandari, Conglong Li, Zhewei Yao, Minjia Zhang, Reza Yazdani Aminabadi, Ammar Ahmad Awan, Jeff Rasley, Yuxiong He
2022WWWPowering Multi-Task Federated Learning with Competitive GPU Resource Sharing.Yongbo Yu, Fuxun Yu, Zirui Xu, Di Wang, Minjia Zhang, Ang Li, Shawn Bray, Chenchen Liu, Xiang Chen
2022SCDeepSpeed- Inference: Enabling Efficient Inference of Transformer Models at Unprecedented Scale.Reza Yazdani Aminabadi, Samyam Rajbhandari, Ammar Ahmad Awan, Cheng Li, Du Li, Elton Zheng, Olatunji Ruwase, Shaden Smith, Minjia Zhang, Jeff Rasley, Yuxiong He
2022WSDMGraSP: Optimizing Graph-based Nearest Neighbor Search with Subgraph Sampling and Pruning.Minjia Zhang, Wenhan Wang, Yuxiong He
2021HPCASentinel: Efficient Tensor Migration and Allocation on Heterogeneous Memory Systems for Deep Learning.Jie Ren, Jiaolin Luo, Kai Wu, Minjia Zhang, Hyeran Jeon, Dong Li
2021ICLRDynaTune: Dynamic Tensor Program Optimization in Deep Neural Network Compilation.Minjia Zhang, Menghao Li, Chi Wang, Mingqin Li
2021ICSOCVertical Scaling of Resource for OpenMP Application.Junfeng Zhao, Minjia Zhang, Hongji Yang
2021WWWDL Inference and Training Optimization Towards Speed and Scale.Minjia Zhang
2021USENIXZeRO-Offload: Democratizing Billion-Scale Model Training.Jie Ren, Samyam Rajbhandari, Reza Yazdani Aminabadi, Olatunji Ruwase, Shuangyan Yang, Minjia Zhang, Dong Li, Yuxiong He
2020SIGMODImproving Approximate Nearest Neighbor Search through Learned Adaptive Early Termination.Conglong Li, Minjia Zhang, David G. Andersen, Yuxiong He
2019CIKMGRIP: Multi-Store Capacity-Optimized High-Performance Nearest Neighbor Search for Vector Search Engine.Minjia Zhang, Yuxiong He
2019UICCode Refactoring from OpenMP to MapReduce Model for Big Data Processing.Junfeng Zhao, Minjia Zhang, Hongji Yang
2018ICLRLearning Intrinsic Sparse Structures within Long Short-Term Memory.Wei Wen, Yuxiong He, Samyam Rajbhandari, Minjia Zhang, Wenhan Wang, Fang Liu, Bin Hu, Yiran Chen, Hai Li
2018ISPARefactoring OpenMP Code Based on MapReduce Model.Junfeng Zhao, Minjia Zhang
2018USENIXDeepCPU: Serving RNN-based Deep Learning Models 10x Faster.Minjia Zhang, Samyam Rajbhandari, Wenhan Wang, Yuxiong He
2017CCLightweight data race detection for production runs.Swarnendu Biswas, Man Cao, Minjia Zhang, Michael D. Bond, Benjamin P. Wood
2017PPoPPPOSTER: On the Problem of Consistency Exceptions in the Context of Strong Memory Models.Minjia Zhang, Swarnendu Biswas, Michael D. Bond
2016CCRelaxed dependence tracking for parallel runtime support.Minjia Zhang, Swarnendu Biswas, Michael D. Bond
2016PPoPPDrinking from both glasses: combining pessimistic and optimistic tracking of cross-thread dependences.Man Cao, Minjia Zhang, Aritra Sengupta, Michael D. Bond
2015ASPLOSHybrid Static: Dynamic Analysis for Statically Bounded Region Serializability.Aritra Sengupta, Swarnendu Biswas, Minjia Zhang, Michael D. Bond, Milind Kulkarni
2015OOPSLAValor: efficient, software-only region conflict exceptions.Swarnendu Biswas, Minjia Zhang, Michael D. Bond, Brandon Lucia
2015OOPSLASIRe: an efficient snapshot isolation-based memory model for detecting and tolerating region conflicts.Minjia Zhang
2015PPoPPLow-overhead software transactional memory with progress guarantees and strong semantics.Minjia Zhang, Jipeng Huang, Man Cao, Michael D. Bond
2013OOPSLAOCTET: capturing and controlling cross-thread dependences efficiently.Michael D. Bond, Milind Kulkarni, Man Cao, Minjia Zhang, Meisam Fathi Salmi, Swarnendu Biswas, Aritra Sengupta, Jipeng Huang
2011ICPPMemcached Design on High Performance RDMA Capable Interconnects.Jithin Jose, Hari Subramoni, Miao Luo, Minjia Zhang, Jian Huang, Md. Wasi-ur-Rahman, Nusrat S. Islam, Xiangyong Ouyang, Hao Wang, Sayantan Sur, Dhabaleswar K. Panda
2010ICPADSVirtCFT: A Transparent VM-Level Fault-Tolerant System for Virtual Clusters.Minjia Zhang, Hai Jin, Xuanhua Shi, Song Wu