| 2026 | Illusions of the Gold Standard: A Large-scale Analysis of Human Evaluation Protocols for Long-form Text Generation. | Katelyn Xiaoying Mei, Yi-Li Hsu, Minjoon Choi, Zongwan Cao, Chenjun Xu, Bingbing Wen, Su Lin Blodgett, Lucy Lu Wang |
| 2026 | TEN: Table Explicitization, Neurosymbolically. | Nikita Mehrotra, Aayush Kumar, Sumit Gulwani, Arjun Radhakrishna, Ashish Tiwari |
| 2026 | FormalScience: Scalable Human-in-the-Loop Autoformalisation of Science with Agentic Code Generation in Lean. | Jordan Meadows, Lan Zhang, Andr Freitas |
| 2026 | ThinkLinker: From Low-Rank Interaction to Knowledge-Aware Verification for Multimodal Entity Linking. | Yingyao Ma, Yuanyuan Zhou, Congyu Zhang, Yi Yuan, Jiasong Wu, Lotfi Senhadji, Huazhong Shu |
| 2026 | Personalizing LLMs with Binary Feedback: A Preference-Calibrated Optimization Framework. | Xilai Ma, Liye Zhao, Weijun Yao, Haibing Di, Wenya Wang, Jing Li |
| 2026 | Breaking Down and Building Up: Mixture of Skill-Based Vision-and-Language Navigation Agents. | Tianyi Ma, Yue Zhang, Zehao Wang, Parisa Kordjamshidi |
| 2026 | Stable and Explainable Personality Trait Evaluation in Large Language Models with Internal Activations. | Xiaoxu Ma, Xiangbo Zhang, Zhenyu Weng |
| 2026 | HCRE: LLM-based Hierarchical Classification for Cross-Document Relation Extraction with a Prediction-then-Verification Strategy. | Guoqi Ma, Liang Zhang, Hongyao Tu, Hao Fu, Hui Li, Yujie Lin, Longyue Wang, Weihua Luo, Jinsong Su |
| 2026 | CuBridge: An LLM-Based Framework for Understanding and Reconstructing High-Performance Attention Kernels. | Xing Ma, Yangjie Zhou, Wu Sun, Zihan Liu, Jingwen Leng, Yun Lin, Shixuan Sun, Minyi Guo, Jin Song Dong |
| 2026 | LVLM-Aware Multimodal Retrieval for RAG-Based Medical Diagnosis with General-Purpose Models. | Nir Mazor, Tom Hope |
| 2026 | VisAidMath: Benchmarking Visual-Aided Mathematical Reasoning. | Jingkun Ma, Runzhe Zhan, Yang Li, Di Sun, Hou Pong Chan, Lidia S. Chao, Derek F. Wong |
| 2026 | Measuring What Matters!! Assessing Therapeutic Principles in Mental-Health Conversation. | Abdullah Mazhar, Het Riteshkumar Shah, Aseem Srivastava, Smriti Joshi, Md. Shad Akhtar |
| 2026 | Towards Unified Multimodal Large Language Models: A survey. | Xu Ma, Yitian Zhang, Yun Fu |
| 2026 | Beyond Unimodal Shortcuts: MLLMs as Cross-Modal Reasoners for Grounded Named Entity Recognition. | Jinlong Ma, Yu Zhang, Xuefeng Bai, Kehai Chen, Yuwei Wang, Zeming Liu, Jun Yu, Min Zhang |
| 2026 | MedErrBench: A Fine-Grained Multilingual Benchmark for Medical Error Detection and Correction with Clinical Expert Annotations. | Congbo Ma, Yichun Zhang, Yousef Al-Jazzazi, Ahamed Foisal, Laasya Sharma, Yousra Sadqi, Khaled Saleh, Jihad Mallat, Farah E. Shamout |
| 2026 | Protecting Language Models Against Unauthorized Distillation through Trace Rewriting. | Xinhang Ma, William Yeoh, Ning Zhang, Yevgeniy Vorobeychik |
| 2026 | Counterfactual Fairness Evaluation of LLM-Based Contact Center Agent Quality Assurance System. | Kawin Mayilvaghanan, Siddhant Gupta, Ayush Kumar |
| 2026 | Capabilities and Evaluation Biases of Large Language Models in Classical Chinese Poetry Generation: A Case Study on Tang Poetry. | Bolei Ma, Yina Yao, Anna-Carolina Haensch |
| 2026 | From AR to Diffusion: Efficiently Adapting Large Language Models with Strictly Causal and Elastic Horizons. | Xiangyu Ma, Teng Xiao, Zuchao Li, Lefei Zhang |
| 2026 | From 2: 4 to 8: 16 sparsity patterns in LLMs for Outliers and Weights with Variance Correction. | Egor Maximov, Yulia Kuzkina, Egor Shvetsov, Azamat Kanametov, Alexander Prutko, Maxim Zhelnin, Aleksei Goncharov |
| 2026 | Ground Then Rank: Revisiting Knowledge-Based VQA with Training-Free Entity Identification. | Qian Ma, Qiong Wu, Zhengyi Zhou, Yao Ma |
| 2026 | A Survey of Deep Learning for Geometry Problem Solving. | Jianzhe Ma, Wenxuan Wang, Qin Jin |
| 2026 | CoTrust: Privacy-Preserving Collaboration Between Large and Small Language Models in Trusted Execution Environments. | Zhenya Ma, Tingyi Wang, Yongheng Deng, Ziqing Qiao, Yinggui Wang, Tao Wei, Lei Wang, Ju Ren |
| 2026 | Human-Agent Collaborative Paper-to-Page Crafting. | Qianli Ma, Siyu Wang, Yilin Chen, Yinhao Tang, Yixiang Yang, Chang Guo, Bingjie Gao, Zhening Xing, Yanan Sun, Zhipeng Zhang |
| 2026 | Conflict-Aware Memory for Embodied Agents: Enhancing Vector Data Quality via Detection Rules. | Kexin Ma, Haotian Wang, Shenglin Chen, Yishuai Cai, Yu Huang, Ruochun Jin |