| 2026 | EvolvR: Self-Evolving Pairwise Reasoning for Story Evaluation to Enhance Generation. | Xinda Wang, Zhengxu Hou, Yangshijie Zhang, Bingren Yan, Jialin Liu, Chenzhuo Zhao, Zhibo Yang, Bin-Bin Yang, Feng Xiao |
| 2026 | Your Reasoning Benchmark May Not Test Reasoning: Revealing Perception Bottleneck in Abstract Reasoning Benchmarks. | Xinhe Wang, Jin Huang, Xingjian Zhang, Tianhao Wang, Jiaqi W. Ma |
| 2026 | Aligning Agents via Planning: A Benchmark for Trajectory-Level Reward Modeling. | Jiaxuan Wang, Yulan Hu, Wenjin Yang, Zheng Pan, Xin Li, Lan-Zhe Guo |
| 2026 | Training-Free Adaptive Speculative Decoding via Linguistic Priors. | Jingyi Wang, Jiaqi Huang, Zunnan Xu, Jun Zhou, Kehong Yuan, Xiang Qian |
| 2026 | What Factors Affect LLMs and RLLMs in Financial Question Answering? | Peng Wang, Xuesi Hu, Jiageng Wu, Yuntao Zou, Qiancheng Zhang, Dagang Li |
| 2026 | TRACE: An Experiential Framework for Coherent Multi-hop Knowledge Graph Question Answering. | Yingxu Wang, Jiaxin Huang, Mengzhu Wang, Nan Yin |
| 2026 | ChunQiuTR: Time-Keyed Temporal Retrieval in Classical Chinese Annals. | Yihao Wang, Zijian He, Jie Ren, Keze Wang |
| 2026 | AlphaContext: An Evolutionary Tree-based Psychometric Context Generator for Creativity Assessment. | Yixuan Wang, Yue Huang, Hong Qian, Yunzhao Wei, Yifei Ding, Wenkai Wang, Zhi Liu, Zhongjing Huang, Aimin Zhou, Jiajun Guo |
| 2026 | Don't Tell the Answer, Truly Guide the Reasoning During RL Rollouts. | Xinyi Wang, Jinyi Han, Zishang Jiang, Tingyun Li, Jiaqing Liang, Sihang Jiang, Zhaoqian Dai, Ma Shuguang, Fei Yu, Yanghua Xiao |
| 2026 | From Heads to Neurons: Causal Attribution and Steering in Multi-Task Vision-Language Models. | Qidong Wang, Junjie Hu, Ming Jiang |
| 2026 | Soft Orthogonal Low-Rank Adaptation for Knowledge Sharing in Large Language Model Continual Learning. | Yitong Wang, Xue Han, Wenchun Gao, Qian Hu, Jiahui Wang, Ziqing Wang, Lijun Mei, Junlan Feng |
| 2026 | ClimAgent: LLM as Agents for Autonomous Open-ended Climate Science Analysis. | Hao Wang, Jindong Han, Wei Fan, Hao Liu |
| 2026 | CentaurTA: A Self-Improving Human-Agents Collaboration Framework for Thematic Analysis. | Lei Wang, Min Huang, Eduard C. Dragut |
| 2026 | Black-Box Membership Inference Attacks for Video Training Data in Multimodal Large Language Models. | Jinrui Wang, Zhenfeng Gao, Wendan Wang, Huili Wang, Zichen Qin, Linjie Zhu, Hongke Fu, Shangguang Wang, Tao Qi |
| 2026 | CAP: Controllable Alignment Prompting for Unlearning in LLMs. | Zhaokun Wang, Jinyu Guo, Jingwen Pu, Hongli Pu, Meng Yang, Xunlei Chen, Jie Ou, Wenyi Li, Guangchun Luo, Wenhong Tian |
| 2026 | Learning While Staying Curious: Entropy-Preserving Supervised Fine-Tuning via Adaptive Self-Distillation for Large Reasoning Models. | Hao Wang, Hao Gu, Hongming Piao, Kaixiong Gong, Yuxiao Ye, Xiangyu Yue, Sirui Han, Yike Guo, Dapeng Wu |
| 2026 | HqeKV: Towards Hybrid Quantization and Eviction for KV Cache in Long-Context LLM Inference. | He Wang, Yu Gu, Fangfang Li, Zhigang Wang, Zhenghao Liu, Ning Wang, Xiaohua Li, Ge Yu |
| 2026 | PRIME: A Process-Outcome Alignment Benchmark for Verifiable Reasoning in Mathematics and Engineering. | Xiangfeng Wang, Hangyu Guo, Yanlin Lai, Mitt Huang, Liang Zhao, Chengyuan Yao, Yinmin Zhang, Qi Han, Xiaoxiao Ren, Chun Yuan, Tong Xu, Zheng Ge, Xiangyu Zhang, Daxin Jiang |
| 2026 | SCAN: Structured Capability Assessment and Navigation for LLMs. | Zongqi Wang, Tianle Gu, Chen Gong, Xin Tian, Siqi Bao, Yujiu Yang |
| 2026 | LEDGER: Scaling Agentic Document Editing with Dependency-aware Graph Retrieval. | Hang Wang, Utkarsh Garg, Reza Davari, Huitian Jiao, Hao Cheng, Baolin Peng, Si-Qing Chen, Tao Ge |
| 2026 | Putting Captions to the Test: Evaluating Video Caption Quality through Multiple-Choice Question Answering. | Zizhen Wang, Bo Feng, Zhengfeng Lai, Shiyu Li, Yang Lu, Meng Cao, Ping Huang, Xiaoming Simon Wang |
| 2026 | TexOCR: Advancing Document OCR Models for Compilable Page-to-LaTeX Reconstruction. | Chengye Wang, Lin Fu, Zexi Kuang, Yilun Zhao |
| 2026 | Reference Attack: A New Cross-Modal Jailbreaking Attack against Multimodal Large Language Models. | Yulong Wang, Yifei Fu, Jiayi Gao |
| 2026 | AdaTooler-V: Adaptive Tool-Use for Images and Videos. | Chaoyang Wang, Kaituo Feng, Dongyang Chen, Zhongyu Wang, Zhixun Li, Sicheng Gao, Meng Meng, Xu Zhou, Manyuan Zhang, Yuzhang Shang, Xiangyu Yue |
| 2026 | Locate and Explain: Joint Multimodal Emotion Cause Extraction and Summarization in Conversation. | Jikun Wan, Chen Gong, Guohong Fu |