Skip to content

Xunliang Cai

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

72

Venues

9

Active years

2021–2026

Best venue rank

A*

Where they publish

Papers

72 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIRethinking the Sampling Criteria in Reinforcement Learning for LLM Reasoning: A Competence-Difficulty Alignment Perspective.Deyang Kong, Qi Guo, Xiangyu Xi, Wei Wang, Jingang Wang, Xunliang Cai, Shikun Zhang, Wei Ye
2026AAAIScaling and Transferability of Annealing Strategies in Large Language Model Training.Siqi Wang, Zhengyu Chen, Teng Xiao, Zheqi Lv, Jinluan Yang, Xunliang Cai, Jingang Wang, Xiaomeng Li
2026ACLHow to Allocate, How to Learn? Dynamic Rollout Allocation and Advantage Modulation for Policy Optimization.Yangyi Fang, Jiaye Lin, Xiaoliang Fu, Cong Qin, Haolin Shi, Chaowen Hu, Lu Pan, Ke Zeng, Xunliang Cai
2026ACLLANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance.Yuchun Fan, Bei Li, Peiguang Li, Yilin Wang, Yongyu Mu, Jian Yang, Xin Chen, Rongxiang Weng, Jingang Wang, Xunliang Cai, JingBo Zhu, Tong Xiao
2026ACLCoreCodeBench: Decoupling Code Intelligence via Fine-Grained Repository-Level Tasks.Lingyue Fu, Hao Guan, Bolun Zhang, Haowei Yuan, Yaoming Zhu, Lin Qiu, Zongyu Wang, Xuezhi Cao, Xunliang Cai, Weiwen Liu, Weinan Zhang, Yong Yu
2026ACLMASPO: Unifying Gradient Utilization, Probability Mass, and Signal Reliability for Robust and Sample-Efficient LLM Reasoning.Xiaoliang Fu, Jiaye Lin, Yangyi Fang, Binbin Zheng, Chaowen Hu, Zekai Shao, Cong Qin, Lu Pan, Ke Zeng, Xunliang Cai
2026ACLCounteracting the Matthew Effect in Self-Improvement of LVLMs through Head-Tail Re-balancing.Xin Guo, Zhiheng Xi, Yiwen Ding, Yitao Zhai, Xiaowei Shi, Xunliang Cai, Tao Gui, Qi Zhang, Xuanjing Huang
2026ACLTurning Failures into Value: Negative Experience Replay for RLVR via Confidence Gating and Boundary Failure Sampling.Jialiang Guo, Fucheng Xiong, Xu He, Haodong Zhao, Xingyang Li, Ke Zeng, Xunliang Cai
2026ACLVANE: Guiding High-Value Exploration in RLVR via Outcome-Process Novelty Shaping.Xu He, Jialiang Guo, Fucheng Xiong, Haodong Zhao, Xingyang Li, Ke Zeng, Xunliang Cai
2026ACLOptimizing Native Sparse Attention with Latent Attention and Local Global Alternating Strategies.Yuxuan Hu, Jianchao Tan, Jiaqi Zhang, Wen Zan, Pingwei Sun, Yifan Lu, Xunliang Cai, Jing Zhang
2026ACLPaTaRM: Bridging Pairwise and Pointwise Signals via Preference-Aware Task-Adaptive Reward Modeling.Ai Jian, Jingqing Ruan, Xing Ma, Dailin Li, Weipeng Zhang, Ke Zeng, Xunliang Cai
2026ACLWISCA: A Lightweight Model Transition Method to Improve LLM Training via Weight Scaling.Jiacheng Li, Jianchao Tan, Zhidong Yang, Pingwei Sun, Feiye Huo, Jiayu Qin, Xiangyu Zhang, Maoxin He, Guangming Tan, Weile Jia, Xunliang Cai, Tong Zhao
2026ACLAMO-Bench: Large Language Models Still Struggle in High School Math Competitions.Junlin Liu, Shengnan An, Shuang Zhou, Dan Ma, Yehao Lin, Xinxuan Lv, Xuanlin Wang, Xiaoyu Li, Ziwen Wang, Xuezhi Cao, Xunliang Cai
2026ACLBAPO: Boundary-Aware Policy Optimization for Reliable Agentic Search.Shiyu Liu, Yongjing Yin, Jianhao Yan, Yunbo Tang, Qinggang Zhang, Bei Li, Xin Chen, Jingang Wang, Xunliang Cai, Jinsong Su
2026ACLMTR-Suite: A Framework for Evaluating and Synthesizing Conversational Retrieval Benchmarks.Junhao Ruan, Abudukeyumu Abudula, Bei Li, Yongjing Yin, Xinyu Liu, Kechen Jiao, Xin Chen, Jingang Wang, Xunliang Cai, Tong Xiao, Jingbo Zhu
2026ACLAJ-Bench: Benchmarking Agent-as-a-Judge for Environment-Aware Evaluation.Wentao Shi, Yu Wang, Yuyang Zhao, Yuxin Chen, Fuli Feng, Xueyuan Hao, Xi Su, Qi Gu, Hui Su, Xunliang Cai, Xiangnan He
2026ACLUnlocking Implicit Experience: Synthesizing Tool-Use Trajectories from Text.Zhihao Xu, Rumei Li, Jiahuan Li, Rongxiang Weng, Jingang Wang, Xunliang Cai, Xiting Wang
2026ACLAttribution-Based Analysis and Optimization of Modular Agentic Workflows.Yingxuan Yang, Bo Huang, Siyuan Qi, Chao Feng, Haoyi Hu, Yuxuan Zhu, Jinbo Hu, Haoran Zhao, Ziyi He, Xiao Liu, Zongyu Wang, Muning Wen, Lin Qiu, Xuezhi Cao, Xunliang Cai, Yong Yu, Weinan Zhang
2026ACLHarmonizing Dense and Sparse Signals in Multi-turn RL: Dual-Horizon Credit Assignment for Industrial Sales Agents.Haojin Yang, Ai Jian, Yiwei Wang, Xinyue Huang, Weipeng Zhang, Ke Zeng, Xunliang Cai, Jingqing Ruan
2026ACLLinkQA: Synthesizing Diverse QA from Multiple Seeds Strongly Linked by Knowledge Points.Xuemiao Zhang, Can Ren, Chengying Tu, Rongxiang Weng, Hongfei Yan, Jingang Wang, Xunliang Cai
2026ACLLarge-Scale Diverse Synthesis for Mid-Training.Xuemiao Zhang, Chengying Tu, Can Ren, Rongxiang Weng, Hongfei Yan, Jingang Wang, Xunliang Cai
2026ACLDIFFA-2: A Practical Diffusion Large Language Model for General Audio Understanding.Jiaming Zhou, Xuxin Cheng, Shiwan Zhao, Yuhang Jia, Cao Liu, Ke Zeng, Xunliang Cai, Yong Qin
2025AAAISEAS: Self-Evolving Adversarial Safety Optimization for Large Language Models.Muxi Diao, Rumei Li, Shiyang Liu, Guogang Liao, Jingang Wang, Xunliang Cai, Weiran Xu
2025AAAIEnhancing LLMs via High-Knowledge Data Selection.Feiyu Duan, Xuemiao Zhang, Sirui Wang, Haoran Que, Yuqi Liu, Wenge Rong, Xunliang Cai
2025AAAIS^3cMath: Spontaneous Step-Level Self-Correction Makes Large Language Models Better Mathematical Reasoners.Yuchen Yan, Jin Jiang, Yang Liu, Yixin Cao, Xin Xu, Mengdi Zhang, Xunliang Cai, Jian Shao
2025ACLWhy Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement.Peng Ding, Jun Kuang, Zongyu Wang, Xuezhi Cao, Xunliang Cai, Jiajun Chen, Shujian Huang
2025ACLRevisiting Scaling Laws for Language Models: The Role of Data Quality and Training Strategies.Zhengyu Chen, Siqi Wang, Teng Xiao, Yudong Wang, Shiqi Chen, Xunliang Cai, Junxian He, Jingang Wang
2025ACLRevisit Self-Debugging with Self-Generated Tests for Code Generation.Xiancai Chen, Zhengwei Tao, Kechi Zhang, Changzhi Zhou, Xinyu Zhang, Wanli Gu, Yuanpeng He, Mengdi Zhang, Xunliang Cai, Haiyan Zhao, Zhi Jin
2025ACLMulti-Programming Language Sandbox for LLMs.Shihan Dou, Jiazheng Zhang, Jianxiang Zang, Yunbo Tao, Weikang Zhou, Haoxiang Jia, Shichun Liu, Yuming Yang, Shenxi Wu, Zhiheng Xi, Muling Wu, Rui Zheng, Changze Lv, Limao Xiong, Shaoqing Zhang, Lin Zhang, Wenyu Zhan, Rongxiang Weng, Jingang Wang, Xunliang Cai, Yueming Wu, Ming Wen, Yixin Cao, Tao Gui, Xipeng Qiu, Qi Zhang, Xuanjing Huang
2025ACLDon't Half-listen: Capturing Key-part Information in Continual Instruction Tuning.Yongquan He, Wenyuan Zhang, Xuancheng Huang, Peng Zhang, Lingxun Meng, Xiang Zhou, Ke Zeng, Xunliang Cai
2025ACLLogicPro: Improving Complex Logical Reasoning via Program-Guided Learning.Jin Jiang, Yuchen Yan, Yang Liu, Jianing Wang, Shuai Peng, Xunliang Cai, Yixin Cao, Mengdi Zhang, Liangcai Gao
2025ACLThe Role of Visual Modality in Multimodal Mathematical Reasoning: Challenges and Insights.Yufang Liu, Yao Du, Tao Ji, Jianing Wang, Yang Liu, Yuanbin Wu, Aimin Zhou, Mengdi Zhang, Xunliang Cai
2025ACLAMoPO: Adaptive Multi-objective Preference Optimization without Reward Models and Reference Models.Qi Liu, Jingqing Ruan, Hao Li, Haodong Zhao, Desheng Wang, Jiansong Chen, Guanglu Wan, Xunliang Cai, Zhi Zheng, Tong Xu
2025ACLFRAME: Boosting LLMs with A Four-Quadrant Multi-Stage Pretraining Strategy.Xuemiao Zhang, Feiyu Duan, Liangyu Xu, Yongwei Zhou, Sirui Wang, Rongxiang Weng, Jingang Wang, Xunliang Cai
2025ACLLeveraging Dual Process Theory in Language Agent Framework for Real-time Simultaneous Human-AI Collaboration.Shao Zhang, Xihuai Wang, Wenhao Zhang, Chaoran Li, Junru Song, Tingyu Li, Lin Qiu, Xuezhi Cao, Xunliang Cai, Wen Yao, Weinan Zhang, Xinbing Wang, Ying Wen
2025ACLPreference Curriculum: LLMs Should Always Be Pretrained on Their Preferred Data.Xuemiao Zhang, Liangyu Xu, Feiyu Duan, Yongwei Zhou, Sirui Wang, Rongxiang Weng, Jingang Wang, Xunliang Cai
2025COLINGLLMs Know What They Need: Leveraging a Missing Information Guided Framework to Empower Retrieval-Augmented Generation.Keheng Wang, Feiyu Duan, Peiguang Li, Sirui Wang, Xunliang Cai
2025EMNLPInstance-level Randomization: Toward More Stable LLM Evaluations.Yiyang Li, Yonghuang Wu, Ying Luo, Liangtai Sun, Zishu Qin, Lin Qiu, Xuezhi Cao, Xunliang Cai
2025EMNLPToo Consistent to Detect: A Study of Self-Consistent Errors in LLMs.Hexiang Tan, Fei Sun, Sha Liu, Du Su, Qi Cao, Xin Chen, Jingang Wang, Xunliang Cai, Yuanzhuo Wang, Huawei Shen, Xueqi Cheng
2025EMNLPPrejudge-Before-Think: Enhancing Large Language Models at Test-Time by Process Prejudge Reasoning.Jianing Wang, Jin Jiang, Yang Liu, Mengdi Zhang, Xunliang Cai
2025EMNLPSampleMix: A Sample-wise Pre-training Data Mixing Strategy by Coordinating Data Quality and Diversity.Xiangyu Xi, Deyang Kong, Jian Yang, Jiawei Yang, Zhengyu Chen, Wei Wang, Jingang Wang, Xunliang Cai, Shikun Zhang, Wei Ye
2025EMNLPFIRE: Flexible Integration of Data Quality Ratings for Effective Pretraining.Liangyu Xu, Xuemiao Zhang, Feiyu Duan, Sirui Wang, Rongxiang Weng, Jingang Wang, Xunliang Cai
2025EMNLPMUSE: MCTS-Driven Red Teaming Framework for Enhanced Multi-Turn Dialogue Safety in Large Language Models.Siyu Yan, Long Zeng, Xuecheng Wu, Chengcheng Han, Kongcheng Zhang, Chong Peng, Xuezhi Cao, Xunliang Cai, Chenjuan Guo
2025EMNLPReMamba: Equip Mamba with Effective Long-Sequence Modeling.Danlong Yuan, Jiahao Liu, Bei Li, Huishuai Zhang, Jingang Wang, Xunliang Cai, Dongyan Zhao
2025EMNLPLeveraging Unpaired Feedback for Long-Term LLM-based Recommendation Tuning.Jizhi Zhang, Chongming Gao, Wentao Shi, Xi-Lin Chen, Jingang Wang, Xunliang Cai, Fuli Feng
2025EMNLPA Reasoner for Real-World Event Detection: Scaling Reinforcement Learning via Adaptive Perplexity-Aware Sampling Strategy.Xiaoyun Zhang, Jingqing Ruan, Xing Ma, Yawen Zhu, Jiansong Chen, Ke Zeng, Xunliang Cai
2025EMNLPWhen to Continue Thinking: Adaptive Thinking Mode Switching for Efficient Reasoning.Xiaoyun Zhang, Jingqing Ruan, Xing Ma, Yawen Zhu, Haodong Zhao, Hao Li, Jiansong Chen, Ke Zeng, Xunliang Cai
2025ICLRAgentRefine: Enhancing Agent Generalization through Refinement Tuning.Dayuan Fu, Keqing He, Yejie Wang, Wentao Hong, Zhuoma Gongque, Weihao Zeng, Wei Wang, Jingang Wang, Xunliang Cai, Weiran Xu
2025ICLREarlier Tokens Contribute More: Learning Direct Preference Optimization From Temporal Decay Perspective.Ruichen Shao, Bei Li, Gangao Liu, Yang Chen, ZhouXiang, Jingang Wang, Xunliang Cai, Peng Li
2025NAACLMitigating Tail Narrowing in LLM Self-Improvement via Socratic-Guided Sampling.Yiwen Ding, Zhiheng Xi, Wei He, Lizhuoyuan Lizhuoyuan, Yitao Zhai, Shi Xiaowei, Xunliang Cai, Tao Gui, Qi Zhang, Xuanjing Huang
2025NAACLDynamic Fisher-weighted Model Merging via Bayesian Optimization.Sanwoo Lee, Jiahao Liu, Qifan Wang, Jingang Wang, Xunliang Cai, Yunfang Wu
2024AAAIWhat Makes Quantization for Large Language Model Hard? An Empirical Study from the Lens of Perturbation.Zhuocheng Gong, Jiahao Liu, Jingang Wang, Xunliang Cai, Dongyan Zhao, Rui Yan
2024ACLGraph-Structured Speculative Decoding.Zhuocheng Gong, Jiahao Liu, Ziyue Wang, Pengfei Wu, Jingang Wang, Xunliang Cai, Dongyan Zhao, Rui Yan
2024ACLSpeculative Decoding via Early-exiting for Faster LLM Inference with Thompson Sampling Control Mechanism.Jiahao Liu, Qifan Wang, Jingang Wang, Xunliang Cai
2024ACLLearning or Self-aligning? Rethinking Instruction Fine-tuning.Mengjie Ren, Boxi Cao, Hongyu Lin, Cao Liu, Xianpei Han, Ke Zeng, Guanglu Wan, Xunliang Cai, Le Sun
2024ACLDolphCoder: Echo-Locating Code Large Language Models with Diverse and Multi-Objective Instruction Tuning.Yejie Wang, Keqing He, Guanting Dong, Pei Wang, Weihao Zeng, Muxi Diao, Weiran Xu, Jingang Wang, Mengdi Zhang, Xunliang Cai
2024COLINGBeyond the Known: Investigating LLMs Performance on Out-of-Domain Intent Detection.Pei Wang, Keqing He, Yejie Wang, Xiaoshuai Song, Yutao Mou, Jingang Wang, Yunsen Xian, Xunliang Cai, Weiran Xu
2024EMNLPRethinking the Reversal Curse of LLMs: a Prescription from Human Knowledge Reversal.Zhicong Lu, Li Jin, Peiguang Li, Yu Tian, Linhao Zhang, Sirui Wang, Guangluan Xu, Changyuan Tian, Xunliang Cai
2024EMNLPNot All Contexts Are Equal: Teaching LLMs Credibility-aware Generation.Ruotong Pan, Boxi Cao, Hongyu Lin, Xianpei Han, Jia Zheng, Sirui Wang, Xunliang Cai, Le Sun
2024EMNLPHow Do Your Code LLMs perform? Empowering Code Instruction Tuning with Really Good Data.Yejie Wang, Keqing He, Dayuan Fu, Zhuoma Gongque, Heyang Xu, Yanxu Chen, Zhexu Wang, Yujia Fu, Guanting Dong, Muxi Diao, Jingang Wang, Mengdi Zhang, Xunliang Cai, Weiran Xu
2023EMNLPImproving Input-label Mapping with Demonstration Replay for In-context Learning.Zhuocheng Gong, Jiahao Liu, Qifan Wang, Jingang Wang, Xunliang Cai, Dongyan Zhao, Rui Yan
2023EMNLPRetrieval-based Knowledge Transfer: An Effective Approach for Extreme Large Language Model Compression.Jiduan Liu, Jiahao Liu, Qifan Wang, Jingang Wang, Xunliang Cai, Dongyan Zhao, Ran Wang, Rui Yan
2023EMNLPLarge Language Models Meet Open-World Intent Discovery and Recognition: An Evaluation of ChatGPT.Xiaoshuai Song, Keqing He, Pei Wang, Guanting Dong, Yutao Mou, Jingang Wang, Yunsen Xian, Xunliang Cai, Weiran Xu
2023EMNLPAPP: Adaptive Prototypical Pseudo-Labeling for Few-shot OOD Detection.Pei Wang, Keqing He, Yutao Mou, Xiaoshuai Song, Yanan Wu, Jingang Wang, Yunsen Xian, Xunliang Cai, Weiran Xu
2022AAAIConfidence Calibration for Intent Detection via Hyperspherical Space and Rebalanced Accuracy-Uncertainty Loss.Yantao Gong, Cao Liu, Fan Yang, Xunliang Cai, Guanglu Wan, Jiansong Chen, Weipeng Zhang, Houfeng Wang
2022DASFAADeep Graph Mutual Learning for Cross-domain Recommendation.Yifan Wang, Yongkang Li, Shuai Li, Weiping Song, Jiangke Fan, Shan Gao, Ling Ma, Bing Cheng, Xunliang Cai, Sheng Wang, Ming Zhang
2022SIGIRStructure-Aware Semantic-Aligned Network for Universal Cross-Domain Retrieval.Jialin Tian, Xing Xu, Kai Wang, Zuo Cao, Xunliang Cai, Heng Tao Shen
2022SIGIRDialogue Topic Segmentation via Parallel Extraction Network with Neighbor Smoothing.Jinxiong Xia, Cao Liu, Jiansong Chen, Yuchen Li, Fan Yang, Xunliang Cai, Guanglu Wan, Houfeng Wang
2021ACLFrom Paraphrasing to Semantic Parsing: Unsupervised Semantic Parsing via Synchronous Semantic Decoding.Shan Wu, Bo Chen, Chunlei Xin, Xianpei Han, Le Sun, Weipeng Zhang, Jiansong Chen, Fan Yang, Xunliang Cai
2021CIKMDensity-Based Dynamic Curriculum Learning for Intent Detection.Yantao Gong, Cao Liu, Jiazhen Yuan, Fan Yang, Xunliang Cai, Guanglu Wan, Jiansong Chen, Ruiyao Niu, Houfeng Wang
2021EMNLPDomain-Lifelong Learning for Dialogue State Tracking via Knowledge Preservation Networks.Qingbin Liu, Pengfei Cao, Cao Liu, Jiansong Chen, Xunliang Cai, Fan Yang, Shizhu He, Kang Liu, Jun Zhao
2021SIGIRDistant Supervision based Machine Reading Comprehension for Extractive Summarization in Customer Service.Bing Ma, Cao Liu, Jingyu Wang, Shujie Hu, Fan Yang, Xunliang Cai, Guanglu Wan, Jiansong Chen, Jianxin Liao