Xunliang Cai
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
72
Venues
9
Active years
2021–2026
Best venue rank
A*
Where they publish
Papers
72 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Rethinking the Sampling Criteria in Reinforcement Learning for LLM Reasoning: A Competence-Difficulty Alignment Perspective. | Deyang Kong, Qi Guo, Xiangyu Xi, Wei Wang, Jingang Wang, Xunliang Cai, Shikun Zhang, Wei Ye |
| 2026 | AAAI | Scaling and Transferability of Annealing Strategies in Large Language Model Training. | Siqi Wang, Zhengyu Chen, Teng Xiao, Zheqi Lv, Jinluan Yang, Xunliang Cai, Jingang Wang, Xiaomeng Li |
| 2026 | ACL | How to Allocate, How to Learn? Dynamic Rollout Allocation and Advantage Modulation for Policy Optimization. | Yangyi Fang, Jiaye Lin, Xiaoliang Fu, Cong Qin, Haolin Shi, Chaowen Hu, Lu Pan, Ke Zeng, Xunliang Cai |
| 2026 | ACL | LANG: Reinforcement Learning for Multilingual Reasoning with Language-Adaptive Hint Guidance. | Yuchun Fan, Bei Li, Peiguang Li, Yilin Wang, Yongyu Mu, Jian Yang, Xin Chen, Rongxiang Weng, Jingang Wang, Xunliang Cai, JingBo Zhu, Tong Xiao |
| 2026 | ACL | CoreCodeBench: Decoupling Code Intelligence via Fine-Grained Repository-Level Tasks. | Lingyue Fu, Hao Guan, Bolun Zhang, Haowei Yuan, Yaoming Zhu, Lin Qiu, Zongyu Wang, Xuezhi Cao, Xunliang Cai, Weiwen Liu, Weinan Zhang, Yong Yu |
| 2026 | ACL | MASPO: Unifying Gradient Utilization, Probability Mass, and Signal Reliability for Robust and Sample-Efficient LLM Reasoning. | Xiaoliang Fu, Jiaye Lin, Yangyi Fang, Binbin Zheng, Chaowen Hu, Zekai Shao, Cong Qin, Lu Pan, Ke Zeng, Xunliang Cai |
| 2026 | ACL | Counteracting the Matthew Effect in Self-Improvement of LVLMs through Head-Tail Re-balancing. | Xin Guo, Zhiheng Xi, Yiwen Ding, Yitao Zhai, Xiaowei Shi, Xunliang Cai, Tao Gui, Qi Zhang, Xuanjing Huang |
| 2026 | ACL | Turning Failures into Value: Negative Experience Replay for RLVR via Confidence Gating and Boundary Failure Sampling. | Jialiang Guo, Fucheng Xiong, Xu He, Haodong Zhao, Xingyang Li, Ke Zeng, Xunliang Cai |
| 2026 | ACL | VANE: Guiding High-Value Exploration in RLVR via Outcome-Process Novelty Shaping. | Xu He, Jialiang Guo, Fucheng Xiong, Haodong Zhao, Xingyang Li, Ke Zeng, Xunliang Cai |
| 2026 | ACL | Optimizing Native Sparse Attention with Latent Attention and Local Global Alternating Strategies. | Yuxuan Hu, Jianchao Tan, Jiaqi Zhang, Wen Zan, Pingwei Sun, Yifan Lu, Xunliang Cai, Jing Zhang |
| 2026 | ACL | PaTaRM: Bridging Pairwise and Pointwise Signals via Preference-Aware Task-Adaptive Reward Modeling. | Ai Jian, Jingqing Ruan, Xing Ma, Dailin Li, Weipeng Zhang, Ke Zeng, Xunliang Cai |
| 2026 | ACL | WISCA: A Lightweight Model Transition Method to Improve LLM Training via Weight Scaling. | Jiacheng Li, Jianchao Tan, Zhidong Yang, Pingwei Sun, Feiye Huo, Jiayu Qin, Xiangyu Zhang, Maoxin He, Guangming Tan, Weile Jia, Xunliang Cai, Tong Zhao |
| 2026 | ACL | AMO-Bench: Large Language Models Still Struggle in High School Math Competitions. | Junlin Liu, Shengnan An, Shuang Zhou, Dan Ma, Yehao Lin, Xinxuan Lv, Xuanlin Wang, Xiaoyu Li, Ziwen Wang, Xuezhi Cao, Xunliang Cai |
| 2026 | ACL | BAPO: Boundary-Aware Policy Optimization for Reliable Agentic Search. | Shiyu Liu, Yongjing Yin, Jianhao Yan, Yunbo Tang, Qinggang Zhang, Bei Li, Xin Chen, Jingang Wang, Xunliang Cai, Jinsong Su |
| 2026 | ACL | MTR-Suite: A Framework for Evaluating and Synthesizing Conversational Retrieval Benchmarks. | Junhao Ruan, Abudukeyumu Abudula, Bei Li, Yongjing Yin, Xinyu Liu, Kechen Jiao, Xin Chen, Jingang Wang, Xunliang Cai, Tong Xiao, Jingbo Zhu |
| 2026 | ACL | AJ-Bench: Benchmarking Agent-as-a-Judge for Environment-Aware Evaluation. | Wentao Shi, Yu Wang, Yuyang Zhao, Yuxin Chen, Fuli Feng, Xueyuan Hao, Xi Su, Qi Gu, Hui Su, Xunliang Cai, Xiangnan He |
| 2026 | ACL | Unlocking Implicit Experience: Synthesizing Tool-Use Trajectories from Text. | Zhihao Xu, Rumei Li, Jiahuan Li, Rongxiang Weng, Jingang Wang, Xunliang Cai, Xiting Wang |
| 2026 | ACL | Attribution-Based Analysis and Optimization of Modular Agentic Workflows. | Yingxuan Yang, Bo Huang, Siyuan Qi, Chao Feng, Haoyi Hu, Yuxuan Zhu, Jinbo Hu, Haoran Zhao, Ziyi He, Xiao Liu, Zongyu Wang, Muning Wen, Lin Qiu, Xuezhi Cao, Xunliang Cai, Yong Yu, Weinan Zhang |
| 2026 | ACL | Harmonizing Dense and Sparse Signals in Multi-turn RL: Dual-Horizon Credit Assignment for Industrial Sales Agents. | Haojin Yang, Ai Jian, Yiwei Wang, Xinyue Huang, Weipeng Zhang, Ke Zeng, Xunliang Cai, Jingqing Ruan |
| 2026 | ACL | LinkQA: Synthesizing Diverse QA from Multiple Seeds Strongly Linked by Knowledge Points. | Xuemiao Zhang, Can Ren, Chengying Tu, Rongxiang Weng, Hongfei Yan, Jingang Wang, Xunliang Cai |
| 2026 | ACL | Large-Scale Diverse Synthesis for Mid-Training. | Xuemiao Zhang, Chengying Tu, Can Ren, Rongxiang Weng, Hongfei Yan, Jingang Wang, Xunliang Cai |
| 2026 | ACL | DIFFA-2: A Practical Diffusion Large Language Model for General Audio Understanding. | Jiaming Zhou, Xuxin Cheng, Shiwan Zhao, Yuhang Jia, Cao Liu, Ke Zeng, Xunliang Cai, Yong Qin |
| 2025 | AAAI | SEAS: Self-Evolving Adversarial Safety Optimization for Large Language Models. | Muxi Diao, Rumei Li, Shiyang Liu, Guogang Liao, Jingang Wang, Xunliang Cai, Weiran Xu |
| 2025 | AAAI | Enhancing LLMs via High-Knowledge Data Selection. | Feiyu Duan, Xuemiao Zhang, Sirui Wang, Haoran Que, Yuqi Liu, Wenge Rong, Xunliang Cai |
| 2025 | AAAI | S^3cMath: Spontaneous Step-Level Self-Correction Makes Large Language Models Better Mathematical Reasoners. | Yuchen Yan, Jin Jiang, Yang Liu, Yixin Cao, Xin Xu, Mengdi Zhang, Xunliang Cai, Jian Shao |
| 2025 | ACL | Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement. | Peng Ding, Jun Kuang, Zongyu Wang, Xuezhi Cao, Xunliang Cai, Jiajun Chen, Shujian Huang |
| 2025 | ACL | Revisiting Scaling Laws for Language Models: The Role of Data Quality and Training Strategies. | Zhengyu Chen, Siqi Wang, Teng Xiao, Yudong Wang, Shiqi Chen, Xunliang Cai, Junxian He, Jingang Wang |
| 2025 | ACL | Revisit Self-Debugging with Self-Generated Tests for Code Generation. | Xiancai Chen, Zhengwei Tao, Kechi Zhang, Changzhi Zhou, Xinyu Zhang, Wanli Gu, Yuanpeng He, Mengdi Zhang, Xunliang Cai, Haiyan Zhao, Zhi Jin |
| 2025 | ACL | Multi-Programming Language Sandbox for LLMs. | Shihan Dou, Jiazheng Zhang, Jianxiang Zang, Yunbo Tao, Weikang Zhou, Haoxiang Jia, Shichun Liu, Yuming Yang, Shenxi Wu, Zhiheng Xi, Muling Wu, Rui Zheng, Changze Lv, Limao Xiong, Shaoqing Zhang, Lin Zhang, Wenyu Zhan, Rongxiang Weng, Jingang Wang, Xunliang Cai, Yueming Wu, Ming Wen, Yixin Cao, Tao Gui, Xipeng Qiu, Qi Zhang, Xuanjing Huang |
| 2025 | ACL | Don't Half-listen: Capturing Key-part Information in Continual Instruction Tuning. | Yongquan He, Wenyuan Zhang, Xuancheng Huang, Peng Zhang, Lingxun Meng, Xiang Zhou, Ke Zeng, Xunliang Cai |
| 2025 | ACL | LogicPro: Improving Complex Logical Reasoning via Program-Guided Learning. | Jin Jiang, Yuchen Yan, Yang Liu, Jianing Wang, Shuai Peng, Xunliang Cai, Yixin Cao, Mengdi Zhang, Liangcai Gao |
| 2025 | ACL | The Role of Visual Modality in Multimodal Mathematical Reasoning: Challenges and Insights. | Yufang Liu, Yao Du, Tao Ji, Jianing Wang, Yang Liu, Yuanbin Wu, Aimin Zhou, Mengdi Zhang, Xunliang Cai |
| 2025 | ACL | AMoPO: Adaptive Multi-objective Preference Optimization without Reward Models and Reference Models. | Qi Liu, Jingqing Ruan, Hao Li, Haodong Zhao, Desheng Wang, Jiansong Chen, Guanglu Wan, Xunliang Cai, Zhi Zheng, Tong Xu |
| 2025 | ACL | FRAME: Boosting LLMs with A Four-Quadrant Multi-Stage Pretraining Strategy. | Xuemiao Zhang, Feiyu Duan, Liangyu Xu, Yongwei Zhou, Sirui Wang, Rongxiang Weng, Jingang Wang, Xunliang Cai |
| 2025 | ACL | Leveraging Dual Process Theory in Language Agent Framework for Real-time Simultaneous Human-AI Collaboration. | Shao Zhang, Xihuai Wang, Wenhao Zhang, Chaoran Li, Junru Song, Tingyu Li, Lin Qiu, Xuezhi Cao, Xunliang Cai, Wen Yao, Weinan Zhang, Xinbing Wang, Ying Wen |
| 2025 | ACL | Preference Curriculum: LLMs Should Always Be Pretrained on Their Preferred Data. | Xuemiao Zhang, Liangyu Xu, Feiyu Duan, Yongwei Zhou, Sirui Wang, Rongxiang Weng, Jingang Wang, Xunliang Cai |
| 2025 | COLING | LLMs Know What They Need: Leveraging a Missing Information Guided Framework to Empower Retrieval-Augmented Generation. | Keheng Wang, Feiyu Duan, Peiguang Li, Sirui Wang, Xunliang Cai |
| 2025 | EMNLP | Instance-level Randomization: Toward More Stable LLM Evaluations. | Yiyang Li, Yonghuang Wu, Ying Luo, Liangtai Sun, Zishu Qin, Lin Qiu, Xuezhi Cao, Xunliang Cai |
| 2025 | EMNLP | Too Consistent to Detect: A Study of Self-Consistent Errors in LLMs. | Hexiang Tan, Fei Sun, Sha Liu, Du Su, Qi Cao, Xin Chen, Jingang Wang, Xunliang Cai, Yuanzhuo Wang, Huawei Shen, Xueqi Cheng |
| 2025 | EMNLP | Prejudge-Before-Think: Enhancing Large Language Models at Test-Time by Process Prejudge Reasoning. | Jianing Wang, Jin Jiang, Yang Liu, Mengdi Zhang, Xunliang Cai |
| 2025 | EMNLP | SampleMix: A Sample-wise Pre-training Data Mixing Strategy by Coordinating Data Quality and Diversity. | Xiangyu Xi, Deyang Kong, Jian Yang, Jiawei Yang, Zhengyu Chen, Wei Wang, Jingang Wang, Xunliang Cai, Shikun Zhang, Wei Ye |
| 2025 | EMNLP | FIRE: Flexible Integration of Data Quality Ratings for Effective Pretraining. | Liangyu Xu, Xuemiao Zhang, Feiyu Duan, Sirui Wang, Rongxiang Weng, Jingang Wang, Xunliang Cai |
| 2025 | EMNLP | MUSE: MCTS-Driven Red Teaming Framework for Enhanced Multi-Turn Dialogue Safety in Large Language Models. | Siyu Yan, Long Zeng, Xuecheng Wu, Chengcheng Han, Kongcheng Zhang, Chong Peng, Xuezhi Cao, Xunliang Cai, Chenjuan Guo |
| 2025 | EMNLP | ReMamba: Equip Mamba with Effective Long-Sequence Modeling. | Danlong Yuan, Jiahao Liu, Bei Li, Huishuai Zhang, Jingang Wang, Xunliang Cai, Dongyan Zhao |
| 2025 | EMNLP | Leveraging Unpaired Feedback for Long-Term LLM-based Recommendation Tuning. | Jizhi Zhang, Chongming Gao, Wentao Shi, Xi-Lin Chen, Jingang Wang, Xunliang Cai, Fuli Feng |
| 2025 | EMNLP | A Reasoner for Real-World Event Detection: Scaling Reinforcement Learning via Adaptive Perplexity-Aware Sampling Strategy. | Xiaoyun Zhang, Jingqing Ruan, Xing Ma, Yawen Zhu, Jiansong Chen, Ke Zeng, Xunliang Cai |
| 2025 | EMNLP | When to Continue Thinking: Adaptive Thinking Mode Switching for Efficient Reasoning. | Xiaoyun Zhang, Jingqing Ruan, Xing Ma, Yawen Zhu, Haodong Zhao, Hao Li, Jiansong Chen, Ke Zeng, Xunliang Cai |
| 2025 | ICLR | AgentRefine: Enhancing Agent Generalization through Refinement Tuning. | Dayuan Fu, Keqing He, Yejie Wang, Wentao Hong, Zhuoma Gongque, Weihao Zeng, Wei Wang, Jingang Wang, Xunliang Cai, Weiran Xu |
| 2025 | ICLR | Earlier Tokens Contribute More: Learning Direct Preference Optimization From Temporal Decay Perspective. | Ruichen Shao, Bei Li, Gangao Liu, Yang Chen, ZhouXiang, Jingang Wang, Xunliang Cai, Peng Li |
| 2025 | NAACL | Mitigating Tail Narrowing in LLM Self-Improvement via Socratic-Guided Sampling. | Yiwen Ding, Zhiheng Xi, Wei He, Lizhuoyuan Lizhuoyuan, Yitao Zhai, Shi Xiaowei, Xunliang Cai, Tao Gui, Qi Zhang, Xuanjing Huang |
| 2025 | NAACL | Dynamic Fisher-weighted Model Merging via Bayesian Optimization. | Sanwoo Lee, Jiahao Liu, Qifan Wang, Jingang Wang, Xunliang Cai, Yunfang Wu |
| 2024 | AAAI | What Makes Quantization for Large Language Model Hard? An Empirical Study from the Lens of Perturbation. | Zhuocheng Gong, Jiahao Liu, Jingang Wang, Xunliang Cai, Dongyan Zhao, Rui Yan |
| 2024 | ACL | Graph-Structured Speculative Decoding. | Zhuocheng Gong, Jiahao Liu, Ziyue Wang, Pengfei Wu, Jingang Wang, Xunliang Cai, Dongyan Zhao, Rui Yan |
| 2024 | ACL | Speculative Decoding via Early-exiting for Faster LLM Inference with Thompson Sampling Control Mechanism. | Jiahao Liu, Qifan Wang, Jingang Wang, Xunliang Cai |
| 2024 | ACL | Learning or Self-aligning? Rethinking Instruction Fine-tuning. | Mengjie Ren, Boxi Cao, Hongyu Lin, Cao Liu, Xianpei Han, Ke Zeng, Guanglu Wan, Xunliang Cai, Le Sun |
| 2024 | ACL | DolphCoder: Echo-Locating Code Large Language Models with Diverse and Multi-Objective Instruction Tuning. | Yejie Wang, Keqing He, Guanting Dong, Pei Wang, Weihao Zeng, Muxi Diao, Weiran Xu, Jingang Wang, Mengdi Zhang, Xunliang Cai |
| 2024 | COLING | Beyond the Known: Investigating LLMs Performance on Out-of-Domain Intent Detection. | Pei Wang, Keqing He, Yejie Wang, Xiaoshuai Song, Yutao Mou, Jingang Wang, Yunsen Xian, Xunliang Cai, Weiran Xu |
| 2024 | EMNLP | Rethinking the Reversal Curse of LLMs: a Prescription from Human Knowledge Reversal. | Zhicong Lu, Li Jin, Peiguang Li, Yu Tian, Linhao Zhang, Sirui Wang, Guangluan Xu, Changyuan Tian, Xunliang Cai |
| 2024 | EMNLP | Not All Contexts Are Equal: Teaching LLMs Credibility-aware Generation. | Ruotong Pan, Boxi Cao, Hongyu Lin, Xianpei Han, Jia Zheng, Sirui Wang, Xunliang Cai, Le Sun |
| 2024 | EMNLP | How Do Your Code LLMs perform? Empowering Code Instruction Tuning with Really Good Data. | Yejie Wang, Keqing He, Dayuan Fu, Zhuoma Gongque, Heyang Xu, Yanxu Chen, Zhexu Wang, Yujia Fu, Guanting Dong, Muxi Diao, Jingang Wang, Mengdi Zhang, Xunliang Cai, Weiran Xu |
| 2023 | EMNLP | Improving Input-label Mapping with Demonstration Replay for In-context Learning. | Zhuocheng Gong, Jiahao Liu, Qifan Wang, Jingang Wang, Xunliang Cai, Dongyan Zhao, Rui Yan |
| 2023 | EMNLP | Retrieval-based Knowledge Transfer: An Effective Approach for Extreme Large Language Model Compression. | Jiduan Liu, Jiahao Liu, Qifan Wang, Jingang Wang, Xunliang Cai, Dongyan Zhao, Ran Wang, Rui Yan |
| 2023 | EMNLP | Large Language Models Meet Open-World Intent Discovery and Recognition: An Evaluation of ChatGPT. | Xiaoshuai Song, Keqing He, Pei Wang, Guanting Dong, Yutao Mou, Jingang Wang, Yunsen Xian, Xunliang Cai, Weiran Xu |
| 2023 | EMNLP | APP: Adaptive Prototypical Pseudo-Labeling for Few-shot OOD Detection. | Pei Wang, Keqing He, Yutao Mou, Xiaoshuai Song, Yanan Wu, Jingang Wang, Yunsen Xian, Xunliang Cai, Weiran Xu |
| 2022 | AAAI | Confidence Calibration for Intent Detection via Hyperspherical Space and Rebalanced Accuracy-Uncertainty Loss. | Yantao Gong, Cao Liu, Fan Yang, Xunliang Cai, Guanglu Wan, Jiansong Chen, Weipeng Zhang, Houfeng Wang |
| 2022 | DASFAA | Deep Graph Mutual Learning for Cross-domain Recommendation. | Yifan Wang, Yongkang Li, Shuai Li, Weiping Song, Jiangke Fan, Shan Gao, Ling Ma, Bing Cheng, Xunliang Cai, Sheng Wang, Ming Zhang |
| 2022 | SIGIR | Structure-Aware Semantic-Aligned Network for Universal Cross-Domain Retrieval. | Jialin Tian, Xing Xu, Kai Wang, Zuo Cao, Xunliang Cai, Heng Tao Shen |
| 2022 | SIGIR | Dialogue Topic Segmentation via Parallel Extraction Network with Neighbor Smoothing. | Jinxiong Xia, Cao Liu, Jiansong Chen, Yuchen Li, Fan Yang, Xunliang Cai, Guanglu Wan, Houfeng Wang |
| 2021 | ACL | From Paraphrasing to Semantic Parsing: Unsupervised Semantic Parsing via Synchronous Semantic Decoding. | Shan Wu, Bo Chen, Chunlei Xin, Xianpei Han, Le Sun, Weipeng Zhang, Jiansong Chen, Fan Yang, Xunliang Cai |
| 2021 | CIKM | Density-Based Dynamic Curriculum Learning for Intent Detection. | Yantao Gong, Cao Liu, Jiazhen Yuan, Fan Yang, Xunliang Cai, Guanglu Wan, Jiansong Chen, Ruiyao Niu, Houfeng Wang |
| 2021 | EMNLP | Domain-Lifelong Learning for Dialogue State Tracking via Knowledge Preservation Networks. | Qingbin Liu, Pengfei Cao, Cao Liu, Jiansong Chen, Xunliang Cai, Fan Yang, Shizhu He, Kang Liu, Jun Zhao |
| 2021 | SIGIR | Distant Supervision based Machine Reading Comprehension for Extractive Summarization in Customer Service. | Bing Ma, Cao Liu, Jingyu Wang, Shujie Hu, Fan Yang, Xunliang Cai, Guanglu Wan, Jiansong Chen, Jianxin Liao |