| 2025 | MUSE: MCTS-Driven Red Teaming Framework for Enhanced Multi-Turn Dialogue Safety in Large Language Models. | Siyu Yan, Long Zeng, Xuecheng Wu, Chengcheng Han, Kongcheng Zhang, Chong Peng, Xuezhi Cao, Xunliang Cai, Chenjuan Guo |
| 2025 | Confusion is the Final Barrier: Rethinking Jailbreak Evaluation and Investigating the Real Misuse Threat of LLMs. | Yu Yan, Sheng Sun, Zhe Wang, Yijun Lin, Zenghao Duan, Zhifei Zheng, Min Liu, Zhiyi Yin, Jianping Zhang |
| 2025 | TRUST-VL: An Explainable News Assistant for General Multimodal Misinformation Detection. | Zehong Yan, Peng Qi, Wynne Hsu, Mong-Li Lee |
| 2025 | FrameEOL: Semantic Frame Induction using Causal Language Models. | Chihiro Yano, Kosuke Yamada, Hayato Tsukagoshi, Ryohei Sasano, Koichi Takeda |
| 2025 | LaMDAgent: An Autonomous Framework for Post-Training Pipeline Optimization via LLM Agents. | Taro Yano, Yoichi Ishibashi, Masafumi Oyamada |
| 2025 | Rethinking Backdoor Detection Evaluation for Language Models. | Jun Yan, Wenjie Jacky Mo, Xiang Ren, Robin Jia |
| 2025 | Addressing Tokenization Inconsistency in Steganography and Watermarking Based on Large Language Models. | Ruiyi Yan, Yugo Murawaki |
| 2025 | Do Large Language Models Truly Grasp Addition? A Rule-Focused Diagnostic Using Two-Integer Arithmetic. | Yang Yan, Yu Lu, Renjun Xu, Zhenzhong Lan |
| 2025 | From Long to Lean: Performance-aware and Adaptive Chain-of-Thought Compression via Multi-round Refinement. | Jianzhi Yan, Le Liu, Youcheng Pan, Shiwei Chen, Zike Yuan, Yang Xiang, Buzhou Tang |
| 2025 | Towards Efficient CoT Distillation: Self-Guided Rationale Selector for Better Performance with Fewer Rationales. | Jianzhi Yan, Le Liu, Youcheng Pan, Shiwei Chen, Yang Xiang, Buzhou Tang |
| 2025 | LMR-BENCH: Evaluating LLM Agent's Ability on Reproducing Language Modeling Research. | Shuo Yan, Ruochen Li, Ziming Luo, Zimu Wang, Daoyang Li, Liqiang Jing, Kaiyu He, Peilin Wu, Juntong Ni, George Michalopoulos, Yue Zhang, Ziyang Zhang, Mian Zhang, Zhiyu Chen, Xinya Du |
| 2025 | Hidden in Plain Sight: Reasoning in Underspecified and Misspecified Scenarios for Multimodal LLMs. | Qianqi Yan, Hongquan Li, Shan Jiang, Yang Zhao, Xinze Guan, Ching-Chen Kuo, Xin Eric Wang |
| 2025 | URO-Bench: Towards Comprehensive Evaluation for End-to-End Spoken Dialogue Models. | Ruiqi Yan, Xiquan Li, Wenxi Chen, Zhikang Niu, Chen Yang, Ziyang Ma, Kai Yu, Xie Chen |
| 2025 | To Answer or Not to Answer (TAONA): A Robust Textual Graph Understanding and Question Answering Approach. | Yuchen Yan, Aakash Kolekar, Sahika Genc, Wenju Xu, Edward W. Huang, Anirudh Srinivasan, Mukesh Jain, Qi He, Hanghang Tong |
| 2025 | Promote, Suppress, Iterate: How Language Models Answer One-to-Many Factual Queries. | Tianyi Lorena Yan, Robin Jia |
| 2025 | UNCLE: Benchmarking Uncertainty Expressions in Long-Form Generation. | Ruihan Yang, Caiqi Zhang, Zhisong Zhang, Xinting Huang, Dong Yu, Nigel Collier, Deqing Yang |
| 2025 | Rethink Rumor Detection in the Era of LLMs: A Review. | Chang Yang, Peng Zhang, Jing Zhang, Hui Gao, Changhao Song |
| 2025 | Sarcasm-R1: Enhancing Sarcasm Detection through Focused Reasoning. | Qi Yang, Jingjie Zeng, Liang Yang, Kai Ma, Hongfei Lin |
| 2025 | Tuning Less, Prompting More: In-Context Preference Learning Pipeline for Natural Language Transformation. | Shuyun Yang, Yan Zhang, Zhengmao Ye, Lei Duan, Mingjie Tang |
| 2025 | A Probabilistic Inference Scaling Theory for LLM Self-Correction. | Zhe Yang, Yichang Zhang, Yudong Wang, Ziyao Xu, Junyang Lin, Zhifang Sui |
| 2025 | Audio-centric Video Understanding Benchmark without Text Shortcut. | Yudong Yang, Jimin Zhuang, Guangzhi Sun, Changli Tang, Yixuan Li, Peihan Li, Yifan Jiang, Wei Li, Zejun Ma, Chao Zhang |
| 2025 | Doubling Your Data in Minutes: Ultra-fast Tabular Data Generation via LLM-Induced Dependency Graphs. | Shuo Yang, Zheyu Zhang, Bardh Prenkaj, Gjergji Kasneci |
| 2025 | Forget the Unneeded: Backdooring Large Language Models via Contrastive-enhanced Machine Unlearning. | Shiji Yang, Shu Zhao, Congyao Mei, Zhen Yang, Jie Chen, Fulan Qian, Zhen Duan, Yan-ping Zhang |
| 2025 | Emphasising Structured Information: Integrating Abstract Meaning Representation into LLMs for Enhanced Open-Domain Dialogue Evaluation. | Bohao Yang, Kun Zhao, Dong Liu, Chen Tang, Liang Zhan, Chenghua Lin |
| 2025 | Calibrating Pseudo-Labeling with Class Distribution for Semi-supervised Text Classification. | Weiyi Yang, Richong Zhang, Junfan Chen, Jiawei Sheng |