| 2025 | From Ground Trust to Truth: Disparities in Offensive Language Judgments on Contemporary Korean Political Discourse. | Seunguk Yu, JungMin Yun, Jinhee Jang, YoungBin Kim |
| 2025 | Explainable Chain-of-Thought Reasoning: An Empirical Analysis on State-Aware Reasoning Dynamics. | Sheldon Yu, Yuxin Xiong, Junda Wu, Xintong Li, Tong Yu, Xiang Chen, Ritwik Sinha, Jingbo Shang, Julian J. McAuley |
| 2025 | TinyScientist: An Interactive, Extensible, and Controllable Framework for Building Research Agents. | Haofei Yu, Keyang Xuan, Fenghai Li, Kunlun Zhu, Zijie Lei, Jiaxun Zhang, Ziheng Qi, Kyle Richardson, Jiaxuan You |
| 2025 | Tree of Agents: Improving Long-Context Capabilities of Large Language Models through Multi-Perspective Reasoning. | Song Yu, Xiaofei Xu, Ke Deng, Li Li, Lin Tian |
| 2025 | ForestCast: Open-Ended Event Forecasting with Semantic News Forest. | Zi Yu, Shaoxiang Wang, Guozheng Li, Yu Zhang, Chi Harold Liu |
| 2025 | LORE: Continual Logit Rewriting Fosters Faithful Generation. | Charles Yu, Qingyun Wang, Yuting Hu, Jinjun Xiong, Heng Ji |
| 2025 | Accelerate Parallelizable Reasoning via Parallel Decoding within One Sequence. | Yijiong Yu, Wei Wang, Ran Chen, Ji Pei |
| 2025 | Z1: Efficient Test-time Scaling with Code. | Zhaojian Yu, Yinghao Wu, Yilun Zhao, Arman Cohan, Xiao-Ping Zhang |
| 2025 | Imagination and Contemplation: A Balanced Framework for Semantic-Augmented Multimodal Machine Translation. | Zhuang Yu, Shiliang Sun, Jing Zhao, Tengfei Song, Hao Yang |
| 2025 | Improve LLM-as-a-Judge Ability as a General Ability. | Jiachen Yu, Shaoning Sun, Xiaohui Hu, Jiaxu Yan, Kaidong Yu, Xuelong Li |
| 2025 | Beyond Pointwise Scores: Decomposed Criteria-Based Evaluation of LLM Responses. | Fangyi Yu, Nabeel Seedat, Drahomira Herrmannova, Frank Schilder, Jonathan Richard Schwarz |
| 2025 | STA-CoT: Structured Target-Centric Agentic Chain-of-Thought for Consistent Multi-Image Geological Reasoning. | Beibei Yu, Tao Shen, Ling Chen |
| 2025 | A Structured Framework for Evaluating and Enhancing Interpretive Capabilities of Multimodal LLMs in Culturally Situated Tasks. | Haorui Yu, Ramon Ruiz-Dolz, Qiufeng Yi |
| 2025 | Long-context Language Models Fail in Basic Retrieval Tasks Without Sufficient Reasoning Steps. | Yijiong Yu, Zhixiao Qi, Yongfeng Huang, Wei Wang, Weifeng Liu, Ran Chen, Ji Pei |
| 2025 | Sheaf Discovery with Joint Computation Graph Pruning and Flexible Granularity. | Lei Yu, Jingcheng Niu, Zining Zhu, Xi Chen, Gerald Penn |
| 2025 | Personality Matters: User Traits Predict LLM Preferences in Multi-Turn Collaborative Tasks. | Sarfaroz Yunusov, Kaige Chen, Kazi Nishat Anwar, Ali Emami |
| 2025 | Med-PRM: Medical Reasoning Models with Stepwise, Guideline-verified Process Rewards. | Jaehoon Yun, Jiwoong Sohn, Jungwoo Park, Hyunjae Kim, Xiangru Tang, Daniel Shao, Yonghoe Koo, Minhyeok Ko, Qingyu Chen, Mark Gerstein, Michael Moor, Jaewoo Kang |
| 2025 | ULTRABENCH: Benchmarking LLMs under Extreme Fine-grained Text Generation. | Longfei Yun, Letian Peng, Jingbo Shang |
| 2025 | LILaC: Late Interacting in Layered Component Graph for Open-domain Multimodal Multihop Retrieval. | Joohyung Yun, Doyup Lee, Wook-Shin Han |
| 2025 | The Price of Format: Diversity Collapse in LLMs. | Longfei Yun, Chenyang An, Zilong Wang, Letian Peng, Jingbo Shang |
| 2025 | PruneCD: Contrasting Pruned Self Model to Improve Decoding Factuality. | Byeongho Yu, Changhun Lee, Jungyu Jin, Eunhyeok Park |
| 2025 | Multimedia Event Extraction with LLM Knowledge Editing. | Jiaao Yu, Yijing Lin, Zhipeng Gao, Xuesong Qiu, Lanlan Rui |
| 2025 | Transfer-Aware Data Selection for Domain Adaptation in Text Retrieval. | Linzhu Yu, Huan Li, Ke Chen, Lidan Shou |
| 2025 | TableRAG: A Retrieval Augmented Generation Framework for Heterogeneous Document Reasoning. | Xiaohan Yu, Pu Jian, Chong Chen |
| 2025 | Eliciting Implicit Acoustic Styles from Open-domain Instructions to Facilitate Fine-grained Controllable Generation of Speech. | Jianxing Yu, Zihao Gou, Chen Li, Zhisheng Wang, Peiji Yang, Wenqing Chen, Jian Yin |