| 2025 | Considering Length Diversity in Retrieval-Augmented Summarization. | Juseon-Do, Jaesung Hwang, Jingun Kwon, Hidetaka Kamigaito, Manabu Okumura |
| 2025 | Privacy-Preserving Federated Learning for Hate Speech Detection. | Ivo De Souza Bueno Jnior, Haotian Ye, Axel Wisiorek, Hinrich Schtze |
| 2025 | CoME: An Unlearning-based Approach to Conflict-free Model Editing. | Dahyun Jung, Jaehyung Seo, Jaewook Lee, Chanjun Park, Heuiseok Lim |
| 2025 | FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models. | Dahyun Jung, Seungyoon Lee, Hyeonseok Moon, Chanjun Park, Heuiseok Lim |
| 2025 | It Is Not Only the Negative that Deserves Attention! Understanding, Generation & Evaluation of (Positive) Moderation. | Iman Jundi, Eva Maria Vecchi, Carlotta Quensel, Neele Falk, Gabriella Lapesa |
| 2025 | Towards Quantifying Commonsense Reasoning with Mechanistic Insights. | Abhinav Joshi, Areeb Ahmad, Divyaksh Shukla, Ashutosh Modi |
| 2025 | Taxonomy and Analysis of Sensitive User Queries in Generative AI Search System. | Hwiyeol Jo, Taiwoo Park, Hyunwoo Lee, Nayoung Choi, Changbong Kim, Ohjoon Kwon, Donghyeon Jeon, Eui-Hyeon Lee, Kyoungho Shin, Sun Suk Lim, Kyungmi Kim, Jihye Lee, Sun Kim |
| 2025 | What the #?*!: Disentangling Hate Across Target Identities. | Yiping Jin, Leo Wanner, Aneesh Moideen Koya |
| 2025 | MedEthicEval: Evaluating Large Language Models Based on Chinese Medical Ethics. | Haoan Jin, Jiacheng Shi, Hanhui Xu, Kenny Q. Zhu, Mengyue Wu |
| 2025 | Regularized Best-of-N Sampling with Minimum Bayes Risk Objective for Language Model Alignment. | Yuu Jinnai, Tetsuro Morimura, Kaito Ariu, Kenshi Abe |
| 2025 | Self-Harmonized Chain of Thought. | Ziqi Jin, Wei Lu |
| 2025 | On A Scale From 1 to 5: Quantifying Hallucination in Faithfulness Evaluation. | Xiaonan Jing, Srinivas Billa, Danny Godbout |
| 2025 | Unlearning as multi-task optimization: A normalized gradient difference approach with an adaptive learning rate. | Xiaomeng Jin, Zhiqi Bu, Bhanukiran Vinzamuri, Anil Ramakrishna, Kai-Wei Chang, Volkan Cevher, Mingyi Hong |
| 2025 | Beyond the Mode: Sequence-Level Distillation of Multilingual Translation Models for Low-Resource Language Pairs. | Aarn Galiano Jimnez, Juan Antonio Prez-Ortiz, Felipe Snchez-Martnez, Vctor M. Snchez-Cartagena |
| 2025 | SimulBench: Evaluating Language Models with Creative Simulation Tasks. | Qi Jia, Xiang Yue, Tuney Zheng, Jie Huang, Bill Yuchen Lin |
| 2025 | On the Feasibility of In-Context Probing for Data Attribution. | Cathy Jiao, Weizhen Gao, Aditi Raghunathan, Chenyan Xiong |
| 2025 | Can Large Language Models Generate High-quality Patent Claims? | Lekang Jiang, Caiqi Zhang, Pascal A. Scherz, Stefan Goetz |
| 2025 | Towards Rationality in Language and Multimodal Agents: A Survey. | Bowen Jiang, Yangxinyu Xie, Xiaomeng Wang, Yuan Yuan, Zhuoqun Hao, Xinyi Bai, Weijie J. Su, Camillo Jose Taylor, Tanwi Mallick |
| 2025 | An Optimizable Suffix Is Worth A Thousand Templates: Efficient Black-box Jailbreaking without Affirmative Phrases via LLM as Optimizer. | Weipeng Jiang, Zhenting Wang, Juan Zhai, Shiqing Ma, Zhengyu Zhao, Chao Shen |
| 2025 | JRE-L: Journalist, Reader, and Editor LLMs in the Loop for Science Journalism for the General Audience. | Gongyao Jiang, Xinran Shi, Qiong Luo |
| 2025 | Patent-CR: A Dataset for Patent Claim Revision. | Lekang Jiang, Pascal A. Scherz, Stefan Goetz |
| 2025 | Probe-Free Low-Rank Activation Intervention. | Chonghe Jiang, Bao Nguyen, Anthony Man-Cho So, Viet Anh Nguyen |
| 2025 | Marrying LLMs with Dynamic Forecasting: A Graph Mixture-of-expert Perspective. | Dapeng Jiang, Xiao Luo |
| 2025 | GPT-4V Cannot Generate Radiology Reports Yet. | Yuyang Jiang, Chacha Chen, Dang Nguyen, Benjamin M. Mervak, Chenhao Tan |
| 2025 | RAG-Star: Enhancing Deliberative Reasoning with Retrieval Augmented Verification and Refinement. | Jinhao Jiang, Jiayi Chen, Junyi Li, Ruiyang Ren, Shijie Wang, Xin Zhao, Yang Song, Tao Zhang |