| 2025 | A Japanese Language Model and Three New Evaluation Benchmarks for Pharmaceutical NLP. | Shinnosuke Ono, Issey Sukeda, Takuro Fujii, Kosei Buma, Shunsuke Sasaki |
| 2025 | Consolidating and Developing Benchmarking Datasets for the Nepali Natural Language Understanding Tasks. | Jinu Nyachhyon, Mridul Sharma, Prajwal Thapa, Bal Krishna Bal |
| 2025 | Agnus LLM: Robust and Flexible Entity Disambiguation with decoder-only Language Models. | Kristian Noullet, Ayoub Ourgani, Niklas Thomas Lakner, Lukas Kinder, Tobias Kfer |
| 2025 | Multi-Modal Data Exploration via Language Agents. | Farhad Nooralahzadeh, Yi Zhang, Jonathan Frst, Kurt Stockinger |
| 2025 | ThaiOCRBench: A Task-Diverse Benchmark for Vision-Language Understanding in Thai. | Surapon Nonesung, Teetouch Jaknamon, Sirinya Chaiophat, Natapong Nitarach, Chanakan Wittayasakpan, Warit Sirichotedumrong, Adisai Na-Thalang, Kunat Pipatanakul |
| 2025 | NyayaRAG: Realistic Legal Judgment Prediction with RAG under the Indian Common Law System. | Shubham Kumar Nigam, Balaramamahanthi Deepak Patnaik, Shivam Mishra, Ajay Varghese Thomas, Noel Shallum, Kripabandhu Ghosh, Arnab Bhattacharya |
| 2025 | TathyaNyaya and FactLegalLlama: Advancing Factual Judgment Prediction and Explanation in the Indian Legal Context. | Shubham Kumar Nigam, Balaramamahanthi Deepak Patnaik, Shivam Mishra, Noel Shallum, Kripabandhu Ghosh, Arnab Bhattacharya |
| 2025 | Decomposed Prompting: Probing Multilingual Linguistic Structure Knowledge in Large Language Models. | Ercong Nie, Shuzhou Yuan, Bolei Ma, Helmut Schmid, Michael Frber, Frauke Kreuter, Hinrich Schtze |
| 2025 | When in Doubt, Ask First: A Unified Retrieval Agent-Based System for Ambiguous and Unanswerable Question Answering. | Long S. T. Nguyen, Quynh T. N. Vo, Hung C. Luu, Tho T. Quan |
| 2025 | LangCompress: Language-Aware Compression of Large Language Models. | Dieu-Hien Nguyen, Nguyen-Khang Le, Truong Dinh Do, Le-Minh Nguyen |
| 2025 | Don't Take it Literally! Idiom-aware Vietnamese Translation via In-context Learning. | Luan Thanh Nguyen, Parisa Kordjamshidi |
| 2025 | Rethinking what matters: Effective and Robust Multilingual Realignment for Low-Resource Languages. | Quang Phuoc Nguyen, David Anugraha, Flix Gaschi, Jun Bin Cheng, En-Shiun Annie Lee |
| 2025 | SEA-LION: Southeast Asian Languages in One Network. | Raymond Ng, Thanh Ngan Nguyen, Yuli Huang, Ngee Chia Tai, Wai Yi Leong, Wei Qi Leong, Xianbin Yong, Jian Gang Ngui, Yosephine Susanto, Nicholas Cheng, Hamsawardhini Rengarajan, Peerat Limkonchotiwat, Adithya Venkatadri Hulagadri, Kok Wai Teng, Yeo Yeow Tong, Bryan Siow, Wei Yi Teo, Choon Meng Tan, Brandon Ong, Zhi Hao Ong, Jann Railey Montalan, Adwin Chan, Sajeban Antonyrex, Ren Lee, Esther Choa, David Ong Tat-Wee, Bing Jie Darius Liu, William-Chandra Tjhi, Erik Cambria, Leslie Teo |
| 2025 | The Feasibility of Topic-Based Watermarking on Academic Peer Reviews. | Alexander Nemecek, Yuzhou Jiang, Erman Ayday |
| 2025 | Agreement-Constrained Probabilistic Minimum Bayes Risk Decoding. | Koki Natsumi, Hiroyuki Deguchi, Yusuke Sakai, Hidetaka Kamigaito, Taro Watanabe |
| 2025 | The Alchemy of Thought: Understanding In-Context Learning Through Supervised Classification. | Harshita Narnoli, Mihai Surdeanu |
| 2025 | Isolating Culture Neurons in Multilingual Large Language Models. | Danial Namazifard, Lukas Galke Poech |
| 2025 | PII-Scope: A Comprehensive Study on Training Data Privacy Leakage in Pretrained LLMs. | Krishna Kanth Nakka, Ahmed Frikha, Ricardo Mendes, Xue Jiang, Xuebing Zhou |
| 2025 | LiteLMGuard: Seamless and Lightweight On-Device Guardrails for Small Language Models against Quantization Vulnerabilities. | Kalyan Nakka, Jimmy Dani, Ausmit Mondal, Nitesh Saxena |
| 2025 | mmJEE-Eval: A Bilingual Multimodal Benchmark for Evaluating Scientific Reasoning in Vision-Language Models. | Arka Mukherjee, Shreya Ghosh |
| 2025 | Improving Sign Language Understanding with a Multi-Stream Masked Autoencoder Trained on ASL Videos. | Junwen Mo, MinhDuc Vo, Hideki Nakayama |
| 2025 | A Scalable Pipeline for Estimating Verb Frame Frequencies Using Large Language Models. | Adam M. Morgan, Adeen Flinker |
| 2025 | Breaking Bad: Norms for Valence, Arousal, and Dominance for over 10k English Multiword Expressions. | Saif M. Mohammad |
| 2025 | Enhancing LLM-Based Molecular Captioning with Molecular Fingerprints. | Keisuke Mizutani, Koriki Ryonosuke, Kento Tokuyama |
| 2025 | ReVision: A Dataset and Baseline VLM for Privacy-Preserving Task-Oriented Visual Instruction Rewriting. | Abhijit Mishra, Mingda Li, Hsiang Fu, Richard Noh, Minji Kim |