| 2024 | From Language Modeling to Instruction Following: Understanding the Behavior Shift in LLMs after Instruction Tuning. | Xuansheng Wu, Wenlin Yao, Jianshu Chen, Xiaoman Pan, Xiaoyang Wang, Ninghao Liu, Dong Yu |
| 2024 | Deferred NAM: Low-latency Top-K Context Injection via Deferred Context Encoding for Non-Streaming ASR. | Zelin Wu, Gan Song, Christopher Li, Pat Rondon, Zhong Meng, Xavier Velez, Weiran Wang, Diamantino Caseiro, Golan Pundak, Tsendsuren Munkhdalai, Angad Chandorkar, Rohit Prabhavalkar |
| 2024 | Reasoning or Reciting? Exploring the Capabilities and Limitations of Language Models Through Counterfactual Tasks. | Zhaofeng Wu, Linlu Qiu, Alexis Ross, Ekin Akyrek, Boyuan Chen, Bailin Wang, Najoung Kim, Jacob Andreas, Yoon Kim |
| 2024 | Weight-Inherited Distillation for Task-Agnostic BERT Compression. | Taiqiang Wu, Cheng Hou, Shanshan Lao, Jiayi Li, Ngai Wong, Zhe Zhao, Yujiu Yang |
| 2024 | Universal Prompt Optimizer for Safe Text-to-Image Generation. | Zongyu Wu, Hongcheng Gao, Yueze Wang, Xiang Zhang, Suhang Wang |
| 2024 | Multimodal Multi-loss Fusion Network for Sentiment Analysis. | Zehui Wu, Ziwei Gong, Jaywon Koo, Julia Hirschberg |
| 2024 | pyvene: A Library for Understanding and Improving PyTorch Models via Interventions. | Zhengxuan Wu, Atticus Geiger, Aryaman Arora, Jing Huang, Zheng Wang, Noah D. Goodman, Christopher D. Manning, Christopher Potts |
| 2024 | F-MALLOC: Feed-forward Memory Allocation for Continual Learning in Neural Machine Translation. | Junhong Wu, Yuchen Liu, Chengqing Zong |
| 2024 | BEAR: A Unified Framework for Evaluating Relational Knowledge in Causal and Masked Language Models. | Jacek Wiland, Max Ploner, Alan Akbik |
| 2024 | COPAL-ID: Indonesian Language Reasoning with Local Culture and Nuances. | Haryo Akbarianto Wibowo, Erland Hilman Fuadi, Made Nindyatama Nityasya, Radityo Eko Prasojo, Alham Fikri Aji |
| 2024 | Low-Rank Adaptation for Multilingual Summarization: An Empirical Study. | Chenxi Whitehouse, Fantine Huot, Jasmijn Bastings, Mostafa Dehghani, Chu-Cheng Lin, Mirella Lapata |
| 2024 | DAGCN: Distance-based and Aspect-oriented Graph Convolutional Network for Aspect-based Sentiment Analysis. | Zhihao Wang, Bo Zhang, Ru Yang, Chang Guo, Maozhen Li |
| 2024 | Bridging the Novice-Expert Gap via Models of Decision-Making: A Case Study on Remediating Math Mistakes. | Rose E. Wang, Qingyang Zhang, Carly Robinson, Susanna Loeb, Dorottya Demszky |
| 2024 | Learning Cross-Architecture Instruction Embeddings for Binary Code Analysis in Low-Resource Architectures. | Junzhe Wang, Qiang Zeng, Lannan Luo |
| 2024 | Can Public Large Language Models Help Private Cross-device Federated Learning? | Boxin Wang, Yibo Zhang, Yuan Cao, Bo Li, Hugh McMahan, Sewoong Oh, Zheng Xu, Manzil Zaheer |
| 2024 | Pre-trained Language Models for Entity Blocking: A Reproducibility Study. | Runhui Wang, Yongfeng Zhang |
| 2024 | Personalized Federated Learning for Text Classification with Gradient-Free Prompt Tuning. | Rui Wang, Tong Yu, Ruiyi Zhang, Sungchul Kim, Ryan A. Rossi, Handong Zhao, Junda Wu, Subrata Mitra, Lina Yao, Ricardo Henao |
| 2024 | Commentary Generation from Data Records of Multiplayer Strategy Esports Game. | Zihan Wang, Naoki Yoshinaga |
| 2024 | Backdoor Attacks on Multilingual Machine Translation. | Jun Wang, Qiongkai Xu, Xuanli He, Benjamin I. P. Rubinstein, Trevor Cohn |
| 2024 | Knowledgeable In-Context Tuning: Exploring and Exploiting Factual Knowledge for In-Context Learning. | Jianing Wang, Chengyu Wang, Chuanqi Tan, Jun Huang, Ming Gao |
| 2024 | MDR: Model-Specific Demonstration Retrieval at Inference Time for In-Context Learning. | Huazheng Wang, Jinming Wu, Haifeng Sun, Zixuan Xia, Daixuan Cheng, Jingyu Wang, Qi Qi, Jianxin Liao |
| 2024 | Fake Alignment: Are LLMs Really Aligned Well? | Yixu Wang, Yan Teng, Kexin Huang, Chengqi Lyu, Songyang Zhang, Wenwei Zhang, Xingjun Ma, Yu-Gang Jiang, Yu Qiao, Yingchun Wang |
| 2024 | AbsPyramid: Benchmarking the Abstraction Ability of Language Models with a Unified Entailment Graph. | Zhaowei Wang, Haochen Shi, Weiqi Wang, Tianqing Fang, Hongming Zhang, Sehyun Choi, Xin Liu, Yangqiu Song |
| 2024 | LaDiC: Are Diffusion Models Really Inferior to Autoregressive Counterparts for Image-to-Text Generation? | Yuchi Wang, Shuhuai Ren, Rundong Gao, Linli Yao, Qingyan Guo, Kaikai An, Jianhong Bai, Xu Sun |
| 2024 | Interpreting Answers to Yes-No Questions in Dialogues from Multiple Domains. | Zijie Wang, Farzana Rashid, Eduardo Blanco |