| 2025 | Instructional Segment Embedding: Improving LLM Safety with Instruction Hierarchy. | Tong Wu, Shujian Zhang, Kaiqiang Song, Silei Xu, Sanqiang Zhao, Ravi Agrawal, Sathish Reddy Indurthi, Chong Xiang, Prateek Mittal, Wenxuan Zhou |
| 2025 | VILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation. | Yecheng Wu, Zhuoyang Zhang, Junyu Chen, Haotian Tang, Dacheng Li, Yunhao Fang, Ligeng Zhu, Enze Xie, Hongxu Yin, Li Yi, Song Han, Yao Lu |
| 2025 | Circuit Representation Learning with Masked Gate Modeling and Verilog-AIG Alignment. | Haoyuan Wu, Haisheng Zheng, Yuan Pu, Bei Yu |
| 2025 | The Semantic Hub Hypothesis: Language Models Share Semantic Representations Across Languages and Modalities. | Zhaofeng Wu, Xinyan Velocity Yu, Dani Yogatama, Jiasen Lu, Yoon Kim |
| 2025 | CofCA: A STEP-WISE Counterfactual Multi-hop QA benchmark. | Jian Wu, Linyi Yang, Zhen Wang, Manabu Okumura, Yue Zhang |
| 2025 | MMQA: Evaluating LLMs with Multi-Table Multi-Hop Complex Questions. | Jian Wu, Linyi Yang, Dongyuan Li, Yuliang Ji, Manabu Okumura, Yue Zhang |
| 2025 | Pursuing Feature Separation based on Neural Collapse for Out-of-Distribution Detection. | Yingwen Wu, Ruiji Yu, Xinwen Cheng, Zhengbao He, Xiaolin Huang |
| 2025 | Gaussian Head & Shoulders: High Fidelity Neural Upper Body Avatars with Anchor Gaussian Guided Texture Warping. | Tianhao (Walter) Wu, Jing Yang, Zhilin Guo, Jingyi Wan, Fangcheng Zhong, Cengiz ztireli |
| 2025 | Multi-Label Test-Time Adaptation with Bound Entropy Minimization. | Xiangyu Wu, Feng Yu, Yang Yang, Qing-Guo Chen, Jianfeng Lu |
| 2025 | Dynamic Sparse Training versus Dense Training: The Unexpected Winner in Image Corruption Robustness. | Boqian Wu, Qiao Xiao, Shunxin Wang, Nicola Strisciuglio, Mykola Pechenizkiy, Maurice van Keulen, Decebal Constantin Mocanu, Elena Mocanu |
| 2025 | Towards Robust Alignment of Language Models: Distributionally Robustifying Direct Preference Optimization. | Junkang Wu, Yuexiang Xie, Zhengyi Yang, Jiancan Wu, Jiawei Chen, Jinyang Gao, Bolin Ding, Xiang Wang, Xiangnan He |
| 2025 | Bridging the Gap between Variational Inference and Stochastic Gradient MCMC in Function Space. | Mengjing Wu, Junyu Xuan, Jie Lu |
| 2025 | LongMemEval: Benchmarking Chat Assistants on Long-Term Interactive Memory. | Di Wu, Hongwei Wang, Wenhao Yu, Yuwei Zhang, Kai-Wei Chang, Dong Yu |
| 2025 | Retrieval Head Mechanistically Explains Long-Context Factuality. | Wenhao Wu, Yizhong Wang, Guangxuan Xiao, Hao Peng, Yao Fu |
| 2025 | Learning the Complexity of Weakly Noisy Quantum States. | Yusen Wu, Bujiao Wu, Yanqi Song, Xiao Yuan, Jingbo Wang |
| 2025 | Balancing Bias in Two-sided Markets for Fair Stable Matchings. | Siyuan Wu, Leong Hou U, Panagiotis Karras |
| 2025 | Building, Reusing, and Generalizing Abstract Representations from Concrete Sequences. | Shuchen Wu, Mirko Thalmann, Peter Dayan, Zeynep Akata, Eric Schulz |
| 2025 | Self-Play Preference Optimization for Language Model Alignment. | Yue Wu, Zhiqing Sun, Huizhuo Yuan, Kaixuan Ji, Yiming Yang, Quanquan Gu |
| 2025 | Vec2Face: Scaling Face Dataset Generation with Loosely Constrained Vectors. | Haiyu Wu, Jaskirat Singh, Sicong Tian, Liang Zheng, Kevin W. Bowyer |
| 2025 | Inference Scaling Laws: An Empirical Analysis of Compute-Optimal Inference for LLM Problem-Solving. | Yangzhen Wu, Zhiqing Sun, Shanda Li, Sean Welleck, Yiming Yang |
| 2025 | Dissecting Adversarial Robustness of Multimodal LM Agents. | Chen Henry Wu, Rishi Rajesh Shah, Jing Yu Koh, Russ Salakhutdinov, Daniel Fried, Aditi Raghunathan |
| 2025 | Computationally Efficient RL under Linear Bellman Completeness for Deterministic Dynamics. | Runzhe Wu, Ayush Sekhari, Akshay Krishnamurthy, Wen Sun |
| 2025 | A Periodic Bayesian Flow for Material Generation. | Hanlin Wu, Yuxuan Song, Jingjing Gong, Ziyao Cao, Yawen Ouyang, Jianbing Zhang, Hao Zhou, Wei-Ying Ma, Jingjing Liu |
| 2025 | Loss Landscape of Shallow ReLU-like Neural Networks: Stationary Points, Saddle Escape, and Network Embedding. | Zhengqing Wu, Berfin Simsek, Franois Gaston Ged |
| 2025 | Provable weak-to-strong generalization via benign overfitting. | David Xing Wu, Anant Sahai |