| 2025 | When Attention Sink Emerges in Language Models: An Empirical View. | Xiangming Gu, Tianyu Pang, Chao Du, Qian Liu, Fengzhuo Zhang, Cunxiao Du, Ye Wang, Min Lin |
| 2025 | BLEND: Behavior-guided Neural Population Dynamics Modeling via Privileged Knowledge Distillation. | Zhengrui Guo, Fangxu Zhou, Wei Wu, Qichen Sun, Lishuang Feng, Jinzhuo Wang, Hao Chen |
| 2025 | Selective Aggregation for Low-Rank Adaptation in Federated Learning. | Pengxin Guo, Shuang Zeng, Yanran Wang, Huijie Fan, Feifei Wang, Liangqiong Qu |
| 2025 | Constraint-Conditioned Actor-Critic for Offline Safe Reinforcement Learning. | Zijian Guo, Weichao Zhou, Shengao Wang, Wenchao Li |
| 2025 | Gap Preserving Distillation by Building Bidirectional Mappings with A Dynamic Teacher. | Yong Guo, Shulian Zhang, Haolin Pan, Jing Liu, Yulun Zhang, Jian Chen |
| 2025 | Dynamical Diffusion: Learning Temporal Dynamics with Diffusion Models. | Xingzhuo Guo, Yu Zhang, Baixu Chen, Haoran Xu, Jianmin Wang, Mingsheng Long |
| 2025 | TetSphere Splatting: Representing High-Quality Geometry with Lagrangian Volumetric Meshes. | Minghao Guo, Bohan Wang, Kaiming He, Wojciech Matusik |
| 2025 | Provable Benefit of Annealed Langevin Monte Carlo for Non-log-concave Sampling. | Wei Guo, Molei Tao, Yongxin Chen |
| 2025 | SRSA: Skill Retrieval and Adaptation for Robotic Assembly Tasks. | Yijie Guo, Bingjie Tang, Iretiayo Akinola, Dieter Fox, Abhishek Gupta, Yashraj Narang |
| 2025 | API Pack: A Massive Multi-Programming Language Dataset for API Call Generation. | Zhen Guo, Adriana Meza Soria, Wei Sun, Yikang Shen, Rameswar Panda |
| 2025 | Aligned Better, Listen Better for Audio-Visual Large Language Models. | Yuxin Guo, Shuailei Ma, Shijie Ma, Xiaoyi Bao, Chen-Wei Xie, Kecheng Zheng, Tingyu Weng, Siyang Sun, Yun Zheng, Wei Zou |
| 2025 | Zeroth-Order Fine-Tuning of LLMs with Transferable Static Sparsity. | Wentao Guo, Jikai Long, Yimeng Zeng, Zirui Liu, Xinyu Yang, Yide Ran, Jacob R. Gardner, Osbert Bastani, Christopher De Sa, Xiaodong Yu, Beidi Chen, Zhaozhuo Xu |
| 2025 | TRACE: Temporal Grounding Video LLM via Causal Event Modeling. | Yongxin Guo, Jingyu Liu, Mingda Li, Qingbin Liu, Xi Chen, Xiaoying Tang |
| 2025 | On Stochastic Contextual Bandits with Knapsacks in Small Budget Regime. | Hengquan Guo, Xin Liu |
| 2025 | Which Tasks Should Be Compressed Together? A Causal Discovery Approach for Efficient Multi-Task Representation Compression. | Sha Guo, Jing Chen, Zixuan Hu, Zhuo Chen, Wenhan Yang, Yu Lin, Xing Jiang, Lingyu Duan |
| 2025 | Dynamic Mixture of Experts: An Auto-Tuning Approach for Efficient Transformer Models. | Yongxin Guo, Zhenglin Cheng, Xiaoying Tang, Zhaopeng Tu, Tao Lin |
| 2025 | AssembleFlow: Rigid Flow Matching with Inertial Frames for Molecular Assembly. | Hongyu Guo, Yoshua Bengio, Shengchao Liu |
| 2025 | XAIguiFormer: explainable artificial intelligence guided transformer for brain disorder identification. | Hanning Guo, Farah Abdellatif, Yu Fu, N. Jon Shah, Abigail Morrison, Jrgen Dammers |
| 2025 | Enhancing Clustered Federated Learning: Integration of Strategies and Improved Methodologies. | Yongxin Guo, Xiaoying Tang, Tao Lin |
| 2025 | TODO: Enhancing LLM Alignment with Ternary Preferences. | Yuxiang Guo, Lu Yin, Bo Jiang, Jiaqi Zhang |
| 2025 | Smoothing the Shift: Towards Stable Test-Time Adaptation under Complex Multimodal Noises. | Zirun Guo, Tao Jin |
| 2025 | An Undetectable Watermark for Generative Image Models. | Sam Gunn, Xuandong Zhao, Dawn Song |
| 2025 | Multi-Reward as Condition for Instruction-based Image Editing. | Xin Gu, Ming Li, Libo Zhang, Fan Chen, Longyin Wen, Tiejian Luo, Sijie Zhu |
| 2025 | Deep Learning Alternatives Of The Kolmogorov Superposition Theorem. | Leonardo Ferreira Guilhoto, Paris Perdikaris |
| 2025 | Data Selection via Optimal Control for Language Models. | Yuxian Gu, Li Dong, Hongning Wang, Yaru Hao, Qingxiu Dong, Furu Wei, Minlie Huang |