| 2025 | CVPR | PVC: Progressive Visual Token Compression for Unified Image and Video Processing in Large Vision-Language Models. | Chenyu Yang, Xuan Dong, Xizhou Zhu, Weijie Su, Jiahao Wang, Hao Tian, Zhe Chen, Wenhai Wang, Lewei Lu, Jifeng Dai |
| 2025 | ICML | CoMemo: LVLMs Need Image Context with Image Memory. | Shi Liu, Weijie Su, Xizhou Zhu, Wenhai Wang, Jifeng Dai |
| 2025 | ISNN | A General One-Parameter Discrete-Time Recurrent Neural Network for Solving Discrete-Form Time-Varying Augmented Sylvester Matrix Equation. | Yueyang Ma, Weijie Su, Jian Li, Dimitrios Gerontitis, Yang Shi, Jiyun Wang |
| 2024 | AAAI | Eliciting Honest Information from Authors Using Sequential Review. | Yichi Zhang, Grant Schoenebeck, Weijie Su |
| 2024 | COLT | Bridging the Gap: Rademacher Complexity in Robust and Standard Generalization. | Jiancong Xiao, Ruoyu Sun, Qi Long, Weijie Su |
| 2024 | CVPR | Intern VL: Scaling up Vision Foundation Models and Aligning for Generic Visual-Linguistic Tasks. | Zhe Chen, Jiannan Wu, Wenhai Wang, Weijie Su, Guo Chen, Sen Xing, Muyan Zhong, Qinglong Zhang, Xizhou Zhu, Lewei Lu, Bin Li, Ping Luo, Tong Lu, Yu Qiao, Jifeng Dai |
| 2024 | EMNLP | A Peek into Token Bias: Large Language Models Are Not Yet Genuine Reasoners. | Bowen Jiang, Yangxinyu Xie, Zhuoqun Hao, Xiaomeng Wang, Tanwi Mallick, Weijie Su, Camillo J. Taylor, Dan Roth |
| 2024 | INDIN | Parameter Identification Based on Generalized Orthonormal Basis Function Without Persistent Excitation: A Learning-Based Paradigm. | Kuan Li, Weijie Su, Xingyong Li, Yang He, Minchang Huang, Hao Luo |
| 2023 | CVPR | Towards All-in-One Pre-Training via Maximizing Multi-Modal Mutual Information. | Weijie Su, Xizhou Zhu, Chenxin Tao, Lewei Lu, Bin Li, Gao Huang, Yu Qiao, Xiaogang Wang, Jie Zhou, Jifeng Dai |
| 2023 | CVPR | Siamese Image Modeling for Self-Supervised Vision Representation Learning. | Chenxin Tao, Xizhou Zhu, Weijie Su, Gao Huang, Bin Li, Jie Zhou, Yu Qiao, Xiaogang Wang, Jifeng Dai |
| 2021 | ICLR | Deformable DETR: Deformable Transformers for End-to-End Object Detection. | Xizhou Zhu, Weijie Su, Lewei Lu, Bin Li, Xiaogang Wang, Jifeng Dai |
| 2020 | ICLR | VL-BERT: Pre-training of Generic Visual-Linguistic Representations. | Weijie Su, Xizhou Zhu, Yue Cao, Bin Li, Lewei Lu, Furu Wei, Jifeng Dai |
| 2011 | VTC | Quantitative Analysis of the VANET Connectivity: Theory and Application. | Xin Jin, Weijie Su, Wei Yan |