Shuhuai Ren
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
17
Venues
7
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
17 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | TEMPLE: Incentivizing Temporal Understanding of Video Large Language Models via Progressive Pre-SFT Alignment. | Shicheng Li, Lei Li, Kun Ouyang, Shuhuai Ren, Yuanxin Liu, Yuanxing Zhang, Fuzheng Zhang, Lingpeng Kong, Qi Liu, Xu Sun |
| 2025 | CVPR | Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis. | Chaoyou Fu, Yuhan Dai, Yongdong Luo, Lei Li, Shuhuai Ren, Renrui Zhang, Zihan Wang, Chenyu Zhou, Yunhang Shen, Mengdan Zhang, Peixian Chen, Yanwei Li, Shaohui Lin, Sirui Zhao, Ke Li, Tong Xu, Xiawu Zheng, Enhong Chen, Caifeng Shan, Ran He, Xing Sun |
| 2025 | CVPR | Parallelized Autoregressive Visual Generation. | Yuqing Wang, Shuhuai Ren, Zhijie Lin, Yujin Han, Haoyuan Guo, Zhenheng Yang, Difan Zou, Jiashi Feng, Xihui Liu |
| 2025 | EMNLP | RICO: Improving Accuracy and Completeness in Image Recaptioning via Visual Reconstruction. | Yuchi Wang, Yishuo Cai, Shuhuai Ren, Sihan Yang, Linli Yao, Yuanxin Liu, Yuanxing Zhang, Pengfei Wan, Xu Sun |
| 2025 | ICCV | Bridging Continuous and Discrete Tokens for Autoregressive Visual Generation. | Yuqing Wang, Zhijie Lin, Yao Teng, Yuanzhi Zhu, Shuhuai Ren, Jiashi Feng, Xihui Liu |
| 2024 | ACL | PCA-Bench: Evaluating Multimodal Large Language Models in Perception-Cognition-Action Chain. | Liang Chen, Yichi Zhang, Shuhuai Ren, Haozhe Zhao, Zefan Cai, Yuchi Wang, Peiyi Wang, Xiangdi Meng, Tianyu Liu, Baobao Chang |
| 2024 | ACL | TempCompass: Do Video LLMs Really Understand Videos? | Yuanxin Liu, Shicheng Li, Yi Liu, Yuxiang Wang, Shuhuai Ren, Lei Li, Sishuo Chen, Xu Sun, Lu Hou |
| 2024 | CVPR | TimeChat: A Time-sensitive Multimodal Large Language Model for Long Video Understanding. | Shuhuai Ren, Linli Yao, Shicheng Li, Xu Sun, Lu Hou |
| 2024 | ECCV | VITATECS: A Diagnostic Dataset for Temporal Concept Understanding of Video-Language Models. | Shicheng Li, Lei Li, Yi Liu, Shuhuai Ren, Yuanxin Liu, Rundong Gao, Xu Sun, Lu Hou |
| 2024 | NAACL | LaDiC: Are Diffusion Models Really Inferior to Autoregressive Counterparts for Image-to-Text Generation? | Yuchi Wang, Shuhuai Ren, Rundong Gao, Linli Yao, Qingyan Guo, Kaikai An, Jianhong Bai, Xu Sun |
| 2023 | ACL | Delving into the Openness of CLIP. | Shuhuai Ren, Lei Li, Xuancheng Ren, Guangxiang Zhao, Xu Sun |
| 2023 | EMNLP | TESTA: Temporal-Spatial Token Aggregation for Long-form Video-Language Understanding. | Shuhuai Ren, Sishuo Chen, Shicheng Li, Xu Sun, Lu Hou |
| 2021 | ACL | Learning Relation Alignment for Calibrated Cross-modal Retrieval. | Shuhuai Ren, Junyang Lin, Guangxiang Zhao, Rui Men, An Yang, Jingren Zhou, Xu Sun, Hongxia Yang |
| 2021 | EMNLP | CascadeBERT: Accelerating Inference of Pre-trained Language Models via Calibrated Complete Models Cascade. | Lei Li, Yankai Lin, Deli Chen, Shuhuai Ren, Peng Li, Jie Zhou, Xu Sun |
| 2021 | EMNLP | Dynamic Knowledge Distillation for Pre-trained Language Models. | Lei Li, Yankai Lin, Shuhuai Ren, Peng Li, Jie Zhou, Xu Sun |
| 2021 | EMNLP | Text AutoAugment: Learning Compositional Augmentation Policy for Text Classification. | Shuhuai Ren, Jinchao Zhang, Lei Li, Xu Sun, Jie Zhou |
| 2019 | ACL | Generating Natural Language Adversarial Examples through Probability Weighted Word Saliency. | Shuhuai Ren, Yihe Deng, Kun He, Wanxiang Che |