| 2026 | AAAI | Earth-Adapter: Bridge the Geospatial Domain Gaps with a Frequency-Guided Mixture of Adapters. | Xiaoxing Hu, Ziyang Gong, Yupei Wang, Yuru Jia, Fei Lin, Dexiang Gao, Ke An, Jianhong Han, Zhuoran Sun, Gen Luo, Xue Yang |
| 2025 | ACL | Training Long-Context LLMs Efficiently via Chunk-wise Optimization. | Wenhao Li, Yuxin Zhang, Gen Luo, Daohai Yu, Rongrong Ji |
| 2025 | CVPR | WeakMCN: Multi-task Collaborative Network for Weakly Supervised Referring Expression Comprehension and Segmentation. | Silin Cheng, Yang Liu, Xinwei He, Sbastien Ourselin, Lei Tan, Gen Luo |
| 2025 | CVPR | DViN: Dynamic Visual Routing Network for Weakly Supervised Referring Expression Comprehension. | Xiaofu Chen, Yaxin Luo, Gen Luo, Jiayi Ji, Henghui Ding, Yiyi Zhou |
| 2025 | CVPR | Mono-InternVL: Pushing the Boundaries of Monolithic Multimodal Large Language Models with Endogenous Visual Pre-training. | Gen Luo, Xue Yang, Wenhan Dou, Zhaokai Wang, Jiawen Liu, Jifeng Dai, Yu Qiao, Xizhou Zhu |
| 2025 | CVPR | FlashSloth : Lightning Multimodal Large Language Models via Embedded Visual Compression. | Bo Tong, Bokai Lai, Yiyi Zhou, Gen Luo, Yunhang Shen, Ke Li, Xiaoshuai Sun, Rongrong Ji |
| 2025 | ICLR | γ-MoD: Exploring Mixture-of-Depth Adaptation for Multimodal Large Language Models. | Yaxin Luo, Gen Luo, Jiayi Ji, Yiyi Zhou, Xiaoshuai Sun, Zhiqiang Shen, Rongrong Ji |
| 2025 | ICLR | Feast Your Eyes: Mixture-of-Resolution Adaptation for Multimodal Large Language Models. | Gen Luo, Yiyi Zhou, Yuxin Zhang, Xiawu Zheng, Xiaoshuai Sun, Rongrong Ji |
| 2025 | VTC | Joint Method for XPIC, Equalization and IQ Imbalance Compensation in Space-Air-Ground Broadband Dual-Polarized Systems. | Haoran Wang, Shili Wang, Gen Luo, Qi He, Yezhou Lu, Kai Yang |
| 2024 | AAAI | 3D-STMN: Dependency-Driven Superpoint-Text Matching Network for End-to-End 3D Referring Expression Segmentation. | Changli Wu, Yiwei Ma, Qi Chen, Haowei Wang, Gen Luo, Jiayi Ji, Xiaoshuai Sun |
| 2024 | ECCV | APL: Anchor-Based Prompt Learning for One-Stage Weakly Supervised Referring Expression Comprehension. | Yaxin Luo, Jiayi Ji, Xiaofu Chen, Yuxin Zhang, Tianhe Ren, Gen Luo |
| 2024 | ICML | CaM: Cache Merging for Memory-efficient LLMs Inference. | Yuxin Zhang, Yuxuan Du, Gen Luo, Yunshan Zhong, Zhenyu Zhang, Shiwei Liu, Rongrong Ji |
| 2024 | ICML | Fast Text-to-3D-Aware Face Generation and Manipulation via Direct Cross-modal Mapping and Geometric Regularization. | Jinlu Zhang, Yiyi Zhou, Qiancheng Zheng, Xiaoxiong Du, Gen Luo, Jun Peng, Xiaoshuai Sun, Rongrong Ji |
| 2023 | CVPR | RefCLIP: A Universal Teacher for Weakly Supervised Referring Expression Comprehension. | Lei Jin, Gen Luo, Yiyi Zhou, Xiaoshuai Sun, Guannan Jiang, Annan Shu, Rongrong Ji |
| 2023 | CVPR | RefTeacher: A Strong Baseline for Semi-Supervised Referring Expression Comprehension. | Jiamu Sun, Gen Luo, Yiyi Zhou, Xiaoshuai Sun, Guannan Jiang, Zhiyu Wang, Rongrong Ji |
| 2022 | CVPR | Active Teacher for Semi-Supervised Object Detection. | Peng Mi, Jianghang Lin, Yiyi Zhou, Yunhang Shen, Gen Luo, Xiaoshuai Sun, Liujuan Cao, Rongrong Fu, Qiang Xu, Rongrong Ji |
| 2022 | ECCV | SeqTR: A Simple Yet Universal Network for Visual Grounding. | Chaoyang Zhu, Yiyi Zhou, Yunhang Shen, Gen Luo, Xingjia Pan, Mingbao Lin, Chao Chen, Liujuan Cao, Xiaoshuai Sun, Rongrong Ji |
| 2021 | AAAI | Improving Image Captioning by Leveraging Intra- and Inter-layer Global Representation in Transformer Network. | Jiayi Ji, Yunpeng Luo, Xiaoshuai Sun, Fuhai Chen, Gen Luo, Yongjian Wu, Yue Gao, Rongrong Ji |
| 2020 | CVPR | Multi-Task Collaborative Network for Joint Referring Expression Comprehension and Segmentation. | Gen Luo, Yiyi Zhou, Xiaoshuai Sun, Liujuan Cao, Chenglin Wu, Cheng Deng, Rongrong Ji |