| 2026 | AAAI | Zooming In on Fakes: A Novel Dataset for Localized AI-Generated Image Detection with Forgery Amplification Approach. | Lvpan Cai, Haowei Wang, Jiayi Ji, YanShu ZhouMen, Shen Chen, Taiping Yao, Xiaoshuai Sun |
| 2026 | AAAI | 3D-DRES: Detailed 3D Referring Expression Segmentation. | Qi Chen, Changli Wu, Jiayi Ji, Yiwei Ma, Liujuan Cao |
| 2026 | AAAI | FIND: A Simple Yet Effective Baseline for Diffusion-Generated Image Detection. | Jie Li, Yingying Feng, Chi Xie, Jie Hu, Lei Tan, Jiayi Ji |
| 2026 | AAAI | QuoTA: Query-oriented Token Assignment via CoT Query Decouple for Long Video Comprehension. | Yongdong Luo, Wang Chen, Weizhong Huang, Shukang Yin, Haojia Lin, Jinfa Huang, Chaoyou Fu, Jiayi Ji, Xiawu Zheng, Jiebo Luo |
| 2026 | ACL | CSMCIR: CoT-Enhanced Symmetric Alignment with Memory Bank for Composed Image Retrieval. | Zhipeng Qian, Zihan Liang, Yufei Ma, Ben Chen, Huangyu Dai, Yiwei Ma, Jiayi Ji, Chenyi Lei, Han Li, Xiaoshuai Sun |
| 2025 | AAAI | IPDN: Image-enhanced Prompt Decoding Network for 3D Referring Expression Segmentation. | Qi Chen, Changli Wu, Jiayi Ji, Yiwei Ma, Danni Yang, Xiaoshuai Sun |
| 2025 | CVPR | Towards General Visual-Linguistic Face Forgery Detection. | Ke Sun, Shen Chen, Taiping Yao, Ziyin Zhou, Jiayi Ji, Xiaoshuai Sun, Chia-Wen Lin, Rongrong Ji |
| 2025 | CVPR | DViN: Dynamic Visual Routing Network for Weakly Supervised Referring Expression Comprehension. | Xiaofu Chen, Yaxin Luo, Gen Luo, Jiayi Ji, Henghui Ding, Yiyi Zhou |
| 2025 | CVPR | ACL: Activating Capability of Linear Attention for Image Restoration. | Yubin Gu, Yuan Meng, Jiayi Ji, Xiaoshuai Sun |
| 2025 | ICCV | Inter2Former: Dynamic Hybrid Attention for Efficient High-Precision Interactive Segmentation. | You Huang, Lichao Chen, Jiayi Ji, Liujuan Cao, Shengchuan Zhang, Rongrong Ji |
| 2025 | ICCV | Aigi-Holmes: Towards Explainable and Generalizable AI-Generated Image Detection via Multimodal Large Language Models. | Ziyin Zhou, Yunpeng Luo, Yuanchen Wu, Ke Sun, Jiayi Ji, Ke Yan, Shouhong Ding, Xiaoshuai Sun, Yunsheng Wu, Rongrong Ji |
| 2025 | ICLR | γ-MoD: Exploring Mixture-of-Depth Adaptation for Multimodal Large Language Models. | Yaxin Luo, Gen Luo, Jiayi Ji, Yiyi Zhou, Xiaoshuai Sun, Zhiqiang Shen, Rongrong Ji |
| 2025 | ICLR | Towards Semantic Equivalence of Tokenization in Multimodal LLM. | Shengqiong Wu, Hao Fei, Xiangtai Li, Jiayi Ji, Hanwang Zhang, Tat-Seng Chua, Shuicheng Yan |
| 2025 | ICML | Multi-Modal Object Re-identification via Sparse Mixture-of-Experts. | Yingying Feng, Jie Li, Chi Xie, Lei Tan, Jiayi Ji |
| 2024 | AAAI | Improving Panoptic Narrative Grounding by Harnessing Semantic Relationships and Visual Confirmation. | Tianyu Guo, Haowei Wang, Yiwei Ma, Jiayi Ji, Xiaoshuai Sun |
| 2024 | AAAI | X-RefSeg3D: Enhancing Referring 3D Instance Segmentation via Structured Cross-Modal Graph Neural Networks. | Zhipeng Qian, Yiwei Ma, Jiayi Ji, Xiaoshuai Sun |
| 2024 | AAAI | Toward Open-Set Human Object Interaction Detection. | Mingrui Wu, Yuqi Liu, Jiayi Ji, Xiaoshuai Sun, Rongrong Ji |
| 2024 | AAAI | 3D-STMN: Dependency-Driven Superpoint-Text Matching Network for End-to-End 3D Referring Expression Segmentation. | Changli Wu, Yiwei Ma, Qi Chen, Haowei Wang, Gen Luo, Jiayi Ji, Xiaoshuai Sun |
| 2024 | COLING | MMAPS: End-to-End Multi-Grained Multi-Modal Attribute-Aware Product Summarization. | Tao Chen, Ze Lin, Hui Li, Jiayi Ji, Yiyi Zhou, Guanbin Li, Rongrong Ji |
| 2024 | CVPR | Rotated Multi-Scale Interaction Network for Referring Remote Sensing Image Segmentation. | Sihan Liu, Yiwei Ma, Xiaoqing Zhang, Haowei Wang, Jiayi Ji, Xiaoshuai Sun, Rongrong Ji |
| 2024 | ECCV | APL: Anchor-Based Prompt Learning for One-Stage Weakly Supervised Referring Expression Comprehension. | Yaxin Luo, Jiayi Ji, Xiaofu Chen, Yuxin Zhang, Tianhe Ren, Gen Luo |
| 2024 | ECCV | Multi-branch Collaborative Learning Network for 3D Visual Grounding. | Zhipeng Qian, Yiwei Ma, Zhekai Lin, Jiayi Ji, Xiawu Zheng, Xiaoshuai Sun, Rongrong Ji |
| 2024 | ECCV | Exploring Phrase-Level Grounding with Text-to-Image Diffusion Model. | Danni Yang, Ruohan Dong, Jiayi Ji, Yiwei Ma, Haowei Wang, Xiaoshuai Sun, Rongrong Ji |
| 2024 | ICML | X-Oscar: A Progressive Framework for High-quality Text-guided 3D Animatable Avatar Generation. | Yiwei Ma, Zhekai Lin, Jiayi Ji, Yijun Fan, Xiaoshuai Sun, Rongrong Ji |
| 2024 | ICML | Evaluating and Analyzing Relationship Hallucinations in Large Vision-Language Models. | Mingrui Wu, Jiayi Ji, Oucheng Huang, Jiale Li, Yuhang Wu, Xiaoshuai Sun, Rongrong Ji |
| 2024 | ICML | SAM as the Guide: Mastering Pseudo-Label Refinement in Semi-Supervised Referring Expression Segmentation. | Danni Yang, Jiayi Ji, Yiwei Ma, Tianyu Guo, Haowei Wang, Xiaoshuai Sun, Rongrong Ji |
| 2023 | AAAI | Towards Real-Time Panoptic Narrative Grounding by an End-to-End Grounding Network. | Haowei Wang, Jiayi Ji, Yiyi Zhou, Yongjian Wu, Xiaoshuai Sun |
| 2023 | ICCV | X-Mesh: Towards Fast and Accurate Text-driven 3D Stylization via Dynamic Textual Guidance. | Yiwei Ma, Haowei Wang, Xiaoqing Zhang, Guannan Jiang, Xiaoshuai Sun, Weilin Zhuang, Jiayi Ji, Rongrong Ji |
| 2021 | AAAI | Improving Image Captioning by Leveraging Intra- and Inter-layer Global Representation in Transformer Network. | Jiayi Ji, Yunpeng Luo, Xiaoshuai Sun, Fuhai Chen, Gen Luo, Yongjian Wu, Yue Gao, Rongrong Ji |
| 2021 | AAAI | Dual-level Collaborative Transformer for Image Captioning. | Yunpeng Luo, Jiayi Ji, Xiaoshuai Sun, Liujuan Cao, Yongjian Wu, Feiyue Huang, Chia-Wen Lin, Rongrong Ji |
| 2021 | CVPR | RSTNet: Captioning With Adaptive Attention on Visual and Non-Visual Words. | Xuying Zhang, Xiaoshuai Sun, Yunpeng Luo, Jiayi Ji, Yiyi Zhou, Yongjian Wu, Feiyue Huang, Rongrong Ji |