| 2026 | WWW | AWMA-MoE: Attention-Guided Watermark Adapter with MoE for Latent Diffusion Models. | Yicheng Huang, Xinyu Xiao, Jian Zhang, Shuhan Qi, Yulin Wu, Xuan Wang |
| 2026 | WWW | PruneRAG: Confidence-Guided Query Decomposition Trees for Efficient Retrieval-Augmented Generation. | Shuguang Jiao, Xinyu Xiao, Yunfan Wei, Shuhan Qi, Chengkai Huang, Quan Z. Sheng, Lina Yao |
| 2025 | AAAI | Privacy-Preserving V2X Collaborative Perception Integrating Unknown Collaborators. | Bin Lu, Xinyu Xiao, Changzhou Zhang, Yang Zhou, Zhiyu Xiang, Hangguan Shan, Eryun Liu |
| 2025 | AAAI | Towards Building Human-like Smart Agents in Modern 3D Video Games (Student Abstract). | Zhihang Sun, Shuhan Qi, Xinhao Huang, Xinyu Xiao, Jiajia Zhang, Xuan Wang, Peixi Peng |
| 2025 | EMNLP | Merge then Realign: Simple and Effective Modality-Incremental Continual Learning for Multimodal LLMs. | Dingkun Zhang, Shuhan Qi, Xinyu Xiao, Kehai Chen, Xuan Wang |
| 2025 | ICCV | Unified Visual Generation via Next-Set Prediction in Continuous Domain. | Zhanzhou Feng, Qingpei Guo, Xinyu Xiao, Ruihan Xu, Ming Yang, Shiliang Zhang |
| 2024 | ECCV | IFTR: An Instance-Level Fusion Transformer for Visual Collaborative Perception. | Shaohong Wang, Lu Bin, Xinyu Xiao, Zhiyu Xiang, Hangguan Shan, Eryun Liu |
| 2022 | ICDM | Spatiotemporal Contextual Consistency Network for Precipitation Nowcasting. | Xinyu Xiao, Qizhao Jin, Gaofeng Meng, Shiming Xiang, Chunhong Pan |
| 2022 | IJCNN | Improving Graph Neural Network For Session-based Recommendation System Via Time Sessions. | Xuqi Yang, Xinyu Xiao, Wei Zhou, Junhao Wen |
| 2022 | Interspeech | CALM: Constrastive Cross-modal Speaking Style Modeling for Expressive Text-to-Speech Synthesis. | Yi Meng, Xiang Li, Zhiyong Wu, Tingtian Li, Zixun Sun, Xinyu Xiao, Chi Sun, Hui Zhan, Helen Meng |
| 2021 | ICASSP | Reinforcement Stacked Learning with Semantic-Associated Attention for Visual Question Answering. | Xinyu Xiao, Chunxia Zhang, Shiming Xiang, Chunhong Pan |
| 2019 | AAAI | What and Where the Themes Dominate in Image. | Xinyu Xiao, Lingfeng Wang, Shiming Xiang, Chunhong Pan |
| 2019 | EMNLP | Guiding the Flowing of Semantics: Interpretable Video Captioning via POS Tag. | Xinyu Xiao, Lingfeng Wang, Bin Fan, Shiming Xiang, Chunhong Pan |