| 2026 | AAAI | Disentangling Adversarial Prompts: A Semantic-Graph Defense for Robust LLM Security. | Xiang Fang, Wanlong Fang |
| 2026 | AAAI | Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization. | Xiang Fang, Wanlong Fang, Changshuo Wang |
| 2026 | AAAI | Rethinking Video-Language Model from the Language Input Perspective. | Xiang Fang, Wanlong Fang, Changshuo Wang, Xiaoye Qu, Daizong Liu |
| 2026 | AAAI | Towards Unified Vision-Language Models with Incomplete Multi-Modal Inputs. | Xiang Fang, Wanlong Fang, Changshuo Wang, Keke Tang, Daizong Liu, Siyi Wang, Wei Ji |
| 2026 | AAAI | To Align or Not to Align: Strategic Multimodal Representation Alignment for Optimal Performance. | Wanlong Fang, Tianle Zhang, Alvin Chan |
| 2025 | AAAI | Multi-Pair Temporal Sentence Grounding via Multi-Thread Knowledge Transfer Network. | Xiang Fang, Wanlong Fang, Changshuo Wang, Daizong Liu, Keke Tang, Jianfeng Dong, Pan Zhou, Beibei Li |
| 2024 | AAAI | Fewer Steps, Better Performance: Efficient Cross-Modal Clip Trimming for Video Moment Retrieval Using Language. | Xiang Fang, Daizong Liu, Wanlong Fang, Pan Zhou, Zichuan Xu, Wenzheng Xu, Junyang Chen, Renfu Li |
| 2024 | COLING | Towards Robust Temporal Activity Localization Learning with Noisy Labels. | Daizong Liu, Xiaoye Qu, Xiang Fang, Jianfeng Dong, Pan Zhou, Guoshun Nan, Keke Tang, Wanlong Fang, Yu Cheng |
| 2024 | ECCV | Rethinking Weakly-Supervised Video Temporal Grounding From a Game Perspective. | Xiang Fang, Zeyu Xiong, Wanlong Fang, Xiaoye Qu, Chen Chen, Jianfeng Dong, Keke Tang, Pan Zhou, Yu Cheng, Daizong Liu |
| 2023 | EMNLP | Annotations Are Not All You Need: A Cross-modal Knowledge Transfer Network for Unsupervised Temporal Sentence Grounding. | Xiang Fang, Daizong Liu, Wanlong Fang, Pan Zhou, Yu Cheng, Keke Tang, Kai Zou |