| 2026 | AAAI | Scene-Aware Spatiotemporal Generalization: Towards Robust Temporal Action Detection Across Domains. | Fangming Feng, Sihang Cai, Zequn Xie, Yangyang Wu, Tao Jin |
| 2026 | ACL | Rectifying the Emotional Flow: Aligning Priors and Dynamic Guidance for High-Arousal Text-to-Speech. | Fangming Feng, Dongjie Fu, Zequn Xie, Yu Zhang, Yangyang Wu, Zhou Zhao, Tao Jin |
| 2026 | ACL | Iterative Self-Correction for Text-Driven Person Re-Identification with Large Vision-Language Models. | Guijin Luo, Zequn Xie, Sihang Cai, Chuxin Wang, Zhou Zhao, Yixuan Tang |
| 2026 | ACL | WebClipper: Efficient Evolution of Web Agents with Graph-based Trajectory Pruning. | Junjie Wang, Zequn Xie, Dan Yang, Jie Feng, Yue Shen, Duolin Sun, Meixiu Long, Yihan Jiao, Zhehao Tan, Jian Wang, Peng Wei, Jinjie Gu |
| 2026 | ACL | DPDV: Dual-Pathway and Dual-View Representation Learning for Bridging Information Asymmetry in Text-Video Retrieval. | Zequn Xie, Xin Liu, Fangming Feng, Boyun Zhang, Tao Jin |
| 2026 | ACL | Bridging the Pose-Semantic Gap: A Cascade Framework for Text-Based Person Anomaly Search. | Zequn Xie, Guijin Luo, Chuxin Wang, Sihang Cai, Tao Jin, Zhou Zhao, Yixuan Tang |
| 2026 | ACL | Generative-to-Discriminative Test-Time Adaptation via Manifold-Aware Diffusion and Bayesian Distillation. | Boyun Zhang, Zequn Xie, Fangming Feng, Zihan Zhang, Yongbo He, Chuxin Wang, Sihang Cai, Tao Jin, Qifei Zhang |
| 2025 | EMNLP | Chat-Driven Text Generation and Interaction for Person Retrieval. | Zequn Xie, Chuxin Wang, Yeqiang Wang, Sihang Cai, Shulei Wang, Tao Jin |