| 2026 | AAAI | VRAgent-R1: Boosting Video Recommendation with MLLM-based Agents via Reinforcement Learning. | Siran Chen, Boyu Chen, Yuxiao Luo, Chenyun Yu, Yi Ouyang, Lei Cheng, Chengxiang Zhuo, Zang Li, Yali Wang |
| 2026 | AAAI | When Top-ranked Recommendations Fail: Modeling Multi-Granular Negative Feedback for Explainable and Robust Video Recommendation. | Siran Chen, Boyu Chen, Chenyun Yu, Yi Ouyang, Lei Cheng, Chengxiang Zhuo, Zang Li, Yali Wang |
| 2026 | AAAI | G-UBS: Towards Robust Understanding of Implicit Feedback via Group-Aware User Behavior Simulation. | Boyu Chen, Siran Chen, Zhengrong Yue, Kainan Yan, Chenyun Yu, Beibei Kong, Lei Cheng, Chengxiang Zhuo, Zang Li, Yali Wang |
| 2025 | AAAI | H-MBA: Hierarchical MamBa Adaptation for Multi-Modal Video Understanding in Autonomous Driving. | Siran Chen, Yuxiao Luo, Yue Ma, Yu Qiao, Yali Wang |
| 2025 | ICCV | LVAgent: Long Video Understanding by Multi-Round Dynamical Collaboration of MLLM Agents. | Boyu Chen, Zhengrong Yue, Siran Chen, Zikang Wang, Yang Liu, Peng Li, Yali Wang |
| 2025 | WACV | MagicStick: Controllable Video Editing via Control Handle Transformations. | Yue Ma, Xiaodong Cun, Sen Liang, Jinbo Xing, Yingqing He, Chenyang Qi, Siran Chen, Qifeng Chen |
| 2024 | AAAI | M-BEV: Masked BEV Perception for Robust Autonomous Driving. | Siran Chen, Yue Ma, Yu Qiao, Yali Wang |
| 2024 | AAAI | Follow Your Pose: Pose-Guided Text-to-Video Generation Using Pose-Free Videos. | Yue Ma, Yingqing He, Xiaodong Cun, Xintao Wang, Siran Chen, Xiu Li, Qifeng Chen |