| 2026 | AAAI | VRAgent-R1: Boosting Video Recommendation with MLLM-based Agents via Reinforcement Learning. | Siran Chen, Boyu Chen, Yuxiao Luo, Chenyun Yu, Yi Ouyang, Lei Cheng, Chengxiang Zhuo, Zang Li, Yali Wang |
| 2026 | AAAI | When Top-ranked Recommendations Fail: Modeling Multi-Granular Negative Feedback for Explainable and Robust Video Recommendation. | Siran Chen, Boyu Chen, Chenyun Yu, Yi Ouyang, Lei Cheng, Chengxiang Zhuo, Zang Li, Yali Wang |
| 2026 | AAAI | G-UBS: Towards Robust Understanding of Implicit Feedback via Group-Aware User Behavior Simulation. | Boyu Chen, Siran Chen, Zhengrong Yue, Kainan Yan, Chenyun Yu, Beibei Kong, Lei Cheng, Chengxiang Zhuo, Zang Li, Yali Wang |
| 2026 | AAAI | VideoChat-A1: Thinking with Long Videos by Chain-of-Shot Reasoning. | Zikang Wang, Boyu Chen, Zhengrong Yue, Yi Wang, Yu Qiao, Limin Wang, Yali Wang |
| 2026 | HCI | Optimizing Navigation Strategies for Older Adults: Wayfinding Performance Under Environmental Travel Modes and Its Correlation with Cognitive Map Evaluation Methods. | Yali Wang, Mingjun Liu, Yuntao Yang, Jia Zhou |
| 2025 | AAAI | H-MBA: Hierarchical MamBa Adaptation for Multi-Modal Video Understanding in Autonomous Driving. | Siran Chen, Yuxiao Luo, Yue Ma, Yu Qiao, Yali Wang |
| 2025 | AAAI | Muses: 3D-Controllable Image Generation via Multi-Modal Agent Collaboration. | Yanbo Ding, Shaobin Zhuang, Kunchang Li, Zhengrong Yue, Yu Qiao, Yali Wang |
| 2025 | ACSAC | Belt and Braces! Fight against Key Compromising in Single Sign-On Systems. | Yuan Zhang, Yali Wang, Guowen Xu, Yaqing Song, Hongwei Li |
| 2025 | CVPR | WeGen: A Unified Model for Interactive Multimodal Generation as We Chat. | Zhipeng Huang, Shaobin Zhuang, Canmiao Fu, Binxin Yang, Ying Zhang, Chong Sun, Zhizheng Zhang, Yali Wang, Chen Li, Zheng-Jun Zha |
| 2025 | CVPR | Task Preference Optimization: Improving Multimodal Large Language Models with Vision Task Alignment. | Ziang Yan, Zhilin Li, Yinan He, Chenting Wang, Kunchang Li, Xinhao Li, Xiangyu Zeng, Zilei Wang, Yali Wang, Yu Qiao, Limin Wang, Yi Wang |
| 2025 | CVPR | V-Stylist: Video Stylization via Collaboration and Reflection of MLLM Agents. | Zhengrong Yue, Shaobin Zhuang, Kunchang Li, Yanbo Ding, Yali Wang |
| 2025 | ICCCN | How Can I Check Your Certificate Status in Dead Zones? A Secure Solution for Satellite Networks. | Yali Wang, Yuan Zhang, Jingwen Lu, Dairu Han, Ruijin Sun, Zhisheng Yin, Nan Cheng |
| 2025 | ICCV | LVAgent: Long Video Understanding by Multi-Round Dynamical Collaboration of MLLM Agents. | Boyu Chen, Zhengrong Yue, Siran Chen, Zikang Wang, Yang Liu, Peng Li, Yali Wang |
| 2025 | ICCV | VRBench: A Benchmark for Multi-Step Reasoning in Long Narrative Videos. | Jiashuo Yu, Yue Wu, Meng Chu, Zhifei Ren, Zizheng Huang, Pei Chu, Ruijie Zhang, Yinan He, Qirui Li, Songze Li, Zhenxiang Li, Zhongying Tu, Conghui He, Yu Qiao, Yali Wang, Yi Wang, Limin Wang |
| 2025 | ICLR | CG-Bench: Clue-grounded Question Answering Benchmark for Long Video Understanding. | Guo Chen, Yicheng Liu, Yifei Huang, Baoqi Pei, Jilan Xu, Yuping He, Tong Lu, Yali Wang, Limin Wang |
| 2025 | ICLR | Modeling Fine-Grained Hand-Object Dynamics for Egocentric Video Representation Learning. | Baoqi Pei, Yifei Huang, Jilan Xu, Guo Chen, Yuping He, Lijin Yang, Yali Wang, Weidi Xie, Yu Qiao, Fei Wu, Limin Wang |
| 2025 | ICLR | Bootstrapping Language-Guided Navigation Learning with Self-Refining Data Flywheel. | Zun Wang, Jialu Li, Yicong Hong, Songze Li, Kunchang Li, Shoubin Yu, Yi Wang, Yu Qiao, Yali Wang, Mohit Bansal, Limin Wang |
| 2025 | ICLR | TimeSuite: Improving MLLMs for Long Video Understanding via Grounded Tuning. | Xiangyu Zeng, Kunchang Li, Chenting Wang, Xinhao Li, Tianxiang Jiang, Ziang Yan, Songze Li, Yansong Shi, Zhengrong Yue, Yi Wang, Yali Wang, Yu Qiao, Limin Wang |
| 2025 | ICML | TimeStep Master: Asymmetrical Mixture of Timestep LoRA Experts for Versatile and Efficient Diffusion Models in Vision. | Shaobin Zhuang, Yiwei Guo, Yanbo Ding, Kunchang Li, Xinyuan Chen, Yaohui Wang, Fangyikang Wang, Ying Zhang, Chen Li, Yali Wang |
| 2024 | AAAI | M-BEV: Masked BEV Perception for Robust Autonomous Driving. | Siran Chen, Yue Ma, Yu Qiao, Yali Wang |
| 2024 | CVPR | MVBench: A Comprehensive Multi-modal Video Understanding Benchmark. | Kunchang Li, Yali Wang, Yinan He, Yizhuo Li, Yi Wang, Yi Liu, Zun Wang, Jilan Xu, Guo Chen, Ping Lou, Limin Wang, Yu Qiao |
| 2024 | CVPR | EgoExoLearn: A Dataset for Bridging Asynchronous Ego- and Exo-centric View of Procedural Activities in Real World. | Yifei Huang, Guo Chen, Jilan Xu, Mingfang Zhang, Lijin Yang, Baoqi Pei, Hongjie Zhang, Lu Dong, Yali Wang, Limin Wang, Yu Qiao |
| 2024 | CVPR | Vlogger: Make Your Dream A Vlog. | Shaobin Zhuang, Kunchang Li, Xinyuan Chen, Yaohui Wang, Ziwei Liu, Yu Qiao, Yali Wang |
| 2024 | ECCV | VideoMamba: State Space Model for Efficient Video Understanding. | Kunchang Li, Xinhao Li, Yi Wang, Yinan He, Yali Wang, Limin Wang, Yu Qiao |
| 2024 | ECCV | InternVideo2: Scaling Foundation Models for Multimodal Video Understanding. | Yi Wang, Kunchang Li, Xinhao Li, Jiashuo Yu, Yinan He, Guo Chen, Baoqi Pei, Rongkun Zheng, Zun Wang, Yansong Shi, Tianxiang Jiang, Songze Li, Jilan Xu, Hongjie Zhang, Yifei Huang, Yu Qiao, Yali Wang, Limin Wang |
| 2024 | ICLR | SEINE: Short-to-Long Video Diffusion Model for Generative Transition and Prediction. | Xinyuan Chen, Yaohui Wang, Lingjun Zhang, Shaobin Zhuang, Xin Ma, Jiashuo Yu, Yali Wang, Dahua Lin, Yu Qiao, Ziwei Liu |
| 2024 | ICLR | InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation. | Yi Wang, Yinan He, Yizhuo Li, Kunchang Li, Jiashuo Yu, Xin Ma, Xinhao Li, Guo Chen, Xinyuan Chen, Yaohui Wang, Ping Luo, Ziwei Liu, Yali Wang, Limin Wang, Yu Qiao |
| 2024 | ICML | MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI. | Kaining Ying, Fanqing Meng, Jin Wang, Zhiqian Li, Han Lin, Yue Yang, Hao Zhang, Wenbo Zhang, Yuqi Lin, Shuo Liu, Jiayi Lei, Quanfeng Lu, Runjian Chen, Peng Xu, Renrui Zhang, Haozhe Zhang, Peng Gao, Yali Wang, Yu Qiao, Ping Luo, Kaipeng Zhang, Wenqi Shao |
| 2024 | ICWS | Energy- and Cost-Oriented Optimization of Hybrid Coded Storage in Edge Caching Systems. | Haojuan Zhang, Yali Wang, Peiyan Yuan, Junna Zhang |
| 2023 | CVPR | VideoMAE V2: Scaling Video Masked Autoencoders with Dual Masking. | Limin Wang, Bingkun Huang, Zhiyu Zhao, Zhan Tong, Yinan He, Yi Wang, Yali Wang, Yu Qiao |
| 2023 | CVPR | MM-3DScene: 3D Scene Understanding by Customizing Masked Modeling with Informative-Preserved Reconstruction and Self-Distilled Consistency. | Mingye Xu, Mutian Xu, Tong He, Wanli Ouyang, Yali Wang, Xiaoguang Han, Yu Qiao |
| 2023 | CVPR | Starting from Non-Parametric Networks for 3D Point Cloud Analysis. | Renrui Zhang, Liuhui Wang, Yali Wang, Peng Gao, Hongsheng Li, Jianbo Shi |
| 2023 | ICCV | HTML: Hybrid Temporal-scale Multimodal Learning Framework for Referring Video Object Segmentation. | Mingfei Han, Yali Wang, Zhihui Li, Lina Yao, Xiaojun Chang, Yu Qiao |
| 2023 | ICCV | Unmasked Teacher: Towards Training-Efficient Video Foundation Models. | Kunchang Li, Yali Wang, Yizhuo Li, Yi Wang, Yinan He, Limin Wang, Yu Qiao |
| 2023 | ICCV | UniFormerV2: Unlocking the Potential of Image ViTs for Video Understanding. | Kunchang Li, Yali Wang, Yinan He, Yizhuo Li, Yi Wang, Limin Wang, Yu Qiao |
| 2022 | CVPR | Dual-AI: Dual-path Actor Interaction Learning for Group Activity Recognition. | Mingfei Han, David Junhao Zhang, Yali Wang, Rui Yan, Lina Yao, Xiaojun Chang, Yu Qiao |
| 2022 | CVPR | Cross Domain Object Detection by Target-Perceived Dual Branch Distillation. | Mengzhe He, Yali Wang, Jiaxi Wu, Yiru Wang, Hanqing Li, Bo Li, Weihao Gan, Wei Wu, Yu Qiao |
| 2022 | CVPR | Target-Relevant Knowledge Preservation for Multi-Source Domain Adaptive Object Detection. | Jiaxi Wu, Jiaxin Chen, Mengzhe He, Yiru Wang, Bo Li, Bingqi Ma, Weihao Gan, Wei Wu, Yali Wang, Di Huang |
| 2022 | ECCV | MorphMLP: An Efficient MLP-Like Backbone for Spatial-Temporal Representation Learning. | David Junhao Zhang, Kunchang Li, Yali Wang, Yunpeng Chen, Shashwat Chandra, Yu Qiao, Luoqi Liu, Mike Zheng Shou |
| 2022 | ECCV | Self-slimmed Vision Transformer. | Zhuofan Zong, Kunchang Li, Guanglu Song, Yali Wang, Yu Qiao, Biao Leng, Yu Liu |
| 2022 | ICLR | UniFormer: Unified Transformer for Efficient Spatial-Temporal Representation Learning. | Kunchang Li, Yali Wang, Peng Gao, Guanglu Song, Yu Liu, Hongsheng Li, Yu Qiao |
| 2022 | ICPR | VideoPipe 2022 Challenge: Real-World Video Understanding for Urban Pipe Inspection. | Yi Liu, Xuan Zhang, Ying Li, Guixin Liang, Yabing Jiang, Lixia Qiu, Haiping Tang, Fei Xie, Wei Yao, Yi Dai, Yu Qiao, Yali Wang |
| 2021 | AAAI | PC-HMR: Pose Calibration for 3D Human Mesh Recovery from 2D Images/Videos. | Tianyu Luan, Yali Wang, Junhao Zhang, Zhe Wang, Zhipeng Zhou, Yu Qiao |
| 2021 | ICCV | Digging into Uncertainty in Self-supervised Multi-view Stereo. | Hongbin Xu, Zhipeng Zhou, Yali Wang, Wenxiong Kang, Baigui Sun, Hao Li, Yu Qiao |
| 2021 | ICLR | CT-Net: Channel Tensorization Network for Video Classification. | Kunchang Li, Xianhang Li, Yali Wang, Jun Wang, Yu Qiao |
| 2020 | AAAI | Context-Transformer: Tackling Object Confusion for Few-Shot Detection. | Ze Yang, Yali Wang, Xianyu Chen, Jianzhuang Liu, Yu Qiao |
| 2020 | AAAI | Learning Attentive Pairwise Interaction for Fine-Grained Classification. | Peiqin Zhuang, Yali Wang, Yu Qiao |
| 2020 | CVPR | SmallBigNet: Integrating Core and Contextual Views for Video Classification. | Xianhang Li, Yali Wang, Zhipeng Zhou, Yu Qiao |
| 2020 | ECCV | Mining Inter-Video Proposal Relations for Video Object Detection. | Mingfei Han, Yali Wang, Xiaojun Chang, Yu Qiao |
| 2020 | GECCO | Improving NSGA-III for flexible job shop scheduling using automatic configuration, smart initialization and local search. | Yali Wang, Bas van Stein, Thomas Bck, Michael Emmerich |
| 2020 | PPSN | Improving Many-Objective Evolutionary Algorithms by Means of Edge-Rotated Cones. | Yali Wang, Andr H. Deutz, Thomas Bck, Michael Emmerich |
| 2019 | CEC | Vehicle Fleet Maintenance Scheduling Optimization by Multi-objective Evolutionary Algorithms. | Yali Wang, Steffen Limmer, Markus Olhofer, Michael T. M. Emmerich, Thomas Bck |
| 2019 | CVPR | Adaptive Pyramid Context Network for Semantic Segmentation. | Junjun He, Zhongying Deng, Lei Zhou, Yali Wang, Yu Qiao |
| 2019 | CVPR | PA3D: Pose-Action 3D Machine for Video Recognition. | An Yan, Yali Wang, Zhifeng Li, Yu Qiao |
| 2019 | CVPR | MetaCleaner: Learning to Hallucinate Clean Representations for Noisy-Labeled Visual Recognition. | Weihe Zhang, Yali Wang, Yu Qiao |
| 2019 | EMO | Diversity-Indicator Based Multi-Objective Evolutionary Algorithm: DI-MOEA. | Yali Wang, Michael Emmerich, Andr H. Deutz, Thomas Bck |
| 2018 | AAAI | LSTD: A Low-Shot Transfer Detector for Object Detection. | Hao Chen, Yali Wang, Guoyou Wang, Yu Qiao |
| 2018 | CVPR | Temporal Hallucinating for Action Recognition With Few Still Images. | Yali Wang, Lei Zhou, Yu Qiao |
| 2017 | AAAI | Sparse Deep Transfer Learning for Convolutional Neural Network. | Jiaming Liu, Yali Wang, Yu Qiao |
| 2017 | CEC | A new approach to target region based multiobjective evolutionary algorithms. | Yali Wang, Longmei Li, Kaifeng Yang, Michael T. M. Emmerich |
| 2017 | GLOBECOM | How Durable and Stable Is a File Sharing on the Move in Cellular-Assisted D2D Communications? | Yali Wang, Wenye Wang, Mei Song |
| 2017 | ICCV | RPAN: An End-to-End Recurrent Pose-Attention Network for Action Recognition in Videos. | Wenbin Du, Yali Wang, Yu Qiao |
| 2017 | ICWS | Pursuing Differentiated Services in a SDN-Based IoT-Oriented Pub/Sub System. | Yali Wang, Yang Zhang, Junliang Chen |
| 2016 | AISTATS | Sequential Inference for Deep Gaussian Process. | Yali Wang, Marcus A. Brubaker, Brahim Chaib-draa, Raquel Urtasun |
| 2016 | GLOBECOM | A Locality-Based Mobile Caching Policy for D2D-Based Content Sharing Network. | Yali Wang, Yujin Li, Wenye Wang, Mei Song |
| 2016 | ICASSP | Codebook enhancement of vlad representation for visual recognition. | Zhe Wang, Yali Wang, Limin Wang, Yu Qiao |
| 2015 | ICASSP | Online local Gaussian process for tensor-variate regression: Application to fast reconstruction of limb movements from brain signal. | Ming Hou, Yali Wang, Brahim Chaib-draa |
| 2014 | DASC | A Visualization Representation Method Based on GIS & RIA and Its Application in Interactive Power Utilization Field. | Xingzhe Hou, Yuangang Tan, Hongliang Sun, Gang Wang, Ying Wang, Yali Wang |
| 2014 | ICML | Gaussian Processes for Bayesian Estimation in Ordinary Differential Equations. | David Barber, Yali Wang |
| 2014 | UAI | Bayesian Filtering with Online Gaussian Process Latent Variable Models. | Yali Wang, Marcus A. Brubaker, Brahim Chaib-draa, Raquel Urtasun |
| 2013 | IJCAI | A KNN Based Kalman Filter Gaussian Process Regression. | Yali Wang, Brahim Chaib-draa |
| 2013 | IPCCC | Minimizing routing overhead with Two-Hop Coordinate Awareness in ad hoc networks. | Yali Wang, J. J. Garcia-Luna-Aceves |
| 2013 | WoWMoM | Using geographical coordinates to attain efficient route signaling in ad hoc networks. | Yali Wang, Cdric Westphal, J. J. Garcia-Luna-Aceves |
| 2012 | ICRA | An adaptive nonparametric particle filter for state estimation. | Yali Wang, Brahim Chaib-draa |
| 2005 | APWEB | A Formal Approach to Evaluate and Compare Internet Search Engines: A Case Study on Searching the Chinese Web. | Kin F. Li, Yali Wang, Shojiro Nishio, Wei Yu |
| 2005 | WWW | Finding the search engine that works for you. | Kin F. Li, Wei Yu, Shojiro Nishio, Yali Wang |