| 2026 | AAAI | Generating Attribute-Aware Human Motions from Textual Prompt. | Xinghan Wang, Kun Xu, Fei Li, Cao Sheng, Jiazhong Yu, Yadong Mu |
| 2025 | AAAI | Granularity-Adaptive Spatial Evidence Tokenization for Video Question Answering. | Hao Jiang, Yang Jin, Zhicheng Sun, Kun Xu, Kun Xu, Liwei Chen, Yang Song, Kun Gai, Yadong Mu |
| 2025 | AAAI | Neural Assembler: Learning to Generate Fine-Grained Robotic Assembly Instructions from Multi-View Images. | Hongyu Yan, Yadong Mu |
| 2025 | ICCV | NavQ: Learning a Q-Model for Foresighted Vision-and-Language Navigation. | Peiran Xu, Xicheng Gong, Yadong Mu |
| 2025 | ICLR | Weakly-Supervised Affordance Grounding Guided by Part-Level Semantic Priors. | Peiran Xu, Yadong Mu |
| 2025 | ICLR | Pyramidal Flow Matching for Efficient Video Generative Modeling. | Yang Jin, Zhicheng Sun, Ningyuan Li, Kun Xu, Hao Jiang, Nan Zhuang, Quzhe Huang, Yang Song, Yadong Mu, Zhouchen Lin |
| 2025 | ICLR | OmniPhysGS: 3D Constitutive Gaussians for General Physics-Based Dynamics Generation. | Yuchen Lin, Chenguo Lin, Jianjin Xu, Yadong Mu |
| 2025 | ICLR | DiffSplat: Repurposing Image Diffusion Models for Scalable Gaussian Splat Generation. | Chenguo Lin, Panwang Pan, Bangbang Yang, Zeming Li, Yadong Mu |
| 2025 | ICML | Closed-Loop Long-Horizon Robotic Planning via Equilibrium Sequence Modeling. | Jinghan Li, Zhicheng Sun, Yadong Mu |
| 2024 | AAAI | Transferable Video Moment Localization by Moment-Guided Query Prompting. | Hao Jiang, Yang Yizhang, Yadong Mu |
| 2024 | CVPR | Exploring Orthogonality in Open World Object Detection. | Zhicheng Sun, Jinghan Li, Yadong Mu |
| 2024 | CVPR | Ink Dot-Oriented Differentiable Optimization for Neural Image Halftoning. | Hao Jiang, Bingfeng Zhou, Yadong Mu |
| 2024 | CVPR | Countering Personalized Text-to-Image Generation with Influence Watermarks. | Hanwen Liu, Zhicheng Sun, Yadong Mu |
| 2024 | ECCV | Weakly-Supervised Spatio-Temporal Video Grounding with Variational Cross-Modal Alignment. | Yang Jin, Yadong Mu |
| 2024 | ECCV | Local Occupancy-Enhanced Object Grasping with Multiple Triplanar Projection. | Kangqi Ma, Hao Dong, Yadong Mu |
| 2024 | ICLR | Unified Language-Vision Pretraining in LLM with Dynamic Discrete Visual Tokenization. | Yang Jin, Kun Xu, Liwei Chen, Chao Liao, Jianchao Tan, Quzhe Huang, Bin Chen, Chengru Song, Dai Meng, Di Zhang, Wenwu Ou, Kun Gai, Yadong Mu |
| 2024 | ICLR | InstructScene: Instruction-Driven 3D Indoor Scene Synthesis with Semantic Graph Prior. | Chenguo Lin, Yadong Mu |
| 2024 | ICML | Video-LaVIT: Unified Video-Language Pre-training with Decoupled Visual-Motional Tokenization. | Yang Jin, Zhicheng Sun, Kun Xu, Kun Xu, Liwei Chen, Hao Jiang, Quzhe Huang, Chengru Song, Yuliang Liu, Di Zhang, Yang Song, Kun Gai, Yadong Mu |
| 2024 | ICML | Learning Solution-Aware Transformers for Efficiently Solving Quadratic Assignment Problem. | Zhentao Tan, Yadong Mu |
| 2023 | AAAI | Tree-Structured Trajectory Encoding for Vision-and-Language Navigation. | Xinzhe Zhou, Yadong Mu |
| 2023 | CVPR | Regularizing Second-Order Influences for Continual Learning. | Zhicheng Sun, Yadong Mu, Gang Hua |
| 2023 | CVPR | Learning Instance-Level Representation for Large-Scale Multi-Modal Pretraining in E-Commerce. | Yang Jin, Yongzhi Li, Zehuan Yuan, Yadong Mu |
| 2023 | CVPR | Neural Koopman Pooling: Control-Inspired Temporal Dynamics Encoding for Skeleton-Based Action Recognition. | Xinghan Wang, Xin Xu, Yadong Mu |
| 2023 | ICCV | Video Action Segmentation via Contextually Refined Temporal Keypoints. | Borui Jiang, Yang Jin, Zhentao Tan, Yadong Mu |
| 2023 | ICML | Trapdoor Normalization with Irreversible Ownership Verification. | Hanwen Liu, Zhenyu Weng, Yuesheng Zhu, Yadong Mu |
| 2023 | WWW | Curriculum Graph Poisoning. | Hanwen Liu, Peilin Zhao, Tingyang Xu, Yatao Bian, Junzhou Huang, Yuesheng Zhu, Yadong Mu |
| 2023 | WACV | Image Completion with Heterogeneously Filtered Spectral Hints. | Xingqian Xu, Shant Navasardyan, Vahram Tadevosyan, Andranik Sargsyan, Yadong Mu, Humphrey Shi |
| 2022 | CVPR | Joint Video Summarization and Moment Localization by Cross-Task Sample Transfer. | Hao Jiang, Yadong Mu |
| 2022 | CVPR | Complex Video Action Reasoning via Learnable Markov Logic Network. | Yang Jin, Linchao Zhu, Yadong Mu |
| 2021 | AAAI | Dense Events Grounding in Video. | Peijun Bao, Qian Zheng, Yadong Mu |
| 2021 | ICANN | DRENet: Giving Full Scope to Detection and Regression-Based Estimation for Video Crowd Counting. | Changsheng Liu, Yuan Huang, Yadong Mu, Xiaoming Yu |
| 2021 | IJCAI | Self-Supervised Video Action Localization with Adversarial Temporal Transforms. | Guoqiang Gong, Liangfeng Zheng, Wenhao Jiang, Yadong Mu |
| 2021 | IJCAI | Learning 3-D Human Pose Estimation from Catadioptric Videos. | Chenchen Liu, Yongzhi Li, Kangqi Ma, Duo Zhang, Peijun Bao, Yadong Mu |
| 2021 | IJCAI | Multi-Target Invisibly Trojaned Networks for Visual Recognition and Detection. | Xinzhe Zhou, Wenhao Jiang, Sheng Qi, Yadong Mu |
| 2020 | AAAI | Localize, Assemble, and Predicate: Contextual Object Proposal Embedding for Visual Relation Detection. | Ruihai Wu, Kehan Xu, Chenchen Liu, Nan Zhuang, Yadong Mu |
| 2020 | CVPR | Non-Local Neural Networks With Grouped Bilinear Attentional Transforms. | Lu Chi, Zehuan Yuan, Yadong Mu, Changhu Wang |
| 2020 | CVPR | Learning Temporal Co-Attention Models for Unsupervised Video Action Localization. | Guoqiang Gong, Xinghan Wang, Yadong Mu, Qi Tian |
| 2020 | CVPR | Beyond Short-Term Snippet: Video Relation Detection With Spatio-Temporal Global Context. | Chenchen Liu, Yang Jin, Kehan Xu, Guoqiang Gong, Yadong Mu |
| 2020 | CVPR | Visual-Semantic Matching by Exploring High-Order Attention and Distraction. | Yongzhi Li, Duo Zhang, Yadong Mu |
| 2020 | CVPR | Weakly-Supervised Action Localization by Generative Attention Modeling. | Baifeng Shi, Qi Dai, Yadong Mu, Jingdong Wang |
| 2020 | ICML | Informative Dropout for Robust Representation Learning: A Shape-bias Perspective. | Baifeng Shi, Dinghuai Zhang, Qi Dai, Zhanxing Zhu, Yadong Mu, Jingdong Wang |
| 2019 | AAAI | Attention-Based Multi-Context Guiding for Few-Shot Semantic Segmentation. | Tao Hu, Pengwan Yang, Chiliang Zhang, Gang Yu, Yadong Mu, Cees G. M. Snoek |
| 2019 | CVPR | Recurrent Attentive Zooming for Joint Crowd Counting and Precise Localization. | Chenchen Liu, Xinyu Weng, Yadong Mu |
| 2017 | AAAI | Boosting Complementary Hash Tables for Fast Nearest Neighbor Search. | Xianglong Liu, Cheng Deng, Yadong Mu, Zhujin Li |
| 2017 | AAAI | Deep Hashing: A Joint Approach for Image Signature Learning. | Yadong Mu, Zhu Liu |
| 2017 | SIGIR | Classification by Retrieval: Binarizing Data and Classifiers. | Fumin Shen, Yadong Mu, Yang Yang, Wei Liu, Li Liu, Jingkuan Song, Heng Tao Shen |
| 2016 | AAAI | Fixed-Rank Supervised Metric Learning on Riemannian Manifold. | Yadong Mu |
| 2016 | IJCAI | A Stochastic Image Grammar for Fine-Grained 3D Scene Reconstruction. | Xiaobai Liu, Yadong Mu, Liang Lin |
| 2016 | IJCAI | Coordinate Discrete Optimization for Efficient Cross-View Image Retrieval. | Yadong Mu, Wei Liu, Cheng Deng, Zongting Lv, Xinbo Gao |
| 2015 | ICDE | Piecewise linear approximation of streaming time series data with max-error guarantees. | Ge Luo, Ke Yi, Siu-Wing Cheng, Zhenguo Li, Wei Fan, Cheng He, Yadong Mu |
| 2014 | CVPR | Hash-SVM: Scalable Kernel Machines for Large-Scale Visual Classification. | Yadong Mu, Gang Hua, Wei Fan, Shih-Fu Chang |
| 2014 | KDD | Supervised deep learning with auxiliary networks. | Junbo Zhang, Guangjian Tian, Yadong Mu, Wei Fan |
| 2013 | ICCV | Distributed Low-Rank Subspace Segmentation. | Ameet Talwalkar, Lester W. Mackey, Yadong Mu, Shih-Fu Chang, Michael I. Jordan |
| 2012 | ECCV | Scene Aligned Pooling for Complex Video Recognition. | Liangliang Cao, Yadong Mu, Apostol Natsev, Shih-Fu Chang, Gang Hua, John R. Smith |
| 2012 | ECCV | Accelerated Large Scale Optimization by Concomitant Hashing. | Yadong Mu, John Wright, Shih-Fu Chang |
| 2012 | ICML | Compact Hyperplane Hashing with Bilinear Functions. | Wei Liu, Jun Wang, Yadong Mu, Sanjiv Kumar, Shih-Fu Chang |
| 2011 | CVPR | Accelerated low-rank visual recovery by random projection. | Yadong Mu, Jian Dong, Xiaotong Yuan, Shuicheng Yan |
| 2011 | ICDM | Towards Optimal Discriminating Order for Multiclass Classification. | Dong Liu, Shuicheng Yan, Yadong Mu, Xian-Sheng Hua, Shih-Fu Chang, Hong-Jiang Zhang |
| 2010 | AAAI | Non-Metric Locality-Sensitive Hashing. | Yadong Mu, Shuicheng Yan |
| 2010 | CVPR | Weakly-supervised hashing in kernel space. | Yadong Mu, Jialie Shen, Shuicheng Yan |
| 2010 | ECCV | Randomized Locality Sensitive Vocabularies for Bag-of-Features Model. | Yadong Mu, Ju Sun, Tony X. Han, Loong Fah Cheong, Shuicheng Yan |
| 2009 | ICASSP | Connectivity similarity based transductive learning for interactive image segmentation. | Yadong Mu, Bingfeng Zhou |
| 2008 | CVPR | Discriminative local binary patterns for human detection in personal album. | Yadong Mu, Shuicheng Yan, Yi Liu, Thomas S. Huang, Bingfeng Zhou |
| 2007 | ACCV | Co-segmentation of Image Pairs with Quadratic Global Constraint in MRFs. | Yadong Mu, Bingfeng Zhou |