| 2026 | ACL | How to Improve LLMs' Performance on Specific Languages: A Perspective on LLM-Derived Language Similarity. | Xinhe Shi, Qingcheng Zeng, Weihao Xuan, Linchao Zhu |
| 2026 | ACL | Verifier-Free RL for LLMs via Intrinsic Gradient-Norm Reward. | Xuexiang Wen, Hang Yu, Linchao Zhu, Gaoang Wang |
| 2026 | ACL | Attention as Selector: Unlocking VLM Attention for Long Document Page Retrieval. | Minfeng Zhu, Linxin Bao, Wei Chen, Linchao Zhu |
| 2026 | ACL | N-GRPO: Embedding-Level Neighbor Mixing for Enhanced Policy Optimization. | Xukun Zhu, Hang Yu, Peng Di, Linchao Zhu |
| 2026 | MMM | GAS: Geometry-Appearance Synergy for Consistent Video Customization. | Heng Jia, Na Zhao, Yunqiu Xu, Linchao Zhu, Yi Yang |
| 2025 | AAAI | Detecting and Mitigating Hallucination in Large Vision Language Models via Fine-Grained AI Feedback. | Wenyi Xiao, Ziwei Huang, Leilei Gan, Wanggui He, Haoyuan Li, Zhelun Yu, Fangxun Shu, Hao Jiang, Linchao Zhu |
| 2025 | AAAI | Scalable Vision-Language Understanding and Generation. | Linchao Zhu |
| 2025 | EMNLP | MuTIS: Enhancing Reasoning Efficiency through Multi Turn Intervention Sampling in Reinforcement Learning. | Wenshuo Zhao, Haoxing Zhai, Xinyu Qiu, Zhenting Qi, Shuhe Li, Linchao Zhu |
| 2025 | ICCV | H3R: Hybrid Multi-view Correspondence for Generalizable 3D Reconstruction. | Heng Jia, Linchao Zhu, Na Zhao |
| 2025 | ICCV | HUST: High-Fidelity Unbiased Skin Tone Estimation via Texture Quantization. | Zimin Ran, Xingyu Ren, Xiang An, Kaicheng Yang, Ziyong Feng, Jing Yang, Rolandos Alexandros Potamias, Linchao Zhu, Jiankang Deng |
| 2025 | ICCV | From Trial to Triumph: Advancing Long Video Understanding via Visual Context Sample Scaling and Self-Reward Alignment. | Yucheng Suo, Fan Ma, Linchao Zhu, Tianyi Wang, Fengyun Rao, Yi Yang |
| 2025 | ICCV | MC-Bench: A Benchmark for Multi-Context Visual Grounding in the Era of MLLMs. | Yunqiu Xu, Linchao Zhu, Yi Yang |
| 2025 | ICLR | Long-horizon Visual Instruction Generation with Logic and Attribute Self-reflection. | Yucheng Suo, Fan Ma, Kaixin Shen, Linchao Zhu, Yi Yang |
| 2025 | ICLR | VideoGrain: Modulating Space-Time Attention for Multi-Grained Video Editing. | Xiangpeng Yang, Linchao Zhu, Hehe Fan, Yi Yang |
| 2025 | ICML | Holistic Physics Solver: Learning PDEs in a Unified Spectral-Physical Space. | Xihang Yue, Yi Yang, Linchao Zhu |
| 2024 | AAAI | Stitching Segments and Sentences towards Generalization in Video-Text Pre-training. | Fan Ma, Xiaojie Jin, Heng Wang, Jingjia Huang, Linchao Zhu, Yi Yang |
| 2024 | AAAI | DGL: Dynamic Global-Local Prompt Tuning for Text-Video Retrieval. | Xiangpeng Yang, Linchao Zhu, Xiaohan Wang, Yi Yang |
| 2024 | ACL | VillagerAgent: A Graph-Based Multi-Agent Framework for Coordinating Complex Task Dependencies in Minecraft. | Yubo Dong, Xukun Zhu, Zhengzhe Pan, Linchao Zhu, Yi Yang |
| 2024 | ACL | FragRel: Exploiting Fragment-level Relations in the External Memory of Large Language Models. | Xihang Yue, Linchao Zhu, Yi Yang |
| 2024 | CVPR | CapHuman: Capture Your Moments in Parallel Universes. | Chao Liang, Fan Ma, Linchao Zhu, Yingying Deng, Yi Yang |
| 2024 | CVPR | Knowledge-Enhanced Dual-Stream Zero-Shot Composed Image Retrieval. | Yucheng Suo, Fan Ma, Linchao Zhu, Yi Yang |
| 2024 | ICLR | Test-Time Adaptation with CLIP Reward for Zero-Shot Generalization in Vision-Language Models. | Shuai Zhao, Xiaohan Wang, Linchao Zhu, Yi Yang |
| 2023 | ACL | Gloss-Free End-to-End Sign Language Translation. | Kezhou Lin, Xiaohan Wang, Linchao Zhu, Ke Sun, Bang Zhang, Yi Yang |
| 2023 | ACL | WhitenedCSE: Whitening-based Contrastive Learning of Sentence Embeddings. | Wenjie Zhuo, Yifan Sun, Xiaohan Wang, Linchao Zhu, Yi Yang |
| 2023 | CVPR | PointListNet: Deep Learning on 3D Point Lists. | Hehe Fan, Linchao Zhu, Yi Yang, Mohan S. Kankanhalli |
| 2023 | CVPR | MIST : Multi-modal Iterative Spatial-Temporal Transformer for Long-form Video Question Answering. | Difei Gao, Luowei Zhou, Lei Ji, Linchao Zhu, Yi Yang, Mike Zheng Shou |
| 2023 | CVPR | Efficient Multimodal Fusion via Interactive Prompting. | Yaowei Li, Ruijie Quan, Linchao Zhu, Yi Yang |
| 2023 | EMNLP | Text Augmented Spatial Aware Zero-shot Referring Image Segmentation. | Yucheng Suo, Linchao Zhu, Yi Yang |
| 2023 | ICCV | MAAL: Multimodality-Aware Autoencoder-based Affordance Learning for 3D Articulated Objects. | Yuanzhi Liang, Xiaohan Wang, Linchao Zhu, Yi Yang |
| 2023 | ICLR | DeCap: Decoding CLIP Latents for Zero-Shot Captioning via Text-Only Training. | Wei Li, Linchao Zhu, Longyin Wen, Yi Yang |
| 2022 | CVPR | Compositional Temporal Grounding with Structured Variational Cross-Graph Correspondence Learning. | Juncheng Li, Junlin Xie, Long Qian, Linchao Zhu, Siliang Tang, Fei Wu, Yi Yang, Yueting Zhuang, Xin Eric Wang |
| 2022 | CVPR | Complex Video Action Reasoning via Learnable Markov Logic Network. | Yang Jin, Linchao Zhu, Yadong Mu |
| 2022 | CVPR | SEEG: Semantic Energized Co-speech Gesture Generation. | Yuanzhi Liang, Qianyu Feng, Linchao Zhu, Li Hu, Pan Pan, Yi Yang |
| 2022 | CVPR | A Simple Episodic Linear Probe Improves Visual Recognition in the Wild. | Yuanzhi Liang, Linchao Zhu, Xiaohan Wang, Yi Yang |
| 2022 | CVPR | Unified Transformer Tracker for Object Tracking. | Fan Ma, Mike Zheng Shou, Linchao Zhu, Haoqi Fan, Yilei Xu, Yi Yang, Zhicheng Yan |
| 2022 | SIGIR | CenterCLIP: Token Clustering for Efficient Text-Video Retrieval. | Shuai Zhao, Linchao Zhu, Xiaohan Wang, Yi Yang |
| 2021 | CVPR | T2VLAD: Global-Local Sequence Alignment for Text-Video Retrieval. | Xiaohan Wang, Linchao Zhu, Yi Yang |
| 2021 | CVPR | Faster Meta Update Strategy for Noise-Robust Deep Learning. | Youjiang Xu, Linchao Zhu, Lu Jiang, Yi Yang |
| 2021 | CVPR | OpenMix: Reviving Known Knowledge for Discovering Novel Visual Categories in an Open World. | Zhun Zhong, Linchao Zhu, Zhiming Luo, Shaozi Li, Yi Yang, Nicu Sebe |
| 2021 | ICCV | Adaptive Hierarchical Graph Reasoning with Semantic Coherence for Video-and-Language Inference. | Juncheng Li, Siliang Tang, Linchao Zhu, Haochen Shi, Xuanwen Huang, Fei Wu, Yi Yang, Yueting Zhuang |
| 2021 | ICCV | A Multi-Mode Modulator for Multi-Domain Few-Shot Classification. | Yanbin Liu, Juho Lee, Linchao Zhu, Ling Chen, Humphrey Shi, Yi Yang |
| 2021 | ICCV | Interactive Prototype Learning for Egocentric Action Recognition. | Xiaohan Wang, Linchao Zhu, Heng Wang, Yi Yang |
| 2021 | ICCV | Universal-Prototype Enhancing for Few-Shot Object Detection. | Aming Wu, Yahong Han, Linchao Zhu, Yi Yang |
| 2021 | ICCV | Vector-Decomposed Disentanglement for Domain-Invariant Object Detection. | Aming Wu, Rui Liu, Yahong Han, Linchao Zhu, Yi Yang |
| 2021 | ICONIP | PoseGate-Former: Transformer Encoder with Trainable Gate for 3D Human Pose Estimation Using Weakly Supervised Learning. | Shannan Guan, Haiyan Lu, Linchao Zhu, Gengfa Fang |
| 2020 | AAAI | Symbiotic Attention with Privileged Information for Egocentric Action Recognition. | Xiaohan Wang, Yu Wu, Linchao Zhu, Yi Yang |
| 2020 | AAAI | FASTER Recurrent Networks for Efficient Video Classification. | Linchao Zhu, Du Tran, Laura Sevilla-Lara, Yi Yang, Matt Feiszli, Heng Wang |
| 2020 | CVPR | Learning Filter Pruning Criteria for Deep Convolutional Neural Networks Acceleration. | Yang He, Yuhang Ding, Ping Liu, Linchao Zhu, Hanwang Zhang, Yi Yang |
| 2020 | CVPR | Semantic Correspondence as an Optimal Transport Problem. | Yanbin Liu, Linchao Zhu, Makoto Yamada, Yi Yang |
| 2020 | CVPR | Gated Channel Transformation for Visual Recognition. | Zongxin Yang, Linchao Zhu, Yu Wu, Yi Yang |
| 2020 | CVPR | Inflated Episodic Memory With Region Self-Attention for Long-Tailed Visual Recognition. | Linchao Zhu, Yi Yang |
| 2020 | CVPR | ActBERT: Learning Global-Local Video-Text Representations. | Linchao Zhu, Yi Yang |
| 2020 | ECCV | SF-Net: Single-Frame Supervision for Temporal Action Localization. | Fan Ma, Linchao Zhu, Yi Yang, Shengxin Zha, Gourab Kundu, Matt Feiszli, Zheng Shou |
| 2020 | ECCV | Motion-Excited Sampler: Video Adversarial Attack with Sparked Prior. | Hu Zhang, Linchao Zhu, Yi Zhu, Yi Yang |
| 2020 | ECCV | Learning to Transfer Learn: Reinforcement Learning-Based Selection for Adaptive Transfer Learning. | Linchao Zhu, Sercan mer Arik, Yi Yang, Tomas Pfister |
| 2019 | AAAI | Cubic LSTMs for Video Prediction. | Hehe Fan, Linchao Zhu, Yi Yang |
| 2019 | CVPR | Sim-Real Joint Reinforcement Transfer for 3D Indoor Navigation. | Fengda Zhu, Linchao Zhu, Yi Yang |
| 2019 | ICCV | Entangled Transformer for Image Captioning. | Guang Li, Linchao Zhu, Ping Liu, Yi Yang |
| 2019 | ICCV | Auto-ReID: Searching for a Part-Aware ConvNet for Person Re-Identification. | Ruijie Quan, Xuanyi Dong, Yu Wu, Linchao Zhu, Yi Yang |
| 2019 | ICCV | Dual Attention Matching for Audio-Visual Event Localization. | Yu Wu, Linchao Zhu, Yan Yan, Yi Yang |
| 2018 | ECCV | Compound Memory Networks for Few-Shot Video Classification. | Linchao Zhu, Yi Yang |
| 2018 | IJCAI | Watching a Small Portion could be as Good as Watching All: Towards Efficient Video Classification. | Hehe Fan, Zhongwen Xu, Linchao Zhu, Chenggang Yan, Jianjun Ge, Yi Yang |
| 2017 | CVPR | Few-Shot Object Recognition from Machine-Labeled Web Images. | Zhongwen Xu, Linchao Zhu, Yi Yang |
| 2017 | CVPR | Bidirectional Multirate Reconstruction for Temporal Modeling in Videos. | Linchao Zhu, Zhongwen Xu, Yi Yang |