Zuxuan Wu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
80
Venues
12
Active years
2016–2026
Best venue rank
A*
Where they publish
Papers
80 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Human2Robot: Learning Robot Actions from Paired Human-Robot Videos. | Sicheng Xie, Haidong Cao, Zejia Weng, Zhen Xing, Haoran Chen, Shiwei Shen, Jiaqi Leng, Zuxuan Wu, Yu-Gang Jiang |
| 2026 | AAAI | DriveSuprim: Towards Precise Trajectory Selection for End-to-End Planning. | Wenhao Yao, Zhenxin Li, Shiyi Lan, Zi Wang, Xinglong Sun, Jos M. lvarez, Zuxuan Wu |
| 2025 | AAAI | Comprehensive Multi-Modal Prototypes Are Simple and Effective Classifiers for Vast-Vocabulary Object Detection. | Yitong Chen, Wenhao Yao, Lingchen Meng, Sihong Wu, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | AAAI | FNIN: A Fourier Neural Operator-based Numerical Integration Network for Surface-from-gradients. | Jiaqi Leng, Yakun Ju, Yuanxu Duan, Jiangnan Zhang, Qingxuan Lv, Zuxuan Wu, Hao Fan |
| 2025 | AAAI | FOCUS: Towards Universal Foreground Segmentation. | Zuyao You, Lingyu Kong, Lingchen Meng, Zuxuan Wu |
| 2025 | AAAI | AdaDiff: Adaptive Step Selection for Fast Diffusion Models. | Hui Zhang, Zuxuan Wu, Zhen Xing, Jie Shao, Yu-Gang Jiang |
| 2025 | ACL | AgentGym: Evaluating and Training Large Language Model-based Agents across Diverse Environments. | Zhiheng Xi, Yiwen Ding, Wenxiang Chen, Boyang Hong, Honglin Guo, Junzhe Wang, Xin Guo, Dingwen Yang, Chenyang Liao, Wei He, Songyang Gao, Lu Chen, Rui Zheng, Yicheng Zou, Tao Gui, Qi Zhang, Xipeng Qiu, Xuanjing Huang, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | CVPR | StableAnimator: High-Quality Identity-Preserving Human Image Animation. | Shuyuan Tu, Zhen Xing, Xintong Han, Zhi-Qi Cheng, Qi Dai, Chong Luo, Zuxuan Wu |
| 2025 | CVPR | EDEN: Enhanced Diffusion for High-quality Large-motion Video Frame Interpolation. | Zihao Zhang, Haoran Chen, Haoyu Zhao, Guansong Lu, Yanwei Fu, Hang Xu, Zuxuan Wu |
| 2025 | CVPR | BlockDance: Reuse Structurally Similar Spatio-Temporal Features to Accelerate Diffusion Transformers. | Hui Zhang, Tingwei Gao, Jie Shao, Zuxuan Wu |
| 2025 | EMNLP | ProLongVid: A Simple but Strong Baseline for Long-context Video Instruction Tuning. | Rui Wang, Bohao Li, Xiyang Dai, Jianwei Yang, Yi-Ling Chen, Zhen Xing, Yifan Yang, Dongdong Chen, Xipeng Qiu, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | ICASSP | Advancing Dark Action Recognition via Modality Fusion and Dark-to-Light Diffusion Model. | Yuxuan Wang, Zhen Xing, Zuxuan Wu |
| 2025 | ICCV | Achieving More with Less: Additive Prompt Tuning for Rehearsal-Free Class-Incremental Learning. | Haoran Chen, Ping Wang, Zihan Zhou, Xu Zhang, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | ICCV | Hydra-NeXt: Robust Closed-Loop Driving with Open-Loop Training. | Zhenxin Li, Shihao Wang, Shiyi Lan, Zhiding Yu, Zuxuan Wu, Jos M. lvarez |
| 2025 | ICCV | MagicMotion: Controllable Video Generation with Dense-to-Sparse Trajectory Guidance. | Quanhao Li, Zhen Xing, Rui Wang, Hui Zhang, Qi Dai, Zuxuan Wu |
| 2025 | ICCV | REDUCIO! Generating 1K Video Within 16 Seconds Using Extremely Compressed Motion Latents. | Rui Tian, Qi Dai, Jianmin Bao, Kai Qiu, Yifan Yang, Chong Luo, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | ICCV | MotionFollower: Editing Video Motion via Score-Guided Diffusion. | Shuyuan Tu, Qi Dai, Zihao Zhang, Sicheng Xie, Zhi-Qi Cheng, Chong Luo, Xintong Han, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | ICCV | Aid: Adapting Image2video Diffusion Models for Instruction-Guided Video Prediction. | Zhen Xing, Qi Dai, Zejia Weng, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | ICCV | CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation. | Hui Zhang, Dexiang Hong, Yitong Wang, Jie Shao, Xinglong Wu, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | ICCV | VLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks. | Shiduo Zhang, Zhe Xu, Peiju Liu, Xiaopeng Yu, Yuan Li, Qinghui Gao, Zhaoye Fei, Zhangyue Yin, Zuxuan Wu, Yu-Gang Jiang, Xipeng Qiu |
| 2025 | ICCV | Rethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis. | Peng Zheng, Junke Wang, Yi Chang, Yizhou Yu, Rui Ma, Zuxuan Wu |
| 2025 | ICLR | Adaptive Retention & Correction: Test-Time Training for Continual Learning. | Haoran Chen, Micah Goldblum, Zuxuan Wu, Yu-Gang Jiang |
| 2024 | CVPR | BEVNeXt: Reviving Dense BEV Frameworks for 3D Object Detection. | Zhenxin Li, Shiyi Lan, Jos M. lvarez, Zuxuan Wu |
| 2024 | CVPR | Learning to Rank Patches for Unbiased Image Redundancy Reduction. | Yang Luo, Zhineng Chen, Peng Zhou, Zuxuan Wu, Xieping Gao, Yu-Gang Jiang |
| 2024 | CVPR | Synthesize, Diagnose, and Optimize: Towards Fine-Grained Vision-Language Understanding. | Wujian Peng, Sicheng Xie, Zuyao You, Shiyi Lan, Zuxuan Wu |
| 2024 | CVPR | MotionEditor: Editing Video Motion via Content-Aware Diffusion. | Shuyuan Tu, Qi Dai, Zhi-Qi Cheng, Han Hu, Xintong Han, Zuxuan Wu, Yu-Gang Jiang |
| 2024 | CVPR | OmniViD: A Generative Framework for Universal Video Understanding. | Junke Wang, Dongdong Chen, Chong Luo, Bo He, Lu Yuan, Zuxuan Wu, Yu-Gang Jiang |
| 2024 | CVPR | SimDA: Simple Diffusion Adapter for Efficient Video Generation. | Zhen Xing, Qi Dai, Han Hu, Zuxuan Wu, Yu-Gang Jiang |
| 2024 | ECCV | PromptFusion: Decoupling Stability and Plasticity for Continual Learning. | Haoran Chen, Zuxuan Wu, Xintong Han, Menglin Jia, Yu-Gang Jiang |
| 2024 | ECCV | SegIC: Unleashing the Emergent Correspondence for In-Context Segmentation. | Lingchen Meng, Shiyi Lan, Hengduo Li, Jos M. lvarez, Zuxuan Wu, Yu-Gang Jiang |
| 2024 | ECCV | DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation. | Haibo Yang, Yang Chen, Yingwei Pan, Ting Yao, Zhineng Chen, Zuxuan Wu, Yu-Gang Jiang, Tao Mei |
| 2024 | ECCV | MagDiff: Multi-alignment Diffusion for High-Fidelity Video Generation and Editing. | Haoyu Zhao, Tianyi Lu, Jiaxi Gu, Xing Zhang, Qingping Zheng, Zuxuan Wu, Hang Xu, Yu-Gang Jiang |
| 2024 | IJCAI | Zero-shot High-fidelity and Pose-controllable Character Animation. | Bingwen Zhu, Fanyi Wang, Tianyi Lu, Peng Liu, Jingwen Su, Jinxiu Liu, Yanhao Zhang, Zuxuan Wu, Guo-Jun Qi, Yu-Gang Jiang |
| 2023 | AAAI | Resolving Task Confusion in Dynamic Expansion Architectures for Class Incremental Learning. | Bingchen Huang, Zhineng Chen, Peng Zhou, Jiayin Chen, Zuxuan Wu |
| 2023 | CVPR | Towards Scalable Neural Representation for Diverse Videos. | Bo He, Xitong Yang, Hanyu Wang, Zuxuan Wu, Hao Chen, Shuaiyi Huang, Yixuan Ren, Ser-Nam Lim, Abhinav Shrivastava |
| 2023 | CVPR | Prototypical Residual Networks for Anomaly Detection and Localization. | Hui Zhang, Zuxuan Wu, Zheng Wang, Zhineng Chen, Yu-Gang Jiang |
| 2023 | CVPR | Vision Transformers are Good Mask Auto-Labelers. | Shiyi Lan, Xitong Yang, Zhiding Yu, Zuxuan Wu, Jos M. lvarez, Anima Anandkumar |
| 2023 | CVPR | Detection Hub: Unifying Object Detection Datasets via Query Adaptation on Language Embedding. | Lingchen Meng, Xiyang Dai, Yinpeng Chen, Pengchuan Zhang, Dongdong Chen, Mengchen Liu, Jianfeng Wang, Zuxuan Wu, Lu Yuan, Yu-Gang Jiang |
| 2023 | CVPR | ResFormer: Scaling ViTs with Multi-Resolution Training. | Rui Tian, Zuxuan Wu, Qi Dai, Han Hu, Yu Qiao, Yu-Gang Jiang |
| 2023 | CVPR | Masked Video Distillation: Rethinking Masked Feature Modeling for Self-supervised Video Representation Learning. | Rui Wang, Dongdong Chen, Zuxuan Wu, Yinpeng Chen, Xiyang Dai, Mengchen Liu, Lu Yuan, Yu-Gang Jiang |
| 2023 | CVPR | Look Before You Match: Instance Understanding Matters in Video Object Segmentation. | Junke Wang, Dongdong Chen, Zuxuan Wu, Chong Luo, Chuanxin Tang, Xiyang Dai, Yucheng Zhao, Yujia Xie, Lu Yuan, Yu-Gang Jiang |
| 2023 | CVPR | Enhancing the Self-Universality for Transferable Targeted Attacks. | Zhipeng Wei, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang |
| 2023 | CVPR | SVFormer: Semi-supervised Video Transformer for Action Recognition. | Zhen Xing, Qi Dai, Han Hu, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang |
| 2023 | ICCV | Implicit Temporal Modeling with Learnable Alignment for Video Recognition. | Shuyuan Tu, Qi Dai, Zuxuan Wu, Zhi-Qi Cheng, Han Hu, Yu-Gang Jiang |
| 2023 | ICML | Open-VCLIP: Transforming CLIP to an Open-vocabulary Video Model via Interpolated Weight Optimization. | Zejia Weng, Xitong Yang, Ang Li, Zuxuan Wu, Yu-Gang Jiang |
| 2022 | AAAI | Attacking Video Recognition Models with Bullet-Screen Comments. | Kai Chen, Zhipeng Wei, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang |
| 2022 | AAAI | Rethinking Pseudo Labels for Semi-supervised Object Detection. | Hengduo Li, Zuxuan Wu, Abhinav Shrivastava, Larry S. Davis |
| 2022 | AAAI | Towards Transferable Adversarial Attacks on Vision Transformers. | Zhipeng Wei, Jingjing Chen, Micah Goldblum, Zuxuan Wu, Tom Goldstein, Yu-Gang Jiang |
| 2022 | AAAI | Boosting the Transferability of Video Adversarial Examples via Temporal Translation. | Zhipeng Wei, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang |
| 2022 | CVPR | Robust Optimization as Data Augmentation for Large-scale Graphs. | Kezhi Kong, Guohao Li, Mucong Ding, Zuxuan Wu, Chen Zhu, Bernard Ghanem, Gavin Taylor, Tom Goldstein |
| 2022 | CVPR | AdaViT: Adaptive Vision Transformers for Efficient Image Recognition. | Lingchen Meng, Hengduo Li, Bor-Chun Chen, Shiyi Lan, Zuxuan Wu, Yu-Gang Jiang, Ser-Nam Lim |
| 2022 | CVPR | BEVT: BERT Pretraining of Video Transformers. | Rui Wang, Dongdong Chen, Zuxuan Wu, Yinpeng Chen, Xiyang Dai, Mengchen Liu, Yu-Gang Jiang, Luowei Zhou, Lu Yuan |
| 2022 | CVPR | ObjectFormer for Image Manipulation Detection and Localization. | Junke Wang, Zuxuan Wu, Jingjing Chen, Xintong Han, Abhinav Shrivastava, Ser-Nam Lim, Yu-Gang Jiang |
| 2022 | CVPR | Cross-Modal Transferable Adversarial Attacks from Images to Videos. | Zhipeng Wei, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang |
| 2022 | ECCV | Efficient Video Transformers with Spatial-Temporal Token Selection. | Junke Wang, Xitong Yang, Hengduo Li, Li Liu, Zuxuan Wu, Yu-Gang Jiang |
| 2022 | ECCV | Semi-supervised Vision Transformers. | Zejia Weng, Xitong Yang, Ang Li, Zuxuan Wu, Yu-Gang Jiang |
| 2022 | ECCV | Semi-supervised Single-View 3D Reconstruction via Prototype Shape Priors. | Zhen Xing, Hengduo Li, Zuxuan Wu, Yu-Gang Jiang |
| 2022 | WACV | M3DETR: Multi-representation, Multi-scale, Mutual-relation 3D Object Detection with Transformers. | Tianrui Guan, Jun Wang, Shiyi Lan, Rohan Chandra, Zuxuan Wu, Larry Davis, Dinesh Manocha |
| 2021 | BMVC | Deep Video Inpainting Detection. | Peng Zhou, Ning Yu, Zuxuan Wu, Larry Davis, Abhinav Shrivastava, Ser-Nam Lim |
| 2021 | BMVC | GTA: Global Temporal Attention for Video Action Understanding. | Bo He, Xitong Yang, Zuxuan Wu, Hao Chen, Ser-Nam Lim, Abhinav Shrivastava |
| 2021 | CVPR | Efficient Object Embedding for Spliced Image Retrieval. | Bor-Chun Chen, Zuxuan Wu, Larry S. Davis, Ser-Nam Lim |
| 2021 | CVPR | Intentonomy: A Dataset and Study Towards Human Intent Understanding. | Menglin Jia, Zuxuan Wu, Austin Reiter, Claire Cardie, Serge J. Belongie, Ser-Nam Lim |
| 2021 | CVPR | 2D or not 2D? Adaptive 3D Convolution Selection for Efficient Video Recognition. | Hengduo Li, Zuxuan Wu, Abhinav Shrivastava, Larry S. Davis |
| 2021 | ICCV | Exploring Visual Engagement Signals for Representation Learning. | Menglin Jia, Zuxuan Wu, Austin Reiter, Claire Cardie, Serge J. Belongie, Ser-Nam Lim |
| 2021 | ICCV | VideoLT: Large-scale Long-tailed Video Recognition. | Xing Zhang, Zuxuan Wu, Zejia Weng, Huazhu Fu, Jingjing Chen, Yu-Gang Jiang, Larry Davis |
| 2020 | AAAI | Recognizing Instagram Filtered Images with Feature De-Stylization. | Zhe Wu, Zuxuan Wu, Bharat Singh, Larry S. Davis |
| 2020 | BMVC | M2KD: Incremental Learning via Multi-model and Multi-level Knowledge Distillation. | Peng Zhou, Long Mai, Jianming Zhang, Ning Xu, Zuxuan Wu, Larry Davis |
| 2020 | CVPR | Learning From Noisy Anchors for One-Stage Object Detection. | Hengduo Li, Zuxuan Wu, Chen Zhu, Caiming Xiong, Richard Socher, Larry S. Davis |
| 2020 | ECCV | Making an Invisibility Cloak: Real World Adversarial Attacks on Object Detectors. | Zuxuan Wu, Ser-Nam Lim, Larry S. Davis, Tom Goldstein |
| 2019 | CVPR | The Regretful Agent: Heuristic-Aided Navigation Through Progress Estimation. | Chih-Yao Ma, Zuxuan Wu, Ghassan AlRegib, Caiming Xiong, Zsolt Kira |
| 2019 | CVPR | AdaFrame: Adaptive Frame Selection for Fast Video Recognition. | Zuxuan Wu, Caiming Xiong, Chih-Yao Ma, Richard Socher, Larry S. Davis |
| 2019 | ICCV | FiNet: Compatible and Diverse Fashion Image Inpainting. | Xintong Han, Zuxuan Wu, Weilin Huang, Matthew R. Scott, Larry Davis |
| 2019 | ICCV | ACE: Adapting to Changing Environments for Semantic Segmentation. | Zuxuan Wu, Xin Wang, Joseph Gonzalez, Tom Goldstein, Larry Davis |
| 2019 | ICLR | Self-Monitoring Navigation Agent via Auxiliary Progress Estimation. | Chih-Yao Ma, Jiasen Lu, Zuxuan Wu, Ghassan AlRegib, Zsolt Kira, Richard Socher, Caiming Xiong |
| 2019 | WACV | Weakly-Supervised Spatial Context Networks. | Zuxuan Wu, Larry Davis, Leonid Sigal |
| 2018 | CVPR | VITON: An Image-Based Virtual Try-On Network. | Xintong Han, Zuxuan Wu, Zhe Wu, Ruichi Yu, Larry S. Davis |
| 2018 | CVPR | BlockDrop: Dynamic Inference Paths in Residual Networks. | Zuxuan Wu, Tushar Nagarajan, Abhishek Kumar, Steven Rennie, Larry S. Davis, Kristen Grauman, Rogrio Schmidt Feris |
| 2018 | ECCV | DCAN: Dual Channel-Wise Alignment Networks for Unsupervised Scene Adaptation. | Zuxuan Wu, Xintong Han, Yen-Liang Lin, Mustafa Gkhan Uzunbas, Tom Goldstein, Ser-Nam Lim, Larry S. Davis |
| 2017 | ICCV | Automatic Spatially-Aware Fashion Concept Discovery. | Xintong Han, Zuxuan Wu, Phoenix X. Huang, Xiao Zhang, Menglong Zhu, Yuan Li, Yang Zhao, Larry S. Davis |
| 2016 | CVPR | Harnessing Object and Scene Semantics for Large-Scale Video Understanding. | Zuxuan Wu, Yanwei Fu, Yu-Gang Jiang, Leonid Sigal |