Skip to content

Zuxuan Wu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

80

Venues

12

Active years

2016–2026

Best venue rank

A*

Where they publish

Papers

80 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIHuman2Robot: Learning Robot Actions from Paired Human-Robot Videos.Sicheng Xie, Haidong Cao, Zejia Weng, Zhen Xing, Haoran Chen, Shiwei Shen, Jiaqi Leng, Zuxuan Wu, Yu-Gang Jiang
2026AAAIDriveSuprim: Towards Precise Trajectory Selection for End-to-End Planning.Wenhao Yao, Zhenxin Li, Shiyi Lan, Zi Wang, Xinglong Sun, Jos M. lvarez, Zuxuan Wu
2025AAAIComprehensive Multi-Modal Prototypes Are Simple and Effective Classifiers for Vast-Vocabulary Object Detection.Yitong Chen, Wenhao Yao, Lingchen Meng, Sihong Wu, Zuxuan Wu, Yu-Gang Jiang
2025AAAIFNIN: A Fourier Neural Operator-based Numerical Integration Network for Surface-from-gradients.Jiaqi Leng, Yakun Ju, Yuanxu Duan, Jiangnan Zhang, Qingxuan Lv, Zuxuan Wu, Hao Fan
2025AAAIFOCUS: Towards Universal Foreground Segmentation.Zuyao You, Lingyu Kong, Lingchen Meng, Zuxuan Wu
2025AAAIAdaDiff: Adaptive Step Selection for Fast Diffusion Models.Hui Zhang, Zuxuan Wu, Zhen Xing, Jie Shao, Yu-Gang Jiang
2025ACLAgentGym: Evaluating and Training Large Language Model-based Agents across Diverse Environments.Zhiheng Xi, Yiwen Ding, Wenxiang Chen, Boyang Hong, Honglin Guo, Junzhe Wang, Xin Guo, Dingwen Yang, Chenyang Liao, Wei He, Songyang Gao, Lu Chen, Rui Zheng, Yicheng Zou, Tao Gui, Qi Zhang, Xipeng Qiu, Xuanjing Huang, Zuxuan Wu, Yu-Gang Jiang
2025CVPRStableAnimator: High-Quality Identity-Preserving Human Image Animation.Shuyuan Tu, Zhen Xing, Xintong Han, Zhi-Qi Cheng, Qi Dai, Chong Luo, Zuxuan Wu
2025CVPREDEN: Enhanced Diffusion for High-quality Large-motion Video Frame Interpolation.Zihao Zhang, Haoran Chen, Haoyu Zhao, Guansong Lu, Yanwei Fu, Hang Xu, Zuxuan Wu
2025CVPRBlockDance: Reuse Structurally Similar Spatio-Temporal Features to Accelerate Diffusion Transformers.Hui Zhang, Tingwei Gao, Jie Shao, Zuxuan Wu
2025EMNLPProLongVid: A Simple but Strong Baseline for Long-context Video Instruction Tuning.Rui Wang, Bohao Li, Xiyang Dai, Jianwei Yang, Yi-Ling Chen, Zhen Xing, Yifan Yang, Dongdong Chen, Xipeng Qiu, Zuxuan Wu, Yu-Gang Jiang
2025ICASSPAdvancing Dark Action Recognition via Modality Fusion and Dark-to-Light Diffusion Model.Yuxuan Wang, Zhen Xing, Zuxuan Wu
2025ICCVAchieving More with Less: Additive Prompt Tuning for Rehearsal-Free Class-Incremental Learning.Haoran Chen, Ping Wang, Zihan Zhou, Xu Zhang, Zuxuan Wu, Yu-Gang Jiang
2025ICCVHydra-NeXt: Robust Closed-Loop Driving with Open-Loop Training.Zhenxin Li, Shihao Wang, Shiyi Lan, Zhiding Yu, Zuxuan Wu, Jos M. lvarez
2025ICCVMagicMotion: Controllable Video Generation with Dense-to-Sparse Trajectory Guidance.Quanhao Li, Zhen Xing, Rui Wang, Hui Zhang, Qi Dai, Zuxuan Wu
2025ICCVREDUCIO! Generating 1K Video Within 16 Seconds Using Extremely Compressed Motion Latents.Rui Tian, Qi Dai, Jianmin Bao, Kai Qiu, Yifan Yang, Chong Luo, Zuxuan Wu, Yu-Gang Jiang
2025ICCVMotionFollower: Editing Video Motion via Score-Guided Diffusion.Shuyuan Tu, Qi Dai, Zihao Zhang, Sicheng Xie, Zhi-Qi Cheng, Chong Luo, Xintong Han, Zuxuan Wu, Yu-Gang Jiang
2025ICCVAid: Adapting Image2video Diffusion Models for Instruction-Guided Video Prediction.Zhen Xing, Qi Dai, Zejia Weng, Zuxuan Wu, Yu-Gang Jiang
2025ICCVCreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation.Hui Zhang, Dexiang Hong, Yitong Wang, Jie Shao, Xinglong Wu, Zuxuan Wu, Yu-Gang Jiang
2025ICCVVLABench: A Large-Scale Benchmark for Language-Conditioned Robotics Manipulation with Long-Horizon Reasoning Tasks.Shiduo Zhang, Zhe Xu, Peiju Liu, Xiaopeng Yu, Yuan Li, Qinghui Gao, Zhaoye Fei, Zhangyue Yin, Zuxuan Wu, Yu-Gang Jiang, Xipeng Qiu
2025ICCVRethinking Discrete Tokens: Treating Them as Conditions for Continuous Autoregressive Image Synthesis.Peng Zheng, Junke Wang, Yi Chang, Yizhou Yu, Rui Ma, Zuxuan Wu
2025ICLRAdaptive Retention & Correction: Test-Time Training for Continual Learning.Haoran Chen, Micah Goldblum, Zuxuan Wu, Yu-Gang Jiang
2024CVPRBEVNeXt: Reviving Dense BEV Frameworks for 3D Object Detection.Zhenxin Li, Shiyi Lan, Jos M. lvarez, Zuxuan Wu
2024CVPRLearning to Rank Patches for Unbiased Image Redundancy Reduction.Yang Luo, Zhineng Chen, Peng Zhou, Zuxuan Wu, Xieping Gao, Yu-Gang Jiang
2024CVPRSynthesize, Diagnose, and Optimize: Towards Fine-Grained Vision-Language Understanding.Wujian Peng, Sicheng Xie, Zuyao You, Shiyi Lan, Zuxuan Wu
2024CVPRMotionEditor: Editing Video Motion via Content-Aware Diffusion.Shuyuan Tu, Qi Dai, Zhi-Qi Cheng, Han Hu, Xintong Han, Zuxuan Wu, Yu-Gang Jiang
2024CVPROmniViD: A Generative Framework for Universal Video Understanding.Junke Wang, Dongdong Chen, Chong Luo, Bo He, Lu Yuan, Zuxuan Wu, Yu-Gang Jiang
2024CVPRSimDA: Simple Diffusion Adapter for Efficient Video Generation.Zhen Xing, Qi Dai, Han Hu, Zuxuan Wu, Yu-Gang Jiang
2024ECCVPromptFusion: Decoupling Stability and Plasticity for Continual Learning.Haoran Chen, Zuxuan Wu, Xintong Han, Menglin Jia, Yu-Gang Jiang
2024ECCVSegIC: Unleashing the Emergent Correspondence for In-Context Segmentation.Lingchen Meng, Shiyi Lan, Hengduo Li, Jos M. lvarez, Zuxuan Wu, Yu-Gang Jiang
2024ECCVDreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation.Haibo Yang, Yang Chen, Yingwei Pan, Ting Yao, Zhineng Chen, Zuxuan Wu, Yu-Gang Jiang, Tao Mei
2024ECCVMagDiff: Multi-alignment Diffusion for High-Fidelity Video Generation and Editing.Haoyu Zhao, Tianyi Lu, Jiaxi Gu, Xing Zhang, Qingping Zheng, Zuxuan Wu, Hang Xu, Yu-Gang Jiang
2024IJCAIZero-shot High-fidelity and Pose-controllable Character Animation.Bingwen Zhu, Fanyi Wang, Tianyi Lu, Peng Liu, Jingwen Su, Jinxiu Liu, Yanhao Zhang, Zuxuan Wu, Guo-Jun Qi, Yu-Gang Jiang
2023AAAIResolving Task Confusion in Dynamic Expansion Architectures for Class Incremental Learning.Bingchen Huang, Zhineng Chen, Peng Zhou, Jiayin Chen, Zuxuan Wu
2023CVPRTowards Scalable Neural Representation for Diverse Videos.Bo He, Xitong Yang, Hanyu Wang, Zuxuan Wu, Hao Chen, Shuaiyi Huang, Yixuan Ren, Ser-Nam Lim, Abhinav Shrivastava
2023CVPRPrototypical Residual Networks for Anomaly Detection and Localization.Hui Zhang, Zuxuan Wu, Zheng Wang, Zhineng Chen, Yu-Gang Jiang
2023CVPRVision Transformers are Good Mask Auto-Labelers.Shiyi Lan, Xitong Yang, Zhiding Yu, Zuxuan Wu, Jos M. lvarez, Anima Anandkumar
2023CVPRDetection Hub: Unifying Object Detection Datasets via Query Adaptation on Language Embedding.Lingchen Meng, Xiyang Dai, Yinpeng Chen, Pengchuan Zhang, Dongdong Chen, Mengchen Liu, Jianfeng Wang, Zuxuan Wu, Lu Yuan, Yu-Gang Jiang
2023CVPRResFormer: Scaling ViTs with Multi-Resolution Training.Rui Tian, Zuxuan Wu, Qi Dai, Han Hu, Yu Qiao, Yu-Gang Jiang
2023CVPRMasked Video Distillation: Rethinking Masked Feature Modeling for Self-supervised Video Representation Learning.Rui Wang, Dongdong Chen, Zuxuan Wu, Yinpeng Chen, Xiyang Dai, Mengchen Liu, Lu Yuan, Yu-Gang Jiang
2023CVPRLook Before You Match: Instance Understanding Matters in Video Object Segmentation.Junke Wang, Dongdong Chen, Zuxuan Wu, Chong Luo, Chuanxin Tang, Xiyang Dai, Yucheng Zhao, Yujia Xie, Lu Yuan, Yu-Gang Jiang
2023CVPREnhancing the Self-Universality for Transferable Targeted Attacks.Zhipeng Wei, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang
2023CVPRSVFormer: Semi-supervised Video Transformer for Action Recognition.Zhen Xing, Qi Dai, Han Hu, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang
2023ICCVImplicit Temporal Modeling with Learnable Alignment for Video Recognition.Shuyuan Tu, Qi Dai, Zuxuan Wu, Zhi-Qi Cheng, Han Hu, Yu-Gang Jiang
2023ICMLOpen-VCLIP: Transforming CLIP to an Open-vocabulary Video Model via Interpolated Weight Optimization.Zejia Weng, Xitong Yang, Ang Li, Zuxuan Wu, Yu-Gang Jiang
2022AAAIAttacking Video Recognition Models with Bullet-Screen Comments.Kai Chen, Zhipeng Wei, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang
2022AAAIRethinking Pseudo Labels for Semi-supervised Object Detection.Hengduo Li, Zuxuan Wu, Abhinav Shrivastava, Larry S. Davis
2022AAAITowards Transferable Adversarial Attacks on Vision Transformers.Zhipeng Wei, Jingjing Chen, Micah Goldblum, Zuxuan Wu, Tom Goldstein, Yu-Gang Jiang
2022AAAIBoosting the Transferability of Video Adversarial Examples via Temporal Translation.Zhipeng Wei, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang
2022CVPRRobust Optimization as Data Augmentation for Large-scale Graphs.Kezhi Kong, Guohao Li, Mucong Ding, Zuxuan Wu, Chen Zhu, Bernard Ghanem, Gavin Taylor, Tom Goldstein
2022CVPRAdaViT: Adaptive Vision Transformers for Efficient Image Recognition.Lingchen Meng, Hengduo Li, Bor-Chun Chen, Shiyi Lan, Zuxuan Wu, Yu-Gang Jiang, Ser-Nam Lim
2022CVPRBEVT: BERT Pretraining of Video Transformers.Rui Wang, Dongdong Chen, Zuxuan Wu, Yinpeng Chen, Xiyang Dai, Mengchen Liu, Yu-Gang Jiang, Luowei Zhou, Lu Yuan
2022CVPRObjectFormer for Image Manipulation Detection and Localization.Junke Wang, Zuxuan Wu, Jingjing Chen, Xintong Han, Abhinav Shrivastava, Ser-Nam Lim, Yu-Gang Jiang
2022CVPRCross-Modal Transferable Adversarial Attacks from Images to Videos.Zhipeng Wei, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang
2022ECCVEfficient Video Transformers with Spatial-Temporal Token Selection.Junke Wang, Xitong Yang, Hengduo Li, Li Liu, Zuxuan Wu, Yu-Gang Jiang
2022ECCVSemi-supervised Vision Transformers.Zejia Weng, Xitong Yang, Ang Li, Zuxuan Wu, Yu-Gang Jiang
2022ECCVSemi-supervised Single-View 3D Reconstruction via Prototype Shape Priors.Zhen Xing, Hengduo Li, Zuxuan Wu, Yu-Gang Jiang
2022WACVM3DETR: Multi-representation, Multi-scale, Mutual-relation 3D Object Detection with Transformers.Tianrui Guan, Jun Wang, Shiyi Lan, Rohan Chandra, Zuxuan Wu, Larry Davis, Dinesh Manocha
2021BMVCDeep Video Inpainting Detection.Peng Zhou, Ning Yu, Zuxuan Wu, Larry Davis, Abhinav Shrivastava, Ser-Nam Lim
2021BMVCGTA: Global Temporal Attention for Video Action Understanding.Bo He, Xitong Yang, Zuxuan Wu, Hao Chen, Ser-Nam Lim, Abhinav Shrivastava
2021CVPREfficient Object Embedding for Spliced Image Retrieval.Bor-Chun Chen, Zuxuan Wu, Larry S. Davis, Ser-Nam Lim
2021CVPRIntentonomy: A Dataset and Study Towards Human Intent Understanding.Menglin Jia, Zuxuan Wu, Austin Reiter, Claire Cardie, Serge J. Belongie, Ser-Nam Lim
2021CVPR2D or not 2D? Adaptive 3D Convolution Selection for Efficient Video Recognition.Hengduo Li, Zuxuan Wu, Abhinav Shrivastava, Larry S. Davis
2021ICCVExploring Visual Engagement Signals for Representation Learning.Menglin Jia, Zuxuan Wu, Austin Reiter, Claire Cardie, Serge J. Belongie, Ser-Nam Lim
2021ICCVVideoLT: Large-scale Long-tailed Video Recognition.Xing Zhang, Zuxuan Wu, Zejia Weng, Huazhu Fu, Jingjing Chen, Yu-Gang Jiang, Larry Davis
2020AAAIRecognizing Instagram Filtered Images with Feature De-Stylization.Zhe Wu, Zuxuan Wu, Bharat Singh, Larry S. Davis
2020BMVCM2KD: Incremental Learning via Multi-model and Multi-level Knowledge Distillation.Peng Zhou, Long Mai, Jianming Zhang, Ning Xu, Zuxuan Wu, Larry Davis
2020CVPRLearning From Noisy Anchors for One-Stage Object Detection.Hengduo Li, Zuxuan Wu, Chen Zhu, Caiming Xiong, Richard Socher, Larry S. Davis
2020ECCVMaking an Invisibility Cloak: Real World Adversarial Attacks on Object Detectors.Zuxuan Wu, Ser-Nam Lim, Larry S. Davis, Tom Goldstein
2019CVPRThe Regretful Agent: Heuristic-Aided Navigation Through Progress Estimation.Chih-Yao Ma, Zuxuan Wu, Ghassan AlRegib, Caiming Xiong, Zsolt Kira
2019CVPRAdaFrame: Adaptive Frame Selection for Fast Video Recognition.Zuxuan Wu, Caiming Xiong, Chih-Yao Ma, Richard Socher, Larry S. Davis
2019ICCVFiNet: Compatible and Diverse Fashion Image Inpainting.Xintong Han, Zuxuan Wu, Weilin Huang, Matthew R. Scott, Larry Davis
2019ICCVACE: Adapting to Changing Environments for Semantic Segmentation.Zuxuan Wu, Xin Wang, Joseph Gonzalez, Tom Goldstein, Larry Davis
2019ICLRSelf-Monitoring Navigation Agent via Auxiliary Progress Estimation.Chih-Yao Ma, Jiasen Lu, Zuxuan Wu, Ghassan AlRegib, Zsolt Kira, Richard Socher, Caiming Xiong
2019WACVWeakly-Supervised Spatial Context Networks.Zuxuan Wu, Larry Davis, Leonid Sigal
2018CVPRVITON: An Image-Based Virtual Try-On Network.Xintong Han, Zuxuan Wu, Zhe Wu, Ruichi Yu, Larry S. Davis
2018CVPRBlockDrop: Dynamic Inference Paths in Residual Networks.Zuxuan Wu, Tushar Nagarajan, Abhishek Kumar, Steven Rennie, Larry S. Davis, Kristen Grauman, Rogrio Schmidt Feris
2018ECCVDCAN: Dual Channel-Wise Alignment Networks for Unsupervised Scene Adaptation.Zuxuan Wu, Xintong Han, Yen-Liang Lin, Mustafa Gkhan Uzunbas, Tom Goldstein, Ser-Nam Lim, Larry S. Davis
2017ICCVAutomatic Spatially-Aware Fashion Concept Discovery.Xintong Han, Zuxuan Wu, Phoenix X. Huang, Xiao Zhang, Menglong Zhu, Yuan Li, Yang Zhao, Larry S. Davis
2016CVPRHarnessing Object and Scene Semantics for Large-Scale Video Understanding.Zuxuan Wu, Yanwei Fu, Yu-Gang Jiang, Leonid Sigal