| 2024 | MacDiff: Unified Skeleton Modeling with Masked Conditional Diffusion. | Lehong Wu, Lilang Lin, Jiahang Zhang, Yiyang Ma, Jiaying Liu |
| 2024 | AugUndo: Scaling Up Augmentations for Monocular Depth Completion and Estimation. | Yangchao Wu, Tian Yu Liu, Hyoungseob Park, Stefano Soatto, Dong Lao, Alex Wong |
| 2024 | Uncertainty-Aware Sign Language Video Retrieval with Probability Distribution Modeling. | Xuan Wu, Hongxiang Li, Yuanjiang Luo, Xuxin Cheng, Xianwei Zhuang, Meng Cao, Keren Fu |
| 2024 | DragAnything: Motion Control for Anything Using Entity Representation. | Weijia Wu, Zhuang Li, Yuchao Gu, Rui Zhao, Yefei He, David Junhao Zhang, Mike Zheng Shou, Yan Li, Tingting Gao, Di Zhang |
| 2024 | Latent Diffusion Prior Enhanced Deep Unfolding for Snapshot Spectral Compressive Imaging. | Zongliang Wu, Ruiying Lu, Ying Fu, Xin Yuan |
| 2024 | CadVLM: Bridging Language and Vision in the Generation of Parametric CAD Sketches. | Sifan Wu, Amir Hosein Khasahmadi, Mor Katz, Pradeep Kumar Jayaraman, Yewen Pu, Karl D. D. Willis, Bang Liu |
| 2024 | TurboEdit: Instant Text-Based Image Editing. | Zongze Wu, Nicholas I. Kolkin, Jonathan Brandt, Richard Zhang, Eli Shechtman |
| 2024 | Diff-Reg: Diffusion Model in Doubly Stochastic Matrix Space for Registration Problem. | Qianliang Wu, Haobo Jiang, Lei Luo, Jun Li, Yaqing Ding, Jin Xie, Jian Yang |
| 2024 | Unsupervised Variational Translator for Bridging Image Restoration and High-Level Vision Tasks. | Jiawei Wu, Zhi Jin |
| 2024 | Co-Student: Collaborating Strong and Weak Students for Sparsely Annotated Object Detection. | Lianjun Wu, Jiangxiao Han, Zengqiang Zheng, Xinggang Wang |
| 2024 | Deep Reward Supervisions for Tuning Text-to-Image Diffusion Models. | Xiaoshi Wu, Yiming Hao, Manyuan Zhang, Keqiang Sun, Zhaoyang Huang, Guanglu Song, Yu Liu, Hongsheng Li |
| 2024 | Identity-Consistent Diffusion Network for Grading Knee Osteoarthritis Progression in Radiographic Imaging. | Wenhua Wu, Kun Hu, Wenxi Yue, Wei Li, Milena Simic, Changyang Li, Wei Xiang, Zhiyong Wang |
| 2024 | MultiGen: Zero-Shot Image Generation from Multi-modal Prompts. | Zhi-Fan Wu, Lianghua Huang, Wei Wang, Yanheng Wei, Yu Liu |
| 2024 | Scissorhands: Scrub Data Influence via Connection Sensitivity in Networks. | Jing Wu, Mehrtash Harandi |
| 2024 | Pseudo-Keypoint RKHS Learning for Self-supervised 6DoF Pose Estimation. | Yangzheng Wu, Michael A. Greenspan |
| 2024 | External Knowledge Enhanced 3D Scene Generation from Sketch. | Zijie Wu, Mingtao Feng, Yaonan Wang, He Xie, Weisheng Dong, Bo Miao, Ajmal Mian |
| 2024 | FreeDiff: Progressive Frequency Truncation for Image Editing with Diffusion Models. | Wei Wu, Qingnan Fan, Shuai Qin, Hong Gu, Ruoyu Zhao, Antoni B. Chan |
| 2024 | WeCromCL: Weakly Supervised Cross-Modality Contrastive Learning for Transcription-Only Supervised Text Spotting. | Jingjing Wu, Zhengyao Fang, Pengyuan Lyu, Chengquan Zhang, Fanglin Chen, Guangming Lu, Wenjie Pei |
| 2024 | AdaLog: Post-training Quantization for Vision Transformers with Adaptive Logarithm Quantizer. | Zhuguanyu Wu, Jiaxin Chen, Hanwen Zhong, Di Huang, Yunhong Wang |
| 2024 | Upper-Body Hierarchical Graph for Skeleton Based Emotion Recognition in Assistive Driving. | Jiehui Wu, Jiansheng Chen, Qifeng Luo, Siqi Liu, Youze Xue, Huimin Ma |
| 2024 | An Economic Framework for 6-DoF Grasp Detection. | Xiao-Ming Wu, Jia-Feng Cai, Jian-Jian Jiang, Dian Zheng, Yi-Lin Wei, Wei-Shi Zheng |
| 2024 | TPA3D: Triplane Attention for Fast Text-to-3D Generation. | Bin-Shih Wu, Hong-En Chen, Sheng-Yu Huang, Yu-Chiang Frank Wang |
| 2024 | Image-Feature Weak-to-Strong Consistency: An Enhanced Paradigm for Semi-supervised Learning. | Zhiyu Wu, Jinshi Cui |
| 2024 | GaussCtrl: Multi-view Consistent Text-Driven 3D Gaussian Splatting Editing. | Jing Wu, Jia-Wang Bian, Xinghui Li, Guangrun Wang, Ian D. Reid, Philip Torr, Victor Adrian Prisacariu |
| 2024 | FTBC: Forward Temporal Bias Correction for Optimizing ANN-SNN Conversion. | Xiaofeng Wu, Velibor Bojkovic, Bin Gu, Kun Suo, Kai Zou |