| 2025 | Stochastic Gradient Estimation for Higher-Order Differentiable Rendering. | Zican Wang, Michael Fischer, Tobias Ritschel |
| 2025 | On the Distributed Evaluation of Generative Models. | Zixiao Wang, Farzan Farnia, Zhenghao Lin, Yunheng Shen, Bei Yu |
| 2025 | From Abyssal Darkness to Blinding Glare: a Benchmark on Extreme Exposure Correction in Real World. | Bo Wang, Huiyuan Fu, Zhiye Huang, Siru Zhang, Xin Wang, Huadong Ma |
| 2025 | RealTalk: Realistic Emotion-Aware Lifelike Talking-Head Synthesis. | Wenqing Wang, Yun Fu |
| 2025 | Class Token as Proxy: Optimal Transport-Assisted Proxy Learning for Weakly Supervised Semantic Segmentation. | Jian Wang, Tianhong Dai, Bingfeng Zhang, Siyue Yu, Eng Gee Lim, Jimin Xiao |
| 2025 | LMM4LMM: Benchmarking and Evaluating Large-Multimodal Image Generation With LMMs. | Jiarui Wang, Huiyu Duan, Yu Zhao, Juntong Wang, Guangtao Zhai, Xiongkuo Min |
| 2025 | Asynchronous Event Error-Minimizing Noise for Safeguarding Event Dataset. | Ruofei Wang, Peiqi Duan, Boxin Shi, Renjie Wan |
| 2025 | CharaConsist: Fine-Grained Consistent Character Generation. | Mengyu Wang, Henghui Ding, Jianing Peng, Yao Zhao, Yunpeng Chen, Yunchao Wei |
| 2025 | How Do Multimodal Large Language Models Handle Complex Multimodal Reasoning? Placing Them in an Extensible Escape Game. | Ziyue Wang, Yurui Dong, Fuwen Luo, Minyuan Ruan, Zhili Cheng, Chi Chen, Peng Li, Yang Liu |
| 2025 | HoliTracer: Holistic Vectorization of Geographic Objects from Large-Size Remote Sensing Imagery. | Yu Wang, Bo Dang, Wanchun Li, Wei Chen, Yansheng Li |
| 2025 | Attention to the Burstiness in Visual Prompt Tuning! | Yuzhu Wang, Manni Duan, Shu Kong |
| 2025 | FairHuman: Boosting Hand and Face Quality in Human Image Generation with Minimum Potential Delay Fairness in Diffusion Models. | Yuxuan Wang, Tianwei Cao, Huayu Zhang, Zhongjiang He, Kongming Liang, Zhanyu Ma |
| 2025 | LOTA: Bit-Planes Guided AI-Generated Image Detection. | Hongsong Wang, Renxi Cheng, Yang Zhang, Chaolei Han, Jie Gui |
| 2025 | Not All Degradations are Equal: A Targeted Feature Denoising Framework for Generalizable Image Super-Resolution. | Hongjun Wang, Jiyuan Chen, Zhengwei Yin, Xuan Song, Yinqiang Zheng |
| 2025 | Enhancing Numerical Prediction of MLLMS With Soft Labeling. | Pei Wang, Zhaowei Cai, Hao Yang, Davide Modolo, Ashwin Swaminathan |
| 2025 | Object-Centric Video Question Answering with Visual Grounding and Referring. | Haochen Wang, Qirui Chen, Cilin Yan, Jiayin Cai, Xiaolong Jiang, Yao Hu, Weidi Xie, Stratis Gavves |
| 2025 | DiffDoctor: Diagnosing Image Diffusion Models Before Treating. | Yiyang Wang, Xi Chen, Xiaogang Xu, Sihui Ji, Yu Liu, Yujun Shen, Hengshuang Zhao |
| 2025 | DynamicFace: High-Quality and Consistent Face Swapping for Image and Video Using Composable 3D Facial Priors. | Runqi Wang, Yang Chen, Sijie Xu, Tianyao He, Wei Zhu, Dejia Song, Nemo Chen, Xu Tang, Yao Hu |
| 2025 | VAFlow: Video-to-Audio Generation with Cross-Modality Flow Matching. | Xihua Wang, Xin Cheng, Yuyue Wang, Ruihua Song, Yunfeng Wang |
| 2025 | SMoLoRa: Exploring and Defying Dual Catastrophic Forgetting in Continual Visual Instruction Tuning. | Ziqi Wang, Chang Che, Qi Wang, Yangyang Li, Zenglin Shi, Meng Wang |
| 2025 | HiMTok: Learning Hierarchical Mask Tokens for Image Segmentation with Large Multimodal Model. | Tao Wang, Changxu Cheng, Lingfeng Wang, Senda Chen, Wuyue Zhao |
| 2025 | Mamba-3VL: Taming State Space Model for 3D Vision Language Learning. | Yuan Wang, Yuxin Chen, Zhongang Qi, Lijun Liu, Jile Jiao, Xuetao Feng, Yujia Liang, Ying Shan, Zhipeng Zhang |
| 2025 | Toward Fair and Accurate Cross-Domain Medical Image Segmentation: a Vlm-Driven Active Domain Adaptation Paradigm. | Hongqiu Wang, Wu Chen, Xiangde Luo, Zhaohu Xing, Lihao Liu, Jing Qin, Shaozhi Wu, Lei Zhu |
| 2025 | VQ-SGen: A Vector Quantized Stroke Representation for Creative Sketch Generation. | Jiawei Wang, Zhiming Cui, Changjian Li |
| 2025 | EditClip: Representation Learning for Image Editing. | Qian Wang, Aleksandar Cvejic, Abdelrahman Eldesokey, Peter Wonka |