Skip to content

Zehan Wang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

33

Venues

13

Active years

2012–2026

Best venue rank

A*

Where they publish

Papers

33 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLView-R1: Asymmetric Policy Optimization for Difficulty-Aware Multimodal Reinforcement Learning.Minjie Hong, Zirun Guo, Jiabao Zhang, Zehan Wang, Ziang Zhang, Tao Jin, Zhou Zhao
2026ACLMasked Text-to-Audio Flow-Matching and Reward Feedback Optimization.Rongjie Huang, Dongchao Yang, Wenxiang Guo, Huadai Liu, Xize Cheng, Zehan Wang, Zhou Zhao, Xixin Wu, Helen M. Meng
2025ACLT2A-Feedback: Improving Basic Capabilities of Text-to-Audio Generation via Fine-grained AI Feedback.Zehan Wang, Ke Lei, Chen Zhu, Jiawei Huang, Sashuai Zhou, Luping Liu, Xize Cheng, Shengpeng Ji, Zhenhui Ye, Tao Jin, Zhou Zhao
2025ACLControlSpeech: Towards Simultaneous and Independent Zero-shot Speaker Cloning and Zero-shot Language Style Control.Shengpeng Ji, Qian Chen, Wen Wang, Jialong Zuo, Minghui Fang, Ziyue Jiang, Hai Huang, Zehan Wang, Xize Cheng, Siqi Zheng, Zhou Zhao
2025CVPRSpatialCLIP: Learning 3D-aware Image Representations from Spatially Discriminative Language.Zehan Wang, Sashuai Zhou, Shaoxuan He, Haifeng Huang, Lihe Yang, Ziang Zhang, Xize Cheng, Shengpeng Ji, Tao Jin, Hengshuang Zhao, Zhou Zhao
2025CVPRRoboGround: Robotic Manipulation with Grounded Vision-Language Priors.Haifeng Huang, Xinyi Chen, Yilun Chen, Hao Li, Xiaoshen Han, Zehan Wang, Tai Wang, Jiangmiao Pang, Zhou Zhao
2025ICLROmniBind: Large-scale Omni Multimodal Representation via Binding Spaces.Zehan Wang, Ziang Zhang, Minjie Hong, Hang Zhang, Luping Liu, Rongjie Huang, Xize Cheng, Shengpeng Ji, Tao Jin, Hengshuang Zhao, Zhou Zhao
2025ICLRVoxDialogue: Can Spoken Dialogue Systems Understand Information Beyond Words?Xize Cheng, Ruofan Hu, Xiaoda Yang, Jingyu Lu, Dongjie Fu, Zehan Wang, Shengpeng Ji, Rongjie Huang, Boyang Zhang, Tao Jin, Zhou Zhao
2025ICLROmniSep: Unified Omni-Modality Sound Separation with Query-Mixup.Xize Cheng, Siqi Zheng, Zehan Wang, Minghui Fang, Ziang Zhang, Rongjie Huang, Shengpeng Ji, Jialong Zuo, Tao Jin, Zhou Zhao
2025ICLRWavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling.Shengpeng Ji, Ziyue Jiang, Wen Wang, Yifu Chen, Minghui Fang, Jialong Zuo, Qian Yang, Xize Cheng, Zehan Wang, Ruiqi Li, Ziang Zhang, Xiaoda Yang, Rongjie Huang, Yidi Jiang, Qian Chen, Siqi Zheng, Zhou Zhao
2025ICLRImproving Long-Text Alignment for Text-to-Image Diffusion Models.Luping Liu, Chao Du, Tianyu Pang, Zehan Wang, Chongxuan Li, Dong Xu
2025ICLRDiff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision.Weicai Yan, Wang Lin, Zirun Guo, Ye Wang, Fangming Feng, Xiaoda Yang, Zehan Wang, Tao Jin
2025ICMLOrient Anything: Learning Robust Object Orientation Estimation from Rendering 3D Models.Zehan Wang, Ziang Zhang, Tianyu Pang, Chao Du, Hengshuang Zhao, Zhou Zhao
2025ICRAMJPR: Multi-Modal Joint Predictive Representation in Deep Reinforcement Learning.Zehan Wang, Ziming He, Zijia Wang, Hua He, Beiya Yang, Haobin Shi
2025KDDMultimodal Conditional Retrieval with High Controllability.Xiaoda Yang, Xize Cheng, Minghui Fang, Hongshun Qiu, Yuhang Ma, Junyu Lu, Jiaqi Duan, Sihang Cai, Zehan Wang, Ruofan Hu, Dongjie Fu, Zhou Zhao, Tao Jin
2025NAACLData-Efficiently Learn Large Language Model for Universal 3D Scene Perception.Zehan Wang, Haifeng Huang, Yang Zhao, Ziang Zhang, Tao Jin, Zhou Zhao
2025WWWEAGER-LLM: Enhancing Large Language Models as Recommenders through Exogenous Behavior-Semantic Integration.Minjie Hong, Yan Xia, Zehan Wang, Jieming Zhu, Ye Wang, Sihang Cai, Xiaoda Yang, Quanyu Dai, Zhenhua Dong, Zhimeng Zhang, Zhou Zhao
2024ACLTransFace: Unit-Based Audio-Visual Speech Synthesizer for Talking Head Translation.Xize Cheng, Rongjie Huang, Linjun Li, Zehan Wang, Tao Jin, Aoxiong Yin, Feiyang Chen, Xinyu Duan, Baoxing Huai, Zhou Zhao
2024ACLMake-A-Voice: Revisiting Voice Large Language Models as Scalable Multilingual and Multitask Learners.Rongjie Huang, Chunlei Zhang, Yongqi Wang, Dongchao Yang, Jinchuan Tian, Zhenhui Ye, Luping Liu, Zehan Wang, Ziyue Jiang, Xuankai Chang, Jiatong Shi, Chao Weng, Zhou Zhao, Dong Yu
2024ICMLFreeBind: Free Lunch in Unified Multimodal Space via Knowledge Fusion.Zehan Wang, Ziang Zhang, Xize Cheng, Rongjie Huang, Luping Liu, Zhenhui Ye, Haifeng Huang, Yang Zhao, Tao Jin, Peng Gao, Zhou Zhao
2024ICMLInstructSpeech: Following Speech Editing Instructions via Large Language Models.Rongjie Huang, Ruofan Hu, Yongqi Wang, Zehan Wang, Xize Cheng, Ziyue Jiang, Zhenhui Ye, Dongchao Yang, Luping Liu, Peng Gao, Zhou Zhao
2023ACLScene-robust Natural Language Video Localization via Learning Domain-invariant Representations.Zehan Wang, Yang Zhao, Haifeng Huang, Yan Xia, Zhou Zhao
2023EMNLP3DRP-Net: 3D Relative Position-aware Network for 3D Visual Grounding.Zehan Wang, Haifeng Huang, Yang Zhao, Linjun Li, Xize Cheng, Yichen Zhu, Aoxiong Yin, Zhou Zhao
2023ICCVMixSpeech: Cross-Modality Self-Learning with Audio-Visual Stream Mixup for Visual Speech Translation and Recognition.Xize Cheng, Tao Jin, Rongjie Huang, Linjun Li, Wang Lin, Zehan Wang, Ye Wang, Huadai Liu, Aoxiong Yin, Zhou Zhao
2023ICCVDistilling Coarse-to-Fine Semantic Matching Knowledge for Weakly Supervised 3D Visual Grounding.Zehan Wang, Haifeng Huang, Yang Zhao, Linjun Li, Xize Cheng, Yichen Zhu, Aoxiong Yin, Zhou Zhao
2020EUSPNTaxi and Mobility: Modeling Taxi Demand Using ARMA and Linear Regression.Sabiheh Faghih, Arpita Shah, Zehan Wang, Abolfazl Safikhani, Camille Kamga
2020IJCNNRisk-Controlled Selective Prediction for Regression Deep Neural Network Models.Wenming Jiang, Ying Zhao, Zehan Wang
2017CVPRReal-Time Video Super-Resolution with Spatio-Temporal Networks and Motion Compensation.Jose Caballero, Christian Ledig, Andrew P. Aitken, Alejandro Acosta, Johannes Totz, Zehan Wang, Wenzhe Shi
2017CVPRPhoto-Realistic Single Image Super-Resolution Using a Generative Adversarial Network.Christian Ledig, Lucas Theis, Ferenc Huszar, Jose Caballero, Andrew Cunningham, Alejandro Acosta, Andrew P. Aitken, Alykhan Tejani, Johannes Totz, Zehan Wang, Wenzhe Shi
2016CVPRReal-Time Single Image and Video Super-Resolution Using an Efficient Sub-Pixel Convolutional Neural Network.Wenzhe Shi, Jose Caballero, Ferenc Huszar, Johannes Totz, Andrew P. Aitken, Rob Bishop, Daniel Rueckert, Zehan Wang
2014MICCAIGeodesic Patch-Based Segmentation.Zehan Wang, Kanwal K. Bhatia, Ben Glocker, Antonio M. Simoes Monteiro de Marvao, Tim Dawes, Kazunari Misawa, Kensaku Mori, Daniel Rueckert
2013MICCAIPatch-Based Segmentation without Registration: Application to Knee MRI.Zehan Wang, Claire R. Donoghue, Daniel Rueckert
2012MICCAISpatially Aware Patch-Based Segmentation (SAPS): An Alternative Patch-Based Segmentation Framework.Zehan Wang, Robin Wolz, Tong Tong, Daniel Rueckert