Zehan Wang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
33
Venues
13
Active years
2012–2026
Best venue rank
A*
Where they publish
Papers
33 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | View-R1: Asymmetric Policy Optimization for Difficulty-Aware Multimodal Reinforcement Learning. | Minjie Hong, Zirun Guo, Jiabao Zhang, Zehan Wang, Ziang Zhang, Tao Jin, Zhou Zhao |
| 2026 | ACL | Masked Text-to-Audio Flow-Matching and Reward Feedback Optimization. | Rongjie Huang, Dongchao Yang, Wenxiang Guo, Huadai Liu, Xize Cheng, Zehan Wang, Zhou Zhao, Xixin Wu, Helen M. Meng |
| 2025 | ACL | T2A-Feedback: Improving Basic Capabilities of Text-to-Audio Generation via Fine-grained AI Feedback. | Zehan Wang, Ke Lei, Chen Zhu, Jiawei Huang, Sashuai Zhou, Luping Liu, Xize Cheng, Shengpeng Ji, Zhenhui Ye, Tao Jin, Zhou Zhao |
| 2025 | ACL | ControlSpeech: Towards Simultaneous and Independent Zero-shot Speaker Cloning and Zero-shot Language Style Control. | Shengpeng Ji, Qian Chen, Wen Wang, Jialong Zuo, Minghui Fang, Ziyue Jiang, Hai Huang, Zehan Wang, Xize Cheng, Siqi Zheng, Zhou Zhao |
| 2025 | CVPR | SpatialCLIP: Learning 3D-aware Image Representations from Spatially Discriminative Language. | Zehan Wang, Sashuai Zhou, Shaoxuan He, Haifeng Huang, Lihe Yang, Ziang Zhang, Xize Cheng, Shengpeng Ji, Tao Jin, Hengshuang Zhao, Zhou Zhao |
| 2025 | CVPR | RoboGround: Robotic Manipulation with Grounded Vision-Language Priors. | Haifeng Huang, Xinyi Chen, Yilun Chen, Hao Li, Xiaoshen Han, Zehan Wang, Tai Wang, Jiangmiao Pang, Zhou Zhao |
| 2025 | ICLR | OmniBind: Large-scale Omni Multimodal Representation via Binding Spaces. | Zehan Wang, Ziang Zhang, Minjie Hong, Hang Zhang, Luping Liu, Rongjie Huang, Xize Cheng, Shengpeng Ji, Tao Jin, Hengshuang Zhao, Zhou Zhao |
| 2025 | ICLR | VoxDialogue: Can Spoken Dialogue Systems Understand Information Beyond Words? | Xize Cheng, Ruofan Hu, Xiaoda Yang, Jingyu Lu, Dongjie Fu, Zehan Wang, Shengpeng Ji, Rongjie Huang, Boyang Zhang, Tao Jin, Zhou Zhao |
| 2025 | ICLR | OmniSep: Unified Omni-Modality Sound Separation with Query-Mixup. | Xize Cheng, Siqi Zheng, Zehan Wang, Minghui Fang, Ziang Zhang, Rongjie Huang, Shengpeng Ji, Jialong Zuo, Tao Jin, Zhou Zhao |
| 2025 | ICLR | WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling. | Shengpeng Ji, Ziyue Jiang, Wen Wang, Yifu Chen, Minghui Fang, Jialong Zuo, Qian Yang, Xize Cheng, Zehan Wang, Ruiqi Li, Ziang Zhang, Xiaoda Yang, Rongjie Huang, Yidi Jiang, Qian Chen, Siqi Zheng, Zhou Zhao |
| 2025 | ICLR | Improving Long-Text Alignment for Text-to-Image Diffusion Models. | Luping Liu, Chao Du, Tianyu Pang, Zehan Wang, Chongxuan Li, Dong Xu |
| 2025 | ICLR | Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision. | Weicai Yan, Wang Lin, Zirun Guo, Ye Wang, Fangming Feng, Xiaoda Yang, Zehan Wang, Tao Jin |
| 2025 | ICML | Orient Anything: Learning Robust Object Orientation Estimation from Rendering 3D Models. | Zehan Wang, Ziang Zhang, Tianyu Pang, Chao Du, Hengshuang Zhao, Zhou Zhao |
| 2025 | ICRA | MJPR: Multi-Modal Joint Predictive Representation in Deep Reinforcement Learning. | Zehan Wang, Ziming He, Zijia Wang, Hua He, Beiya Yang, Haobin Shi |
| 2025 | KDD | Multimodal Conditional Retrieval with High Controllability. | Xiaoda Yang, Xize Cheng, Minghui Fang, Hongshun Qiu, Yuhang Ma, Junyu Lu, Jiaqi Duan, Sihang Cai, Zehan Wang, Ruofan Hu, Dongjie Fu, Zhou Zhao, Tao Jin |
| 2025 | NAACL | Data-Efficiently Learn Large Language Model for Universal 3D Scene Perception. | Zehan Wang, Haifeng Huang, Yang Zhao, Ziang Zhang, Tao Jin, Zhou Zhao |
| 2025 | WWW | EAGER-LLM: Enhancing Large Language Models as Recommenders through Exogenous Behavior-Semantic Integration. | Minjie Hong, Yan Xia, Zehan Wang, Jieming Zhu, Ye Wang, Sihang Cai, Xiaoda Yang, Quanyu Dai, Zhenhua Dong, Zhimeng Zhang, Zhou Zhao |
| 2024 | ACL | TransFace: Unit-Based Audio-Visual Speech Synthesizer for Talking Head Translation. | Xize Cheng, Rongjie Huang, Linjun Li, Zehan Wang, Tao Jin, Aoxiong Yin, Feiyang Chen, Xinyu Duan, Baoxing Huai, Zhou Zhao |
| 2024 | ACL | Make-A-Voice: Revisiting Voice Large Language Models as Scalable Multilingual and Multitask Learners. | Rongjie Huang, Chunlei Zhang, Yongqi Wang, Dongchao Yang, Jinchuan Tian, Zhenhui Ye, Luping Liu, Zehan Wang, Ziyue Jiang, Xuankai Chang, Jiatong Shi, Chao Weng, Zhou Zhao, Dong Yu |
| 2024 | ICML | FreeBind: Free Lunch in Unified Multimodal Space via Knowledge Fusion. | Zehan Wang, Ziang Zhang, Xize Cheng, Rongjie Huang, Luping Liu, Zhenhui Ye, Haifeng Huang, Yang Zhao, Tao Jin, Peng Gao, Zhou Zhao |
| 2024 | ICML | InstructSpeech: Following Speech Editing Instructions via Large Language Models. | Rongjie Huang, Ruofan Hu, Yongqi Wang, Zehan Wang, Xize Cheng, Ziyue Jiang, Zhenhui Ye, Dongchao Yang, Luping Liu, Peng Gao, Zhou Zhao |
| 2023 | ACL | Scene-robust Natural Language Video Localization via Learning Domain-invariant Representations. | Zehan Wang, Yang Zhao, Haifeng Huang, Yan Xia, Zhou Zhao |
| 2023 | EMNLP | 3DRP-Net: 3D Relative Position-aware Network for 3D Visual Grounding. | Zehan Wang, Haifeng Huang, Yang Zhao, Linjun Li, Xize Cheng, Yichen Zhu, Aoxiong Yin, Zhou Zhao |
| 2023 | ICCV | MixSpeech: Cross-Modality Self-Learning with Audio-Visual Stream Mixup for Visual Speech Translation and Recognition. | Xize Cheng, Tao Jin, Rongjie Huang, Linjun Li, Wang Lin, Zehan Wang, Ye Wang, Huadai Liu, Aoxiong Yin, Zhou Zhao |
| 2023 | ICCV | Distilling Coarse-to-Fine Semantic Matching Knowledge for Weakly Supervised 3D Visual Grounding. | Zehan Wang, Haifeng Huang, Yang Zhao, Linjun Li, Xize Cheng, Yichen Zhu, Aoxiong Yin, Zhou Zhao |
| 2020 | EUSPN | Taxi and Mobility: Modeling Taxi Demand Using ARMA and Linear Regression. | Sabiheh Faghih, Arpita Shah, Zehan Wang, Abolfazl Safikhani, Camille Kamga |
| 2020 | IJCNN | Risk-Controlled Selective Prediction for Regression Deep Neural Network Models. | Wenming Jiang, Ying Zhao, Zehan Wang |
| 2017 | CVPR | Real-Time Video Super-Resolution with Spatio-Temporal Networks and Motion Compensation. | Jose Caballero, Christian Ledig, Andrew P. Aitken, Alejandro Acosta, Johannes Totz, Zehan Wang, Wenzhe Shi |
| 2017 | CVPR | Photo-Realistic Single Image Super-Resolution Using a Generative Adversarial Network. | Christian Ledig, Lucas Theis, Ferenc Huszar, Jose Caballero, Andrew Cunningham, Alejandro Acosta, Andrew P. Aitken, Alykhan Tejani, Johannes Totz, Zehan Wang, Wenzhe Shi |
| 2016 | CVPR | Real-Time Single Image and Video Super-Resolution Using an Efficient Sub-Pixel Convolutional Neural Network. | Wenzhe Shi, Jose Caballero, Ferenc Huszar, Johannes Totz, Andrew P. Aitken, Rob Bishop, Daniel Rueckert, Zehan Wang |
| 2014 | MICCAI | Geodesic Patch-Based Segmentation. | Zehan Wang, Kanwal K. Bhatia, Ben Glocker, Antonio M. Simoes Monteiro de Marvao, Tim Dawes, Kazunari Misawa, Kensaku Mori, Daniel Rueckert |
| 2013 | MICCAI | Patch-Based Segmentation without Registration: Application to Knee MRI. | Zehan Wang, Claire R. Donoghue, Daniel Rueckert |
| 2012 | MICCAI | Spatially Aware Patch-Based Segmentation (SAPS): An Alternative Patch-Based Segmentation Framework. | Zehan Wang, Robin Wolz, Tong Tong, Daniel Rueckert |