| 2026 | AAAI | VideoSeg-R1: Reasoning Video Object Segmentation via Reinforcement Learning. | Zishan Xu, Yifu Guo, Yuquan Lu, Fengyu Yang, Junxin Li, Lihua Cai |
| 2026 | ICPR | CaCMam: Content-Aware Contrastive State Space Model for Unpaired Image Dehazing. | Tong Chen, Jia Li, Yunzhi Chen, Hongyang Huang, Fengyu Yang, Ying Chen |
| 2026 | ICPR | MSF-YOLO: Steel Surface Defect Detection with Multi-scale Spectral and Spatial Bidirectional Feature Fusion. | Weixing Huang, Ying Ma, Bo Wang, Fengyu Yang, Wenting He, Ying Chen |
| 2026 | ICPR | Edge-Guided Feature Enhancement for Self-supervised Image Deblurring. | Jia Li, Bo Wang, Tong Chen, Fengyu Yang, Ying Ma, Ying Chen |
| 2025 | AAAI | Tri-Ergon: Fine-Grained Video-to-Audio Generation with Multi-Modal Conditions and LUFS Control. | Bingliang Li, Fengyu Yang, Yuxin Mao, Qingwen Ye, Hongkai Chen, Yiran Zhong |
| 2025 | AAAI | TextToucher: Fine-Grained Text-to-Touch Generation. | Jiahang Tu, Hao Fu, Fengyu Yang, Hanbin Zhao, Chao Zhang, Hui Qian |
| 2025 | ICCV | Discretized Gaussian Representation for Tomographic Reconstruction. | Shaokai Wu, Yuxiang Lu, Yapan Guo, Wei Ji, Suizhi Huang, Fengyu Yang, Shalayiding Sirejiding, Qichen He, Jing Tong, Yanbiao Ji, Yue Ding, Hongtao Lu |
| 2025 | PRICAI | Text2Omni: A Text-Only Training Strategy for MLLMs. | Junxin Li, Yifu Guo, Zishan Xu, Fengyu Yang, Siyue Chen, Siyan Wu, Lihua Cai |
| 2024 | CVPR | Tactile-Augmented Radiance Fields. | Yiming Dou, Fengyu Yang, Yi Liu, Antonio Loquercio, Andrew Owens |
| 2024 | CVPR | FreeMan: Towards Benchmarking 3D Human Pose Estimation Under Real-World Conditions. | Jiong Wang, Fengyu Yang, Bingliang Li, Wenbo Gou, Danqi Yan, Ailing Zeng, Yijun Gao, Junle Wang, Yanqing Jing, Ruimao Zhang |
| 2024 | CVPR | APISR: Anime Production Inspired Real-World Anime Super-Resolution. | Boyang Wang, Fengyu Yang, Xihang Yu, Chao Zhang, Hanbin Zhao |
| 2024 | CVPR | Binding Touch to Everything: Learning Unified Multimodal Tactile Representations. | Fengyu Yang, Chao Feng, Ziyang Chen, Hyoungseob Park, Daniel Wang, Yiming Dou, Ziyao Zeng, Xien Chen, Rit Gangopadhyay, Andrew Owens, Alex Wong |
| 2024 | CVPR | WorDepth: Variational Language Prior for Monocular Depth Estimation. | Ziyao Zeng, Daniel Wang, Fengyu Yang, Hyoungseob Park, Stefano Soatto, Dong Lao, Alex Wong |
| 2024 | ECCV | On the Viability of Monocular Depth Pre-training for Semantic Segmentation. | Dong Lao, Fengyu Yang, Daniel Wang, Hyoungseob Park, Samuel Lu, Alex Wong, Stefano Soatto |
| 2024 | Interspeech | Towards Expressive Zero-Shot Speech Synthesis with Hierarchical Prosody Modeling. | Yuepeng Jiang, Tao Li, Fengyu Yang, Lei Xie, Meng Meng, Yujun Wang |
| 2024 | WACV | VCISR: Blind Single Image Super-Resolution with Video Compression Synthetic Data. | Boyang Wang, Bowen Liu, Shiyu Liu, Fengyu Yang |
| 2023 | CVPR | Boosting Detection in Crowd Analysis via Underutilized Output Features. | Shaokai Wu, Fengyu Yang |
| 2023 | ICCV | Generating Visual Scenes from Touch. | Fengyu Yang, Jiacheng Zhang, Andrew Owens |
| 2023 | Interspeech | Improving Bilingual TTS Using Language And Phonology Embedding With Embedding Strength Modulator. | Fengyu Yang, Jian Luan, Meng Meng, Yujun Wang |
| 2022 | CVPR | Sparse and Complete Latent Organization for Geospatial Semantic Segmentation. | Fengyu Yang, Chenyang Ma |
| 2022 | ECCV | RBC: Rectifying the Biased Context in Continual Semantic Segmentation. | Hanbin Zhao, Fengyu Yang, Xinghe Fu, Xi Li |
| 2022 | ICASSP | Improving Emotional Speech Synthesis by Using SUS-Constrained VAE and Text Encoder Aggregation. | Fengyu Yang, Jian Luan, Yujun Wang |
| 2021 | Interspeech | Enriching Source Style Transfer in Recognition-Synthesis Based Non-Parallel Voice Conversion. | Zhichao Wang, Xinyong Zhou, Fengyu Yang, Tao Li, Hongqiang Du, Lei Xie, Wendong Gan, Haitao Chen, Hai Li |
| 2020 | Interspeech | Exploiting Deep Sentential Context for Expressive End-to-End Speech Synthesis. | Fengyu Yang, Shan Yang, Qinghua Wu, Yujun Wang, Lei Xie |
| 2019 | ASRU | Improving Mandarin End-to-End Speech Synthesis by Self-Attention and Learnable Gaussian Bias. | Fengyu Yang, Shan Yang, Pengcheng Zhu, Pengju Yan, Lei Xie |
| 2017 | ICNC | CFXGBoost: Topic phrase extraction based on context features and XGBoost for knowledge base question answering. | Han Han, Fengyu Yang, Jiuming Huang, Bin Zhou |