| 2026 | AAAI | AV-SSAN: Audio-Visual Selective DOA Estimation Through Explicit Multi-Band Semantic-Spatial Alignment. | Yu Chen, Hongxu Zhu, Jiadong Wang, Kainan Chen, Xinyuan Qian |
| 2026 | AAAI | MartDE: A Privacy-Preserving and Cost-Efficient Evaluation Framework for Data Marketplaces. | Xinyuan Qian, Haoyong Wang, Hangcheng Cao, Shuai Yuan, Senkang Hu, Qingchuan Zhao, Hongwei Li, Guowen Xu |
| 2025 | AAAI | FaceSpeak: Expressive and High-Quality Speech Synthesis from Human Portraits of Different Styles. | Tian-Hao Zhang, Jiawei Zhang, Jun Wang, Xinyuan Qian, Xu-Cheng Yin |
| 2025 | ICASSP | M2PAIR: A High-Quality Acoustic Impulse Response Computation Model. | Zhiyu Li, Xinpei Zhao, Jing Wang, Xinyuan Qian, Xiang Xie |
| 2025 | ICASSP | Breaking Through the Spike: Spike Window Decoding for Accelerated and Precise Automatic Speech Recognition. | Wei Zhang, Tian-Hao Zhang, Chao Luo, Hui Zhou, Chao Yang, Xinyuan Qian, Xu-Cheng Yin |
| 2024 | GLOBECOM | QPFFL: Advancing Federated Learning with Quantum-Resistance, Privacy, and Fairness. | Ran Zhang, Hongwei Li, Xinyuan Qian, Xiaoyuan Liu, Wenbo Jiang |
| 2024 | ICASSP | LOCSELECT: Target Speaker Localization with an Auditory Selective Hearing Mechanism. | Yu Chen, Xinyuan Qian, Zexu Pan, Kainan Chen, Haizhou Li |
| 2024 | ICASSP | Visually Guided Binaural Audio Generation with Cross-Modal Consistency. | Miao Liu, Jing Wang, Xinyuan Qian, Xiang Xie |
| 2024 | ICASSP | GLMB 3D Speaker Tracking with Video-Assisted Multi-Channel Audio Optimization Functions. | Xinyuan Qian, Zexu Pan, Qiquan Zhang, Kainan Chen, Shoufeng Lin |
| 2024 | ICDCS | SecSCS: A User-Centric Secure Smart Camera System Based on Blockchain. | Xinyuan Qian, Hongwei Li, Haoyong Wang, Guowen Xu, Shengmin Xu, Ju Ren |
| 2024 | INFOCOM | Privacy-Preserving Data Evaluation via Functional Encryption, Revisited. | Xinyuan Qian, Hongwei Li, Guowen Xu, Haoyong Wang, Tianwei Zhang, Xianhao Chen, Yuguang Fang |
| 2024 | Interspeech | Transmitted and Aggregated Self-Attention for Automatic Speech Recognition. | Tian-Hao Zhang, Xinyuan Qian, Feng Chen, Xu-Cheng Yin |
| 2024 | Interspeech | An Exploration of Length Generalization in Transformer-Based Speech Enhancement. | Qiquan Zhang, Hongxu Zhu, Xinyuan Qian, Eliathamby Ambikairajah, Haizhou Li |
| 2023 | CVPR | Seeing What You Said: Talking Face Generation Guided by a Lip Reading Expert. | Jiadong Wang, Xinyuan Qian, Malu Zhang, Robby T. Tan, Haizhou Li |
| 2023 | ICASSP | Stream Attention Based U-Net for L3DAS23 Challenge. | Honglong Wang, Yanjie Fu, Junjie Li, Meng Ge, Longbiao Wang, Xinyuan Qian |
| 2023 | ICASSP | Self-Convolution for Automatic Speech Recognition. | Tianhao Zhang, Qi Liu, Xinyuan Qian, Song-Lu Chen, Feng Chen, Xu-Cheng Yin |
| 2023 | ICASSP | Ripple Sparse Self-Attention for Monaural Speech Enhancement. | Qiquan Zhang, Hongxu Zhu, Qi Song, Xinyuan Qian, Zhaoheng Ni, Haizhou Li |
| 2023 | ICRA | A Miniaturised Camera-based Multi-Modal Tactile Sensor. | Kaspar Althoefer, Yonggen Ling, Wanlin Li, Xinyuan Qian, Wang Wei Lee, Peng Qi |
| 2023 | Interspeech | InterFormer: Interactive Local and Global Features Fusion for Automatic Speech Recognition. | Zhi-Hao Lai, Tian-Hao Zhang, Qi Liu, Xinyuan Qian, Li-Fang Wei, Feng Chen, Song-Lu Chen, Xu-Cheng Yin |
| 2023 | Interspeech | Rethinking Speech Recognition with A Multimodal Perspective via Acoustic and Semantic Cooperative Decoding. | Tian-Hao Zhang, Haibo Qin, Zhi-Hao Lai, Song-Lu Chen, Qi Liu, Feng Chen, Xinyuan Qian, Xu-Cheng Yin |
| 2022 | GLOBECOM | Fast Secure Aggregation for Privacy-Preserving Federated Learning. | Yanjun Liu, Xinyuan Qian, Hongwei Li, Meng Hao, Song Guo |
| 2022 | GLOBECOM | CryptoFE: Practical and Privacy-Preserving Federated Learning via Functional Encryption. | Xinyuan Qian, Hongwei Li, Meng Hao, Shuai Yuan, Xilin Zhang, Song Guo |
| 2022 | Interspeech | Iterative Sound Source Localization for Unknown Number of Sources. | Yanjie Fu, Meng Ge, Haoran Yin, Xinyuan Qian, Longbiao Wang, Gaoyan Zhang, Jianwu Dang |
| 2021 | ICASSP | Multi-Target DoA Estimation with an Audio-Visual Fusion Mechanism. | Xinyuan Qian, Maulik C. Madhavi, Zexu Pan, Jiadong Wang, Haizhou Li |
| 2021 | ICRA | GCC-PHAT with Speech-oriented Attention for Robotic Sound Source Localization. | Jiadong Wang, Xinyuan Qian, Zihan Pan, Malu Zhang, Haizhou Li |
| 2020 | Interspeech | Audio-Visual Multi-Speaker Tracking Based on the GLMB Framework. | Shoufeng Lin, Xinyuan Qian |
| 2019 | ICASSP | Accurate Target Annotation in 3D from Multimodal Streams. | Oswald Lanz, Alessio Brutti, Alessio Xompero, Xinyuan Qian, Maurizio Omologo, Andrea Cavallaro |
| 2018 | ICASSP | 3D Mouth Tracking from a Compact Microphone Array Co-Located with a camera. | Xinyuan Qian, Alessio Xompero, Andrea Cavallaro, Alessio Brutti, Oswald Lanz, Maurizio Omologo |
| 2017 | ICASSP | 3D audio-visual speaker tracking with an adaptive particle filter. | Xinyuan Qian, Alessio Brutti, Maurizio Omologo, Andrea Cavallaro |
| 2015 | ISCAS | An 8-stage time delay integration CMOS image sensor with on-chip polarization pixels. | Hang Yu, Vigil Varghese, Xinyuan Qian, Menghan Guo, Shoushun Chen, Kay Soon Low |
| 2012 | ISCAS | A Time-Delay-Integration CMOS image sensor with pipelined charge transfer architecture. | Hang Yu, Xinyuan Qian, Shoushun Chen, Kay Soon Low |