Siqi Zheng
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
36
Venues
10
Active years
2018–2026
Best venue rank
A*
Where they publish
Papers
36 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | CHI | BernO: A Breath-Driven Odor Display for Spatial Olfactory Interaction in VR. | Yu Zhang, Chih-Hung Lee, Jingtong Cai, Yaqing Hou, Siqi Zheng, Qianyao Xu, Qi Lu |
| 2025 | AAAI | Speech Recognition Meets Large Language Model: Benchmarking, Models, and Exploration. | Ziyang Ma, Guanrou Yang, Yifan Yang, Zhifu Gao, Jiaming Wang, Zhihao Du, Fan Yu, Qian Chen, Siqi Zheng, Shiliang Zhang, Xie Chen |
| 2025 | ACL | Integrating Audio, Visual, and Semantic Information for Enhanced Multimodal Speaker Diarization on Multi-party Conversation. | Luyao Cheng, Hui Wang, Chong Deng, Siqi Zheng, Yafeng Chen, Rongjie Huang, Qinglin Zhang, Qian Chen, Xihao Li, Wen Wang |
| 2025 | ACL | ControlSpeech: Towards Simultaneous and Independent Zero-shot Speaker Cloning and Zero-shot Language Style Control. | Shengpeng Ji, Qian Chen, Wen Wang, Jialong Zuo, Minghui Fang, Ziyue Jiang, Hai Huang, Zehan Wang, Xize Cheng, Siqi Zheng, Zhou Zhao |
| 2025 | ACL | OmniFlatten: An End-to-end GPT Model for Seamless Voice Conversation. | Qinglin Zhang, Luyao Cheng, Chong Deng, Qian Chen, Wen Wang, Siqi Zheng, Jiaqing Liu, Hai Yu, Chao-Hong Tan, Zhihao Du, Shiliang Zhang |
| 2025 | ICASSP | Self-Distillation Prototypes Network: Learning Robust Speaker Representations without Supervision. | Yafeng Chen, Siqi Zheng, Hui Wang, Luyao Cheng, Qian Chen, Chong Deng, Shiliang Zhang, Wen Wang |
| 2025 | ICASSP | 3D-Speaker-Toolkit: An Open-Source Toolkit for Multimodal Speaker Verification and Diarization. | Yafeng Chen, Siqi Zheng, Hui Wang, Luyao Cheng, Tinglong Zhu, Rongjie Huang, Chong Deng, Qian Chen, Shiliang Zhang, Wen Wang, Xihao Li |
| 2025 | ICASSP | Exploring Text-Queried Sound Event Detection with Audio Source Separation. | Han Yin, Jisheng Bai, Yang Xiao, Hui Wang, Siqi Zheng, Yafeng Chen, Rohan Kumar Das, Chong Deng, Jianfeng Chen |
| 2025 | ICLR | OmniSep: Unified Omni-Modality Sound Separation with Query-Mixup. | Xize Cheng, Siqi Zheng, Zehan Wang, Minghui Fang, Ziang Zhang, Rongjie Huang, Shengpeng Ji, Jialong Zuo, Tao Jin, Zhou Zhao |
| 2025 | ICLR | WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling. | Shengpeng Ji, Ziyue Jiang, Wen Wang, Yifu Chen, Minghui Fang, Jialong Zuo, Qian Yang, Xize Cheng, Zehan Wang, Ruiqi Li, Ziang Zhang, Xiaoda Yang, Rongjie Huang, Yidi Jiang, Qian Chen, Siqi Zheng, Zhou Zhao |
| 2025 | UIST | Understanding Users' Perceptions and Expectations toward a Social Balloon Robot via an Exploratory Study. | Chongyang Wang, Tianyi Xia, Yifan Wang, Gang Yu, Zixuan Zhao, Siqi Zheng, Manqiu Liao, Chen Liang, Yuan Gao, Chun Yu, Yuntao Wang, Yuanchun Shi |
| 2024 | CHI | PepperPose: Full-Body Pose Estimation with a Companion Robot. | Chongyang Wang, Siqi Zheng, Lingxiao Zhong, Chun Yu, Chen Liang, Yuntao Wang, Yuan Gao, Tin Lun Lam, Yuanchun Shi |
| 2024 | ICASSP | Loss Masking Is Not Needed In Decoder-Only Transformer For Discrete-Token-Based ASR. | Qian Chen, Wen Wang, Qinglin Zhang, Siqi Zheng, Shiliang Zhang, Chong Deng, Yukun Ma, Hai Yu, Jiaqing Liu, Chong Zhang |
| 2024 | ICASSP | FunCodec: A Fundamental, Reproducible and Integrable Open-Source Toolkit for Neural Speech Codec. | Zhihao Du, Shiliang Zhang, Kai Hu, Siqi Zheng |
| 2024 | Interspeech | ERes2NetV2: Boosting Short-Duration Speaker Verification Performance with Computational Efficiency. | Yafeng Chen, Siqi Zheng, Hui Wang, Luyao Cheng, Qian Chen, Shiliang Zhang, Junjie Li |
| 2023 | ACL | Exploring Speaker-Related Information in Spoken Language Understanding for Better Speaker Diarization. | Luyao Cheng, Siqi Zheng, Qinglin Zhang, Hui Wang, Yafeng Chen, Qian Chen |
| 2023 | ACL | DopplerBAS: Binaural Audio Synthesis Addressing Doppler Effect. | Jinglin Liu, Zhenhui Ye, Qian Chen, Siqi Zheng, Wen Wang, Qinglin Zhang, Zhou Zhao |
| 2023 | EMNLP | Ditto: A Simple and Efficient Approach to Improve Sentence Embeddings. | Qian Chen, Wen Wang, Qinglin Zhang, Siqi Zheng, Chong Deng, Hai Yu, Jiaqing Liu, Yukun Ma, Chong Zhang |
| 2023 | ICASSP | Pushing the Limits of Self-Supervised Speaker Verification using Regularized Distillation Framework. | Yafeng Chen, Siqi Zheng, Hui Wang, Luyao Cheng, Qian Chen |
| 2023 | Interspeech | An Enhanced Res2Net with Local and Global Feature Fusion for Speaker Verification. | Yafeng Chen, Siqi Zheng, Hui Wang, Luyao Cheng, Qian Chen, Jiajun Qi |
| 2023 | Interspeech | CAM++: A Fast and Efficient Network for Speaker Verification Using Context-Aware Masking. | Hui Wang, Siqi Zheng, Yafeng Chen, Luyao Cheng, Qian Chen |
| 2022 | EMNLP | Speaker Overlap-aware Neural Diarization for Multi-party Meeting Analysis. | Zhihao Du, Shiliang Zhang, Siqi Zheng, Zhi-Jie Yan |
| 2022 | ICASSP | Graph Convolutional Network Based Semi-Supervised Learning on Multi-Speaker Meeting Data. | Fuchuan Tong, Siqi Zheng, Min Zhang, Yafeng Chen, Hongbin Suo, Qingyang Hong, Lin Li |
| 2022 | ICASSP | M2Met: The Icassp 2022 Multi-Channel Multi-Party Meeting Transcription Challenge. | Fan Yu, Shiliang Zhang, Yihui Fu, Lei Xie, Siqi Zheng, Zhihao Du, Weilong Huang, Pengcheng Guo, Zhijie Yan, Bin Ma, Xin Xu, Hui Bu |
| 2022 | ICASSP | Summary on the ICASSP 2022 Multi-Channel Multi-Party Meeting Transcription Grand Challenge. | Fan Yu, Shiliang Zhang, Pengcheng Guo, Yihui Fu, Zhihao Du, Siqi Zheng, Weilong Huang, Lei Xie, Zheng-Hua Tan, DeLiang Wang, Yanmin Qian, Kong Aik Lee, Zhijie Yan, Bin Ma, Xin Xu, Hui Bu |
| 2022 | ICASSP | Reformulating Speaker Diarization As Community Detection With Emphasis On Topological Structure. | Siqi Zheng, Hongbin Suo |
| 2022 | ICLR | PoNet: Pooling Network for Efficient Token Mixing in Long Sequences. | Chao-Hong Tan, Qian Chen, Wen Wang, Qinglin Zhang, Siqi Zheng, Zhen-Hua Ling |
| 2022 | IJCNN | Label-Dividing Gated Graph Neural Network for Hierarchical Text Classification. | Siqi Zheng, Jie Zhou, Kui Meng, Gongshen Liu |
| 2022 | Interspeech | PRISM: Pre-trained Indeterminate Speaker Representation Model for Speaker Diarization and Speaker Verification. | Siqi Zheng, Hongbin Suo, Qian Chen |
| 2021 | ICASSP | Cam: Context-Aware Masking for Robust Speaker Verification. | Ya-Qi Yu, Siqi Zheng, Hongbin Suo, Yun Lei, Wu-Jun Li |
| 2021 | ICASSP | A Real-Time Speaker Diarization System Based on Spatial Spectrum. | Siqi Zheng, Weilong Huang, Xianliang Wang, Hongbin Suo, Jinwei Feng, Zhijie Yan |
| 2021 | Interspeech | Investigation of Spatial-Acoustic Features for Overlapping Speech Detection in Multiparty Meetings. | Shiliang Zhang, Siqi Zheng, Weilong Huang, Ming Lei, Hongbin Suo, Jinwei Feng, Zhijie Yan |
| 2020 | Interspeech | Phonetically-Aware Coupled Network For Short Duration Text-Independent Speaker Verification. | Siqi Zheng, Yun Lei, Hongbin Suo |
| 2019 | Interspeech | Towards a Fault-Tolerant Speaker Verification System: A Regularization Approach to Reduce the Condition Number. | Siqi Zheng, Gang Liu, Hongbin Suo, Yun Lei |
| 2019 | Interspeech | Autoencoder-Based Semi-Supervised Curriculum Learning for Out-of-Domain Speaker Verification. | Siqi Zheng, Gang Liu, Hongbin Suo, Yun Lei |
| 2018 | ICPR | A Noise-Robust Self-Adaptive Multitarget Speaker Detection System. | Siqi Zheng, Jianzong Wang, Jing Xiao, Wei-Ning Hsu, James R. Glass |