| 2026 | AAAI | SACodec: Asymmetric Quantization with Semantic Anchoring for Low-Bitrate High-Fidelity Neural Speech Codecs. | Zhongren Dong, Bin Wang, Jing Han, Haotian Guo, Xiaojun Mo, Yimin Cao, Zixing Zhang |
| 2026 | AAAI | PLUM-Net: Prototype-Induced Label Structuring for Disentangled Multimodal Representation Network. | Kehan Wang, Huan Zhao, Yong Wei, Xupeng Zha, Guanghui Ye, Cheng Zhu, Yiming Liu, Zixing Zhang |
| 2026 | ACL | OneRec-Think: In-Text Reasoning for Generative Recommendation. | Zhanyu Liu, Shiyao Wang, Xingmei Wang, Rongzhou Zhang, Jiaxin Deng, Honghui Bao, Jinghao Zhang, Wuchao Li, Penggei Zheng, Xiangyu Wu, Yifei Hu, Qigen Hu, Xinchen Luo, Lejian Ren, Zixing Zhang, Qianqian Wang, Kuo Cai, Yunfan Wu, Hongtao Cheng, Zexuan Cheng, Lu Ren, Huanjie Wang, Yi Su, Ruiming Tang, Kun Gai, Guorui Zhou |
| 2026 | NSDI | Morphe: High-Fidelity Generative Video Streaming with Vision Foundation Model. | Tianyi Gong, Zijian Cao, Zixing Zhang, Jiangkai Wu, Xinggong Zhang, Shuguang Cui, Fangxin Wang |
| 2025 | AAAI | ProsodyFM: Unsupervised Phrasing and Intonation Control for Intelligible Speech Synthesis. | Xiangheng He, Junjie Chen, Zixing Zhang, Bjrn W. Schuller |
| 2025 | AAAI | Dual-View Learning for Conversational Emotion Recognition Through Context and Emotion-Shift Modeling. | Xupeng Zha, Huan Zhao, Guanghui Ye, Zixing Zhang |
| 2025 | ICASSP | XDGesture: An xLSTM-based Diffusion Model for Co-speech Gesture Generation. | Zixing Zhang, Jiajun Li, Bin Wang, Yiming Liu, Huan Zhao, Bjrn W. Schuller |
| 2025 | ICASSP | Enhanced Multimodal Emotion Recognition in Conversations via Contextual Filtering and Multi-Frequency Graph Propagation. | Huan Zhao, Yingxue Gao, Haijiao Chen, Bo Li, Guanghui Ye, Zixing Zhang |
| 2025 | ICASSP | Parameter-Efficient Federal-Tuning Enhances Privacy Preserving for Speech Emotion Recognition. | Haijiao Chen, Huan Zhao, Yingxue Gao, Yiming Liu, Zixing Zhang |
| 2025 | ICASSP | MHSDB: A Comprehensive Benchmark for Multimodal Humor and Sarcasm Detection Leveraging Foundation Models. | Zhongren Dong, Donghao Wang, Ciqiang Chen, Dong-Yan Huang, Zixing Zhang |
| 2025 | ICASSP | Semi-Supervised Cognitive State Classification from Speech with Multi-View Pseudo-Labeling. | Yuanchao Li, Zixing Zhang, Jing Han, Peter Bell, Catherine Lai |
| 2025 | ICASSP | DSSM: Dual State Space Model For Human Motions Generation. | Yiming Liu, Huan Zhao, Yaqian Liu, Haijiao Chen, Bo Li, Guanghui Ye, Zixing Zhang |
| 2025 | ICASSP | GateM | Weixiang Xu, Zhongren Dong, Runming Wang, Xinzhou Xu, Zixing Zhang |
| 2025 | ICASSP | SSE: A Speaking Style Extractor Based on Fine-Grained Contrastive Learning between Speech and Descriptive Text. | Zixing Zhang, Yimeng Wu, Zhongren Dong, Wulong Xiang, Shengfan Shen, Bjrn W. Schuller |
| 2025 | ICDE | DaRec: A Disentangled Alignment Framework for Large Language Model and Recommender System. | Xihong Yang, Heming Jing, Zixing Zhang, Jindong Wang, Huakang Niu, Shuaiqiang Wang, Yu Lu, Junfeng Wang, Dawei Yin, Xinwang Liu, En Zhu, Defu Lian, Erxue Min |
| 2025 | IJCAI | Rethinking Removal Attack and Fingerprinting Defense for Model Intellectual Property Protection: A Frequency Perspective. | Cheng Zhang, Yang Xu, Tingqiao Huang, Zixing Zhang |
| 2024 | ACL | EmoTransKG: An Innovative Emotion Knowledge Graph to Reveal Emotion Transformation. | Huan Zhao, Xupeng Zha, Zixing Zhang |
| 2024 | ICASSP | Intelligent Cardiac Auscultation for Murmur Detection via Parallel-Attentive Models with Uncertainty Estimation. | Zixing Zhang, Tao Pang, Jing Han, Bjrn W. Schuller |
| 2024 | ICASSP | HAFFormer: A Hierarchical Attention-Free Framework for Alzheimer's Disease Detection From Spontaneous Speech. | Zhongren Dong, Zixing Zhang, Weixiang Xu, Jing Han, Jianjun Ou, Bjrn W. Schuller |
| 2024 | ICASSP | Adaptive Speech Emotion Representation Learning Based On Dynamic Graph. | Yingxue Gao, Huan Zhao, Zixing Zhang |
| 2024 | ICASSP | Customising General Large Language Models for Specialised Emotion Recognition Tasks. | Liyizhe Peng, Zixing Zhang, Tao Pang, Jing Han, Huan Zhao, Hao Chen, Bjrn W. Schuller |
| 2024 | ICASSP | Esihgnn: Event-State Interactions Infused Heterogeneous Graph Neural Network for Conversational Emotion Recognition. | Xupeng Zha, Huan Zhao, Zixing Zhang |
| 2024 | NAACL | LSTDial: Enhancing Dialogue Generation via Long- and Short-Term Measurement Feedback. | Guanghui Ye, Huan Zhao, Zixing Zhang, Xupeng Zha, Zhihua Jiang |
| 2023 | ICASSP | Zero-Shot Speech Emotion Recognition Using Generative Learning with Reconstructed Prototypes. | Xinzhou Xu, Jun Deng, Zixing Zhang, Zhen Yang, Bjrn W. Schuller |
| 2023 | ICASSP | Privacy-Enhanced Federated Learning Against Attribute Inference Attack for Speech Emotion Recognition. | Huan Zhao, Haijiao Chen, Yufeng Xiao, Zixing Zhang |
| 2023 | ICMI | GCFormer: A Graph Convolutional Transformer for Speech Emotion Recognition. | Yingxue Gao, Huan Zhao, Yufeng Xiao, Zixing Zhang |
| 2023 | Interspeech | Speaker-aware Cross-modal Fusion Architecture for Conversational Emotion Recognition. | Huan Zhao, Bo Li, Zixing Zhang |
| 2023 | PRICAI | Frequency Domain Feature Learning with Wavelet Transform for Image Translation. | Huan Zhao, Yujiang Wang, Tingting Li, Song Wang, Lixuan Li, Xupeng Zha, Zixing Zhang |
| 2022 | ICASSP | Automatic Respiratory Sound Classification Via Multi-Branch Temporal Convolutional Network. | Ziping Zhao, Zhen Gong, Mingyue Niu, Jiali Ma, Haishuai Wang, Zixing Zhang, Ya Li |
| 2022 | PRICAI | Deliberation Selector for Knowledge-Grounded Conversation Generation. | Huan Zhao, Yiqing Wang, Bo Li, Song Wang, Zixing Zhang, Xupeng Zha |
| 2021 | HCI | Identification of Hate Tweets: Which Words Matter the Most? | Kezheng Xiang, Zixing Zhang, Yuwen Yu, Luis San Lucas, Mohammad Ruhul Amin, Yanjun Li |
| 2021 | SAC | Identifying surgical-mask speech using deep neural networks on low-level aggregation. | Xinzhou Xu, Jun Deng, Zixing Zhang, Chen Wu, Bjrn W. Schuller |
| 2020 | ICASSP | Generating and Protecting Against Adversarial Attacks for Deep Speech-Based Emotion Recognition Models. | Zhao Ren, Alice Baird, Jing Han, Zixing Zhang, Bjrn W. Schuller |
| 2020 | ICASSP | Hierarchical Attention Transfer Networks for Depression Assessment from Speech. | Ziping Zhao, Zhongtian Bao, Zixing Zhang, Nicholas Cummins, Haishuai Wang, Bjrn W. Schuller |
| 2020 | Interspeech | An Early Study on Intelligent Analysis of Speech Under COVID-19: Severity, Sleep Quality, Fatigue, and Anxiety. | Jing Han, Kun Qian, Meishu Song, Zijiang Yang, Zhao Ren, Shuo Liu, Juan Liu, Huaiyuan Zheng, Wei Ji, Tomoya Koike, Xiao Li, Zixing Zhang, Yoshiharu Yamamoto, Bjrn W. Schuller |
| 2019 | ACII | Audiovisual Analysis for Recognising Frustration during Game-Play: Introducing the Multimodal Game Frustration Database. | Meishu Song, Zijiang Yang, Alice Baird, Emilia Parada-Cabaleiro, Zixing Zhang, Ziping Zhao, Bjrn W. Schuller |
| 2019 | ICASSP | Attention-augmented End-to-end Multi-task Learning for Emotion Prediction from Speech. | Zixing Zhang, Bingwen Wu, Bjrn W. Schuller |
| 2019 | ICASSP | Implicit Fusion by Joint Audiovisual Training for Emotion Recognition in Mono Modality. | Jing Han, Zixing Zhang, Zhao Ren, Bjrn W. Schuller |
| 2019 | ICASSP | Compact Convolutional Recurrent Neural Networks via Binarization for Speech Emotion Recognition. | Huan Zhao, Yufeng Xiao, Jing Han, Zixing Zhang |
| 2019 | ICMI | VCMNet: Weakly Supervised Learning for Automatic Infant Vocalisation Maturity Analysis. | Najla Al Futaisi, Zixing Zhang, Alejandrina Cristi, Anne S. Warlaumont, Bjrn W. Schuller |
| 2019 | Interspeech | Autonomous Emotion Learning in Speech: A View of Zero-Shot Speech Emotion Recognition. | Xinzhou Xu, Jun Deng, Nicholas Cummins, Zixing Zhang, Li Zhao, Bjrn W. Schuller |
| 2019 | Interspeech | Attention-Enhanced Connectionist Temporal Classification for Discrete Speech Emotion Recognition. | Ziping Zhao, Zhongtian Bao, Zixing Zhang, Nicholas Cummins, Haishuai Wang, Bjrn W. Schuller |
| 2018 | ICASSP | Towards Conditional Adversarial Training for Predicting Emotions from Speech. | Jing Han, Zixing Zhang, Zhao Ren, Fabien Ringeval, Bjrn W. Schuller |
| 2018 | ICMI | Exploring A New Method for Food Likability Rating Based on DT-CWT Theory. | Ya'nan Guo, Jing Han, Zixing Zhang, Bjrn W. Schuller, Yide Ma |
| 2018 | Interspeech | Evolving Learning for Analysing Mood-Related Infant Vocalisation. | Zixing Zhang, Jing Han, Kun Qian, Bjrn W. Schuller |
| 2018 | Interspeech | Bags in Bag: Generating Context-Aware Bags for Tracking Emotions from Speech. | Jing Han, Zixing Zhang, Maximilian Schmitt, Zhao Ren, Fabien Ringeval, Bjrn W. Schuller |
| 2018 | Interspeech | Automated Classification of Children's Linguistic versus Non-Linguistic Vocalisations. | Zixing Zhang, Alejandrina Cristi, Anne S. Warlaumont, Bjrn W. Schuller |
| 2018 | Interspeech | Exploring Spatio-Temporal Representations by Integrating Attention-based Bidirectional-LSTM-RNNs and FCNs for Speech Emotion Recognition. | Ziping Zhao, Yu Zheng, Zixing Zhang, Haishuai Wang, Yiqin Zhao, Chao Li |
| 2018 | PRICAI | Inertial Constrained Hierarchical Belief Propagation for Optical Flow. | Zixing Zhang, Ying Wen |
| 2017 | ICASSP | Reconstruction-error-based learning for continuous emotion recognition in speech. | Jing Han, Zixing Zhang, Fabien Ringeval, Bjrn W. Schuller |
| 2017 | ICASSP | Prediction-based learning for continuous emotion recognition in speech. | Jing Han, Zixing Zhang, Fabien Ringeval, Bjrn W. Schuller |
| 2017 | IJCNN | Towards intoxicated speech recognition. | Zixing Zhang, Felix Weninger, Martin Wllmer, Jing Han, Bjrn W. Schuller |
| 2017 | Interspeech | Towards Intelligent Crowdsourcing for Audio Data Annotation: Integrating Active Learning in the Real World. | Simone Hantke, Zixing Zhang, Bjrn W. Schuller |
| 2016 | ICASSP | Wavelet features for classification of vote snore sounds. | Kun Qian, Christoph Janott, Zixing Zhang, Clemens Heiser, Bjrn W. Schuller |
| 2016 | ICASSP | Enhanced semi-supervised learning for multimodal emotion recognition. | Zixing Zhang, Fabien Ringeval, Bin Dong, Eduardo Coutinho, Erik Marchi, Bjrn W. Schuller |
| 2016 | ICMI | Multiscale kernel locally penalised discriminant analysis exemplified by emotion recognition in speech. | Xinzhou Xu, Jun Deng, Maryna Gavryukova, Zixing Zhang, Li Zhao, Bjrn W. Schuller |
| 2016 | Interspeech | Facing Realism in Spontaneous Emotion Recognition from Speech: Feature Enhancement by Autoencoder with LSTM Neural Networks. | Zixing Zhang, Fabien Ringeval, Jing Han, Jun Deng, Erik Marchi, Bjrn W. Schuller |
| 2015 | ACII | On rater reliability and agreement based dynamic active learning. | Yue Zhang, Eduardo Coutinho, Bjrn W. Schuller, Zixing Zhang, Michael G. Adam |
| 2015 | ICMI | Dynamic Active Learning Based on Agreement and Applied to Emotion Recognition in Spoken Interactions. | Yue Zhang, Eduardo Coutinho, Zixing Zhang, Caijiao Quan, Bjrn W. Schuller |
| 2014 | ICASSP | Introducing shared-hidden-layer autoencoders for transfer learning and their application in acoustic emotion recognition. | Jun Deng, Rui Xia, Zixing Zhang, Yang Liu, Bjrn W. Schuller |
| 2014 | ICPR | Linked Source and Target Domain Subspace Feature Transfer Learning - Exemplified by Speech Emotion Recognition. | Jun Deng, Zixing Zhang, Bjrn W. Schuller |
| 2014 | Interspeech | Robust speech recognition using long short-term memory recurrent neural networks for hybrid acoustic modelling. | Jrgen T. Geiger, Zixing Zhang, Felix Weninger, Bjrn W. Schuller, Gerhard Rigoll |
| 2013 | ACII | Sparse Autoencoder-Based Feature Transfer Learning for Speech Emotion Recognition. | Jun Deng, Zixing Zhang, Erik Marchi, Bjrn W. Schuller |
| 2013 | ICASSP | Feature enhancement by bidirectional LSTM networks for conversational speech recognition in highly non-stationary noise. | Martin Wllmer, Zixing Zhang, Felix Weninger, Bjrn W. Schuller, Gerhard Rigoll |
| 2013 | ICASSP | Co-training succeeds in Computational Paralinguistics. | Zixing Zhang, Jun Deng, Bjrn W. Schuller |
| 2013 | Interspeech | Active learning by label uncertainty for acoustic emotion recognition. | Zixing Zhang, Jun Deng, Erik Marchi, Bjrn W. Schuller |
| 2012 | ICASSP | Automatic recognition of emotion evoked by general sound events. | Bjrn W. Schuller, Simone Hantke, Felix Weninger, Wenjing Han, Zixing Zhang, Shrikanth S. Narayanan |
| 2012 | ICASSP | Semi-supervised learning helps in sound event classification. | Zixing Zhang, Bjrn W. Schuller |
| 2012 | Interspeech | Active Learning by Sparse Instance Tracking and Classifier Confidence in Acoustic Emotion Recognition. | Zixing Zhang, Bjrn W. Schuller |
| 2011 | ASRU | Unsupervised learning in cross-corpus acoustic emotion recognition. | Zixing Zhang, Felix Weninger, Martin Wllmer, Bjrn W. Schuller |
| 2011 | Interspeech | Using Multiple Databases for Training in Emotion Recognition: To Unite or to Vote? | Bjrn W. Schuller, Zixing Zhang, Felix Weninger, Gerhard Rigoll |