| 2026 | AAAI | Towards Training-Free and Accurate ANN-to-SNN Conversion via Activation-Aware Redistribution. | Honglin Cao, Shuai Wang, Zijian Zhou, Ammar Belatreche, Wenjie Wei, Yu Liang, Yu Yang, Rui Xi, Malu Zhang, Haizhou Li |
| 2026 | AAAI | CATCH: A Controllable Theme Detection Framework with Contextualized Clustering and Hierarchical Generation. | Rui Ke, Jiahui Xu, Shenghao Yang, Kuang Wang, Feng Jiang, Haizhou Li |
| 2026 | ACL | NaturalSloth: Revisiting Denial-of-Service Attacks on Large Language Models. | Yiming Chen, Zexin Li, Xianghu Yue, Robby T. Tan, Haizhou Li |
| 2026 | ACL | S2S-Arena: Evaluating Paralinguistic Instruction Following in Speech-to-Speech Models. | Feng Jiang, Zhiyu Lin, Yiyang Liu, Liumeng Xue, Fan Bu, Yuhao Du, Xiangying Chen, Benyou Wang, Haizhou Li |
| 2026 | ACL | UniMoE-Audio: Unified Speech and Music Generation with Dynamic-Capacity Mixture-of-Experts. | Zhenyu Liu, Yunxin Li, Xuanyu Zhang, Qixun Teng, Shenyuan Jiang, Xinyu Chen, Haoyuan Shi, Haolan Chen, Fanbo Meng, Mingjun Zhao, Yu Xu, Yancheng He, Baotian Hu, Haizhou Li, Min Zhang |
| 2026 | ACL | Hierarchical Acoustic-Semantic Modeling: Modality Separation and Semantic Coherence for Full-Duplex SLMs. | Zhenyu Liu, Xuanyu Zhang, Yunxin Li, Qixun Teng, Shenyuan Jiang, Haolan Chen, Mingjun Zhao, Fanbo Meng, Yu Xu, Yancheng He, Baotian Hu, Haizhou Li, Min Zhang |
| 2026 | ECIR | Improving Conversational Recommendation with Contextual Adaptation of External Recommenders and LLM-Based Reranking. | Chuang Li, Weida Liang, Hengchang Hu, See-Kiong Ng, Min-Yen Kan, Haizhou Li, Yang Deng |
| 2025 | AAAI | Multi-modal and Multi-scale Spatial Environment Understanding for Immersive Visual Text-to-Speech. | Rui Liu, Shuwei He, Yifan Hu, Haizhou Li |
| 2025 | AAAI | Aligning Language Models Using Follow-up Likelihood as Reward Signal. | Chen Zhang, Dading Chong, Feng Jiang, Chengguang Tang, Anningzhe Gao, Guohua Tang, Haizhou Li |
| 2025 | AAAI | SongEditor: Adapting Zero-Shot Song Generation Language Model as a Multi-Task Editor. | Chenyu Yang, Shuai Wang, Hangting Chen, Jianwei Yu, Wei Tan, Rongzhi Gu, Yaoxun Xu, Yizhi Zhou, Haina Zhu, Haizhou Li |
| 2025 | ACL | Chain-Talker: Chain Understanding and Rendering for Empathetic Conversational Speech Synthesis. | Yifan Hu, Rui Liu, Yi Ren, Xiang Yin, Haizhou Li |
| 2025 | ACL | UniCodec: Unified Audio Codec with Single Domain-Adaptive Codebook. | Yidi Jiang, Qian Chen, Shengpeng Ji, Yu Xi, Wen Wang, Chong Zhang, Xianghu Yue, Shiliang Zhang, Haizhou Li |
| 2025 | ACL | Know You First and Be You Better: Modeling Human-Like User Simulators via Implicit Profiles. | Kuang Wang, Xianfei Li, Shenghao Yang, Li Zhou, Feng Jiang, Haizhou Li |
| 2025 | ACL | Soundwave: Less is More for Speech-Text Alignment in LLMs. | Yuhao Zhang, Zhiheng Liu, Fan Bu, Ruiyu Zhang, Benyou Wang, Haizhou Li |
| 2025 | ACL | Second Language (Arabic) Acquisition of LLMs via Progressive Vocabulary Expansion. | Jianqing Zhu, Huang Huang, Zhihang Lin, Juhao Liang, Zhengyang Tang, Khalid Almubarak, Mosen Alharthi, Bang An, Juncai He, Xiangbo Wu, Fei Yu, Junying Chen, Zhuoheng Ma, Yuhao Du, He Zhang, Saied Alshahrani, Emad A. Alghamdi, Lian Zhang, Ruoyu Sun, Haizhou Li, Benyou Wang, Jinchao Xu |
| 2025 | EMNLP | Benchmarking Large Language Models Under Data Contamination: A Survey from Static to Dynamic Evaluation. | Simin Chen, Yiming Chen, Zexin Li, Yifan Jiang, Zhongwei Wan, Yixin He, Dezhi Ran, Tianle Gu, Haizhou Li, Tao Xie, Baishakhi Ray |
| 2025 | EMNLP | From Word to World: Evaluate and Mitigate Culture Bias in LLMs via Word Association Test. | Xunlian Dai, Li Zhou, Benyou Wang, Haizhou Li |
| 2025 | EMNLP | Multimodal Fine-grained Context Interaction Graph Modeling for Conversational Speech Synthesis. | Zhenqi Jia, Rui Liu, Berrak Sisman, Haizhou Li |
| 2025 | EMNLP | Hanfu-Bench: A Multimodal Benchmark on Cross-Temporal Cultural Understanding and Transcreation. | Li Zhou, Lutong Yu, Dongchu Xie, Shaohuan Cheng, Wenyan Li, Haizhou Li |
| 2025 | ICASSP | MEIJU - The 1st Multimodal Emotion and Intent Joint Understanding Challenge. | Rui Liu, Xiaofen Xing, Zheng Lian, Haizhou Li, Bjrn W. Schuller, Haolin Zuo |
| 2025 | ICASSP | Speech Separation for Low-Resource Languages. | Marvin Borsdorf, Zexu Pan, Pascal Himmelmann, Haizhou Li, Tanja Schultz |
| 2025 | ICASSP | MacST: Multi-Accent Speech Synthesis via Text Transliteration for Accent Conversion. | Sho Inoue, Shuai Wang, Wanxing Wang, Pengcheng Zhu, Mengxiao Bi, Haizhou Li |
| 2025 | ICASSP | E1 TTS: Simple and Fast Non-Autoregressive TTS. | Zhijun Liu, Shuai Wang, Pengcheng Zhu, Mengxiao Bi, Haizhou Li |
| 2025 | ICASSP | ATGnet: Adaptive Temporal Graph Network for EEG-enabled Sound Source Tracking in Cocktail Party Scenarios. | Saurav Pahuja, Gabriel Ivucic, Siqi Cai, Dashanka De Silva, Tanja Schultz, Haizhou Li |
| 2025 | ICASSP | Multi-Level Speaker Representation for Target Speaker Extraction. | Ke Zhang, Junjie Li, Shuai Wang, Yangjie Wei, Yi Wang, Yannan Wang, Haizhou Li |
| 2025 | ICLR | Quantized Spike-driven Transformer. | Xuerui Qiu, Malu Zhang, Jieyuan Zhang, Wenjie Wei, Honglin Cao, Junsheng Guo, Rui-Jie Zhu, Yimeng Shan, Yang Yang, Haizhou Li |
| 2025 | IJCAI | Binary Event-Driven Spiking Transformer. | Honglin Cao, Zijian Zhou, Wenjie Wei, Yu Liang, Ammar Belatreche, Dehao Zhang, Malu Zhang, Yang Yang, Haizhou Li |
| 2025 | Interspeech | Towards Emotionally Consistent Text-Based Speech Editing: Introducing EmoCorrector and The ECD-TSE Dataset. | Rui Liu, Pu Gao, Jiatian Xi, Berrak Sisman, Carlos Busso, Haizhou Li |
| 2024 | AAAI | Emotion Rendering for Conversational Speech Synthesis with Heterogeneous Graph-Based Context Modeling. | Rui Liu, Yifan Hu, Yi Ren, Xiang Yin, Haizhou Li |
| 2024 | AAAI | Restoring Speaking Lips from Occlusion for Audio-Visual Speech Recognition. | Jiadong Wang, Zexu Pan, Malu Zhang, Robby T. Tan, Haizhou Li |
| 2024 | AAAI | A Comprehensive Analysis of the Effectiveness of Large Language Models as Automatic Dialogue Evaluators. | Chen Zhang, Luis Fernando D'Haro, Yiming Chen, Malu Zhang, Haizhou Li |
| 2024 | AAAI | TC-LIF: A Two-Compartment Spiking Neuron Model for Long-Term Sequential Modelling. | Shimin Zhang, Qu Yang, Chenxiang Ma, Jibin Wu, Haizhou Li, Kay Chen Tan |
| 2024 | ACL | Unveiling the Achilles' Heel of NLG Evaluators: A Unified Adversarial Framework Driven by Large Language Models. | Yiming Chen, Chen Zhang, Danqing Luo, Luis Fernando D'Haro, Robby T. Tan, Haizhou Li |
| 2024 | COLING | Uncovering the Potential of ChatGPT for Discourse Analysis in Dialogue: An Empirical Study. | Yaxin Fan, Feng Jiang, Peifeng Li, Haizhou Li |
| 2024 | COLING | Advancing Topic Segmentation and Outline Generation in Chinese Texts: The Paragraph-level Topic Representation, Corpus, and Benchmark. | Feng Jiang, Weihao Liu, Xiaomin Chu, Peifeng Li, Qiaoming Zhu, Haizhou Li |
| 2024 | COLING | CrossTune: Black-Box Few-Shot Classification with Label Enhancement. | Danqing Luo, Chen Zhang, Yan Zhang, Haizhou Li |
| 2024 | EMNLP | TS-Align: A Teacher-Student Collaborative Framework for Scalable Iterative Finetuning of Large Language Models. | Chen Zhang, Chengguang Tang, Dading Chong, Ke Shi, Guohua Tang, Feng Jiang, Haizhou Li |
| 2024 | EMNLP | Beyond Single-Audio: Advancing Multi-Audio Processing in Audio Large Language Models. | Yiming Chen, Xianghu Yue, Xiaoxue Gao, Chen Zhang, Luis Fernando D'Haro, Robby T. Tan, Haizhou Li |
| 2024 | EMNLP | DynaThink: Fast or Slow? A Dynamic Decision-Making Framework for Large Language Models. | Jiabao Pan, Yan Zhang, Chen Zhang, Zuozhu Liu, Hongwei Wang, Haizhou Li |
| 2024 | ICASSP | Robust Decoding of the Auditory Attention from EEG Recordings Through Graph Convolutional Networks. | Siqi Cai, Ran Zhang, Haizhou Li |
| 2024 | ICASSP | LOCSELECT: Target Speaker Localization with an Auditory Selective Hearing Mechanism. | Yu Chen, Xinyuan Qian, Zexu Pan, Kainan Chen, Haizhou Li |
| 2024 | ICASSP | Hierarchical Emotion Prediction and Control in Text-to-Speech Synthesis. | Sho Inoue, Kun Zhou, Shuai Wang, Haizhou Li |
| 2024 | ICASSP | Prompt-Driven Target Speech Diarization. | Yidi Jiang, Zhengyang Chen, Ruijie Tao, Liqun Deng, Yanmin Qian, Haizhou Li |
| 2024 | ICASSP | Audio-Visual Active Speaker Extraction for Sparsely Overlapped Multi-Talker Speech. | Junjie Li, Ruijie Tao, Zexu Pan, Meng Ge, Shuai Wang, Haizhou Li |
| 2024 | ICASSP | Gradient Weighting for Speaker Verification in Extremely Low Signal-to-Noise Ratio. | Yi Ma, Kong Aik Lee, Ville Hautamki, Meng Ge, Haizhou Li |
| 2024 | ICASSP | Spiking-Leaf: A Learnable Auditory Front-End for Spiking Neural Networks. | Zeyang Song, Jibin Wu, Malu Zhang, Mike Zheng Shou, Haizhou Li |
| 2024 | ICASSP | Leveraging in-the-wild Data for Effective Self-supervised Pretraining in Speaker Recognition. | Shuai Wang, Qibing Bai, Qi Liu, Jianwei Yu, Zhengyang Chen, Bing Han, Yanmin Qian, Haizhou Li |
| 2024 | ICASSP | SVAD: A Robust, Low-Power, and Light-Weight Voice Activity Detection with Spiking Neural Networks. | Qu Yang, Qianhui Liu, Nan Li, Meng Ge, Zeyang Song, Haizhou Li |
| 2024 | ICASSP | An Empirical Study on the Impact of Positional Encoding in Transformer-Based Monaural Speech Enhancement. | Qiquan Zhang, Meng Ge, Hongxu Zhu, Eliathamby Ambikairajah, Qi Song, Zhaoheng Ni, Haizhou Li |
| 2024 | ICONIP | Tailored Domain-Specific Summaries: A Two-Stage Method Combining Extractive and Abstractive Summarization Models. | Feng Jiang, Lingyi Yang, Yu Lu, Haizhou Li |
| 2024 | IJCAI | LitE-SNN: Designing Lightweight and Efficient Spiking Neural Network through Spatial-Temporal Compressive Network Search and Joint Optimization. | Qianhui Liu, Jiaqi Yan, Malu Zhang, Gang Pan, Haizhou Li |
| 2024 | IJCAI | Apprenticeship-Inspired Elegance: Synergistic Knowledge Distillation Empowers Spiking Neural Networks for Efficient Single-Eye Emotion Recognition. | Yang Wang, Haiyang Mei, Qirui Bao, Ziqi Wei, Mike Zheng Shou, Haizhou Li, Bo Dong, Xin Yang |
| 2024 | IJCNN | Target Speech Extraction with Pre-trained AV-HuBERT and Mask-And-Recover Strategy. | Wenxuan Wu, Xueyuan Chen, Xixin Wu, Haizhou Li, Helen Meng |
| 2024 | Interspeech | How Do Neural Spoofing Countermeasures Detect Partially Spoofed Audio? | Tianchi Liu, Lin Zhang, Rohan Kumar Das, Yi Ma, Ruijie Tao, Haizhou Li |
| 2024 | Interspeech | FluentEditor: Text-based Speech Editing by Considering Acoustic and Prosody Consistency. | Rui Liu, Jiatian Xi, Ziyue Jiang, Haizhou Li |
| 2023 | ACL | Dynamic Transformers Provide a False Sense of Efficiency. | Yiming Chen, Simin Chen, Zexin Li, Wei Yang, Cong Liu, Robby T. Tan, Haizhou Li |
| 2023 | CVPR | Minimizing the Accumulated Trajectory Error to Improve Dataset Distillation. | Jiawei Du, Yidi Jiang, Vincent Y. F. Tan, Joey Tianyi Zhou, Haizhou Li |
| 2023 | CVPR | Seeing What You Said: Talking Face Generation Guided by a Lip Reading Expert. | Jiadong Wang, Xinyuan Qian, Malu Zhang, Robby T. Tan, Haizhou Li |
| 2023 | EMNLP | How Well Do Text Embedding Models Understand Syntax? | Yan Zhang, Zhaopeng Feng, Zhiyang Teng, Zuozhu Liu, Haizhou Li |
| 2023 | EMNLP | HuatuoGPT, Towards Taming Language Model to Be a Doctor. | Hongbo Zhang, Junying Chen, Feng Jiang, Fei Yu, Zhihong Chen, Guiming Chen, Jianquan Li, Xiangbo Wu, Zhiyi Zhang, Qingying Xiao, Xiang Wan, Benyou Wang, Haizhou Li |
| 2023 | EMNLP | xDial-Eval: A Multilingual Open-Domain Dialogue Evaluation Benchmark. | Chen Zhang, Luis F. D'Haro, Chengguang Tang, Ke Shi, Guohua Tang, Haizhou Li |
| 2023 | ICASSP | Multi-Head Attention and GRU for Improved Match-Mismatch Classification of Speech Stimulus and EEG Response. | Marvin Borsdorf, Saurav Pahuja, Gabriel Ivucic, Siqi Cai, Haizhou Li, Tanja Schultz |
| 2023 | ICASSP | Self-Transriber: Few-Shot Lyrics Transcription With Self-Training. | Xiaoxue Gao, Xianghu Yue, Haizhou Li |
| 2023 | ICASSP | ImagineNet: Target Speaker Extraction with Intermittent Visual Cue Through Embedding Inpainting. | Zexu Pan, Wupeng Wang, Marvin Borsdorf, Haizhou Li |
| 2023 | ICASSP | Speaker Recognition with Two-Step Multi-Modal Deep Cleansing. | Ruijie Tao, Kong Aik Lee, Zhan Shi, Haizhou Li |
| 2023 | ICASSP | Token2vec: A Joint Self-Supervised Pre-Training Framework Using Unpaired Speech and Text. | Xianghu Yue, Junyi Ao, Xiaoxue Gao, Haizhou Li |
| 2023 | ICASSP | Ripple Sparse Self-Attention for Monaural Speech Enhancement. | Qiquan Zhang, Hongxu Zhu, Qi Song, Xinyuan Qian, Zhaoheng Ni, Haizhou Li |
| 2023 | ICASSP | Exploiting Modality-Invariant Feature for Robust Multimodal Emotion Recognition with Missing Modalities. | Haolin Zuo, Rui Liu, Jinming Zhao, Guanglai Gao, Haizhou Li |
| 2023 | IJCNN | Local and Global Context Modeling with Relation Matching Task for Dialog Act Recognition. | Yuke Si, Yan Zhang, Yuhang Li, Xiaobao Wang, Longbiao Wang, Jianwu Dang, Eng Siong Chng, Haizhou Li |
| 2022 | AAAI | MDD-Eval: Self-Training on Augmented Data for Multi-Domain Dialogue Evaluation. | Chen Zhang, Luis Fernando D'Haro, Thomas Friedrichs, Haizhou Li |
| 2022 | ACL | Just Rank: Rethinking Evaluation with Word and Sentence Similarities. | Bin Wang, C.-C. Jay Kuo, Haizhou Li |
| 2022 | ACL | M3ED: Multi-modal Multi-scene Multi-label Emotional Dialogue Database. | Jinming Zhao, Tenggan Zhang, Jingwen Hu, Yuchen Liu, Qin Jin, Xinchao Wang, Haizhou Li |
| 2022 | CVPR | Ego4D: Around the World in 3, 000 Hours of Egocentric Video. | Kristen Grauman, Andrew Westbury, Eugene Byrne, Zachary Chavis, Antonino Furnari, Rohit Girdhar, Jackson Hamburger, Hao Jiang, Miao Liu, Xingyu Liu, Miguel Martin, Tushar Nagarajan, Ilija Radosavovic, Santhosh Kumar Ramakrishnan, Fiona Ryan, Jayant Sharma, Michael Wray, Mengmeng Xu, Eric Zhongcong Xu, Chen Zhao, Siddhant Bansal, Dhruv Batra, Vincent Cartillier, Sean Crane, Tien Do, Morrie Doulaty, Akshay Erapalli, Christoph Feichtenhofer, Adriano Fragomeni, Qichen Fu, Abrham Gebreselasie, Cristina Gonzlez, James Hillis, Xuhua Huang, Yifei Huang, Wenqi Jia, Weslie Khoo, Jchym Kolr, Satwik Kottur, Anurag Kumar, Federico Landini, Chao Li, Yanghao Li, Zhenqiang Li, Karttikeya Mangalam, Raghava Modhugu, Jonathan Munro, Tullie Murrell, Takumi Nishiyasu, Will Price, Paola Ruiz Puentes, Merey Ramazanova, Leda Sari, Kiran K. Somasundaram, Audrey Southerland, Yusuke Sugano, Ruijie Tao, Minh Vo, Yuchen Wang, Xindi Wu, Takuma Yagi, Ziwei Zhao, Yunyi Zhu, Pablo Arbelez, David Crandall, Dima Damen, Giovanni Maria Farinella, Christian Fuegen, Bernard Ghanem, Vamsi Krishna Ithapu, C. V. Jawahar, Hanbyul Joo, Kris Kitani, Haizhou Li, Richard A. Newcombe, Aude Oliva, Hyun Soo Park, James M. Rehg, Yoichi Sato, Jianbo Shi, Mike Zheng Shou, Antonio Torralba, Lorenzo Torresani, Mingfei Yan, Jitendra Malik |
| 2022 | EMNLP | Generate, Discriminate and Contrast: A Semi-Supervised Sentence Representation Learning Framework. | Yiming Chen, Yan Zhang, Bin Wang, Zuozhu Liu, Haizhou Li |
| 2022 | EMNLP | Analyzing and Evaluating Faithfulness in Dialogue Summarization. | Bin Wang, Chen Zhang, Yan Zhang, Yiming Chen, Haizhou Li |
| 2022 | EMNLP | FineD-Eval: Fine-grained Automatic Dialogue-Level Evaluation. | Chen Zhang, Luis Fernando D'Haro, Qiquan Zhang, Thomas Friedrichs, Haizhou Li |
| 2022 | ICASSP | Experts Versus All-Rounders: Target Language Extraction for Multiple Target Languages. | Marvin Borsdorf, Kevin Scheck, Haizhou Li, Tanja Schultz |
| 2022 | ICASSP | Genre-Conditioned Acoustic Models for Automatic Lyrics Transcription of Polyphonic Music. | Xiaoxue Gao, Chitralekha Gupta, Haizhou Li |
| 2022 | ICASSP | L-SpEx: Localized Target Speaker Extraction. | Meng Ge, Chenglin Xu, Longbiao Wang, Eng Siong Chng, Jianwu Dang, Haizhou Li |
| 2022 | ICASSP | MFA: TDNN with Multi-Scale Frequency-Channel Attention for Text-Independent Speaker Verification with Short Utterances. | Tianchi Liu, Rohan Kumar Das, Kong Aik Lee, Haizhou Li |
| 2022 | ICASSP | Visualtts: TTS with Accurate Lip-Speech Synchronization for Automatic Voice Over. | Junchen Lu, Berrak Sisman, Rui Liu, Mingyang Zhang, Haizhou Li |
| 2022 | ICASSP | Self-Supervised Speaker Recognition with Loss-Gated Learning. | Ruijie Tao, Kong Aik Lee, Rohan Kumar Das, Ville Hautamki, Haizhou Li |
| 2022 | ICASSP | A Hybrid Learning Framework for Deep Spiking Neural Networks with One-Spike Temporal Coding. | Jiadong Wang, Jibin Wu, Malu Zhang, Qi Liu, Haizhou Li |
| 2022 | ICASSP | ADD 2022: the first Audio Deep Synthesis Detection Challenge. | Jiangyan Yi, Ruibo Fu, Jianhua Tao, Shuai Nie, Haoxin Ma, Chenglong Wang, Tao Wang, Zhengkun Tian, Ye Bai, Cunhang Fan, Shan Liang, Shiming Wang, Shuai Zhang, Xinrui Yan, Le Xu, Zhengqi Wen, Haizhou Li |
| 2022 | ICASSP | Time-Frequency Attention for Monaural Speech Enhancement. | Qiquan Zhang, Qi Song, Zhaoheng Ni, Aaron Nicolson, Haizhou Li |
| 2022 | ICASSP | Memobert: Pre-Training Model with Prompt-Based Learning for Multimodal Emotion Recognition. | Jinming Zhao, Ruichen Li, Qin Jin, Xinchao Wang, Haizhou Li |
| 2022 | Interspeech | Accurate Emotion Strength Assessment for Seen and Unseen Speech Based on Data-Driven Deep Learning. | Rui Liu, Berrak Sisman, Bjrn W. Schuller, Guanglai Gao, Haizhou Li |
| 2021 | ACL | Bootstrapped Unsupervised Sentence Representation Learning. | Yan Zhang, Ruidan He, Zuozhu Liu, Lidong Bing, Haizhou Li |
| 2021 | ACL | DynaEval: Unifying Turn and Dialogue Level Evaluation. | Chen Zhang, Yiming Chen, Luis Fernando D'Haro, Yan Zhang, Thomas Friedrichs, Grandee Lee, Haizhou Li |
| 2021 | ASRU | Target Language Extraction at Multilingual Cocktail Parties. | Marvin Borsdorf, Haizhou Li, Tanja Schultz |
| 2021 | ASRU | Expressive Voice Conversion: A Joint Framework for Speaker Identity and Emotional Style Transfer. | Zongyang Du, Berrak Sisman, Kun Zhou, Haizhou Li |
| 2021 | ASRU | PL-EESR: Perceptual Loss Based End-to-End Robust Speaker Representation Extraction. | Yi Ma, Kong Aik Lee, Ville Hautamki, Haizhou Li |
| 2021 | ASRU | DEEPA: A Deep Neural Analyzer for Speech and Singing Vocoding. | Sergey Nikonorov, Berrak Sisman, Mingyang Zhang, Haizhou Li |
| 2021 | ASRU | Exploring Teacher-Student Learning Approach for Multi-Lingual Speech-to-Intent Classification. | Bidisha Sharma, Maulik C. Madhavi, Xuehao Zhou, Haizhou Li |
| 2021 | EMNLP | Revisiting Self-training for Few-shot Learning of Language Model. | Yiming Chen, Yan Zhang, Chen Zhang, Grandee Lee, Ran Cheng, Haizhou Li |
| 2021 | ICASSP | Graphspeech: Syntax-Aware Graph Attention Network for Neural Speech Synthesis. | Rui Liu, Berrak Sisman, Haizhou Li |
| 2021 | ICASSP | Data Augmentation with Signal Companding for Detection of Logical Access Attacks. | Rohan Kumar Das, Jichen Yang, Haizhou Li |
| 2021 | ICASSP | Multi-Stage Speaker Extraction with Utterance and Frame-Level Reference Signals. | Meng Ge, Chenglin Xu, Longbiao Wang, Eng Siong Chng, Jianwu Dang, Haizhou Li |
| 2021 | ICASSP | Representation Learning with Spectro-Temporal-Channel Attention for Speech Emotion Recognition. | Lili Guo, Longbiao Wang, Chenglin Xu, Jianwu Dang, Eng Siong Chng, Haizhou Li |
| 2021 | ICASSP | Learning Disentangled Feature Representations for Speech Enhancement Via Adversarial Training. | Nana Hou, Chenglin Xu, Eng Siong Chng, Haizhou Li |
| 2021 | ICASSP | Muse: Multi-Modal Target Speaker Extraction with Visual Cues. | Zexu Pan, Ruijie Tao, Chenglin Xu, Haizhou Li |
| 2021 | ICASSP | Multi-Target DoA Estimation with an Audio-Visual Fusion Mechanism. | Xinyuan Qian, Maulik C. Madhavi, Zexu Pan, Jiadong Wang, Haizhou Li |
| 2021 | ICASSP | Leveraging Acoustic and Linguistic Embeddings from Pretrained Speech and Language Models for Intent Classification. | Bidisha Sharma, Maulik C. Madhavi, Haizhou Li |
| 2021 | ICASSP | The Multi-Speaker Multi-Style Voice Cloning Challenge 2021. | Qicong Xie, Xiaohai Tian, Guanghou Liu, Kun Song, Lei Xie, Zhiyong Wu, Hai Li, Song Shi, Haizhou Li, Fen Hong, Hui Bu, Xin Xu |
| 2021 | ICASSP | Seen and Unseen Emotional Style Transfer for Voice Conversion with A New Emotional Speech Dataset. | Kun Zhou, Berrak Sisman, Rui Liu, Haizhou Li |
| 2021 | ICML | Accumulated Decoupled Learning with Gradient Staleness Mitigation for Convolutional Neural Networks. | Huiping Zhuang, Zhenyu Weng, Fulin Luo, Kar-Ann Toj, Haizhou Li, Zhiping Lin |
| 2021 | IJCNN | Rethinking Benchmarks for Neuromorphic Learning Algorithms. | Qu Yang, Jibin Wu, Haizhou Li |
| 2021 | Interspeech | Reinforcement Learning for Emotional Text-to-Speech Synthesis with Improved Emotion Discriminability. | Rui Liu, Berrak Sisman, Haizhou Li |
| 2020 | ACL | Modeling Code-Switch Languages Using Bilingual Parallel Corpus. | Grandee Lee, Haizhou Li |
| 2020 | ICARCV | Robust Real-time Face Tracking for People Wearing Face Masks. | Xinggan Peng, Huiping Zhuang, Guang-Bin Huang, Haizhou Li, Zhiping Lin |
| 2020 | ICARCV | Real-Time Multiple Object Tracking with Discriminative Features. | Zhenyu Weng, Yuesheng Zhu, Zhiping Lin, Haizhou Li |
| 2020 | ICASSP | Teacher-Student Training For Robust Tacotron-Based TTS. | Rui Liu, Berrak Sisman, Jingdong Li, Feilong Bao, Guanglai Gao, Haizhou Li |
| 2020 | ICASSP | On the Importance of Vocal Tract Constriction for Speaker Characterization: The Whispered Speech Study. | Rohan Kumar Das, Haizhou Li |
| 2020 | ICASSP | Assessing the Scope of Generalized Countermeasures for Anti-Spoofing. | Rohan Kumar Das, Jichen Yang, Haizhou Li |
| 2020 | ICASSP | Effective Wavenet Adaptation for Voice Conversion with Limited Data. | Hongqiang Du, Xiaohai Tian, Lei Xie, Haizhou Li |
| 2020 | ICASSP | Automatic Lyrics Alignment and Transcription in Polyphonic Music: Does Background Music Help? | Chitralekha Gupta, Emre Yilmaz, Haizhou Li |
| 2020 | ICASSP | Time-Domain Neural Network Approach for Speech Bandwidth Extension. | Xiang Hao, Chenglin Xu, Nana Hou, Lei Xie, Eng Siong Chng, Haizhou Li |
| 2020 | ICASSP | Independent Language Modeling Architecture for End-To-End ASR. | Van Tung Pham, Haihua Xu, Yerbolat Khassanov, Zhiping Zeng, Eng Siong Chng, Chongjia Ni, Bin Ma, Haizhou Li |
| 2020 | ICASSP | End-to-End Code-Switching TTS with Cross-Lingual Language Model. | Xuehao Zhou, Xiaohai Tian, Grandee Lee, Rohan Kumar Das, Haizhou Li |
| 2020 | Interspeech | Speaker-Utterance Dual Attention for Speaker and Utterance Verification. | Tianchi Liu, Rohan Kumar Das, Maulik C. Madhavi, Shengmei Shen, Haizhou Li |
| 2019 | AAAI | MPD-AL: An Efficient Membrane Potential Driven Aggregate-Label Learning Algorithm for Spiking Neurons. | Malu Zhang, Jibin Wu, Yansong Chua, Xiaoling Luo, Zihan Pan, Dan Liu, Haizhou Li |
| 2019 | ASRU | Long Range Acoustic and Deep Features Perspective on ASVspoof 2019. | Rohan Kumar Das, Jichen Yang, Haizhou Li |
| 2019 | ASRU | WaveNet Factorization with Singular Value Decomposition for Voice Conversion. | Hongqiang Du, Xiaohai Tian, Lei Xie, Haizhou Li |
| 2019 | ASRU | On the Study of Generative Adversarial Networks for Cross-Lingual Voice Conversion. | Berrak Sisman, Mingyang Zhang, Minghui Dong, Haizhou Li |
| 2019 | ASRU | Time-Domain Speaker Extraction Network. | Chenglin Xu, Wei Rao, Eng Siong Chng, Haizhou Li |
| 2019 | ASRU | End-to-End Code-Switching ASR for Low-Resourced Language Pairs. | Xianghu Yue, Grandee Lee, Emre Yilmaz, Fang Deng, Haizhou Li |
| 2019 | ASRU | A Modularized Neural Network with Language-Specific Output Layers for Cross-Lingual Voice Conversion. | Yi Zhou, Xiaohai Tian, Emre Yilmaz, Rohan Kumar Das, Haizhou Li |
| 2019 | ICASSP | Word and Class Common Space Embedding for Code-switch Language Modelling. | Grandee Lee, Haizhou Li |
| 2019 | ICASSP | Automatic Lyrics-to-audio Alignment on Polyphonic Music Using Singing-adapted Acoustic Models. | Bidisha Sharma, Chitralekha Gupta, Haizhou Li, Ye Wang |
| 2019 | ICASSP | Auditory Inspired Spatial Differentiation for Replay Spoofing Attack Detection. | Buddhi Wickramasinghe, Eliathamby Ambikairajah, Julien Epps, Vidhyasaharan Sethu, Haizhou Li |
| 2019 | ICASSP | Optimization of Speaker Extraction Neural Network with Magnitude and Temporal Spectrum Approximation Loss. | Chenglin Xu, Wei Rao, Eng Siong Chng, Haizhou Li |
| 2019 | ICASSP | Cross-lingual Voice Conversion with Bilingual Phonetic Posteriorgram and Average Modeling. | Yi Zhou, Xiaohai Tian, Haihua Xu, Rohan Kumar Das, Haizhou Li |
| 2019 | IJCNN | Neural Population Coding for Effective Temporal Classification. | Zihan Pan, Jibin Wu, Malu Zhang, Haizhou Li, Yansong Chua |
| 2019 | IJCNN | Deep Spiking Neural Network with Spike Count based Learning Rule. | Jibin Wu, Yansong Chua, Malu Zhang, Qu Yang, Guoqi Li, Haizhou Li |
| 2019 | IJCNN | Competitive STDP-based Feature Representation Learning for Sound Event Classification. | Jibin Wu, Malu Zhang, Haizhou Li, Yansong Chua |
| 2019 | Interspeech | Joint Training Framework for Text-to-Speech and Voice Conversion Using Multi-Source Tacotron and WaveNet. | Mingyang Zhang, Xin Wang, Fuming Fang, Haizhou Li, Junichi Yamagishi |
| 2018 | ICASSP | End-to-End Hierarchical Language Identification System. | Saad Irtza, Vidhyasaharan Sethu, Eliathamby Ambikairajah, Haizhou Li |
| 2018 | ICASSP | On the Importance of Analytic Phase of Speech Signals in Spoken Language Recognition. | Karthika Vijayan, Haizhou Li, Hanwu Sun, Kong-Aik Lee |
| 2018 | ICASSP | Unsupervised Domain Adaptation via Domain Adversarial Training for Speaker Recognition. | Qing Wang, Wei Rao, Sining Sun, Lei Xie, Eng Siong Chng, Haizhou Li |
| 2018 | ICASSP | Single Channel Speech Separation with Constrained Utterance Level Permutation Invariant Training Using Grid LSTM. | Chenglin Xu, Wei Rao, Xiong Xiao, Eng Siong Chng, Haizhou Li |
| 2018 | IJCNN | An Event-Based Cochlear Filter Temporal Encoding Scheme for Speech Signals. | Zihan Pan, Haizhou Li, Jibin Wu, Yansong Chua |
| 2018 | IJCNN | A Biologically Plausible Speech Recognition Framework Based on Spiking Neural Networks. | Jibin Wu, Yansong Chua, Haizhou Li |
| 2017 | ASRU | Multilingual bottle-neck feature learning from untranscribed speech. | Hongjie Chen, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |
| 2017 | ASRU | Sparse representation of phonetic features for voice conversion with and without parallel data. | Berrak Sisman, Haizhou Li, Kay Chen Tan |
| 2017 | ASRU | Statistical parametric speech synthesis using generative adversarial networks under a multi-task learning framework. | Shan Yang, Lei Xie, Xiao Chen, Xiaoyan Lou, Xuan Zhu, Dongyan Huang, Haizhou Li |
| 2017 | ASRU | Extracting bottleneck features and word-like pairs from untranscribed speech for feature representation. | Yougen Yuan, Cheung-Chi Leung, Lei Xie, Hongjie Chen, Bin Ma, Haizhou Li |
| 2017 | ETFA | A data-driven prognostics framework for tool remaining useful life estimation in tool condition monitoring. | Chong Zhang, Geok Soon Hong, Huan Xu, Kay Chen Tan, Jun-Hong Zhou, Hian-Leng Chan, Haizhou Li |
| 2017 | ICASSP | Adaptation of PLDA for multi-source text-independent speaker verification. | Liping Chen, Kong-Aik Lee, Bin Ma, Long Ma, Haizhou Li, Li-Rong Dai |
| 2017 | ICASSP | On time-frequency mask estimation for MVDR beamforming with application in robust speech recognition. | Xiong Xiao, Shengkui Zhao, Douglas L. Jones, Eng Siong Chng, Haizhou Li |
| 2017 | ICASSP | Pairwise learning using multi-lingual bottleneck features for low-resource query-by-example spoken term detection. | Yougen Yuan, Cheung-Chi Leung, Lei Xie, Hongjie Chen, Bin Ma, Haizhou Li |
| 2016 | ACL | Exploring Convolutional and Recurrent Neural Networks in Sequential Labelling for Dialogue Topic Tracking. | Seokhwan Kim, Rafael E. Banchs, Haizhou Li |
| 2016 | ICASSP | Content-aware local variability vector for speaker verification with short utterance. | Liping Chen, Kong-Aik Lee, Eng Siong Chng, Bin Ma, Haizhou Li, Li-Rong Dai |
| 2016 | ICASSP | Exemplar-inspired strategies for low-resource spoken keyword search in Swahili. | Nancy F. Chen, Van Tung Pham, Haihua Xu, Xiong Xiao, Van Hai Do, Chongjia Ni, I-Fan Chen, Sunil Sivadas, Chin-Hui Lee, Eng Siong Chng, Bin Ma, Haizhou Li |
| 2016 | ICASSP | Combining multiple kernel models for automatic intelligibility detection of pathological speech. | Dong-Yan Huang, Minghui Dong, Haizhou Li |
| 2016 | ICASSP | A hierarchical framework for language identification. | Saad Irtza, Vidhyasaharan Sethu, Haris Bavattichalil, Eliathamby Ambikairajah, Haizhou Li |
| 2016 | ICASSP | Exemplar-based sparse representation of timbre and prosody for voice conversion. | Huaiping Ming, Dong-Yan Huang, Lei Xie, Shaofei Zhang, Minghui Dong, Haizhou Li |
| 2016 | ICASSP | Cross-lingual deep neural network based submodular unbiased data selection for low-resource keyword search. | Chongjia Ni, Cheung-Chi Leung, Lei Wang, Haibo Liu, Feng Rao, Li Lu, Nancy F. Chen, Bin Ma, Haizhou Li |
| 2016 | ICASSP | Keyword search using query expansion for graph-based rescoring of hypothesized detections. | Van Tung Pham, Haihua Xu, Xiong Xiao, Nancy F. Chen, Eng Siong Chng, Haizhou Li |
| 2016 | ICASSP | Spoofing detection from a feature representation perspective. | Xiaohai Tian, Zhizheng Wu, Xiong Xiao, Eng Siong Chng, Haizhou Li |
| 2016 | ICASSP | An expectation-maximization eigenvector clustering approach to direction of arrival estimation of multiple speech sources. | Xiong Xiao, Shengkui Zhao, Thi Ngoc Tho Nguyen, Douglas L. Jones, Eng Siong Chng, Haizhou Li |
| 2016 | ICASSP | Approximate search of audio queries by using DTW with phone time boundary and data augmentation. | Haihua Xu, Jingyong Hou, Xiong Xiao, Van Tung Pham, Cheung-Chi Leung, Lei Wang, Van Hai Do, Hang Lv, Lei Xie, Bin Ma, Eng Siong Chng, Haizhou Li |
| 2016 | ICMI | Audio and face video emotion recognition in the wild using deep neural networks and small datasets. | Wan Ding, Mingyu Xu, Dong-Yan Huang, Weisi Lin, Minghui Dong, Xinguo Yu, Haizhou Li |
| 2015 | AAAI | An Entorhinal-Hippocampal Model for Simultaneous Cognitive Map Building. | Miaolong Yuan, Bo Tian, Vui Ann Shim, Huajin Tang, Haizhou Li |
| 2015 | ACII | Fundamental frequency modeling using wavelets for emotional voice conversion. | Huaiping Ming, Dong-Yan Huang, Minghui Dong, Haizhou Li, Lei Xie, Shaofei Zhang |
| 2015 | ASRU | Robust speech recognition using beamforming with adaptive microphone gains and multichannel noise reduction. | Shengkui Zhao, Xiong Xiao, Zhaofeng Zhang, Thi Ngoc Tho Nguyen, Xionghu Zhong, Bo Ren, Longbiao Wang, Douglas L. Jones, Engsiong Chng, Haizhou Li |
| 2015 | EMNLP | Wikification of Concept Mentions within Spoken Dialogues Using Domain Constraints from Wikipedia. | Seokhwan Kim, Rafael E. Banchs, Haizhou Li |
| 2015 | ICASSP | Channel adaptation of plda for text-independent speaker verification. | Liping Chen, Kong-Aik Lee, Bin Ma, Wu Guo, Haizhou Li, Li-Rong Dai |
| 2015 | ICASSP | Low-resource keyword search strategies for tamil. | Nancy F. Chen, Chongjia Ni, I-Fan Chen, Sunil Sivadas, Van Tung Pham, Haihua Xu, Xiong Xiao, Tze Siong Lau, Su Jun Leow, Boon Pang Lim, Cheung-Chi Leung, Lei Wang, Chin-Hui Lee, Alvina Goh, Engsiong Chng, Bin Ma, Haizhou Li |
| 2015 | ICASSP | Combining robust spike coding with spiking neural networks for sound event classification. | Jonathan William Dennis, Tran Huy Dat, Haizhou Li |
| 2015 | ICASSP | Source-specific informative prior for i-vector extraction. | Sven Ewan Shepstone, Kong-Aik Lee, Haizhou Li, Zheng-Hua Tan, Sren Holdt Jensen |
| 2015 | ICASSP | Tokenizing fundamental frequency variation for Mandarin tone error detection. | Rong Tong, Nancy F. Chen, Boon Pang Lim, Bin Ma, Haizhou Li |
| 2015 | ICASSP | A learning-based approach to direction of arrival estimation in noisy and reverberant environments. | Xiong Xiao, Shengkui Zhao, Xionghu Zhong, Douglas L. Jones, Engsiong Chng, Haizhou Li |
| 2015 | ICASSP | Language independent query-by-example spoken term detection using N-best phone sequences and partial matching. | Haihua Xu, Peng Yang, Xiong Xiao, Lei Xie, Cheung-Chi Leung, Hongjie Chen, Jia Yu, Hang Lv, Lei Wang, Su Jun Leow, Bin Ma, Engsiong Chng, Haizhou Li |
| 2014 | ACL | A Composite Kernel Approach for Dialog Topic Tracking with Structured Domain Knowledge from Wikipedia. | Seokhwan Kim, Rafael E. Banchs, Haizhou Li |
| 2014 | ICASSP | Minimum divergence estimation of speaker prior in multi-session PLDA scoring. | Liping Chen, Kong-Aik Lee, Bin Ma, Wu Guo, Haizhou Li, Li-Rong Dai |
| 2014 | ICASSP | Strategies for Vietnamese keyword search. | Nancy F. Chen, Sunil Sivadas, Boon Pang Lim, Hoang Gia Ngo, Haihua Xu, Van Tung Pham, Bin Ma, Haizhou Li |
| 2014 | ICASSP | Improving language modeling by using distance and co-occurrence information of word-pairs and its application to LVCSR. | Tze Yuang Chong, Rafael E. Banchs, Engsiong Chng, Haizhou Li |
| 2014 | ICASSP | A discriminatively trained Hough Transform for frame-level phoneme recognition. | Jonathan William Dennis, Tran Huy Dat, Haizhou Li, Engsiong Chng |
| 2014 | ICASSP | Intelligibility detection of pathological speech using asymmetric sparse kernel partial least squares classifier. | Dong-Yan Huang, Minghui Dong, Haizhou Li |
| 2014 | ICASSP | Wikipedia-based Kernels for dialogue topic tracking. | Seokhwan Kim, Rafael E. Banchs, Haizhou Li |
| 2014 | ICASSP | Modelling the alternative hypothesis for text-dependent speaker verification. | Anthony Larcher, Kong-Aik Lee, Bin Ma, Haizhou Li |
| 2014 | ICASSP | Imposture classification for text-dependent speaker verification. | Anthony Larcher, Kong-Aik Lee, Bin Ma, Haizhou Li |
| 2014 | ICASSP | Generalization of temporal filter and linear transformation for robust speech recognition. | Duc Hoang Ha Nguyen, Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2014 | ICASSP | Discriminative score normalization for keyword search decision. | Van Tung Pham, Haihua Xu, Nancy F. Chen, Sunil Sivadas, Boon Pang Lim, Engsiong Chng, Haizhou Li |
| 2014 | ICASSP | Subspace Gaussian mixture model for computer-assisted language learning. | Rong Tong, Boon Pang Lim, Nancy F. Chen, Bin Ma, Haizhou Li |
| 2014 | ICASSP | Feature compensation using linear combination of speaker and environment dependent correction vectors. | Xiong Xiao, Jinyu Li, Engsiong Chng, Haizhou Li |
| 2013 | ACL | Modeling of term-distance and term-occurrence information for improving n-gram language model performance. | Tze Yuang Chong, Rafael E. Banchs, Engsiong Chng, Haizhou Li |
| 2013 | ACL | Broadcast News Story Segmentation Using Manifold Learning on Latent Topic Distributions. | Xiaoming Lu, Lei Xie, Cheung-Chi Leung, Bin Ma, Haizhou Li |
| 2013 | ICASSP | Recurrent neural network language modeling for code switching conversational speech. | Heike Adel, Ngoc Thang Vu, Franziska Kraus, Tim Schlippe, Haizhou Li, Tanja Schultz |
| 2013 | ICASSP | Minimal-resource phonetic language models to summarize untranscribed speech. | Nancy F. Chen, Bin Ma, Haizhou Li |
| 2013 | ICASSP | Temporal coding of local spectrogram features for robust sound recognition. | Jonathan William Dennis, Qiang Yu, Huajin Tang, Tran Huy Dat, Haizhou Li |
| 2013 | ICASSP | Phonetically-constrained PLDA modeling for text-dependent speaker verification with multiple short utterances. | Anthony Larcher, Kong-Aik Lee, Bin Ma, Haizhou Li |
| 2013 | ICASSP | Broadcast news story segmentation using latent topics on data manifold. | Xiaoming Lu, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |
| 2013 | ICASSP | Language diarization for code-switch conversational speech. | Dau-Cheng Lyu, Engsiong Chng, Haizhou Li |
| 2013 | ICASSP | Using parallel tokenizers with DTW matrix combination for low-resource spoken term detection. | Haipeng Wang, Tan Lee, Cheung-Chi Leung, Bin Ma, Haizhou Li |
| 2013 | ICASSP | Synthetic speech detection using temporal modulation feature. | Zhizheng Wu, Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2013 | ICASSP | Temporal filter design by minimum KL divergence criterion for robust speech recognition. | Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2013 | ICASSP | A study on GMM-SVM with adaptive relevance factor and its comparison with i-vector and JFA for speaker recognition. | Chang Huai You, Haizhou Li, Bin Ma, Kong-Aik Lee |
| 2012 | ACL | IRIS: a Chat-oriented Dialogue System based on the Vector Space Model. | Rafael E. Banchs, Haizhou Li |
| 2012 | ACL | Utilizing Dependency Language Models for Graph-based Dependency Parsing Models. | Wenliang Chen, Min Zhang, Haizhou Li |
| 2012 | ACL | Modeling the Translation of Predicate-Argument Structure for SMT. | Deyi Xiong, Min Zhang, Haizhou Li |
| 2012 | HRI | Vision-based attention estimation and selection for social robot to perform natural interaction in the open world. | Liyuan Li, Xinguo Yu, Jun Li, Gang S. Wang, Ji Yu Shi, Yeow Kee Tan, Haizhou Li |
| 2012 | ICASSP | Vulnerability of speaker verification systems against voice conversion spoofing attacks: The case of telephone speech. | Tomi Kinnunen, Zhizheng Wu, Kong-Aik Lee, Filip Sedlak, Engsiong Chng, Haizhou Li |
| 2012 | ICASSP | I-vectors in the context of phonetically-constrained short utterances for speaker verification. | Anthony Larcher, Pierre-Michel Bousquet, Kong-Aik Lee, Driss Matrouf, Haizhou Li, Jean-Franois Bonastre |
| 2012 | ICASSP | Generalized F0 modelling with absolute and relative pitch features for singing voice synthesis. | Siu Wa Lee, Shen Ting Ang, Minghui Dong, Haizhou Li |
| 2012 | ICASSP | A bootstrapping approach for SLU portability to a new language by inducting unannotated user queries. | Teruhisa Misu, Etsuo Mizukami, Hideki Kashioka, Satoshi Nakamura, Haizhou Li |
| 2012 | ICASSP | A first speech recognition system for Mandarin-English code-switch conversational speech. | Ngoc Thang Vu, Dau-Cheng Lyu, Jochen Weiner, Dominic Telaar, Tim Schlippe, Fabian Blaicher, Engsiong Chng, Tanja Schultz, Haizhou Li |
| 2012 | ICASSP | An acoustic segment modeling approach to query-by-example spoken term detection. | Haipeng Wang, Cheung-Chi Leung, Tan Lee, Bin Ma, Haizhou Li |
| 2012 | ICASSP | Joint spectral and temporal normalization of features for robust recognition of noisy and reverberated speech. | Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2012 | ICASSP | Lasso environment model combination for robust speech recognition. | Xiong Xiao, Jinyu Li, Engsiong Chng, Haizhou Li |
| 2012 | ICASSP | Acoustic TextTiling for story segmentation of spoken documents. | Lilei Zheng, Cheung-Chi Leung, Lei Xie, Bin Ma, Haizhou Li |
| 2011 | ACL | AM-FM: A Semantic Framework for Translation Quality Assessment. | Rafael E. Banchs, Haizhou Li |
| 2011 | ACL | Enhancing Language Models in Statistical Machine Translation with Backward N-grams and Mutual Information Triggers. | Deyi Xiong, Min Zhang, Haizhou Li |
| 2011 | CIKM | A cross-domain adaptation method for sentiment classification using probabilistic latent analysis. | Sheng Gao, Haizhou Li |
| 2011 | DASFAA | Design Non-recursive and Redundant-Free XML Conceptual Schema with Hypergraph (Extended Abstract). | Joseph Fong, Wai Yin Mok, Haizhou Li |
| 2011 | EMNLP | SMT Helps Bitext Dependency Parsing. | Wenliang Chen, Jun'ichi Kazama, Min Zhang, Yoshimasa Tsuruoka, Yujie Zhang, Yiou Wang, Kentaro Torisawa, Haizhou Li |
| 2011 | EMNLP | Joint Models for Chinese POS Tagging and Dependency Parsing. | Zhenghua Li, Min Zhang, Wanxiang Che, Ting Liu, Wenliang Chen, Haizhou Li |
| 2011 | ICASSP | Probabilistic distance SVM with Hellinger-Exponential Kernel for sound event classification. | Tran Huy Dat, Haizhou Li |
| 2011 | ICASSP | Jump Function Kolmogorov for overlapping audio event classification. | Tran Huy Dat, Haizhou Li |
| 2011 | ICASSP | Score fusion and calibration in multiple language detectors with large performance variation. | Raymond W. M. Ng, Cheung-Chi Leung, Tan Lee, Bin Ma, Haizhou Li |
| 2011 | ICASSP | Classifier subset selection and fusion for speaker verification. | Filip Sedlak, Tomi Kinnunen, Ville Hautamki, Kong-Aik Lee, Haizhou Li |
| 2011 | ICASSP | Factored covariance modeling for text-independent speaker verification. | Eryu Wang, Kong-Aik Lee, Bin Ma, Haizhou Li, Wu Guo, Li-Rong Dai |
| 2011 | ICASSP | Maximum likelihood adaptation of histogram equalization with constraint for robust speech recognition. | Xiong Xiao, Jinyu Li, Engsiong Chng, Haizhou Li |
| 2011 | IJCNLP | CLGVSM: Adapting Generalized Vector Space Model to Cross-lingual Document Clustering. | Guoyu Tang, Yunqing Xia, Min Zhang, Haizhou Li, Fang Zheng |
| 2011 | IJCNLP | Joint Alignment and Artificial Data Generation: An Empirical Study of Pivot-based Machine Transliteration. | Min Zhang, Xiangyu Duan, Ming Liu, Yunqing Xia, Haizhou Li |
| 2010 | ACL | Pseudo-Word for Phrase-Based Machine Translation. | Xiangyu Duan, Min Zhang, Haizhou Li |
| 2010 | ACL | Error Detection for Statistical Machine Translation Using Linguistic Features. | Deyi Xiong, Min Zhang, Haizhou Li |
| 2010 | ACL | Convolution Kernel over Packed Parse Forest. | Min Zhang, Hui Zhang, Haizhou Li |
| 2010 | COLING | EM-based Hybrid Model for Bilingual Terminology Extraction from Comparable Corpora. | Lianhau Lee, AiTi Aw, Min Zhang, Haizhou Li |
| 2010 | COLING | Improving Name Origin Recognition with Context Features and Unlabelled Data. | Vladimir Pervouchine, Min Zhang, Ming Liu, Haizhou Li |
| 2010 | COLING | Machine Transliteration: Leveraging on Third Languages. | Min Zhang, Xiangyu Duan, Vladimir Pervouchine, Haizhou Li |
| 2010 | EMNLP | Non-Isomorphic Forest Pair Translation. | Hui Zhang, Min Zhang, Haizhou Li, Engsiong Chng |
| 2010 | ICASSP | Semi-supervised learning of language model using unsupervised topic model. | Shuanhu Bai, Chien-Lin Huang, Bin Ma, Haizhou Li |
| 2010 | ICASSP | Feature integration for heart sound biometrics. | Tran Huy Dat, Yi Ren Leng, Haizhou Li |
| 2010 | ICASSP | Error corrective classifier fusion for spoken Language Recognition. | Omid Dehzangi, Bin Ma, Engsiong Chng, Haizhou Li |
| 2010 | ICASSP | Tuning phone decoders for language identification. | C. Santhosh Kumar, Haizhou Li, Rong Tong, Pavel Matejka, Luks Burget, Jan Cernock |
| 2010 | ICASSP | Prosodic attribute model for spoken language identification. | Raymond W. M. Ng, Cheung-Chi Leung, Tan Lee, Bin Ma, Haizhou Li |
| 2010 | ICASSP | Speaker diarization system for RT07 and RT09 meeting room audio. | Hanwu Sun, Bin Ma, Swe Zin Kalayar Khine, Haizhou Li |
| 2010 | ICASSP | An acoustic segment model approach to incorporating temporal information into speaker modeling for text-independent speaker recognition. | Yu Tsao, Hanwu Sun, Haizhou Li, Chin-Hui Lee |
| 2010 | ICASSP | Soft margin estimation of Gaussian mixture model parameters for spoken language recognition. | Donglai Zhu, Bin Ma, Haizhou Li |
| 2010 | ICPR | Framewise Phone Classification Using Weighted Fuzzy Classification Rules. | Omid Dehzangi, Bin Ma, Engsiong Chng, Haizhou Li |
| 2009 | ACL | A Comparative Study of Hypothesis Alignment and its Improvement for Machine Translation System Combination. | Boxing Chen, Min Zhang, Haizhou Li, AiTi Aw |
| 2009 | ACL | MARS: Multilingual Access and Retrieval System with Enhanced Query Translation and Document Retrieval. | Lianhau Lee, AiTi Aw, Thuy Vu, Sharifah Aljunied Mahani, Min Zhang, Haizhou Li |
| 2009 | ACL | Transliteration Alignment. | Vladimir Pervouchine, Haizhou Li, Bo Lin |
| 2009 | ACL | Topological Ordering of Function Words in Hierarchical Phrase-based Translation. | Hendra Setiawan, Min-Yen Kan, Haizhou Li, Philip Resnik |
| 2009 | ACL | A Syntax-Driven Bracketing Model for Phrase-Based Translation. | Deyi Xiong, Min Zhang, AiTi Aw, Haizhou Li |
| 2009 | ACL | Forest-based Tree Sequence to String Translation Model. | Hui Zhang, Min Zhang, Haizhou Li, AiTi Aw, Chew Lim Tan |
| 2009 | ASRU | The Asian network-based speech-to-speech translation system. | Sakriani Sakti, Noriyuki Kimura, Michael Paul, Chiori Hori, Eiichiro Sumita, Satoshi Nakamura, Jun Park, Chai Wutiwiwatchai, Bo Xu, Hammam Riza, Karunesh Arora, Chi Mai Luong, Haizhou Li |
| 2009 | ASRU | A study on hidden Markov model's generalization capability for speech recognition. | Xiong Xiao, Jinyu Li, Engsiong Chng, Haizhou Li, Chin-Hui Lee |
| 2009 | EMNLP | Tree Kernel-based SVM with Structured Syntactic Knowledge for BTG-based Phrase Reordering. | Min Zhang, Haizhou Li |
| 2009 | EMNLP | Fast Translation Rule Matching for Syntax-based Statistical Machine Translation. | Hui Zhang, Min Zhang, Haizhou Li, Chew Lim Tan |
| 2009 | EMNLP | K-Best Combination of Syntactic Parsers. | Hui Zhang, Min Zhang, Chew Lim Tan, Haizhou Li |
| 2009 | HCI | An Interactive Robot Butler. | Yeow Kee Tan, Dilip Kumar Limbu, Ridong Jiang, Liyuan Li, Kah Eng Hoe, Xinguo Yu, Li Dong, Chern Yuen Wong, Haizhou Li |
| 2009 | ICASSP | Sound event classification based on Feature Integration, Recursive Feature Elimination and Structured Classification. | Tran Huy Dat, Haizhou Li |
| 2009 | ICASSP | The I4U system in NIST 2008 speaker recognition evaluation. | Haizhou Li, Bin Ma, Kong-Aik Lee, Hanwu Sun, Donglai Zhu, Khe Chai Sim, Changhuai You, Rong Tong, Ismo Krkkinen, Chien-Lin Huang, Vladimir Pervouchine, Wu Guo, Yijie Li, Li-Rong Dai, Mohaddeseh Nosratighods, Tharmarajah Thiruvaran, Julien Epps, Eliathamby Ambikairajah, Chng Eng Siong, Tanja Schultz, Qin Jin |
| 2009 | ICASSP | Exploiting prosodic information for Speaker Recognition. | Yanhua Long, Bin Ma, Haizhou Li, Wu Guo, Chng Eng Siong, Li-Rong Dai |
| 2009 | ICASSP | Cluster criterion functions in spectral subspace and their application in speaker clustering. | Trung Hieu Nguyen, Haizhou Li, Chng Eng Siong |
| 2009 | ICASSP | Evaluation of a fused FM and cepstral-based speaker recognition system on the NIST 2008 SRE. | Mohaddeseh Nosratighods, Tharmarajah Thiruvaran, Julien Epps, Eliathamby Ambikairajah, Bin Ma, Haizhou Li |
| 2009 | ICASSP | Speaker diarization in meeting audio. | Tin Lay Nwe, Hanwu Sun, Haizhou Li, Susanto Rahardja |
| 2009 | ICASSP | Cross-validation of multiple language recognition systems using pseudo keys. | Hanwu Sun, Bin Ma, Haizhou Li |
| 2009 | ICASSP | A GMM supervector Kernel with the Bhattacharyya distance for SVM based speaker recognition. | Chang Huai You, Kong-Aik Lee, Haizhou Li |
| 2009 | ICASSP | Joint map adaptation of feature transformation and Gaussian Mixture Model for speaker recognition. | Donglai Zhu, Bin Ma, Haizhou Li |
| 2008 | ACL | Exploiting N-best Hypotheses for SMT Self-Enhancement. | Boxing Chen, Min Zhang, AiTi Aw, Haizhou Li |
| 2008 | ACL | A Linguistically Annotated Reordering Model for BTG-based Statistical Machine Translation. | Deyi Xiong, Min Zhang, AiTi Aw, Haizhou Li |
| 2008 | ACL | A Tree Sequence Alignment-based Tree-to-Tree Translation Model. | Min Zhang, Hongfei Jiang, AiTi Aw, Haizhou Li, Chew Lim Tan, Sheng Li |
| 2008 | COLING | Regenerating Hypotheses for Statistical Machine Translation. | Boxing Chen, Min Zhang, AiTi Aw, Haizhou Li |
| 2008 | COLING | Linguistically Annotated BTG for Statistical Machine Translation. | Deyi Xiong, Min Zhang, AiTi Aw, Haizhou Li |
| 2008 | COLING | Grammar Comparison Study for Translational Equivalence Modeling and Statistical Machine Translation. | Min Zhang, Hongfei Jiang, Haizhou Li, AiTi Aw, Sheng Li |
| 2008 | ICASSP | Jump function komogorov and its application for audio stream segmentation and classification. | Tran Huy Dat, Haizhou Li |
| 2008 | ICASSP | Singing voice detection in pop songs using co-training algorithm. | Swe Zin Kalayar Khine, Tin Lay Nwe, Haizhou Li |
| 2008 | ICASSP | Spoken Language recognition using support vector machines with generative front-end. | Kong-Aik Lee, Changhuai You, Haizhou Li |
| 2008 | ICASSP | On fusion of timbre-motivated features for singing voice detection and singer identification. | Tin Lay Nwe, Haizhou Li |
| 2008 | ICASSP | Robust phone set mapping using decision tree clustering for cross-lingual phone recognition. | Khe Chai Sim, Haizhou Li |
| 2008 | ICASSP | Target-oriented phone tokenizers for spoken language recognition. | Rong Tong, Bin Ma, Haizhou Li, Engsiong Chng |
| 2008 | ICASSP | Discriminative learning for optimizing detection performance in spoken language recognition. | Donglai Zhu, Haizhou Li, Bin Ma, Chin-Hui Lee |
| 2008 | ICPR | Fuzzy rule selection using Iterative Rule Learning for speech data classification. | Omid Dehzangi, Bin Ma, Chng Eng Siong, Haizhou Li |
| 2008 | IJCNLP | Multi-View Co-Training of Transliteration Model. | Jin-Shea Kuo, Haizhou Li |
| 2008 | IJCNLP | Mining Transliterations from Web Query Results: An Incremental Approach. | Jin-Shea Kuo, Haizhou Li, Chih-Lung Lin |
| 2008 | IJCNLP | Name Origin Recognition Using Maximum Entropy Model and Diverse Features. | Min Zhang, Chengjie Sun, Haizhou Li, AiTi Aw, Chew Lim Tan, Xiaolong Wang |
| 2007 | ACL | Semantic Transliteration of Personal Names. | Haizhou Li, Khe Chai Sim, Jin-Shea Kuo, Minghui Dong |
| 2007 | ACL | Ordering Phrases with Function Words. | Hendra Setiawan, Min-Yen Kan, Haizhou Li |
| 2007 | EMNLP | A Statistical Language Modeling Approach to Lattice-Based Spoken Document Retrieval. | Tee Kiah Chia, Haizhou Li, Hwee Tou Ng |
| 2007 | ICASSP | Discriminative Vector for Spoken Language Recognition. | Bin Ma, Rong Tong, Haizhou Li |
| 2007 | ICASSP | Spoken Language Recognition with Relevance Feedback. | Rong Tong, Haizhou Li, Bin Ma, Engsiong Chng, Siu-Yeung Cho |
| 2007 | ICASSP | Normalizing the Speech Modulation Spectrum for Robust Speech Recognition. | Xiong Xiao, Engsiong Chng, Haizhou Li |
| 2007 | ICASSP | A Generalized Feature Transformation Approach for Channel Robust Speaker Verification. | Donglai Zhu, Bin Ma, Haizhou Li, Qiang Huo |
| 2006 | ACL | Learning Transliteration Lexicons from the Web. | Jin-Shea Kuo, Haizhou Li, Ying-Kuei Yang |
| 2006 | ICASSP | Bayesian Learning of N-Gram Statistical Language Modeling. | Shuanhu Bai, Haizhou Li |
| 2006 | ICASSP | Vibrato-Motivated Acoustic Features for Singger Identification. | Haizhou Li, Tin Lay Nwe |
| 2006 | ICASSP | Integrating Acoustic, Prosodic and Phonotactic Features for Spoken Language Identification. | Rong Tong, Bin Ma, Donglai Zhu, Haizhou Li, Engsiong Chng |
| 2005 | ACL | A Phonotactic Language Model for Spoken Language Identification. | Haizhou Li, Bin Ma |
| 2005 | ICASSP | Using Local & Global Phonotactic Features in Chinese Dialect Identification. | Boon Pang Lim, Haizhou Li, Bin Ma |
| 2005 | ICASSP | Broadcast news segmentation by audio type analysis. | Tin Lay Nwe, Haizhou Li |
| 2005 | IJCNLP | Phrase-Based Statistical Machine Translation: A Level of Detail Approach. | Hendra Setiawan, Haizhou Li, Min Zhang, Beng Chin Ooi |
| 2005 | IJCNLP | A Phrase-Based Context-Dependent Joint Probability Model for Named Entity Translation. | Min Zhang, Haizhou Li, Jian Su, Hendra Setiawan |
| 2004 | ACL | A Joint Source-Channel Model for Machine Transliteration. | Haizhou Li, Min Zhang, Jian Su |
| 2004 | COLING | Direct Orthographical Mapping for Machine Transliteration. | Min Zhang, Haizhou Li, Jian Su |
| 1998 | ICASSP | Building class-based language models with contextual statistics. | Shuanhu Bai, Haizhou Li, Zhiwei Lin, Baosheng Yuan |
| 1996 | ICASSP | Probabilistic mapping networks for speaker recognition. | Haizhou Li, Yifan Gong, Jean-Paul Haton |
| 1996 | ICASSP | Speaker time-drifting adaptation using trajectory mixture hidden Markov models. | Jian Su, Haizhou Li, Jean-Paul Haton, Kai-Tat Ng |