| 2026 | ACL | GuideTree: Guideline-Induced Review Trees for Long Medical Records. | Chengze Ge, Ruiqing Zhang, Yining Wang, Shengping Liu, Jiaen Liang, Weihuang, Weihua Chen |
| 2026 | ACL | FocalOrder: Focal Preference Optimization for Reading Order Detection. | Fuyuan Liu, Dianyu Yu, He Ren, Nayu Liu, Xiaomian Kang, Delai Qiu, Fa Zhang, Genpeng Zhen, Shengping Liu, Jiaen Liang, Wei Huang, Yining Wang, Junnan Zhu |
| 2024 | CVPR | Exploring Facial Expression Recognition through Semi-Supervised Pre-training and Temporal Modeling. | Jun Yu, Zhihong Wei, Zhongpeng Cai, Gongpeng Zhao, Zerui Zhang, Yongqi Wang, Guochen Xie, Jichao Zhu, Wangyuan Zhu, Qingsong Liu, Jiaen Liang |
| 2024 | CVPR | Improving Valence-Arousal Estimation with Spatiotemporal Relationship Learning and Multimodal Fusion. | Jun Yu, Gongpeng Zhao, Yongqi Wang, Zhihong Wei, Zerui Zhang, Zhongpeng Cai, Guochen Xie, Jichao Zhu, Wangyuan Zhu, Shuoping Yang, Yang Zheng, Qingsong Liu, Jiaen Liang |
| 2024 | CVPR | AUD-TGN: Advancing Action Unit Detection with Temporal Convolution and GPT-2 in Wild Audiovisual Contexts. | Jun Yu, Zerui Zhang, Zhihong Wei, Gongpeng Zhao, Zhongpeng Cai, Yongqi Wang, Guochen Xie, Jichao Zhu, Wangyuan Zhu, Qingsong Liu, Jiaen Liang |
| 2024 | CVPR | Multi Model Ensemble for Compound Expression Recognition. | Jun Yu, Jichao Zhu, Wangyuan Zhu, Zhongpeng Cai, Gongpeng Zhao, Zhihong Wei, Guochen Xie, Zerui Zhang, Qingsong Liu, Jiaen Liang |
| 2024 | CVPR | Efficient Feature Extraction and Late Fusion Strategy for Audiovisual Emotional Mimicry Intensity Estimation. | Jun Yu, Wangyuan Zhu, Jichao Zhu, Zhongpeng Cai, Gongpeng Zhao, Zerui Zhang, Guochen Xie, Zhihong Wei, Qingsong Liu, Jiaen Liang |
| 2024 | Interspeech | Reducing Speech Distortion and Artifacts for Speech Enhancement by Loss Function. | Haixin Guan, Wei Dai, Guangyong Wang, Xiaobin Tan, Peng Li, Jiaen Liang |
| 2023 | ICASSP | M | Jinlong Xue, Yayue Deng, Fengping Wang, Ya Li, Yingming Gao, Jianhua Tao, Jianqing Sun, Jiaen Liang |
| 2022 | Interspeech | Selective Pseudo-labeling and Class-wise Discriminative Fusion for Sound Event Detection. | Yunhao Liang, Yanhua Long, Yijie Li, Jiaen Liang |
| 2021 | ASRU | Attention-Based Scaling Adaptation for Target Speech Extraction. | Jiangyu Han, Wei Rao, Yanhua Long, Jiaen Liang |
| 2020 | Interspeech | Speech Driven Talking Head Generation via Attentional Landmarks Based Representation. | Wentao Wang, Yan Wang, Jianqing Sun, Qingsong Liu, Jiaen Liang, Teng Li |
| 2020 | Interspeech | Self-and-Mixed Attention Decoder with Deep Acoustic Structure for Transformer-Based LVCSR. | Xinyuan Zhou, Grandee Lee, Emre Yilmaz, Yanhua Long, Jiaen Liang, Haizhou Li |
| 2018 | Interspeech | Active Learning for LF-MMI Trained Neural Networks in ASR. | Yanhua Long, Hong Ye, Yijie Li, Jiaen Liang |
| 2017 | Interspeech | Speaker Direction-of-Arrival Estimation Based on Frequency-Independent Beampattern. | Feng Guo, Yuhang Cao, Zheng Liu, Jiaen Liang, Baoqing Li, Xiaobing Yuan |
| 2011 | ICASSP | Exploring nuisance attribute projection and score normalization for GLDS-SVM based automatic mispronunciation detection method. | Hongyan Li, Shen Huang, Shijin Wang, Jiaen Liang, Bo Xu |
| 2010 | Interspeech | Automatic reference independent evaluation of prosody quality using multiple knowledge fusions. | Shen Huang, Hongyan Li, Shijin Wang, Jiaen Liang, Bo Xu |
| 2010 | Interspeech | Exploring goodness of prosody by diverse matching templates. | Shen Huang, Hongyan Li, Shijin Wang, Jiaen Liang, Bo Xu |
| 2009 | ICASSP | An efficient mispronounciation detction method using GLDS-SVM and formant enhanced features. | Hongyan Li, Jiaen Liang, Shijin Wang, Bo Xu |
| 2009 | ICALT | Context Dependent Feature Based Bottom-up Rescoring SVM Classifier in Children's English Stress Mis-pronunciation Detection. | Shen Huang, Hongyan Li, Shijin Wang, Jiaen Liang, Bo Xu |
| 2009 | Interspeech | High performance automatic mispronunciation detection method based on neural network and TRAP features. | Hongyan Li, Shijin Wang, Jiaen Liang, Shen Huang, Bo Xu |
| 2008 | ICASSP | Improved phonotactic language identification using random forest language models. | Xiaorui Wang, Shijin Wang, Jiaen Liang, Bo Xu |
| 2008 | ICNC | Music Genre Classification Based on Multiple Classifier Fusion. | Lei Wang, Shen Huang, Shijin Wang, Jiaen Liang, Bo Xu |
| 2008 | Interspeech | Improving searching speed and accuracy of query by humming system based on three methods: feature fusion, candidates set reduction and multiple similarity measurement rescoring. | Lei Wang, Shen Huang, Sheng Hu, Jiaen Liang, Bo Xu |
| 2007 | ICASSP | A Novel Phone-State Matrix Based Vocabulary-Indenendent Keyword Spotting Method for Spontaneous Speech. | Peng Gao, Jiaen Liang, Peng Ding, Bo Xu |
| 2006 | ICASSP | An Improved Mandarin Keyword Spotting System Using MCE Training and Context-Enhanced Verification. | Jiaen Liang, Meng Meng, Xiaorui Wang, Peng Ding, Bo Xu |