| 2026 | AAAI | Long-form RewardBench: Evaluating Reward Models for Long-form Generation. | Hui Huang, Yancheng He, Wei Liu, Muyun Yang, Jiaheng Liu, Kehai Chen, Bing Xu, Conghui Zhu, Hailong Cao, Tiejun Zhao |
| 2026 | AAAI | Lost in Benchmarks? Rethinking Large Language Model Benchmarking with Item Response Theory. | Hongli Zhou, Hui Huang, Ziqing Zhao, Lvyuan Han, Huicheng Wang, Kehai Chen, Muyun Yang, Wei Bao, Jian Dong, Bing Xu, Conghui Zhu, Hailong Cao, Tiejun Zhao |
| 2026 | ACL | WSDPO: A Generative Word Sense Disambiguation Framework with Chain-of-Thought and Preference Optimization. | Kunpeng Kang, Shuaimin Li, Kaiyuan Zhang, Luyang Zhang, Jiasheng Si, Bing Xu, Kehai Chen, Muyun Yang, Wenpeng Lu |
| 2026 | ACL | Diagnosing and Remedying Representation Deficiencies for Deterministic Reasoning in KGQA. | Gewen Liang, Mufan Xu, Kehai Chen, Wei Wang, Yuwei Wang, Muyun Yang, Tiejun Zhao, Min Zhang |
| 2025 | AAAI | Look Before You Leap: Enhance Attention and Vigilance Regarding Harmful Content with GuidelineLLM. | Shaoqing Zhang, Zhuosheng Zhang, Kehai Chen, Rongxiang Weng, Muyun Yang, Tiejun Zhao, Min Zhang |
| 2025 | ACL | An Empirical Study of LLM-as-a-Judge for LLM Evaluation: Fine-tuned Judge Model is not a General Substitute for GPT-4. | Hui Huang, Xingyuan Bu, Hongli Zhou, Yingqi Qu, Jing Liu, Muyun Yang, Bing Xu, Tiejun Zhao |
| 2025 | ACL | LLM-based Translation Inference with Iterative Bilingual Understanding. | Andong Chen, Kehai Chen, Yang Xiang, Xuefeng Bai, Muyun Yang, Yang Feng, Tiejun Zhao, Min Zhang |
| 2025 | ACL | Make Imagination Clearer! Stable Diffusion-based Visual Imagination for Multimodal Machine Translation. | Andong Chen, Yuchen Song, Kehai Chen, Xuefeng Bai, Muyun Yang, Liqiang Nie, Jie Liu, Tiejun Zhao, Min Zhang |
| 2025 | ACL | MuSC: Improving Complex Instruction Following with Multi-granularity Self-Contrastive Training. | Hui Huang, Jiaheng Liu, Yancheng He, Shilong Li, Bing Xu, Conghui Zhu, Muyun Yang, Tiejun Zhao |
| 2025 | ACL | Memory-augmented Query Reconstruction for LLM-based Knowledge Graph Reasoning. | Mufan Xu, Gewen Liang, Kehai Chen, Wei Wang, Xun Zhou, Muyun Yang, Tiejun Zhao, Min Zhang |
| 2025 | COLING | A Chain-of-Task Framework for Instruction Tuning of LLMs Based on Chinese Grammatical Error Correction. | Xinpeng Liu, Bing Xu, Muyun Yang, Hailong Cao, Conghui Zhu, Tiejun Zhao, Wenpeng Lu |
| 2025 | COLING | LoRA-drop: Efficient LoRA Parameter Pruning based on Output Evaluation. | Hongyun Zhou, Xiangyu Lu, Wang Xu, Conghui Zhu, Tiejun Zhao, Muyun Yang |
| 2025 | EMNLP | Benchmarking LLMs for Translating Classical Chinese Poetry: Evaluating Adequacy, Fluency, and Elegance. | Andong Chen, Lianzhang Lou, Kehai Chen, Xuefeng Bai, Yang Xiang, Muyun Yang, Tiejun Zhao, Min Zhang |
| 2025 | EMNLP | Legal Fact Prediction: The Missing Piece in Legal Judgment Prediction. | Junkai Liu, Yujie Tong, Hui Huang, Bowen Zheng, Yiran Hu, Peicheng Wu, Chuan Xiao, Makoto Onizuka, Muyun Yang, Shuyuan Zheng |
| 2025 | EMNLP | MADAWSD: Multi-Agent Debate Framework for Adversarial Word Sense Disambiguation. | Kaiyuan Zhang, Qian Liu, Luyang Zhang, Chaoqun Zheng, Shuaimin Li, Bing Xu, Muyun Yang, Xinxiao Qiao, Wenpeng Lu |
| 2025 | ICASSP | HiRes: Hierarchical Feature Optimization and Rescorer for Automatic ICD Coding. | Zhenpeng Liang, Hongjiao Guan, Wenpeng Lu, Xueping Peng, Bing Xu, Muyun Yang |
| 2024 | ACL | DUAL-REFLECT: Enhancing Large Language Models for Reflective Translation through Dual Learning Feedback Mechanisms. | Andong Chen, Lianzhang Lou, Kehai Chen, Xuefeng Bai, Yang Xiang, Muyun Yang, Tiejun Zhao, Min Zhang |
| 2024 | EMNLP | Self-Evaluation of Large Language Model based on Glass-box Features. | Hui Huang, Yingqi Qu, Jing Liu, Muyun Yang, Bing Xu, Tiejun Zhao, Wenpeng Lu |
| 2024 | EMNLP | Dynamic Planning for LLM-based Graphical User Interface Automation. | Shaoqing Zhang, Zhuosheng Zhang, Kehai Chen, Xinbei Ma, Muyun Yang, Tiejun Zhao, Min Zhang |
| 2023 | ACL | Improving Translation Quality Estimation with Bias Mitigation. | Hui Huang, Shuangzhi Wu, Kehai Chen, Hui Di, Muyun Yang, Tiejun Zhao |
| 2023 | ACL | Iterative Nearest Neighbour Machine Translation for Unsupervised Domain Adaptation. | Hui Huang, Shuangzhi Wu, Xinnian Liang, Zefan Zhou, Muyun Yang, Tiejun Zhao |
| 2022 | IJCAI | Effective Graph Context Representation for Document-level Machine Translation. | Kehai Chen, Muyun Yang, Masao Utiyama, Eiichiro Sumita, Rui Wang, Min Zhang |
| 2021 | ACL | Grammar-Based Patches Generation for Automated Program Repair. | Yu Tang, Long Zhou, Ambrosio Blanco, Shujie Liu, Furu Wei, Ming Zhou, Muyun Yang |
| 2020 | COLING | Robust Machine Reading Comprehension by Learning Soft labels. | Zhenyu Zhao, Shuangzhi Wu, Muyun Yang, Kehai Chen, Tiejun Zhao |
| 2018 | ICNC | An Intention Domain Classification Method Based on Concept Map and Language Model. | Bing Xu, Jingjing Zhao, Huaxing Shi, Muyun Yang |
| 2017 | AAAI | Translation Prediction with Source Dependency-Based Context Representation. | Kehai Chen, Tiejun Zhao, Muyun Yang, Lemao Liu |
| 2017 | INLG | Investigating the content and form of referring expressions in Mandarin: introducing the Mtuna corpus. | Kees van Deemter, Le Sun, Rint Sybesma, Xiao Li, Bo Chen, Muyun Yang |
| 2016 | ICNC | Clause sentiment identification based on convolutional neural network with context embedding. | Peng Chen, Bing Xu, Muyun Yang, Sheng Li |
| 2015 | EMNLP | Hierarchical Recurrent Neural Network for Document Modeling. | Rui Lin, Shujie Liu, Muyun Yang, Mu Li, Ming Zhou, Sheng Li |
| 2014 | ACL | Learning Topic Representation for SMT with Neural Networks. | Lei Cui, Dongdong Zhang, Shujie Liu, Qiming Chen, Mu Li, Ming Zhou, Muyun Yang |
| 2013 | IJCAI | Fusion of Word and Letter Based Metrics for Automatic MT Evaluation. | Muyun Yang, Junguo Zhu, Sheng Li, Tiejun Zhao |
| 2013 | IJCNLP | A Hierarchical Semantics-Aware Distributional Similarity Scheme. | Shuqi Sun, Ke Sun, Shiqi Zhao, Haifeng Wang, Muyun Yang, Sheng Li |
| 2013 | IJCNLP | Repairing Incorrect Translation with Examples. | Junguo Zhu, Muyun Yang, Sheng Li, Tiejun Zhao |
| 2012 | ICMLC | F-score-like measure: A new measure for spam filtering. | Yong Han, Haoliang Qi, Muyun Yang |
| 2012 | ICMLC | An empirical study on query expansion and documentexpans ion in information retrieval. | Xuwei Li, Muyun Yang, Haoliang Qi, Sheng Li, Zhongyuan Han |
| 2011 | IJCNLP | Harvesting Related Entities with a Search Engine. | Shu-Qi Sun, Shiqi Zhao, Muyun Yang, Haifeng Wang, Sheng Li |
| 2010 | COLING | Reexamination on Potential for Personalization in Web Search. | Daren Li, Muyun Yang, Haoliang Qi, Sheng Li, Tiejun Zhao |
| 2010 | COLING | Utilizing Variability of Time and Term Content, within and across Users in Session Detection. | Shu-Qi Sun, Sheng Li, Muyun Yang, Haoliang Qi, Tiejun Zhao |
| 2010 | COLING | All in Strings: a Powerful String-based Automatic MT Evaluation Metric with Multiple Granularities. | Junguo Zhu, Muyun Yang, Bo Wang, Sheng Li, Tiejun Zhao |
| 2010 | SIGIR | Predicting query potential for personalization, classification or regression? | Chen Chen, Muyun Yang, Sheng Li, Tiejun Zhao, Haoliang Qi |
| 2010 | SIGIR | Re-examination on lam% in spam filtering. | Haoliang Qi, Muyun Yang, Xiaoning He, Sheng Li |
| 2009 | ACL | A Statistical Machine Translation Model Based on a Synthetic Synchronous Grammar. | Hongfei Jiang, Muyun Yang, Tiejun Zhao, Sheng Li, Bo Wang |
| 2004 | IJCNLP | FML-Based SCF Predefinition Learning for Chinese Verbs. | Xiwu Han, Tiejun Zhao, Muyun Yang |
| 2002 | COLING | Learning Chinese Bracketing Knowledge Based on a Bilingual Language Model. | Yajuan L, Sheng Li, Tiejun Zhao, Muyun Yang |
| 2000 | ICMI | Bilingual Dictionary Based Sentence Alignment for Chinese English Bitext. | Tiejun Zhao, Muyun Yang, Liping Qian, Gaolin Fang |