| 2026 | AAAI | From Diagnosis to Generalization: A Cognitive Approach to Data Selection for Educational LLMs. | Yuxiang Guo, Yan Zhuang, Qi Liu, Zhenya Huang, Xianquan Wang, Liyang He, Jiatong Li, Rui Li, Shijin Wang |
| 2025 | ACL | Refining Sentence Embedding Model through Ranking Sentences Generation with Large Language Models. | Liyang He, Chenglong Liu, Rui Li, Zhenya Huang, Shulan Ruan, Jun Zhou, Enhong Chen |
| 2025 | ACL | UniRAG: Unified Query Understanding Method for Retrieval Augmented Generation. | Rui Li, Liyang He, Qi Liu, Zheng Zhang, Heng Yu, Yuyang Ye, Linbo Zhu, Yu Su |
| 2025 | ACL | CA-GAR: Context-Aware Alignment of LLM Generation for Document Retrieval. | Heng Yu, Junfeng Kang, Rui Li, Qi Liu, Liyang He, Zhenya Huang, Shuanghong Shen, Junyu Lu |
| 2025 | COLING | Multi-perspective Preference Alignment of LLMs for Programming-Community Question Answering. | Hongyu Yang, Jiahui Hou, Liyang He, Rui Li |
| 2025 | KDD | MGS3: A Multi-Granularity Self-Supervised Code Search Framework. | Rui Li, Junfeng Kang, Qi Liu, Liyang He, Zheng Zhang, Yunhao Sha, Linbo Zhu, Zhenya Huang |
| 2024 | AAAI | CONSIDER: Commonalities and Specialties Driven Multilingual Code Retrieval Framework. | Rui Li, Liyang He, Qi Liu, Yuze Zhao, Zheng Zhang, Zhenya Huang, Yu Su, Shijin Wang |
| 2024 | EMNLP | Optimizing Code Retrieval: High-Quality and Scalable Dataset Annotation through Large Language Models. | Rui Li, Qi Liu, Liyang He, Zheng Zhang, Hao Zhang, Shengyu Ye, Junyu Lu, Zhenya Huang |
| 2024 | WWW | Bit-mask Robust Contrastive Knowledge Distillation for Unsupervised Semantic Hashing. | Liyang He, Zhenya Huang, Jiayu Liu, Enhong Chen, Fei Wang, Jing Sha, Shijin Wang |
| 2020 | ICDM | Exploiting Knowledge Hierarchy for Finding Similar Exercises in Online Education Systems. | Wei Tong, Shiwei Tong, Wei Huang, Liyang He, Jianhui Ma, Qi Liu, Enhong Chen |