| 2025 | NAACL | CAMIEval: Enhancing NLG Evaluation through Multidimensional Comparative Instruction-Following Analysis. | Ziyue Fan, Junliang He, Li Xiaoqing, Shaohui Kuang, Kai Song, Yaqian Zhou, Xipeng Qiu |
| 2025 | NAACL | FiNE: Filtering and Improving Noisy Data Elaborately with Large Language Models. | Junliang He, Ziyue Fan, Shaohui Kuang, Li Xiaoqing, Kai Song, Yaqian Zhou, Xipeng Qiu |
| 2024 | AAAI | DenoSent: A Denoising Objective for Self-Supervised Sentence Representation Learning. | Xinghao Wang, Junliang He, Pengyu Wang, Yunhua Zhou, Tianxiang Sun, Xipeng Qiu |
| 2024 | ADMA | IRKT: Integrating Relationships from Internal Features and External Manifestations for Knowledge Tracing. | Junliang He, Zhilong Shan |
| 2024 | EMNLP | Making Large Language Models Better Reasoners with Orchestrated Streaming Experiences. | Xiangyang Liu, Junliang He, Xipeng Qiu |
| 2022 | EMNLP | BERTScore is Unfair: On Social Bias in Language Model-Based Metrics for Text Generation. | Tianxiang Sun, Junliang He, Xipeng Qiu, Xuanjing Huang |
| 2022 | NAACL | Towards Efficient NLP: A Standard Evaluation and A Strong Baseline. | Xiangyang Liu, Tianxiang Sun, Junliang He, Jiawen Wu, Lingling Wu, Xinyu Zhang, Hao Jiang, Zhao Cao, Xuanjing Huang, Xipeng Qiu |