| 2026 | ACL | Reasoning with OmniThought: A Large CoT Dataset with Verbosity and Cognitive Difficulty Annotations. | Wenrui Cai, Chengyu Wang, Junbing Yan, Jun Huang, Xiangzhong Fang |
| 2026 | ACL | AgenticQwen: Training Small Agentic Language Models with Dual Data Flywheels for Industrial-Scale Tool Use. | Yuanjie Lyu, Chengyu Wang, Haonan Zheng, Yuanhao Yue, Junbing Yan, Ming Wang, Jun Huang |
| 2025 | ACL | DistilQwen2.5: Industrial Practices of Training Distilled Open Lightweight Language Models. | Chengyu Wang, Junbing Yan, Yuanhao Yue, Jun Huang |
| 2025 | EMNLP | Thinking with DistilQwen: A Tale of Four Distilled Reasoning and Reward Model Series. | Wenrui Cai, Chengyu Wang, Junbing Yan, Jun Huang, Xiangzhong Fang |
| 2025 | EMNLP | EasyDistill: A Comprehensive Toolkit for Effective Knowledge Distillation of Large Language Models. | Chengyu Wang, Junbing Yan, Wenrui Cai, Yuanhao Yue, Jun Huang |
| 2025 | EMNLP | Enhancing Reasoning Abilities of Small LLMs with Cognitive Alignment. | Wenrui Cai, Chengyu Wang, Junbing Yan, Jun Huang, Xiangzhong Fang |
| 2024 | ACL | On the Role of Long-tail Knowledge in Retrieval Augmented Large Language Models. | Dongyang Li, Junbing Yan, Taolin Zhang, Chengyu Wang, Xiaofeng He, Longtao Huang, Hui Xue, Jun Huang |
| 2024 | COLING | TRELM: Towards Robust and Efficient Pre-training for Knowledge-Enhanced Language Models. | Junbing Yan, Chengyu Wang, Taolin Zhang, Xiaofeng He, Jun Huang, Wei Zhang, Longtao Huang, Hui Xue |
| 2024 | WSDM | Making Small Language Models Better Multi-task Learners with Mixture-of-Task-Adapters. | Yukang Xie, Chengyu Wang, Junbing Yan, Jiyong Zhou, Feiqi Deng, Jun Huang |
| 2023 | EMNLP | From Complex to Simple: Unraveling the Cognitive Tree for Reasoning with Small Language Models. | Junbing Yan, Chengyu Wang, Taolin Zhang, Xiaofeng He, Jun Huang, Wei Zhang |
| 2022 | WWW | Neuro-Symbolic Interpretable Collaborative Filtering for Attribute-based Recommendation. | Wei Zhang, Junbing Yan, Zhuo Wang, Jianyong Wang |