| 2026 | AAAI | Think-J: Learning to Think for Generative LLM-as-a-Judge. | Hui Huang, Yancheng He, Hongli Zhou, Rui Zhang, Wei Liu, Weixun Wang, Jiaheng Liu, Wenbo Su |
| 2026 | AAAI | Lost in Benchmarks? Rethinking Large Language Model Benchmarking with Item Response Theory. | Hongli Zhou, Hui Huang, Ziqing Zhao, Lvyuan Han, Huicheng Wang, Kehai Chen, Muyun Yang, Wei Bao, Jian Dong, Bing Xu, Conghui Zhu, Hailong Cao, Tiejun Zhao |
| 2025 | ACL | An Empirical Study of LLM-as-a-Judge for LLM Evaluation: Fine-tuned Judge Model is not a General Substitute for GPT-4. | Hui Huang, Xingyuan Bu, Hongli Zhou, Yingqi Qu, Jing Liu, Muyun Yang, Bing Xu, Tiejun Zhao |
| 2024 | SIGIR | CLLP: Contrastive Learning Framework Based on Latent Preferences for Next POI Recommendation. | Hongli Zhou, Zhihao Jia, Haiyang Zhu, Zhizheng Zhang |
| 2020 | ICPR | Deep Reinforcement Learning for Autonomous Driving by Transferring Visual Features. | Hongli Zhou, Xiaolei Chen, Guanwen Zhang, Wei Zhou |
| 2018 | IGARSS | The Difference of Rrs Product Derived From Modis Meris and Seawifs in South China Sea. | Jun Li, Jianhua Zhu, Tongji Li, Bing Han, Chuntao Chen, Anan Yang, Hongli Zhou, Fei Gao |
| 2016 | CSCWD | Influence study of participants' characteristics on project evolution in open source community based on agent-based simulation. | Hongli Zhou, Yang Hu, Xiaodong Zhang, Dongfang Zhao |