| 2024 | ACL | KIEval: A Knowledge-grounded Interactive Evaluation Framework for Large Language Models. | Zhuohao Yu, Chang Gao, Wenjin Yao, Yidong Wang, Wei Ye, Jindong Wang, Xing Xie, Yue Zhang, Shikun Zhang |
| 2024 | EMNLP | FreeEval: A Modular Framework for Trustworthy and Efficient Evaluation of Large Language Models. | Zhuohao Yu, Chang Gao, Wenjin Yao, Yidong Wang, Zhengran Zeng, Wei Ye, Jindong Wang, Yue Zhang, Shikun Zhang |
| 2024 | EMNLP | PURE: Aligning LLM via Pluggable Query Reformulation for Enhanced Helpfulness. | Wenjin Yao, Yidong Wang, Zhuohao Yu, Rui Xie, Shikun Zhang, Wei Ye |
| 2024 | ICLR | PandaLM: An Automatic Evaluation Benchmark for LLM Instruction Tuning Optimization. | Yidong Wang, Zhuohao Yu, Wenjin Yao, Zhengran Zeng, Linyi Yang, Cunxiang Wang, Hao Chen, Chaoya Jiang, Rui Xie, Jindong Wang, Xing Xie, Wei Ye, Shikun Zhang, Yue Zhang |
| 2021 | ISCAS | Unsupervised Learning of Visual and Semantic Features for Video Summarization. | Yansen Huang, Rui Zhong, Wenjin Yao, Rui Wang |
| 2021 | ICSOC | KG2Code: Correct Code Examples Mining Service Based on Knowledge Graph for Fixing API Misuses. | Yangqi Zhang, Zhirui Kuai, Wenjin Yao, Zhiyang Zhang, Li Kuang |
| 2016 | HCI | Approaching a Chinese Cultural Transferring Design Model Through Analysis of Culturally Oriented Design and Its Context. | Wenjin Yao, Gang Lu |