Skip to content

Qiaozhi He

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

7

Venues

5

Active years

2025–2026

Best venue rank

A*

Where they publish

Papers

7 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIProbing Preference Representations: A Multi-Dimensional Evaluation and Analysis Method for Reward Models.Chenglong Wang, Yifu Huo, Yang Gan, Yongyu Mu, Qiaozhi He, Murun Yang, Bei Li, Chunliang Zhang, Tongran Liu, Anxiang Ma, Zhengtao Yu, Jingbo Zhu, Tong Xiao
2026ACLSPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models.Yifu Huo, Chenglong Wang, Ziming Zhu, Shunjie Xing, Peinan Feng, Tongran Liu, Qiaozhi He, Tianhua Zhou, Changxiaojia, JingBo Zhu, Zhengtao Yu, Tong Xiao
2026ACLSERM: Self-Evolving Relevance Model with Agent-Driven Learning from Massive Query Streams.Chenglong Wang, Canjia Li, Xingzhao Zhu, Yifu Huo, Huiyu Wang, Weixiong Lin, Yun Yang, Qiaozhi He, Tianhua Zhou, Changxiaojia, JingBo Zhu, Tong Xiao
2025AAAIRoVRM: A Robust Visual Reward Model Optimized via Auxiliary Textual Preference Data.Chenglong Wang, Yang Gan, Yifu Huo, Yongyu Mu, Murun Yang, Qiaozhi He, Tong Xiao, Chunliang Zhang, Tongran Liu, Jingbo Zhu
2025CVPRStickMotion: Generating 3D Human Motions by Drawing a Stickman.Tao Wang, Zhihua Wu, Qiaozhi He, Jiaming Chu, Ling Qian, Yu Cheng, Junliang Xing, Jian Zhao, Lei Jin
2025ICASSPBoosting Text-To-Image Generation via Multilingual Prompting in Large Multimodal Models.Yongyu Mu, Hengyu Li, Junxin Wang, Xiaoxuan Zhou, Chenglong Wang, Yingfeng Luo, Qiaozhi He, Tong Xiao, Guocheng Chen, Jingbo Zhu
2025ICMLGRAM: A Generative Foundation Reward Model for Reward Generalization.Chenglong Wang, Yang Gan, Yifu Huo, Yongyu Mu, Qiaozhi He, Murun Yang, Bei Li, Tong Xiao, Chunliang Zhang, Tongran Liu, JingBo Zhu