Skip to content

Jiaming Ji

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

23

Venues

4

Active years

2023–2026

Best venue rank

A*

Where they publish

Papers

23 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIWhat, Whether and How? Unveiling Process Reward Models for Thinking with Images Reasoning.Yujin Zhou, Pengcheng Wen, Jiale Chen, Boqin Yin, Han Zhu, Jiaming Ji, Juntao Dai, Chi-Min Chan, Sirui Han
2026ACLBenchmarking Fine-Grained Error Detection in Multimodal Reasoning.Chi-Min Chan, Han Zhu, Chunyang Jiang, Jiaming Ji, Juntao Dai, Wei Xue, Sirui Han, Yike Guo
2026ACLOmni-RewardBench: Toward a Comprehensive Evaluation of Generative Reward Models Across Modalities.Chi-Min Chan, Yujin Zhou, Pengcheng Wen, Boqin Yin, Jiaming Ji, Juntao Dai, Wei Xue, Sirui Han, Yike Guo
2026ACLWhen Slower Isn't Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning.Sitong Fang, Wenjing Cao, Jiahao Li, Xuyao Wang, Chi-Min Chan, Sirui Han, Juntao Dai, Yike Guo, Yaodong Yang, Jiaming Ji
2026ACLSafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning.Lichao Wang, ZhaoXing Ren, Tianzhuo Yang, Jiaming Ji, Chi Harold Liu, Yaodong Yang, Juntao Dai
2026ACLAgentGym2: Benchmarking Large Language Model Agents in De-Idealized Real-World Environments.Zhiheng Xi, Dingwen Yang, Jiaqi Liu, Jixuan Huang, Honglin Guo, Baodai Huang, Tinggang Chen, Qi Zhang, Zhonghang Lu, Chenyu Liu, Jiajun Sun, Jiazheng Zhang, Dingwei Zhu, Xin Guo, Junzhe Wang, Zhihao Zhang, Yuming Yang, Junjie Ye, Minghe Gao, Dongrui Liu, Jiaming Ji, Guohao Li, Tao Gui, Xuanjing Huang
2026ACLA Game-Theoretica Negotiation Framework for Cross-Cultural Consensus.Guoxi Zhang, Jiawei Chen, Tianzhuo Yang, Jiaming Ji, Yaodong Yang, Juntao Dai
2026ACLSafeMT: Multi-turn Safety for Multimodal Language Models.Han Zhu, Juntao Dai, Jiaming Ji, Haoran Li, Chengkun Cai, Pengcheng Wen, Chi-Min Chan, Boyuan Chen, Yaodong Yang, Sirui Han, Yike Guo
2025AAAIStream Aligner: Efficient Sentence-Level Alignment via Distribution Induction.Hantao Lou, Jiaming Ji, Kaile Wang, Yaodong Yang
2025AAAISequence to Sequence Reward Modeling: Improving RLHF by Language Feedback.Jiayi Zhou, Jiaming Ji, Josef Dai, Yaodong Yang
2025ACLFinMME: Benchmark Dataset for Financial Multi-Modal Reasoning Evaluation.Junyu Luo, Zhizhuo Kou, Liming Yang, Xiao Luo, Jinsheng Huang, Zhiping Xiao, Jingshu Peng, Chengzhong Liu, Jiaming Ji, Xuanzhe Liu, Sirui Han, Ming Zhang, Yike Guo
2025ACLSafeLawBench: Towards Safe Alignment of Large Language Models.Chuxue Cao, Han Zhu, Jiaming Ji, Qichao Sun, Zhenghao Zhu, Yinyu Wu, Josef Dai, Yaodong Yang, Sirui Han, Yike Guo
2025ACLBoosting Policy and Process Reward Models with Monte Carlo Tree Search in Open-Domain QA.Chi-Min Chan, Chunpu Xu, Junqi Zhu, Jiaming Ji, Donghai Hong, Pengcheng Wen, Chunyang Jiang, Zhen Ye, Yaodong Yang, Wei Xue, Sirui Han, Yike Guo
2025ACLPKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference.Jiaming Ji, Donghai Hong, Borong Zhang, Boyuan Chen, Josef Dai, Boren Zheng, Tianyi Alex Qiu, Jiayi Zhou, Kaile Wang, Boxun Li, Sirui Han, Yike Guo, Yaodong Yang
2025ACLLanguage Models Resist Alignment: Evidence From Data Compression.Jiaming Ji, Kaile Wang, Tianyi Alex Qiu, Boyuan Chen, Jiayi Zhou, Changye Li, Hantao Lou, Josef Dai, Yunhuai Liu, Yaodong Yang
2025ACLBenchmarking Multi-National Value Alignment for Large Language Models.Chengyi Ju, Weijie Shi, Chengzhong Liu, Jiaming Ji, Jipeng Zhang, Ruiyuan Zhang, Jiajie Xu, Yaodong Yang, Sirui Han, Yike Guo
2025ACLReward Generalization in RLHF: A Topological Perspective.Tianyi Alex Qiu, Fanzhi Zeng, Jiaming Ji, Dong Yan, Kaile Wang, Jiayi Zhou, Yang Han, Josef Dai, Xuehai Pan, Yaodong Yang
2025ACLLegalReasoner: Step-wised Verification-Correction for Legal Judgment Reasoning.Weijie Shi, Han Zhu, Jiaming Ji, Mengze Li, Jipeng Zhang, Ruiyuan Zhang, Jia Zhu, Jiajie Xu, Sirui Han, Yike Guo
2025ACLA Survey of LLM-based Agents in Medicine: How far are we from Baymax?Wenxuan Wang, Zizhan Ma, Zheng Wang, Chenghan Wu, Jiaming Ji, Wenting Chen, Xiang Li, Yixuan Yuan
2025ICMLSAE-V: Interpreting Multimodal Models for Enhanced Alignment.Hantao Lou, Changye Li, Jiaming Ji, Yaodong Yang
2024ICLRSafeDreamer: Safe Reinforcement Learning with World Models.Weidong Huang, Jiaming Ji, Chunhe Xia, Borong Zhang, Yaodong Yang
2024ICLRSafe RLHF: Safe Reinforcement Learning from Human Feedback.Josef Dai, Xuehai Pan, Ruiyang Sun, Jiaming Ji, Xinbo Xu, Mickel Liu, Yizhou Wang, Yaodong Yang
2023AAAIAugmented Proximal Policy Optimization for Safe Reinforcement Learning.Juntao Dai, Jiaming Ji, Long Yang, Qian Zheng, Gang Pan