Skip to content

Juntao Dai

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

13

Venues

5

Active years

2023–2026

Best venue rank

A*

Where they publish

Papers

13 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIWhat, Whether and How? Unveiling Process Reward Models for Thinking with Images Reasoning.Yujin Zhou, Pengcheng Wen, Jiale Chen, Boqin Yin, Han Zhu, Jiaming Ji, Juntao Dai, Chi-Min Chan, Sirui Han
2026ACLBenchmarking Fine-Grained Error Detection in Multimodal Reasoning.Chi-Min Chan, Han Zhu, Chunyang Jiang, Jiaming Ji, Juntao Dai, Wei Xue, Sirui Han, Yike Guo
2026ACLOmni-RewardBench: Toward a Comprehensive Evaluation of Generative Reward Models Across Modalities.Chi-Min Chan, Yujin Zhou, Pengcheng Wen, Boqin Yin, Jiaming Ji, Juntao Dai, Wei Xue, Sirui Han, Yike Guo
2026ACLPerception, Understanding and Reasoning: A Multimodal Benchmark for Video Fake News Detection.Yakun Cui, Peng Qi, Fushuo Huo, Hang Du, Weijie Shi, Juntao Dai, Zhenghao Zhu, Sirui Han
2026ACLWhen Slower Isn't Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning.Sitong Fang, Wenjing Cao, Jiahao Li, Xuyao Wang, Chi-Min Chan, Sirui Han, Juntao Dai, Yike Guo, Yaodong Yang, Jiaming Ji
2026ACLSafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning.Lichao Wang, ZhaoXing Ren, Tianzhuo Yang, Jiaming Ji, Chi Harold Liu, Yaodong Yang, Juntao Dai
2026ACLA Game-Theoretica Negotiation Framework for Cross-Cultural Consensus.Guoxi Zhang, Jiawei Chen, Tianzhuo Yang, Jiaming Ji, Yaodong Yang, Juntao Dai
2026ACLSafeMT: Multi-turn Safety for Multimodal Language Models.Han Zhu, Juntao Dai, Jiaming Ji, Haoran Li, Chengkun Cai, Pengcheng Wen, Chi-Min Chan, Boyuan Chen, Yaodong Yang, Sirui Han, Yike Guo
2025EMNLPTowards Advanced Mathematical Reasoning for LLMs via First-Order Logic Theorem Proving.Chuxue Cao, Mengze Li, Juntao Dai, Jinluan Yang, Zijian Zhao, Shengyu Zhang, Weijie Shi, Chengzhong Liu, Sirui Han, Yike Guo
2025EMNLPAutomate Strategy Finding with LLM in Quant Investment.Zhizhuo Kou, Holam Yu, Junyu Luo, Jingshu Peng, Xujia Li, Chengzhong Liu, Juntao Dai, Lei Chen, Sirui Han, Yike Guo
2025ICLRMitigating Reward Over-Optimization in RLHF via Behavior-Supported Regularization.Juntao Dai, Taiye Chen, Yaodong Yang, Qian Zheng, Gang Pan
2024ICMLSafe Reinforcement Learning using Finite-Horizon Gradient-based Estimation.Juntao Dai, Yaodong Yang, Qian Zheng, Gang Pan
2023AAAIAugmented Proximal Policy Optimization for Safe Reinforcement Learning.Juntao Dai, Jiaming Ji, Long Yang, Qian Zheng, Gang Pan