Juntao Dai
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
13
Venues
5
Active years
2023–2026
Best venue rank
A*
Where they publish
Papers
13 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | What, Whether and How? Unveiling Process Reward Models for Thinking with Images Reasoning. | Yujin Zhou, Pengcheng Wen, Jiale Chen, Boqin Yin, Han Zhu, Jiaming Ji, Juntao Dai, Chi-Min Chan, Sirui Han |
| 2026 | ACL | Benchmarking Fine-Grained Error Detection in Multimodal Reasoning. | Chi-Min Chan, Han Zhu, Chunyang Jiang, Jiaming Ji, Juntao Dai, Wei Xue, Sirui Han, Yike Guo |
| 2026 | ACL | Omni-RewardBench: Toward a Comprehensive Evaluation of Generative Reward Models Across Modalities. | Chi-Min Chan, Yujin Zhou, Pengcheng Wen, Boqin Yin, Jiaming Ji, Juntao Dai, Wei Xue, Sirui Han, Yike Guo |
| 2026 | ACL | Perception, Understanding and Reasoning: A Multimodal Benchmark for Video Fake News Detection. | Yakun Cui, Peng Qi, Fushuo Huo, Hang Du, Weijie Shi, Juntao Dai, Zhenghao Zhu, Sirui Han |
| 2026 | ACL | When Slower Isn't Truer: Inverse Scaling Law of Truthfulness in Multimodal Reasoning. | Sitong Fang, Wenjing Cao, Jiahao Li, Xuyao Wang, Chi-Min Chan, Sirui Han, Juntao Dai, Yike Guo, Yaodong Yang, Jiaming Ji |
| 2026 | ACL | SafeMCP: Proactive Power Regulation for LLM Agent Defense via Environment-Grounded Look-Ahead Reasoning. | Lichao Wang, ZhaoXing Ren, Tianzhuo Yang, Jiaming Ji, Chi Harold Liu, Yaodong Yang, Juntao Dai |
| 2026 | ACL | A Game-Theoretica Negotiation Framework for Cross-Cultural Consensus. | Guoxi Zhang, Jiawei Chen, Tianzhuo Yang, Jiaming Ji, Yaodong Yang, Juntao Dai |
| 2026 | ACL | SafeMT: Multi-turn Safety for Multimodal Language Models. | Han Zhu, Juntao Dai, Jiaming Ji, Haoran Li, Chengkun Cai, Pengcheng Wen, Chi-Min Chan, Boyuan Chen, Yaodong Yang, Sirui Han, Yike Guo |
| 2025 | EMNLP | Towards Advanced Mathematical Reasoning for LLMs via First-Order Logic Theorem Proving. | Chuxue Cao, Mengze Li, Juntao Dai, Jinluan Yang, Zijian Zhao, Shengyu Zhang, Weijie Shi, Chengzhong Liu, Sirui Han, Yike Guo |
| 2025 | EMNLP | Automate Strategy Finding with LLM in Quant Investment. | Zhizhuo Kou, Holam Yu, Junyu Luo, Jingshu Peng, Xujia Li, Chengzhong Liu, Juntao Dai, Lei Chen, Sirui Han, Yike Guo |
| 2025 | ICLR | Mitigating Reward Over-Optimization in RLHF via Behavior-Supported Regularization. | Juntao Dai, Taiye Chen, Yaodong Yang, Qian Zheng, Gang Pan |
| 2024 | ICML | Safe Reinforcement Learning using Finite-Horizon Gradient-based Estimation. | Juntao Dai, Yaodong Yang, Qian Zheng, Gang Pan |
| 2023 | AAAI | Augmented Proximal Policy Optimization for Safe Reinforcement Learning. | Juntao Dai, Jiaming Ji, Long Yang, Qian Zheng, Gang Pan |