Skip to content

Bei Peng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

18

Venues

12

Active years

2012–2026

Best venue rank

A*

Where they publish

Papers

18 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLSynthetic Data Generation for Training Diversified Commonsense Reasoning Models.Tianhui Zhang, Bei Peng, Danushka Bollegala
2025ACLEvaluating the Evaluation of Diversity in Commonsense Generation.Tianhui Zhang, Bei Peng, Danushka Bollegala
2025CVPRSIDA: Social Media Image Deepfake Detection, Localization and Explanation with Large Multimodal Model.Zhenglin Huang, Jinwei Hu, Xiangtai Li, Yiwei He, Xingyu Zhao, Bei Peng, Baoyuan Wu, Xiaowei Huang, Guangliang Cheng
2025IROSLSTM-MHSA-Enhanced Deep Reinforcement Learning for Accurate Gait Control in Human Musculoskeletal Model.Shiyu Mao, Zihao Tang, Fanny Ficuciello, Bei Peng, Dunwen Wei
2024EMNLPImproving Diversity of Commonsense Generation by Large Language Models via In-Context Learning.Tianhui Zhang, Bei Peng, Danushka Bollegala
2024SGAIContextual Transformers for Goal-Oriented Reinforcement Learning.Oliver Dippel, Alexei Lisitsa, Bei Peng
2023IJCNLPLearning to Predict Concept Ordering for Common Sense Generation.Tianhui Zhang, Danushka Bollegala, Bei Peng
2023SGAIDeep Reinforcement Learning for Continuous Control of Material Thickness.Oliver Dippel, Alexei Lisitsa, Bei Peng
2021ICLRRODE: Learning Roles to Decompose Multi-Agent Tasks.Tonghan Wang, Tarun Gupta, Anuj Mahajan, Bei Peng, Shimon Whiteson, Chongjie Zhang
2021ICMLUneVEn: Universal Value Exploration for Multi-Agent Reinforcement Learning.Tarun Gupta, Anuj Mahajan, Bei Peng, Wendelin Boehmer, Shimon Whiteson
2021ICMLRandomized Entity-wise Factorization for Multi-Agent Reinforcement Learning.Shariq Iqbal, Christian A. Schrder de Witt, Bei Peng, Wendelin Boehmer, Shimon Whiteson, Fei Sha
2020ICLROptimistic Exploration even with a Pessimistic Initialisation.Tabish Rashid, Bei Peng, Wendelin Boehmer, Shimon Whiteson
2017ICMLInteractive Learning from Policy-Dependent Human Feedback.James MacGlashan, Mark K. Ho, Robert Tyler Loftin, Bei Peng, Guan Wang, David L. Roberts, Matthew E. Taylor, Michael L. Littman
2015AAAIGenerating Real-Time Crowd Advice to Improve Reinforcement Learning Agents.Gabriel Victor de la Cruz, Bei Peng, Walter Stephen Lasecki, Matthew Edmund Taylor
2015IUITowards Integrating Real-Time Crowd Advice with Reinforcement Learning.Gabriel Victor de la Cruz, Bei Peng, Walter S. Lasecki, Matthew E. Taylor
2014AAAIA Strategy-Aware Technique for Learning Behaviors from Discrete Human Feedback.Robert Tyler Loftin, James MacGlashan, Bei Peng, Matthew E. Taylor, Michael L. Littman, Jeff Huang, David L. Roberts
2014RO-MANLearning something from nothing: Leveraging implicit human feedback strategies.Robert Tyler Loftin, Bei Peng, James MacGlashan, Michael L. Littman, Matthew E. Taylor, Jeff Huang, David L. Roberts
2012APWEBA GPU-Based Accelerator for Chinese Word Segmentation.Xiwu Gu, Ruixuan Li, Kunmei Wen, Bei Peng, Weijun Xiao