Skip to content

Paul Weng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

37

Venues

15

Active years

2005–2025

Best venue rank

A*

Where they publish

Papers

37 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAIEnhancing Online Reinforcement Learning with Meta-Learned Objective from Offline Data.Shilong Deng, Zetao Zheng, Hongcai He, Paul Weng, Jie Shao
2025AAAIDUO: Diverse, Uncertain, On-Policy Query Generation and Selection for Reinforcement Learning from Human Feedback.Xuening Feng, Zhaohui Jiang, Timo Kaufmann, Puchen Xu, Eyke Hllermeier, Paul Weng, Yifei Zhu
2025ICLRReinforcement Learning from Imperfect Corrective Actions and Proxy Rewards.Zhaohui Jiang, Xuening Feng, Paul Weng, Yifei Zhu, Yan Song, Tianze Zhou, Yujing Hu, Tangjie Lv, Changjie Fan
2025ICMLComparing Comparisons: Informative and Easy Human Feedback with Distinguishability Queries.Xuening Feng, Zhaohui Jiang, Timo Kaufmann, Eyke Hllermeier, Paul Weng, Yifei Zhu
2024ICLRRevisiting Data Augmentation in Deep Reinforcement Learning.Jianshu Hu, Yunpeng Jiang, Paul Weng
2024ICMLINViT: A Generalizable Routing Problem Solver with Invariant Nested View Transformer.Han Fang, Zhihao Song, Paul Weng, Yutong Ban
2023ECAIFair Deep Reinforcement Learning with Preferential Treatment.Guanbao Yu, Umer Siddique, Paul Weng
2022ACMLCVaR-Regret Bounds for Multi-armed Bandits.Chenmien Tan, Paul Weng
2022CoRLSolving Complex Manipulation Tasks with Model-Assisted Model-Free Reinforcement Learning.Jianshu Hu, Paul Weng
2022ICMLNeuro-Symbolic Hierarchical Rule Induction.Claire Glanois, Zhaohui Jiang, Xuening Feng, Paul Weng, Matthieu Zimmer, Dong Li, Wulong Liu, Jianye Hao
2021ICMLLearning Fair Policies in Decentralized Cooperative Multi-Agent Reinforcement Learning.Matthieu Zimmer, Claire Glanois, Umer Siddique, Paul Weng
2020ICMLLearning Fair Policies in Multi-Objective (Deep) Reinforcement Learning with Average and Discounted Rewards.Umer Siddique, Paul Weng, Matthieu Zimmer
2019IJCAIExploiting the Sign of the Advantage Function to Learn Deterministic Policies in Continuous Domains.Matthieu Zimmer, Paul Weng
2019KDDDual Sequential Prediction Models Linking Sequential Recommendation and Information Dissemination.Qitian Wu, Yirui Gao, Xiaofeng Gao, Paul Weng, Guihai Chen
2019WWWDual Graph Attention Networks for Deep Latent Representation of Multifaceted Social Effects in Recommender Systems.Qitian Wu, Hengrui Zhang, Xiaofeng Gao, Peng He, Paul Weng, Han Gao, Guihai Chen
2018CIKMAdversarial Training Model Unifying Feature Driven and Point Process Perspectives for Event Popularity Prediction.Qitian Wu, Chaoqi Yang, Hengrui Zhang, Xiaofeng Gao, Paul Weng, Guihai Chen
2018COMMAMediation of Debates with Dynamic Argumentative Behaviors.Emmanuel Hadoux, Aurlie Beynier, Nicolas Maudet, Paul Weng
2018ICPRRepresenting Relative Visual Attributes with a Reference-Point-Based Decision Model.Marc T. Law, Paul Weng
2017AAAIOptimizing Quantiles in Preference-Based Markov Decision Processes.Hugo Gilbert, Paul Weng, Yan Xu
2017COCOAAn Efficient Primal-Dual Algorithm for Fair Combinatorial Optimization Problems.Viet Hung Nguyen, Paul Weng
2017ICMLMulti-objective Bandits: Optimizing the Generalized Gini Index.Rbert Busa-Fekete, Balzs Szrnyi, Paul Weng, Shie Mannor
2016UAIModel-Free Reinforcement Learning with Skew-Symmetric Bilinear Utilities.Hugo Gilbert, Bruno Zanuttini, Paul Weng, Paolo Viappiani, Esther Nicart
2015ICMLQualitative Multi-Armed Bandits: A Quantile-Based Approach.Balzs Szrnyi, Rbert Busa-Fekete, Paul Weng, Eyke Hllermeier
2015IJCAISolving MDPs with Skew Symmetric Bilinear Utility Functions.Hugo Gilbert, Olivier Spanjaard, Paolo Viappiani, Paul Weng
2015IJCAIOptimization of Probabilistic Argumentation with Markov Decision Models.Emmanuel Hadoux, Aurlie Beynier, Nicolas Maudet, Paul Weng, Anthony Hunter
2014AAAIPreface.Darius Braziunas, Markus Endres, K. Brent Venable, Paul Weng, Lirong Xia
2013AAAIApproximation of Lorenz-Optimal Solutions in Multiobjective Markov Decision Processes.Patrice Perny, Paul Weng, Judy Goldsmith, Josiah Hanna
2013ICMLTop-k Selection based on Adaptive Sampling of Noisy Preferences.Rbert Busa-Fekete, Balzs Szrnyi, Weiwei Cheng, Paul Weng, Eyke Hllermeier
2013IJCAIInteractive Value Iteration for Markov Decision Processes with Unknown Rewards.Paul Weng, Bruno Zanuttini
2013UAIApproximation of Lorenz-Optimal Solutions in Multiobjective Markov Decision Processes.Patrice Perny, Paul Weng, Judy Goldsmith, Josiah Hanna
2012ECAIOrdinal Decision Models for Markov Decision Processes.Paul Weng
2012MDAIOn WOWA Rank Reversal.Wlodzimierz Ogryczak, Patrice Perny, Paul Weng
2010ECAIOn Finding Compromise Solutions in Multiobjective Markov Decision Processes.Patrice Perny, Paul Weng
2006ECAIAn Axiomatic Approach in Qualitative Decision Theory with Binary Possibilistic Utility.Paul Weng
2006UAIAxiomatic Foundations for a Class of Generalized Expected Utility: Algebraic Expected Utility.Paul Weng
2005IJCAIAlgebraic Markov Decision Processes.Patrice Perny, Olivier Spanjaard, Paul Weng
2005UAIQualitative Decision Making Under Possibilistic Uncertainty: Toward more Discriminating Criteria.Paul Weng