Skip to content

Benjamin Van Roy

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

24

Venues

11

Active years

2000–2026

Best venue rank

A*

Where they publish

Papers

24 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIMisalignment from Treating Means as Ends.Henrik Marklund, Alex Infanger, Benjamin Van Roy
2024ICMLEfficient Exploration for LLMs.Vikranth Dwaracherla, Seyed Mohammad Asghari, Botao Hao, Benjamin Van Roy
2024ICMLAn Information-Theoretic Analysis of In-Context Learning.Hong Jun Jeon, Jason D. Lee, Qi Lei, Benjamin Van Roy
2023AISTATSNonstationary Bandit Learning via Predictive Sampling.Yueyang Liu, Benjamin Van Roy, Kuang Xu
2023CIKMScalable Neural Contextual Bandit for Recommender Systems.Zheqing Zhu, Benjamin Van Roy
2023ICMLLeveraging Demonstrations to Improve Online Learning: Quality Matters.Botao Hao, Rahul Jain, Tor Lattimore, Benjamin Van Roy, Zheng Wen
2023RecSysDeep Exploration for Recommendation Systems.Zheqing Zhu, Benjamin Van Roy
2023UAIApproximate Thompson Sampling via Epistemic Neural Networks.Ian Osband, Zheng Wen, Seyed Mohammad Asghari, Vikranth Dwaracherla, Morteza Ibrahimi, Xiuyuan Lu, Benjamin Van Roy
2022UAIEvaluating high-order predictive distributions in deep learning.Ian Osband, Zheng Wen, Seyed Mohammad Asghari, Vikranth Dwaracherla, Xiuyuan Lu, Benjamin Van Roy
2021ICMLDeciding What to Learn: A Rate-Distortion Approach.Dilip Arumugam, Benjamin Van Roy
2020ICLRHypermodels for Exploration.Vikranth Dwaracherla, Xiuyuan Lu, Morteza Ibrahimi, Ian Osband, Zheng Wen, Benjamin Van Roy
2020ICLRBehaviour Suite for Reinforcement Learning.Ian Osband, Yotam Doron, Matteo Hessel, John Aslanides, Eren Sezener, Andre Saraiva, Katrina McKinney, Tor Lattimore, Csaba Szepesvri, Satinder Singh, Benjamin Van Roy, Richard S. Sutton, David Silver, Hado van Hasselt
2019COLTOn the Performance of Thompson Sampling on Logistic Bandits.Shi Dong, Tengyu Ma, Benjamin Van Roy
2018ICMLCoordinated Exploration in Concurrent Reinforcement Learning.Maria Dimakopoulou, Benjamin Van Roy
2017ICMLWhy is Posterior Sampling Better than Optimism for Reinforcement Learning?Ian Osband, Benjamin Van Roy
2016ICMLGeneralization and Exploration via Randomized Value Functions.Ian Osband, Benjamin Van Roy, Zheng Wen
2009RecSysManipulation-resistant collaborative filtering systems.Benjamin Van Roy, Xiang Yan
2008SIGCOMMReputation markets.Xiang Yan, Benjamin Van Roy
2007ISITCapacity and Zero-Error Capacity of the Chemical Channel with Feedback.Haim H. Permuter, Paul Cuff, Benjamin Van Roy, Tsachy Weissman
2005ISITA universal scheme for learning.Vivek F. Farias, Ciamac C. Moallemi, Benjamin Van Roy, Tsachy Weissman
2004WAWMaking Eigenvector-Based Reputation Systems Robust to Collusion.Hui Zhang, Ashish Goel, Ramesh Govindan, Kahn Mason, Benjamin Van Roy
2001ICMLA Generalized Kalman Filter for Fixed Point Approximation and Efficient Temporal Difference Learning.David Choi, Benjamin Van Roy
2001UAIA Tractable POMDP for Dynamic Sequencing with Applications to Personalized Internet Content Provision.Paat Rusmevichientong, Benjamin Van Roy
2000ICMLFixed Points of Approximate Value Iteration and Temporal-Difference Learning.Daniela Pucci de Farias, Benjamin Van Roy