Skip to content

Stephen Marcus McAleer

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

12

Venues

3

Active years

2022–2026

Best venue rank

A*

Where they publish

Papers

12 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIFaster Game Solving via Hyperparameter Schedules.Naifeng Zhang, Stephen Marcus McAleer, Tuomas Sandholm
2024ICLRLlemma: An Open Language Model for Mathematics.Zhangir Azerbayev, Hailey Schoelkopf, Keiran Paster, Marco Dos Santos, Stephen Marcus McAleer, Albert Q. Jiang, Jia Deng, Stella Biderman, Sean Welleck
2024ICLRIllusory Attacks: Information-theoretic detectability matters in adversarial attacks.Tim Franzmeyer, Stephen Marcus McAleer, Joo F. Henriques, Jakob Nicolaus Foerster, Philip Torr, Adel Bibi, Christian Schrder de Witt
2024ICLRGame-Theoretic Robust Reinforcement Learning Handles Temporally-Coupled Perturbations.Yongyuan Liang, Yanchao Sun, Ruijie Zheng, Xiangyu Liu, Benjamin Eysenbach, Tuomas Sandholm, Furong Huang, Stephen Marcus McAleer
2024ICLRToward Optimal Policy Population Growth in Two-Player Zero-Sum Games.Stephen Marcus McAleer, JB Lanier, Kevin A. Wang, Pierre Baldi, Tuomas Sandholm, Roy Fox
2024ICLRConfronting Reward Model Overoptimization with Constrained RLHF.Ted Moskovitz, Aaditya K. Singh, DJ Strouse, Tuomas Sandholm, Ruslan Salakhutdinov, Anca D. Dragan, Stephen Marcus McAleer
2024ICMLAlphaZero-Like Tree-Search can Guide Large Language Model Decoding and Training.Ziyu Wan, Xidong Feng, Muning Wen, Stephen Marcus McAleer, Ying Wen, Weinan Zhang, Jun Wang
2023ICLRESCHER: Eschewing Importance Sampling in Games by Computing a History Value Function to Estimate Regret.Stephen Marcus McAleer, Gabriele Farina, Marc Lanctot, Tuomas Sandholm
2023ICMLMANSA: Learning Fast and Slow in Multi-Agent Systems.David Henry Mguni, Haojun Chen, Taher Jafferjee, Jianhong Wang, Longfei Yue, Xidong Feng, Stephen Marcus McAleer, Feifei Tong, Jun Wang, Yaodong Yang
2023ICMLA Game-Theoretic Framework for Managing Risk in Multi-Agent Systems.Oliver Slumbers, David Henry Mguni, Stefano B. Blumberg, Stephen Marcus McAleer, Yaodong Yang, Jun Wang
2023ICMLRegret-Minimizing Double Oracle for Extensive-Form Games.Xiaohang Tang, Le Cong Dinh, Stephen Marcus McAleer, Yaodong Yang
2022ICMLProving Theorems using Incremental Learning and Hindsight Experience Replay.Eser Aygn, Ankit Anand, Laurent Orseau, Xavier Glorot, Stephen Marcus McAleer, Vlad Firoiu, Lei M. Zhang, Doina Precup, Shibl Mourad