Skip to content

Alec Koppel

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

56

Venues

10

Active years

2014–2025

Best venue rank

A*

Where they publish

Papers

56 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAIDecentralized Convergence to Equilibrium Prices in Trading Networks.Edwin Lock, Benjamin Patrick Evans, Eleonora Kreacic, Sujay Bhatt, Alec Koppel, Sumitra Ganesh, Paul W. Goldberg
2025AISTATSApproximate Equivariance in Reinforcement Learning.Jung Yeon Park, Sujay Bhatt, Sihan Zeng, Lawson L. S. Wong, Alec Koppel, Sumitra Ganesh, Robin Walters
2025AISTATSLearning in Herding Mean Field Games: Single-Loop Algorithm with Finite-Time Convergence Analysis.Sihan Zeng, Sujay Bhatt, Alec Koppel, Sumitra Ganesh
2025ICASSPPartially Observable Contextual Bandits With Linear Payoffs.Sihan Zeng, Sujay Bhatt, Alec Koppel, Sumitra Ganesh
2025ICLRCollab: Controlled Decoding using Mixture of Agents for LLM Alignment.Souradip Chakraborty, Sujay Bhatt, Udari Madhushani Sehwag, Soumya Suvra Ghosal, Jiahao Qiu, Mengdi Wang, Dinesh Manocha, Furong Huang, Alec Koppel, Sumitra Ganesh
2025ICLRGenARM: Reward Guided Generation with Autoregressive Reward Model for Test-Time Alignment.Yuancheng Xu, Udari Madhushani Sehwag, Alec Koppel, Sicheng Zhu, Bang An, Furong Huang, Sumitra Ganesh
2025IROSConfidence-Controlled Exploration: Efficient Sparse-Reward Policy Learning for Robot Navigation.Bhrij Patel, Kasun Weerakoon, Wesley A. Suttle, Alec Koppel, Brian M. Sadler, Tianyi Zhou, Dinesh Manocha, Amrit Singh Bedi
2024ACSSCBimodal Bandits: Max-Mean Regret Minimization.Adit Jain, Sujay Bhatt, Vikram Krishnamurthy, Alec Koppel
2024AISTATSSharpened Lazy Incremental Quasi-Newton Method.Aakash Sunil Lahoti, Spandan Senapati, Ketan Rajawat, Alec Koppel
2024ICLRPARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human Feedback.Souradip Chakraborty, Amrit Singh Bedi, Alec Koppel, Huazheng Wang, Dinesh Manocha, Mengdi Wang, Furong Huang
2024ICLREfficient Inverse Multiagent Learning.Denizalp Goktas, Amy Greenwald, Sadie Zhao, Alec Koppel, Sumitra Ganesh
2024ICMLMaxMin-RLHF: Alignment with Diverse Human Preferences.Souradip Chakraborty, Jiahao Qiu, Hui Yuan, Alec Koppel, Dinesh Manocha, Furong Huang, Amrit S. Bedi, Mengdi Wang
2024ICMLInformation-Directed Pessimism for Offline Reinforcement Learning.Alec Koppel, Sujay Bhatt, Jiacheng Guo, Joe Eappen, Mengdi Wang, Sumitra Ganesh
2024ICMLTowards Global Optimality for Practical Average Reward Reinforcement Learning without Mixing Time Oracles.Bhrij Patel, Wesley A. Suttle, Alec Koppel, Vaneet Aggarwal, Brian M. Sadler, Dinesh Manocha, Amrit S. Bedi
2024WSCLearning Payment-Free Resource Allocation Mechanisms.Sihan Zeng, Sujay Bhatt, Eleonora Kreacic, Parisa Hassanzadeh, Alec Koppel, Sumitra Ganesh
2023AAAIPosterior Coreset Construction with Kernelized Stein Discrepancy for Model-Based Reinforcement Learning.Souradip Chakraborty, Amrit Singh Bedi, Pratap Tokekar, Alec Koppel, Brian M. Sadler, Furong Huang, Dinesh Manocha
2023AISTATSOracle-free Reinforcement Learning in Mean-Field Games along a Single Sample Path.Muhammad Aneeq uz Zaman, Alec Koppel, Sujay Bhatt, Tamer Basar
2023CISSInformation-Directed Policy Search in Sparse-Reward Settings via the Occupancy Information Ratio.Wesley A. Suttle, Alec Koppel, Ji Liu
2023ICMLSTEERING : Stein Information Directed Exploration for Model-Based Reinforcement Learning.Souradip Chakraborty, Amrit S. Bedi, Alec Koppel, Mengdi Wang, Furong Huang, Dinesh Manocha
2023ICMLBeyond Exponentially Fast Mixing in Average-Reward Reinforcement Learning via Multi-Level Monte Carlo Actor-Critic.Wesley A. Suttle, Amrit S. Bedi, Bhrij Patel, Brian M. Sadler, Alec Koppel, Dinesh Manocha
2023ICRADealing with Sparse Rewards in Continuous Control Robotics via Heavy-Tailed Policy Optimization.Souradip Chakraborty, Amrit Singh Bedi, Kasun Weerakoon, Prithvi Poddar, Alec Koppel, Pratap Tokekar, Dinesh Manocha
2023ICRADecentralized Multi-agent Exploration with Limited Inter-agent Communications.Hans He, Alec Koppel, Amrit Singh Bedi, Daniel J. Stilwell, Mazen Farhood, Benjamin Biggs
2022AAAIAchieving Zero Constraint Violation for Constrained Reinforcement Learning via Primal-Dual Approach.Qinbo Bai, Amrit Singh Bedi, Mridul Agarwal, Alec Koppel, Vaneet Aggarwal
2022AAAIMulti-Agent Reinforcement Learning with General Utilities via Decentralized Shadow Reward Actor-Critic.Junyu Zhang, Amrit Singh Bedi, Mengdi Wang, Alec Koppel
2022CISSPolicy Gradient for Ratio Optimization: A Case Study.Wesley A. Suttle, Alec Koppel, Ji Liu
2022ICASSPOn Submodular Set Cover Problems for Near-Optimal Online Kernel Basis Selection.Hrusikesha Pradhan, Alec Koppel, Ketan Rajawat
2022ICMLOn the Hidden Biases of Policy Mirror Ascent in Continuous Action Spaces.Amrit Singh Bedi, Souradip Chakraborty, Anjaly Parayil, Brian M. Sadler, Pratap Tokekar, Alec Koppel
2022ICMLSharpened Quasi-Newton Methods: Faster Superlinear Rate and Larger Local Convergence Neighborhood.Qiujiang Jin, Alec Koppel, Ketan Rajawat, Aryan Mokhtari
2022IROSDistributed Riemannian Optimization with Lazy Communication for Collaborative Geometric Estimation.Yulun Tian, Amrit Singh Bedi, Alec Koppel, Miguel Calvo-Fullana, David M. Rosen, Jonathan P. How
2021ACSSCProjected Pseudo-Mirror Descent in Reproducing Kernel Hilbert Space.Abhishek Chakraborty, Ketan Rajawat, Alec Koppel
2021ACSSCRandomized Linear Programming for Tabular Average-Cost Multi-agent Reinforcement Learning.Alec Koppel, Amrit Singh Bedi, Bhargav Ganguly, Vaneet Aggarwal
2021ACSSCCollaborative Beamforming for Agents with Localization Errors.Erfaun Noorani, Yagiz Savas, Alec Koppel, John S. Baras, Ufuk Topcu, Brian M. Sadler
2021ICASSPA Dynamical Systems Perspective on Online Bayesian Nonparametric Estimators with Adaptive Hyperparameters.Alec Koppel, Amrit S. Bedi, Vikram Krishnamurthy
2021IROSWasserstein-Splitting Gaussian Process Regression for Heterogeneous Online Bayesian Inference.Michael E. Kepler, Alec Koppel, Amrit Singh Bedi, Daniel J. Stilwell
2020ACSSCConservative Multi-agent Online Kernel Learning in Heterogeneous Networks.Hrusikesha Pradhan, Amrit Singh Bedi, Alec Koppel, Ketan Rajawat
2020CISSReduced-rank Least Squares Parameter Estimation in the Presence of Byzantine Sensors.Nagananda K. G, Rick S. Blum, Alec Koppel
2020ICASSPBalancing Rates and Variance via Adaptive Batch-Sizes in First-Order Stochastic Optimization.Zhan Gao, Alec Koppel, Alejandro Ribeiro
2020ICASSPProjection Free Dynamic Online Learning.Deepak S. Kalhan, Amrit S. Bedi, Alec Koppel, Ketan Rajawat, Abhishek K. Gupta, Adrish Banerjee
2020IROSDense Incremental Metric-Semantic Mapping via Sparse Gaussian Process Regression.Ehsan Zobeidi, Alec Koppel, Nikolay Atanasov
2019ACSSCCompressed Streaming Importance Sampling for Efficient Representations of Localization Distributions.Amrit Singh Bedi, Alec Koppel, Brian M. Sadler, Vctor Elvira
2019CISSPolicy Gradient using Weak Derivatives for Reinforcement Learning.Sujay Bhatt, Alec Koppel, Vikram Krishnamurthy
2019CISSPolicy Search in Infinite-Horizon Discounted Reinforcement Learning: Advances through Connections to Non-Convex Optimization : Invited Presentation.Kaiqing Zhang, Alec Koppel, Hao Zhu, Tamer Basar
2018ACSSCDecentralized Online Nonparametric Learning.Alec Koppel, Santiago Paternain, Cdric Richard, Alejandro Ribeiro
2018ICASSPParallel Stochastic Successive Convex Approximation Method for Large-Scale Dictionary Learning.Alec Koppel, Aryan Mokhtari, Alejandro Ribeiro
2018IROSComposable Learning with Sparse Kernel Representations.Ekaterina I. Tolstaya, Ethan Stump, Alec Koppel, Alejandro Ribeiro
2017ACSSCBeyond consensus and synchrony in decentralized online optimization using saddle point method.Amrit Singh Bedi, Alec Koppel, Ketan Rajawat
2017ICASSPParsimonious Online Learning with Kernels via sparse projections in function space.Alec Koppel, Garrett Warnell, Ethan Stump, Alejandro Ribeiro
2017ICASSPLarge-scale nonconvex stochastic optimization by Doubly Stochastic Successive Convex approximation.Aryan Mokhtari, Alec Koppel, Gesualdo Scutari, Alejandro Ribeiro
2016ACSSCDoubly stochastic algorithms for large-scale optimization.Alec Koppel, Aryan Mokhtari, Alejandro Ribeiro
2016ICASSPProximity without consensus in online multi-agent optimization.Alec Koppel, Brian M. Sadler, Alejandro Ribeiro
2016IROSOnline learning for characterizing unknown environments in ground robotic vehicle models.Alec Koppel, Jonathan Fink, Garrett Warnell, Ethan Stump, Alejandro Ribeiro
2015ACSSCTask-driven dictionary learning in distributed online settings.Alec Koppel, Garrett Warned, Ethan Stump
2015ACSSCPrediction-correction methods for time-varying convex optimization.Andrea Simonetto, Alec Koppel, Aryan Mokhtari, Geert Leus, Alejandro Ribeiro
2015ICASSPRegret bounds of a distributed saddle point algorithm.Alec Koppel, Felicia Y. Jakubiec, Alejandro Ribeiro
2015IROSD4L: Decentralized dynamic discriminative dictionary learning.Alec Koppel, Garrett Warnell, Ethan Stump, Alejandro Ribeiro
2014ICASSPA saddle point algorithm for networked online convex optimization.Alec Koppel, Felicia Y. Jakubiec, Alejandro Ribeiro