| 2025 | UAI | Adaptive Human-Robot Collaboration using Type-Based IRL. | Prasanth Sengadu Suresh, Prashant Doshi, Bikramjit Banerjee |
| 2024 | PRIMA | Robust Individualistic Learning in Many-Agent Systems. | Keyang He, Prashant Doshi, Bikramjit Banerjee |
| 2022 | CoRL | Online Inverse Reinforcement Learning with Learned Observation Model. | Saurabh Arora, Prashant Doshi, Bikramjit Banerjee |
| 2022 | UAI | Reinforcement learning in many-agent settings under partial observability. | Keyang He, Prashant Doshi, Bikramjit Banerjee |
| 2021 | ICRA | Min-Max Entropy Inverse RL of Multiple Tasks. | Saurabh Arora, Prashant Doshi, Bikramjit Banerjee |
| 2019 | AAAI | Model-Free IRL Using Maximum Likelihood Estimation. | Vinamra Jain, Prashant Doshi, Bikramjit Banerjee |
| 2018 | IROS | Autonomous Acquisition of Behavior Trees for Robot Control. | Bikramjit Banerjee |
| 2016 | AAAI | Detection of Plan Deviation in Multi-Agent Systems. | Bikramjit Banerjee, Steven Loscalzo, Daniel Lucas Thompson |
| 2014 | AAAI | Model AI Assignments 2014. | Todd W. Neller, Laura E. Brown, Roger L. West, James E. Heliotis, Sean Strout, Ivona Bezkov, Bikramjit Banerjee, Daniel Lucas Thompson |
| 2013 | AAAI | Pruning for Monte Carlo Distributed Reinforcement Learning in Decentralized POMDPs. | Bikramjit Banerjee |
| 2012 | AAAI | Sample Bounded Distributed Reinforcement Learning for Decentralized POMDPs. | Bikramjit Banerjee, Jeremy Lyle, Landon Kraemer, Rajesh Yellamraju |
| 2012 | AAAI | Informed Initial Policies for Learning in Dec-POMDPs. | Landon Kraemer, Bikramjit Banerjee |
| 2012 | AAMAS | Efficient context free parsing of multi-agent activities for team and plan recognition. | Bikramjit Banerjee, Jeremy Lyle, Landon Kraemer |
| 2011 | AAAI | Branch and Price for Multi-Agent Plan Recognition. | Bikramjit Banerjee, Landon Kraemer |
| 2010 | AAAI | Search Performance of Multi-Agent Plan Recognition in a General Model. | Bikramjit Banerjee, Landon Kraemer |
| 2010 | AAAI | Multi-Agent Plan Recognition: Formalization and Algorithms. | Bikramjit Banerjee, Landon Kraemer, Jeremy Lyle |
| 2008 | PADS | Advancing the Layered Approach to Agent-Based Crowd Simulation. | Bikramjit Banerjee, Ahmed Abukmail, Landon Kraemer |
| 2007 | IJCAI | General Game Learning Using Knowledge Transfer. | Bikramjit Banerjee, Peter Stone |
| 2005 | AAAI | Efficient No-Regret Multiagent Learning. | Bikramjit Banerjee, Jing Peng |
| 2004 | AAAI | Performance Bounded Reinforcement Learning in Strategic Interactions. | Bikramjit Banerjee, Jing Peng |
| 2001 | IJCAI | Fast Concurrent Reinforcement Learners. | Bikramjit Banerjee, Sandip Sen, Jing Peng |
| 2001 | KDD | Mining user session data to facilitate user interaction with a customer service knowledge base in RightNow Web. | Doug Warner, J. Neal Richter, Stephen D. Durbin, Bikramjit Banerjee |
| 2000 | ICML | Combining Multiple Perspectives. | Bikramjit Banerjee, Sandip Debnath, Sandip Sen |