| 2026 | AAAI | Optimizing Ride-Pooling Operations with Extended Pickup and Drop-Off Flexibility. | Hao Jiang, Yixin Xu, Pradeep Varakantham |
| 2026 | AIED | RL Agents Reveal What's Hard: Bootstrapping Difficulty-Ordered Curricula for Human Learners. | Sidney Tio, Wenjun Li, Ramesha Karunasena, Pradeep Varakantham |
| 2025 | AAAI | Offline Safe Reinforcement Learning Using Trajectory Classification. | Ze Gong, Akshat Kumar, Pradeep Varakantham |
| 2025 | AAAI | Marginal Benefit Driven RL Teacher for Unsupervised Environment Design. | Dexun Li, Wenjun Li, Pradeep Varakantham |
| 2025 | ICLR | On Minimizing Adversarial Counterfactual Error in Adversarial Reinforcement Learning. | Roman Belaire, Arunesh Sinha, Pradeep Varakantham |
| 2025 | ICLR | Bootstrapping Language Models with DPO Implicit Rewards. | Changyu Chen, Zichen Liu, Chao Du, Tianyu Pang, Qian Liu, Arunesh Sinha, Pradeep Varakantham, Min Lin |
| 2025 | ICLR | Semantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs. | Yuxiao Lu, Arunesh Sinha, Pradeep Varakantham |
| 2025 | ICLR | On Generalization Across Environments In Multi-Objective Reinforcement Learning. | Jayden Teoh, Pradeep Varakantham, Peter Vamplew |
| 2025 | NAACL | Unlocking the Planning Capabilities of Large Language Models with Maximum Diversity Fine-tuning. | Wenjun Li, Changyu Chen, Pradeep Varakantham |
| 2024 | AAAI | Imitate the Good and Avoid the Bad: An Incremental Approach to Safe Reinforcement Learning. | Huy Hoang, Tien Mai, Pradeep Varakantham |
| 2024 | AAAI | Reward Penalties on Augmented States for Solving Richly Constrained RL Effectively. | Hao Jiang, Tien Mai, Pradeep Varakantham, Huy Hoang |
| 2024 | AAAI | Unsupervised Training Sequence Design: Efficient and Generalizable Agent Training. | Wenjun Li, Pradeep Varakantham |
| 2024 | AAAI | Handling Long and Richly Constrained Tasks through Constrained Hierarchical Reinforcement Learning. | Yuxiao Lu, Arunesh Sinha, Pradeep Varakantham |
| 2024 | ECAI | Preserving the Privacy of Reward Functions in MDPs through Deception. | Shashank Reddy Chirra, Pradeep Varakantham, Praveen Paruchuri |
| 2024 | ICAPS | Imitating Cost-Constrained Behaviors in Reinforcement Learning. | Qian Shao, Pradeep Varakantham, Shih-Fen Cheng |
| 2024 | PRICAI | IRL for Restless Multi-armed Bandits with Applications in Maternal and Child Health. | Gauri Jain, Pradeep Varakantham, Haifeng Xu, Aparna Taneja, Prashant Doshi, Milind Tambe |
| 2023 | AAAI | Constrained Reinforcement Learning in Hard Exploration Problems. | Pathmanathan Pankayaraj, Pradeep Varakantham |
| 2023 | AAAI | Future Aware Pricing and Matching for Sustainable On-Demand Ride Pooling. | Xianjie Zhang, Pradeep Varakantham, Hao Jiang |
| 2023 | ECAI | On Sustainable Ride Pooling Through Conditional Expected Value Decomposition. | Avinandan Bose, Hao Jiang, Pradeep Varakantham, Zichang Ge |
| 2023 | IJCAI | Generalization through Diversity: Improving Unsupervised Environment Design. | Wenjun Li, Pradeep Varakantham, Dexun Li |
| 2023 | IJCAI | Transferable Curricula through Difficulty Conditioned Generators. | Sidney Tio, Pradeep Varakantham |
| 2022 | AAAI | Facilitating Human-Wildlife Cohabitation through Conflict Prediction. | Susobhan Ghosh, Pradeep Varakantham, Aniket Bhatkhande, Tamanna Ahmad, Anish Andheria, Wenjun Li, Aparna Taneja, Divy Thakkar, Milind Tambe |
| 2022 | AAAI | Field Study in Deploying Restless Multi-Armed Bandits: Assisting Non-profits in Improving Maternal and Child Health. | Aditya Mate, Lovish Madaan, Aparna Taneja, Neha Madhiwalla, Shresth Verma, Gargi Singh, Aparna Hegde, Pradeep Varakantham, Milind Tambe |
| 2022 | UAI | Efficient resource allocation with fairness constraints in restless multi-armed bandits. | Dexun Li, Pradeep Varakantham |
| 2021 | IJCAI | Learn to Intervene: An Adaptive Learning Policy for Restless Bandits in Application to Preventive Healthcare. | Arpita Biswas, Gaurav Aggarwal, Pradeep Varakantham, Milind Tambe |
| 2021 | UAI | CLAIM: curriculum learning policy for influence maximization in unknown social networks. | Dexun Li, Meghna Lowalekar, Pradeep Varakantham |
| 2020 | AAAI | Neural Approximate Dynamic Programming for On-Demand Ride-Pooling. | Sanket Shah, Meghna Lowalekar, Pradeep Varakantham |
| 2020 | AAAI | Solving Online Threat Screening Games using Constrained Action Space Reinforcement Learning. | Sanket Shah, Arunesh Sinha, Pradeep Varakantham, Andrew Perrault, Milind Tambe |
| 2019 | UAI | Correlated Learning for Aggregation Systems. | Tanvi Verma, Pradeep Varakantham |
| 2018 | AAAI | Dispatch Guided Allocation Optimization for Effective Emergency Response. | Supriyo Ghosh, Pradeep Varakantham |
| 2018 | AAAI | Upping the Game of Taxi Driving in the Age of Uber. | Shashi Shekhar Jha, Shih-Fen Cheng, Meghna Lowalekar, Nicholas Wong, Rishikeshan Rajendram, Trong Khiem Tran, Pradeep Varakantham, Trong Nghia Truong, Firmansyah Bin Abd Rahman |
| 2018 | UAI | Decentralized Planning for Non-dedicated Agent Teams with Submodular Rewards in Uncertain Environments. | Pritee Agrawal, Pradeep Varakantham, William Yeoh |
| 2017 | AAAI | Decentralized Planning in Stochastic Environments with Submodular Rewards. | Rajiv Ranjan Kumar, Pradeep Varakantham, Akshat Kumar |
| 2017 | IJCAI | Proactive and Reactive Coordination of Non-dedicated Agent Teams Operating in Uncertain Environments. | Pritee Agrawal, Pradeep Varakantham |
| 2017 | IJCAI | Mechanism Design for Strategic Project Scheduling. | Pradeep Varakantham, Na Fu |
| 2016 | AAAI | Solving Risk-Sensitive POMDPs With and Without Cost Observations. | Ping Hou, William Yeoh, Pradeep Varakantham |
| 2016 | AAAI | Robust Decision Making for Stochastic Network Design. | Akshat Kumar, Arambam James Singh, Pradeep Varakantham, Daniel Sheldon |
| 2016 | AAAI | NLU Framework for Voice Enabling Non-Native Applications on Smart Devices. | Soujanya Lanka, Deepika Pathania, Pooja Kushalappa, Pradeep Varakantham |
| 2016 | AAAI | Online Spatio-Temporal Matching in Stochastic and Dynamic Domains. | Meghna Lowalekar, Pradeep Varakantham, Patrick Jaillet |
| 2016 | AAAI | A Proactive Sampling Approach to Project Scheduling under Uncertainty. | Pradeep Varakantham, Na Fu, Hoong Chuin Lau |
| 2016 | ECAI | Detecting Communities Using Coordination Games: A Short Paper. | Radhika Arava, Pradeep Varakantham |
| 2016 | ECAI | An Intelligent System for Personalized Conference Event Recommendation and Scheduling. | Aldy Gunawan, Hoong Chuin Lau, Pradeep Varakantham, Wenjie Wang |
| 2016 | IJCAI | Scalable Greedy Algorithms for Task/Resource Constrained Multi-Agent Stochastic Planning. | Pritee Agrawal, Pradeep Varakantham, William Yeoh |
| 2016 | IJCAI | Robust Repositioning to Counter Unpredictable Demand in Bike Sharing Systems. | Supriyo Ghosh, Michael A. Trick, Pradeep Varakantham |
| 2016 | IJCAI | Sequential Decision Making for Improving Efficiency in Urban Environments. | Pradeep Varakantham |
| 2015 | AAAI | Solving Uncertain MDPs with Objectives that Are Separable over Instantiations of Model Uncertainty. | Yossiri Adulyasak, Pradeep Varakantham, Asrar Ahmed, Patrick Jaillet |
| 2015 | AAAI | Dynamic Redeployment to Counter Congestion or Starvation in Vehicle Sharing Systems. | Supriyo Ghosh, Pradeep Varakantham, Yossiri Adulyasak, Patrick Jaillet |
| 2015 | AAAI | Risk Based Optimization for Improving Emergency Medical Systems. | Sandhya Saisubramanian, Pradeep Varakantham, Hoong Chuin Lau |
| 2015 | IJCAI | Probabilistic Inference Based Message-Passing for Resource Constrained DCOPs. | Supriyo Ghosh, Akshat Kumar, Pradeep Varakantham |
| 2015 | SoCS | Dynamic Redeployment to Counter Congestion or Starvation in Vehicle Sharing Systems. | Supriyo Ghosh, Pradeep Varakantham, Yossiri Adulyasak, Patrick Jaillet |
| 2014 | AAAI | STREETS: Game-Theoretic Traffic Patrolling with Exploration and Exploitation. | Matthew Brown, Sandhya Saisubramanian, Pradeep Varakantham, Milind Tambe |
| 2014 | AAAI | Decentralized Stochastic Planning with Anonymity in Interactions. | Pradeep Varakantham, Yossiri Adulyasak, Patrick Jaillet |
| 2014 | ECAI | Unleashing Dec-MDPs in Security Games: Enabling Effective Defender Teamwork. | Eric Anyung Shieh, Albert Xin Jiang, Amulya Yadav, Pradeep Varakantham, Milind Tambe |
| 2014 | PRIMA | Marginal Contribution Stochastic Games for Dynamic Resource Allocation. | Archie C. Chapman, Pradeep Varakantham |
| 2013 | IAAI | Scalable Randomized Patrolling for Securing Rapid Transit Networks. | Pradeep Varakantham, Hoong Chuin Lau, Zhi Yuan |
| 2013 | WSC | An agent-based simulation approach to experience management in theme parks. | Shih-Fen Cheng, Larry Lin, Jiali Du, Hoong Chuin Lau, Pradeep Varakantham |
| 2012 | AAAI | Decision Support for Agent Populations in Uncertain and Congested Environments. | Pradeep Varakantham, Shih-Fen Cheng, Geoffrey J. Gordon, Asrar Ahmed |
| 2012 | AAMAS | Lagrangian relaxation for large-scale multi-agent planning. | Geoffrey J. Gordon, Pradeep Varakantham, William Yeoh, Hoong Chuin Lau, Ajay S. Aravamudhan, Shih-Fen Cheng |
| 2012 | AAMAS | SAVES: a sustainable multiagent application to conserve building energy considering occupants. | Jun-young Kwak, Pradeep Varakantham, Rajiv T. Maheswaran, Milind Tambe, Farrokh Jazizadeh, Geoffrey Kavulya, Laura Klein, Burcin Becerik-Gerber, Timothy Hayes, Wendy Wood |
| 2012 | AAMAS | Sustainable multiagent application to conserve energy (demonstration). | Jun-young Kwak, Pradeep Varakantham, Rajiv T. Maheswaran, Milind Tambe, Farrokh Jazizadeh, Geoffrey Kavulya, Laura Klein, Burcin Becerik-Gerber, Timothy Hayes, Wendy Wood |
| 2012 | AAMAS | Delayed observation planning in partially observable domains. | Pradeep Varakantham, Janusz Marecki |
| 2012 | AAMAS | Prioritized shaping of models for solving DEC-POMDPs. | Pradeep Varakantham, William Yeoh, Prasanna Velagapudi, Katia P. Sycara, Paul Scerri |
| 2012 | AAMAS | Active malware analysis using stochastic games. | Simon Andrew Williamson, Pradeep Varakantham, Ong Chen Hui, Debin Gao |
| 2012 | UAI | Uncertain Congestion Games with Assorted Human Agent Populations. | Asrar Ahmed, Pradeep Varakantham, Shih-Fen Cheng |
| 2012 | UAI | Dynamic Stochastic Orienteering Problems for Risk-Aware Applications. | Hoong Chuin Lau, William Yeoh, Pradeep Varakantham, Duc Thien Nguyen, HuaXing Chen |
| 2007 | IJCAI | Towards Efficient Computation of Error Bounded Solutions in POMDPs: Expected Value Approximation and Dynamic Disjunctive Beliefs. | Pradeep Varakantham, Rajiv T. Maheswaran, Tapana Gupta, Milind Tambe |
| 2005 | AAAI | Networked Distributed POMDPs: A Synthesis of Distributed Constraint Optimization and POMDPs. | Ranjit Nair, Pradeep Varakantham, Milind Tambe, Makoto Yokoo |
| 2005 | IJCAI | Networked Distributed POMDPs: A Synergy of Distributed Constraint Optimization and POMDPs. | Ranjit Nair, Pradeep Varakantham, Milind Tambe, Makoto Yokoo |