Skip to content

Pradeep Varakantham

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

68

Venues

14

Active years

2005–2026

Best venue rank

A*

Where they publish

Papers

68 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIOptimizing Ride-Pooling Operations with Extended Pickup and Drop-Off Flexibility.Hao Jiang, Yixin Xu, Pradeep Varakantham
2026AIEDRL Agents Reveal What's Hard: Bootstrapping Difficulty-Ordered Curricula for Human Learners.Sidney Tio, Wenjun Li, Ramesha Karunasena, Pradeep Varakantham
2025AAAIOffline Safe Reinforcement Learning Using Trajectory Classification.Ze Gong, Akshat Kumar, Pradeep Varakantham
2025AAAIMarginal Benefit Driven RL Teacher for Unsupervised Environment Design.Dexun Li, Wenjun Li, Pradeep Varakantham
2025ICLROn Minimizing Adversarial Counterfactual Error in Adversarial Reinforcement Learning.Roman Belaire, Arunesh Sinha, Pradeep Varakantham
2025ICLRBootstrapping Language Models with DPO Implicit Rewards.Changyu Chen, Zichen Liu, Chao Du, Tianyu Pang, Qian Liu, Arunesh Sinha, Pradeep Varakantham, Min Lin
2025ICLRSemantic Loss Guided Data Efficient Supervised Fine Tuning for Safe Responses in LLMs.Yuxiao Lu, Arunesh Sinha, Pradeep Varakantham
2025ICLROn Generalization Across Environments In Multi-Objective Reinforcement Learning.Jayden Teoh, Pradeep Varakantham, Peter Vamplew
2025NAACLUnlocking the Planning Capabilities of Large Language Models with Maximum Diversity Fine-tuning.Wenjun Li, Changyu Chen, Pradeep Varakantham
2024AAAIImitate the Good and Avoid the Bad: An Incremental Approach to Safe Reinforcement Learning.Huy Hoang, Tien Mai, Pradeep Varakantham
2024AAAIReward Penalties on Augmented States for Solving Richly Constrained RL Effectively.Hao Jiang, Tien Mai, Pradeep Varakantham, Huy Hoang
2024AAAIUnsupervised Training Sequence Design: Efficient and Generalizable Agent Training.Wenjun Li, Pradeep Varakantham
2024AAAIHandling Long and Richly Constrained Tasks through Constrained Hierarchical Reinforcement Learning.Yuxiao Lu, Arunesh Sinha, Pradeep Varakantham
2024ECAIPreserving the Privacy of Reward Functions in MDPs through Deception.Shashank Reddy Chirra, Pradeep Varakantham, Praveen Paruchuri
2024ICAPSImitating Cost-Constrained Behaviors in Reinforcement Learning.Qian Shao, Pradeep Varakantham, Shih-Fen Cheng
2024PRICAIIRL for Restless Multi-armed Bandits with Applications in Maternal and Child Health.Gauri Jain, Pradeep Varakantham, Haifeng Xu, Aparna Taneja, Prashant Doshi, Milind Tambe
2023AAAIConstrained Reinforcement Learning in Hard Exploration Problems.Pathmanathan Pankayaraj, Pradeep Varakantham
2023AAAIFuture Aware Pricing and Matching for Sustainable On-Demand Ride Pooling.Xianjie Zhang, Pradeep Varakantham, Hao Jiang
2023ECAIOn Sustainable Ride Pooling Through Conditional Expected Value Decomposition.Avinandan Bose, Hao Jiang, Pradeep Varakantham, Zichang Ge
2023IJCAIGeneralization through Diversity: Improving Unsupervised Environment Design.Wenjun Li, Pradeep Varakantham, Dexun Li
2023IJCAITransferable Curricula through Difficulty Conditioned Generators.Sidney Tio, Pradeep Varakantham
2022AAAIFacilitating Human-Wildlife Cohabitation through Conflict Prediction.Susobhan Ghosh, Pradeep Varakantham, Aniket Bhatkhande, Tamanna Ahmad, Anish Andheria, Wenjun Li, Aparna Taneja, Divy Thakkar, Milind Tambe
2022AAAIField Study in Deploying Restless Multi-Armed Bandits: Assisting Non-profits in Improving Maternal and Child Health.Aditya Mate, Lovish Madaan, Aparna Taneja, Neha Madhiwalla, Shresth Verma, Gargi Singh, Aparna Hegde, Pradeep Varakantham, Milind Tambe
2022UAIEfficient resource allocation with fairness constraints in restless multi-armed bandits.Dexun Li, Pradeep Varakantham
2021IJCAILearn to Intervene: An Adaptive Learning Policy for Restless Bandits in Application to Preventive Healthcare.Arpita Biswas, Gaurav Aggarwal, Pradeep Varakantham, Milind Tambe
2021UAICLAIM: curriculum learning policy for influence maximization in unknown social networks.Dexun Li, Meghna Lowalekar, Pradeep Varakantham
2020AAAINeural Approximate Dynamic Programming for On-Demand Ride-Pooling.Sanket Shah, Meghna Lowalekar, Pradeep Varakantham
2020AAAISolving Online Threat Screening Games using Constrained Action Space Reinforcement Learning.Sanket Shah, Arunesh Sinha, Pradeep Varakantham, Andrew Perrault, Milind Tambe
2019UAICorrelated Learning for Aggregation Systems.Tanvi Verma, Pradeep Varakantham
2018AAAIDispatch Guided Allocation Optimization for Effective Emergency Response.Supriyo Ghosh, Pradeep Varakantham
2018AAAIUpping the Game of Taxi Driving in the Age of Uber.Shashi Shekhar Jha, Shih-Fen Cheng, Meghna Lowalekar, Nicholas Wong, Rishikeshan Rajendram, Trong Khiem Tran, Pradeep Varakantham, Trong Nghia Truong, Firmansyah Bin Abd Rahman
2018UAIDecentralized Planning for Non-dedicated Agent Teams with Submodular Rewards in Uncertain Environments.Pritee Agrawal, Pradeep Varakantham, William Yeoh
2017AAAIDecentralized Planning in Stochastic Environments with Submodular Rewards.Rajiv Ranjan Kumar, Pradeep Varakantham, Akshat Kumar
2017IJCAIProactive and Reactive Coordination of Non-dedicated Agent Teams Operating in Uncertain Environments.Pritee Agrawal, Pradeep Varakantham
2017IJCAIMechanism Design for Strategic Project Scheduling.Pradeep Varakantham, Na Fu
2016AAAISolving Risk-Sensitive POMDPs With and Without Cost Observations.Ping Hou, William Yeoh, Pradeep Varakantham
2016AAAIRobust Decision Making for Stochastic Network Design.Akshat Kumar, Arambam James Singh, Pradeep Varakantham, Daniel Sheldon
2016AAAINLU Framework for Voice Enabling Non-Native Applications on Smart Devices.Soujanya Lanka, Deepika Pathania, Pooja Kushalappa, Pradeep Varakantham
2016AAAIOnline Spatio-Temporal Matching in Stochastic and Dynamic Domains.Meghna Lowalekar, Pradeep Varakantham, Patrick Jaillet
2016AAAIA Proactive Sampling Approach to Project Scheduling under Uncertainty.Pradeep Varakantham, Na Fu, Hoong Chuin Lau
2016ECAIDetecting Communities Using Coordination Games: A Short Paper.Radhika Arava, Pradeep Varakantham
2016ECAIAn Intelligent System for Personalized Conference Event Recommendation and Scheduling.Aldy Gunawan, Hoong Chuin Lau, Pradeep Varakantham, Wenjie Wang
2016IJCAIScalable Greedy Algorithms for Task/Resource Constrained Multi-Agent Stochastic Planning.Pritee Agrawal, Pradeep Varakantham, William Yeoh
2016IJCAIRobust Repositioning to Counter Unpredictable Demand in Bike Sharing Systems.Supriyo Ghosh, Michael A. Trick, Pradeep Varakantham
2016IJCAISequential Decision Making for Improving Efficiency in Urban Environments.Pradeep Varakantham
2015AAAISolving Uncertain MDPs with Objectives that Are Separable over Instantiations of Model Uncertainty.Yossiri Adulyasak, Pradeep Varakantham, Asrar Ahmed, Patrick Jaillet
2015AAAIDynamic Redeployment to Counter Congestion or Starvation in Vehicle Sharing Systems.Supriyo Ghosh, Pradeep Varakantham, Yossiri Adulyasak, Patrick Jaillet
2015AAAIRisk Based Optimization for Improving Emergency Medical Systems.Sandhya Saisubramanian, Pradeep Varakantham, Hoong Chuin Lau
2015IJCAIProbabilistic Inference Based Message-Passing for Resource Constrained DCOPs.Supriyo Ghosh, Akshat Kumar, Pradeep Varakantham
2015SoCSDynamic Redeployment to Counter Congestion or Starvation in Vehicle Sharing Systems.Supriyo Ghosh, Pradeep Varakantham, Yossiri Adulyasak, Patrick Jaillet
2014AAAISTREETS: Game-Theoretic Traffic Patrolling with Exploration and Exploitation.Matthew Brown, Sandhya Saisubramanian, Pradeep Varakantham, Milind Tambe
2014AAAIDecentralized Stochastic Planning with Anonymity in Interactions.Pradeep Varakantham, Yossiri Adulyasak, Patrick Jaillet
2014ECAIUnleashing Dec-MDPs in Security Games: Enabling Effective Defender Teamwork.Eric Anyung Shieh, Albert Xin Jiang, Amulya Yadav, Pradeep Varakantham, Milind Tambe
2014PRIMAMarginal Contribution Stochastic Games for Dynamic Resource Allocation.Archie C. Chapman, Pradeep Varakantham
2013IAAIScalable Randomized Patrolling for Securing Rapid Transit Networks.Pradeep Varakantham, Hoong Chuin Lau, Zhi Yuan
2013WSCAn agent-based simulation approach to experience management in theme parks.Shih-Fen Cheng, Larry Lin, Jiali Du, Hoong Chuin Lau, Pradeep Varakantham
2012AAAIDecision Support for Agent Populations in Uncertain and Congested Environments.Pradeep Varakantham, Shih-Fen Cheng, Geoffrey J. Gordon, Asrar Ahmed
2012AAMASLagrangian relaxation for large-scale multi-agent planning.Geoffrey J. Gordon, Pradeep Varakantham, William Yeoh, Hoong Chuin Lau, Ajay S. Aravamudhan, Shih-Fen Cheng
2012AAMASSAVES: a sustainable multiagent application to conserve building energy considering occupants.Jun-young Kwak, Pradeep Varakantham, Rajiv T. Maheswaran, Milind Tambe, Farrokh Jazizadeh, Geoffrey Kavulya, Laura Klein, Burcin Becerik-Gerber, Timothy Hayes, Wendy Wood
2012AAMASSustainable multiagent application to conserve energy (demonstration).Jun-young Kwak, Pradeep Varakantham, Rajiv T. Maheswaran, Milind Tambe, Farrokh Jazizadeh, Geoffrey Kavulya, Laura Klein, Burcin Becerik-Gerber, Timothy Hayes, Wendy Wood
2012AAMASDelayed observation planning in partially observable domains.Pradeep Varakantham, Janusz Marecki
2012AAMASPrioritized shaping of models for solving DEC-POMDPs.Pradeep Varakantham, William Yeoh, Prasanna Velagapudi, Katia P. Sycara, Paul Scerri
2012AAMASActive malware analysis using stochastic games.Simon Andrew Williamson, Pradeep Varakantham, Ong Chen Hui, Debin Gao
2012UAIUncertain Congestion Games with Assorted Human Agent Populations.Asrar Ahmed, Pradeep Varakantham, Shih-Fen Cheng
2012UAIDynamic Stochastic Orienteering Problems for Risk-Aware Applications.Hoong Chuin Lau, William Yeoh, Pradeep Varakantham, Duc Thien Nguyen, HuaXing Chen
2007IJCAITowards Efficient Computation of Error Bounded Solutions in POMDPs: Expected Value Approximation and Dynamic Disjunctive Beliefs.Pradeep Varakantham, Rajiv T. Maheswaran, Tapana Gupta, Milind Tambe
2005AAAINetworked Distributed POMDPs: A Synthesis of Distributed Constraint Optimization and POMDPs.Ranjit Nair, Pradeep Varakantham, Milind Tambe, Makoto Yokoo
2005IJCAINetworked Distributed POMDPs: A Synergy of Distributed Constraint Optimization and POMDPs.Ranjit Nair, Pradeep Varakantham, Milind Tambe, Makoto Yokoo