Skip to content

Anca D. Dragan

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

108

Venues

15

Active years

2011–2025

Best venue rank

A*

Where they publish

Papers

108 indexed papers, newest first.

YearVenueTitleAuthors
2025ICLRContext Steering: Controllable Personalization at Inference Time.Jerry Zhi-Yang He, Sashrika Pandey, Mariah L. Schrum, Anca D. Dragan
2025ICLRQ-SFT: Q-Learning for Language Models via Supervised Fine-Tuning.Joey Hong, Anca D. Dragan, Sergey Levine
2025ICLRCorrelated Proxies: A New Definition and Improved Mitigation for Reward Hacking.Cassidy Laidlaw, Shivam Singhal, Anca D. Dragan
2025ICLROn Targeted Manipulation and Deception when Optimizing LLMs for User Feedback.Marcus Williams, Micah Carroll, Adhyyan Narang, Constantin Weisser, Brendan Murphy, Anca D. Dragan
2025ICMLAdversaries Can Misuse Combinations of Safe Models.Erik Jones, Anca D. Dragan, Jacob Steinhardt
2025ICMLAssistanceZero: Scalably Solving Assistance Games.Cassidy Laidlaw, Eli Bronstein, Timothy Guo, Dylan Feng, Lukas Berglund, Justin Svegliato, Stuart Russell, Anca D. Dragan
2024AAAILearning Optimal Advantage from Preferences and Mistaking It for Reward.W. Bradley Knox, Stephane Hatgis-Kessell, Sigurdur O. Adalgeirsson, Serena Booth, Anca D. Dragan, Peter Stone, Scott Niekum
2024CoRLTrajectory Improvement and Reward Learning from Comparative Language Feedback.Zhaojing Yang, Miru Jun, Jeremy Tien, Stuart Russell, Anca D. Dragan, Erdem Biyik
2024HRIAligning Human and Robot Representations.Andreea Bobu, Andi Peng, Pulkit Agrawal, Julie A. Shah, Anca D. Dragan
2024ICLROffline RL with Observation Histories: Analyzing and Improving Sample Complexity.Joey Hong, Anca D. Dragan, Sergey Levine
2024ICLRThe Effective Horizon Explains Deep RL Performance in Stochastic Environments.Cassidy Laidlaw, Banghua Zhu, Stuart Russell, Anca D. Dragan
2024ICLRConfronting Reward Model Overoptimization with Constrained RLHF.Ted Moskovitz, Aaditya K. Singh, DJ Strouse, Tuomas Sandholm, Ruslan Salakhutdinov, Anca D. Dragan, Stephen Marcus McAleer
2024ICMLAI Alignment with Changing and Influenceable Reward Functions.Micah Carroll, Davis Foote, Anand Siththaranjan, Stuart Russell, Anca D. Dragan
2024ICMLLearning to Model the World With Language.Jessy Lin, Yuqing Du, Olivia Watkins, Danijar Hafner, Pieter Abbeel, Dan Klein, Anca D. Dragan
2024ICMLLearning Temporal Distances: Contrastive Successor Features Can Provide a Metric Structure for Decision-Making.Vivek Myers, Chongyi Zheng, Anca D. Dragan, Sergey Levine, Benjamin Eysenbach
2024ICMLCoprocessor Actor Critic: A Model-Based Reinforcement Learning Approach For Adaptive Brain Stimulation.Michelle Pan, Mariah L. Schrum, Vivek Myers, Erdem Biyik, Anca D. Dragan
2024ICRAA Generalized Acquisition Function for Preference-based Reward Learning.Evan Ellis, Gaurav R. Ghosal, Stuart J. Russell, Anca D. Dragan, Erdem Biyik
2024ICRAToward Grounded Commonsense Reasoning.Minae Kwon, Hengyuan Hu, Vivek Myers, Siddharth Karamcheti, Anca D. Dragan, Dorsa Sadigh
2023AAAIThe Effect of Modeling Human Rationality Level on Learning Rewards from Multiple Feedback Types.Gaurav R. Ghosal, Matthew Zurek, Daniel S. Brown, Anca D. Dragan
2023CoRLQuantifying Assistive Robustness Via the Natural-Adversarial Frontier.Jerry Zhi-Yang He, Daniel S. Brown, Zackory Erickson, Anca D. Dragan
2023CoRLGoal Representations for Instruction Following: A Semi-Supervised Language Interface to Control.Vivek Myers, Andre Wang He, Kuan Fang, Homer Rich Walke, Philippe Hansen-Estruch, Ching-An Cheng, Mihai Jalobeanu, Andrey Kolobov, Anca D. Dragan, Sergey Levine
2023HRISIRL: Similarity-based Implicit Representation Learning.Andreea Bobu, Yi Liu, Rohin Shah, Daniel S. Brown, Anca D. Dragan
2023HRITowards Modeling and Influencing the Dynamics of Human Learning.Ran Tian, Masayoshi Tomizuka, Anca D. Dragan, Andrea Bajcsy
2023ICLROn the Sensitivity of Reward Inference to Misspecified Human Models.Joey Hong, Kush Bhatia, Anca D. Dragan
2023ICLRCausal Confusion and Reward Misidentification in Preference-Based Reward Learning.Jeremy Tien, Jerry Zhi-Yang He, Zackory Erickson, Anca D. Dragan, Daniel S. Brown
2023ICMLContextual Reliability: When Different Features Matter in Different Contexts.Gaurav Rohit Ghosal, Amrith Setlur, Daniel S. Brown, Anca D. Dragan, Aditi Raghunathan
2023ICMLAutomatically Auditing Large Language Models via Discrete Optimization.Erik Jones, Anca D. Dragan, Aditi Raghunathan, Jacob Steinhardt
2023IROSBootstrapping Adaptive Human-Machine Interfaces with Offline Reinforcement Learning.Jensen Gao, Siddharth Reddy, Glen Berseth, Anca D. Dragan, Sergey Levine
2022ACLInferring Rewards from Language in Context.Jessy Lin, Daniel Fried, Dan Klein, Anca D. Dragan
2022CoRLLearning Representations that Enable Generalization in Assistive Tasks.Jerry Zhi-Yang He, Zackory Erickson, Daniel S. Brown, Aditi Raghunathan, Anca D. Dragan
2022ICLRThe Boltzmann Policy Distribution: Accounting for Systematic Suboptimality in Human Models.Cassidy Laidlaw, Anca D. Dragan
2022ICMLEstimating and Penalizing Induced Preference Shifts in Recommender Systems.Micah D. Carroll, Anca D. Dragan, Stuart Russell, Dylan Hadfield-Menell
2022ICRAASHA: Assistive Teleoperation via Human-in-the-Loop Reinforcement Learning.Sean Chen, Jensen Gao, Siddharth Reddy, Glen Berseth, Anca D. Dragan, Sergey Levine
2022IROSTeaching Robots to Span the Space of Functional Expressive Motion.Arjun Sripathy, Andreea Bobu, Zhongyu Li, Koushil Sreenath, Daniel S. Brown, Anca D. Dragan
2022ICRASafety Assurances for Human-Robot Interaction via Confidence-aware Game-theoretic Human Models.Ran Tian, Liting Sun, Andrea Bajcsy, Masayoshi Tomizuka, Anca D. Dragan
2021CoRLAssisted Robust Reward Design.Jerry Zhi-Yang He, Anca D. Dragan
2021HRIFeature Expansive Reward Learning: Rethinking Human Input.Andreea Bobu, Marius Wiggert, Claire J. Tomlin, Anca D. Dragan
2021ICLRX2T: Training an X-to-Text Typing Interface with Online Learning from User Feedback.Jensen Gao, Siddharth Reddy, Glen Berseth, Nicholas Hardy, Nikhilesh Natraj, Karunesh Ganguly, Anca D. Dragan, Sergey Levine
2021ICLRLearning What To Do by Simulating the Past.David Lindner, Rohin Shah, Pieter Abbeel, Anca D. Dragan
2021ICMLValue Alignment Verification.Daniel S. Brown, Jordan Schneider, Anca D. Dragan, Scott Niekum
2021ICMLPolicy Gradient Bayesian Robust Optimization for Imitation Learning.Zaynah Javed, Daniel S. Brown, Satvik Sharma, Jerry Zhu, Ashwin Balakrishna, Marek Petrik, Anca D. Dragan, Ken Goldberg
2021ICRAAnalyzing Human Models that Adapt Online.Andrea Bajcsy, Anand Siththaranjan, Claire J. Tomlin, Anca D. Dragan
2021ICRADynamically Switching Human Prediction Models for Efficient Planning.Arjun Sripathy, Andreea Bobu, Daniel S. Brown, Anca D. Dragan
2021ICRASituational Confidence Assistance for Lifelong Shared Autonomy.Matthew Zurek, Andreea Bobu, Daniel S. Brown, Anca D. Dragan
2021RecSysEstimating and Penalizing Preference Shift in Recommender Systems.Micah Carroll, Dylan Hadfield-Menell, Stuart Russell, Anca D. Dragan
2020CoRLAssisted Perception: Optimizing Observations to Communicate State.Siddharth Reddy, Sergey Levine, Anca D. Dragan
2020HRILESS is More: Rethinking Probabilistic Models of Human Behavior.Andreea Bobu, Dexter R. R. Scobee, Jaime F. Fisac, S. Shankar Sastry, Anca D. Dragan
2020ICLRSQIL: Imitation Learning via Reinforcement Learning with Sparse Rewards.Siddharth Reddy, Anca D. Dragan, Sergey Levine
2020ICMLLearning Human Objectives by Evaluating Hypothetical Behavior.Siddharth Reddy, Anca D. Dragan, Sergey Levine, Shane Legg, Jan Leike
2020IJCAIChoice Set Misspecification in Reward Inference.Rachel Freedman, Rohin Shah, Anca D. Dragan
2020ICRAA Hamilton-Jacobi Reachability-Based Framework for Predicting and Analyzing Human Motion for Safe Planning.Somil Bansal, Andrea Bajcsy, Ellis Ratner, Anca D. Dragan, Claire J. Tomlin
2020ICRAEfficient Iterative Linear-Quadratic Approximations for Nonlinear Multi-Player General-Sum Differential Games.David Fridovich-Keil, Ellis Ratner, Lasse Peters, Anca D. Dragan, Claire J. Tomlin
2020ICRAScaled Autonomy: Enabling Human Operators to Control Robot Fleets.Gokul Swamy, Siddharth Reddy, Sergey Levine, Anca D. Dragan
2019AIESSpecifying AI Objectives as a Human-AI Collaboration problem.Anca D. Dragan
2019AIESHuman-AI Learning Performance in Multi-Armed Bandits.Ravi Pandya, Sandy H. Huang, Dylan Hadfield-Menell, Anca D. Dragan
2019CoRLNonverbal Robot Feedback for Human Teachers.Sandy H. Huang, Isabella Huang, Ravi Pandya, Anca D. Dragan
2019HRIThe Assistive Multi-Armed Bandit.Lawrence Chan, Dylan Hadfield-Menell, Siddhartha S. Srinivasa, Anca D. Dragan
2019HRIOn the Utility of Model Learning in HRI.Rohan Choudhury, Gokul Swamy, Dylan Hadfield-Menell, Anca D. Dragan
2019ICLRPreferences Implicit in the State of the World.Rohin Shah, Dmitrii Krasheninnikov, Jordan Alexander, Pieter Abbeel, Anca D. Dragan
2019ICMLOn the Feasibility of Learning, Rather than Assuming, Human Biases for Reward Inference.Rohin Shah, Noah Gundotra, Pieter Abbeel, Anca D. Dragan
2019ICMLLearning a Prior over Intent via Meta-Inverse Reinforcement Learning.Kelvin Xu, Ellis Ratner, Anca D. Dragan, Sergey Levine, Chelsea Finn
2019ICRAA Scalable Framework For Real-Time Multi-Robot, Multi-Human Collision Avoidance.Andrea Bajcsy, Sylvia L. Herbert, David Fridovich-Keil, Jaime F. Fisac, Sampada Deglurkar, Anca D. Dragan, Claire J. Tomlin
2019ICRAHierarchical Game-Theoretic Planning for Autonomous Vehicles.Jaime F. Fisac, Eli Bronstein, Elis Stefansson, Dorsa Sadigh, S. Shankar Sastry, Anca D. Dragan
2019ICRALearning from Extrapolated Corrections.Jason Y. Zhang, Anca D. Dragan
2019UAILiteral or Pedagogic Human? Analyzing Human Model Misspecification in Objective Learning.Smitha Milli, Anca D. Dragan
2018CoRLLearning under Misspecified Objective Spaces.Andreea Bobu, Andrea Bajcsy, Jaime F. Fisac, Anca D. Dragan
2018HRILearning from Physical Human Corrections, One Feature at a Time.Andrea Bajcsy, Dylan P. Losey, Marcia K. O'Malley, Anca D. Dragan
2018HRILearning from Richer Human Guidance: Augmenting Comparison-Based Learning with Feature Queries.Chandrayee Basu, Mukesh Singhal, Anca D. Dragan
2018HRIExplainable Robotic Systems.Maartje M. A. de Graaf, Bertram F. Malle, Anca D. Dragan, Tom Ziemke
2018HRIExpressing Robot Incapability.Minae Kwon, Sandy H. Huang, Anca D. Dragan
2018ICMLAn Efficient, Generalized Bellman Update For Cooperative Inverse Reinforcement Learning.Dhruv Malik, Malayandi Palaniappan, Jaime F. Fisac, Dylan Hadfield-Menell, Stuart Russell, Anca D. Dragan
2018ICRALearning Human Ergonomic Preferences for Handovers.Aaron M. Bestick, Ravi Pandya, Ruzena Bajcsy, Anca D. Dragan
2018IROSEstablishing Appropriate Trust via Critical States.Sandy H. Huang, Kush Bhatia, Pieter Abbeel, Anca D. Dragan
2018IROSConfiguration Space Metrics.Hong Jun Jeon, Anca D. Dragan
2018IROSSocial Cohesion in Autonomous Driving.Nicholas C. Landolfi, Anca D. Dragan
2018IROSCourteous Autonomous Cars.Liting Sun, Wei Zhan, Masayoshi Tomizuka, Anca D. Dragan
2018IROSCost Functions for Robot Motion Style.Allan Zhou, Anca D. Dragan
2017AAAIThe Off-Switch Game.Dylan Hadfield-Menell, Anca D. Dragan, Pieter Abbeel, Stuart Russell
2017ACLTranslating Neuralese.Jacob Andreas, Anca D. Dragan, Dan Klein
2017CoRLLearning Robot Objectives from Physical Human Interaction.Andrea Bajcsy, Dylan P. Losey, Marcia K. O'Malley, Anca D. Dragan
2017CoRLDART: Noise Injection for Robust Imitation Learning.Michael Laskey, Jonathan Lee, Roy Fox, Anca D. Dragan, Ken Goldberg
2017HRIDo You Want Your Autonomous Car To Drive Like You?Chandrayee Basu, Qian Yang, David Hungerman, Mukesh Singhal, Anca D. Dragan
2017HRIExpressive Robot Motion Timing.Allan Zhou, Dylan Hadfield-Menell, Anusha Nagabandi, Anca D. Dragan
2017IJCAIThe Off-Switch Game.Dylan Hadfield-Menell, Anca D. Dragan, Pieter Abbeel, Stuart Russell
2017IJCAIShould Robots be Obedient?Smitha Milli, Dylan Hadfield-Menell, Anca D. Dragan, Stuart Russell
2017ICRAComparing human-centric and robot-centric sampling for robot deep learning from demonstrations.Michael Laskey, Caleb Chuck, Jonathan Lee, Jeffrey Mahler, Sanjay Krishnan, Kevin Jamieson, Anca D. Dragan, Ken Goldberg
2017ISRRPragmatic-Pedagogic Value Alignment.Jaime F. Fisac, Monica A. Gates, Jessica B. Hamrick, Chang Liu, Dylan Hadfield-Menell, Malayandi Palaniappan, Dhruv Malik, S. Shankar Sastry, Thomas L. Griffiths, Anca D. Dragan
2016HRIViewpoint-Based Legibility Optimization.Stefanos Nikolaidis, Anca D. Dragan, Siddhartha S. Srinivasa
2016ICRASHIV: Reducing supervisor burden in DAgger using support vectors for efficient learning from demonstrations in high dimensional state spaces.Michael Laskey, Sam Staszak, Wesley Yu-Shu Hsieh, Jeffrey Mahler, Florian T. Pokorny, Anca D. Dragan, Ken Goldberg
2016IROSInformation gathering actions over human internal state.Dorsa Sadigh, S. Shankar Sastry, Sanjit A. Seshia, Anca D. Dragan
2016WAFRGenerating Plans that Predict Themselves.Jaime F. Fisac, Chang Liu, Jessica B. Hamrick, Shankar Sastry, J. Karl Hedrick, Thomas L. Griffiths, Anca D. Dragan
2015HRIEffects of Robot Motion on Human-Robot Collaboration.Anca D. Dragan, Shira Bauman, Jodi Forlizzi, Siddhartha S. Srinivasa
2015ICRAMovement primitives via optimization.Anca D. Dragan, Katharina Mlling, J. Andrew Bagnell, Siddhartha S. Srinivasa
2015RO-MANPerceived robot capability.Elizabeth Cha, Anca D. Dragan, Siddhartha S. Srinivasa
2014HRIDeliberate delays during robot-to-human handovers improve compliance with gaze communication.Henny Admoni, Anca D. Dragan, Siddhartha S. Srinivasa, Brian Scassellati
2014HRIEffects of speech on perceived capability.Elizabeth Cha, Anca D. Dragan, Jodi Forlizzi, Siddhartha S. Srinivasa
2014HRIPre-school children's first encounter with a robot.Elizabeth Cha, Anca D. Dragan, Siddhartha S. Srinivasa
2014HRIFamiliarization to robot motion.Anca D. Dragan, Siddhartha S. Srinivasa
2014RO-MANLegible robot pointing.Rachel M. Holladay, Anca D. Dragan, Siddhartha S. Srinivasa
2013HRIEffects of robot capability on user acceptance.Elizabeth Cha, Anca D. Dragan, Siddhartha S. Srinivasa
2013HRILegibility and predictability of robot motion.Anca D. Dragan, Kenton C. T. Lee, Siddhartha S. Srinivasa
2013HRICollaborative manipulation: new challenges for robotics and HRI.Anca D. Dragan, Andrea Lockerd Thomaz, Siddhartha S. Srinivasa
2013HRILegible user input for intent prediction.Kenton C. T. Lee, Anca D. Dragan, Siddhartha S. Srinivasa
2012HRIAssistive teleoperation for manipulation tasks.Anca D. Dragan, Siddhartha S. Srinivasa
2012RO-MANOnline customization of teleoperation interfaces.Anca D. Dragan, Siddhartha S. Srinivasa
2012RO-MANLearning the communication of intent prior to physical collaboration.Kyle Strabala, Min Kyung Lee, Anca D. Dragan, Jodi Forlizzi, Siddhartha S. Srinivasa
2011ICRAManipulation planning with goal sets using constrained trajectory optimization.Anca D. Dragan, Nathan D. Ratliff, Siddhartha S. Srinivasa
2011ISRRLearning from Experience in Manipulation Planning: Setting the Right Goals.Anca D. Dragan, Geoffrey J. Gordon, Siddhartha S. Srinivasa