Skip to content

Souradip Chakraborty

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

22

Venues

12

Active years

2020–2026

Best venue rank

A*

Where they publish

Papers

22 indexed papers, newest first.

YearVenueTitleAuthors
2026EACLJailbreaks as Inference-Time Alignment: A Framework for Understanding Safety Failures in LLMs.James Beetham, Souradip Chakraborty, Mengdi Wang, Furong Huang, Amrit Singh Bedi, Mubarak Shah
2025AAAICan Watermarking Large Language Models Prevent Copyrighted Text Generation and Hide Training Data?Michael-Andrei Panaitescu-Liess, Zora Che, Bang An, Yuancheng Xu, Pankayaraj Pathmanathan, Souradip Chakraborty, Sicheng Zhu, Tom Goldstein, Furong Huang
2025AAAIIs Poisoning a Real Threat to DPO? Maybe More So Than You Think.Pankayaraj Pathmanathan, Souradip Chakraborty, Xiangyu Liu, Yongyuan Liang, Furong Huang
2025AAAIAlign-Pro: A Principled Approach to Prompt Optimization for LLM Alignment.Prashant Trivedi, Souradip Chakraborty, Avinash Reddy, Vaneet Aggarwal, Amrit Singh Bedi, George K. Atia
2025CVPRImmune: Improving Safety Against Jailbreaks in Multi-modal LLMs via Inference-Time Alignment.Soumya Suvra Ghosal, Souradip Chakraborty, Vaibhav Singh, Tianrui Guan, Mengdi Wang, Ahmad Beirami, Furong Huang, Alvaro Velasquez, Dinesh Manocha, Amrit Singh Bedi
2025EMNLPUncertainty-Aware Answer Selection for Improved Reasoning in Multi-LLM Systems.Aakriti Agrawal, Rohith Aralikatti, Anirudh Satheesh, Souradip Chakraborty, Amrit Singh Bedi, Furong Huang
2025ICLRCollab: Controlled Decoding using Mixture of Agents for LLM Alignment.Souradip Chakraborty, Sujay Bhatt, Udari Madhushani Sehwag, Soumya Suvra Ghosal, Jiahao Qiu, Mengdi Wang, Dinesh Manocha, Furong Huang, Alec Koppel, Sumitra Ganesh
2025ICMLBounded Rationality for LLMs: Satisficing Alignment at Inference-Time.Mohamad Fares El Hajj Chehade, Soumya Suvra Ghosal, Souradip Chakraborty, Avinash Reddy, Dinesh Manocha, Hao Zhu, Amrit Singh Bedi
2025IROSOn the Vulnerability of LLM/VLM-Controlled Robotics.Xiyang Wu, Souradip Chakraborty, Ruiqi Xian, Jing Liang, Tianrui Guan, Fuxiao Liu, Brian M. Sadler, Dinesh Manocha, Amrit Singh Bedi
2024ICLRPARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human Feedback.Souradip Chakraborty, Amrit Singh Bedi, Alec Koppel, Huazheng Wang, Dinesh Manocha, Mengdi Wang, Furong Huang
2024ICLRRethinking Adversarial Policies: A Generalized Attack Formulation and Provable Defense in RL.Xiangyu Liu, Souradip Chakraborty, Yanchao Sun, Furong Huang
2024ICMLPosition: On the Possibilities of AI-Generated Text Detection.Souradip Chakraborty, Amrit S. Bedi, Sicheng Zhu, Bang An, Dinesh Manocha, Furong Huang
2024ICMLMaxMin-RLHF: Alignment with Diverse Human Preferences.Souradip Chakraborty, Jiahao Qiu, Hui Yuan, Alec Koppel, Dinesh Manocha, Furong Huang, Amrit S. Bedi, Mengdi Wang
2023AAAIPosterior Coreset Construction with Kernelized Stein Discrepancy for Model-Based Reinforcement Learning.Souradip Chakraborty, Amrit Singh Bedi, Pratap Tokekar, Alec Koppel, Brian M. Sadler, Furong Huang, Dinesh Manocha
2023ICMLSTEERING : Stein Information Directed Exploration for Model-Based Reinforcement Learning.Souradip Chakraborty, Amrit S. Bedi, Alec Koppel, Mengdi Wang, Furong Huang, Dinesh Manocha
2023ICRADealing with Sparse Rewards in Continuous Control Robotics via Heavy-Tailed Policy Optimization.Souradip Chakraborty, Amrit Singh Bedi, Kasun Weerakoon, Prithvi Poddar, Alec Koppel, Pratap Tokekar, Dinesh Manocha
2022CoRLHTRON: Efficient Outdoor Navigation with Sparse Rewards via Heavy Tailed Adaptive Reinforce Algorithm.Kasun Weerakoon, Souradip Chakraborty, Nare Karapetyan, Adarsh Jagan Sathyamoorthy, Amrit S. Bedi, Dinesh Manocha
2022ICMLOn the Hidden Biases of Policy Mirror Ascent in Continuous Action Spaces.Amrit Singh Bedi, Souradip Chakraborty, Anjaly Parayil, Brian M. Sadler, Pratap Tokekar, Alec Koppel
2020COLINGBioMedBERT: A Pre-trained Biomedical Language Model for QA and IR.Souradip Chakraborty, O. Ekaba Bisong, Shweta Bhatt, Thomas Wagner, Riley Elliott, Francesco Mosconi
2020ICDMG-SimCLR: Self-Supervised Contrastive Learning with Guided Projection via Pseudo Labelling.Souradip Chakraborty, Aritra Roy Gosthipaty, Sayak Paul
2020ICDMFairMixRep: Self-supervised Robust Representation Learning for Heterogeneous Data with Fairness constraints.Souradip Chakraborty, Ekansh Verma, Saswata Sahoo, Jyotishka Datta
2020ICPRGraph Spectral Feature Learning for Mixed Data of Categorical and Numerical Type.Saswata Sahoo, Souradip Chakraborty