| 2025 | CVPR | Interpretable Generative Models through Post-hoc Concept Bottlenecks. | Akshay R. Kulkarni, Ge Yan, Chung-En Sun, Tuomas P. Oikarinen, Tsui-Wei Weng |
| 2025 | EMNLP | ThinkEdit: Interpretable Weight Editing to Mitigate Overly Short Thinking in Reasoning Models. | Chung-En Sun, Ge Yan, Tsui-Wei Weng |
| 2025 | ICLR | Concept Bottleneck Large Language Models. | Chung-En Sun, Tuomas P. Oikarinen, Berk Ustun, Tsui-Wei Weng |
| 2025 | ICML | Understanding Fixed Predictions via Confined Regions. | Connor Lawless, Tsui-Wei Weng, Berk Ustun, Madeleine Udell |
| 2025 | ICML | Evaluating Neuron Explanations: A Unified Framework with Sanity Checks. | Tuomas P. Oikarinen, Ge Yan, Tsui-Wei Weng |
| 2025 | ICRA | Anti-Sensing: Defense Against Unauthorized Radar-Based Human Vital Sign Sensing with Physically Realizable Wearable Oscillators. | Md. Farhan Tasnim Oshim, Nigel Doering, Bashima Islam, Tsui-Wei Weng, Tauhidur Rahman |
| 2025 | NAACL | Effective Skill Unlearning through Intervention and Abstention. | Yongce Li, Chung-En Sun, Tsui-Wei Weng |
| 2025 | NAACL | Iterative Self-Tuning LLMs for Enhanced Jailbreaking Capabilities. | Chung-En Sun, Xiaodong Liu, Weiwei Yang, Tsui-Wei Weng, Hao Cheng, Aidan San, Michel Galley, Jianfeng Gao |
| 2025 | WACV | SAND: Enhancing Open-Set Neuron Descriptions through Spatial Awareness. | Anvita A. Srinivas, Tuomas P. Oikarinen, Divyansh Srivastava, Wei-Hung Weng, Tsui-Wei Weng |
| 2024 | ECCV | Interpretability-Guided Test-Time Adversarial Defense. | Akshay R. Kulkarni, Tsui-Wei Weng |
| 2024 | ICLR | Prediction without Preclusion: Recourse Verification with Reachable Sets. | Avni Kothari, Bogdan Kulynych, Tsui-Wei Weng, Berk Ustun |
| 2024 | ICLR | Provably Robust Conformal Prediction with Improved Efficiency. | Ge Yan, Yaniv Romano, Tsui-Wei Weng |
| 2024 | ICML | Linear Explanations for Individual Neurons. | Tuomas P. Oikarinen, Tsui-Wei Weng |
| 2024 | ICML | Breaking the Barrier: Enhanced Utility and Robustness in Smoothed DRL Agents. | Chung-En Sun, Sicun Gao, Tsui-Wei Weng |
| 2024 | ICML | AND: Audio Network Dissection for Interpreting Deep Acoustic Models. | Tung-Yu Wu, Yu-Xiang Lin, Tsui-Wei Weng |
| 2023 | ICCV | Corrupting Neuron Explanations of Deep Visual Features. | Divyansh Srivastava, Tuomas P. Oikarinen, Tsui-Wei Weng |
| 2023 | ICDM | Promoting Robustness of Randomized Smoothing: Two Cost-Effective Approaches. | Linbo Liu, Trong Nghia Hoang, Lam M. Nguyen, Tsui-Wei Weng |
| 2023 | ICDM | Attacking c-MARL More Effectively: A Data Driven Approach. | Nhan H. Pham, Lam M. Nguyen, Jie Chen, Hoang Thanh Lam, Subhro Das, Tsui-Wei Weng |
| 2023 | ICLR | Min-Max Multi-objective Bilevel Optimization with Applications in Robust Machine Learning. | Alex Gu, Songtao Lu, Parikshit Ram, Tsui-Wei Weng |
| 2023 | ICLR | Label-free Concept Bottleneck Models. | Tuomas P. Oikarinen, Subhro Das, Lam M. Nguyen, Tsui-Wei Weng |
| 2023 | ICLR | CLIP-Dissect: Automatic Description of Neuron Representations in Deep Vision Networks. | Tuomas P. Oikarinen, Tsui-Wei Weng |
| 2023 | ICML | ConCerNet: A Contrastive Learning Based Framework for Automated Conservation Law Discovery and Trustworthy Dynamical System Prediction. | Wang Zhang, Tsui-Wei Weng, Subhro Das, Alexandre Megretski, Luca Daniel, Lam M. Nguyen |
| 2022 | ICLR | Adversarially Robust Conformal Prediction. | Asaf Gendler, Tsui-Wei Weng, Luca Daniel, Yaniv Romano |
| 2022 | IROS | Quantifying Safety of Learning-based Self-Driving Control Using Almost-Barrier Functions. | Zhizhen Qin, Tsui-Wei Weng, Sicun Gao |
| 2021 | ICLR | On Fast Adversarial Robustness Adaptation in Model-Agnostic Meta-Learning. | Ren Wang, Kaidi Xu, Sijia Liu, Pin-Yu Chen, Tsui-Wei Weng, Chuang Gan, Meng Wang |
| 2020 | AAAI | Towards Certificated Model Robustness Against Weight Perturbations. | Tsui-Wei Weng, Pu Zhao, Sijia Liu, Pin-Yu Chen, Xue Lin, Luca Daniel |
| 2020 | CVPR | Towards Verifying Robustness of Neural Networks Against A Family of Semantic Perturbations. | Jeet Mohapatra, Tsui-Wei Weng, Pin-Yu Chen, Sijia Liu, Luca Daniel |
| 2020 | ICLR | Toward Evaluating Robustness of Deep Reinforcement Learning with Continuous Control. | Tsui-Wei Weng, Krishnamurthy (Dj) Dvijotham, Jonathan Uesato, Kai Xiao, Sven Gowal, Robert Stanforth, Pushmeet Kohli |
| 2019 | AAAI | CNN-Cert: An Efficient Framework for Certifying Robustness of Convolutional Neural Networks. | Akhilan Boopathy, Tsui-Wei Weng, Pin-Yu Chen, Sijia Liu, Luca Daniel |
| 2019 | IJCAI | Topology Attack and Defense for Graph Neural Networks: An Optimization Perspective. | Kaidi Xu, Hongge Chen, Sijia Liu, Pin-Yu Chen, Tsui-Wei Weng, Mingyi Hong, Xue Lin |
| 2018 | ICLR | Evaluating the Robustness of Neural Networks: An Extreme Value Theory Approach. | Tsui-Wei Weng, Huan Zhang, Pin-Yu Chen, Jinfeng Yi, Dong Su, Yupeng Gao, Cho-Jui Hsieh, Luca Daniel |
| 2018 | ICML | Towards Fast Computation of Certified Robustness for ReLU Networks. | Tsui-Wei Weng, Huan Zhang, Hongge Chen, Zhao Song, Cho-Jui Hsieh, Luca Daniel, Duane S. Boning, Inderjit S. Dhillon |