Liwei Jiang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
31
Venues
10
Active years
2019–2025
Best venue rank
A*
Where they publish
Papers
31 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | AAAI | To Err Is AI: A Case Study Informing LLM Flaw Reporting Practices. | Sean McGregor, Allyson Ettinger, Nick Judd, Paul Albee, Liwei Jiang, Kavel Rao, William H. Smith, Shayne Longpre, Avijit Ghosh, Christopher Fiorelli, Michelle Hoang, Sven Cattell, Nouha Dziri |
| 2025 | ACL | CulturalBench: A Robust, Diverse and Challenging Benchmark for Measuring LMs' Cultural Knowledge Through Human-AI Red-Teaming. | Yu Ying Chiu, Liwei Jiang, Bill Yuchen Lin, Chan Young Park, Shuyue Stella Li, Sahithya Ravi, Mehar Bhatia, Maria Antoniak, Yulia Tsvetkov, Vered Shwartz, Yejin Choi |
| 2025 | ACL | Can Language Models Reason about Individualistic Human Values and Preferences? | Liwei Jiang, Taylor Sorensen, Sydney Levine, Yejin Choi |
| 2025 | ACL | Guardrails and Security for LLMs: Safe, Secure and Controllable Steering of LLM Applications. | Traian Rebedea, Leon Derczynski, Shaona Ghosh, Makesh Narsimhan Sreedhar, Faeze Brahman, Liwei Jiang, Bo Li, Yulia Tsvetkov, Christopher Parisien, Yejin Choi |
| 2025 | COLT | Online Covariance Estimation in Nonsmooth Stochastic Approximation. | Liwei Jiang, Abhishek Roy, Krishna Balasubramanian, Damek Davis, Dmitriy Drusvyatskiy, Sen Na |
| 2025 | ICLR | DailyDilemmas: Revealing Value Preferences of LLMs with Quandaries of Daily Life. | Yu Ying Chiu, Liwei Jiang, Yejin Choi |
| 2025 | ICLR | AI as Humanity's Salieri: Quantifying Linguistic Creativity of Language Models via Systematic Attribution of Machine Text against Web Text. | Ximing Lu, Melanie Sclar, Skyler Hallinan, Niloofar Mireshghallah, Jiacheng Liu, Seungju Han, Allyson Ettinger, Liwei Jiang, Khyathi Raghavi Chandu, Nouha Dziri, Yejin Choi |
| 2025 | ICML | Position: Political Neutrality in AI Is Impossible - But Here Is How to Approximate It. | Jillian Fisher, Ruth Elisabeth Appel, Chan Young Park, Yujin Potter, Liwei Jiang, Taylor Sorensen, Shangbin Feng, Yulia Tsvetkov, Margaret E. Roberts, Jennifer Pan, Dawn Song, Yejin Choi |
| 2025 | ICML | SafetyAnalyst: Interpretable, Transparent, and Steerable Safety Moderation for AI Behavior. | Jing-Jing Li, Valentina Pyatkin, Max Kleiman-Weiner, Liwei Jiang, Nouha Dziri, Anne Collins, Jana Schaich Borg, Maarten Sap, Yejin Choi, Sydney Levine |
| 2024 | AAAI | Value Kaleidoscope: Engaging AI with Pluralistic Human Values, Rights, and Duties. | Taylor Sorensen, Liwei Jiang, Jena D. Hwang, Sydney Levine, Valentina Pyatkin, Peter West, Nouha Dziri, Ximing Lu, Kavel Rao, Chandra Bhagavatula, Maarten Sap, John Tasioulas, Yejin Choi |
| 2024 | AIES | Particip-AI: A Democratic Surveying Framework for Anticipating Future AI Use Cases, Harms and Benefits. | Jimin Mun, Liwei Jiang, Jenny T. Liang, Inyoung Cheong, Nicole DeCario, Yejin Choi, Tadayoshi Kohno, Maarten Sap |
| 2024 | CHI | MigraineTracker: Examining Patient Experiences with Goal-Directed Self-Tracking for a Chronic Health Condition. | Yasaman S. Sefidgar, Carla L. Castillo, Shaan Chopra, Liwei Jiang, Tae Jones, Anant Mittal, Hyeyoung Ryu, Jessica Schroeder, Allison M. Cole, Natalia Murinova, Sean A. Munson, James Fogarty |
| 2024 | ICLR | Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement. | Linlu Qiu, Liwei Jiang, Ximing Lu, Melanie Sclar, Valentina Pyatkin, Chandra Bhagavatula, Bailin Wang, Yoon Kim, Yejin Choi, Nouha Dziri, Xiang Ren |
| 2024 | ICLR | The Generative AI Paradox: "What It Can Create, It May Not Understand". | Peter West, Ximing Lu, Nouha Dziri, Faeze Brahman, Linjie Li, Jena D. Hwang, Liwei Jiang, Jillian Fisher, Abhilasha Ravichander, Khyathi Raghavi Chandu, Benjamin Newman, Pang Wei Koh, Allyson Ettinger, Yejin Choi |
| 2024 | ICML | Position: A Roadmap to Pluralistic Alignment. | Taylor Sorensen, Jared Moore, Jillian Fisher, Mitchell L. Gordon, Niloofar Mireshghallah, Christopher Michael Rytting, Andre Ye, Liwei Jiang, Ximing Lu, Nouha Dziri, Tim Althoff, Yejin Choi |
| 2024 | NAACL | JAMDEC: Unsupervised Authorship Obfuscation using Constrained Decoding over Small Language Models. | Jillian Fisher, Ximing Lu, Jaehun Jung, Liwei Jiang, Zad Harchaoui, Yejin Choi |
| 2024 | NAACL | Impossible Distillation for Paraphrasing and Summarization: How to Make High-quality Lemonade out of Small, Low-quality Model. | Jaehun Jung, Peter West, Liwei Jiang, Faeze Brahman, Ximing Lu, Jillian Fisher, Taylor Sorensen, Yejin Choi |
| 2023 | ACL | ClarifyDelphi: Reinforced Clarification Questions with Defeasibility Rewards for Social and Moral Situations. | Valentina Pyatkin, Jena D. Hwang, Vivek Srikumar, Ximing Lu, Liwei Jiang, Yejin Choi, Chandra Bhagavatula |
| 2023 | EMNLP | SODA: Million-scale Dialogue Distillation with Social Commonsense Contextualization. | Hyunwoo Kim, Jack Hessel, Liwei Jiang, Peter West, Ximing Lu, Youngjae Yu, Pei Zhou, Ronan Le Bras, Malihe Alikhani, Gunhee Kim, Maarten Sap, Yejin Choi |
| 2023 | EMNLP | Reading Books is Great, But Not if You Are Driving! Visually Grounded Reasoning about Defeasible Commonsense Norms. | Seungju Han, Junhyeok Kim, Jack Hessel, Liwei Jiang, Jiwan Chung, Yejin Son, Yejin Choi, Youngjae Yu |
| 2023 | EMNLP | Inference-Time Policy Adapters (IPA): Tailoring Extreme-Scale LMs without Fine-tuning. | Ximing Lu, Faeze Brahman, Peter West, Jaehun Jung, Khyathi Raghavi Chandu, Abhilasha Ravichander, Prithviraj Ammanabrolu, Liwei Jiang, Sahana Ramnath, Nouha Dziri, Jillian Fisher, Bill Y. Lin, Skyler Hallinan, Lianhui Qin, Xiang Ren, Sean Welleck, Yejin Choi |
| 2023 | EMNLP | What Makes it Ok to Set a Fire? Iterative Self-distillation of Contexts and Rationales for Disambiguating Defeasible Social and Moral Situations. | Kavel Rao, Liwei Jiang, Valentina Pyatkin, Yuling Gu, Niket Tandon, Nouha Dziri, Faeze Brahman, Yejin Choi |
| 2023 | EMNLP | NovaCOMET: Open Commonsense Foundation Models with Symbolic Knowledge Distillation. | Peter West, Ronan Le Bras, Taylor Sorensen, Bill Yuchen Lin, Liwei Jiang, Ximing Lu, Khyathi Raghavi Chandu, Jack Hessel, Ashutosh Baheti, Chandra Bhagavatula, Yejin Choi |
| 2023 | EMNLP | BiasX: "Thinking Slow" in Toxic Content Moderation with Explanations of Implied Social Biases. | Yiming Zhang, Sravani Nanduri, Liwei Jiang, Tongshuang Wu, Maarten Sap |
| 2022 | EMNLP | ProsocialDialog: A Prosocial Backbone for Conversational Agents. | Hyunwoo Kim, Youngjae Yu, Liwei Jiang, Ximing Lu, Daniel Khashabi, Gunhee Kim, Yejin Choi, Maarten Sap |
| 2022 | NAACL | Aligning to Social Norms and Values in Interactive Narratives. | Prithviraj Ammanabrolu, Liwei Jiang, Maarten Sap, Hannaneh Hajishirzi, Yejin Choi |
| 2022 | NAACL | NeuroLogic A*esque Decoding: Constrained Text Generation with Lookahead Heuristics. | Ximing Lu, Sean Welleck, Peter West, Liwei Jiang, Jungo Kasai, Daniel Khashabi, Ronan Le Bras, Lianhui Qin, Youngjae Yu, Rowan Zellers, Noah A. Smith, Yejin Choi |
| 2022 | NAACL | Symbolic Knowledge Distillation: from General Language Models to Commonsense Models. | Peter West, Chandra Bhagavatula, Jack Hessel, Jena D. Hwang, Liwei Jiang, Ronan Le Bras, Ximing Lu, Sean Welleck, Yejin Choi |
| 2021 | IUI | EnglishBot: An AI-Powered Conversational System for Second Language Learning. | Sherry Ruan, Liwei Jiang, Qianyao Xu, Zhiyuan Liu, Glenn M. Davis, Emma Brunskill, James A. Landay |
| 2021 | NAACL | "I'm Not Mad": Commonsense Implications of Negation and Contradiction. | Liwei Jiang, Antoine Bosselut, Chandra Bhagavatula, Yejin Choi |
| 2019 | CHI | QuizBot: A Dialogue-based Adaptive Learning System for Factual Knowledge. | Sherry Ruan, Liwei Jiang, Justin Xu, Bryce Joe-Kun Tham, Zhengneng Qiu, Yeshuang Zhu, Elizabeth L. Murnane, Emma Brunskill, James A. Landay |