Skip to content

Bertie Vidgen

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

16

Venues

6

Active years

2021–2025

Best venue rank

A*

Where they publish

Papers

16 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAISafetyPrompts: A Systematic Review of Open Datasets for Evaluating and Improving Large Language Model Safety.Paul Rttger, Fabio Pernisi, Bertie Vidgen, Dirk Hovy
2025EMNLPLMUNIT: Fine-grained Evaluation with Natural Language Unit Tests.Jon Saad-Falcon, Rajan Vivek, William Berrios, Nandita Shankar Naik, Matija Franklin, Bertie Vidgen, Amanpreet Singh, Douwe Kiela, Shikib Mehri
2024ICMLPosition: Near to Mid-term Risks and Opportunities of Open-Source Generative AI.Francisco Eiras, Aleksandar Petrov, Bertie Vidgen, Christian Schrder de Witt, Fabio Pizzati, Katherine Elkins, Supratik Mukhopadhyay, Adel Bibi, Botos Csaba, Fabro Steibel, Fazl Barez, Genevieve Smith, Gianluca Guadagni, Jon Chun, Jordi Cabot, Joseph Marvin Imperial, Juan A. Nolazco-Flores, Lori Landay, Matthew Thomas Jackson, Paul Rttger, Philip H. S. Torr, Trevor Darrell, Yong Suk Lee, Jakob N. Foerster
2024ICMLPosition: TrustLLM: Trustworthiness in Large Language Models.Yue Huang, Lichao Sun, Haoran Wang, Siyuan Wu, Qihui Zhang, Yuan Li, Chujie Gao, Yixin Huang, Wenhan Lyu, Yixuan Zhang, Xiner Li, Hanchi Sun, Zhengliang Liu, Yixin Liu, Yijue Wang, Zhikun Zhang, Bertie Vidgen, Bhavya Kailkhura, Caiming Xiong, Chaowei Xiao, Chunyuan Li, Eric P. Xing, Furong Huang, Hao Liu, Heng Ji, Hongyi Wang, Huan Zhang, Huaxiu Yao, Manolis Kellis, Marinka Zitnik, Meng Jiang, Mohit Bansal, James Zou, Jian Pei, Jian Liu, Jianfeng Gao, Jiawei Han, Jieyu Zhao, Jiliang Tang, Jindong Wang, Joaquin Vanschoren, John C. Mitchell, Kai Shu, Kaidi Xu, Kai-Wei Chang, Lifang He, Lifu Huang, Michael Backes, Neil Zhenqiang Gong, Philip S. Yu, Pin-Yu Chen, Quanquan Gu, Ran Xu, Rex Ying, Shuiwang Ji, Suman Jana, Tianlong Chen, Tianming Liu, Tianyi Zhou, William Wang, Xiang Li, Xiangliang Zhang, Xiao Wang, Xing Xie, Xun Chen, Xuyu Wang, Yan Liu, Yanfang Ye, Yinzhi Cao, Yong Chen, Yue Zhao
2024NAACLXSTest: A Test Suite for Identifying Exaggerated Safety Behaviours in Large Language Models.Paul Rttger, Hannah Kirk, Bertie Vidgen, Giuseppe Attanasio, Federico Bianchi, Dirk Hovy
2023ACLImproving the Detection of Multilingual Online Attacks with Rich Social Media Data from Singapore.Janosch Haber, Bertie Vidgen, Matthew Chapman, Vibhor Agarwal, Roy Ka-Wei Lee, Yong Keong Yap, Paul Rttger
2023EMNLPThe Past, Present and Better Future of Feedback Learning in Large Language Models for Subjective Human Preferences and Values.Hannah Kirk, Andrew M. Bean, Bertie Vidgen, Paul Rttger, Scott Hale
2022EMNLPHandling and Presenting Harmful Text in NLP Research.Hannah Kirk, Abeba Birhane, Bertie Vidgen, Leon Derczynski
2022NAACLHatemoji: A Test Suite and Adversarially-Generated Dataset for Benchmarking and Detecting Emoji-Based Hate.Hannah Kirk, Bertie Vidgen, Paul Rttger, Tristan Thrush, Scott Hale
2022NAACLTwo Contrasting Data Annotation Paradigms for Subjective NLP Tasks.Paul Rttger, Bertie Vidgen, Dirk Hovy, Janet B. Pierrehumbert
2021ACLDeciphering Implicit Hate: Evaluating Automated Detection Algorithms for Multimodal Hate.Austin Botelho, Scott Hale, Bertie Vidgen
2021ACLHateCheck: Functional Tests for Hate Speech Detection Models.Paul Rttger, Bertie Vidgen, Dong Nguyen, Zeerak Waseem, Helen Z. Margetts, Janet B. Pierrehumbert
2021ACLLearning from the Worst: Dynamically Generated Datasets to Improve Online Hate Detection.Bertie Vidgen, Tristan Thrush, Zeerak Waseem, Douwe Kiela
2021EACLAn Expert Annotated Dataset for the Detection of Online Misogyny.Ella Guest, Bertie Vidgen, Alexandros Mittos, Nishanth Sastry, Gareth Tyson, Helen Z. Margetts
2021NAACLDynabench: Rethinking Benchmarking in NLP.Douwe Kiela, Max Bartolo, Yixin Nie, Divyansh Kaushik, Atticus Geiger, Zhengxuan Wu, Bertie Vidgen, Grusha Prasad, Amanpreet Singh, Pratik Ringshia, Zhiyi Ma, Tristan Thrush, Sebastian Riedel, Zeerak Waseem, Pontus Stenetorp, Robin Jia, Mohit Bansal, Christopher Potts, Adina Williams
2021NAACLIntroducing CAD: the Contextual Abuse Dataset.Bertie Vidgen, Dong Nguyen, Helen Z. Margetts, Patrcia G. C. Rossini, Rebekah Tromble