| 2026 | ACL | From If-Statements to ML Pipelines: Revisiting Bias in Code-Generation. | Minh Duc Bui, Xenia Heilmann, Mattia Cerrato, Manuel Mager, Katharina von der Wense |
| 2026 | LREC | Meenz bleibt Meenz, but Large Language Models Do Not Speak Its Dialect. | Minh Duc Bui, Manuel Mager, Peter Herbert Kann, Katharina von der Wense |
| 2025 | ACL | On Generalization across Measurement Systems: LLMs Entail More Test-Time Compute for Underrepresented Cultures. | Minh Duc Bui, Kyung Eun Park, Goran Glavas, Fabian David Schmidt, Katharina von der Wense |
| 2025 | EMNLP | Large Language Models Discriminate Against Speakers of German Dialects. | Minh Duc Bui, Carolin Holtermann, Valentin Hofmann, Anne Lauscher, Katharina von der Wense |
| 2025 | EMNLP | Mind the Gap: A Closer Look at Tokenization for Multiple-Choice Question Answering with LLMs. | Mario Sanz-Guerrero, Minh Duc Bui, Katharina von der Wense |
| 2025 | NAACL | Multi³Hate: Multimodal, Multilingual, and Multicultural Hate Speech Detection with Vision-Language Models. | Minh Duc Bui, Katharina von der Wense, Anne Lauscher |