| 2025 | EMNLP | It's All About In-Context Learning! Teaching Extremely Low-Resource Languages to LLMs. | Yue Li, Zhixue Zhao, Carolina Scarton |
| 2025 | EMNLP | Label Set Optimization via Activation Distribution Kurtosis for Zero-Shot Classification with Generative Models. | Yue Li, Zhixue Zhao, Carolina Scarton |
| 2025 | ICWSM | UKElectionNarratives: A Dataset of Misleading Narratives Surrounding Recent UK General Elections. | Fatima Haouari, Carolina Scarton, Nicol Faggiani, Nikolaos Nikolaidis, Bonka Kotseva, Ibrahim Abu Farha, Jens P. Linge, Kalina Bontcheva |
| 2025 | WWW | A Cross-Domain Study of the Use of Persuasion Techniques in Online Disinformation. | Joo Augusto Leite, Olesya Razuvayevskaya, Carolina Scarton, Kalina Bontcheva |
| 2024 | ACL | Enhancing Idiomatic Representation in Multiple Languages via an Adaptive Contrastive Triplet Loss. | Wei He, Marco Idiart, Carolina Scarton, Aline Villavicencio |
| 2024 | ACL | ATLAS: Improving Lay Summarisation with Attribute-based Control. | Zhihao Zhang, Tomas Goldsack, Carolina Scarton, Chenghua Lin |
| 2024 | CIKM | EUvsDisinfo: A Dataset for Multilingual Detection of Pro-Kremlin Disinformation in News Articles. | Joo Augusto Leite, Olesya Razuvayevskaya, Kalina Bontcheva, Carolina Scarton |
| 2024 | COLING | Can We Identify Stance without Target Arguments? A Study for Rumour Stance Classification. | Yue Li, Carolina Scarton |
| 2024 | COLING | Navigating Prompt Complexity for Zero-Shot Classification: A Study of Large Language Models in Computational Social Science. | Yida Mu, Ben P. Wu, William Thorne, Ambrose Robinson, Nikolaos Aletras, Carolina Scarton, Kalina Bontcheva, Xingyi Song |
| 2024 | COLING | Reference-less Analysis of Context Specificity in Translation with Personalised Language Models. | Sebastian T. Vincent, Rowanne Sumner, Alice Dowek, Charlotte Prescott, Emily Preston, Chris Bayliss, Chris Oakley, Carolina Scarton |
| 2024 | EAMT | Multilinguality in the VIGILANT project. | Brendan Spillane, Carolina Scarton, Rbert Mro, Petar Ivanov, Andrey Tagarev, Jakub Simko, Ibrahim Abu Farha, Gary Munnelly, Filip Uhlrik, Freddy Heppell |
| 2024 | EAMT | ExU: AI Models for Examining Multilingual Disinformation Narratives and Understanding their Spread. | Jake Vasilakes, Zhixue Zhao, Michal Gregor, Ivan Vykopal, Martin Hyben, Carolina Scarton |
| 2024 | EAMT | A Case Study on Contextual Machine Translation in a Professional Scenario of Subtitling. | Sebastian T. Vincent, Charlotte Prescott, Chris Bayliss, Chris Oakley, Carolina Scarton |
| 2023 | ACL | MTCue: Learning Zero-Shot Control of Extra-Textual Attributes by Leveraging Unstructured Context in Neural Machine Translation. | Sebastian T. Vincent, Robert Flynn, Carolina Scarton |
| 2023 | ECIR | Domain-Driven and Discourse-Guided Scientific Summarisation. | Tomas Goldsack, Zhihao Zhang, Chenghua Lin, Carolina Scarton |
| 2023 | EMNLP | Enhancing Biomedical Lay Summarisation with External Knowledge Graphs. | Tomas Goldsack, Zhihao Zhang, Chen Tang, Carolina Scarton, Chenghua Lin |
| 2023 | EMNLP | Analysing State-Backed Propaganda Websites: a New Dataset and Linguistic Study. | Freddy Heppell, Kalina Bontcheva, Carolina Scarton |
| 2023 | EMNLP | Don't waste a single annotation: improving single-label classifiers through soft labels. | Ben Wu, Yue Li, Yida Mu, Carolina Scarton, Kalina Bontcheva, Xingyi Song |
| 2023 | ICWSM | VaxxHesitancy: A Dataset for Studying Hesitancy towards COVID-19 Vaccination on Twitter. | Yida Mu, Mali Jin, Charlie Grimshaw, Carolina Scarton, Kalina Bontcheva, Xingyi Song |
| 2023 | RANLP | Categorising Fine-to-Coarse Grained Misinformation: An Empirical Study of the COVID-19 Infodemic. | Ye Jiang, Xingyi Song, Carolina Scarton, Iknoor Singh, Ahmet Aker, Kalina Bontcheva |
| 2023 | RANLP | Noisy Self-Training with Data Augmentations for Offensive and Hate Speech Detection Tasks. | Joo Augusto Leite, Carolina Scarton, Diego F. Silva |
| 2023 | RANLP | Classifying COVID-19 Vaccine Narratives. | Yue Li, Carolina Scarton, Xingyi Song, Kalina Bontcheva |
| 2022 | EAMT | Controlling Extra-Textual Attributes about Dialogue Participants: A Case Study of English-to-Polish Neural Machine Translation. | Sebastian T. Vincent, Loc Barrault, Carolina Scarton |
| 2022 | EMNLP | Making Science Simple: Corpora for the Lay Summarisation of Scientific Literature. | Tomas Goldsack, Zhihao Zhang, Chenghua Lin, Carolina Scarton |
| 2022 | EMNLP | Improving Tokenisation by Alternative Treatment of Spaces. | Edward Gow-Smith, Harish Tayyar Madabushi, Carolina Scarton, Aline Villavicencio |
| 2021 | ACL | Assessing the Representations of Idiomaticity in Vector Models with a Noun Compound Dataset Labeled at Type and Token Levels. | Marcos Garca, Tiago Kramer Vieira, Carolina Scarton, Marco Idiart, Aline Villavicencio |
| 2021 | EACL | Probing for idiomaticity in vector space models. | Marcos Garca, Tiago Kramer Vieira, Carolina Scarton, Marco Idiart, Aline Villavicencio |
| 2021 | EMNLP | AStitchInLanguageModels: Dataset and Methods for the Exploration of Idiomaticity in Pre-Trained Language Models. | Harish Tayyar Madabushi, Edward Gow-Smith, Carolina Scarton, Aline Villavicencio |
| 2020 | ACL | ASSET: A Dataset for Tuning and Evaluation of Sentence Simplification Models with Multiple Rewriting Transformations. | Fernando Alva-Manchego, Louis Martin, Antoine Bordes, Carolina Scarton, Benot Sagot, Lucia Specia |
| 2020 | ECAI | Deciding When, How and for Whom to Simplify. | Carolina Scarton, Pranava Madhyastha, Lucia Specia |
| 2020 | IJCNLP | Toxic Language Detection in Social Media for Brazilian Portuguese: New Dataset and Multilingual Analysis. | Joo Augusto Leite, Diego F. Silva, Kalina Bontcheva, Carolina Scarton |
| 2020 | IJCNLP | Measuring What Counts: The Case of Rumour Stance Classification. | Carolina Scarton, Diego F. Silva, Kalina Bontcheva |
| 2020 | LREC | Measuring the Impact of Readability Features in Fake News Detection. | Roney L. S. Santos, Gabriela Wick-Pedro, Sidney Evaldo Leal, Oto A. Vale, Thiago A. S. Pardo, Kalina Bontcheva, Carolina Scarton |
| 2019 | EMNLP | EASSE: Easier Automatic Sentence Simplification Evaluation. | Fernando Alva-Manchego, Louis Martin, Carolina Scarton, Lucia Specia |
| 2018 | ACL | Learning Simplifications for Specific Target Audiences. | Carolina Scarton, Lucia Specia |
| 2018 | LREC | Text Simplification from Professionally Produced Corpora. | Carolina Scarton, Gustavo Paetzold, Lucia Specia |
| 2018 | LREC | SimPA: A Sentence-Level Simplification Corpus for the Public Administration Domain. | Carolina Scarton, Gustavo Paetzold, Lucia Specia |
| 2017 | EACL | Improving Evaluation of Document-level Machine Translation Quality Estimation. | Yvette Graham, Qingsong Ma, Timothy Baldwin, Qun Liu, Carla Parra Escartn, Carolina Scarton |
| 2017 | IJCNLP | Learning How to Simplify From Explicit Labeling of Complex-Simplified Text Pairs. | Fernando Alva-Manchego, Joachim Bingel, Gustavo Paetzold, Carolina Scarton, Lucia Specia |
| 2017 | IJCNLP | MUSST: A Multilingual Syntactic Simplification Tool. | Carolina Scarton, Alessio Palmero Aprosio, Sara Tonelli, Tamara Martn-Wanton, Lucia Specia |
| 2016 | COLING | Quality Estimation for Language Output Applications. | Carolina Scarton, Gustavo Paetzold, Lucia Specia |
| 2016 | LREC | A Reading Comprehension Corpus for Machine Translation Evaluation. | Carolina Scarton, Lucia Specia |
| 2015 | ACL | Multi-level Translation Quality Prediction with QuEst++. | Lucia Specia, Gustavo Paetzold, Carolina Scarton |
| 2015 | EAMT | Searching for Context: a Study on Document-Level Labels for Translation Quality Estimation. | Carolina Scarton, Marcos Zampieri, Mihaela Vela, Josef van Genabith, Lucia Specia |
| 2015 | NAACL | Discourse and Document-level Information for Evaluating Language Output Tasks. | Carolina Scarton |
| 2014 | CICLING | Verb Clustering for Brazilian Portuguese. | Carolina Scarton, Lin Sun, Karin Kipper Schuler, Magali Sanches Duran, Martha Palmer, Anna Korhonen |
| 2014 | EAMT | Document-level translation quality estimation: exploring discourse and pseudo-references. | Carolina Scarton, Lucia Specia |
| 2010 | NAACL | SIMPLIFICA: a tool for authoring simplified texts in Brazilian Portuguese guided by readability assessments. | Carolina Scarton, Matheus de Oliveira, Arnaldo Cndido Jnior, Caroline Gasperin, Sandra M. Alusio |