Skip to content

Sara Hooker

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

28

Venues

7

Active years

2021–2026

Best venue rank

A*

Where they publish

Papers

28 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLOne Tokenizer To Rule Them All: Emergent Language Plasticity via Multilingual Tokenizers.Diana Abagyan, Alejandro Salamanca, Andrs Felipe Cruz-Salinas, Kris Cao, Hangyu Lin, Acyr Locatelli, Marzieh Fadaee, Ahmet stn, Sara Hooker
2025ACLM-RewardBench: Evaluating Reward Models in Multilingual Settings.Srishti Gureja, Lester James Validad Miranda, Shayekh Bin Islam, Rishabh Maheshwary, Drishti Sharma, Gusti Triandi Winata, Nathan Lambert, Sebastian Ruder, Sara Hooker, Marzieh Fadaee
2025ACLMultilingual Arbitration: Optimizing Data Pools to Accelerate Multilingual Progress.Ayomide Odumakinde, Daniel D'souza, Pat Verga, Beyza Ermis, Sara Hooker
2025ACLGlobal MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation.Shivalika Singh, Angelika Romanou, Clmentine Fourrier, David Ifeoluwa Adelani, Jian Gang Ngui, Daniel Vila-Suero, Peerat Limkonchotiwat, Kelly Marchisio, Wei Qi Leong, Yosephine Susanto, Raymond Ng, Shayne Longpre, Sebastian Ruder, Wei-Yin Ko, Antoine Bosselut, Alice Oh, Andr F. T. Martins, Leshem Choshen, Daphne Ippolito, Enzo Ferrante, Marzieh Fadaee, Beyza Ermis, Sara Hooker
2025EMNLPNexus: Adaptive Upcycling to Efficiently Pretrain Mixture of Experts.Nikolas Gritsch, Qizhen Zhang, Acyr Locatelli, Sara Hooker, Ahmet stn
2025EMNLPWhen Life Gives You Samples: The Benefits of Scaling up Inference Compute for Multilingual LLMs.Ammar Khairi, Daniel D'souza, Ye Shen, Julia Kreutzer, Sara Hooker
2025ICLRTo Code or Not To Code? Exploring Impact of Code in Pre-training.Viraat Aryabumi, Yixuan Su, Raymond Ma, Adrien Morisot, Ivan Zhang, Acyr Locatelli, Marzieh Fadaee, Ahmet stn, Sara Hooker
2025ICLRINCLUDE: Evaluating Multilingual Language Understanding with Regional Knowledge.Angelika Romanou, Negar Foroutan, Anna Sotnikova, Zeming Chen, Sree Harsha Nelaturu, Shivalika Singh, Rishabh Maheshwary, Micol Altomare, Mohamed A. Haggag, Imanol Schlag, Marzieh Fadaee, Sara Hooker, Antoine Bosselut, Snegha A, Alfonso Amayuelas, Azril Hafizi Amirudin, Viraat Aryabumi, Danylo Boiko, Michael Chang, Jenny Chim, Gal Cohen, Aditya Kumar Dalmia, Abraham Diress, Sharad Duwal, Daniil Dzenhaliou, Daniel Fernando Erazo Florez, Fabian Farestam, Joseph Marvin Imperial, Shayekh Bin Islam, Perttu Isotalo, Maral Jabbarishiviari, Brje F. Karlsson, Eldar Khalilov, Christopher Klamm, Fajri Koto, Dominik Krzeminski, Gabriel Adriano de Melo, Syrielle Montariol, Yiyang Nan, Joel Niklaus, Jekaterina Novikova, Johan Samir Obando-Ceron, Debjit Paul, Esther Ploeger, Jebish Purbey, Swati Rajwal, Selvan Sunitha Ravi, Sara Rydell, Roshan Santhosh, Drishti Sharma, Marjana Prifti Skenduli, Arshia Soltani Moakhar, Bardia Soltani Moakhar, Ran Tamir, Ayush Kumar Tarun, Azmine Toushik Wasi, Thenuka Ovin Weerasinghe, Serhan Yilmaz, Mike Zhang
2025NAACLIrokoBench: A New Benchmark for African Languages in the Age of Large Language Models.David Ifeoluwa Adelani, Jessica Ojo, Israel Abebe Azime, Jian Yun Zhuang, Jesujoba Oluwadara Alabi, Xuanli He, Millicent Ochieng, Sara Hooker, Andiswa Bukula, En-Shiun Annie Lee, Chiamaka Ijeoma Chukwuneke, Happy Buzaaba, Blessing K. Sibanda, Godson Koffi Kalipe, Jonathan Mukiibi, Salomon Kabongo Kabenamualu, Foutse Yuehgoh, Mmasibidi Setaka, Lolwethu Ndolela, Nkiruka Odu, Rooweither Mabuya, Salomey Osei, Shamsuddeen Hassan Muhammad, Sokhar Samb, Tadesse Kebede Guge, Tombekai Vangoni Sherman, Pontus Stenetorp
2024ACLBack to Basics: Revisiting REINFORCE-Style Optimization for Learning from Human Feedback in LLMs.Arash Ahmadian, Chris Cremer, Matthias Gall, Marzieh Fadaee, Julia Kreutzer, Olivier Pietquin, Ahmet stn, Sara Hooker
2024ACLCritical Learning Periods: Leveraging Early Training Dynamics for Efficient Data Pruning.Everlyn Chimoto, Jay Gala, Orevaoghene Ahia, Julia Kreutzer, Bruce A. Bassett, Sara Hooker
2024ACLFrom One to Many: Expanding the Scope of Toxicity Mitigation in Language Models.Beyza Ermis, Luiza Pozzobon, Sara Hooker, Patrick Lewis
2024ACLAya Dataset: An Open-Access Collection for Multilingual Instruction Tuning.Shivalika Singh, Freddie Vargus, Daniel D'souza, Brje Karlsson, Abinaya Mahendiran, Wei-Yin Ko, Herumb Shandilya, Jay Patel, Deividas Mataciunas, Laura O'Mahony, Mike Zhang, Ramith Hettiarachchi, Joseph Wilson, Marina Machado, Luisa Souza Moura, Dominik Krzeminski, Hakimeh Fadaei, Irem Ergn, Ifeoma Okoh, Aisha Alaagib, Oshan Mudannayake, Zaid Alyafeai, Minh Vu Chien, Sebastian Ruder, Surya Guthikonda, Emad A. Alghamdi, Sebastian Gehrmann, Niklas Muennighoff, Max Bartolo, Julia Kreutzer, Ahmet stn, Marzieh Fadaee, Sara Hooker
2024ACLAya Model: An Instruction Finetuned Open-Access Multilingual Language Model.Ahmet stn, Viraat Aryabumi, Zheng Xin Yong, Wei-Yin Ko, Daniel D'souza, Gbemileke Onilude, Neel Bhandari, Shivalika Singh, Hui-Lee Ooi, Amr Kayid, Freddie Vargus, Phil Blunsom, Shayne Longpre, Niklas Muennighoff, Marzieh Fadaee, Julia Kreutzer, Sara Hooker
2024EMNLPThe Multilingual Alignment Prism: Aligning Global and Local Preferences to Reduce Harm.Aakanksha, Arash Ahmadian, Beyza Ermis, Seraphina Goldfarb-Tarrant, Julia Kreutzer, Marzieh Fadaee, Sara Hooker
2024EMNLPRLHF Can Speak Many Languages: Unlocking Multilingual Preference Optimization for LLMs.John Dang, Arash Ahmadian, Kelly Marchisio, Julia Kreutzer, Ahmet stn, Sara Hooker
2024EMNLPHow Does Quantization Affect Multilingual LLMs?Kelly Marchisio, Saurabh Dash, Hongyu Chen, Dennis Aumiller, Ahmet stn, Sara Hooker, Sebastian Ruder
2024EMNLPLLM See, LLM Do: Leveraging Active Inheritance to Target Non-Differentiable Objectives.Lusa Shimabucoro, Sebastian Ruder, Julia Kreutzer, Marzieh Fadaee, Sara Hooker
2024ICLRPushing Mixture of Experts to the Limit: Extremely Parameter Efficient MoE for Instruction Tuning.Ted Zadouri, Ahmet stn, Arash Ahmadian, Beyza Ermis, Acyr Locatelli, Sara Hooker
2024ICMLOn The Fairness Impacts of Hardware Selection in Machine Learning.Sree Harsha Nelaturu, Nishaanth Kanna Ravichandran, Cuong Tran, Sara Hooker, Ferdinando Fioretto
2023EMNLPOn the Challenges of Using Black-Box APIs for Toxicity Evaluation in Research.Luiza Pozzobon, Beyza Ermis, Patrick Lewis, Sara Hooker
2023EMNLPGoodtriever: Adaptive Toxicity Mitigation with Retrieval-augmented Models.Luiza Pozzobon, Beyza Ermis, Patrick Lewis, Sara Hooker
2023EMNLPLocally Differentially Private Document Generation Using Zero Shot Prompting.Saiteja Utpala, Sara Hooker, Pin-Yu Chen
2023ICLRMetadata Archaeology: Unearthing Data Subsets by Leveraging Training Dynamics.Shoaib Ahmed Siddiqui, Nitarshan Rajkumar, Tegan Maharaj, David Krueger, Sara Hooker
2023UAIRobust distillation for worst-class performance: on the interplay between teacher and student objectives.Serena Wang, Harikrishna Narasimhan, Yichen Zhou, Sara Hooker, Michal Lukasik, Aditya Krishna Menon
2022CVPREstimating Example Difficulty using Variance of Gradients.Chirag Agarwal, Daniel D'souza, Sara Hooker
2022EMNLPIntriguing Properties of Compression on Multilingual Models.Kelechi Ogueji, Orevaoghene Ahia, Gbemileke Onilude, Sebastian Gehrmann, Sara Hooker, Julia Kreutzer
2021EMNLPThe Low-Resource Double Bind: An Empirical Study of Pruning for Low-Resource Machine Translation.Orevaoghene Ahia, Julia Kreutzer, Sara Hooker