Skip to content

Leshem Choshen

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

54

Venues

11

Active years

2018–2026

Best venue rank

A*

Where they publish

Papers

54 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLStop Guessing When to Stop Testing: Efficient Model Evaluation with Just Enough Data.Ofir Arviv, Kristjan Greenewald, Yotam Perlitz, Hadar Mulian, Michal Shmueli-Scheuer, Leshem Choshen
2026ACLMediocrity is the key for LLM as a Judge Anchor Selection.Shachar Don-Yehiya, Asaf Yehudai, Leshem Choshen, Omri Abend
2026ACLWill it Merge? On The Causes of Model Mergeability.Adir Rahamim, Asaf Yehudai, Boaz Carmeli, Leshem Choshen, Yosi Mass, Yonatan Belinkov
2026ACLCommonLID: Re-evaluating State-of-the-Art Language Identification Performance on Web Data.Pedro Ortiz Suarez, Laurie Burchell, Catherine Arnett, Rafael Mosquera, Sara Hincapi Monsalve, Thom Vaughan, Damian Stewart, Malte Ostendorff, Idris Abdulmumin, Vukosi Marivate, Shamsuddeen Hassan Muhammad, Atnafu Lambebo Tonja, Hend Al-Khalifa, Nadia Ghezaiel Hammouda, Verrah Akinyi Otiende, Tack Hwa Wong, Jakhongir Saydaliev, Melika Nobakhtian, Muhammad Ravi Shulthan Habibi, Kranti Chalamalasetti, Carol Muchemi, Khang Nguyen, Faisal Muhammad Adam, Luis Frentzen Salim, Reem Alqifari, Cynthia Jayne Amol, Joseph Marvin Imperial, Ilker Kesen, Ahmad Mustafid, Pavel Stepachev, Leshem Choshen, David Anugraha, Hamada Nayel, Seid Muhie Yimam, Vallerie Alexandra Putra, My Chiffon Nguyen, Azmine Toushik Wasi, Gouthami Vadithya, Rob van der Goot, Lanwenn Ar C'horr, Karan Dua, Andrew Yates, Mithil Bangera, Yeshil Bangera, Hitesh Laxmichand Patel, Shu Okabe, Fenal Ashokbhai Ilasariya, Dmitry Gaynullin, Genta Indra Winata, Yiyuan Li, Juan Pablo Martnez, Amit Agarwal, Ikhlasul Akmal Hanif, Raia Abu Ahmad, Esther Adenuga, Filbert Aurelian Tjiaranata, Weerayut Buaphet, Michael Anugraha, Sowmya Vajjala, Benjamin Rice, Azril Hafizi Amirudin, Jesujoba Oluwadara Alabi, Srikant Panda, Yassine Toughrai, Bruhan Kyomuhendo, Daniel Ruffinelli, Akshata A, Manuel Goulo, Ej Zhou, Ingrid Gabriela Franco Ramirez, Cristina Aggazzotti, Konstantin Dobler, Jun Kevin, Quentin Pags, Nicholas Andrews, Nuhu Ibrahim, Mattes Ruckdeschel, Amr Keleg, Mike Zhang, Casper Rufaro Muziri, Saron Samuel, Sotaro Takeshita, Kun Kerdthaisong, Luca Foppiano, Rasul Dent, Tommaso Green, Ahmad Mustapha Wali, Kamohelo Makaaka, Vicky Feliren, Inshirah Idris, Hande elikkanat, Abdulhamid Abubakar, Jean Maillard, Benot Sagot, Thibault Clrice, Kenton Murray, Sarah K. K. Luger
2026EACLPretraining Language Models for Diachronic Linguistic Change Discovery.Elisabeth Fittschen, Sabrina Li, Tom Lippincott, Leshem Choshen, Craig Messner
2026EACLBabyBabelLM: A Multilingual Benchmark of Developmentally Plausible Training Data.Jaap Jumelet, Abdellah Fourtassi, Akari Haga, Bastian Bunzeck, Bhargav Shandilya, Diana Galvn-Sosa, Faiz Ghifari Haznitrama, Francesca Padovani, Francois Meyer, Hai Hu, Julen Etxaniz, Laurent Prvot, Linyang He, Mara Grandury, Mila Marcheva, Negar Foroutan, Nikitas Theodoropoulos, Pouya Sadeghi, Siyuan Song, Suchir Salhan, Susana Zhou, Yurii Paniv, Ziyin Zhang, Arianna Bisazza, Alex Warstadt, Leshem Choshen
2025ACLThe ShareLM Collection and Plugin: Contributing Human-Model Chats for the Benefit of the Community.Shachar Don-Yehiya, Leshem Choshen, Omri Abend
2025ACLDOVE: A Large-Scale Multi-Dimensional Predictions Dataset Towards Meaningful LLM Evaluation.Eliya Habba, Ofir Arviv, Itay Itzhak, Yotam Perlitz, Elron Bandel, Leshem Choshen, Michal Shmueli-Scheuer, Gabriel Stanovsky
2025ACLGlobal MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation.Shivalika Singh, Angelika Romanou, Clmentine Fourrier, David Ifeoluwa Adelani, Jian Gang Ngui, Daniel Vila-Suero, Peerat Limkonchotiwat, Kelly Marchisio, Wei Qi Leong, Yosephine Susanto, Raymond Ng, Shayne Longpre, Sebastian Ruder, Wei-Yin Ko, Antoine Bosselut, Alice Oh, Andr F. T. Martins, Leshem Choshen, Daphne Ippolito, Enzo Ferrante, Marzieh Fadaee, Beyza Ermis, Sara Hooker
2025ICLRLiveXiv - A Multi-Modal live benchmark based on Arxiv papers content.Nimrod Shabtay, Felipe Maia Polo, Sivan Doveh, Wei Lin, Muhammad Jehanzeb Mirza, Leshem Choshen, Mikhail Yurochkin, Yuekai Sun, Assaf Arbelle, Leonid Karlinsky, Raja Giryes
2025ICLRModel merging with SVD to tie the Knots.George Stoica, Pratik Ramesh, Boglarka Ecsedi, Leshem Choshen, Judy Hoffman
2025ICMLA Hitchhiker's Guide to Scaling Law Estimation.Leshem Choshen, Yang Zhang, Jacob Andreas
2025ICMLCompress then Serve: Serving Thousands of LoRA Adapters with Little Overhead.Rickard Brel Gabrielsson, Jiacheng Zhu, Onkar Bhardwaj, Leshem Choshen, Kristjan H. Greenewald, Mikhail Yurochkin, Justin Solomon
2024ACLDeductive Closure Training of Language Models for Coherence, Accuracy, and Updatability.Afra Feyza Akyrek, Ekin Akyrek, Leshem Choshen, Derry Wijaya, Jacob Andreas
2024ACLLabel-Efficient Model Selection for Text Generation.Shir Ashury-Tahan, Ariel Gera, Benjamin Sznajder, Leshem Choshen, Liat Ein-Dor, Eyal Shnarch
2024CogSciInsights from the first BabyLM Challenge: Training sample-efficient language models on a developmentally plausible corpus.Alex Warstadt, Aaron Mueller, Leshem Choshen, Ethan Gotlieb Wilcox, Chengxu Zhuang, Adina Williams, Ryan Cotterell, Tal Linzen
2024COLINGJump to Conclusions: Short-Cutting Transformers with Linear Transformations.Alexander Yom Din, Taelin Karidi, Leshem Choshen, Mor Geva
2024EMNLPNumeroLogic: Number Encoding for Enhanced LLMs' Numerical Reasoning.Eli Schwartz, Leshem Choshen, Joseph Shtok, Sivan Doveh, Leonid Karlinsky, Assaf Arbelle
2024EMNLPFuse to Forget: Bias Reduction and Selective Memorization through Model Fusion.Kerem Zaman, Leshem Choshen, Shashank Srivastava
2024ICLRAchieving Human Parity in Content-Grounded Datasets Generation.Asaf Yehudai, Boaz Carmeli, Yosi Mass, Ofir Arviv, Nathaniel Mills, Eyal Shnarch, Leshem Choshen
2024ICMLtinyBenchmarks: evaluating LLMs with fewer examples.Felipe Maia Polo, Lucas Weber, Leshem Choshen, Yuekai Sun, Gongjun Xu, Mikhail Yurochkin
2024ICMLAsymmetry in Low-Rank Adapters of Foundation Models.Jiacheng Zhu, Kristjan H. Greenewald, Kimia Nadjahi, Haitz Sez de Ocriz Borde, Rickard Brel Gabrielsson, Leshem Choshen, Marzyeh Ghassemi, Mikhail Yurochkin, Justin Solomon
2024NAACLUnitxt: Flexible, Shareable and Reusable Data Preparation and Evaluation for Generative AI.Elron Bandel, Yotam Perlitz, Elad Venezian, Roni Friedman, Ofir Arviv, Matan Orbach, Shachar Don-Yehiya, Dafna Sheinwald, Ariel Gera, Leshem Choshen, Michal Shmueli-Scheuer, Yoav Katz
2024NAACLEfficient Benchmarking (of Language Models).Yotam Perlitz, Elron Bandel, Ariel Gera, Ofir Arviv, Liat Ein-Dor, Eyal Shnarch, Noam Slonim, Michal Shmueli-Scheuer, Leshem Choshen
2023ACLColD Fusion: Collaborative Descent for Distributed Multitask Finetuning.Shachar Don-Yehiya, Elad Venezian, Colin Raffel, Noam Slonim, Leshem Choshen
2023ACLDisentQA: Disentangling Parametric and Contextual Knowledge with Counterfactual Question Answering.Ella Neeman, Roee Aharoni, Or Honovich, Leshem Choshen, Idan Szpektor, Omri Abend
2023CoNLLMuLER: Detailed and Scalable Reference-based Evaluation.Taelin Karidi, Leshem Choshen, Gal Patel, Omri Abend
2023EMNLPWhere to start? Analyzing the potential value of intermediate models.Leshem Choshen, Elad Venezian, Shachar Don-Yehiya, Noam Slonim, Yoav Katz
2023EMNLPHuman Learning by Model Feedback: The Dynamics of Iterative Prompting with Midjourney.Shachar Don-Yehiya, Leshem Choshen, Omri Abend
2023EMNLPKnowledge is a Region in Weight Space for Fine-tuned Language Models.Almog Gueta, Elad Venezian, Colin Raffel, Noam Slonim, Yoav Katz, Leshem Choshen
2022ACLThe Grammar-Learning Trajectories of Neural Language Models.Leshem Choshen, Guy Hacohen, Daphna Weinshall, Omri Abend
2022ACLCluster & Tune: Boost Cold Start Performance in Text Classification.Eyal Shnarch, Ariel Gera, Alon Halfon, Lena Dankin, Leshem Choshen, Ranit Aharonov, Noam Slonim
2022COLINGReinforcement Learning with Large Action Spaces for Neural Machine Translation.Asaf Yehudai, Leshem Choshen, Lior Fox, Omri Abend
2022CoNLLEnhancing the Transformer Decoder with Transition-based Syntax.Leshem Choshen, Omri Abend
2022CoNLLOn Neurons Invariant to Sentence Structural Changes in Neural Machine Translation.Gal Patel, Leshem Choshen, Omri Abend
2022EMNLPPreQuEL: Quality Estimation of Machine Translation Outputs in Advance.Shachar Don-Yehiya, Leshem Choshen, Omri Abend
2022EMNLPLabel Sleuth: From Unlabeled Text to a Classifier in a Few Hours.Eyal Shnarch, Alon Halfon, Ariel Gera, Marina Danilevsky, Yannis Katsis, Leshem Choshen, Martn Santilln Cooper, Dina Epelboim, Zheng Zhang, Dakuo Wang
2022LRECGrASP: A Library for Extracting and Exploring Human-Interpretable Textual Patterns.Piyawat Lertvittayakumjorn, Leshem Choshen, Eyal Shnarch, Francesca Toni
2021EMNLP$Q^2$: Evaluating Factual Consistency in Knowledge-Grounded Dialogues via Question Generation and Question Answering.Or Honovich, Leshem Choshen, Roee Aharoni, Ella Neeman, Idan Szpektor, Omri Abend
2021NAACLMediators in Determining what Processing BERT Performs First.Aviv Slobodkin, Leshem Choshen, Omri Abend
2020AAAICorpus Wide Argument Mining - A Working Solution.Liat Ein-Dor, Eyal Shnarch, Lena Dankin, Alon Halfon, Benjamin Sznajder, Ariel Gera, Carlos Alzate, Martin Gleize, Leshem Choshen, Yufang Hou, Yonatan Bilu, Ranit Aharonov, Noam Slonim
2020CoNLLClassifying Syntactic Errors in Learner Language.Leshem Choshen, Dmitry Nikolaev, Yevgeni Berzak, Omri Abend
2020EMNLPActive Learning for BERT: An Empirical Study.Liat Ein-Dor, Alon Halfon, Ariel Gera, Eyal Shnarch, Lena Dankin, Leshem Choshen, Marina Danilevsky, Ranit Aharonov, Yoav Katz, Noam Slonim
2020EMNLPUnsupervised Expressive Rules Provide Explainability and Assist Human Experts Grasping New Domains.Eyal Shnarch, Leshem Choshen, Guy Moshkowich, Ranit Aharonov, Noam Slonim
2020ICLROn the Weaknesses of Reinforcement Learning for Neural Machine Translation.Leshem Choshen, Lior Fox, Zohar Aizenbud, Omri Abend
2020ICMLLet's Agree to Agree: Neural Networks Share Classification Order on Real Datasets.Guy Hacohen, Leshem Choshen, Daphna Weinshall
2019ACLThe Language of Legal and Illegal Activity on the Darknet.Leshem Choshen, Dan Eldad, Daniel Hershcovich, Elior Sulem, Omri Abend
2019ACLAre You Convinced? Choosing the More Convincing Evidence with a Siamese Network.Martin Gleize, Eyal Shnarch, Leshem Choshen, Lena Dankin, Guy Moshkowich, Ranit Aharonov, Noam Slonim
2019CoNLLAutomatically Extracting Challenge Sets for Non-Local Phenomena in Neural Machine Translation.Leshem Choshen, Omri Abend
2018ACLInherent Biases in Reference-based Evaluation for Grammatical Error Correction.Leshem Choshen, Omri Abend
2018ACLAutomatic Metric Validation for Grammatical Error Correction.Leshem Choshen, Omri Abend
2018ACLWill it Blend? Blending Weak and Strong Labeled Data in a Neural Network for Argumentation Mining.Eyal Shnarch, Carlos Alzate, Lena Dankin, Martin Gleize, Yufang Hou, Leshem Choshen, Ranit Aharonov, Noam Slonim
2018ICLRDORA The Explorer: Directed Outreaching Reinforcement Action-Selection.Lior Fox, Leshem Choshen, Yonatan Loewenstein
2018NAACLReference-less Measure of Faithfulness for Grammatical Error Correction.Leshem Choshen, Omri Abend