Leshem Choshen
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
54
Venues
11
Active years
2018–2026
Best venue rank
A*
Where they publish
Papers
54 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Stop Guessing When to Stop Testing: Efficient Model Evaluation with Just Enough Data. | Ofir Arviv, Kristjan Greenewald, Yotam Perlitz, Hadar Mulian, Michal Shmueli-Scheuer, Leshem Choshen |
| 2026 | ACL | Mediocrity is the key for LLM as a Judge Anchor Selection. | Shachar Don-Yehiya, Asaf Yehudai, Leshem Choshen, Omri Abend |
| 2026 | ACL | Will it Merge? On The Causes of Model Mergeability. | Adir Rahamim, Asaf Yehudai, Boaz Carmeli, Leshem Choshen, Yosi Mass, Yonatan Belinkov |
| 2026 | ACL | CommonLID: Re-evaluating State-of-the-Art Language Identification Performance on Web Data. | Pedro Ortiz Suarez, Laurie Burchell, Catherine Arnett, Rafael Mosquera, Sara Hincapi Monsalve, Thom Vaughan, Damian Stewart, Malte Ostendorff, Idris Abdulmumin, Vukosi Marivate, Shamsuddeen Hassan Muhammad, Atnafu Lambebo Tonja, Hend Al-Khalifa, Nadia Ghezaiel Hammouda, Verrah Akinyi Otiende, Tack Hwa Wong, Jakhongir Saydaliev, Melika Nobakhtian, Muhammad Ravi Shulthan Habibi, Kranti Chalamalasetti, Carol Muchemi, Khang Nguyen, Faisal Muhammad Adam, Luis Frentzen Salim, Reem Alqifari, Cynthia Jayne Amol, Joseph Marvin Imperial, Ilker Kesen, Ahmad Mustafid, Pavel Stepachev, Leshem Choshen, David Anugraha, Hamada Nayel, Seid Muhie Yimam, Vallerie Alexandra Putra, My Chiffon Nguyen, Azmine Toushik Wasi, Gouthami Vadithya, Rob van der Goot, Lanwenn Ar C'horr, Karan Dua, Andrew Yates, Mithil Bangera, Yeshil Bangera, Hitesh Laxmichand Patel, Shu Okabe, Fenal Ashokbhai Ilasariya, Dmitry Gaynullin, Genta Indra Winata, Yiyuan Li, Juan Pablo Martnez, Amit Agarwal, Ikhlasul Akmal Hanif, Raia Abu Ahmad, Esther Adenuga, Filbert Aurelian Tjiaranata, Weerayut Buaphet, Michael Anugraha, Sowmya Vajjala, Benjamin Rice, Azril Hafizi Amirudin, Jesujoba Oluwadara Alabi, Srikant Panda, Yassine Toughrai, Bruhan Kyomuhendo, Daniel Ruffinelli, Akshata A, Manuel Goulo, Ej Zhou, Ingrid Gabriela Franco Ramirez, Cristina Aggazzotti, Konstantin Dobler, Jun Kevin, Quentin Pags, Nicholas Andrews, Nuhu Ibrahim, Mattes Ruckdeschel, Amr Keleg, Mike Zhang, Casper Rufaro Muziri, Saron Samuel, Sotaro Takeshita, Kun Kerdthaisong, Luca Foppiano, Rasul Dent, Tommaso Green, Ahmad Mustapha Wali, Kamohelo Makaaka, Vicky Feliren, Inshirah Idris, Hande elikkanat, Abdulhamid Abubakar, Jean Maillard, Benot Sagot, Thibault Clrice, Kenton Murray, Sarah K. K. Luger |
| 2026 | EACL | Pretraining Language Models for Diachronic Linguistic Change Discovery. | Elisabeth Fittschen, Sabrina Li, Tom Lippincott, Leshem Choshen, Craig Messner |
| 2026 | EACL | BabyBabelLM: A Multilingual Benchmark of Developmentally Plausible Training Data. | Jaap Jumelet, Abdellah Fourtassi, Akari Haga, Bastian Bunzeck, Bhargav Shandilya, Diana Galvn-Sosa, Faiz Ghifari Haznitrama, Francesca Padovani, Francois Meyer, Hai Hu, Julen Etxaniz, Laurent Prvot, Linyang He, Mara Grandury, Mila Marcheva, Negar Foroutan, Nikitas Theodoropoulos, Pouya Sadeghi, Siyuan Song, Suchir Salhan, Susana Zhou, Yurii Paniv, Ziyin Zhang, Arianna Bisazza, Alex Warstadt, Leshem Choshen |
| 2025 | ACL | The ShareLM Collection and Plugin: Contributing Human-Model Chats for the Benefit of the Community. | Shachar Don-Yehiya, Leshem Choshen, Omri Abend |
| 2025 | ACL | DOVE: A Large-Scale Multi-Dimensional Predictions Dataset Towards Meaningful LLM Evaluation. | Eliya Habba, Ofir Arviv, Itay Itzhak, Yotam Perlitz, Elron Bandel, Leshem Choshen, Michal Shmueli-Scheuer, Gabriel Stanovsky |
| 2025 | ACL | Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation. | Shivalika Singh, Angelika Romanou, Clmentine Fourrier, David Ifeoluwa Adelani, Jian Gang Ngui, Daniel Vila-Suero, Peerat Limkonchotiwat, Kelly Marchisio, Wei Qi Leong, Yosephine Susanto, Raymond Ng, Shayne Longpre, Sebastian Ruder, Wei-Yin Ko, Antoine Bosselut, Alice Oh, Andr F. T. Martins, Leshem Choshen, Daphne Ippolito, Enzo Ferrante, Marzieh Fadaee, Beyza Ermis, Sara Hooker |
| 2025 | ICLR | LiveXiv - A Multi-Modal live benchmark based on Arxiv papers content. | Nimrod Shabtay, Felipe Maia Polo, Sivan Doveh, Wei Lin, Muhammad Jehanzeb Mirza, Leshem Choshen, Mikhail Yurochkin, Yuekai Sun, Assaf Arbelle, Leonid Karlinsky, Raja Giryes |
| 2025 | ICLR | Model merging with SVD to tie the Knots. | George Stoica, Pratik Ramesh, Boglarka Ecsedi, Leshem Choshen, Judy Hoffman |
| 2025 | ICML | A Hitchhiker's Guide to Scaling Law Estimation. | Leshem Choshen, Yang Zhang, Jacob Andreas |
| 2025 | ICML | Compress then Serve: Serving Thousands of LoRA Adapters with Little Overhead. | Rickard Brel Gabrielsson, Jiacheng Zhu, Onkar Bhardwaj, Leshem Choshen, Kristjan H. Greenewald, Mikhail Yurochkin, Justin Solomon |
| 2024 | ACL | Deductive Closure Training of Language Models for Coherence, Accuracy, and Updatability. | Afra Feyza Akyrek, Ekin Akyrek, Leshem Choshen, Derry Wijaya, Jacob Andreas |
| 2024 | ACL | Label-Efficient Model Selection for Text Generation. | Shir Ashury-Tahan, Ariel Gera, Benjamin Sznajder, Leshem Choshen, Liat Ein-Dor, Eyal Shnarch |
| 2024 | CogSci | Insights from the first BabyLM Challenge: Training sample-efficient language models on a developmentally plausible corpus. | Alex Warstadt, Aaron Mueller, Leshem Choshen, Ethan Gotlieb Wilcox, Chengxu Zhuang, Adina Williams, Ryan Cotterell, Tal Linzen |
| 2024 | COLING | Jump to Conclusions: Short-Cutting Transformers with Linear Transformations. | Alexander Yom Din, Taelin Karidi, Leshem Choshen, Mor Geva |
| 2024 | EMNLP | NumeroLogic: Number Encoding for Enhanced LLMs' Numerical Reasoning. | Eli Schwartz, Leshem Choshen, Joseph Shtok, Sivan Doveh, Leonid Karlinsky, Assaf Arbelle |
| 2024 | EMNLP | Fuse to Forget: Bias Reduction and Selective Memorization through Model Fusion. | Kerem Zaman, Leshem Choshen, Shashank Srivastava |
| 2024 | ICLR | Achieving Human Parity in Content-Grounded Datasets Generation. | Asaf Yehudai, Boaz Carmeli, Yosi Mass, Ofir Arviv, Nathaniel Mills, Eyal Shnarch, Leshem Choshen |
| 2024 | ICML | tinyBenchmarks: evaluating LLMs with fewer examples. | Felipe Maia Polo, Lucas Weber, Leshem Choshen, Yuekai Sun, Gongjun Xu, Mikhail Yurochkin |
| 2024 | ICML | Asymmetry in Low-Rank Adapters of Foundation Models. | Jiacheng Zhu, Kristjan H. Greenewald, Kimia Nadjahi, Haitz Sez de Ocriz Borde, Rickard Brel Gabrielsson, Leshem Choshen, Marzyeh Ghassemi, Mikhail Yurochkin, Justin Solomon |
| 2024 | NAACL | Unitxt: Flexible, Shareable and Reusable Data Preparation and Evaluation for Generative AI. | Elron Bandel, Yotam Perlitz, Elad Venezian, Roni Friedman, Ofir Arviv, Matan Orbach, Shachar Don-Yehiya, Dafna Sheinwald, Ariel Gera, Leshem Choshen, Michal Shmueli-Scheuer, Yoav Katz |
| 2024 | NAACL | Efficient Benchmarking (of Language Models). | Yotam Perlitz, Elron Bandel, Ariel Gera, Ofir Arviv, Liat Ein-Dor, Eyal Shnarch, Noam Slonim, Michal Shmueli-Scheuer, Leshem Choshen |
| 2023 | ACL | ColD Fusion: Collaborative Descent for Distributed Multitask Finetuning. | Shachar Don-Yehiya, Elad Venezian, Colin Raffel, Noam Slonim, Leshem Choshen |
| 2023 | ACL | DisentQA: Disentangling Parametric and Contextual Knowledge with Counterfactual Question Answering. | Ella Neeman, Roee Aharoni, Or Honovich, Leshem Choshen, Idan Szpektor, Omri Abend |
| 2023 | CoNLL | MuLER: Detailed and Scalable Reference-based Evaluation. | Taelin Karidi, Leshem Choshen, Gal Patel, Omri Abend |
| 2023 | EMNLP | Where to start? Analyzing the potential value of intermediate models. | Leshem Choshen, Elad Venezian, Shachar Don-Yehiya, Noam Slonim, Yoav Katz |
| 2023 | EMNLP | Human Learning by Model Feedback: The Dynamics of Iterative Prompting with Midjourney. | Shachar Don-Yehiya, Leshem Choshen, Omri Abend |
| 2023 | EMNLP | Knowledge is a Region in Weight Space for Fine-tuned Language Models. | Almog Gueta, Elad Venezian, Colin Raffel, Noam Slonim, Yoav Katz, Leshem Choshen |
| 2022 | ACL | The Grammar-Learning Trajectories of Neural Language Models. | Leshem Choshen, Guy Hacohen, Daphna Weinshall, Omri Abend |
| 2022 | ACL | Cluster & Tune: Boost Cold Start Performance in Text Classification. | Eyal Shnarch, Ariel Gera, Alon Halfon, Lena Dankin, Leshem Choshen, Ranit Aharonov, Noam Slonim |
| 2022 | COLING | Reinforcement Learning with Large Action Spaces for Neural Machine Translation. | Asaf Yehudai, Leshem Choshen, Lior Fox, Omri Abend |
| 2022 | CoNLL | Enhancing the Transformer Decoder with Transition-based Syntax. | Leshem Choshen, Omri Abend |
| 2022 | CoNLL | On Neurons Invariant to Sentence Structural Changes in Neural Machine Translation. | Gal Patel, Leshem Choshen, Omri Abend |
| 2022 | EMNLP | PreQuEL: Quality Estimation of Machine Translation Outputs in Advance. | Shachar Don-Yehiya, Leshem Choshen, Omri Abend |
| 2022 | EMNLP | Label Sleuth: From Unlabeled Text to a Classifier in a Few Hours. | Eyal Shnarch, Alon Halfon, Ariel Gera, Marina Danilevsky, Yannis Katsis, Leshem Choshen, Martn Santilln Cooper, Dina Epelboim, Zheng Zhang, Dakuo Wang |
| 2022 | LREC | GrASP: A Library for Extracting and Exploring Human-Interpretable Textual Patterns. | Piyawat Lertvittayakumjorn, Leshem Choshen, Eyal Shnarch, Francesca Toni |
| 2021 | EMNLP | $Q^2$: Evaluating Factual Consistency in Knowledge-Grounded Dialogues via Question Generation and Question Answering. | Or Honovich, Leshem Choshen, Roee Aharoni, Ella Neeman, Idan Szpektor, Omri Abend |
| 2021 | NAACL | Mediators in Determining what Processing BERT Performs First. | Aviv Slobodkin, Leshem Choshen, Omri Abend |
| 2020 | AAAI | Corpus Wide Argument Mining - A Working Solution. | Liat Ein-Dor, Eyal Shnarch, Lena Dankin, Alon Halfon, Benjamin Sznajder, Ariel Gera, Carlos Alzate, Martin Gleize, Leshem Choshen, Yufang Hou, Yonatan Bilu, Ranit Aharonov, Noam Slonim |
| 2020 | CoNLL | Classifying Syntactic Errors in Learner Language. | Leshem Choshen, Dmitry Nikolaev, Yevgeni Berzak, Omri Abend |
| 2020 | EMNLP | Active Learning for BERT: An Empirical Study. | Liat Ein-Dor, Alon Halfon, Ariel Gera, Eyal Shnarch, Lena Dankin, Leshem Choshen, Marina Danilevsky, Ranit Aharonov, Yoav Katz, Noam Slonim |
| 2020 | EMNLP | Unsupervised Expressive Rules Provide Explainability and Assist Human Experts Grasping New Domains. | Eyal Shnarch, Leshem Choshen, Guy Moshkowich, Ranit Aharonov, Noam Slonim |
| 2020 | ICLR | On the Weaknesses of Reinforcement Learning for Neural Machine Translation. | Leshem Choshen, Lior Fox, Zohar Aizenbud, Omri Abend |
| 2020 | ICML | Let's Agree to Agree: Neural Networks Share Classification Order on Real Datasets. | Guy Hacohen, Leshem Choshen, Daphna Weinshall |
| 2019 | ACL | The Language of Legal and Illegal Activity on the Darknet. | Leshem Choshen, Dan Eldad, Daniel Hershcovich, Elior Sulem, Omri Abend |
| 2019 | ACL | Are You Convinced? Choosing the More Convincing Evidence with a Siamese Network. | Martin Gleize, Eyal Shnarch, Leshem Choshen, Lena Dankin, Guy Moshkowich, Ranit Aharonov, Noam Slonim |
| 2019 | CoNLL | Automatically Extracting Challenge Sets for Non-Local Phenomena in Neural Machine Translation. | Leshem Choshen, Omri Abend |
| 2018 | ACL | Inherent Biases in Reference-based Evaluation for Grammatical Error Correction. | Leshem Choshen, Omri Abend |
| 2018 | ACL | Automatic Metric Validation for Grammatical Error Correction. | Leshem Choshen, Omri Abend |
| 2018 | ACL | Will it Blend? Blending Weak and Strong Labeled Data in a Neural Network for Argumentation Mining. | Eyal Shnarch, Carlos Alzate, Lena Dankin, Martin Gleize, Yufang Hou, Leshem Choshen, Ranit Aharonov, Noam Slonim |
| 2018 | ICLR | DORA The Explorer: Directed Outreaching Reinforcement Action-Selection. | Lior Fox, Leshem Choshen, Yonatan Loewenstein |
| 2018 | NAACL | Reference-less Measure of Faithfulness for Grammatical Error Correction. | Leshem Choshen, Omri Abend |