David R. Mortensen
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
58
Venues
11
Active years
2016–2026
Best venue rank
A*
Where they publish
Papers
58 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | PRiSM: Benchmarking Phone Realization in Speech Models. | Shikhar Bharadwaj, Chin-Jou Li, Yoonjae Kim, Kwanghee Choi, Eunjung Yeo, Ryan Soh-Eun Shim, Hanyu Zhou, Brendon Boldt, Karen Rosero, Kalvin Chang, Darsh Agrawal, Keer Xu, Chao-Han Huck Yang, Jian Zhu, Shinji Watanabe, David R. Mortensen |
| 2026 | ACL | Communicating in Emergent Language with an Induced Morphological Phrasebook. | Brendon Boldt, David R. Mortensen |
| 2026 | ACL | [b] = [d] - [t] + [p]: Self-supervised Speech Models Discover Phonological Vector Arithmetic. | Kwanghee Choi, Eunjung Yeo, Cheol Jun Cho, David Harwath, David R. Mortensen |
| 2026 | ACL | POWSM: A Phonetic Open Whisper-Style Speech Foundation Model. | Chin-Jou Li, Kalvin Chang, Shikhar Bharadwaj, Eunjung Yeo, Kwanghee Choi, Jian Zhu, David R. Mortensen, Shinji Watanabe |
| 2026 | ACL | PBEBench: A Multi-Step Programming by Examples Reasoning Benchmark inspired by Historical Linguistics. | Atharva Naik, Prakam, Yash Mathur, Darsh Agrawal, Manav Nitin Kapadnis, Yuwei An, Clayton Marr, Carolyn P. Ros, David R. Mortensen |
| 2026 | ACL | Linear Script Representations in Speech Foundation Models Enable Zero-Shot Transliteration. | Ryan Soh-Eun Shim, Kwanghee Choi, Kalvin Chang, Ming-Hao Hsu, Florian Eichin, Zhizheng Wu, Alane Suhr, Michael A. Hedderich, David Harwath, David R. Mortensen, Barbara Plank |
| 2026 | CoNLL | Harnessing Linguistic Dissimilarity for Language Generalization on Unseen Low-Resource Varieties. | Jinju Kim, Haeji Jung, Youjeong Roh, Jong Hwan Ko, David R. Mortensen |
| 2026 | EACL | Happiness is Sharing a Vocabulary: A Study of Transliteration Methods. | Haeji Jung, Jinju Kim, Kyungjin Kim, Youjeong Roh, David R. Mortensen |
| 2026 | LREC | Transformer-Enabled Diachronic Analysis of Vedic Sanskrit: Neural Methods for Quantifying Types of Language Change. | Ananth Hariharan, David R. Mortensen |
| 2026 | LREC | CS-YODAS: A Mined Dataset of In-the-Wild Code-Switched Speech. | Brian Yan, Qingzheng Wang, Matthew Wiesner, Anuj Diwan, Olga Iakovenko, Alexander Polok, Injy Hamed, Shuichiro Shimizu, Iris Emerman, Thomas Hain, David R. Mortensen, Peter Viechnicki, Shinji Watanabe |
| 2025 | ACL | DialUp! Modeling the Language Continuum by Adapting Models to Dialects and Dialects to Models. | Niyati Bafna, Emily Chang, Nathaniel Romney Robinson, David R. Mortensen, Kenton Murray, David Yarowsky, Hale Sirin |
| 2025 | ACL | Programming by Example meets Historical Linguistics: A Large Language Model Based Approach to Sound Law Induction. | Atharva Naik, Darsh Agrawal, Hong Sng, Clayton Marr, Kexun Zhang, Nathaniel Romney Robinson, Kalvin Chang, Rebecca Byrnes, Aravind Mysore, Carolyn P. Ros, David R. Mortensen |
| 2025 | ACL | ZIPA: A family of efficient models for multilingual phone recognition. | Jian Zhu, Farhan Samir, Eleanor Chodroff, David R. Mortensen |
| 2025 | EMNLP | Searching for the Most Human-like Emergent Language. | Brendon Boldt, David R. Mortensen |
| 2025 | EMNLP | Morpheme Induction for Emergent Language. | Brendon Boldt, David R. Mortensen |
| 2025 | IJCNLP | The Translation Barrier Hypothesis: Multilingual Generation with Large Language Models Suffers from Implicit Translation Failure. | Niyati Bafna, Tianjian Li, Kenton Murray, David R. Mortensen, David Yarowsky, Hale Sirin, Daniel Khashabi |
| 2025 | Interspeech | Towards Inclusive ASR: Investigating Voice Conversion for Dysarthric Speech Recognition in Low-Resource Languages. | Chin-Jou Li, Eunjung Yeo, Kwanghee Choi, Paula Andrea Prez-Toro, Masao Someki, Rohan Kumar Das, Zhengjun Yue, Juan Rafael Orozco-Arroyave, Elmar Nth, David R. Mortensen |
| 2025 | NAACL | Leveraging Allophony in Self-Supervised Speech Models for Atypical Pronunciation Assessment. | Kwanghee Choi, Eunjung Yeo, Kalvin Chang, Shinji Watanabe, David R. Mortensen |
| 2024 | ACL | Wav2Gloss: Generating Interlinear Glossed Text from Speech. | Taiqi He, Kwanghee Choi, Lindia Tjuatja, Nathaniel R. Robinson, Jiatong Shi, Shinji Watanabe, Graham Neubig, David R. Mortensen, Lori S. Levin |
| 2024 | ACL | Semisupervised Neural Proto-Language Reconstruction. | Liang Lu, Peirong Xie, David R. Mortensen |
| 2024 | COLING | Improved Neural Protoform Reconstruction via Reflex Prediction. | Liang Lu, Jingzhi Wang, David R. Mortensen |
| 2024 | COLING | Verbing Weirds Language (Models): Evaluation of English Zero-Derivation in Five LLMs. | David R. Mortensen, Valentina Izrailevitch, Yunze Xiao, Hinrich Schtze, Leonie Weissweiler |
| 2024 | COLING | Phonotactic Complexity across Dialects. | Ryan Soh-Eun Shim, Kalvin Chang, David R. Mortensen |
| 2024 | COLING | Constructions Are So Difficult That Even Large Language Models Get Them Right for the Wrong Reasons. | Shijia Zhou, Leonie Weissweiler, Taiqi He, Hinrich Schtze, David R. Mortensen, Lori S. Levin |
| 2024 | COLING | PWESuite: Phonetic Word Embeddings and Tasks They Facilitate. | Vilm Zouhar, Kalvin Chang, Chenxuan Cui, Nate B. Carlson, Nathaniel Romney Robinson, Mrinmaya Sachan, David R. Mortensen |
| 2024 | EMNLP | Zero-Shot Cross-Lingual NER Using Phonemic Representations for Low-Resource Languages. | Jimin Sohn, Haeji Jung, Alex Cheng, Jooeon Kang, Yilin Du, David R. Mortensen |
| 2024 | Interspeech | Self-supervised Speech Representations Still Struggle with African American Vernacular English. | Kalvin Chang, Yi-Hui Chou, Jiatong Shi, Hsuan-Ming Chen, Nicole Holliday, Odette Scharenborg, David R. Mortensen |
| 2024 | NAACL | XferBench: a Data-Driven Benchmark for Emergent Language. | Brendon Boldt, David R. Mortensen |
| 2023 | ACL | Transformed Protoform Reconstruction. | Young Min Kim, Kalvin Chang, Chenxuan Cui, David R. Mortensen |
| 2023 | EMNLP | Do All Languages Cost the Same? Tokenization in the Era of Commercial Language Models. | Orevaoghene Ahia, Sachin Kumar, Hila Gonen, Jungo Kasai, David R. Mortensen, Noah A. Smith, Yulia Tsvetkov |
| 2023 | EMNLP | Calibrated Seq2seq Models for Efficient and Generalizable Ultra-fine Entity Typing. | Yanlin Feng, Adithya Pratapa, David R. Mortensen |
| 2023 | EMNLP | Counting the Bugs in ChatGPT's Wugs: A Multilingual Investigation into the Morphological Capabilities of a Large Language Model. | Leonie Weissweiler, Valentin Hofmann, Anjali Kantharuban, Anna Cai, Ritam Dutt, Amey Hengle, Anubha Kabra, Atharva Kulkarni, Abhishek Vijayakumar, Haofei Yu, Hinrich Schtze, Kemal Oflazer, David R. Mortensen |
| 2022 | ACL | Zero-shot Learning for Grapheme to Phoneme Conversion with Language Ensemble. | Xinjian Li, Florian Metze, David R. Mortensen, Shinji Watanabe, Alan W. Black |
| 2022 | COLING | WikiHan: A New Comparative Dataset for Chinese Languages. | Kalvin Chang, Chenxuan Cui, Youngmin Kim, David R. Mortensen |
| 2022 | Interspeech | ASR2K: Speech Recognition for Around 2000 Languages without Audio. | Xinjian Li, Florian Metze, David R. Mortensen, Alan W. Black, Shinji Watanabe |
| 2022 | Interspeech | When Is TTS Augmentation Through a Pivot Language Useful? | Nathaniel Romney Robinson, Perez Ogayo, Swetha R. Gangu, David R. Mortensen, Shinji Watanabe |
| 2022 | LREC | Phone Inventories and Recognition for Every Language. | Xinjian Li, Florian Metze, David R. Mortensen, Alan W. Black, Shinji Watanabe |
| 2022 | LREC | A Hmong Corpus with Elaborate Expression Annotations. | David R. Mortensen, Xinyu Zhang, Chenxuan Cui, Katherine J. Zhang |
| 2022 | NAACL | Learning the Ordering of Coordinate Compounds and Elaborate Expressions in Hmong, Lahu, and Chinese. | Chenxuan Cui, Katherine J. Zhang, David R. Mortensen |
| 2021 | EACL | Cross-Cultural Similarity Features for Cross-Lingual Transfer Learning of Pragmatically Motivated Tasks. | Jimin Sun, Hwijeen Ahn, Chan Young Park, Yulia Tsvetkov, David R. Mortensen |
| 2021 | EMNLP | Evaluating the Morphosyntactic Well-formedness of Generated Texts. | Adithya Pratapa, Antonios Anastasopoulos, Shruti Rijhwani, Aditi Chaudhary, David R. Mortensen, Graham Neubig, Yulia Tsvetkov |
| 2021 | ICASSP | Multilingual Phonetic Dataset for Low Resource Speech Recognition. | Xinjian Li, David R. Mortensen, Florian Metze, Alan W. Black |
| 2021 | Interspeech | Tusom2021: A Phonetically Transcribed Speech Dataset from an Endangered Language for Universal Phone Recognition Experiments. | David R. Mortensen, Jordan Picone, Xinjian Li, Kathleen Siminyu |
| 2021 | Interspeech | Phoneme Recognition Through Fine Tuning of Phonetic Representations: A Case Study on Luhya Language Varieties. | Kathleen Siminyu, Xinjian Li, Antonios Anastasopoulos, David R. Mortensen, Michael R. Marlo, Graham Neubig |
| 2021 | Interspeech | Differentiable Allophone Graphs for Language-Universal Speech Recognition. | Brian Yan, Siddharth Dalmia, David R. Mortensen, Florian Metze, Shinji Watanabe |
| 2020 | AAAI | Towards Zero-Shot Learning for Automatic Phonemic Transcription. | Xinjian Li, Siddharth Dalmia, David R. Mortensen, Juncheng Li, Alan W. Black, Florian Metze |
| 2020 | EMNLP | Automatic Extraction of Rules Governing Morphological Agreement. | Aditi Chaudhary, Antonios Anastasopoulos, Adithya Pratapa, David R. Mortensen, Zaid Sheikh, Yulia Tsvetkov, Graham Neubig |
| 2020 | ICASSP | Universal Phone Recognition with a Multilingual Allophone System. | Xinjian Li, Siddharth Dalmia, Juncheng Li, Matthew Lee, Patrick Littell, Jiali Yao, Antonios Anastasopoulos, David R. Mortensen, Graham Neubig, Alan W. Black, Florian Metze |
| 2020 | LREC | AlloVera: A Multilingual Allophone Database. | David R. Mortensen, Xinjian Li, Patrick Littell, Alexis Michaud, Shruti Rijhwani, Antonios Anastasopoulos, Alan W. Black, Florian Metze, Graham Neubig |
| 2018 | EMNLP | Adapting Word Embeddings to New Languages with Morphological and Phonological Subword Representations. | Aditi Chaudhary, Chunting Zhou, Lori S. Levin, Graham Neubig, David R. Mortensen, Jaime G. Carbonell |
| 2018 | LREC | Parser combinators for Tigrinya and Oromo morphology. | Patrick Littell, Tom McCoy, Na-Rae Han, Shruti Rijhwani, Zaid Sheikh, David R. Mortensen, Teruko Mitamura, Lori S. Levin |
| 2018 | LREC | Epitran: Precision G2P for Many Languages. | David R. Mortensen, Siddharth Dalmia, Patrick Littell |
| 2017 | EACL | URIEL and lang2vec: Representing languages as typological, geographical, and phylogenetic vectors. | Patrick Littell, David R. Mortensen, Ke Lin, Katherine Kairis, Carlisle Turner, Lori S. Levin |
| 2016 | COLING | Named Entity Recognition for Linguistic Rapid Response in Low-Resource Languages: Sorani Kurdish and Tajik. | Patrick Littell, Kartik Goyal, David R. Mortensen, Alexa Little, Chris Dyer, Lori S. Levin |
| 2016 | COLING | PanPhon: A Resource for Mapping IPA Segments to Articulatory Feature Vectors. | David R. Mortensen, Patrick Littell, Akash Bharadwaj, Kartik Goyal, Chris Dyer, Lori S. Levin |
| 2016 | EMNLP | Phonologically Aware Neural Model for Named Entity Recognition in Low Resource Transfer Settings. | Akash Bharadwaj, David R. Mortensen, Chris Dyer, Jaime G. Carbonell |
| 2016 | LREC | Bridge-Language Capitalization Inference in Western Iranian: Sorani, Kurmanji, Zazaki, and Tajik. | Patrick Littell, David R. Mortensen, Kartik Goyal, Chris Dyer, Lori S. Levin |
| 2016 | NAACL | Polyglot Neural Language Models: A Case Study in Cross-Lingual Phonetic Representation Learning. | Yulia Tsvetkov, Sunayana Sitaram, Manaal Faruqui, Guillaume Lample, Patrick Littell, David R. Mortensen, Alan W. Black, Lori S. Levin, Chris Dyer |