Leda Sari
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
19
Venues
5
Active years
2014–2025
Best venue rank
A*
Where they publish
Papers
19 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ICASSP | CJST: CTC Compressor based Joint Speech and Text Training for Decoder-Only ASR. | Wei Zhou, Junteng Jia, Leda Sari, Jay Mahadeokar, Ozlem Kalinli |
| 2025 | Interspeech | The Interspeech 2025 Speech Accessibility Project Challenge. | Xiuwen Zheng, Bornali Phukon, Jonghwan Na, Ed Cutrell, Kyu J. Han, Mark Hasegawa-Johnson, Pan-Pan Jiang, Aadhrik Kuila, Colin Lea, Bob MacDonald, Gautam Varma Mantena, Venkatesh Ravichandran, Leda Sari, Katrin Tomanek, Chang D. Yoo, Chris Zwilling |
| 2025 | Interspeech | Frozen Large Language Models Can Perceive Paralinguistic Aspects of Speech. | Wonjune Kang, Junteng Jia, Chunyang Wu, Wei Zhou, Egor Lakomkin, Yashesh Gaur, Leda Sari, Suyoun Kim, Ke Li, Jay Mahadeokar, Ozlem Kalinli |
| 2024 | ICASSP | Dynamic ASR Pathways: An Adaptive Masking Approach Towards Efficient Pruning of a Multilingual ASR Model. | Jiamin Xie, Ke Li, Jinxi Guo, Andros Tjandra, Yuan Shangguan, Leda Sari, Chunyang Wu, Junteng Jia, Jay Mahadeokar, Ozlem Kalinli |
| 2023 | ICASSP | Self-Supervised Representations for Singing Voice Conversion. | Tejas Jayashankar, Jilong Wu, Leda Sari, David Kant, Vimal Manohar, Qing He |
| 2023 | Interspeech | Biased Self-supervised Learning for ASR. | Florian L. Kreyssig, Yangyang Shi, Jinxi Guo, Leda Sari, Abdel-rahman Mohamed, Philip C. Woodland |
| 2022 | CVPR | Ego4D: Around the World in 3, 000 Hours of Egocentric Video. | Kristen Grauman, Andrew Westbury, Eugene Byrne, Zachary Chavis, Antonino Furnari, Rohit Girdhar, Jackson Hamburger, Hao Jiang, Miao Liu, Xingyu Liu, Miguel Martin, Tushar Nagarajan, Ilija Radosavovic, Santhosh Kumar Ramakrishnan, Fiona Ryan, Jayant Sharma, Michael Wray, Mengmeng Xu, Eric Zhongcong Xu, Chen Zhao, Siddhant Bansal, Dhruv Batra, Vincent Cartillier, Sean Crane, Tien Do, Morrie Doulaty, Akshay Erapalli, Christoph Feichtenhofer, Adriano Fragomeni, Qichen Fu, Abrham Gebreselasie, Cristina Gonzlez, James Hillis, Xuhua Huang, Yifei Huang, Wenqi Jia, Weslie Khoo, Jchym Kolr, Satwik Kottur, Anurag Kumar, Federico Landini, Chao Li, Yanghao Li, Zhenqiang Li, Karttikeya Mangalam, Raghava Modhugu, Jonathan Munro, Tullie Murrell, Takumi Nishiyasu, Will Price, Paola Ruiz Puentes, Merey Ramazanova, Leda Sari, Kiran K. Somasundaram, Audrey Southerland, Yusuke Sugano, Ruijie Tao, Minh Vo, Yuchen Wang, Xindi Wu, Takuma Yagi, Ziwei Zhao, Yunyi Zhu, Pablo Arbelez, David Crandall, Dima Damen, Giovanni Maria Farinella, Christian Fuegen, Bernard Ghanem, Vamsi Krishna Ithapu, C. V. Jawahar, Hanbyul Joo, Kris Kitani, Haizhou Li, Richard A. Newcombe, Aude Oliva, Hyun Soo Park, James M. Rehg, Yoichi Sato, Jianbo Shi, Mike Zheng Shou, Antonio Torralba, Lorenzo Torresani, Mingfei Yan, Jitendra Malik |
| 2022 | ICASSP | Towards Measuring Fairness in Speech Recognition: Casual Conversations Dataset Transcriptions. | Chunxi Liu, Michael Picheny, Leda Sari, Pooja Chitkara, Alex Xiao, Xiaohui Zhang, Mark Chou, Andres Alvarado, Caner Hazirbas, Yatharth Saraf |
| 2021 | ICASSP | A Multi-View Approach to Audio-Visual Speaker Verification. | Leda Sari, Kritika Singh, Jiatong Zhou, Lorenzo Torresani, Nayan Singhal, Yatharth Saraf |
| 2021 | NAACL | Worldly Wise (WoW) - Cross-Lingual Knowledge Fusion for Fact-based Visual Spoken-Question Answering. | Kiran Ramnath, Leda Sari, Mark Hasegawa-Johnson, Chang D. Yoo |
| 2020 | ICASSP | Training Spoken Language Understanding Systems with Non-Parallel Speech and Text. | Leda Sari, Samuel Thomas, Mark Hasegawa-Johnson |
| 2020 | ICASSP | Unsupervised Speaker Adaptation Using Attention-Based Speaker Memory for End-to-End ASR. | Leda Sari, Niko Moritz, Takaaki Hori, Jonathan Le Roux |
| 2020 | Interspeech | Deep F-Measure Maximization for End-to-End Speech Understanding. | Leda Sari, Mark Hasegawa-Johnson |
| 2020 | Interspeech | Identify Speakers in Cocktail Parties with End-to-End Attention. | Junzhe Zhu, Mark Hasegawa-Johnson, Leda Sari |
| 2019 | ICASSP | Pre-training of Speaker Embeddings for Low-latency Speaker Change Detection in Broadcast News. | Leda Sari, Samuel Thomas, Mark Hasegawa-Johnson, Michael Picheny |
| 2019 | Interspeech | Learning Speaker Aware Offsets for Speaker Adaptation of Neural Networks. | Leda Sari, Samuel Thomas, Mark A. Hasegawa-Johnson |
| 2018 | Interspeech | Speaker Adaptive Audio-Visual Fusion for the Open-Vocabulary Section of AVICAR. | Leda Sari, Mark Hasegawa-Johnson, Kumaran S, Georg Stemmer, Krishnakumar N. Nair |
| 2015 | Interspeech | Fusion of LVCSR and posteriorgram based keyword search. | Leda Sari, Batuhan Gndogdu, Murat Saralar |
| 2014 | ICPR | Texture Defect Detection Using Independent Vector Analysis in Wavelet Domain. | Leda Sari, Aysin Ertzn |