Skip to content

Leda Sari

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

19

Venues

5

Active years

2014–2025

Best venue rank

A*

Where they publish

Papers

19 indexed papers, newest first.

YearVenueTitleAuthors
2025ICASSPCJST: CTC Compressor based Joint Speech and Text Training for Decoder-Only ASR.Wei Zhou, Junteng Jia, Leda Sari, Jay Mahadeokar, Ozlem Kalinli
2025InterspeechThe Interspeech 2025 Speech Accessibility Project Challenge.Xiuwen Zheng, Bornali Phukon, Jonghwan Na, Ed Cutrell, Kyu J. Han, Mark Hasegawa-Johnson, Pan-Pan Jiang, Aadhrik Kuila, Colin Lea, Bob MacDonald, Gautam Varma Mantena, Venkatesh Ravichandran, Leda Sari, Katrin Tomanek, Chang D. Yoo, Chris Zwilling
2025InterspeechFrozen Large Language Models Can Perceive Paralinguistic Aspects of Speech.Wonjune Kang, Junteng Jia, Chunyang Wu, Wei Zhou, Egor Lakomkin, Yashesh Gaur, Leda Sari, Suyoun Kim, Ke Li, Jay Mahadeokar, Ozlem Kalinli
2024ICASSPDynamic ASR Pathways: An Adaptive Masking Approach Towards Efficient Pruning of a Multilingual ASR Model.Jiamin Xie, Ke Li, Jinxi Guo, Andros Tjandra, Yuan Shangguan, Leda Sari, Chunyang Wu, Junteng Jia, Jay Mahadeokar, Ozlem Kalinli
2023ICASSPSelf-Supervised Representations for Singing Voice Conversion.Tejas Jayashankar, Jilong Wu, Leda Sari, David Kant, Vimal Manohar, Qing He
2023InterspeechBiased Self-supervised Learning for ASR.Florian L. Kreyssig, Yangyang Shi, Jinxi Guo, Leda Sari, Abdel-rahman Mohamed, Philip C. Woodland
2022CVPREgo4D: Around the World in 3, 000 Hours of Egocentric Video.Kristen Grauman, Andrew Westbury, Eugene Byrne, Zachary Chavis, Antonino Furnari, Rohit Girdhar, Jackson Hamburger, Hao Jiang, Miao Liu, Xingyu Liu, Miguel Martin, Tushar Nagarajan, Ilija Radosavovic, Santhosh Kumar Ramakrishnan, Fiona Ryan, Jayant Sharma, Michael Wray, Mengmeng Xu, Eric Zhongcong Xu, Chen Zhao, Siddhant Bansal, Dhruv Batra, Vincent Cartillier, Sean Crane, Tien Do, Morrie Doulaty, Akshay Erapalli, Christoph Feichtenhofer, Adriano Fragomeni, Qichen Fu, Abrham Gebreselasie, Cristina Gonzlez, James Hillis, Xuhua Huang, Yifei Huang, Wenqi Jia, Weslie Khoo, Jchym Kolr, Satwik Kottur, Anurag Kumar, Federico Landini, Chao Li, Yanghao Li, Zhenqiang Li, Karttikeya Mangalam, Raghava Modhugu, Jonathan Munro, Tullie Murrell, Takumi Nishiyasu, Will Price, Paola Ruiz Puentes, Merey Ramazanova, Leda Sari, Kiran K. Somasundaram, Audrey Southerland, Yusuke Sugano, Ruijie Tao, Minh Vo, Yuchen Wang, Xindi Wu, Takuma Yagi, Ziwei Zhao, Yunyi Zhu, Pablo Arbelez, David Crandall, Dima Damen, Giovanni Maria Farinella, Christian Fuegen, Bernard Ghanem, Vamsi Krishna Ithapu, C. V. Jawahar, Hanbyul Joo, Kris Kitani, Haizhou Li, Richard A. Newcombe, Aude Oliva, Hyun Soo Park, James M. Rehg, Yoichi Sato, Jianbo Shi, Mike Zheng Shou, Antonio Torralba, Lorenzo Torresani, Mingfei Yan, Jitendra Malik
2022ICASSPTowards Measuring Fairness in Speech Recognition: Casual Conversations Dataset Transcriptions.Chunxi Liu, Michael Picheny, Leda Sari, Pooja Chitkara, Alex Xiao, Xiaohui Zhang, Mark Chou, Andres Alvarado, Caner Hazirbas, Yatharth Saraf
2021ICASSPA Multi-View Approach to Audio-Visual Speaker Verification.Leda Sari, Kritika Singh, Jiatong Zhou, Lorenzo Torresani, Nayan Singhal, Yatharth Saraf
2021NAACLWorldly Wise (WoW) - Cross-Lingual Knowledge Fusion for Fact-based Visual Spoken-Question Answering.Kiran Ramnath, Leda Sari, Mark Hasegawa-Johnson, Chang D. Yoo
2020ICASSPTraining Spoken Language Understanding Systems with Non-Parallel Speech and Text.Leda Sari, Samuel Thomas, Mark Hasegawa-Johnson
2020ICASSPUnsupervised Speaker Adaptation Using Attention-Based Speaker Memory for End-to-End ASR.Leda Sari, Niko Moritz, Takaaki Hori, Jonathan Le Roux
2020InterspeechDeep F-Measure Maximization for End-to-End Speech Understanding.Leda Sari, Mark Hasegawa-Johnson
2020InterspeechIdentify Speakers in Cocktail Parties with End-to-End Attention.Junzhe Zhu, Mark Hasegawa-Johnson, Leda Sari
2019ICASSPPre-training of Speaker Embeddings for Low-latency Speaker Change Detection in Broadcast News.Leda Sari, Samuel Thomas, Mark Hasegawa-Johnson, Michael Picheny
2019InterspeechLearning Speaker Aware Offsets for Speaker Adaptation of Neural Networks.Leda Sari, Samuel Thomas, Mark A. Hasegawa-Johnson
2018InterspeechSpeaker Adaptive Audio-Visual Fusion for the Open-Vocabulary Section of AVICAR.Leda Sari, Mark Hasegawa-Johnson, Kumaran S, Georg Stemmer, Krishnakumar N. Nair
2015InterspeechFusion of LVCSR and posteriorgram based keyword search.Leda Sari, Batuhan Gndogdu, Murat Saralar
2014ICPRTexture Defect Detection Using Independent Vector Analysis in Wavelet Domain.Leda Sari, Aysin Ertzn