Skip to content

Chao-Han Huck Yang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

79

Venues

19

Active years

2018–2026

Best venue rank

A*

Where they publish

Papers

79 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLPRiSM: Benchmarking Phone Realization in Speech Models.Shikhar Bharadwaj, Chin-Jou Li, Yoonjae Kim, Kwanghee Choi, Eunjung Yeo, Ryan Soh-Eun Shim, Hanyu Zhou, Brendon Boldt, Karen Rosero, Kalvin Chang, Darsh Agrawal, Keer Xu, Chao-Han Huck Yang, Jian Zhu, Shinji Watanabe, David R. Mortensen
2026ACLWoW-Bench: Evaluating Fine-Grained Acoustic Perception in Audio-Language Models via Marine Mammal Vocalizations.Jaeyeon Kim, Heeseung Yun, Tony Woo, Chao-Han Huck Yang, Gunhee Kim
2026ACLSpeech-Hands: A Self-Reflection Voice Agentic Approach to Speech Recognition and Audio Reasoning with Omni Perception.Zhen Wan, Chao-Han Huck Yang, Jinchuan Tian, Hanrong Ye, Ankita Pasad, Szu-Wei Fu, Arushi Goel, Ryo Hachiuma, Shizhe Diao, Kunal Dhawan, Sreyan Ghosh, Yusuke Hirota, Zhehuai Chen, Rafael Valle, Chenhui Chu, Shinji Watanabe, Boris Ginsburg, Yu-Chiang Frank Wang
2025ACLMISP-Meeting: A Real-World Dataset with Multimodal Cues for Long-form Meeting Transcription and Summarization.HangChen HangChen, Chao-Han Huck Yang, Jia-Chen Gu, Sabato Marco Siniscalchi, Jun Du
2025ACLLOTUS: A Leaderboard for Detailed Image Captioning from Quality to Societal Bias and User Preferences.Yusuke Hirota, Boyi Li, Ryo Hachiuma, Yueh-Hua Wu, Boris Ivanovic, Marco Pavone, Yejin Choi, Yu-Chiang Frank Wang, Yuta Nakashima, Chao-Han Huck Yang
2025ACLNeKo: Cross-Modality Post-Recognition Error Correction with Tasks-Guided Mixture-of-Experts Language Model.Yen-Ting Lin, Zhehuai Chen, Piotr Zelasko, Zhen Wan, Xuesong Yang, Zih-Ching Chen, Krishna C. Puvvada, Ke Hu, Szu-Wei Fu, Jun Wei Chiu, Jagadeesh Balam, Boris Ginsburg, Yu-Chiang Frank Wang, Chao-Han Huck Yang
2025ACLSpeechIQ: Speech-Agentic Intelligence Quotient Across Cognitive Levels in Voice Understanding by Large Language Models.Zhen Wan, Chao-Han Huck Yang, Yahan Yu, Jinchuan Tian, Sheng Li, Ke Hu, Zhehuai Chen, Shinji Watanabe, Fei Cheng, Chenhui Chu, Sadao Kurohashi
2025EMNLPExtending Automatic Machine Translation Evaluation to Book-Length Documents.Kuang-Da Wang, Shuoyang Ding, Chao-Han Huck Yang, Ping-Chun Hsieh, Wen-Chih Peng, Vitaly Lavrukhin, Boris Ginsburg
2025EMNLPCoVoGER: A Multilingual Multitask Benchmark for Speech-to-text Generative Error Correction with Large Language Models.Zhengdong Yang, Zhen Wan, Sheng Li, Chao-Han Huck Yang, Chenhui Chu
2025ICASSPProjection Valued-based Quantum Machine Learning Adapting to Differential Privacy Algorithm for Word-level Lipreading.Hang Chen, Chang Wang, Jun Du, Chao-Han Huck Yang, Jun Qi
2025ICASSPChain-of-Thought Prompting for Speech Translation.Ke Hu, Zhehuai Chen, Chao-Han Huck Yang, Piotr Zelasko, Oleksii Hrinchuk, Vitaly Lavrukhin, Jagadeesh Balam, Boris Ginsburg
2025ICASSPRevise, Reason, and Recognize: LLM-Based Emotion Recognition via Emotion-Specific Prompts and ASR Error Correction.Yuanchao Li, Yuan Gong, Chao-Han Huck Yang, Peter Bell, Catherine Lai
2025ICASSPDeveloping Instruction-Following Speech Language Model Without Speech Instruction-Tuning Data.Ke-Han Lu, Zhehuai Chen, Szu-Wei Fu, Chao-Han Huck Yang, Jagadeesh Balam, Boris Ginsburg, Yu-Chiang Frank Wang, Hung-Yi Lee
2025ICCVBias in Gender Bias Benchmarks: How Spurious Features Distort Evaluation.Yusuke Hirota, Ryo Hachiuma, Boyi Li, Ximing Lu, Michael Ross Boone, Boris Ivanovic, Yejin Choi, Marco Pavone, Yu-Chiang Frank Wang, Noa Garcia, Yuta Nakashima, Chao-Han Huck Yang
2025ICLRAudio Large Language Models Can Be Descriptive Speech Quality Evaluators.Chen Chen, Yuchen Hu, Siyin Wang, Helin Wang, Zhehuai Chen, Chao Zhang, Chao-Han Huck Yang, Eng Siong Chng
2025ICLRUniWav: Towards Unified Pre-training for Speech Representation Learning and Generation.Alexander H. Liu, Sang-gil Lee, Chao-Han Huck Yang, Yuan Gong, Yu-Chiang Frank Wang, James R. Glass, Rafael Valle, Bryan Catanzaro
2025ICLRA Quantum Circuit-Based Compression Perspective for Parameter-Efficient Learning.Chen-Yu Liu, Chao-Han Huck Yang, Hsi-Sheng Goan, Min-Hsiu Hsieh
2025ICLRFugatto 1: Foundational Generative Audio Transformer Opus 1.Rafael Valle, Rohan Badlani, Zhifeng Kong, Sang-gil Lee, Arushi Goel, Sungwon Kim, Joo Felipe Santos, Shuqi Dai, Siddharth Gururani, Aya Aljafari, Alexander H. Liu, Kevin J. Shih, Ryan Prenger, Wei Ping, Chao-Han Huck Yang, Bryan Catanzaro
2025ICLRTowards Neural Scaling Laws for Time Series Foundation Models.Qingren Yao, Chao-Han Huck Yang, Renhe Jiang, Yuxuan Liang, Ming Jin, Shirui Pan
2025ICMLOWLS: Scaling Laws for Multilingual Speech Recognition and Translation Models.William Chen, Jinchuan Tian, Yifan Peng, Brian Yan, Chao-Han Huck Yang, Shinji Watanabe
2025ISCASQuantum Machine Learning: An Interplay Between Quantum Computing and Machine Learning.Jun Qi, Chao-Han Huck Yang, Samuel Yen-Chi Chen, Pin-Yu Chen
2025NAACLESPnet-SpeechLM: An Open Speech Language Model Toolkit.Jinchuan Tian, Jiatong Shi, William Chen, Siddhant Arora, Yoshiki Masuyama, Takashi Maekaku, Yihan Wu, Junyi Peng, Shikhar Bharadwaj, Yiwen Zhao, Samuele Cornell, Yifan Peng, Xiang Yue, Chao-Han Huck Yang, Graham Neubig, Shinji Watanabe
2024ACLGenTranslate: Large Language Models are Generative Multilingual Speech and Machine Translators.Yuchen Hu, Chen Chen, Chao-Han Huck Yang, Ruizhe Li, Dong Zhang, Zhehuai Chen, Engsiong Chng
2024EMNLPFrom Descriptive Richness to Bias: Unveiling the Dark Side of Generative Image Caption Enrichment.Yusuke Hirota, Ryo Hachiuma, Chao-Han Huck Yang, Yuta Nakashima
2024EMNLPFastAdaSP: Multitask-Adapted Efficient Inference for Large Speech Language Model.Yichen Lu, Jiaqi Song, Chao-Han Huck Yang, Shinji Watanabe
2024EMNLPBayesian Example Selection Improves In-Context Learning for Speech, Text and Visual Modalities.Siyin Wang, Chao-Han Huck Yang, Ji Wu, Chao Zhang
2024ICASSPTowards ASR Robust Spoken Language Understanding Through in-Context Learning with Word Confusion Networks.Kevin Everson, Yile Gu, Chao-Han Huck Yang, Prashanth Gurunath Shivakumar, Guan-Ting Lin, Jari Kolehmainen, Ivan Bulyko, Ankur Gandhe, Shalini Ghosh, Wael Hamza, Hung-Yi Lee, Ariya Rastrow, Andreas Stolcke
2024ICASSPExploiting A Quantum Multiple Kernel Learning Approach For Low-Resource Spoken Command Recognition.Xianyan Fu, Xiao-Lei Zhang, Chao-Han Huck Yang, Jun Qi
2024ICASSPHot-Fixing Wake Word Recognition for End-to-End ASR Via Neural Model Reprogramming.Pin-Jui Ku, I-Fan Chen, Chao-Han Huck Yang, Anirudh Raju, Pranav Dheram, Pegah Ghahremani, Brian King, Jing Liu, Roger Ren, Phani Sankar Nidadavolu
2024ICASSPParalinguistics-Enhanced Large Language Modeling of Spoken Dialogue.Guan-Ting Lin, Prashanth Gurunath Shivakumar, Ankur Gandhe, Chao-Han Huck Yang, Yile Gu, Shalini Ghosh, Andreas Stolcke, Hung-Yi Lee, Ivan Bulyko
2024ICASSPMultimodal Attention Merging for Improved Speech Recognition and Audio Event Classification.Anirudh S. Sundar, Chao-Han Huck Yang, David M. Chan, Shalini Ghosh, Venkatesh Ravichandran, Phani Sankar Nidadavolu
2024ICASSPCan Whisper Perform Speech-Based In-Context Learning?Siyin Wang, Chao-Han Huck Yang, Ji Wu, Chao Zhang
2024ICLRIt's Never Too Late: Fusing Acoustic Information into Large Language Models for Automatic Speech Recognition.Chen Chen, Ruizhe Li, Yuchen Hu, Sabato Marco Siniscalchi, Pin-Yu Chen, Engsiong Chng, Chao-Han Huck Yang
2024ICLRLarge Language Models are Efficient Learners of Noise-Robust Speech Recognition.Yuchen Hu, Chen Chen, Chao-Han Huck Yang, Ruizhe Li, Chao Zhang, Pin-Yu Chen, Engsiong Chng
2024QCEQTRL: Toward Practical Quantum Reinforcement Learning via Quantum-Train.Chen-Yu Liu, Chu-Hsuan Abraham Lin, Chao-Han Huck Yang, Kuan-Cheng Chen, Min-Hsiu Hsieh
2023ASRUGenerative Speech Recognition Error Correction With Large Language Models and Task-Activating Prompting.Chao-Han Huck Yang, Yile Gu, Yi-Chieh Liu, Shalini Ghosh, Ivan Bulyko, Andreas Stolcke
2023ASRULow-Rank Adaptation of Large Language Model Rescoring for Parameter-Efficient Speech Recognition.Yu Yu, Chao-Han Huck Yang, Jari Kolehmainen, Prashanth Gurunath Shivakumar, Yile Gu, Sungho Ryu, Roger Ren, Qi Luo, Aditya Gourav, I-Fan Chen, Yi-Chieh Liu, Tuan Dinh, Ankur Gandhe, Denis Filimonov, Shalini Ghosh, Andreas Stolcke, Ariya Rastrow, Ivan Bulyko
2023CVPRCausalainer: Causal Explainer for Automatic Video Summarization.Jia-Hong Huang, Chao-Han Huck Yang, Pin-Yu Chen, Min-Hung Chen, Marcel Worring
2023EMNLPWhispering LLaMA: A Cross-Modal Generative Error Correction Framework for Speech Recognition.Srijith Radhakrishnan, Chao-Han Huck Yang, Sumeer Ahmad Khan, Rohit Kumar, Narsis A. Kiani, David Gomez-Cabrero, Jesper Tegnr
2023ICASSPCertified Robustness of Quantum Classifiers Against Adversarial Examples Through Quantum Noise.Jhih-Cing Huang, Yu-Lin Tsai, Chao-Han Huck Yang, Cheng-Fang Su, Chia-Mu Yu, Pin-Yu Chen, Sy-Yen Kuo
2023ICASSPLow-Resource Music Genre Classification with Cross-Modal Neural Model Reprogramming.Yun-Ning Hung, Chao-Han Huck Yang, Pin-Yu Chen, Alexander Lerch
2023ICASSPFrom English to More Languages: Parameter-Efficient Model Reprogramming for Cross-Lingual Speech Recognition.Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Rohit Prabhavalkar, Tara N. Sainath, Trevor Strohman
2023ICASSPA Quantum Kernel Learning Approach to Acoustic Modeling for Spoken Command Recognition.Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Tara N. Sainath, Sabato Marco Siniscalchi, Chin-Hui Lee
2023InterspeechA Neural State-Space Modeling Approach to Efficient Speech Separation.Chen Chen, Chao-Han Huck Yang, Kai Li, Yuchen Hu, Pin-Jui Ku, Eng Siong Chng
2023InterspeechHow to Estimate Model Transferability of Pre-Trained Speech Models?Zih-Ching Chen, Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Shuo-Yiin Chang, Rohit Prabhavalkar, Hung-yi Lee, Tara N. Sainath
2023InterspeechDifferentially Private Adapters for Parameter Efficient Acoustic Modeling.Chun-Wei Ho, Chao-Han Huck Yang, Sabato Marco Siniscalchi
2023InterspeechA Multi-dimensional Deep Structured State Space Approach to Speech Enhancement Using Small-footprint Models.Pin-Jui Ku, Chao-Han Huck Yang, Sabato Marco Siniscalchi, Chin-Hui Lee
2023InterspeechA Parameter-Efficient Learning Approach to Arabic Dialect Identification with Pre-Trained General-Purpose Speech Model.Srijith Radhakrishnan, Chao-Han Huck Yang, Sumeer Ahmad Khan, Narsis A. Kiani, David Gomez-Cabrero, Jesper N. Tegnr
2023InterspeechParameter-Efficient Learning for Text-to-Speech Accent Adaptation.Li-Jen Yang, Chao-Han Huck Yang, Jen-Tzung Chien
2023InterspeechNeural Model Reprogramming with Similarity Based Mapping for Low-Resource Spoken Command Recognition.Hao Yen, Pin-Jui Ku, Chao-Han Huck Yang, Hu Hu, Sabato Marco Siniscalchi, Pin-Yu Chen, Yu Tsao
2023WACVTreatment Learning Causal Transformer for Noisy Image Classification.Chao-Han Huck Yang, I-Te Danny Hung, Yi-Chieh Liu, Pin-Yu Chen
2023UAIPessimistic Model Selection for Offline Deep Reinforcement Learning.Chao-Han Huck Yang, Zhengling Qi, Yifan Cui, Pin-Yu Chen
2022AAAITraining a Resilient Q-network against Observational Interference.Chao-Han Huck Yang, I-Te Danny Hung, Yi Ouyang, Pin-Yu Chen
2022ICASSPA Variational Bayesian Approach to Learning Latent Variables for Acoustic Knowledge Transfer.Hu Hu, Sabato Marco Siniscalchi, Chao-Han Huck Yang, Chin-Hui Lee
2022ICASSPMitigating Closed-Model Adversarial Examples with Bayesian Neural Modeling for Enhanced End-to-End Speech Recognition.Chao-Han Huck Yang, Zeeshan Ahmed, Yile Gu, Joseph Szurley, Roger Ren, Linda Liu, Andreas Stolcke, Ivan Bulyko
2022ICASSPWhen BERT Meets Quantum Temporal Convolution Learning for Text Classification in Heterogeneous Computing.Chao-Han Huck Yang, Jun Qi, Samuel Yen-Chi Chen, Yu Tsao, Pin-Yu Chen
2022ICASSPA Study of Designing Compact Audio-Visual Wake Word Spotting System Based on Iterative Fine-Tuning in Neural Network Pruning.Hengshun Zhou, Jun Du, Chao-Han Huck Yang, Shifu Xiong, Chin-Hui Lee
2022WACVNon-local Attention Improves Description Generation for Retinal Images.Jia-Hong Huang, Ting-Wei Wu, Chao-Han Huck Yang, Zenglin Shi, I-Hung Lin, Jesper Tegnr, Marcel Worring
2021ASRUMulti-Task Language Modeling for Improving Speech Recognition of Rare Words.Chao-Han Huck Yang, Linda Liu, Ankur Gandhe, Yile Gu, Anirudh Raju, Denis Filimonov, Ivan Bulyko
2021ICASSPA Two-Stage Approach to Device-Robust Acoustic Scene Classification.Hu Hu, Chao-Han Huck Yang, Xianjun Xia, Xue Bai, Xin Tang, Yajian Wang, Shutong Niu, Li Chai, Juanjuan Li, Hongning Zhu, Feng Bao, Yuanjun Zhao, Sabato Marco Siniscalchi, Yannan Wang, Jun Du, Chin-Hui Lee
2021ICASSPDecentralizing Feature Extraction with Quantum Convolutional Neural Network for Automatic Speech Recognition.Chao-Han Huck Yang, Jun Qi, Samuel Yen-Chi Chen, Pin-Yu Chen, Sabato Marco Siniscalchi, Xiaoli Ma, Chin-Hui Lee
2021ICIPDeep Context-Encoding Network For Retinal Image Captioning.Jia-Hong Huang, Ting-Wei Wu, Chao-Han Huck Yang, Marcel Worring
2021ICIPRobust Unsupervised Multi-Object Tracking In Noisy Environments.Chao-Han Huck Yang, Mohit Chhabra, Yi-Chieh Liu, Quan Kong, Tomoaki Yoshinaga, Tomokazu Murakami
2021ICMLVoice2Series: Reprogramming Acoustic Models for Time Series Classification.Chao-Han Huck Yang, Yun-Yun Tsai, Pin-Yu Chen
2021InterspeechPATE-AAE: Incorporating Adversarial Autoencoder into Private Aggregation of Teacher Ensembles for Spoken Command Classification.Chao-Han Huck Yang, Sabato Marco Siniscalchi, Chin-Hui Lee
2021WACVDeepOpht: Medical Report Generation for Retinal Images via Deep Models and Visual Explanation.Jia-Hong Huang, Chao-Han Huck Yang, Fangyu Liu, Meng Tian, Yi-Chieh Liu, Ting-Wei Wu, I-Hung Lin, Kang Wang, Hiromasa Morikawa, Hernghua Chang, Jesper Tegnr, Marcel Worring
2020CECEvolving Neural Networks through a Reverse Encoding Tree.Haoling Zhang, Chao-Han Huck Yang, Hector Zenil, Narsis Aftab Kiani, Yue Shen, Jesper N. Tegnr
2020CISSConvolutional Neural Network Based Radio Tomographic Imaging.Hongzhuang Wu, Xiaoli Ma, Chao-Han Huck Yang, Songyong Liu
2020ICASSPInterpretable Self-Attention Temporal Reasoning for Driving Behavior Understanding.Yi-Chieh Liu, Yung-An Hsieh, Min-Hung Chen, Chao-Han Huck Yang, Jesper Tegnr, Yi-Chang James Tsai
2020ICASSPTensor-To-Vector Regression for Multi-Channel Speech Enhancement Based on Tensor-Train Network.Jun Qi, Hu Hu, Yannan Wang, Chao-Han Huck Yang, Sabato Marco Siniscalchi, Chin-Hui Lee
2020ICASSPSubmodular Rank Aggregation on Score-Based Permutations for Distributed Automatic Speech Recognition.Jun Qi, Chao-Han Huck Yang, Javier Tejedor
2020ICASSPCharacterizing Speech Adversarial Examples Using Self-Attention U-Net Enhancement.Chao-Han Huck Yang, Jun Qi, Pin-Yu Chen, Xiaoli Ma, Chin-Hui Lee
2020ICASSPEnhanced Adversarial Strategically-Timed Attacks Against Deep Reinforcement Learning.Chao-Han Huck Yang, Jun Qi, Pin-Yu Chen, Yi Ouyang, I-Te Danny Hung, Chin-Hui Lee, Xiaoli Ma
2020ICASSPY-Net: Multi-Scale Feature Aggregation Network With Wavelet Structure Similarity Loss Function For Single Image Dehazing.Hao-Hsiang Yang, Chao-Han Huck Yang, Yi-Chang James Tsai
2020ICIPWavelet Channel Attention Module With A Fusion Network For Single Image Deraining.Hao-Hsiang Yang, Chao-Han Huck Yang, Yu-Chiang Frank Wang
2020InterspeechExploring Deep Hybrid Tensor-to-Vector Network Architectures for Regression Based Speech Enhancement.Jun Qi, Hu Hu, Yannan Wang, Chao-Han Huck Yang, Sabato Marco Siniscalchi, Chin-Hui Lee
2019ICIPWhen Causal Intervention Meets Adversarial Examples and Image Masking for Deep Neural Networks.Chao-Han Huck Yang, Yi-Chieh Liu, Pin-Yu Chen, Xiaoli Ma, Yi-Chang James Tsai
2018ACCVSynthesizing New Retinal Symptom Images by Multiple Generative Models.Yi-Chieh Liu, Hao-Hsiang Yang, Chao-Han Huck Yang, Jia-Hong Huang, Meng Tian, Hiromasa Morikawa, Yi-Chang James Tsai, Jesper Tegnr
2018ACCVAuto-classification of Retinal Diseases in the Limit of Sparse Data Using a Two-Streams Machine Learning Model.Chao-Han Huck Yang, Fangyu Liu, Jia-Hong Huang, Meng Tian, I-Hung Lin, Yi-Chieh Liu, Hiromasa Morikawa, Hao-Hsiang Yang, Jesper Tegnr