Chao-Han Huck Yang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
79
Venues
19
Active years
2018–2026
Best venue rank
A*
Where they publish
Papers
79 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | PRiSM: Benchmarking Phone Realization in Speech Models. | Shikhar Bharadwaj, Chin-Jou Li, Yoonjae Kim, Kwanghee Choi, Eunjung Yeo, Ryan Soh-Eun Shim, Hanyu Zhou, Brendon Boldt, Karen Rosero, Kalvin Chang, Darsh Agrawal, Keer Xu, Chao-Han Huck Yang, Jian Zhu, Shinji Watanabe, David R. Mortensen |
| 2026 | ACL | WoW-Bench: Evaluating Fine-Grained Acoustic Perception in Audio-Language Models via Marine Mammal Vocalizations. | Jaeyeon Kim, Heeseung Yun, Tony Woo, Chao-Han Huck Yang, Gunhee Kim |
| 2026 | ACL | Speech-Hands: A Self-Reflection Voice Agentic Approach to Speech Recognition and Audio Reasoning with Omni Perception. | Zhen Wan, Chao-Han Huck Yang, Jinchuan Tian, Hanrong Ye, Ankita Pasad, Szu-Wei Fu, Arushi Goel, Ryo Hachiuma, Shizhe Diao, Kunal Dhawan, Sreyan Ghosh, Yusuke Hirota, Zhehuai Chen, Rafael Valle, Chenhui Chu, Shinji Watanabe, Boris Ginsburg, Yu-Chiang Frank Wang |
| 2025 | ACL | MISP-Meeting: A Real-World Dataset with Multimodal Cues for Long-form Meeting Transcription and Summarization. | HangChen HangChen, Chao-Han Huck Yang, Jia-Chen Gu, Sabato Marco Siniscalchi, Jun Du |
| 2025 | ACL | LOTUS: A Leaderboard for Detailed Image Captioning from Quality to Societal Bias and User Preferences. | Yusuke Hirota, Boyi Li, Ryo Hachiuma, Yueh-Hua Wu, Boris Ivanovic, Marco Pavone, Yejin Choi, Yu-Chiang Frank Wang, Yuta Nakashima, Chao-Han Huck Yang |
| 2025 | ACL | NeKo: Cross-Modality Post-Recognition Error Correction with Tasks-Guided Mixture-of-Experts Language Model. | Yen-Ting Lin, Zhehuai Chen, Piotr Zelasko, Zhen Wan, Xuesong Yang, Zih-Ching Chen, Krishna C. Puvvada, Ke Hu, Szu-Wei Fu, Jun Wei Chiu, Jagadeesh Balam, Boris Ginsburg, Yu-Chiang Frank Wang, Chao-Han Huck Yang |
| 2025 | ACL | SpeechIQ: Speech-Agentic Intelligence Quotient Across Cognitive Levels in Voice Understanding by Large Language Models. | Zhen Wan, Chao-Han Huck Yang, Yahan Yu, Jinchuan Tian, Sheng Li, Ke Hu, Zhehuai Chen, Shinji Watanabe, Fei Cheng, Chenhui Chu, Sadao Kurohashi |
| 2025 | EMNLP | Extending Automatic Machine Translation Evaluation to Book-Length Documents. | Kuang-Da Wang, Shuoyang Ding, Chao-Han Huck Yang, Ping-Chun Hsieh, Wen-Chih Peng, Vitaly Lavrukhin, Boris Ginsburg |
| 2025 | EMNLP | CoVoGER: A Multilingual Multitask Benchmark for Speech-to-text Generative Error Correction with Large Language Models. | Zhengdong Yang, Zhen Wan, Sheng Li, Chao-Han Huck Yang, Chenhui Chu |
| 2025 | ICASSP | Projection Valued-based Quantum Machine Learning Adapting to Differential Privacy Algorithm for Word-level Lipreading. | Hang Chen, Chang Wang, Jun Du, Chao-Han Huck Yang, Jun Qi |
| 2025 | ICASSP | Chain-of-Thought Prompting for Speech Translation. | Ke Hu, Zhehuai Chen, Chao-Han Huck Yang, Piotr Zelasko, Oleksii Hrinchuk, Vitaly Lavrukhin, Jagadeesh Balam, Boris Ginsburg |
| 2025 | ICASSP | Revise, Reason, and Recognize: LLM-Based Emotion Recognition via Emotion-Specific Prompts and ASR Error Correction. | Yuanchao Li, Yuan Gong, Chao-Han Huck Yang, Peter Bell, Catherine Lai |
| 2025 | ICASSP | Developing Instruction-Following Speech Language Model Without Speech Instruction-Tuning Data. | Ke-Han Lu, Zhehuai Chen, Szu-Wei Fu, Chao-Han Huck Yang, Jagadeesh Balam, Boris Ginsburg, Yu-Chiang Frank Wang, Hung-Yi Lee |
| 2025 | ICCV | Bias in Gender Bias Benchmarks: How Spurious Features Distort Evaluation. | Yusuke Hirota, Ryo Hachiuma, Boyi Li, Ximing Lu, Michael Ross Boone, Boris Ivanovic, Yejin Choi, Marco Pavone, Yu-Chiang Frank Wang, Noa Garcia, Yuta Nakashima, Chao-Han Huck Yang |
| 2025 | ICLR | Audio Large Language Models Can Be Descriptive Speech Quality Evaluators. | Chen Chen, Yuchen Hu, Siyin Wang, Helin Wang, Zhehuai Chen, Chao Zhang, Chao-Han Huck Yang, Eng Siong Chng |
| 2025 | ICLR | UniWav: Towards Unified Pre-training for Speech Representation Learning and Generation. | Alexander H. Liu, Sang-gil Lee, Chao-Han Huck Yang, Yuan Gong, Yu-Chiang Frank Wang, James R. Glass, Rafael Valle, Bryan Catanzaro |
| 2025 | ICLR | A Quantum Circuit-Based Compression Perspective for Parameter-Efficient Learning. | Chen-Yu Liu, Chao-Han Huck Yang, Hsi-Sheng Goan, Min-Hsiu Hsieh |
| 2025 | ICLR | Fugatto 1: Foundational Generative Audio Transformer Opus 1. | Rafael Valle, Rohan Badlani, Zhifeng Kong, Sang-gil Lee, Arushi Goel, Sungwon Kim, Joo Felipe Santos, Shuqi Dai, Siddharth Gururani, Aya Aljafari, Alexander H. Liu, Kevin J. Shih, Ryan Prenger, Wei Ping, Chao-Han Huck Yang, Bryan Catanzaro |
| 2025 | ICLR | Towards Neural Scaling Laws for Time Series Foundation Models. | Qingren Yao, Chao-Han Huck Yang, Renhe Jiang, Yuxuan Liang, Ming Jin, Shirui Pan |
| 2025 | ICML | OWLS: Scaling Laws for Multilingual Speech Recognition and Translation Models. | William Chen, Jinchuan Tian, Yifan Peng, Brian Yan, Chao-Han Huck Yang, Shinji Watanabe |
| 2025 | ISCAS | Quantum Machine Learning: An Interplay Between Quantum Computing and Machine Learning. | Jun Qi, Chao-Han Huck Yang, Samuel Yen-Chi Chen, Pin-Yu Chen |
| 2025 | NAACL | ESPnet-SpeechLM: An Open Speech Language Model Toolkit. | Jinchuan Tian, Jiatong Shi, William Chen, Siddhant Arora, Yoshiki Masuyama, Takashi Maekaku, Yihan Wu, Junyi Peng, Shikhar Bharadwaj, Yiwen Zhao, Samuele Cornell, Yifan Peng, Xiang Yue, Chao-Han Huck Yang, Graham Neubig, Shinji Watanabe |
| 2024 | ACL | GenTranslate: Large Language Models are Generative Multilingual Speech and Machine Translators. | Yuchen Hu, Chen Chen, Chao-Han Huck Yang, Ruizhe Li, Dong Zhang, Zhehuai Chen, Engsiong Chng |
| 2024 | EMNLP | From Descriptive Richness to Bias: Unveiling the Dark Side of Generative Image Caption Enrichment. | Yusuke Hirota, Ryo Hachiuma, Chao-Han Huck Yang, Yuta Nakashima |
| 2024 | EMNLP | FastAdaSP: Multitask-Adapted Efficient Inference for Large Speech Language Model. | Yichen Lu, Jiaqi Song, Chao-Han Huck Yang, Shinji Watanabe |
| 2024 | EMNLP | Bayesian Example Selection Improves In-Context Learning for Speech, Text and Visual Modalities. | Siyin Wang, Chao-Han Huck Yang, Ji Wu, Chao Zhang |
| 2024 | ICASSP | Towards ASR Robust Spoken Language Understanding Through in-Context Learning with Word Confusion Networks. | Kevin Everson, Yile Gu, Chao-Han Huck Yang, Prashanth Gurunath Shivakumar, Guan-Ting Lin, Jari Kolehmainen, Ivan Bulyko, Ankur Gandhe, Shalini Ghosh, Wael Hamza, Hung-Yi Lee, Ariya Rastrow, Andreas Stolcke |
| 2024 | ICASSP | Exploiting A Quantum Multiple Kernel Learning Approach For Low-Resource Spoken Command Recognition. | Xianyan Fu, Xiao-Lei Zhang, Chao-Han Huck Yang, Jun Qi |
| 2024 | ICASSP | Hot-Fixing Wake Word Recognition for End-to-End ASR Via Neural Model Reprogramming. | Pin-Jui Ku, I-Fan Chen, Chao-Han Huck Yang, Anirudh Raju, Pranav Dheram, Pegah Ghahremani, Brian King, Jing Liu, Roger Ren, Phani Sankar Nidadavolu |
| 2024 | ICASSP | Paralinguistics-Enhanced Large Language Modeling of Spoken Dialogue. | Guan-Ting Lin, Prashanth Gurunath Shivakumar, Ankur Gandhe, Chao-Han Huck Yang, Yile Gu, Shalini Ghosh, Andreas Stolcke, Hung-Yi Lee, Ivan Bulyko |
| 2024 | ICASSP | Multimodal Attention Merging for Improved Speech Recognition and Audio Event Classification. | Anirudh S. Sundar, Chao-Han Huck Yang, David M. Chan, Shalini Ghosh, Venkatesh Ravichandran, Phani Sankar Nidadavolu |
| 2024 | ICASSP | Can Whisper Perform Speech-Based In-Context Learning? | Siyin Wang, Chao-Han Huck Yang, Ji Wu, Chao Zhang |
| 2024 | ICLR | It's Never Too Late: Fusing Acoustic Information into Large Language Models for Automatic Speech Recognition. | Chen Chen, Ruizhe Li, Yuchen Hu, Sabato Marco Siniscalchi, Pin-Yu Chen, Engsiong Chng, Chao-Han Huck Yang |
| 2024 | ICLR | Large Language Models are Efficient Learners of Noise-Robust Speech Recognition. | Yuchen Hu, Chen Chen, Chao-Han Huck Yang, Ruizhe Li, Chao Zhang, Pin-Yu Chen, Engsiong Chng |
| 2024 | QCE | QTRL: Toward Practical Quantum Reinforcement Learning via Quantum-Train. | Chen-Yu Liu, Chu-Hsuan Abraham Lin, Chao-Han Huck Yang, Kuan-Cheng Chen, Min-Hsiu Hsieh |
| 2023 | ASRU | Generative Speech Recognition Error Correction With Large Language Models and Task-Activating Prompting. | Chao-Han Huck Yang, Yile Gu, Yi-Chieh Liu, Shalini Ghosh, Ivan Bulyko, Andreas Stolcke |
| 2023 | ASRU | Low-Rank Adaptation of Large Language Model Rescoring for Parameter-Efficient Speech Recognition. | Yu Yu, Chao-Han Huck Yang, Jari Kolehmainen, Prashanth Gurunath Shivakumar, Yile Gu, Sungho Ryu, Roger Ren, Qi Luo, Aditya Gourav, I-Fan Chen, Yi-Chieh Liu, Tuan Dinh, Ankur Gandhe, Denis Filimonov, Shalini Ghosh, Andreas Stolcke, Ariya Rastrow, Ivan Bulyko |
| 2023 | CVPR | Causalainer: Causal Explainer for Automatic Video Summarization. | Jia-Hong Huang, Chao-Han Huck Yang, Pin-Yu Chen, Min-Hung Chen, Marcel Worring |
| 2023 | EMNLP | Whispering LLaMA: A Cross-Modal Generative Error Correction Framework for Speech Recognition. | Srijith Radhakrishnan, Chao-Han Huck Yang, Sumeer Ahmad Khan, Rohit Kumar, Narsis A. Kiani, David Gomez-Cabrero, Jesper Tegnr |
| 2023 | ICASSP | Certified Robustness of Quantum Classifiers Against Adversarial Examples Through Quantum Noise. | Jhih-Cing Huang, Yu-Lin Tsai, Chao-Han Huck Yang, Cheng-Fang Su, Chia-Mu Yu, Pin-Yu Chen, Sy-Yen Kuo |
| 2023 | ICASSP | Low-Resource Music Genre Classification with Cross-Modal Neural Model Reprogramming. | Yun-Ning Hung, Chao-Han Huck Yang, Pin-Yu Chen, Alexander Lerch |
| 2023 | ICASSP | From English to More Languages: Parameter-Efficient Model Reprogramming for Cross-Lingual Speech Recognition. | Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Rohit Prabhavalkar, Tara N. Sainath, Trevor Strohman |
| 2023 | ICASSP | A Quantum Kernel Learning Approach to Acoustic Modeling for Spoken Command Recognition. | Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Tara N. Sainath, Sabato Marco Siniscalchi, Chin-Hui Lee |
| 2023 | Interspeech | A Neural State-Space Modeling Approach to Efficient Speech Separation. | Chen Chen, Chao-Han Huck Yang, Kai Li, Yuchen Hu, Pin-Jui Ku, Eng Siong Chng |
| 2023 | Interspeech | How to Estimate Model Transferability of Pre-Trained Speech Models? | Zih-Ching Chen, Chao-Han Huck Yang, Bo Li, Yu Zhang, Nanxin Chen, Shuo-Yiin Chang, Rohit Prabhavalkar, Hung-yi Lee, Tara N. Sainath |
| 2023 | Interspeech | Differentially Private Adapters for Parameter Efficient Acoustic Modeling. | Chun-Wei Ho, Chao-Han Huck Yang, Sabato Marco Siniscalchi |
| 2023 | Interspeech | A Multi-dimensional Deep Structured State Space Approach to Speech Enhancement Using Small-footprint Models. | Pin-Jui Ku, Chao-Han Huck Yang, Sabato Marco Siniscalchi, Chin-Hui Lee |
| 2023 | Interspeech | A Parameter-Efficient Learning Approach to Arabic Dialect Identification with Pre-Trained General-Purpose Speech Model. | Srijith Radhakrishnan, Chao-Han Huck Yang, Sumeer Ahmad Khan, Narsis A. Kiani, David Gomez-Cabrero, Jesper N. Tegnr |
| 2023 | Interspeech | Parameter-Efficient Learning for Text-to-Speech Accent Adaptation. | Li-Jen Yang, Chao-Han Huck Yang, Jen-Tzung Chien |
| 2023 | Interspeech | Neural Model Reprogramming with Similarity Based Mapping for Low-Resource Spoken Command Recognition. | Hao Yen, Pin-Jui Ku, Chao-Han Huck Yang, Hu Hu, Sabato Marco Siniscalchi, Pin-Yu Chen, Yu Tsao |
| 2023 | WACV | Treatment Learning Causal Transformer for Noisy Image Classification. | Chao-Han Huck Yang, I-Te Danny Hung, Yi-Chieh Liu, Pin-Yu Chen |
| 2023 | UAI | Pessimistic Model Selection for Offline Deep Reinforcement Learning. | Chao-Han Huck Yang, Zhengling Qi, Yifan Cui, Pin-Yu Chen |
| 2022 | AAAI | Training a Resilient Q-network against Observational Interference. | Chao-Han Huck Yang, I-Te Danny Hung, Yi Ouyang, Pin-Yu Chen |
| 2022 | ICASSP | A Variational Bayesian Approach to Learning Latent Variables for Acoustic Knowledge Transfer. | Hu Hu, Sabato Marco Siniscalchi, Chao-Han Huck Yang, Chin-Hui Lee |
| 2022 | ICASSP | Mitigating Closed-Model Adversarial Examples with Bayesian Neural Modeling for Enhanced End-to-End Speech Recognition. | Chao-Han Huck Yang, Zeeshan Ahmed, Yile Gu, Joseph Szurley, Roger Ren, Linda Liu, Andreas Stolcke, Ivan Bulyko |
| 2022 | ICASSP | When BERT Meets Quantum Temporal Convolution Learning for Text Classification in Heterogeneous Computing. | Chao-Han Huck Yang, Jun Qi, Samuel Yen-Chi Chen, Yu Tsao, Pin-Yu Chen |
| 2022 | ICASSP | A Study of Designing Compact Audio-Visual Wake Word Spotting System Based on Iterative Fine-Tuning in Neural Network Pruning. | Hengshun Zhou, Jun Du, Chao-Han Huck Yang, Shifu Xiong, Chin-Hui Lee |
| 2022 | WACV | Non-local Attention Improves Description Generation for Retinal Images. | Jia-Hong Huang, Ting-Wei Wu, Chao-Han Huck Yang, Zenglin Shi, I-Hung Lin, Jesper Tegnr, Marcel Worring |
| 2021 | ASRU | Multi-Task Language Modeling for Improving Speech Recognition of Rare Words. | Chao-Han Huck Yang, Linda Liu, Ankur Gandhe, Yile Gu, Anirudh Raju, Denis Filimonov, Ivan Bulyko |
| 2021 | ICASSP | A Two-Stage Approach to Device-Robust Acoustic Scene Classification. | Hu Hu, Chao-Han Huck Yang, Xianjun Xia, Xue Bai, Xin Tang, Yajian Wang, Shutong Niu, Li Chai, Juanjuan Li, Hongning Zhu, Feng Bao, Yuanjun Zhao, Sabato Marco Siniscalchi, Yannan Wang, Jun Du, Chin-Hui Lee |
| 2021 | ICASSP | Decentralizing Feature Extraction with Quantum Convolutional Neural Network for Automatic Speech Recognition. | Chao-Han Huck Yang, Jun Qi, Samuel Yen-Chi Chen, Pin-Yu Chen, Sabato Marco Siniscalchi, Xiaoli Ma, Chin-Hui Lee |
| 2021 | ICIP | Deep Context-Encoding Network For Retinal Image Captioning. | Jia-Hong Huang, Ting-Wei Wu, Chao-Han Huck Yang, Marcel Worring |
| 2021 | ICIP | Robust Unsupervised Multi-Object Tracking In Noisy Environments. | Chao-Han Huck Yang, Mohit Chhabra, Yi-Chieh Liu, Quan Kong, Tomoaki Yoshinaga, Tomokazu Murakami |
| 2021 | ICML | Voice2Series: Reprogramming Acoustic Models for Time Series Classification. | Chao-Han Huck Yang, Yun-Yun Tsai, Pin-Yu Chen |
| 2021 | Interspeech | PATE-AAE: Incorporating Adversarial Autoencoder into Private Aggregation of Teacher Ensembles for Spoken Command Classification. | Chao-Han Huck Yang, Sabato Marco Siniscalchi, Chin-Hui Lee |
| 2021 | WACV | DeepOpht: Medical Report Generation for Retinal Images via Deep Models and Visual Explanation. | Jia-Hong Huang, Chao-Han Huck Yang, Fangyu Liu, Meng Tian, Yi-Chieh Liu, Ting-Wei Wu, I-Hung Lin, Kang Wang, Hiromasa Morikawa, Hernghua Chang, Jesper Tegnr, Marcel Worring |
| 2020 | CEC | Evolving Neural Networks through a Reverse Encoding Tree. | Haoling Zhang, Chao-Han Huck Yang, Hector Zenil, Narsis Aftab Kiani, Yue Shen, Jesper N. Tegnr |
| 2020 | CISS | Convolutional Neural Network Based Radio Tomographic Imaging. | Hongzhuang Wu, Xiaoli Ma, Chao-Han Huck Yang, Songyong Liu |
| 2020 | ICASSP | Interpretable Self-Attention Temporal Reasoning for Driving Behavior Understanding. | Yi-Chieh Liu, Yung-An Hsieh, Min-Hung Chen, Chao-Han Huck Yang, Jesper Tegnr, Yi-Chang James Tsai |
| 2020 | ICASSP | Tensor-To-Vector Regression for Multi-Channel Speech Enhancement Based on Tensor-Train Network. | Jun Qi, Hu Hu, Yannan Wang, Chao-Han Huck Yang, Sabato Marco Siniscalchi, Chin-Hui Lee |
| 2020 | ICASSP | Submodular Rank Aggregation on Score-Based Permutations for Distributed Automatic Speech Recognition. | Jun Qi, Chao-Han Huck Yang, Javier Tejedor |
| 2020 | ICASSP | Characterizing Speech Adversarial Examples Using Self-Attention U-Net Enhancement. | Chao-Han Huck Yang, Jun Qi, Pin-Yu Chen, Xiaoli Ma, Chin-Hui Lee |
| 2020 | ICASSP | Enhanced Adversarial Strategically-Timed Attacks Against Deep Reinforcement Learning. | Chao-Han Huck Yang, Jun Qi, Pin-Yu Chen, Yi Ouyang, I-Te Danny Hung, Chin-Hui Lee, Xiaoli Ma |
| 2020 | ICASSP | Y-Net: Multi-Scale Feature Aggregation Network With Wavelet Structure Similarity Loss Function For Single Image Dehazing. | Hao-Hsiang Yang, Chao-Han Huck Yang, Yi-Chang James Tsai |
| 2020 | ICIP | Wavelet Channel Attention Module With A Fusion Network For Single Image Deraining. | Hao-Hsiang Yang, Chao-Han Huck Yang, Yu-Chiang Frank Wang |
| 2020 | Interspeech | Exploring Deep Hybrid Tensor-to-Vector Network Architectures for Regression Based Speech Enhancement. | Jun Qi, Hu Hu, Yannan Wang, Chao-Han Huck Yang, Sabato Marco Siniscalchi, Chin-Hui Lee |
| 2019 | ICIP | When Causal Intervention Meets Adversarial Examples and Image Masking for Deep Neural Networks. | Chao-Han Huck Yang, Yi-Chieh Liu, Pin-Yu Chen, Xiaoli Ma, Yi-Chang James Tsai |
| 2018 | ACCV | Synthesizing New Retinal Symptom Images by Multiple Generative Models. | Yi-Chieh Liu, Hao-Hsiang Yang, Chao-Han Huck Yang, Jia-Hong Huang, Meng Tian, Hiromasa Morikawa, Yi-Chang James Tsai, Jesper Tegnr |
| 2018 | ACCV | Auto-classification of Retinal Diseases in the Limit of Sparse Data Using a Two-Streams Machine Learning Model. | Chao-Han Huck Yang, Fangyu Liu, Jia-Hong Huang, Meng Tian, I-Hung Lin, Yi-Chieh Liu, Hiromasa Morikawa, Hao-Hsiang Yang, Jesper Tegnr |