| 2025 | ASRU | Towards Generalized Source Tracing for Codec-Based Deepfake Speech. | I-Ming Lin, Xuanjun Chen, Lin Zhang, Haibin Wu, Hung-yi Lee, Jyh-Shing Roger Jang |
| 2025 | AVSS | Enhancing LLM Question Answering with RAG through Dense Vector Search and Re-Ranking. | Te-Lun Yang, Jyi-Shane Liu, Yuen-Hsien Tseng, Jyh-Shing Roger Jang, Ming-Ching Chang, Wei-Chao Chen |
| 2025 | COLING | Concept-Based RAG Models: A High-Accuracy Fact Retrieval Approach. | Cheng-Yu Lin, Jyh-Shing Roger Jang |
| 2025 | ICASSP | Similarity-based Accent Recognition with Continuous and Discrete Self-supervised Speech Representations. | Jun-You Wang, Sheng Li, Li-An Lu, Sydney Chia-Chun Kao, Jyh-Shing Roger Jang |
| 2025 | Interspeech | Codec-Based Deepfake Source Tracing via Neural Audio Codec Taxonomy. | Xuanjun Chen, I-Ming Lin, Lin Zhang, Jiawei Du, Haibin Wu, Hung-yi Lee, Jyh-Shing Roger Jang |
| 2024 | ACCV | Enhancing 3D Human Pose Estimation with Bone Length Adjustment. | Chih-Hsiang Hsu, Jyh-Shing Roger Jang |
| 2024 | ICASSP | Multimodal Transformer Distillation for Audio-Visual Synchronization. | Xuanjun Chen, Haibin Wu, Chung-Che Wang, Hung-Yi Lee, Jyh-Shing Roger Jang |
| 2024 | ICASSP | MIR-MLPop: A Multilingual Pop Music Dataset with Time-Aligned Lyrics and Audio. | Jun-You Wang, Chung-Che Wang, Chon-In Leong, Jyh-Shing Roger Jang |
| 2024 | Interspeech | Neural Codec-based Adversarial Sample Detection for Speaker Verification. | Xuanjun Chen, Jiawei Du, Haibin Wu, Jyh-Shing Roger Jang, Hung-yi Lee |
| 2024 | Interspeech | Leveraging Phonemic Transcription and Whisper toward Clinically Significant Indices for Automatic Child Speech Assessment. | Yeh-Sheng Lin, Shu-Chuan Tseng, Jyh-Shing Roger Jang |
| 2023 | ASRU | Zero-Shot Singing Voice Synthesis from Musical Score. | Jun-You Wang, Hung-Yi Lee, Jyh-Shing Roger Jang, Li Su |
| 2023 | ASRU | Adapting Pretrained Speech Model for Mandarin Lyrics Transcription and Alignment. | Jun-You Wang, Chon-In Leong, Yu-Chen Lin, Li Su, Jyh-Shing Roger Jang |
| 2023 | Interspeech | Noise-Robust Bandwidth Expansion for 8K Speech Recordings. | Yin-Tse Lin, Bo-Hao Su, Chi-Han Lin, Shih-Chan Kuo, Jyh-Shing Roger Jang, Chi-Chun Lee |
| 2022 | ICASSP | Towards Automatic Transcription of Polyphonic Electric Guitar Music: A New Dataset and a Multi-Loss Transformer Model. | Yu-Hua Chen, Wen-Yi Hsiao, Tsu-Kuang Hsieh, Jyh-Shing Roger Jang, Yi-Hsuan Yang |
| 2021 | ASRU | Mandarin Electrolaryngeal Speech Voice Conversion with Sequence-to-Sequence Modeling. | Ming-Chi Yen, Wen-Chin Huang, Kazuhiro Kobayashi, Yu-Huai Peng, Shu-Wei Tsai, Yu Tsao, Tomoki Toda, Jyh-Shing Roger Jang, Hsin-Min Wang |
| 2021 | ICASSP | On the Preparation and Validation of a Large-Scale Dataset of Singing Transcription. | Jun-You Wang, Jyh-Shing Roger Jang |
| 2019 | AVSS | Improving ResNet-based Feature Extractor for Face Recognition via Re-ranking and Approximate Nearest Neighbor. | Sheng-Hsing Hsiao, Jyh-Shing Roger Jang |
| 2019 | AVSS | K-Same-Siamese-GAN: K-Same Algorithm with Generative Adversarial Network for Facial Image De-identification with Hyperparameter Tuning and Mixed Precision Training. | Yi-Lun Pan, Min-Jhih Haung, Kuo-Teng Ding, Ja-Ling Wu, Jyh-Shing Roger Jang |
| 2019 | ICASSP | Learning to Match Transient Sound Events Using Attentional Similarity for Few-shot Sound Recognition. | Szu-Yu Chou, Kai-Hsiang Cheng, Jyh-Shing Roger Jang, Yi-Hsuan Yang |
| 2019 | IJCNN | Deep Cyclic Group Networks. | Zhe-Cheng Fan, Tak-Shing Chan, Yi-Hsuan Yang, Jyh-Shing Roger Jang |
| 2018 | ICASSP | SVSGAN: Singing Voice Separation Via Generative Adversarial Network. | Zhe-Cheng Fan, Yen-Lin Lai, Jyh-Shing Roger Jang |
| 2018 | IJCAI | Learning to Recognize Transient Sound Events using Attentional Supervision. | Szu-Yu Chou, Jyh-Shing Roger Jang, Yi-Hsuan Yang |
| 2016 | ICASSP | An efficient method for polyphonic audio-to-score alignment using onset detection and constant Q transform. | Chun-Ta Chen, Jyh-Shing Roger Jang, Wen-Shan Liu, Chi-Yao Weng |
| 2016 | RecSys | Addressing Cold Start for Next-song Recommendation. | Szu-Yu Chou, Yi-Hsuan Yang, Jyh-Shing Roger Jang, Yu-Ching Lin |
| 2015 | ICASSP | Vocal activity informed singing voice separation with the iKala dataset. | Tak-Shing Chan, Tzu-Chun Yeh, Zhe-Cheng Fan, Hung-Wei Chen, Li Su, Yi-Hsuan Yang, Jyh-Shing Roger Jang |
| 2014 | ICASSP | Improved score-performance alignment algorithms on polyphonic music. | Chun-Ta Chen, Jyh-Shing Roger Jang, Wenshan Liou |
| 2014 | ISM | Bridging Music via Sound Effects. | Yin-Tzu Lin, Chuan-Lung Lee, Jyh-Shing Roger Jang, Ja-Ling Wu |
| 2014 | LREC | Phone Boundary Annotation in Conversational Speech. | Yi-Fen Liu, Shu-Chuan Tseng, Jyh-Shing Roger Jang |
| 2012 | ACL | Learning to Find Translations and Transliterations on the Web. | Joseph Z. Chang, Jason S. Chang, Jyh-Shing Roger Jang |
| 2012 | ICASSP | Accelerating query by singing/humming on GPU: Optimization for web deployment. | Chung-Che Wang, Chieh-Hsing Chen, Chin-Yang Kuo, Li-Ting Chiu, Jyh-Shing Roger Jang |
| 2012 | ICASSP | A hybrid approach to singing pitch extraction based on trend estimation and hidden Markov models. | Tzu-Chun Yeh, Ming-Ju Wu, Jyh-Shing Roger Jang, Wei-Lun Chang, I-Bin Liao |
| 2012 | Interspeech | Improvement in Automatic Pronunciation Scoring using Additional Basic Scores and Learning to Rank. | Liang-Yu Chen, Jyh-Shing Roger Jang |
| 2011 | ICASSP | A trend estimation algorithm for singing pitch detection in musical recordings. | Chao-Ling Hsu, DeLiang Wang, Jyh-Shing Roger Jang |
| 2011 | ICASSP | Time-constrained sequential pattern discovery for music genre classification. | Jia-Min Ren, Jyh-Shing Roger Jang |
| 2011 | ICMLA | Combining Visual and Acoustic Features for Music Genre Classification. | Ming-Ju Wu, Zhi-Sheng Chen, Jyh-Shing Roger Jang, Jia-Min Ren, Yi-Hsung Li, Chun-Hung Lu |
| 2010 | ICASSP | On the use of sequential patterns mining as temporal features for music genre classification. | Jia-Min Ren, Zhi-Sheng Chen, Jyh-Shing Roger Jang |
| 2010 | ICALT | Using Tangible Learning Companions in English Education. | Yi Hsuan Wang, Shelley Shwu-Ching Young, Jyh-Shing Roger Jang |
| 2010 | Interspeech | Automatic pronunciation scoring using learning to rank and DP-based score segmentation. | Liang-Yu Chen, Jyh-Shing Roger Jang |
| 2010 | Interspeech | Coping imbalanced prosodic unit boundary detection with linguistically-motivated prosodic features. | Yi-Fen Liu, Shu-Chuan Tseng, Jyh-Shing Roger Jang, C.-H. Alvin Chen |
| 2009 | ICALT | Evaluation of Tangible Learning Companion/Robot for English Language Learning. | Yi Hsuan Wang, Shelley Shwu-Ching Young, Jyh-Shing Roger Jang |
| 2008 | Interspeech | Minimum phone error discriminative training for Mandarin Chinese speaker adaptation. | Liang-Yu Chen, Chun-Jen Lee, Jyh-Shing Roger Jang |
| 2007 | Interspeech | An effective initial/final duration prediction method for corpus-based singing voice synthesis of Mandarin Chinese. | Cheng-Yuan Lin, Pei-Chi Jao, Jyh-Shing Roger Jang |
| 2006 | Interspeech | Formant-based English vowel assessment for Chinese in Taiwan. | Jiang-Chun Chen, Wei-Tang Hsu, Jyh-Shing Roger Jang, Ren-Yuan Lyu, Yuang-Chin Chiang |
| 2006 | Interspeech | Automatic phonetic segmentation by using a SPM-based approach for a Mandarin singing voice corpus. | Cheng-Yuan Lin, Jyh-Shing Roger Jang |
| 2005 | Interspeech | A hybrid approach to automatic segmentation and labeling for Mandarin Chinese speech corpus. | Cheng-Yuan Lin, Kuan-Ting Chen, Jyh-Shing Roger Jang |
| 2004 | Interspeech | A two-phase pitch marking method for TD-PSOLA synthesis. | Cheng-Yuan Lin, Jyh-Shing Roger Jang |
| 2003 | PACLIC | A Statistical Approach to Chinese-to-English Back-Transliteration. | Chun-Jen Lee, Jason S. Chang, Jyh-Shing Roger Jang |
| 1991 | AAAI | Fuzzy Modeling Using Generalized Neural Networks and Kalman Filter Algorithm. | Jyh-Shing Roger Jang |
| 1990 | UAI | A hierarchical approach to designing approximate reasoning-based controllers for dynamic physical systems. | Hamid R. Berenji, Yung-Yaw Chen, Chuen-Chien Lee, Jyh-Shing Roger Jang, S. Murugesan |