| 2024 | ACL | Let's Go Real Talk: Spoken Dialogue Model for Face-to-Face Conversation. | Se Jin Park, Chae Won Kim, Hyeongseop Rha, Minsu Kim, Joanna Hong, Jeong Hun Yeo, Yong Man Ro |
| 2023 | CVPR | Watch or Listen: Robust Audio-Visual Speech Recognition with Visual Corruption Modeling and Reliability Scoring. | Joanna Hong, Minsu Kim, Jeongsoo Choi, Yong Man Ro |
| 2023 | EMNLP | Intuitive Multilingual Audio-Visual Speech Recognition with a Single-Trained Model. | Joanna Hong, Se Jin Park, Yong Man Ro |
| 2023 | ICASSP | Lip-to-Speech Synthesis in the Wild with Multi-Task Learning. | Minsu Kim, Joanna Hong, Yong Man Ro |
| 2023 | ICCV | DiffV2S: Diffusion-based Video-to-Speech Synthesis with Vision-guided Speaker Embedding. | Jeongsoo Choi, Joanna Hong, Yong Man Ro |
| 2022 | AAAI | SyncTalkFace: Talking Face Generation with Precise Lip-Syncing via Audio-Lip Memory. | Se Jin Park, Minsu Kim, Joanna Hong, Jeongsoo Choi, Yong Man Ro |
| 2022 | ECCV | VisageSynTalk: Unseen Speaker Video-to-Speech Synthesis via Speech-Visage Feature Selection. | Joanna Hong, Minsu Kim, Yong Man Ro |
| 2022 | Interspeech | Visual Context-driven Audio Feature Enhancement for Robust End-to-End Audio-Visual Speech Recognition. | Joanna Hong, Minsu Kim, Daehun Yoo, Yong Man Ro |
| 2021 | ICCV | Multi-modality Associative Bridging through Memory: Speech Sound Recollected from Face Video. | Minsu Kim, Joanna Hong, Se Jin Park, Yong Man Ro |
| 2020 | ICIP | Comprehensive Facial Expression Synthesis Using Human-Interpretable Language. | Joanna Hong, Jung Uk Kim, Sangmin Lee, Yong Man Ro |
| 2020 | ICIP | Learning Style Correlation for Elaborate Few-Shot Classification. | Junho Kim, Minsu Kim, Jung Uk Kim, Hong Joo Lee, Sangmin Lee, Joanna Hong, Yong Man Ro |
| 2020 | ICPR | Unsupervised Disentangling of Viewpoint and Residues Variations by Substituting Representations for Robust Face Recognition. | Minsu Kim, Joanna Hong, Junho Kim, Hong Joo Lee, Yong Man Ro |
| 2020 | MMM | Face Tells Detailed Expression: Generating Comprehensive Facial Expression Sentence Through Facial Action Units. | Joanna Hong, Hong Joo Lee, Yelin Kim, Yong Man Ro |