| 2025 | AAAI | Personalized Lip Reading: Adapting to Your Unique Lip Movements with Vision and Language. | Jeong Hun Yeo, Chae Won Kim, Hyunjun Kim, Hyeongseop Rha, Seunghee Han, Wen-Huang Cheng, Yong Man Ro |
| 2025 | ICCV | Zero-AVSR: Zero-Shot Audio-Visual Speech Recognition with LLMs by Learning Language-Agnostic Speech Representations. | Jeong Hun Yeo, Minsu Kim, Chae Won Kim, Stavros Petridis, Yong Man Ro |
| 2024 | ACL | CoLLaVO: Crayon Large Language and Vision mOdel. | Byung-Kwan Lee, Beomchan Park, Chae Won Kim, Yong Man Ro |
| 2024 | ACL | Let's Go Real Talk: Spoken Dialogue Model for Face-to-Face Conversation. | Se Jin Park, Chae Won Kim, Hyeongseop Rha, Minsu Kim, Joanna Hong, Jeong Hun Yeo, Yong Man Ro |
| 2024 | ECCV | MoAI: Mixture of All Intelligence for Large Language and Vision Models. | Byung-Kwan Lee, Beomchan Park, Chae Won Kim, Yong Man Ro |
| 2024 | EMNLP | TroL: Traversal of Layers for Large Language and Vision Models. | Byung-Kwan Lee, Sangyun Chung, Chae Won Kim, Beomchan Park, Yong Man Ro |
| 2024 | ICASSP | Persona Extraction Through Semantic Similarity for Emotional Support Conversation Generation. | Seunghee Han, Se Jin Park, Chae Won Kim, Yong Man Ro |
| 2023 | AAAI | Deep Visual Forced Alignment: Learning to Align Transcription with Talking Face Video. | Minsu Kim, Chae Won Kim, Yong Man Ro |
| 2018 | Tencon | Design of a Smart Image Sensor with a Current Steering CMOS DAC for High Performance Autofocusing Micro-lens Driver. | Minhyun Jin, Chae Won Kim, Soo Youn Kim, Minkyu Song |