| 2025 | ACL | MMS-LLaMA: Efficient LLM-based Audio-Visual Speech Recognition with Minimal Multimodal Speech Tokens. | Jeong Hun Yeo, Hyeongseop Rha, Se Jin Park, Yong Man Ro |
| 2025 | ICML | Long-Form Speech Generation with Spoken Language Models. | Se Jin Park, Julian Salazar, Aren Jansen, Keisuke Kinoshita, Yong Man Ro, R. J. Skerry-Ryan |
| 2024 | ACL | Let's Go Real Talk: Spoken Dialogue Model for Face-to-Face Conversation. | Se Jin Park, Chae Won Kim, Hyeongseop Rha, Minsu Kim, Joanna Hong, Jeong Hun Yeo, Yong Man Ro |
| 2024 | CVPR | AV2AV: Direct Audio-Visual Speech to Audio-Visual Speech Translation with Unified Audio-Visual Speech Representation. | Jeongsoo Choi, Se Jin Park, Minsu Kim, Yong Man Ro |
| 2024 | ICASSP | Text-Driven Talking Face Synthesis by Reprogramming Audio-Driven Models. | Jeongsoo Choi, Minsu Kim, Se Jin Park, Yong Man Ro |
| 2024 | ICASSP | Persona Extraction Through Semantic Similarity for Emotional Support Conversation Generation. | Seunghee Han, Se Jin Park, Chae Won Kim, Yong Man Ro |
| 2024 | ICASSP | Exploring Phonetic Context-Aware Lip-Sync for Talking Face Generation. | Se Jin Park, Minsu Kim, Jeongsoo Choi, Yong Man Ro |
| 2023 | EMNLP | Intuitive Multilingual Audio-Visual Speech Recognition with a Single-Trained Model. | Joanna Hong, Se Jin Park, Yong Man Ro |
| 2022 | AAAI | SyncTalkFace: Talking Face Generation with Precise Lip-Syncing via Audio-Lip Memory. | Se Jin Park, Minsu Kim, Joanna Hong, Jeongsoo Choi, Yong Man Ro |
| 2021 | ICCV | Multi-modality Associative Bridging through Memory: Speech Sound Recollected from Face Video. | Minsu Kim, Joanna Hong, Se Jin Park, Yong Man Ro |
| 2020 | HCI | Development of Mobile Application Program for Stroke Prediction Using Machine Learning with Voice Onset Time Data. | Murali Subramaniyam, Kyung-Sun Lee, Se Jin Park, Seung Nam Min |
| 2018 | HCI | Knowledge Based Health Monitoring During Driving. | Se Jin Park, Seunghee Hong, Damee Kim, Young Seo, Iqram Hussain |
| 2017 | HCI | Framework of Health Monitoring Service for the Elderly Drivers Community. | Se Jin Park, Murali Subramaniyam, Seunghee Hong, Damee Kim |
| 2014 | HCI | 3D Hand Anthropometry of Korean Teenager's and Comparison with Manual Method. | Se Jin Park, Seung Nam Min, Heeran Lee, Murali Subramaniyam, Sang Jae Ahn |
| 2013 | HCI | Physiological Responses to Watching 3D on Television with Active and Passive Glasses. | Se Jin Park, Murali Subramaniyam, Myung Kug Moon, Dong Gyun Kim |