| 2026 | ACL | SMILE-Next: Teaching Large Language Models to Detect, Classify, and Reason about Laughter. | JungMok Lee, Sung-Bin Kim, Joohyun Chang, Lee Hyun, Tae-Hyun Oh |
| 2025 | AAAI | SoundBrush: Sound as a Brush for Visual Scene Editing. | Sung-Bin Kim, Kim Jun-Seong, Junseok Ko, Yewon Kim, Tae-Hyun Oh |
| 2025 | CVPR | Perceptually Accurate 3D Talking Head Generation: New Definitions, Speech-Mesh Representation, and Evaluation Metrics. | Lee Chae-Yeon, Oh Hyun-Bin, Han EunGi, Sung-Bin Kim, Suekyeong Nam, Tae-Hyun Oh |
| 2025 | ICCV | VoiceCraft-Dub: Automated Video Dubbing with Neural Codec Language Models. | Sung-Bin Kim, Jeongsoo Choi, Puyuan Peng, Joon Son Chung, Tae-Hyun Oh, David Harwath |
| 2025 | ICLR | AVHBench: A Cross-Modal Hallucination Benchmark for Audio-Visual Large Language Models. | Sung-Bin Kim, Oh Hyun-Bin, JungMok Lee, Arda Senocak, Joon Son Chung, Tae-Hyun Oh |
| 2024 | Interspeech | Enhancing Speech-Driven 3D Facial Animation with Audio-Visual Guidance from Lip Reading Expert. | Han EunGi, Oh Hyun-Bin, Sung-Bin Kim, Corentin Nivelet Etcheberry, Suekyeong Nam, Janghoon Ju, Tae-Hyun Oh |
| 2024 | Interspeech | MultiTalk: Enhancing 3D Talking Head Generation Across Languages with Multilingual Video Dataset. | Sung-Bin Kim, Lee Chae-Yeon, Gihun Son, Oh Hyun-Bin, Janghoon Ju, Suekyeong Nam, Tae-Hyun Oh |
| 2024 | NAACL | SMILE: Multimodal Dataset for Understanding Laughter in Video with Language Models. | Lee Hyun, Sung-Bin Kim, Seungju Han, Youngjae Yu, Tae-Hyun Oh |
| 2024 | WACV | LaughTalk: Expressive 3D Talking Head Generation with Laughter. | Sung-Bin Kim, Lee Hyun, Da Hye Hong, Suekyeong Nam, Janghoon Ju, Tae-Hyun Oh |
| 2023 | CVPR | Sound to Visual Scene Generation by Audio-to-Visual Latent Alignment. | Sung-Bin Kim, Arda Senocak, Hyunwoo Ha, Andrew Owens, Tae-Hyun Oh |
| 2023 | ICASSP | Prefix Tuning for Automated Audio Captioning. | Minkyu Kim, Sung-Bin Kim, Tae-Hyun Oh |