| 2026 | WACV | Mitigating Object and Action Hallucinations in Multimodal LLMs via Self-Augmented Contrastive Alignment. | Kai-Po Chang, Wei-Yuan Cheng, Chi-Pin Huang, Fu-En Yang, Yu-Chiang Frank Wang |
| 2026 | WACV | TA-Prompting: Enhancing Video Large Language Models for Dense Video Captioning via Temporal Anchors. | Wei-Yuan Cheng, Kai-Po Chang, Chi-Pin Huang, Fu-En Yang, Yu-Chiang Frank Wang |
| 2025 | ACL | Serial Lifelong Editing via Mixture of Knowledge Experts. | YuJu Cheng, Yu-Chu Yu, Kai-Po Chang, Yu-Chiang Frank Wang |
| 2025 | CVPR | VideoMage: Multi-Subject and Motion Customization of Text-to-Video Diffusion Models. | Chi-Pin Huang, Yen-Siang Wu, Hung-Kai Chung, Kai-Po Chang, Fu-En Yang, Yu-Chiang Frank Wang |
| 2024 | ECCV | Receler: Reliable Concept Erasing of Text-to-Image Diffusion Models via Lightweight Erasers. | Chi-Pin Huang, Kai-Po Chang, Chung-Ting Tsai, Yung-Hsuan Lai, Fu-En Yang, Yu-Chiang Frank Wang |
| 2024 | ECCV | Select and Distill: Selective Dual-Teacher Knowledge Transfer for Continual Learning on Vision-Language Models. | Yu-Chu Yu, Chi-Pin Huang, Jr-Jen Chen, Kai-Po Chang, Yung-Hsuan Lai, Fu-En Yang, Yu-Chiang Frank Wang |
| 2024 | ICLR | RAPPER: Reinforced Rationale-Prompted Paradigm for Natural Language Explanation in Visual Question Answering. | Kai-Po Chang, Chi-Pin Huang, Wei-Yuan Cheng, Fu-En Yang, Chien-Yi Wang, Yung-Hsuan Lai, Yu-Chiang Frank Wang |