| 2025 | CVPR | Beyond Raw Videos: Understanding Edited Videos with Large Multimodal Model. | Lu Xu, Sijie Zhu, Chunyuan Li, Chia-Wen Kuo, Fan Chen, Xinyao Wang, Guang Chen, Dawei Du, Ye Yuan, Longyin Wen |
| 2025 | ICCV | $\mathcal{D}$-Attn: Decomposed Attention for Large Vision-and-Language Models. | Chia-Wen Kuo, Sijie Zhu, Fan Chen, Xiaohui Shen, Longyin Wen |
| 2023 | CVPR | HAAV: Hierarchical Aggregation of Augmented Views for Image Captioning. | Chia-Wen Kuo, Zsolt Kira |
| 2023 | WACV | Structure-Encoding Auxiliary Tasks for Improved Visual Representation in Vision-and-Language Navigation. | Chia-Wen Kuo, Chih-Yao Ma, Judy Hoffman, Zsolt Kira |
| 2022 | CVPR | Beyond a Pre-Trained Object Detector: Cross-Modal Textual and Visual Context for Image Captioning. | Chia-Wen Kuo, Zsolt Kira |
| 2021 | ICLR | Unbiased Teacher for Semi-Supervised Object Detection. | Yen-Cheng Liu, Chih-Yao Ma, Zijian He, Chia-Wen Kuo, Kan Chen, Peizhao Zhang, Bichen Wu, Zsolt Kira, Peter Vajda |
| 2020 | ECCV | FeatMatch: Feature-Based Augmentation for Semi-supervised Learning. | Chia-Wen Kuo, Chih-Yao Ma, Jia-Bin Huang, Zsolt Kira |
| 2020 | ICRA | Who2com: Collaborative Perception via Learnable Handshake Communication. | Yen-Cheng Liu, Junjiao Tian, Chih-Yao Ma, Nathan Glaser, Chia-Wen Kuo, Zsolt Kira |
| 2019 | ICASSP | Learning Pose-aware 3D Reconstruction via 2D-3D Self-consistency. | Yi-Lun Liao, Yao-Cheng Yang, Yuan-Fang Lin, Pin-Jung Chen, Chia-Wen Kuo, Wei-Chen Chiu, Yu-Chiang Frank Wang |
| 2019 | WACV | Data-Efficient Graph Embedding Learning for PCB Component Detection. | Chia-Wen Kuo, Jacob Ashmore, David Huggins, Zsolt Kira |
| 2015 | ICRA | Model-based 3D object recognition and fetching by a 7-DoF robot with online obstacle avoidance for factory automation. | Ren C. Luo, Chia-Wen Kuo, Yi-Ting Chung |
| 2015 | INDIN | A scalable modular architecture of 3D object acquisition for manufacturing automation. | Ren C. Luo, Chia-Wen Kuo |