| 2025 | ICCV | OpenM3D: Open Vocabulary Multi-View Indoor 3D Object Detection without Human Annotations. | Peng-Hao Hsu, Ke Zhang, Fu-En Wang, Tao Tu, Ming-Feng Li, Yu-Lun Liu, Albert Y. C. Chen, Min Sun, Cheng-Hao Kuo |
| 2025 | WACV | DreaMo: Articulated 3D Reconstruction from a Single Casual Video. | Tao Tu, Ming-Feng Li, Chieh Hubert Lin, Yen-Chi Cheng, Min Sun, Ming-Hsuan Yang |
| 2025 | WACV | V-MIND: Building Versatile Monocular Indoor 3D Detector with Diverse 2D Annotations. | Jin-Cheng Jhang, Tao Tu, Fu-En Wang, Ke Zhang, Min Sun, Cheng-Hao Kuo |
| 2023 | ICCV | ImGeoNet: Image-induced Geometry-aware Voxel Representation for Multi-view 3D Object Detection. | Tao Tu, Shun-Po Chuang, Yu-Lun Liu, Cheng Sun, Ke Zhang, Donna Roy, Cheng-Hao Kuo, Min Sun |
| 2023 | ICCV | Disentangle then Parse: Night-time Semantic Segmentation with Illumination Disentanglement. | Zhixiang Wei, Lin Chen, Tao Tu, Pengyang Ling, Huaian Chen, Yi Jin |
| 2021 | CVPR | Learning Better Visual Dialog Agents With Pretrained Visual-Linguistic Representation. | Tao Tu, Qing Ping, Govindarajan Thattai, Gkhan Tr, Prem Natarajan |
| 2020 | ICASSP | Towards Unsupervised Speech Recognition and Synthesis with Quantized Speech Representation Learning. | Alexander H. Liu, Tao Tu, Hung-yi Lee, Lin-Shan Lee |
| 2020 | Interspeech | Semi-Supervised Learning for Multi-Speaker Text-to-Speech Synthesis Using Discrete Speech Representation. | Tao Tu, Yuan-Jui Chen, Alexander H. Liu, Hung-yi Lee |
| 2019 | Interspeech | End-to-End Text-to-Speech for Low-Resource Languages by Cross-Lingual Transfer Learning. | Yuan-Jui Chen, Tao Tu, Cheng-chieh Yeh, Hung-yi Lee |
| 2018 | CVPR | Relating Deep Neural Network Representations to EEG-fMRI Spatiotemporal Dynamics in a Perceptual Decision-Making Task. | Tao Tu, Jonathan Koss, Paul Sajda |