| 2026 | AAAI | Affordance-Guided Coarse-to-Fine Exploration for Base Placement in Open-Vocabulary Mobile Manipulation. | Tzu-Jung Lin, Jia-Fong Yeh, Hung-Ting Su, Chung-Yi Lin, Yi-Ting Chen, Winston H. Hsu |
| 2026 | ACL | ADAPT: Benchmarking Commonsense Planning under Unspecified Affordance Constraints. | Pei-An Chen, Yong-Ching Liang, Jia-Fong Yeh, Hung-Ting Su, Yi-Ting Chen, Min Sun, Winston H. Hsu |
| 2026 | ACL | VLN-NF: Feasibility-Aware Vision-and-Language Navigation with False-Premise Instructions. | Hung-Ting Su, Ting-Jun Wang, Jia-Fong Yeh, Min Sun, Winston H. Hsu |
| 2025 | EMNLP | MovieCORE: COgnitive REasoning in Movies. | Gueter Josmy Faure, Min-Hung Chen, Jia-Fong Yeh, Ying Cheng, Hung-Ting Su, Yung-Hao Tang, Shang-Hong Lai, Winston H. Hsu |
| 2025 | ICCV | HERMES: Temporal-Coherent Long-form Understanding with Episodes and Semantics. | Gueter Josmy Faure, Jia-Fong Yeh, Min-Hung Chen, Hung-Ting Su, Shang-Hong Lai, Winston H. Hsu |
| 2025 | ICLR | VICtoR: Learning Hierarchical Vision-Instruction Correlation Rewards for Long-horizon Manipulation. | Kuo-Han Hung, Pang-Chi Lo, Jia-Fong Yeh, Han-Yuan Hsu, Yi-Ting Chen, Winston H. Hsu |
| 2025 | ICRA | Improving Generalization Ability for 3D Object Detection by Learning Sparsity-Invariant Features. | Hsin-Cheng Lu, Chung-Yi Lin, Winston H. Hsu |
| 2025 | NAACL | Attention Tracker: Detecting Prompt Injection Attacks in LLMs. | Kuo-Han Hung, Ching-Yun Ko, Ambrish Rawat, I-Hsin Chung, Winston H. Hsu, Pin-Yu Chen |
| 2024 | AAAI | TelTrans: Applying Multi-Type Telecom Data to Transportation Evaluation and Prediction via Multifaceted Graph Modeling. | ChungYi Lin, Shen-Lung Tung, Hung-Ting Su, Winston H. Hsu |
| 2024 | CoRL | Distribution Discrepancy and Feature Heterogeneity for Active 3D Object Detection. | Huang-Yu Chen, Jia-Fong Yeh, Jiawe Jiawei, Pin-Hsuan Peng, Winston H. Hsu |
| 2024 | CoRL | Context-Aware Replanning with Pre-Explored Semantic Map for Object Navigation. | Po-Chen Ko, Hung-Ting Su, CY Chen, Jia-Fong Yeh, Min Sun, Winston H. Hsu |
| 2024 | CVPR | Unsupervised Image Prior via Prompt Learning and CLIP Semantic Guidance for Low-Light Image Enhancement. | Igor Morawski, Kai He, Shusil Dangi, Winston H. Hsu |
| 2024 | ECCV | Tracking-Assisted Object Detection with Event Cameras. | Ting-Kang Yen, Igor Morawski, Shusil Dangi, Kai He, Chung-Yi Lin, Jia-Fong Yeh, Hung-Ting Su, Winston H. Hsu |
| 2024 | EMNLP | Unveiling Narrative Reasoning Limits of Large Language Models with Trope in Movie Synopses. | Hung-Ting Su, Ya-Ching Hsu, Xudong Lin, Xiang Qian Shi, Yulei Niu, Han-Yuan Hsu, Hung-yi Lee, Winston H. Hsu |
| 2024 | IJCAI | Enhancing Sustainable Urban Mobility Prediction with Telecom Data: A Spatio-Temporal Framework Approach. | ChungYi Lin, Shen-Lung Tung, Hung-Ting Su, Winston H. Hsu |
| 2024 | ICRA | WLST: Weak Labels Guided Self-training for Weakly-supervised Domain Adaptation on 3D Object Detection. | Tsung-Lin Tsou, Tsung-Han Wu, Winston H. Hsu |
| 2024 | WWW | Tel2Veh: Fusion of Telecom Data and Vehicle Flow to Predict Camera-Free Traffic via a Spatio-Temporal Framework. | ChungYi Lin, Shen-Lung Tung, Hung-Ting Su, Winston H. Hsu |
| 2023 | ASRU | Minisuperb: Lightweight Benchmark for Self-Supervised Speech Models. | Yu-Hsiang Wang, Huang-Yu Chen, Kai-Wei Chang, Winston H. Hsu, Hung-Yi Lee |
| 2023 | CIKM | STAMINA (Spatial-Temporal Aligned Meteorological INformation Attention) and FPL (Focal Precip Loss): Advancements in Precipitation Nowcasting for Heavy Rainfall Events. | Ping-Chia Huang, Yueh-Li Chen, Yi-Syuan Liou, Bing-Chen Tsai, Chun-Chieh Wu, Winston H. Hsu |
| 2023 | CIKM | CTCam: Enhancing Transportation Evaluation through Fusion of Cellular Traffic and Camera-Based Vehicle Flows. | ChungYi Lin, Shen-Lung Tung, Hung-Ting Su, Winston H. Hsu |
| 2023 | CoRL | Revisiting Depth-guided Methods for Monocular 3D Object Detection by Hierarchical Balanced Depth. | Yi-Rong Chen, Ching-Yu Tseng, Yi-Syuan Liou, Tsung-Han Wu, Winston H. Hsu |
| 2023 | CVPR | Language Models are Causal Knowledge Extractors for Zero-shot Video Question Answering. | Hung-Ting Su, Yulei Niu, Xudong Lin, Winston H. Hsu, Shih-Fu Chang |
| 2023 | ICASSP | BIRD-PCC: Bi-Directional Range Image-Based Deep Lidar Point Cloud Compression. | Chia-Sheng Liu, Jia-Fong Yeh, Hao Hsu, Hung-Ting Su, Ming-Sui Lee, Winston H. Hsu |
| 2023 | ICLR | Pay Attention to Multi-Channel for Improving Graph Neural Networks. | ChungYi Lin, Shen-Lung Tung, Winston H. Hsu |
| 2023 | IJCAI | Geographical Cellular Traffic Prediction with Multivariate Spatio-Temporal Modeling. | ChungYi Lin, Shen-Lung Tung, Winston H. Hsu |
| 2023 | ICRA | Orbeez-SLAM: A Real-time Monocular Visual SLAM with ORB Features and NeRF-realized Mapping. | Chi-Ming Chung, Yang-Che Tseng, Ya-Ching Hsu, Xiang Qian Shi, Yun-Hung Hua, Jia-Fong Yeh, Wen-Chin Chen, Yi-Ting Chen, Winston H. Hsu |
| 2023 | ICRA | Coarse-to-Fine Point Cloud Registration with SE(3)-Equivariant Representations. | Cheng-Wei Lin, Tung-I Chen, Hsin-Ying Lee, Wen-Chin Chen, Winston H. Hsu |
| 2023 | ICRA | CFVS: Coarse-to-Fine Visual Servoing for 6-DoF Object-Agnostic Peg-In-Hole Assembly. | Bo-Siang Lu, Tung-I Chen, Hsin-Ying Lee, Winston H. Hsu |
| 2023 | ICRA | CrossDTR: Cross-view and Depth-guided Transformers for 3D Object Detection. | Ching-Yu Tseng, Yi-Rong Chen, Hsin-Ying Lee, Tsung-Han Wu, Wen-Chin Chen, Winston H. Hsu |
| 2022 | AAAI | Stage Conscious Attention Network (SCAN): A Demonstration-Conditioned Policy for Few-Shot Imitation. | Jia-Fong Yeh, Chi-Ming Chung, Hung-Ting Su, Yi-Ting Chen, Winston H. Hsu |
| 2022 | BMVC | Free-form 3D Scene Inpainting with Dual-stream GAN. | Ru-Fen Jheng, Tsung-Han Wu, Jia-Fong Yeh, Winston H. Hsu |
| 2022 | BMVC | Learning Fine-Grained Visual Understanding for Video Question Answering via Decoupling Spatial-Temporal Modeling. | Hsin-Ying Lee, Hung-Ting Su, Bing-Chen Tsai, Tsung-Han Wu, Jia-Fong Yeh, Winston H. Hsu |
| 2022 | CVPR | MonoDTR: Monocular 3D Object Detection with Depth-Aware Transformer. | Kuan-Chih Huang, Tsung-Han Wu, Hung-Ting Su, Winston H. Hsu |
| 2022 | CVPR | GenISP: Neural ISP for Low-Light Machine Cognition. | Igor Morawski, Yu-An Chen, Yu-Sheng Lin, Shusil Dangi, Kai He, Winston H. Hsu |
| 2022 | ECCV | $\mathrm {D^2ADA}$: Dynamic Density-Aware Active Domain Adaptation for Semantic Segmentation. | Tsung-Han Wu, Yi-Syuan Liou, Shao-Ji Yuan, Hsin-Ying Lee, Tung-I Chen, Kuan-Chih Huang, Winston H. Hsu |
| 2022 | ICIP | SeqDNet: Improving Missing Value by Sequential Depth Network. | Hao Hsu, Hung-Ting Su, Jia-Fong Yeh, Chi-Ming Chung, Winston H. Hsu |
| 2021 | BMVC | Multi-Stream Attention Learning for Monocular Vehicle Velocity and Inter-Vehicle Distance Estimation. | Kuan-Chih Huang, Yu-Kai Huang, Winston H. Hsu |
| 2021 | BMVC | NOD: Taking a Closer Look at Detection under Extreme Low-Light Conditions with Night Object Detection Dataset. | Igor Morawski, Yu-An Chen, Yu-Sheng Lin, Winston H. Hsu |
| 2021 | CIKM | Multivariate and Propagation Graph Attention Network for Spatial-Temporal Prediction with Outdoor Cellular Traffic. | Chung-Yi Lin, Hung-Ting Su, Shen-Lung Tung, Winston H. Hsu |
| 2021 | CIKM | TrUMAn: Trope Understanding in Movies and Animations. | Hung-Ting Su, Po-Wei Shen, Bing-Chen Tsai, Wen-Feng Cheng, Ke-Jyun Wang, Winston H. Hsu |
| 2021 | CVPR | S3: Learnable Sparse Signal Superdensity for Guided Depth Estimation. | Yu-Kai Huang, Yueh-Cheng Liu, Tsung-Han Wu, Hung-Ting Su, Yu-Cheng Chang, Tsung-Lin Tsou, Yu-An Wang, Winston H. Hsu |
| 2021 | ICASSP | Role Aware Multi-Party Dialogue Question Answering. | Jui-Heng Hsu, Po-Wei Shen, Hung-Ting Su, Chen-Hsi Chang, Jia-Fong Yeh, Winston H. Hsu |
| 2021 | ICCV | ReDAL: Region-based and Diversity-aware Active Learning for Point Cloud Semantic Segmentation. | Tsung-Han Wu, Yueh-Cheng Liu, Yu-Kai Huang, Hsin-Ying Lee, Hung-Ting Su, Ping-Chia Huang, Winston H. Hsu |
| 2021 | IROS | ODIP: Towards Automatic Adaptation for Object Detection by Interactive Perception. | Tung-I Chen, Jen-Wei Wang, Winston H. Hsu |
| 2021 | NAACL | OCID-Ref: A 3D Robotic Dataset With Embodied Language For Clutter Scene Grounding. | Ke-Jyun Wang, Yun-Hsuan Liu, Hung-Ting Su, Jen-Wei Wang, Yu-Siang Wang, Winston H. Hsu, Wen-Chin Chen |
| 2021 | WWW | Situation and Behavior Understanding by Trope Detection on Films. | Chen-Hsi Chang, Hung-Ting Su, Juiheng Hsu, Yu-Siang Wang, Yu-Cheng Chang, Zhe Yu Liu, Ya-Liang Chang, Wen-Feng Cheng, Ke-Jyun Wang, Winston H. Hsu |
| 2021 | WACV | Class-agnostic Few-shot Object Counting. | Shuo-Diao Yang, Hung-Ting Su, Winston H. Hsu, Wen-Chin Chen |
| 2020 | CoRL | GDN: A Coarse-To-Fine (C2F) Representation for End-To-End 6-DoF Grasp Detection. | Kuang-Yu Jeng, Yueh-Cheng Liu, Zhe Yu Liu, Jen-Wei Wang, Ya-Liang Chang, Hung-Ting Su, Winston H. Hsu |
| 2020 | ICASSP | Video Question Generation via Semantic Rich Cross-Modal Self-Attention Networks Learning. | Yu-Siang Wang, Hung-Ting Su, Chen-Hsi Chang, Zhe Yu Liu, Winston H. Hsu |
| 2020 | MICCAI | Efficient and Phase-Aware Video Super-Resolution for Cardiac MRI. | Jhih-Yuan Lin, Yu-Cheng Chang, Winston H. Hsu |
| 2019 | BMVC | Learnable Gated Temporal Shift Module for Free-form Video Inpainting. | Ya-Liang Chang, Zhe Yu Liu, Kuan-Ying Lee, Winston H. Hsu |
| 2019 | CVPR | Anticipation of Human Actions With Pose-Based Fine-Grained Representations. | Sebastian Agethen, Hu-Cheng Lee, Winston H. Hsu |
| 2019 | CVPR | VORNet: Spatio-Temporally Consistent Video Inpainting for Object Removal. | Ya-Liang Chang, Zhe Yu Liu, Winston H. Hsu |
| 2019 | ICASSP | Saliency Aware: Weakly Supervised Object Localization. | Yun-Chun Chen, Winston H. Hsu |
| 2019 | ICASSP | Audio Feature Generation for Missing Modality Problem in Video Action Recognition. | Hu-Cheng Lee, Chih-Yu Lin, Pin-Chun Hsu, Winston H. Hsu |
| 2019 | ICCV | Free-Form Video Inpainting With 3D Gated Convolution and Temporal PatchGAN. | Ya-Liang Chang, Zhe Yu Liu, Kuan-Ying Lee, Winston H. Hsu |
| 2018 | ACCV | PIVTONS: Pose Invariant Virtual Try-On Shoe with Conditional Image Completion. | Chao-Te Chou, Cheng-Han Lee, Kaipeng Zhang, Hu-Cheng Lee, Winston H. Hsu |
| 2018 | CVPR | Drone-View Building Identification by Cross-View Visual Learning and Relative Spatial Estimation. | Chun-Wei Chen, Yin-Hsi Kuo, Tang Lee, Cheng-Han Lee, Winston H. Hsu |
| 2018 | CVPR | Attribute Augmented Convolutional Neural Network for Face Hallucination. | Cheng-Han Lee, Kaipeng Zhang, Hu-Cheng Lee, Chia-Wen Cheng, Winston H. Hsu |
| 2018 | CVPR | Cross-Domain Hallucination Network for Fine-Grained Object Recognition. | Jin-Fu Lin, Yen-Liang Lin, Erh-Kan King, Hung-Ting Su, Winston H. Hsu |
| 2018 | CVPR | Deep Disguised Faces Recognition. | Kaipeng Zhang, Ya-Liang Chang, Winston H. Hsu |
| 2018 | ECCV | Super-Identity Convolutional Neural Network for Face Hallucination. | Kaipeng Zhang, Zhanpeng Zhang, Chia-Wen Cheng, Winston H. Hsu, Yu Qiao, Wei Liu, Tong Zhang |
| 2018 | WWW | Netizen-Style Commenting on Fashion Photos: Dataset and Diversity Measures. | Wen Hua Lin, Kuan-Ting Chen, HungYueh Chiang, Winston H. Hsu |
| 2017 | CVPR | Joint Sequence Learning and Cross-Modality Convolution for 3D Biomedical Segmentation. | Kuan-Lun Tseng, Yen-Liang Lin, Winston H. Hsu, Chung-Yang Huang |
| 2017 | ICASSP | Multi-task learning for face identification and attribute estimation. | Hui-Lan Hsieh, Winston H. Hsu, Yan-Ying Chen |
| 2017 | ICCV | Drone-Based Object Counting by Spatially Regularized Regional Proposal Network. | Meng-Ru Hsieh, Yen-Liang Lin, Winston H. Hsu |
| 2016 | ICASSP | Mediated experts for deep convolutional networks. | Sebastian Agethen, Winston H. Hsu |
| 2016 | ICASSP | WiFi action recognition via vision-based methods. | Jen-Yin Chang, Kuan-Ying Lee, Kate Ching-Ju Lin, Winston H. Hsu |
| 2016 | ICASSP | LDADEEP+: Latent aspect discovery with deep representations. | Chieh-En Tsai, Hui-Lan Hsieh, Winston H. Hsu |
| 2015 | AAAI | Visually Interpreting Names as Demographic Attributes by Exploiting Click-Through Data. | Yan-Ying Chen, Yin-Hsi Kuo, Chun-Che Wu, Winston H. Hsu |
| 2015 | CVPR | Scalable object detection by filter compression with regularized sparse coding. | Ting-Hsuan Chao, Yen-Liang Lin, Yin-Hsi Kuo, Winston H. Hsu |
| 2015 | ECIR | Approximating Weighted Hamming Distance by Probabilistic Selection for Multiple Hash Tables. | Chiang-Yu Tsai, Yin-Hsi Kuo, Winston H. Hsu |
| 2015 | ICASSP | Enhancing sparse voice annotation for semantic retrieval of personal photos by continuous space word representations. | Yuan-ming Liou, Hung-tsung Lu, Yi-Sheng Fu, Winston H. Hsu, Lin-Shan Lee |
| 2015 | ICASSP | Identify Visual Human Signature in community via wearable camera. | Chia-Chin Tsao, Yan-Ying Chen, Yu-Lin Hou, Winston H. Hsu |
| 2015 | MMSP | Augmenting flower recognition by automatically expanding training data from web. | Cheng-Yu Huang, Yen-Liang Lin, Winston H. Hsu |
| 2014 | ECCV | Cross-Age Reference Coding for Age-Invariant Face Recognition and Retrieval. | Bor-Chun Chen, Chu-Song Chen, Winston H. Hsu |
| 2014 | ECCV | Jointly Optimizing 3D Model Fitting and Fine-Grained Classification. | Yen-Liang Lin, Vlad I. Morariu, Winston H. Hsu, Larry S. Davis |
| 2014 | ICASSP | Investigating and predicting social and visual image interestingness on social media by crowdsourcing. | Liang-Chi Hsieh, Winston H. Hsu, Hao-Chuan Wang |
| 2014 | ICASSP | Learning-based heart rate detection from remote photoplethysmography features. | YungChien Hsu, Yen-Liang Lin, Winston H. Hsu |
| 2014 | WWW | Me-link: link me to the media - fusing audio and visual cues for robust and efficient mobile media interaction. | Chun-Yen Yeh, Yu-Ming Hsu, Hsinfu Huang, Hong-Wun Jheng, Yu-Chuan Su, Tzu-Hsuan Chiu, Winston H. Hsu |
| 2014 | SIGIR | Learning to personalize trending image search suggestion. | Chun-Che Wu, Tao Mei, Winston H. Hsu, Yong Rui |
| 2013 | AVSS | Full body human attribute detection in indoor surveillance environment using color-depth information. | Hao-Jen Wang, Yen-Liang Lin, Cheng-Yu Huang, Yu-Lin Hou, Winston H. Hsu |
| 2013 | ICCV | 3D Sub-query Expansion for Improving Sketch-Based Multi-view Image Retrieval. | Yen-Liang Lin, Cheng-Yu Huang, Hao-Jeng Wang, Winston H. Hsu |
| 2012 | ICASSP | Two-stage sparse graph construction using MinHash on MapReduce. | Liang-Chi Hsieh, Guan-Long Wu, Wen-Yu Lee, Winston H. Hsu |
| 2012 | ICASSP | Content-based vehicle retrieval using 3D model and part information. | Ming-Kuang Tsai, Yen-Liang Lin, Winston H. Hsu, Chih-Wei Chen |
| 2012 | MMSP | Sharing the trees among random forests for effective and efficient concept detection. | Tzu-Hsuan Chiu, Guan-Long Wu, Yu-Chuan Su, Winston H. Hsu |
| 2012 | SIGIR | Where is who: large-scale photo retrieval by facial attributes and canvas layout. | Yu-Heng Lei, Yan-Ying Chen, Bor-Chun Chen, Lime Iida, Winston H. Hsu |
| 2011 | CVPR | Unsupervised auxiliary visual words discovery for large-scale image object retrieval. | Yin-Hsi Kuo, Hsuan-Tien Lin, Wen-Huang Cheng, Yi-Hsuan Yang, Winston H. Hsu |
| 2011 | MMM | Snap2Read: Automatic Magazine Capturing and Analysis for Adaptive Mobile Reading. | Yu-Ming Hsu, Yen-Liang Lin, Winston H. Hsu, Brian Wang |
| 2011 | WWW | Learning facial attributes by crowdsourcing in social media. | Yan-Ying Chen, Winston H. Hsu, Hong-Yuan Mark Liao |
| 2011 | SIGIR | Region-based landmark discovery by crowdsourcing geo-referenced photos. | Yen-Ta Huang, An-Jung Cheng, Liang-Chi Hsieh, Winston H. Hsu, Kuo-Wei Chang |
| 2011 | SIGIR | Multi-layer graph-based semi-supervised learning for large-scale image datasets using mapreduce. | Wen-Yu Lee, Liang-Chi Hsieh, Guan-Long Wu, Winston H. Hsu, Ya-Fan Su |
| 2010 | ICASSP | Search-Based Automatic Image Annotation via Flickr Photos Using Tag Expansion. | Liang-Chi Hsieh, Winston H. Hsu |
| 2009 | ICIP | Boosting object retrieval by estimating pseudo-objects. | Kuan Hung Lin, Kuan-Ting Chen, Winston H. Hsu, Chun Jen Lee, Tien-Hsu Lee |
| 2008 | SIGIR | AdImage: video advertising by image matching and ad scheduling optimization. | Wei-Shing Liao, Kuan-Ting Chen, Winston H. Hsu |
| 2006 | ICIP | Topic Tracking Across Broadcast News Videos with Visual Duplicates and Semantic Concepts. | Winston H. Hsu, Shih-Fu Chang |
| 2004 | ICASSP | News video story segmentation using fusion of multi-level multi-modal features in TRECVID 2003. | Winston H. Hsu, Lyndon S. Kennedy, Chih-Wei Huang, Shih-Fu Chang, Ching-Yung Lin, Giridharan Iyengar |