| 2025 | ACL | M²-TabFact: Multi-Document Multi-Modal Fact Verification with Visual and Textual Representations of Tabular Data. | Mingyang Zhou, Lingyu Zhang, Sophia Horng, Maximillian Chen, Kung-Hsiang Huang, Shih-Fu Chang |
| 2025 | NAACL | PuzzleGPT: Emulating Human Puzzle-Solving Ability for Time and Location Prediction. | Hammad A. Ayyubi, Xuande Feng, Junzhang Liu, Xudong Lin, Zhecan Wang, Shih-Fu Chang |
| 2024 | AAAI | Beyond Grounding: Extracting Fine-Grained Event Hierarchies across Modalities. | Hammad A. Ayyubi, Christopher Thomas, Lovish Chum, Rahul Lokesh, Long Chen, Yulei Niu, Xudong Lin, Xuande Feng, Jaywon Koo, Sounak Ray, Shih-Fu Chang |
| 2024 | ACL | Do LVLMs Understand Charts? Analyzing and Correcting Factual Errors in Chart Captioning. | Kung-Hsiang Huang, Mingyang Zhou, Hou Pong Chan, Yi Fung, Zhenhailong Wang, Lingyu Zhang, Shih-Fu Chang, Heng Ji |
| 2024 | CVPR | What, When, and Where? Self-Supervised Spatio- Temporal Grounding in Untrimmed Multi-Action Videos from Narrated Instructions. | Brian Chen, Nina Shvetsova, Andrew Rouditchenko, Daniel Kondermann, Samuel Thomas, Shih-Fu Chang, Rogrio Feris, James R. Glass, Hilde Kuehne |
| 2024 | CVPR | MoDE: CLIP Data Experts via Clustering. | Jiawei Ma, Po-Yao Huang, Saining Xie, Shang-Wen Li, Luke Zettlemoyer, Shih-Fu Chang, Wen-Tau Yih, Hu Xu |
| 2024 | ECCV | RAP: Retrieval-Augmented Planner for Adaptive Procedure Planning in Instructional Videos. | Ali Zare, Yulei Niu, Hammad A. Ayyubi, Shih-Fu Chang |
| 2024 | EMNLP | Training-free Deep Concept Injection Enables Language Models for Video Question Answering. | Xudong Lin, Manling Li, Richard S. Zemel, Heng Ji, Shih-Fu Chang |
| 2024 | EMNLP | VIEWS: Entity-Aware News Video Captioning. | Hammad A. Ayyubi, Tianqi Liu, Arsha Nagrani, Xudong Lin, Mingda Zhang, Anurag Arnab, Feng Han, Yukun Zhu, Xuande Feng, Kevin Zhang, Jialu Liu, Shih-Fu Chang |
| 2024 | EMNLP | Personalized Video Comment Generation. | Xudong Lin, Ali Zare, Shiyuan Huang, Ming-Hsuan Yang, Shih-Fu Chang, Li Zhang |
| 2024 | ICLR | SCHEMA: State CHangEs MAtter for Procedure Planning in Instructional Videos. | Yulei Niu, Wenliang Guo, Long Chen, Xudong Lin, Shih-Fu Chang |
| 2024 | ICLR | Ferret: Refer and Ground Anything Anywhere at Any Granularity. | Haoxuan You, Haotian Zhang, Zhe Gan, Xianzhi Du, Bowen Zhang, Zirui Wang, Liangliang Cao, Shih-Fu Chang, Yinfei Yang |
| 2023 | AAAI | Video Event Extraction via Tracking Visual States of Arguments. | Guang Yang, Manling Li, Jiajie Zhang, Xudong Lin, Heng Ji, Shih-Fu Chang |
| 2023 | ACL | Learning from Children: Improving Image-Caption Pretraining via Curriculum. | Hammad A. Ayyubi, Rahul Lokesh, Alireza Zareian, Bo Wu, Shih-Fu Chang |
| 2023 | ACL | UniFine: A Unified and Fine-grained Approach for Zero-shot Vision-Language Understanding. | Rui Sun, Zhecan Wang, Haoxuan You, Noel Codella, Kai-Wei Chang, Shih-Fu Chang |
| 2023 | ACL | Enhanced Chart Understanding via Visual Language Pre-training on Plot Table Pairs. | Mingyang Zhou, Yi Ren Fung, Long Chen, Christopher Thomas, Heng Ji, Shih-Fu Chang |
| 2023 | ACL | Non-Sequential Graph Script Induction via Multimedia Grounding. | Yu Zhou, Sha Li, Manling Li, Xudong Lin, Shih-Fu Chang, Mohit Bansal, Heng Ji |
| 2023 | CVPR | Towards Fast Adaptation of Pretrained Contrastive Models for Multi-channel Video-Language Retrieval. | Xudong Lin, Simran Tiwari, Shiyuan Huang, Manling Li, Mike Zheng Shou, Heng Ji, Shih-Fu Chang |
| 2023 | CVPR | Supervised Masked Knowledge Distillation for Few-Shot Transformers. | Han Lin, Guangxing Han, Jiawei Ma, Shiyuan Huang, Xudong Lin, Shih-Fu Chang |
| 2023 | CVPR | In Defense of Structural Symbolic Representation for Video Event-Relation Prediction. | Andrew Lu, Xudong Lin, Yulei Niu, Shih-Fu Chang |
| 2023 | CVPR | DiGeo: Discriminative Geometry-Aware Learning for Generalized Few-Shot Object Detection. | Jiawei Ma, Yulei Niu, Jincheng Xu, Shiyuan Huang, Guangxing Han, Shih-Fu Chang |
| 2023 | CVPR | Language Models are Causal Knowledge Extractors for Zero-shot Video Question Answering. | Hung-Ting Su, Yulei Niu, Xudong Lin, Winston H. Hsu, Shih-Fu Chang |
| 2023 | EMNLP | Dataset Bias Mitigation in Multiple-Choice Visual Question Answering and Beyond. | Zhecan Wang, Long Chen, Haoxuan You, Keyang Xu, Yicheng He, Wenhao Li, Noel Codella, Kai-Wei Chang, Shih-Fu Chang |
| 2023 | EMNLP | IdealGPT: Iteratively Decomposing Vision and Language Reasoning via Large Language Models. | Haoxuan You, Rui Sun, Zhecan Wang, Long Chen, Gengyu Wang, Hammad A. Ayyubi, Kai-Wei Chang, Shih-Fu Chang |
| 2023 | ICLR | TempCLR: Temporal Alignment Representation with Contrastive Learning. | Yuncong Yang, Jiawei Ma, Shiyuan Huang, Long Chen, Xudong Lin, Guangxing Han, Shih-Fu Chang |
| 2023 | WACV | PreViTS: Contrastive Pretraining with Video Tracking Supervision. | Brian Chen, Ramprasaath R. Selvaraju, Shih-Fu Chang, Juan Carlos Niebles, Nikhil Naik |
| 2022 | AAAI | Meta Faster R-CNN: Towards Accurate Few-Shot Object Detection with Attentive Feature Alignment. | Guangxing Han, Shiyuan Huang, Jiawei Ma, Yicheng He, Shih-Fu Chang |
| 2022 | AAAI | MuMuQA: Multimedia Multi-Hop News Question Answering via Cross-Media Knowledge Extraction and Grounding. | Revanth Gangi Reddy, Xilin Rui, Manling Li, Xudong Lin, Haoyang Wen, Jaemin Cho, Lifu Huang, Mohit Bansal, Avirup Sil, Shih-Fu Chang, Alexander G. Schwing, Heng Ji |
| 2022 | AAAI | SGEITL: Scene Graph Enhanced Image-Text Learning for Visual Commonsense Reasoning. | Zhecan Wang, Haoxuan You, Liunian Harold Li, Alireza Zareian, Suji Park, Yiqing Liang, Kai-Wei Chang, Shih-Fu Chang |
| 2022 | CVPR | Learning To Recognize Procedural Activities with Distant Supervision. | Xudong Lin, Fabio Petroni, Gedas Bertasius, Marcus Rohrbach, Shih-Fu Chang, Lorenzo Torresani |
| 2022 | CVPR | One-Stage Object Referring with Gaze Estimation. | Jianhang Chen, Xu Zhang, Yue Wu, Shalini Ghosh, Pradeep Natarajan, Shih-Fu Chang, Jan P. Allebach |
| 2022 | CVPR | Few-Shot Object Detection with Fully Cross-Transformer. | Guangxing Han, Jiawei Ma, Shiyuan Huang, Long Chen, Shih-Fu Chang |
| 2022 | CVPR | Task-Adaptive Negative Envision for Few-Shot Open-Set Recognition. | Shiyuan Huang, Jiawei Ma, Guangxing Han, Shih-Fu Chang |
| 2022 | CVPR | CLIP-Event: Connecting Text and Images with Event Structures. | Manling Li, Ruochen Xu, Shuohang Wang, Luowei Zhou, Xudong Lin, Chenguang Zhu, Michael Zeng, Heng Ji, Shih-Fu Chang |
| 2022 | ECCV | Video in 10 Bits: Few-Bit VideoQA for Efficiency and Privacy. | Shiyuan Huang, Robinson Piramuthu, Shih-Fu Chang, Gunnar A. Sigurdsson |
| 2022 | ECCV | Few-Shot End-to-End Object Detection via Constantly Concentrated Encoding Across Heads. | Jiawei Ma, Guangxing Han, Shiyuan Huang, Yuncong Yang, Shih-Fu Chang |
| 2022 | ECCV | Fine-Grained Visual Entailment. | Christopher Thomas, Yipeng Zhang, Shih-Fu Chang |
| 2022 | ECCV | Learning Visual Representation from Modality-Shared Contrastive Language-Image Pre-training. | Haoxuan You, Luowei Zhou, Bin Xiao, Noel Codella, Yu Cheng, Ruochen Xu, Shih-Fu Chang, Lu Yuan |
| 2022 | EMNLP | Weakly-Supervised Temporal Article Grounding. | Long Chen, Yulei Niu, Brian Chen, Xudong Lin, Guangxing Han, Christopher Thomas, Hammad A. Ayyubi, Heng Ji, Shih-Fu Chang |
| 2022 | EMNLP | Understanding ME? Multimodal Evaluation for Fine-grained Visual Commonsense. | Zhecan Wang, Haoxuan You, Yicheng He, Wenhao Li, Kai-Wei Chang, Shih-Fu Chang |
| 2022 | EMNLP | Find Someone Who: Visual Commonsense Understanding in Human-Centric Grounding. | Haoxuan You, Rui Sun, Zhecan Wang, Kai-Wei Chang, Shih-Fu Chang |
| 2022 | ICASSP | Asd-Transformer: Efficient Active Speaker Detection Using Self And Multimodal Transformers. | Gourav Datta, Tyler Etchart, Vivek Yadav, Varsha Hedau, Pradeep Natarajan, Shih-Fu Chang |
| 2022 | ICASSP | Few-Shot Gaze Estimation with Model Offset Predictors. | Jiawei Ma, Xu Zhang, Yue Wu, Varsha Hedau, Shih-Fu Chang |
| 2021 | AAAI | Ref-NMS: Breaking Proposal Bottlenecks in Two-Stage Referring Expression Grounding. | Long Chen, Wenbo Ma, Jun Xiao, Hanwang Zhang, Shih-Fu Chang |
| 2021 | ACL | InfoSurgeon: Cross-Media Fine-grained Information Consistency Checking for Fake News Detection. | Yi R. Fung, Christopher Thomas, Revanth Gangi Reddy, Sandeep Polisetty, Heng Ji, Shih-Fu Chang, Kathleen R. McKeown, Mohit Bansal, Avi Sil |
| 2021 | CVPR | Vx2Text: End-to-End Learning of Video-Based Text Generation From Multimodal Inputs. | Xudong Lin, Gedas Bertasius, Jue Wang, Shih-Fu Chang, Devi Parikh, Lorenzo Torresani |
| 2021 | CVPR | Co-Grounding Networks With Semantic Attention for Referring Expression Comprehension in Videos. | Sijie Song, Xudong Lin, Jiaying Liu, Zongming Guo, Shih-Fu Chang |
| 2021 | CVPR | Open-Vocabulary Object Detection Using Captions. | Alireza Zareian, Kevin Dela Rosa, Derek Hao Hu, Shih-Fu Chang |
| 2021 | EMNLP | Joint Multimedia Event Extraction from Video and Article. | Brian Chen, Xudong Lin, Christopher Thomas, Manling Li, Shoya Yoshida, Lovish Chum, Heng Ji, Shih-Fu Chang |
| 2021 | ICCV | Multimodal Clustering Networks for Self-supervised Learning from Unlabeled Videos. | Brian Chen, Andrew Rouditchenko, Kevin Duarte, Hilde Kuehne, Samuel Thomas, Angie W. Boggust, Rameswar Panda, Brian Kingsbury, Rogrio Feris, David Harwath, James R. Glass, Michael Picheny, Shih-Fu Chang |
| 2021 | ICCV | Query Adaptive Few-Shot Object Detection with Heterogeneous Graph Convolutional Networks. | Guangxing Han, Yicheng He, Shiyuan Huang, Jiawei Ma, Shih-Fu Chang |
| 2021 | ICCV | Partner-Assisted Learning for Few-Shot Image Classification. | Jiawei Ma, Hanchen Xie, Guangxing Han, Shih-Fu Chang, Aram Galstyan, Wael Abd-Almageed |
| 2021 | IJCAI | Uncertainty-Aware Few-Shot Image Classification. | Zhizheng Zhang, Cuiling Lan, Wenjun Zeng, Zhibo Chen, Shih-Fu Chang |
| 2021 | NAACL | Unsupervised Vision-and-Language Pre-training Without Parallel Images and Captions. | Liunian Harold Li, Haoxuan You, Zhecan Wang, Alireza Zareian, Shih-Fu Chang, Kai-Wei Chang |
| 2021 | NAACL | COVID-19 Literature Knowledge Graph Construction and Drug Repurposing Report Generation. | Qingyun Wang, Manling Li, Xuan Wang, Nikolaus Nova Parulian, Guangxing Han, Jiawei Ma, Jingxuan Tu, Ying Lin, Haoran Zhang, Weili Liu, Aabhas Chauhan, Yingjun Guan, Bangzheng Li, Ruisong Li, Xiangchen Song, Yi R. Fung, Heng Ji, Jiawei Han, Shih-Fu Chang, James Pustejovsky, Jasmine Rah, David Liem, Ahmed Elsayed, Martha Palmer, Clare R. Voss, Cynthia Schneider, Boyan A. Onyshkevych |
| 2021 | NAACL | RESIN: A Dockerized Schema-Guided Cross-document Cross-lingual Cross-media Information Extraction and Event Tracking System. | Haoyang Wen, Ying Lin, Tuan Manh Lai, Xiaoman Pan, Sha Li, Xudong Lin, Ben Zhou, Manling Li, Haoyu Wang, Hongming Zhang, Xiaodong Yu, Alexander Dong, Zhenhailong Wang, Yi Ren Fung, Piyush Mishra, Qing Lyu, Ddac Surs, Brian Chen, Susan Windisch Brown, Martha Palmer, Chris Callison-Burch, Carl Vondrick, Jiawei Han, Dan Roth, Shih-Fu Chang, Heng Ji |
| 2020 | AAAI | General Partial Label Learning via Dual Bipartite Graph Autoencoder. | Brian Chen, Bo Wu, Alireza Zareian, Hanwang Zhang, Shih-Fu Chang |
| 2020 | ACL | GAIA: A Fine-grained Multimedia Knowledge Extraction System. | Manling Li, Alireza Zareian, Ying Lin, Xiaoman Pan, Spencer Whitehead, Brian Chen, Bo Wu, Heng Ji, Shih-Fu Chang, Clare R. Voss, Daniel Napierski, Marjorie Freedman |
| 2020 | ACL | Cross-media Structured Common Space for Multimedia Event Extraction. | Manling Li, Alireza Zareian, Qi Zeng, Spencer Whitehead, Di Lu, Heng Ji, Shih-Fu Chang |
| 2020 | CVPR | Weakly Supervised Visual Semantic Parsing. | Alireza Zareian, Svebor Karaman, Shih-Fu Chang |
| 2020 | ECCV | Context-Gated Convolution. | Xudong Lin, Lin Ma, Wei Liu, Shih-Fu Chang |
| 2020 | ECCV | Learning to Learn Words from Visual Scenes. | Ddac Surs, Dave Epstein, Heng Ji, Shih-Fu Chang, Carl Vondrick |
| 2020 | ECCV | Bridging Knowledge Graphs to Generate Scene Graphs. | Alireza Zareian, Svebor Karaman, Shih-Fu Chang |
| 2020 | ECCV | Learning Visual Commonsense for Robust Scene Graph Generation. | Alireza Zareian, Zhecan Wang, Haoxuan You, Shih-Fu Chang |
| 2020 | LREC | Cross-lingual Structure Transfer for Zero-resource Event Extraction. | Di Lu, Ananya Subburathinam, Heng Ji, Jonathan May, Shih-Fu Chang, Avirup Sil, Clare R. Voss |
| 2019 | CVPR | Multi-Level Multimodal Common Semantic Space for Image-Phrase Grounding. | Hassan Akbari, Svebor Karaman, Surabhi Bhargava, Brian Chen, Carl Vondrick, Shih-Fu Chang |
| 2019 | CVPR | Urban Semantic 3D Reconstruction From Multiview Satellite Imagery. | Matthew J. Leotta, Chengjiang Long, Bastien Jacquet, Matthieu Zins, Dan Lipsa, Jie Shan, Bo Xu, Zhixin Li, Xu Zhang, Shih-Fu Chang, Matthew Purri, Jia Xue, Kristin J. Dana |
| 2019 | CVPR | Multi-Granularity Generator for Temporal Action Proposal. | Yuan Liu, Lin Ma, Yifeng Zhang, Wei Liu, Shih-Fu Chang |
| 2019 | CVPR | DMC-Net: Generating Discriminative Motion Cues for Fast Compressed Video Action Recognition. | Zheng Shou, Xudong Lin, Yannis Kalantidis, Laura Sevilla-Lara, Marcus Rohrbach, Shih-Fu Chang, Zhicheng Yan |
| 2019 | CVPR | Unsupervised Embedding Learning via Invariant and Spreading Instance Feature. | Mang Ye, Xu Zhang, Pong C. Yuen, Shih-Fu Chang |
| 2019 | EMNLP | Cross-lingual Structure Transfer for Relation and Event Extraction. | Ananya Subburathinam, Di Lu, Heng Ji, Jonathan May, Shih-Fu Chang, Avirup Sil, Clare R. Voss |
| 2019 | ICCV | Counterfactual Critic Multi-Agent Training for Scene Graph Generation. | Long Chen, Hanwang Zhang, Jun Xiao, Xiangnan He, Shiliang Pu, Shih-Fu Chang |
| 2019 | ICWSM | Multimodal Social Media Analysis for Gang Violence Prevention. | Philipp Blandfort, Desmond Upton Patton, William R. Frey, Svebor Karaman, Surabhi Bhargava, Fei-Tzin Lee, Siddharth Varia, Chris Kedzie, Michael B. Gaskell, Rossano Schifanella, Kathleen R. McKeown, Shih-Fu Chang |
| 2018 | CVPR | Zero-Shot Visual Recognition Using Semantics-Preserving Adversarial Embedding Networks. | Long Chen, Hanwang Zhang, Jun Xiao, Wei Liu, Shih-Fu Chang |
| 2018 | CVPR | Grounding Referring Expressions in Images by Variational Context. | Hanwang Zhang, Yulei Niu, Shih-Fu Chang |
| 2018 | ECCV | AutoLoc: Weakly-Supervised Temporal Action Localization in Untrimmed Videos. | Zheng Shou, Hang Gao, Lei Zhang, Kazuyuki Miyazawa, Shih-Fu Chang |
| 2018 | ECCV | Online Detection of Action Start in Untrimmed, Streaming Videos. | Zheng Shou, Junting Pan, Jonathan Chan, Kazuyuki Miyazawa, Hassan Mansour, Anthony Vetro, Xavier Gir-i-Nieto, Shih-Fu Chang |
| 2018 | EMNLP | Entity-aware Image Caption Generation. | Di Lu, Spencer Whitehead, Lifu Huang, Heng Ji, Shih-Fu Chang |
| 2018 | EMNLP | Incorporating Background Knowledge into Video Description Generation. | Spencer Whitehead, Heng Ji, Mohit Bansal, Shih-Fu Chang, Clare R. Voss |
| 2018 | ICLR | Skip RNN: Learning to Skip State Updates in Recurrent Neural Networks. | Vctor Campos, Brendan Jou, Xavier Gir-i-Nieto, Jordi Torres, Shih-Fu Chang |
| 2017 | BMVC | Localizing Actions from Video Labels and Pseudo-Annotations. | Pascal Mettes, Cees Snoek, Shih-Fu Chang |
| 2017 | CVPR | CDC: Convolutional-De-Convolutional Networks for Precise Temporal Action Localization in Untrimmed Videos. | Zheng Shou, Jonathan Chan, Alireza Zareian, Kazuyuki Miyazawa, Shih-Fu Chang |
| 2017 | CVPR | Visual Translation Embedding Network for Visual Relation Detection. | Hanwang Zhang, Zawlin Kyaw, Shih-Fu Chang, Tat-Seng Chua |
| 2017 | CVPR | Learning Discriminative and Transformation Covariant Local Feature Detectors. | Xu Zhang, Felix X. Yu, Svebor Karaman, Shih-Fu Chang |
| 2017 | ICCV | PPR-FCN: Weakly Supervised Visual Relation Detection via Parallel Pairwise R-FCN. | Hanwang Zhang, Zawlin Kyaw, Jinyang Yu, Shih-Fu Chang |
| 2017 | ICCV | Learning Spread-Out Local Feature Descriptors. | Xu Zhang, Felix X. Yu, Sanjiv Kumar, Shih-Fu Chang |
| 2017 | WACV | Deep Image Set Hashing. | Jie Feng, Svebor Karaman, Shih-Fu Chang |
| 2016 | ACL | A Multi-media Approach to Cross-lingual Entity Knowledge Transfer. | Di Lu, Xiaoman Pan, Nima Pourdamghani, Shih-Fu Chang, Heng Ji, Kevin Knight |
| 2016 | CVPR | Interactive Segmentation on RGBD Images via Cue Selection. | Jie Feng, Brian L. Price, Scott Cohen, Shih-Fu Chang |
| 2016 | CVPR | Temporal Action Localization in Untrimmed Videos via Multi-stage CNNs. | Zheng Shou, Dongang Wang, Shih-Fu Chang |
| 2016 | IUI | PanoSwarm: Collaborative and Synchronized Multi-Device Panoramic Photography. | Yan Wang, Sunghyun Cho, Jue Wang, Shih-Fu Chang |
| 2016 | NAACL | Cross-media Event Extraction and Recommendation. | Di Lu, Clare R. Voss, Fangbo Tao, Xiang Ren, Rachel Guan, Rostyslav Korolov, Tongtao Zhang, Dongang Wang, Hongzhi Li, Taylor Cassidy, Heng Ji, Shih-Fu Chang, Jiawei Han, William A. Wallace, James A. Hendler, Mei Si, Lance M. Kaplan |
| 2016 | WACV | 3D shape retrieval using a single depth image from low-cost sensors. | Jie Feng, Yan Wang, Shih-Fu Chang |
| 2015 | AAAI | Low-Rank Similarity Metric Learning in High Dimensions. | Wei Liu, Cun Mu, Rongrong Ji, Shiqian Ma, John R. Smith, Shih-Fu Chang |
| 2015 | AVSS | An end-to-end system for content-based video retrieval using behavior, actions, and appearance with interactive query refinement. | Anthony Hoogs, A. G. Amitha Perera, Roderic Collins, Arslan Basharat, Keith Fieldhouse, Chuck Atkins, Linus Sherrill, Benjamin Boeckel, Russell Blue, Matthew Woehlke, C. Greco, Zhaohui Sun, Eran Swears, Naresh P. Cuntoor, J. Luck, B. Drew, D. Hanson, D. Rowley, J. Kopaz, T. Rude, D. Keefe, Amit Srivastava, Saurabh Khanwalkar, Anoop Kumar, Chia-Chih Chen, J. K. Aggarwal, Larry S. Davis, Yaser Yacoob, A. Jain, Dong Liu, Shih-Fu Chang, Bi Song, Amit K. Roy-Chowdhury, Kenneth Sullivan, Jelena Tesic, Shivkumar Chandrasekaran, B. S. Manjunath, X. Wang, Qiang Ji, K. Reddy, J. Liu, Mubarak Shah, K. Chang, Tsuhan Chen, Mita Desai |
| 2015 | CVPR | Attributes and categories for generic instance search from one example. | Ran Tao, Arnold W. M. Smeulders, Shih-Fu Chang |
| 2015 | CVPR | New insights into Laplacian similarity search. | Xiao-Ming Wu, Zhenguo Li, Shih-Fu Chang |
| 2015 | EMNLP | Cross-document Event Coreference Resolution based on Cross-media Features. | Tongtao Zhang, Hongzhi Li, Heng Ji, Shih-Fu Chang |
| 2015 | ICCV | An Exploration of Parameter Redundancy in Deep Networks with Circulant Projections. | Yu Cheng, Felix X. Yu, Rogrio Schmidt Feris, Sanjiv Kumar, Alok N. Choudhary, Shih-Fu Chang |
| 2015 | ICCV | Fast Orthogonal Projection Based on Kronecker Product. | Xu Zhang, Felix X. Yu, Ruiqi Guo, Sanjiv Kumar, Shengjin Wang, Shih-Fu Chang |
| 2015 | ICRA | Regrasping and unfolding of garments using predictive thin shell modeling. | Yinxiao Li, Danfei Xu, Yonghao Yue, Yan Wang, Shih-Fu Chang, Eitan Grinspun, Peter K. Allen |
| 2014 | CVPR | Locally Linear Hashing for Extracting Non-linear Manifolds. | Go Irie, Zhenguo Li, Xiao-Ming Wu, Shih-Fu Chang |
| 2014 | CVPR | Video Event Detection by Inferring Temporal Instance Labels. | Kuan-Ting Lai, Felix X. Yu, Ming-Syan Chen, Shih-Fu Chang |
| 2014 | CVPR | Hash-SVM: Scalable Kernel Machines for Large-Scale Visual Classification. | Yadong Mu, Gang Hua, Wei Fan, Shih-Fu Chang |
| 2014 | ECCV | Recognizing Complex Events in Videos by Learning Key Static-Dynamic Evidences. | Kuan-Ting Lai, Dong Liu, Ming-Syan Chen, Shih-Fu Chang |
| 2014 | ECCV | Discriminative Indexing for Probabilistic Image Patch Priors. | Yan Wang, Sunghyun Cho, Jue Wang, Shih-Fu Chang |
| 2014 | ECCV | From Low-Cost Depth Sensors to CAD: Cross-Domain 3D Shape Retrieval via Regression Tree Fields. | Yan Wang, Jie Feng, Zhixiang Wu, Jun Wang, Shih-Fu Chang |
| 2014 | ICMI | Why We Watch the News: A Dataset for Exploring Sentiment in Broadcast Video News. | Joseph G. Ellis, Brendan Jou, Shih-Fu Chang |
| 2014 | ICML | Circulant Binary Embedding. | Felix X. Yu, Sanjiv Kumar, Yunchao Gong, Shih-Fu Chang |
| 2014 | IROS | Real-time pose estimation of deformable objects using a volumetric approach. | Yinxiao Li, Yan Wang, Michael Case, Shih-Fu Chang, Peter K. Allen |
| 2014 | ISM | Predicting Evoked Emotions in Video. | Joseph G. Ellis, W. Sabrina Lin, Ching-Yung Lin, Shih-Fu Chang |
| 2013 | CVPR | Robust Object Co-detection. | Xin Guo, Dong Liu, Brendan Jou, Mojun Zhu, Anni Cai, Shih-Fu Chang |
| 2013 | CVPR | A Bayesian Approach to Multimodal Visual Dictionary Learning. | Go Irie, Dong Liu, Zhenguo Li, Shih-Fu Chang |
| 2013 | CVPR | Hash Bit Selection: A Unified Solution for Selection Problems in Hashing. | Xianglong Liu, Junfeng He, Bo Lang, Shih-Fu Chang |
| 2013 | CVPR | Sample-Specific Late Fusion for Visual Category Recognition. | Dong Liu, Kuan-Ting Lai, Guangnan Ye, Ming-Syan Chen, Shih-Fu Chang |
| 2013 | CVPR | Label Propagation from ImageNet to 3D Point Clouds. | Yan Wang, Rongrong Ji, Shih-Fu Chang |
| 2013 | CVPR | Designing Category-Level Attributes for Discriminative Visual Recognition. | Felix X. Yu, Liangliang Cao, Rogrio Schmidt Feris, John R. Smith, Shih-Fu Chang |
| 2013 | ICCV | Distributed Low-Rank Subspace Segmentation. | Ameet Talwalkar, Lester W. Mackey, Yadong Mu, Shih-Fu Chang, Michael I. Jordan |
| 2013 | ICCV | Large-Scale Video Hashing via Structure Learning. | Guangnan Ye, Dong Liu, Jun Wang, Shih-Fu Chang |
| 2013 | ICML | \(\propto\)SVM for Learning with Label Proportions. | Felix X. Yu, Dong Liu, Sanjiv Kumar, Tony Jebara, Shih-Fu Chang |
| 2012 | CVPR | Exploiting web images for event recognition in consumer videos: A multiple source domain adaptation approach. | Lixin Duan, Dong Xu, Shih-Fu Chang |
| 2012 | CVPR | Mobile product search with Bag of Hash Bits and boundary reranking. | Junfeng He, Jinyuan Feng, Xianglong Liu, Tao Cheng, Tai-Hsu Lin, Hyunjin Chung, Shih-Fu Chang |
| 2012 | CVPR | Spherical hashing. | Jae-Pil Heo, Youngwoon Lee, Junfeng He, Shih-Fu Chang, Sung-Eui Yoon |
| 2012 | CVPR | Robust visual domain adaptation with low-rank reconstruction. | I-Hong Jhuo, Dong Liu, D. T. Lee, Shih-Fu Chang |
| 2012 | CVPR | Supervised hashing with kernels. | Wei Liu, Jun Wang, Rongrong Ji, Yu-Gang Jiang, Shih-Fu Chang |
| 2012 | CVPR | Segmentation using superpixels: A bipartite graph partitioning approach. | Zhenguo Li, Xiao-Ming Wu, Shih-Fu Chang |
| 2012 | CVPR | Robust late fusion with rank minimization. | Guangnan Ye, Dong Liu, I-Hong Jhuo, Shih-Fu Chang |
| 2012 | CVPR | Weak attributes for large-scale image retrieval. | Felix X. Yu, Rongrong Ji, Ming-Hen Tsai, Guangnan Ye, Shih-Fu Chang |
| 2012 | ECCV | Scene Aligned Pooling for Complex Video Recognition. | Liangliang Cao, Yadong Mu, Apostol Natsev, Shih-Fu Chang, Gang Hua, John R. Smith |
| 2012 | ECCV | Accelerated Large Scale Optimization by Concomitant Hashing. | Yadong Mu, John Wright, Shih-Fu Chang |
| 2012 | ICML | On the Difficulty of Nearest Neighbor Search. | Junfeng He, Sanjiv Kumar, Shih-Fu Chang |
| 2012 | ICML | Compact Hyperplane Hashing with Bilinear Functions. | Wei Liu, Jun Wang, Yadong Mu, Sanjiv Kumar, Shih-Fu Chang |
| 2011 | CVPR | Compact hashing with joint optimization of search accuracy and time. | Junfeng He, Shih-Fu Chang, Regunathan Radhakrishnan, Claus Bauer |
| 2011 | CVPR | Noise resistant graph ranking for improved web image search. | Wei Liu, Yu-Gang Jiang, Jiebo Luo, Shih-Fu Chang |
| 2011 | ICCV | Learning component-level sparse representation using histogram information for image classification. | Chen-Kuo Chiang, Chih-Hsueh Duan, Shang-Hong Lai, Shih-Fu Chang |
| 2011 | ICDM | Towards Optimal Discriminating Order for Multiclass Classification. | Dong Liu, Shuicheng Yan, Yadong Mu, Xian-Sheng Hua, Shih-Fu Chang, Hong-Jiang Zhang |
| 2011 | ICML | Hashing with Graphs. | Wei Liu, Jun Wang, Sanjiv Kumar, Shih-Fu Chang |
| 2010 | CVPR | Semi-supervised hashing for scalable image retrieval. | Jun Wang, Ondrej Kumar, Shih-Fu Chang |
| 2010 | ICML | Large Graph Construction for Scalable Semi-Supervised Learning. | Wei Liu, Junfeng He, Shih-Fu Chang |
| 2010 | ICML | Sequential Projection Learning for Hashing with Compact Codes. | Jun Wang, Sanjiv Kumar, Shih-Fu Chang |
| 2010 | KDD | Scalable similarity search with optimized kernel hashing. | Junfeng He, Wei Liu, Shih-Fu Chang |
| 2009 | CVPR | Robust multi-class transductive learning with graphs. | Wei Liu, Shih-Fu Chang |
| 2009 | CVPR | Label diagnosis through self tuning forweb image search. | Jun Wang, Yu-Gang Jiang, Shih-Fu Chang |
| 2009 | ICASSP | Visual saliency with side information. | Wei Jiang, Lexing Xie, Shih-Fu Chang |
| 2009 | ICCV | Domain adaptive semantic diffusion for large scale context-based video annotation. | Yu-Gang Jiang, Jun Wang, Shih-Fu Chang, Chong-Wah Ngo |
| 2009 | ICML | Graph construction and | Tony Jebara, Jun Wang, Shih-Fu Chang |
| 2008 | ACSSC | Statistical fusion of multiple cues for image tampering detection. | Yu-Feng Hsu, Shih-Fu Chang |
| 2008 | CVPR | Fast kernel learning for spatial pyramid matching. | Junfeng He, Shih-Fu Chang, Lexing Xie |
| 2008 | CVPR | Semi-supervised distance metric learning for Collaborative Image Retrieval. | Steven C. H. Hoi, Wei Liu, Shih-Fu Chang |
| 2008 | CVPR | Active microscopic cellular image annotation by superposable graph transduction with imbalanced labels. | Jun Wang, Shih-Fu Chang, Xiaobo Zhou, Stephen T. C. Wong |
| 2008 | CVPR | Near duplicate image identification with patially Aligned Pyramid Matching. | Dong Xu, Tat-Jen Cham, Shuicheng Yan, Shih-Fu Chang |
| 2008 | ECCV | Semantic Concept Classification by Joint Semi-supervised Learning of Feature Subspaces and Support Vector Machines. | Wei Jiang, Shih-Fu Chang, Tony Jebara, Alexander C. Loui |
| 2008 | ICIP | Cross-domain learning methods for high-level visual concept classification. | Wei Jiang, Eric Zavesky, Shih-Fu Chang, Alexander C. Loui |
| 2008 | ICML | Graph transduction via alternating minimization. | Jun Wang, Tony Jebara, Shih-Fu Chang |
| 2007 | CVPR | Kernel Sharing With Joint Boosting For Multi-Class Concept Detection. | Wei Jiang, Shih-Fu Chang, Alexander C. Loui |
| 2007 | CVPR | Using Geometry Invariants for Camera Response Function Estimation. | Tian-Tsong Ng, Shih-Fu Chang, Mao-Pei Tsui |
| 2007 | CVPR | Visual Event Recognition in News Video using Kernel Methods with Multi-Level Temporal Alignment. | Dong Xu, Shih-Fu Chang |
| 2007 | CVPR | Element Rearrangement for Tensor-Based Subspace Learning. | Shuicheng Yan, Dong Xu, Stephen Lin, Thomas S. Huang, Shih-Fu Chang |
| 2007 | ICASSP | Recent Advances and Challenges of Semantic Image/Video Search. | Shih-Fu Chang, Wei-Ying Ma, Arnold W. M. Smeulders |
| 2007 | ICASSP | Context-Based Concept Fusion with Boosted Conditional Random Fields. | Wei Jiang, Shih-Fu Chang, Alexander C. Loui |
| 2006 | CVPR | A Generative-Discriminative Hybrid Method for Multi-View Object Detection. | DongQing Zhang, Shih-Fu Chang |
| 2006 | ECCV | Modeling the Activity Pattern of the Constellation of Cardiac Chambers in Echocardiogram Videos. | Shahram Ebadollahi, Shih-Fu Chang, Henry D. Wu |
| 2006 | ICASSP | Complexity Adaptive H.264 Encoding for Light Weight Streams. | Yong Wang, Shih-Fu Chang |
| 2006 | ICIP | Topic Tracking Across Broadcast News Videos with Visual Duplicates and Semantic Concepts. | Winston H. Hsu, Shih-Fu Chang |
| 2006 | ICIP | Active Context-Based Concept Fusionwith Partial User Labels. | Wei Jiang, Shih-Fu Chang, Alexander C. Loui |
| 2005 | ICASSP | Combining text and audio-visual features in video indexing. | Shih-Fu Chang, R. Manmatha, Tat-Seng Chua |
| 2005 | ICASSP | Commercial Detection in Heterogeneous Video Streams Using Fused Multi-Modal and Temporal Features. | Masami Mizutani, Shahram Ebadollahi, Shih-Fu Chang |
| 2005 | ICASSP | Layered dynamic mixture model for pattern discovery in asynchronous multi-modal streams [video applications]. | Lexing Xie, Lyndon S. Kennedy, Shih-Fu Chang, Ajay Divakaran, Huifang Sun, Ching-Yung Lin |
| 2005 | MMM | A Framework for Sub-Window Shot Detection. | Chuohao Yeo, Yongwei Zhu, Qibin Sun, Shih-Fu Chang |
| 2004 | CVPR | Automatic View Recognition in Echocardiogram Videos Using Parts-Based Representation. | Shahram Ebadollahi, Shih-Fu Chang, Henry D. Wu |
| 2004 | CVPR | Learning to Detect Scene Text Using a Higher-Order MRF with Belief Propagation. | Dong-Qing Zhang, Shih-Fu Chang |
| 2004 | ICASSP | News video story segmentation using fusion of multi-level multi-modal features in TRECVID 2003. | Winston H. Hsu, Lyndon S. Kennedy, Chih-Wei Huang, Shih-Fu Chang, Ching-Yung Lin, Giridharan Iyengar |
| 2004 | ICIP | Video mining: pattern discovery versus pattern recognition. | Ajay Divakaran, Kadir A. Peker, Shih-Fu Chang, Regunathan Radhakrishnan, Lexing Xie |
| 2004 | ICIP | A model for image splicing. | Tian-Tsong Ng, Shih-Fu Chang |
| 2004 | ICIP | Discovering meaningful multimedia patterns with audio-visual concepts and associated text. | Lexing Xie, Lyndon S. Kennedy, Shih-Fu Chang, Ajay Divakaran, Huifang Sun, Ching-Yung Lin |
| 2004 | ISCAS | Blind detection of photomontage using higher order statistics. | Tian-Tsong Ng, Shih-Fu Chang, Qibin Sun |
| 2004 | VCIP | Predicting optimal operation of MC-3DSBC multidimensional scalable video coding using subjective quality measurement. | Yong Wang, Tian-Tsong Ng, Mihaela van der Schaar, Shih-Fu Chang |
| 2003 | CVPR | A Bayesian Framework for Fusing Multiple Word Knowledge Models in Videotext Recognition. | DongQing Zhang, Shih-Fu Chang |
| 2003 | ICIAP | Content-based video summarization and adaptation for ubiquitous media access. | Shih-Fu Chang |
| 2003 | ICIP | Image classification using multimedia knowledge networks. | Ana B. Benitez, Shih-Fu Chang |
| 2003 | ICIP | Content-based utility function prediction for real-time MPEG-4 video transcoding. | Yong Wang, Jae-Gon Kim, Shih-Fu Chang |
| 2003 | ICIP | Feature selection for unsupervised discovery of statistical temporal structures in video. | Lexing Xie, Shih-Fu Chang, Ajay Divakaran, Huifang Sun |
| 2002 | ICASSP | Structure analysis of soccer video with hidden Markov models. | Lexing Xie, Shih-Fu Chang, Ajay Divakaran, Huifang Sun |
| 2002 | ICIP | Echocardiogram videos: summarization, temporal segmentation and browsing. | Shahram Ebadollahi, Shih-Fu Chang, Henry D. Wu |
| 2002 | ICIP | Semi-fragile image authentication using generic wavelet domain features and ECC. | Qibin Sun, Shih-Fu Chang |
| 2002 | ICIP | A quantitative semi-fragile JPEG2000 image authentication system. | Qibin Sun, Shih-Fu Chang, Kurato Maeno, Masayuki Suto |
| 2002 | ICIP | Video skims: taxonomies and an optimal generation framework. | Hari Sundaram, Shih-Fu Chang |
| 2002 | ICIP | General and domain-specific techniques for detecting and recognizing superimposed text in video. | DongQing Zhang, Raj Kumar Rajendran, Shih-Fu Chang |
| 2002 | ISCAS | FGS+: optimizing the joint SNR-temporal video quality in MPEG-4 fine grained scalable coding. | Raj Kumar Rajendran, Mihaela van der Schaar, Shih-Fu Chang |
| 2002 | KDD | Multimedia Knowledge Integration, Summarization And Evaluation. | Ana B. Benitez, Shih-Fu Chang |
| 2001 | CAIP | MPEG-7 MDS Content Description Tools and Applications. | Ana B. Benitez, Di Zhong, Shih-Fu Chang, John R. Smith |
| 2001 | ICIP | VISMap: an interactive image/video retrieval system using visualization and concept maps. | William Chen, Shih-Fu Chang |
| 2001 | ICIP | Zero-error information hiding capacity of digital images. | Ching-Yung Lin, Shih-Fu Chang |
| 2001 | ICIP | Long-term moving object segmentation and tracking using spatio-temporal consistency. | Di Zhong, Shih-Fu Chang |
| 2000 | ICASSP | Audio scene segmentation using multiple features, models and time scales. | Hari Sundaram, Shih-Fu Chang |
| 2000 | ICIP | Discovering Recurrent Visual Semantics in Consumer Photographs. | Alejandro Jaimes, Ana B. Benitez, Shih-Fu Chang, Alexander C. Loui |
| 2000 | ICIP | Experiments in Constructing Belief Networks for Image Classification Systems. | Seungyup Paek, Shih-Fu Chang |
| 2000 | ISCAS | Principles and applications of content-aware video communication. | Shih-Fu Chang, Paul Bocheck |
| 1999 | ICIP | Region Feature Based Similarity Searching of Semantic Video Objects. | Di Zhong, Shih-Fu Chang |
| 1998 | ICASSP | Digital image/video library and MPEG-7: standardization and research issues. | Yong Rui, Thomas S. Huang, Shih-Fu Chang |
| 1998 | ICIP | Semantic Visual Templates: Linking Visual Features to Semantics. | Shih-Fu Chang, William Chen, Hari Sundaram |
| 1998 | ICIP | Embedding Visible Video Watermarks in the Compressed Domain. | Jianhao Meng, Shih-Fu Chang |
| 1998 | ICIP | Video Transcoding for Resilience in Wireless Channels. | Gustavo de los Reyes, Amy R. Reibman, Justin C.-I. Chuang, Shih-Fu Chang |
| 1998 | ICIP | AMOS: An Active System for MPEG-4 Video Object Segmentation. | Di Zhong, Shih-Fu Chang |
| 1998 | WACV | VideoQ: a fully automated video retrieval system using motion sketches. | Shih-Fu Chang, William Chen, Hari Sundaram |
| 1997 | ICIP | Exploring Image Functionalities in WWW Applications- Development of Image/Video Search and Editing Engines. | Shih-Fu Chang, John R. Smith, Horace J. Meng |
| 1997 | ICIP | Joint adaptive space and frequency basis selection. | John R. Smith, Shih-Fu Chang |
| 1997 | ICIP | Spatio-Temporal Video Search Using the Object-Based Video Representation. | Di Zhong, Shih-Fu Chang |
| 1997 | MMSP | A distributed system for editing and browsing compressed video over the network. | Horace J. Meng, Di Zhong, Shih-Fu Chang |
| 1997 | MMSP | WebClip: a WWW video editing/browsing system. | Horace J. Meng, Di Zhong, Shih-Fu Chang |
| 1997 | MMSP | SaFe: a general framework for integrated spatial and feature image search. | John R. Smith, Shih-Fu Chang |
| 1997 | MMSP | Enhancing image search engines in visual information environments. | John R. Smith, Shih-Fu Chang |
| 1996 | DCC | Hybrid Block-Based/Segment-Based Video Compression at very Low Bitrate. | Chung-Tao Chu, Dimitris Anastassiou, Shih-Fu Chang |
| 1996 | ICASSP | Automated binary texture feature sets for image retrieval. | John R. Smith, Shih-Fu Chang |
| 1996 | ICIP | A content based video traffic model using camera operations. | Paul Bocheck, Shih-Fu Chang |
| 1996 | ICIP | A robust content based digital signature for image authentication. | Marc Schneider, Shih-Fu Chang |
| 1996 | ICIP | Local color and texture extraction and spatial query. | John R. Smith, Shih-Fu Chang |
| 1995 | ICASSP | Frequency and spatially adaptive wavelet packets. | John R. Smith, Shih-Fu Chang |
| 1995 | ICIP | Compressed-domain techniques for image/video indexing and manipulation. | Shih-Fu Chang |
| 1995 | ICIP | Single color extraction and image query. | John R. Smith, Shih-Fu Chang |
| 1995 | NOSSDAV | Scalable MPEG2 Video Servers with Heterogeneous QoS on Parallel Disk Arrays. | Seungyup Paek, Paul Bocheck, Shih-Fu Chang |
| 1994 | ICIP | Transform Features for Texture Classification and Discrimination in Large Image Databases. | John R. Smith, Shih-Fu Chang |
| 1994 | ISCAS | Error Accumulation of Repetitive Image Coding. | Shih-Fu Chang, Alexandros Eleftheriadis |
| 1993 | ICASSP | A new approach to decoding and compositing motion-compensated DCT-based images. | Shih-Fu Chang, David G. Messerschmitt |
| 1991 | ICCD | VLSI Designs for High-Speed Huffman Decoder. | Shih-Fu Chang, David G. Messerschmitt |