Skip to content

Po-Yao Huang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

24

Venues

14

Active years

2014–2024

Best venue rank

A*

Where they publish

Papers

24 indexed papers, newest first.

YearVenueTitleAuthors
2024ACLVoiceCraft: Zero-Shot Speech Editing and Text-to-Speech in the Wild.Puyuan Peng, Po-Yao Huang, Shang-Wen Li, Abdelrahman Mohamed, David Harwath
2024CVPRMoDE: CLIP Data Experts via Clustering.Jiawei Ma, Po-Yao Huang, Saining Xie, Shang-Wen Li, Luke Zettlemoyer, Shih-Fu Chang, Wen-Tau Yih, Hu Xu
2024ECCVSelf-Supervised Audio-Visual Soundscape Stylization.Tingle Li, Renhao Wang, Po-Yao Huang, Andrew Owens, Gopala Anumanchipalli
2024EMNLPAltogether: Image Captioning via Re-aligning Alt-text.Hu Xu, Po-Yao Huang, Xiaoqing Ellen Tan, Ching-Feng Yeh, Jacob Kahn, Christine Jou, Gargi Ghosh, Omer Levy, Luke Zettlemoyer, Wen-tau Yih, Shang-Wen Li, Saining Xie, Christoph Feichtenhofer
2024ICLRDemystifying CLIP Data.Hu Xu, Saining Xie, Xiaoqing Ellen Tan, Po-Yao Huang, Russell Howes, Vasu Sharma, Shang-Wen Li, Gargi Ghosh, Luke Zettlemoyer, Christoph Feichtenhofer
2023ACLGenerating Hashtags for Short-form Videos with Guided Signals.Tiezheng Yu, Hanchao Yu, Davis Liang, Yuning Mao, Shaoliang Nie, Po-Yao Huang, Madian Khabsa, Pascale Fung, Yi-Chia Wang
2023ASRUFlap: Fast Language-Audio Pre-Training.Ching-Feng Yeh, Po-Yao Huang, Vasu Sharma, Shang-Wen Li, Gargi Ghosh
2023CVPRSTMT: A Spatial-Temporal Mesh Transformer for MoCap-Based Action Recognition.Xiaoyu Zhu, Po-Yao Huang, Junwei Liang, Celso M. de Melo, Alexander G. Hauptmann
2023ICCVCiT: Curation in Training for Effective Vision-Language Data.Hu Xu, Saining Xie, Po-Yao Huang, Licheng Yu, Russell Howes, Gargi Ghosh, Luke Zettlemoyer, Christoph Feichtenhofer
2023ICCVDiffusion Models as Masked Autoencoders.Chen Wei, Karttikeya Mangalam, Po-Yao Huang, Yanghao Li, Haoqi Fan, Hu Xu, Huiyu Wang, Cihang Xie, Alan L. Yuille, Christoph Feichtenhofer
2023ICMLHiera: A Hierarchical Vision Transformer without the Bells-and-Whistles.Chaitanya Ryali, Yuan-Ting Hu, Daniel Bolya, Chen Wei, Haoqi Fan, Po-Yao Huang, Vaibhav Aggarwal, Arkabandhu Chowdhury, Omid Poursaeed, Judy Hoffman, Jitendra Malik, Yanghao Li, Christoph Feichtenhofer
2022InterspeechAudioTagging Done Right: 2nd comparison of deep learning methods for environmental sound classification.Juncheng Li, Shuhui Qu, Po-Yao Huang, Florian Metze
2021ACLVLM: Task-agnostic Video-Language Model Pre-training for Video Understanding.Hu Xu, Gargi Ghosh, Po-Yao Huang, Prahal Arora, Masoumeh Aminzadeh, Christoph Feichtenhofer, Florian Metze, Luke Zettlemoyer
2021EMNLPVideoCLIP: Contrastive Pre-training for Zero-shot Video-Text Understanding.Hu Xu, Gargi Ghosh, Po-Yao Huang, Dmytro Okhonko, Armen Aghajanyan, Florian Metze, Luke Zettlemoyer, Christoph Feichtenhofer
2021ICASSPAudio-Visual Event Recognition Through the Lens of Adversary.Juncheng B. Li, Kaixin Ma, Shuhui Qu, Po-Yao Huang, Florian Metze
2021ICCVSpace-Time Crop & Attend: Improving Cross-modal Video Representation Learning.Mandela Patrick, Po-Yao Huang, Ishan Misra, Florian Metze, Andrea Vedaldi, Yuki M. Asano, Joo F. Henriques
2021ICLRSupport-set bottlenecks for video-text representation learning.Mandela Patrick, Po-Yao Huang, Yuki Markus Asano, Florian Metze, Alexander G. Hauptmann, Joo F. Henriques, Andrea Vedaldi
2020ACLUnsupervised Multimodal Neural Machine Translation with Pseudo Visual Pivoting.Po-Yao Huang, Junjie Hu, Xiaojun Chang, Alexander G. Hauptmann
2020WACVArgus: Efficient Activity Detection System for Extended Video Analysis.Wenhe Liu, Guoliang Kang, Po-Yao Huang, Xiaojun Chang, Lijun Yu, Yijun Qian, Junwei Liang, Liangke Gui, Jing Wen, Peng Chen, Alexander G. Hauptmann
2019EMNLPMulti-Head Attention with Diversity for Learning Grounded Multilingual Multimodal Representations.Po-Yao Huang, Xiaojun Chang, Alexander G. Hauptmann
2018ECCVRCAA: Relational Context-Aware Agents for Person Search.Xiaojun Chang, Po-Yao Huang, Yi-Dong Shen, Xiaodan Liang, Yi Yang, Alexander G. Hauptmann
2018SiggraphAPanoramic depth reconstruction within a single shot by optimizing global sphere radii.Po-Yao Huang, Hong Shiang Lin, Sun-Yu Gordon Chi, Liang-Han Lin, Ming Ouhyoung
2015QshineCognitive vertical handover in heterogeneous networks.Yu-Jui Liu, Shin-Ming Cheng, Po-Yao Huang
2014IWCMCCognitive access in multichannel wireless networks using two-dimension Markov chain.Han-Feng Lin, Shin-Ming Cheng, Po-Yao Huang