Po-Yao Huang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
24
Venues
14
Active years
2014–2024
Best venue rank
A*
Where they publish
Papers
24 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | ACL | VoiceCraft: Zero-Shot Speech Editing and Text-to-Speech in the Wild. | Puyuan Peng, Po-Yao Huang, Shang-Wen Li, Abdelrahman Mohamed, David Harwath |
| 2024 | CVPR | MoDE: CLIP Data Experts via Clustering. | Jiawei Ma, Po-Yao Huang, Saining Xie, Shang-Wen Li, Luke Zettlemoyer, Shih-Fu Chang, Wen-Tau Yih, Hu Xu |
| 2024 | ECCV | Self-Supervised Audio-Visual Soundscape Stylization. | Tingle Li, Renhao Wang, Po-Yao Huang, Andrew Owens, Gopala Anumanchipalli |
| 2024 | EMNLP | Altogether: Image Captioning via Re-aligning Alt-text. | Hu Xu, Po-Yao Huang, Xiaoqing Ellen Tan, Ching-Feng Yeh, Jacob Kahn, Christine Jou, Gargi Ghosh, Omer Levy, Luke Zettlemoyer, Wen-tau Yih, Shang-Wen Li, Saining Xie, Christoph Feichtenhofer |
| 2024 | ICLR | Demystifying CLIP Data. | Hu Xu, Saining Xie, Xiaoqing Ellen Tan, Po-Yao Huang, Russell Howes, Vasu Sharma, Shang-Wen Li, Gargi Ghosh, Luke Zettlemoyer, Christoph Feichtenhofer |
| 2023 | ACL | Generating Hashtags for Short-form Videos with Guided Signals. | Tiezheng Yu, Hanchao Yu, Davis Liang, Yuning Mao, Shaoliang Nie, Po-Yao Huang, Madian Khabsa, Pascale Fung, Yi-Chia Wang |
| 2023 | ASRU | Flap: Fast Language-Audio Pre-Training. | Ching-Feng Yeh, Po-Yao Huang, Vasu Sharma, Shang-Wen Li, Gargi Ghosh |
| 2023 | CVPR | STMT: A Spatial-Temporal Mesh Transformer for MoCap-Based Action Recognition. | Xiaoyu Zhu, Po-Yao Huang, Junwei Liang, Celso M. de Melo, Alexander G. Hauptmann |
| 2023 | ICCV | CiT: Curation in Training for Effective Vision-Language Data. | Hu Xu, Saining Xie, Po-Yao Huang, Licheng Yu, Russell Howes, Gargi Ghosh, Luke Zettlemoyer, Christoph Feichtenhofer |
| 2023 | ICCV | Diffusion Models as Masked Autoencoders. | Chen Wei, Karttikeya Mangalam, Po-Yao Huang, Yanghao Li, Haoqi Fan, Hu Xu, Huiyu Wang, Cihang Xie, Alan L. Yuille, Christoph Feichtenhofer |
| 2023 | ICML | Hiera: A Hierarchical Vision Transformer without the Bells-and-Whistles. | Chaitanya Ryali, Yuan-Ting Hu, Daniel Bolya, Chen Wei, Haoqi Fan, Po-Yao Huang, Vaibhav Aggarwal, Arkabandhu Chowdhury, Omid Poursaeed, Judy Hoffman, Jitendra Malik, Yanghao Li, Christoph Feichtenhofer |
| 2022 | Interspeech | AudioTagging Done Right: 2nd comparison of deep learning methods for environmental sound classification. | Juncheng Li, Shuhui Qu, Po-Yao Huang, Florian Metze |
| 2021 | ACL | VLM: Task-agnostic Video-Language Model Pre-training for Video Understanding. | Hu Xu, Gargi Ghosh, Po-Yao Huang, Prahal Arora, Masoumeh Aminzadeh, Christoph Feichtenhofer, Florian Metze, Luke Zettlemoyer |
| 2021 | EMNLP | VideoCLIP: Contrastive Pre-training for Zero-shot Video-Text Understanding. | Hu Xu, Gargi Ghosh, Po-Yao Huang, Dmytro Okhonko, Armen Aghajanyan, Florian Metze, Luke Zettlemoyer, Christoph Feichtenhofer |
| 2021 | ICASSP | Audio-Visual Event Recognition Through the Lens of Adversary. | Juncheng B. Li, Kaixin Ma, Shuhui Qu, Po-Yao Huang, Florian Metze |
| 2021 | ICCV | Space-Time Crop & Attend: Improving Cross-modal Video Representation Learning. | Mandela Patrick, Po-Yao Huang, Ishan Misra, Florian Metze, Andrea Vedaldi, Yuki M. Asano, Joo F. Henriques |
| 2021 | ICLR | Support-set bottlenecks for video-text representation learning. | Mandela Patrick, Po-Yao Huang, Yuki Markus Asano, Florian Metze, Alexander G. Hauptmann, Joo F. Henriques, Andrea Vedaldi |
| 2020 | ACL | Unsupervised Multimodal Neural Machine Translation with Pseudo Visual Pivoting. | Po-Yao Huang, Junjie Hu, Xiaojun Chang, Alexander G. Hauptmann |
| 2020 | WACV | Argus: Efficient Activity Detection System for Extended Video Analysis. | Wenhe Liu, Guoliang Kang, Po-Yao Huang, Xiaojun Chang, Lijun Yu, Yijun Qian, Junwei Liang, Liangke Gui, Jing Wen, Peng Chen, Alexander G. Hauptmann |
| 2019 | EMNLP | Multi-Head Attention with Diversity for Learning Grounded Multilingual Multimodal Representations. | Po-Yao Huang, Xiaojun Chang, Alexander G. Hauptmann |
| 2018 | ECCV | RCAA: Relational Context-Aware Agents for Person Search. | Xiaojun Chang, Po-Yao Huang, Yi-Dong Shen, Xiaodan Liang, Yi Yang, Alexander G. Hauptmann |
| 2018 | SiggraphA | Panoramic depth reconstruction within a single shot by optimizing global sphere radii. | Po-Yao Huang, Hong Shiang Lin, Sun-Yu Gordon Chi, Liang-Han Lin, Ming Ouhyoung |
| 2015 | Qshine | Cognitive vertical handover in heterogeneous networks. | Yu-Jui Liu, Shin-Ming Cheng, Po-Yao Huang |
| 2014 | IWCMC | Cognitive access in multichannel wireless networks using two-dimension Markov chain. | Han-Feng Lin, Shin-Ming Cheng, Po-Yao Huang |