Hexiang Hu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
31
Venues
9
Active years
2016–2025
Best venue rank
A*
Where they publish
Papers
31 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | CVPR | Scaling Inference Time Compute for Diffusion Models. | Nanye Ma, Shangyuan Tong, Haolin Jia, Hexiang Hu, Yu-Chuan Su, Mingda Zhang, Xuan Yang, Yandong Li, Tommi S. Jaakkola, Xuhui Jia, Saining Xie |
| 2025 | ICLR | OmnixR: Evaluating Omni-modality Language Models on Reasoning across Modalities. | Lichang Chen, Hexiang Hu, Mingda Zhang, Yiwen Chen, Zifeng Wang, Yandong Li, Pranav Shyam, Tianyi Zhou, Heng Huang, Ming-Hsuan Yang, Boqing Gong |
| 2025 | ICLR | MEGA-Bench: Scaling Multimodal Evaluation to over 500 Real-World Tasks. | Jiacheng Chen, Tianhao Liang, Sherman Siu, Zhengqing Wang, Kai Wang, Yubo Wang, Yuansheng Ni, Ziyan Jiang, Wang Zhu, Bohan Lyu, Dongfu Jiang, Xuan He, Yuan Liu, Hexiang Hu, Xiang Yue, Wenhu Chen |
| 2025 | NAACL | LOFT: Scalable and More Realistic Long-Context Evaluation. | Jinhyuk Lee, Anthony Chen, Zhuyun Dai, Dheeru Dua, Devendra Singh Sachan, Michael Boratko, Yi Luan, Sbastien M. R. Arnold, Vincent Perot, Siddharth Dalmia, Hexiang Hu, Xudong Lin, Panupong Pasupat, Aida Amini, Jeremy R. Cole, Sebastian Riedel, Iftekhar Naim, Ming-Wei Chang, Kelvin Guu |
| 2024 | CVPR | On Scaling Up a Multilingual Vision and Language Model. | Xi Chen, Josip Djolonga, Piotr Padlewski, Basil Mustafa, Soravit Changpinyo, Jialin Wu, Carlos Riquelme Ruiz, Sebastian Goodman, Xiao Wang, Yi Tay, Siamak Shakeri, Mostafa Dehghani, Daniel Salz, Mario Lucic, Michael Tschannen, Arsha Nagrani, Hexiang Hu, Mandar Joshi, Bo Pang, Ceslee Montgomery, Paulina Pietrzyk, Marvin Ritter, A. J. Piergiovanni, Matthias Minderer, Filip Pavetic, Austin Waters, Gang Li, Ibrahim Alabdulmohsin, Lucas Beyer, Julien Amelot, Kenton Lee, Andreas Peter Steiner, Yang Li, Daniel Keysers, Anurag Arnab, Yuanzhong Xu, Keran Rong, Alexander Kolesnikov, Mojtaba Seyedhosseini, Anelia Angelova, Xiaohua Zhai, Neil Houlsby, Radu Soricut |
| 2024 | CVPR | Instruct-Imagen: Image Generation with Multi-modal Instruction. | Hexiang Hu, Kelvin C. K. Chan, Yu-Chuan Su, Wenhu Chen, Yandong Li, Kihyuk Sohn, Yang Zhao, Xue Ben, Boqing Gong, William W. Cohen, Ming-Wei Chang, Xuhui Jia |
| 2024 | ECCV | UniIR: Training and Benchmarking Universal Multimodal Information Retrievers. | Cong Wei, Yang Chen, Haonan Chen, Hexiang Hu, Ge Zhang, Jie Fu, Alan Ritter, Wenhu Chen |
| 2024 | ICML | MagicLens: Self-Supervised Image Retrieval with Open-Ended Instructions. | Kai Zhang, Yi Luan, Hexiang Hu, Kenton Lee, Siyuan Qiao, Wenhu Chen, Yu Su, Ming-Wei Chang |
| 2023 | EMNLP | Can Pre-trained Vision and Language Models Answer Visual Information-Seeking Questions? | Yang Chen, Hexiang Hu, Yi Luan, Haitian Sun, Soravit Changpinyo, Alan Ritter, Ming-Wei Chang |
| 2023 | ICCV | Open-domain Visual Entity Recognition: Towards Recognizing Millions of Wikipedia Entities. | Hexiang Hu, Yi Luan, Yang Chen, Urvashi Khandelwal, Mandar Joshi, Kenton Lee, Kristina Toutanova, Ming-Wei Chang |
| 2023 | ICCV | PreSTU: Pre-Training for Scene-Text Understanding. | Jihyung Kil, Soravit Changpinyo, Xi Chen, Hexiang Hu, Sebastian Goodman, Wei-Lun Chao, Radu Soricut |
| 2023 | ICLR | Re-Imagen: Retrieval-Augmented Text-to-Image Generator. | Wenhu Chen, Hexiang Hu, Chitwan Saharia, William W. Cohen |
| 2023 | ICML | Pix2Struct: Screenshot Parsing as Pretraining for Visual Language Understanding. | Kenton Lee, Mandar Joshi, Iulia Raluca Turc, Hexiang Hu, Fangyu Liu, Julian Martin Eisenschlos, Urvashi Khandelwal, Peter Shaw, Ming-Wei Chang, Kristina Toutanova |
| 2022 | EMNLP | MuRAG: Multimodal Retrieval-Augmented Generator for Open Question Answering over Images and Text. | Wenhu Chen, Hexiang Hu, Xi Chen, Pat Verga, William W. Cohen |
| 2021 | CVPR | Learning the Best Pooling Strategy for Visual Semantic Embedding. | Jiacheng Chen, Hexiang Hu, Hao Wu, Yuning Jiang, Changhu Wang |
| 2021 | EMNLP | Visually Grounded Concept Composition. | Bowen Zhang, Hexiang Hu, Linlu Qiu, Peter Shaw, Fei Sha |
| 2021 | EMNLP | Systematic Generalization on gSCAN: What is Nearly Solved and What is Next? | Linlu Qiu, Hexiang Hu, Bowen Zhang, Peter Shaw, Fei Sha |
| 2021 | ICCV | MosaicOS: A Simple and Effective Use of Object-Centric Images for Long-Tailed Object Detection. | Cheng Zhang, Tai-Yu Pan, Yandong Li, Hexiang Hu, Dong Xuan, Soravit Changpinyo, Boqing Gong, Wei-Lun Chao |
| 2020 | ACL | BabyWalk: Going Farther in Vision-and-Language Navigation by Taking Baby Steps. | Wang Zhu, Hexiang Hu, Jiacheng Chen, Zhiwei Deng, Vihan Jain, Eugene Ie, Fei Sha |
| 2020 | CVPR | Few-Shot Learning via Embedding Adaptation With Set-to-Set Functions. | Han-Jia Ye, Hexiang Hu, De-Chuan Zhan, Fei Sha |
| 2020 | EMNLP | Learning to Represent Image and Text with Denotation Graph. | Bowen Zhang, Hexiang Hu, Vihan Jain, Eugene Ie, Fei Sha |
| 2019 | CVPR | Engaging Image Captioning via Personality. | Kurt Shuster, Samuel Humeau, Hexiang Hu, Antoine Bordes, Jason Weston |
| 2018 | COLING | Multi-Task Learning for Sequence Tagging: An Empirical Study. | Soravit Changpinyo, Hexiang Hu, Fei Sha |
| 2018 | CVPR | Cross-Dataset Adaptation for Visual Question Answering. | Wei-Lun Chao, Hexiang Hu, Fei Sha |
| 2018 | CVPR | Learning Answer Embeddings for Visual Question Answering. | Hexiang Hu, Wei-Lun Chao, Fei Sha |
| 2018 | CVPR | Compressed Video Action Recognition. | Chao-Yuan Wu, Manzil Zaheer, Hexiang Hu, R. Manmatha, Alexander J. Smola, Philipp Krhenbhl |
| 2018 | ECCV | Cross-Modal and Hierarchical Modeling of Video and Text. | Bowen Zhang, Hexiang Hu, Fei Sha |
| 2018 | NAACL | Being Negative but Constructively: Lessons Learnt from Creating Better Visual Question Answering Datasets. | Wei-Lun Chao, Hexiang Hu, Fei Sha |
| 2017 | CVPR | FastMask: Segment Multi-scale Object Candidates in One Shot. | Hexiang Hu, Shiyi Lan, Yuning Jiang, Zhimin Cao, Fei Sha |
| 2016 | CVPR | Structure Inference Machines: Recurrent Neural Networks for Analyzing Relations in Group Activity Recognition. | Zhiwei Deng, Arash Vahdat, Hexiang Hu, Greg Mori |
| 2016 | CVPR | Learning Structured Inference Neural Networks with Label Relations. | Hexiang Hu, Guang-Tong Zhou, Zhiwei Deng, Zicheng Liao, Greg Mori |