Skip to content

Hexiang Hu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

31

Venues

9

Active years

2016–2025

Best venue rank

A*

Where they publish

Papers

31 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRScaling Inference Time Compute for Diffusion Models.Nanye Ma, Shangyuan Tong, Haolin Jia, Hexiang Hu, Yu-Chuan Su, Mingda Zhang, Xuan Yang, Yandong Li, Tommi S. Jaakkola, Xuhui Jia, Saining Xie
2025ICLROmnixR: Evaluating Omni-modality Language Models on Reasoning across Modalities.Lichang Chen, Hexiang Hu, Mingda Zhang, Yiwen Chen, Zifeng Wang, Yandong Li, Pranav Shyam, Tianyi Zhou, Heng Huang, Ming-Hsuan Yang, Boqing Gong
2025ICLRMEGA-Bench: Scaling Multimodal Evaluation to over 500 Real-World Tasks.Jiacheng Chen, Tianhao Liang, Sherman Siu, Zhengqing Wang, Kai Wang, Yubo Wang, Yuansheng Ni, Ziyan Jiang, Wang Zhu, Bohan Lyu, Dongfu Jiang, Xuan He, Yuan Liu, Hexiang Hu, Xiang Yue, Wenhu Chen
2025NAACLLOFT: Scalable and More Realistic Long-Context Evaluation.Jinhyuk Lee, Anthony Chen, Zhuyun Dai, Dheeru Dua, Devendra Singh Sachan, Michael Boratko, Yi Luan, Sbastien M. R. Arnold, Vincent Perot, Siddharth Dalmia, Hexiang Hu, Xudong Lin, Panupong Pasupat, Aida Amini, Jeremy R. Cole, Sebastian Riedel, Iftekhar Naim, Ming-Wei Chang, Kelvin Guu
2024CVPROn Scaling Up a Multilingual Vision and Language Model.Xi Chen, Josip Djolonga, Piotr Padlewski, Basil Mustafa, Soravit Changpinyo, Jialin Wu, Carlos Riquelme Ruiz, Sebastian Goodman, Xiao Wang, Yi Tay, Siamak Shakeri, Mostafa Dehghani, Daniel Salz, Mario Lucic, Michael Tschannen, Arsha Nagrani, Hexiang Hu, Mandar Joshi, Bo Pang, Ceslee Montgomery, Paulina Pietrzyk, Marvin Ritter, A. J. Piergiovanni, Matthias Minderer, Filip Pavetic, Austin Waters, Gang Li, Ibrahim Alabdulmohsin, Lucas Beyer, Julien Amelot, Kenton Lee, Andreas Peter Steiner, Yang Li, Daniel Keysers, Anurag Arnab, Yuanzhong Xu, Keran Rong, Alexander Kolesnikov, Mojtaba Seyedhosseini, Anelia Angelova, Xiaohua Zhai, Neil Houlsby, Radu Soricut
2024CVPRInstruct-Imagen: Image Generation with Multi-modal Instruction.Hexiang Hu, Kelvin C. K. Chan, Yu-Chuan Su, Wenhu Chen, Yandong Li, Kihyuk Sohn, Yang Zhao, Xue Ben, Boqing Gong, William W. Cohen, Ming-Wei Chang, Xuhui Jia
2024ECCVUniIR: Training and Benchmarking Universal Multimodal Information Retrievers.Cong Wei, Yang Chen, Haonan Chen, Hexiang Hu, Ge Zhang, Jie Fu, Alan Ritter, Wenhu Chen
2024ICMLMagicLens: Self-Supervised Image Retrieval with Open-Ended Instructions.Kai Zhang, Yi Luan, Hexiang Hu, Kenton Lee, Siyuan Qiao, Wenhu Chen, Yu Su, Ming-Wei Chang
2023EMNLPCan Pre-trained Vision and Language Models Answer Visual Information-Seeking Questions?Yang Chen, Hexiang Hu, Yi Luan, Haitian Sun, Soravit Changpinyo, Alan Ritter, Ming-Wei Chang
2023ICCVOpen-domain Visual Entity Recognition: Towards Recognizing Millions of Wikipedia Entities.Hexiang Hu, Yi Luan, Yang Chen, Urvashi Khandelwal, Mandar Joshi, Kenton Lee, Kristina Toutanova, Ming-Wei Chang
2023ICCVPreSTU: Pre-Training for Scene-Text Understanding.Jihyung Kil, Soravit Changpinyo, Xi Chen, Hexiang Hu, Sebastian Goodman, Wei-Lun Chao, Radu Soricut
2023ICLRRe-Imagen: Retrieval-Augmented Text-to-Image Generator.Wenhu Chen, Hexiang Hu, Chitwan Saharia, William W. Cohen
2023ICMLPix2Struct: Screenshot Parsing as Pretraining for Visual Language Understanding.Kenton Lee, Mandar Joshi, Iulia Raluca Turc, Hexiang Hu, Fangyu Liu, Julian Martin Eisenschlos, Urvashi Khandelwal, Peter Shaw, Ming-Wei Chang, Kristina Toutanova
2022EMNLPMuRAG: Multimodal Retrieval-Augmented Generator for Open Question Answering over Images and Text.Wenhu Chen, Hexiang Hu, Xi Chen, Pat Verga, William W. Cohen
2021CVPRLearning the Best Pooling Strategy for Visual Semantic Embedding.Jiacheng Chen, Hexiang Hu, Hao Wu, Yuning Jiang, Changhu Wang
2021EMNLPVisually Grounded Concept Composition.Bowen Zhang, Hexiang Hu, Linlu Qiu, Peter Shaw, Fei Sha
2021EMNLPSystematic Generalization on gSCAN: What is Nearly Solved and What is Next?Linlu Qiu, Hexiang Hu, Bowen Zhang, Peter Shaw, Fei Sha
2021ICCVMosaicOS: A Simple and Effective Use of Object-Centric Images for Long-Tailed Object Detection.Cheng Zhang, Tai-Yu Pan, Yandong Li, Hexiang Hu, Dong Xuan, Soravit Changpinyo, Boqing Gong, Wei-Lun Chao
2020ACLBabyWalk: Going Farther in Vision-and-Language Navigation by Taking Baby Steps.Wang Zhu, Hexiang Hu, Jiacheng Chen, Zhiwei Deng, Vihan Jain, Eugene Ie, Fei Sha
2020CVPRFew-Shot Learning via Embedding Adaptation With Set-to-Set Functions.Han-Jia Ye, Hexiang Hu, De-Chuan Zhan, Fei Sha
2020EMNLPLearning to Represent Image and Text with Denotation Graph.Bowen Zhang, Hexiang Hu, Vihan Jain, Eugene Ie, Fei Sha
2019CVPREngaging Image Captioning via Personality.Kurt Shuster, Samuel Humeau, Hexiang Hu, Antoine Bordes, Jason Weston
2018COLINGMulti-Task Learning for Sequence Tagging: An Empirical Study.Soravit Changpinyo, Hexiang Hu, Fei Sha
2018CVPRCross-Dataset Adaptation for Visual Question Answering.Wei-Lun Chao, Hexiang Hu, Fei Sha
2018CVPRLearning Answer Embeddings for Visual Question Answering.Hexiang Hu, Wei-Lun Chao, Fei Sha
2018CVPRCompressed Video Action Recognition.Chao-Yuan Wu, Manzil Zaheer, Hexiang Hu, R. Manmatha, Alexander J. Smola, Philipp Krhenbhl
2018ECCVCross-Modal and Hierarchical Modeling of Video and Text.Bowen Zhang, Hexiang Hu, Fei Sha
2018NAACLBeing Negative but Constructively: Lessons Learnt from Creating Better Visual Question Answering Datasets.Wei-Lun Chao, Hexiang Hu, Fei Sha
2017CVPRFastMask: Segment Multi-scale Object Candidates in One Shot.Hexiang Hu, Shiyi Lan, Yuning Jiang, Zhimin Cao, Fei Sha
2016CVPRStructure Inference Machines: Recurrent Neural Networks for Analyzing Relations in Group Activity Recognition.Zhiwei Deng, Arash Vahdat, Hexiang Hu, Greg Mori
2016CVPRLearning Structured Inference Neural Networks with Label Relations.Hexiang Hu, Guang-Tong Zhou, Zhiwei Deng, Zicheng Liao, Greg Mori