Skip to content

Xuehai He

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

15

Venues

11

Active years

2021–2026

Best venue rank

A*

Where they publish

Papers

15 indexed papers, newest first.

YearVenueTitleAuthors
2026WACVInterleaved Vision-and-Language Generation via Generative Voken.Kaizhi Zheng, Xuehai He, Xin Eric Wang
2025ACLWorse than Random? An Embarrassingly Simple Probing Evaluation of Large Multimodal Models in Medical VQA.Qianqi Yan, Xuehai He, Xiang Yue, Xin Eric Wang
2025CVPRIs Your World Simulator a Good Story Presenter? A Consecutive Events-Based Benchmark for Future Long Video Generation.Yiping Wang, Xuehai He, Kuan Wang, Luyao Ma, Jianwei Yang, Shuohang Wang, Simon Shaolei Du, Yelong Shen
2025ICCVVLM4D: Towards Spatiotemporal Awareness in Vision Language Models.Shijie Zhou, Alexander Vilesov, Xuehai He, Ziyu Wan, Shuwang Zhang, Aditya Nagachandra, Di Chang, Dongdong Chen, Xin Eric Wang, Achuta Kadambi
2025ICLRMMWorld: Towards Multi-discipline Multi-faceted World Model Evaluation in Videos.Xuehai He, Weixi Feng, Kaizhi Zheng, Yujie Lu, Wanrong Zhu, Jiachen Li, Yue Fan, Jianfeng Wang, Linjie Li, Zhengyuan Yang, Kevin Lin, William Yang Wang, Lijuan Wang, Xin Eric Wang
2025ICLREditRoom: LLM-parameterized Graph Diffusion for Composable 3D Room Layout Editing.Kaizhi Zheng, Xiaotong Chen, Xuehai He, Jing Gu, Linjie Li, Zhengyuan Yang, Kevin Lin, Jianfeng Wang, Lijuan Wang, Xin Eric Wang
2025NeSyJARVIS: A Neuro-Symbolic Commonsense Reasoning Framework for Conversational Embodied Agents.Kaizhi Zheng, Kaiwen Zhou, Jing Gu, Yue Fan, Jialu Wang, Zonglin Di, Xuehai He, Xin Eric Wang
2024ICMLMastering Robot Manipulation with Multimodal Prompts through Pretraining and Multi-task Fine-tuning.Jiachen Li, Qiaozi Gao, Michael Johnston, Xiaofeng Gao, Xuehai He, Hangjie Shi, Suhaila Shakiah, Reza Ghanadan, William Yang Wang
2024NAACLComCLIP: Training-Free Compositional Image and Text Matching.Kenan Jiang, Xuehai He, Ruize Xu, Xin Wang
2023AAAIParameter-Efficient Model Adaptation for Vision Transformers.Xuehai He, Chunyuan Li, Pengchuan Zhang, Jianwei Yang, Xin Eric Wang
2023EACLMultimodal Graph Transformer for Multimodal Question Answering.Xuehai He, Xin Eric Wang
2023ICLRTraining-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis.Weixi Feng, Xuehai He, Tsu-Jui Fu, Varun Jampani, Arjun R. Akula, Pradyumna Narayana, Sugato Basu, Xin Eric Wang, William Yang Wang
2022EMNLPCPL: Counterfactual Prompt Learning for Vision and Language Models.Xuehai He, Diji Yang, Weixi Feng, Tsu-Jui Fu, Arjun R. Akula, Varun Jampani, Pradyumna Narayana, Sugato Basu, William Yang Wang, Xin Wang
2021ACLTowards Visual Question Answering on Pathology Images.Xuehai He, Zhuo Cai, Wenlan Wei, Yichen Zhang, Luntian Mou, Eric P. Xing, Pengtao Xie
2021ACLOn the Generation of Medical Dialogs for COVID-19.Meng Zhou, Zechen Li, Bowen Tan, Guangtao Zeng, Wenmian Yang, Xuehai He, Zeqian Ju, Subrato Chakravorty, Shu Chen, Xingyi Yang, Yichen Zhang, Qingyang Wu, Zhou Yu, Kun Xu, Eric P. Xing, Pengtao Xie