Xuehai He
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
15
Venues
11
Active years
2021–2026
Best venue rank
A*
Where they publish
Papers
15 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | WACV | Interleaved Vision-and-Language Generation via Generative Voken. | Kaizhi Zheng, Xuehai He, Xin Eric Wang |
| 2025 | ACL | Worse than Random? An Embarrassingly Simple Probing Evaluation of Large Multimodal Models in Medical VQA. | Qianqi Yan, Xuehai He, Xiang Yue, Xin Eric Wang |
| 2025 | CVPR | Is Your World Simulator a Good Story Presenter? A Consecutive Events-Based Benchmark for Future Long Video Generation. | Yiping Wang, Xuehai He, Kuan Wang, Luyao Ma, Jianwei Yang, Shuohang Wang, Simon Shaolei Du, Yelong Shen |
| 2025 | ICCV | VLM4D: Towards Spatiotemporal Awareness in Vision Language Models. | Shijie Zhou, Alexander Vilesov, Xuehai He, Ziyu Wan, Shuwang Zhang, Aditya Nagachandra, Di Chang, Dongdong Chen, Xin Eric Wang, Achuta Kadambi |
| 2025 | ICLR | MMWorld: Towards Multi-discipline Multi-faceted World Model Evaluation in Videos. | Xuehai He, Weixi Feng, Kaizhi Zheng, Yujie Lu, Wanrong Zhu, Jiachen Li, Yue Fan, Jianfeng Wang, Linjie Li, Zhengyuan Yang, Kevin Lin, William Yang Wang, Lijuan Wang, Xin Eric Wang |
| 2025 | ICLR | EditRoom: LLM-parameterized Graph Diffusion for Composable 3D Room Layout Editing. | Kaizhi Zheng, Xiaotong Chen, Xuehai He, Jing Gu, Linjie Li, Zhengyuan Yang, Kevin Lin, Jianfeng Wang, Lijuan Wang, Xin Eric Wang |
| 2025 | NeSy | JARVIS: A Neuro-Symbolic Commonsense Reasoning Framework for Conversational Embodied Agents. | Kaizhi Zheng, Kaiwen Zhou, Jing Gu, Yue Fan, Jialu Wang, Zonglin Di, Xuehai He, Xin Eric Wang |
| 2024 | ICML | Mastering Robot Manipulation with Multimodal Prompts through Pretraining and Multi-task Fine-tuning. | Jiachen Li, Qiaozi Gao, Michael Johnston, Xiaofeng Gao, Xuehai He, Hangjie Shi, Suhaila Shakiah, Reza Ghanadan, William Yang Wang |
| 2024 | NAACL | ComCLIP: Training-Free Compositional Image and Text Matching. | Kenan Jiang, Xuehai He, Ruize Xu, Xin Wang |
| 2023 | AAAI | Parameter-Efficient Model Adaptation for Vision Transformers. | Xuehai He, Chunyuan Li, Pengchuan Zhang, Jianwei Yang, Xin Eric Wang |
| 2023 | EACL | Multimodal Graph Transformer for Multimodal Question Answering. | Xuehai He, Xin Eric Wang |
| 2023 | ICLR | Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis. | Weixi Feng, Xuehai He, Tsu-Jui Fu, Varun Jampani, Arjun R. Akula, Pradyumna Narayana, Sugato Basu, Xin Eric Wang, William Yang Wang |
| 2022 | EMNLP | CPL: Counterfactual Prompt Learning for Vision and Language Models. | Xuehai He, Diji Yang, Weixi Feng, Tsu-Jui Fu, Arjun R. Akula, Varun Jampani, Pradyumna Narayana, Sugato Basu, William Yang Wang, Xin Wang |
| 2021 | ACL | Towards Visual Question Answering on Pathology Images. | Xuehai He, Zhuo Cai, Wenlan Wei, Yichen Zhang, Luntian Mou, Eric P. Xing, Pengtao Xie |
| 2021 | ACL | On the Generation of Medical Dialogs for COVID-19. | Meng Zhou, Zechen Li, Bowen Tan, Guangtao Zeng, Wenmian Yang, Xuehai He, Zeqian Ju, Subrato Chakravorty, Shu Chen, Xingyi Yang, Yichen Zhang, Qingyang Wu, Zhou Yu, Kun Xu, Eric P. Xing, Pengtao Xie |