| 2025 | EMNLP | On Domain-Adaptive Post-Training for Multimodal Large Language Models. | Daixuan Cheng, Shaohan Huang, Ziyu Zhu, Xintong Zhang, Xin Zhao, Zhongzhi Luan, Bo Dai, Zhenliang Zhang |
| 2025 | IROS | DEXTER-LLM: Dynamic and Explainable Coordination of Multi-Robot Systems in Unknown Environments via Large Language Models. | Yuxiao Zhu, Junfeng Chen, Xintong Zhang, Meng Guo, Zhongkui Li |
| 2024 | CogSci | PersonalityScanner: Exploring the Validity of Personality Assessment Based on Multimodal Signals in Virtual Reality. | Xintong Zhang, Di Lu, Huiqi Hu, Nan Jiang, Xianhao Yu, Jinan Xu, Yujia Peng, Qing Li, Wenjuan Han |
| 2024 | CVPR | CLOVA: A Closed-LOop Visual Assistant with Tool Usage and Update. | Zhi Gao, Yuntao Du, Xintong Zhang, Xiaojian Ma, Wenjuan Han, Song-Chun Zhu, Qing Li |
| 2024 | ICASSP | Empowering Vision-Language Models for Reasoning Ability through Large Language Models. | Yueting Yang, Xintong Zhang, Jinan Xu, Wenjuan Han |
| 1997 | ICIP | Multiresolution surface feature analysis for automatic target identification based on laser radar images. | Quentin A. Holmes, Xintong Zhang, Dongming Zhao |