Skip to content

Zijia Zhao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

8

Venues

5

Active years

2023–2026

Best venue rank

A*

Where they publish

Papers

8 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLM³-VQA: A Benchmark for Multimodal, Multi-Entity, Multi-Hop Visual Question Answering.Jiatong Ma, Longteng Guo, Yuchen Liu, Zijia Zhao, Dongze Hao, Xuanxu Lin, Jing Liu
2025CVPREfficient Motion-Aware Video MLLM.Zijia Zhao, Yuqi Huo, Tongtian Yue, Longteng Guo, Haoyu Lu, Bingning Wang, Weipeng Chen, Jing Liu
2025ICLRExploring the Design Space of Visual Context Representation in Video MLLMs.Yifan Du, Yuqi Huo, Kun Zhou, Zijia Zhao, Haoyu Lu, Han Huang, Xin Zhao, Bingning Wang, Weipeng Chen, Ji-Rong Wen
2025ICLRNeedle In A Video Haystack: A Scalable Synthetic Evaluator for Video MLLMs.Zijia Zhao, Haoyu Lu, Yuqi Huo, Yifan Du, Tongtian Yue, Longteng Guo, Bingning Wang, Weipeng Chen, Jing Liu
2024ACCVOneDiff: A Generalist Model for Image Difference Captioning.Erdong Hu, Longteng Guo, Tongtian Yue, Zijia Zhao, Shuning Xue, Jing Liu
2024ACLBeyond Literal Descriptions: Understanding and Locating Open-World Objects Aligned with Human Intentions.Wenxuan Wang, Yisi Zhang, Xingjian He, Yichen Yan, Zijia Zhao, Xinlong Wang, Jing Liu
2024CVPRSC- Tune: Unleashing Self-Consistent Referential Comprehension in Large Vision Language Models.Tongtian Yue, Jie Cheng, Longteng Guo, Xingyuan Dai, Zijia Zhao, Xingjian He, Gang Xiong, Yisheng Lv, Jing Liu
2023SIGIRMAMO: Fine-Grained Vision-Language Representations Learning with Masked Multimodal Modeling.Zijia Zhao, Longteng Guo, Xingjian He, Shuai Shao, Zehuan Yuan, Jing Liu