Skip to content

Longteng Guo

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

22

Venues

11

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

22 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIUrbanNav: Learning Language-Guided Embodied Urban Navigation from Web-Scale Human Trajectories.Yanghong Mei, Yirong Yang, Longteng Guo, Qunbo Wang, Ming-Ming Yu, Xingjian He, Wenjun Wu, Jing Liu
2026ACLSciVQR: A Multidisciplinary Multimodal Benchmark for Advanced Scientific Reasoning Evaluation.Longteng Guo, Xuanxu Lin, Dongze Hao, Tongtian Yue, Pengkang Huo, Jiatong Ma, Yuchen Liu, Jing Liu
2026ACLCan MLLMs Reason Beyond Language? VisReason: A Comprehensive Benchmark for Vision-Centric Reasoning.Longteng Guo, Yifan Wang, Pengkang Huo, Tailai Chen, Yuze Wu, Jing Liu, Xinxin Zhu
2026ACLM³-VQA: A Benchmark for Multimodal, Multi-Entity, Multi-Hop Visual Question Answering.Jiatong Ma, Longteng Guo, Yuchen Liu, Zijia Zhao, Dongze Hao, Xuanxu Lin, Jing Liu
2025CVPREfficient Motion-Aware Video MLLM.Zijia Zhao, Yuqi Huo, Tongtian Yue, Longteng Guo, Haoyu Lu, Bingning Wang, Weipeng Chen, Jing Liu
2025EMNLPVRoPE: Rotary Position Embedding for Video Large Language Models.Zikang Liu, Longteng Guo, Yepeng Tang, Tongtian Yue, Junxian Cai, Kai Ma, Qingbin Liu, Xi Chen, Jing Liu
2025EMNLPViPE: Visual Perception in Parameter Space for Efficient Video-Language Understanding.Shichen Lu, Tongtian Yue, Longteng Guo, Handong Li, Xingjian He, Si Liu, Jing Liu
2025ICCVBreaking the Encoder Barrier for Seamless Video-Language Understanding.Handong Li, Yiyuan Zhang, Longteng Guo, Xiangyu Yue, Jing Liu
2025ICLRAda-K Routing: Boosting the Efficiency of MoE-based LLMs.Tongtian Yue, Longteng Guo, Jie Cheng, Xuange Gao, Hua Huang, Jing Liu
2025ICLRNeedle In A Video Haystack: A Scalable Synthetic Evaluator for Video MLLMs.Zijia Zhao, Haoyu Lu, Yuqi Huo, Yifan Du, Tongtian Yue, Longteng Guo, Bingning Wang, Weipeng Chen, Jing Liu
2025WACVGroundingMate: Aiding Object Grounding for Goal-Oriented Vision-and-Language Navigation.Qianyi Liu, Siqi Zhang, Yanyuan Qiao, Junyou Zhu, Xiang Li, Longteng Guo, Qunbo Wang, Xingjian He, Qi Wu, Jing Liu
2024AAAIEVE: Efficient Vision-Language Pre-training with Masked Prediction and Modality-Aware MoE.Junyi Chen, Longteng Guo, Jia Sun, Shuai Shao, Zehuan Yuan, Liang Lin, Dongyu Zhang
2024ACCVOneDiff: A Generalist Model for Image Difference Captioning.Erdong Hu, Longteng Guo, Tongtian Yue, Zijia Zhao, Shuning Xue, Jing Liu
2024CVPRUnveiling Parts Beyond Objects: Towards Finer-Granularity Referring Expression Segmentation.Wenxuan Wang, Tongtian Yue, Yisi Zhang, Longteng Guo, Xingjian He, Xinlong Wang, Jing Liu
2024CVPRSC- Tune: Unleashing Self-Consistent Referential Comprehension in Large Vision Language Models.Tongtian Yue, Jie Cheng, Longteng Guo, Xingyuan Dai, Zijia Zhao, Xingjian He, Gang Xiong, Yisheng Lv, Jing Liu
2024EMNLPSelf-Bootstrapped Visual-Language Model for Knowledge Selection and Question Answering.Dongze Hao, Qunbo Wang, Longteng Guo, Jie Jiang, Jing Liu
2023ICIGCSDNet: Contrastive Similarity Distillation Network for Multi-lingual Image-Text Retrieval.Shichen Lu, Longteng Guo, Xingjian He, Xinxin Zhu, Jing Liu, Si Liu
2023SIGIRMAMO: Fine-Grained Vision-Language Representations Learning with Masked Multimodal Modeling.Zijia Zhao, Longteng Guo, Xingjian He, Shuai Shao, Zehuan Yuan, Jing Liu
2021ICIGKeypoint Context Aggregation for Human Pose Estimation.Wenzhu Wu, Weining Wang, Longteng Guo, Jing Liu
2020CVPRNormalized and Geometry-Aware Self-Attention Network for Image Captioning.Longteng Guo, Jing Liu, Xinxin Zhu, Peng Yao, Shichen Lu, Hanqing Lu
2020IJCAINon-Autoregressive Image Captioning with Counterfactuals-Critical Multi-Agent Learning.Longteng Guo, Jing Liu, Xinxin Zhu, Xingjian He, Jie Jiang, Hanqing Lu
2019CVPRMSCap: Multi-Style Image Captioning With Unpaired Stylized Text.Longteng Guo, Jing Liu, Peng Yao, Jiangwei Li, Hanqing Lu