Skip to content

Peihao Chen

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

8

Active years

2019–2026

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAINaVLA$^2$: A Vision-Language-Audio-Action Model for Multimodal Instruction Navigation.Jugang Fan, Peihao Chen, Changhao Li, Qing Du, Jian Chen, Mingkui Tan
2025CVPR3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning.Yuncong Yang, Han Yang, Jiachen Zhou, Peihao Chen, Hongxin Zhang, Yilun Du, Chuang Gan
2025CVPRLSceneLLM: Enhancing Large 3D Scene Understanding Using Adaptive Visual Preferences.Hongyan Zhi, Peihao Chen, Junyan Li, Shuailei Ma, Xinyu Sun, Tianhang Xiang, Yinjie Lei, Mingkui Tan, Chuang Gan
2025ICASSPMap-Guided Few-Shot Audio-Visual Acoustics Modeling.Diwei Huang, Kunyang Lin, Peihao Chen, Qing Du
2025IJCAIEnhancing User-Oriented Proactivity in Open-Domain Dialogues with Critic Guidance.Yufeng Wang, Jinwu Hu, Ziteng Huang, Kunyang Lin, Zitian Zhang, Peihao Chen, Yu Hu, Qianyue Wang, Zhuliang Yu, Bin Sun, Xiaofen Xing, Qingfang Zheng, Mingkui Tan
2024CVPRMultiPLY: A Multisensory Object-Centric Embodied Large Language Model in 3D World.Yining Hong, Zishuo Zheng, Peihao Chen, Yian Wang, Junyan Li, Chuang Gan
2024CVPRRILA: Reflective and Imaginative Language Agent for Zero-Shot Semantic Audio-Visual Navigation.Zeyuan Yang, Jiageng Lin, Peihao Chen, Anoop Cherian, Tim K. Marks, Jonathan Le Roux, Chuang Gan
2024ECCVFlexAttention for Efficient High-Resolution Vision-Language Models.Junyan Li, Delin Chen, Tianle Cai, Peihao Chen, Yining Hong, Zhenfang Chen, Yikang Shen, Chuang Gan
2024ICLRCoVLM: Composing Visual Entities and Relationships in Large Language Models Via Communicative Decoding.Junyan Li, Delin Chen, Yining Hong, Zhenfang Chen, Peihao Chen, Yikang Shen, Chuang Gan
2024ICML3D-VLA: A 3D Vision-Language-Action Generative World Model.Haoyu Zhen, Xiaowen Qiu, Peihao Chen, Jincheng Yang, Xin Yan, Yilun Du, Yining Hong, Chuang Gan
2023CVPRMasked Motion Encoding for Self-Supervised Video Representation Learning.Xinyu Sun, Peihao Chen, Liangwei Chen, Changhao Li, Thomas H. Li, Mingkui Tan, Chuang Gan
2023ICCVLearning Vision-and-Language Navigation from YouTube Videos.Kunyang Lin, Peihao Chen, Diwei Huang, Thomas H. Li, Mingkui Tan, Chuang Gan
2021AAAIRSPNet: Relative Speed Perception for Unsupervised Video Representation Learning.Peihao Chen, Deng Huang, Dongliang He, Xiang Long, Runhao Zeng, Shilei Wen, Mingkui Tan, Chuang Gan
2020AAAILocation-Aware Graph Convolutional Networks for Video Question Answering.Deng Huang, Peihao Chen, Runhao Zeng, Qing Du, Mingkui Tan, Chuang Gan
2020CVPRDense Regression Network for Video Grounding.Runhao Zeng, Haoming Xu, Wenbing Huang, Peihao Chen, Mingkui Tan, Chuang Gan
2020ECCVFoley Music: Learning to Generate Music from Videos.Chuang Gan, Deng Huang, Peihao Chen, Joshua B. Tenenbaum, Antonio Torralba
2019ICCVSelf-Supervised Moving Vehicle Tracking With Stereo Sound.Chuang Gan, Hang Zhao, Peihao Chen, David D. Cox, Antonio Torralba