Peihao Chen
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
17
Venues
8
Active years
2019–2026
Best venue rank
A*
Where they publish
Papers
17 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | NaVLA$^2$: A Vision-Language-Audio-Action Model for Multimodal Instruction Navigation. | Jugang Fan, Peihao Chen, Changhao Li, Qing Du, Jian Chen, Mingkui Tan |
| 2025 | CVPR | 3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning. | Yuncong Yang, Han Yang, Jiachen Zhou, Peihao Chen, Hongxin Zhang, Yilun Du, Chuang Gan |
| 2025 | CVPR | LSceneLLM: Enhancing Large 3D Scene Understanding Using Adaptive Visual Preferences. | Hongyan Zhi, Peihao Chen, Junyan Li, Shuailei Ma, Xinyu Sun, Tianhang Xiang, Yinjie Lei, Mingkui Tan, Chuang Gan |
| 2025 | ICASSP | Map-Guided Few-Shot Audio-Visual Acoustics Modeling. | Diwei Huang, Kunyang Lin, Peihao Chen, Qing Du |
| 2025 | IJCAI | Enhancing User-Oriented Proactivity in Open-Domain Dialogues with Critic Guidance. | Yufeng Wang, Jinwu Hu, Ziteng Huang, Kunyang Lin, Zitian Zhang, Peihao Chen, Yu Hu, Qianyue Wang, Zhuliang Yu, Bin Sun, Xiaofen Xing, Qingfang Zheng, Mingkui Tan |
| 2024 | CVPR | MultiPLY: A Multisensory Object-Centric Embodied Large Language Model in 3D World. | Yining Hong, Zishuo Zheng, Peihao Chen, Yian Wang, Junyan Li, Chuang Gan |
| 2024 | CVPR | RILA: Reflective and Imaginative Language Agent for Zero-Shot Semantic Audio-Visual Navigation. | Zeyuan Yang, Jiageng Lin, Peihao Chen, Anoop Cherian, Tim K. Marks, Jonathan Le Roux, Chuang Gan |
| 2024 | ECCV | FlexAttention for Efficient High-Resolution Vision-Language Models. | Junyan Li, Delin Chen, Tianle Cai, Peihao Chen, Yining Hong, Zhenfang Chen, Yikang Shen, Chuang Gan |
| 2024 | ICLR | CoVLM: Composing Visual Entities and Relationships in Large Language Models Via Communicative Decoding. | Junyan Li, Delin Chen, Yining Hong, Zhenfang Chen, Peihao Chen, Yikang Shen, Chuang Gan |
| 2024 | ICML | 3D-VLA: A 3D Vision-Language-Action Generative World Model. | Haoyu Zhen, Xiaowen Qiu, Peihao Chen, Jincheng Yang, Xin Yan, Yilun Du, Yining Hong, Chuang Gan |
| 2023 | CVPR | Masked Motion Encoding for Self-Supervised Video Representation Learning. | Xinyu Sun, Peihao Chen, Liangwei Chen, Changhao Li, Thomas H. Li, Mingkui Tan, Chuang Gan |
| 2023 | ICCV | Learning Vision-and-Language Navigation from YouTube Videos. | Kunyang Lin, Peihao Chen, Diwei Huang, Thomas H. Li, Mingkui Tan, Chuang Gan |
| 2021 | AAAI | RSPNet: Relative Speed Perception for Unsupervised Video Representation Learning. | Peihao Chen, Deng Huang, Dongliang He, Xiang Long, Runhao Zeng, Shilei Wen, Mingkui Tan, Chuang Gan |
| 2020 | AAAI | Location-Aware Graph Convolutional Networks for Video Question Answering. | Deng Huang, Peihao Chen, Runhao Zeng, Qing Du, Mingkui Tan, Chuang Gan |
| 2020 | CVPR | Dense Regression Network for Video Grounding. | Runhao Zeng, Haoming Xu, Wenbing Huang, Peihao Chen, Mingkui Tan, Chuang Gan |
| 2020 | ECCV | Foley Music: Learning to Generate Music from Videos. | Chuang Gan, Deng Huang, Peihao Chen, Joshua B. Tenenbaum, Antonio Torralba |
| 2019 | ICCV | Self-Supervised Moving Vehicle Tracking With Stereo Sound. | Chuang Gan, Hang Zhao, Peihao Chen, David D. Cox, Antonio Torralba |