Yaya Shi
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
8
Venues
6
Active years
2020–2025
Best venue rank
A*
Where they publish
Papers
8 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ACL | iMOVE : Instance-Motion-Aware Video Understanding. | Jiaze Li, Yaya Shi, Zongyang Ma, Haoran Xu, Yandong Bai, Huihui Xiao, Ruiwen Kang, Fan Yang, Tingting Gao, Di Zhang |
| 2025 | ICLR | TaskGalaxy: Scaling Multi-modal Instruction Fine-tuning with Tens of Thousands Vision Task Types. | Jiankang Chen, Tianke Zhang, Changyi Liu, Haojie Ding, Yaya Shi, Cheng Feng, Huihui Xiao, Bin Wen, Fan Yang, Tingting Gao, Di Zhang |
| 2024 | COLING | Semantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-training. | Haowei Liu, Yaya Shi, Haiyang Xu, Chunfeng Yuan, Qinghao Ye, Chenliang Li, Ming Yan, Ji Zhang, Fei Huang, Bing Li, Weiming Hu |
| 2024 | COLING | Unifying Latent and Lexicon Representations for Effective Video-Text Retrieval. | Haowei Liu, Yaya Shi, Haiyang Xu, Chunfeng Yuan, Qinghao Ye, Chenliang Li, Ming Yan, Ji Zhang, Fei Huang, Bing Li, Weiming Hu |
| 2024 | EMNLP | MIBench: Evaluating Multimodal Large Language Models over Multiple Images. | Haowei Liu, Xi Zhang, Haiyang Xu, Yaya Shi, Chaoya Jiang, Ming Yan, Ji Zhang, Fei Huang, Chunfeng Yuan, Bing Li, Weiming Hu |
| 2023 | ICML | mPLUG-2: A Modularized Multi-modal Foundation Model Across Text, Image and Video. | Haiyang Xu, Qinghao Ye, Ming Yan, Yaya Shi, Jiabo Ye, Yuanhong Xu, Chenliang Li, Bin Bi, Qi Qian, Wei Wang, Guohai Xu, Ji Zhang, Songfang Huang, Fei Huang, Jingren Zhou |
| 2022 | CVPR | EMScore: Evaluating Video Captioning via Coarse-Grained and Fine-Grained Embedding Matching. | Yaya Shi, Xu Yang, Haiyang Xu, Chunfeng Yuan, Bing Li, Weiming Hu, Zheng-Jun Zha |
| 2020 | CVPR | Object Relational Graph With Teacher-Recommended Learning for Video Captioning. | Ziqi Zhang, Yaya Shi, Chunfeng Yuan, Bing Li, Peijin Wang, Weiming Hu, Zheng-Jun Zha |