Focus: A Streaming Concentration Architecture for Efficient Vision-Language Models.
Chiyue Wei, Cong Guo, Junyao Zhang, Haoxuan Shan, Yifan Xu, Ziyue Zhang, Yudong Liu, Qinsi Wang, Changchun Zhou, Hai Helen Li, Yiran Chen
Browse the full HPCA paper archive.