Skip to content

Zhuoyang Zhang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

10

Venues

5

Active years

2023–2025

Best venue rank

A*

Where they publish

Papers

10 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRNVILA: Efficient Frontier Visual Language Models.Zhijian Liu, Ligeng Zhu, Baifeng Shi, Zhuoyang Zhang, Yuming Lou, Shang Yang, Haocheng Xi, Shiyi Cao, Yuxian Gu, Dacheng Li, Xiuyu Li, Haotian Tang, Yunhao Fang, Yukang Chen, Cheng-Yu Hsieh, De-An Huang, An-Chieh Cheng, Jinyi Hu, Sifei Liu, Ranjay Krishna, Pavlo Molchanov, Jan Kautz, Hongxu Yin, Song Han, Yao Lu
2025CVPRCoT-VLA: Visual Chain-of-Thought Reasoning for Vision-Language-Action Models.Qingqing Zhao, Yao Lu, Moo Jin Kim, Zipeng Fu, Zhuoyang Zhang, Yecheng Wu, Zhaoshuo Li, Qianli Ma, Song Han, Chelsea Finn, Ankur Handa, Tsung-Yi Lin, Gordon Wetzstein, Ming-Yu Liu, Donglai Xiang
2025ICCVDC-AR: Efficient Masked Autoregressive Image Generation with Deep Compression Hybrid Tokenizer.Yecheng Wu, Junyu Chen, Zhuoyang Zhang, Enze Xie, Jincheng Yu, Junsong Chen, Jinyi Hu, Yao Lu, Song Han, Han Cai
2025ICIPDISCO: A Diffusion Model For Spatial Transcriptomics Data Completion.Ziheng Duan, Xi Li, Zhuoyang Zhang, James Song, Jing Zhang
2025ICLRHART: Efficient Visual Generation with Hybrid Autoregressive Transformer.Haotian Tang, Yecheng Wu, Shang Yang, Enze Xie, Junsong Chen, Junyu Chen, Zhuoyang Zhang, Han Cai, Yao Lu, Song Han
2025ICLRVILA-U: a Unified Foundation Model Integrating Visual Understanding and Generation.Yecheng Wu, Zhuoyang Zhang, Junyu Chen, Haotian Tang, Dacheng Li, Yunhao Fang, Ligeng Zhu, Enze Xie, Hongxu Yin, Li Yi, Song Han, Yao Lu
2024CVPROne-2-3-45++: Fast Single Image to 3D Objects with Consistent Multi-View Generation and 3D Diffusion.Minghua Liu, Ruoxi Shi, Linghao Chen, Zhuoyang Zhang, Chao Xu, Xinyue Wei, Hansheng Chen, Chong Zeng, Jiayuan Gu, Hao Su
2024CVPREfficientViT-SAM: Accelerated Segment Anything Model Without Performance Loss.Zhuoyang Zhang, Han Cai, Song Han
2024ECCVSparse Refinement for Efficient High-Resolution Semantic Segmentation.Zhijian Liu, Zhuoyang Zhang, Samir Khaki, Shang Yang, Haotian Tang, Chenfeng Xu, Kurt Keutzer, Song Han
2023CVPRComplete-to-Partial 4D Distillation for Self-Supervised Point Cloud Sequence Representation Learning.Zhuoyang Zhang, Yuhao Dong, Yunze Liu, Li Yi