Skip to content

Yanqi Zhou

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

19

Venues

14

Active years

2014–2025

Best venue rank

A*

Where they publish

Papers

19 indexed papers, newest first.

YearVenueTitleAuthors
2025SOSPIC-Cache: Efficient Large Language Model Serving via In-context Caching.Yifan Yu, Yu Gan, Nikhil Sarda, Lillian Tsai, Jiaming Shen, Yanqi Zhou, Arvind Krishnamurthy, Fan Lai, Hank Levy, David E. Culler
2024ICLRMixture-of-Experts Meets Instruction Tuning: A Winning Combination for Large Language Models.Sheng Shen, Le Hou, Yanqi Zhou, Nan Du, Shayne Longpre, Jason Wei, Hyung Won Chung, Barret Zoph, William Fedus, Xinyun Chen, Tu Vu, Yuexin Wu, Wuyang Chen, Albert Webson, Yunxuan Li, Vincent Y. Zhao, Hongkun Yu, Kurt Keutzer, Trevor Darrell, Denny Zhou
2023ICCVTripLe: Revisiting Pretrained Model Reuse and Progressive Learning for Efficient Vision Transformer Scaling and Searching.Cheng Fu, Hanxian Huang, Zixuan Jiang, Yun Ni, Lifeng Nai, Gang Wu, Liqun Cheng, Yanqi Zhou, Sheng Li, Andrew Li, Jishen Zhao
2023ICMLLifelong Language Pretraining with Distribution-Specialized Experts.Wuyang Chen, Yanqi Zhou, Nan Du, Yanping Huang, James Laudon, Zhifeng Chen, Claire Cui
2023ICMLBrainformers: Trading Simplicity for Efficiency.Yanqi Zhou, Nan Du, Yanping Huang, Daiyi Peng, Chang Lan, Da Huang, Siamak Shakeri, David R. So, Andrew M. Dai, Yifeng Lu, Zhifeng Chen, Quoc V. Le, Claire Cui, James Laudon, Jeff Dean
2023WACVToward Edge-Efficient Dense Predictions with Synergistic Multi-Task Neural Architecture Search.Thanh Vu, Yanqi Zhou, Chunfeng Wen, Yueqi Li, Jan-Michael Frahm
2022CVPRSearching for Efficient Neural Architectures for On-Device ML on Edge TPUs.Berkin Akin, Suyog Gupta, Yun Long, Anton Spiridonov, Zhuo Wang, Marie White, Hao Xu, Ping Zhou, Yanqi Zhou
2022ICMLGLaM: Efficient Scaling of Language Models with Mixture-of-Experts.Nan Du, Yanping Huang, Andrew M. Dai, Simon Tong, Dmitry Lepikhin, Yuanzhong Xu, Maxim Krikun, Yanqi Zhou, Adams Wei Yu, Orhan Firat, Barret Zoph, Liam Fedus, Maarten P. Bosma, Zongwei Zhou, Tao Wang, Yu Emma Wang, Kellie Webster, Marie Pellat, Kevin Robinson, Kathleen S. Meier-Hellstern, Toju Duke, Lucas Dixon, Kun Zhang, Quoc V. Le, Yonghui Wu, Zhifeng Chen, Claire Cui
2021EMNLPDo Transformer Modifications Transfer Across Implementations and Applications?Sharan Narang, Hyung Won Chung, Yi Tay, Liam Fedus, Thibault Fvry, Michael Matena, Karishma Malkan, Noah Fiedel, Noam Shazeer, Zhenzhong Lan, Yanqi Zhou, Wei Li, Nan Ding, Jake Marcus, Adam Roberts, Colin Raffel
2020ICRAOmnidirectional Depth Extension Networks.Xinjing Cheng, Peng Wang, Yanqi Zhou, Chenye Guan, Ruigang Yang
2019BMVCEPNAS: Efficient Progressive Neural Architecture Search.Yanqi Zhou, Peng Wang
2019SCSwift machine learning model serving scheduling: a region based reinforcement learning approach.Heyang Qin, Syed Zawad, Yanqi Zhou, Lei Yang, Dongfang Zhao, Feng Yan
2018HPCAPower and Energy Characterization of an Open Source 25-Core Manycore Processor.Michael McKeown, Alexey Lavrov, Mohammad Shahrad, Paul J. Jackson, Yaosheng Fu, Jonathan Balkind, Tri Minh Nguyen, Katie Lim, Yanqi Zhou, David Wentzlaff
2017EuroSysAtomic In-place Updates for Non-volatile Main Memories with Kamino-Tx.Amir Saman Memaripour, Anirudh Badam, Amar Phanishayee, Yanqi Zhou, Ramnatthan Alagappan, Karin Strauss, Steven Swanson
2017HPCACamouflage: Memory Traffic Shaping to Mitigate Timing Attacks.Yanqi Zhou, Sameer Wagh, Prateek Mittal, David Wentzlaff
2016ASPLOSOpenPiton: An Open Source Manycore Research Framework.Jonathan Balkind, Michael McKeown, Yaosheng Fu, Tri Minh Nguyen, Yanqi Zhou, Alexey Lavrov, Mohammad Shahrad, Adi Fuchs, Samuel Payne, Xiaohua Liang, Matthew Matl, David Wentzlaff
2016ISCACASH: Supporting IaaS Customers with a Sub-core Configurable Architecture.Yanqi Zhou, Henry Hoffmann, David Wentzlaff
2016ISCAMITTS: Memory Inter-arrival Time Traffic Shaping.Yanqi Zhou, David Wentzlaff
2014ASPLOSThe sharing architecture: sub-core configurability for IaaS clouds.Yanqi Zhou, David Wentzlaff