Skip to content

Shengen Yan

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

31

Venues

22

Active years

2012–2026

Best venue rank

A*

Where they publish

Papers

31 indexed papers, newest first.

YearVenueTitleAuthors
2026DATELATIAS: A General Architecture-Operator Model for Spatial Accelerators with Complex Topology and Memory Hierarchy.Chengrui Zhang, Liancheng Jia, Chu Wang, Tianqi Li, Renze Chen, Xiuping Cui, Size Zheng, Shengen Yan, Xiuhong Li, Yu Wang, Xiang Chen, Yun (Eric) Liang
2026EuroSysSTAlloc: Enhancing Memory Efficiency in Large-Scale Model Training with Spatio-Temporal Planning.Zixiao Huang, Junhao Hu, Hao Lin, Chunyang Zhu, Yueran Tang, Quanlu Zhang, Zhen Guo, Zhenhua Li, Shengen Yan, Zhenhua Zhu, Guohao Dai, Yu Wang
2025CVPRMBQ: Modality-Balanced Quantization for Large Vision-Language Models.Shiyao Li, Yingchun Hu, Xuefei Ning, Xihui Liu, Ke Hong, Xiaotao Jia, Xiuhong Li, Yaqi Yan, Pei Ran, Guohao Dai, Shengen Yan, Huazhong Yang, Yu Wang
2025ICCVFrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Vision Language Models.Tianyu Fu, Tengxuan Liu, Qinghao Han, Guohao Dai, Shengen Yan, Huazhong Yang, Xuefei Ning, Yu Wang
2025ICCVDlfr-Gen: Diffusion-Based Video Generation With Dynamic Latent Frame Rate.Zhihang Yuan, Rui Xie, Yuzhang Shang, Hanling Zhang, Siyuan Wang, Shengen Yan, Guohao Dai, Yu Wang
2025ICCVDiTFastAttnV2: Head-Wise Attention Compression for Multi-Modality Diffusion Transformers.Hanling Zhang, Rundong Su, Zhihang Yuan, Pengtao Chen, Mingzhu Shen, Yibo Fan, Shengen Yan, Guohao Dai, Yu Wang
2025ICLRLinear Combination of Saved Checkpoints Makes Consistency and Diffusion Models Better.Enshu Liu, Junyi Zhu, Zinan Lin, Xuefei Ning, Shuaiqi Wang, Matthew B. Blaschko, Sergey Yekhanin, Shengen Yan, Guohao Dai, Huazhong Yang, Yu Wang
2025ICLRViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation.Tianchen Zhao, Tongcheng Fang, Haofeng Huang, Rui Wan, Widyadewi Soedarmadji, Enshu Liu, Shiyao Li, Zinan Lin, Guohao Dai, Shengen Yan, Huazhong Yang, Xuefei Ning, Yu Wang
2025WWWAgentSociety Challenge: Designing LLM Agents for User Modeling and Recommendation on Web Platforms.Yuwei Yan, Yu Shang, Qingbin Zeng, Yu Li, Keyu Zhao, Zhiheng Zheng, Xuefei Ning, Tianji Wu, Shengen Yan, Yu Wang, Fengli Xu, Yong Li
2024DACA Holistic Functionalization Approach to Optimizing Imperative Tensor Programs in Deep Learning.Jinming Ma, Xiuhong Li, Zihan Wang, Xingcheng Zhang, Shengen Yan, Yuting Chen, Yueqian Zhang, Minxi Jin, Lijuan Jiang, Yun Liang, Chao Yang, Dahua Lin
2024ECCVMixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization.Tianchen Zhao, Xuefei Ning, Tongcheng Fang, Enshu Liu, Guyue Huang, Zinan Lin, Shengen Yan, Guohao Dai, Yu Wang
2024ICMLEvaluating Quantized Large Language Models.Shiyao Li, Xuefei Ning, Luning Wang, Tengxuan Liu, Xiangsheng Shi, Shengen Yan, Guohao Dai, Huazhong Yang, Yu Wang
2023HPCAChimera: An Analytical Optimizing Framework for Effective Compute-intensive Operators Fusion.Size Zheng, Siyuan Chen, Peidi Song, Renze Chen, Xiuhong Li, Shengen Yan, Dahua Lin, Jingwen Leng, Yun Liang
2022ICPPEasyView: Enabling and Scheduling Tensor Views in Deep Learning Compilers.Lijuan Jiang, Ping Xu, Qianchao Zhu, Xiuhong Li, Shengen Yan, Xingcheng Zhang, Dahua Lin, Wenjing Ma, Zhouyang Li, Jun Liu, Jinming Ma, Minxi Jin, Chao Yang
2022ISCAAMOS: enabling automatic mapping for tensor computations on spatial accelerators with hardware abstraction.Size Zheng, Renze Chen, Anjiang Wei, Yicheng Jin, Qin Han, Liqiang Lu, Bingyang Wu, Xiuhong Li, Shengen Yan, Yun Liang
2021SCCharacterization and prediction of deep learning workloads in large-scale GPU datacenters.Qinghao Hu, Peng Sun, Shengen Yan, Yonggang Wen, Tianwei Zhang
2020ICDCSElan: Towards Generic and Efficient Elastic Training for Deep Learning.Lei Xie, Jidong Zhai, Baodong Wu, Yuanbo Wang, Xingcheng Zhang, Peng Sun, Shengen Yan
2020ICPADSAccelerating Deep Learning Tasks with Optimized GPU-assisted Image Decoding.Lipeng Wang, Qiong Luo, Shengen Yan
2020ICPPDIESEL: A Dataset-Based Distributed Storage and Caching System for Large-Scale Deep Learning Training.Lipeng Wang, Songgao Ye, Baichen Yang, Youyou Lu, Hequan Zhang, Shengen Yan, Qiong Luo
2019PPoPPA coordinated tiling and batching framework for efficient GEMM on GPUs.Xiuhong Li, Yun Liang, Shengen Yan, Liancheng Jia, Yinghan Li
2017DACExploring Heterogeneous Algorithms for Accelerating Deep Convolutional Neural Networks on FPGAs.Qingcheng Xiao, Yun Liang, Liqiang Lu, Shengen Yan, Yu-Wing Tai
2017FCCMEvaluating Fast Algorithms for Convolutional Neural Networks on FPGAs.Liqiang Lu, Yun Liang, Qingcheng Xiao, Shengen Yan
2017SmartCompTowards Distributed Machine Learning in Shared Clusters: A Dynamically-Partitioned Approach.Peng Sun, Yonggang Wen, Ta Nguyen Binh Duong, Shengen Yan
2016ICPADSTimed Dataflow: Reducing Communication Overhead for Distributed Machine Learning Systems.Peng Sun, Yonggang Wen, Ta Nguyen Binh Duong, Shengen Yan
2014ICPADSA fast integral image generation algorithm on GPUs.Qingqing Dang, Shengen Yan, Ren Wu
2014ISPASSUnderstanding the tradeoffs between software-managed vs. hardware-managed caches in GPUs.Chao Li, Yi Yang, Hongwen Dai, Shengen Yan, Frank Mueller, Huiyang Zhou
2014PPoPPyaSpMV: yet another SpMV framework on GPUs.Shengen Yan, Chao Li, Yunquan Zhang, Huiyang Zhou
2013HPCCCLSIFT: An Optimization Study of the Scale Invariance Feature Transform on GPUs.Weiyan Wang, Yunquan Zhang, Guoping Long, Shengen Yan, Haipeng Jia
2013PPoPPStreamScan: fast scan algorithms for GPUs without global barrier synchronization.Shengen Yan, Guoping Long, Yunquan Zhang
2012EuroParGPURoofline: A Model for Guiding Performance Optimizations on GPUs.Haipeng Jia, Yunquan Zhang, Guoping Long, Jianliang Xu, Shengen Yan, Yan Li
2012ICA3PPAn Insightful Program Performance Tuning Chain for GPU Computing.Haipeng Jia, Yunquan Zhang, Guoping Long, Shengen Yan