Shengen Yan
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
31
Venues
22
Active years
2012–2026
Best venue rank
A*
Where they publish
- A*ICCV3 papers
- BICPADS3 papers
- BPPoPP3 papers
- A*ICLR2 papers
- A*DAC2 papers
- BICPP2 papers
- ADATE1 paper
- AEuroSys1 paper
- A*CVPR1 paper
- A*WWW1 paper
- A*ECCV1 paper
- A*ICML1 paper
- A*HPCA1 paper
- A*ISCA1 paper
- ASC1 paper
- AICDCS1 paper
- NationalFCCM1 paper
- BSmartComp1 paper
- BISPASS1 paper
- CHPCC1 paper
- BEuroPar1 paper
- CICA3PP1 paper
Papers
31 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | DATE | LATIAS: A General Architecture-Operator Model for Spatial Accelerators with Complex Topology and Memory Hierarchy. | Chengrui Zhang, Liancheng Jia, Chu Wang, Tianqi Li, Renze Chen, Xiuping Cui, Size Zheng, Shengen Yan, Xiuhong Li, Yu Wang, Xiang Chen, Yun (Eric) Liang |
| 2026 | EuroSys | STAlloc: Enhancing Memory Efficiency in Large-Scale Model Training with Spatio-Temporal Planning. | Zixiao Huang, Junhao Hu, Hao Lin, Chunyang Zhu, Yueran Tang, Quanlu Zhang, Zhen Guo, Zhenhua Li, Shengen Yan, Zhenhua Zhu, Guohao Dai, Yu Wang |
| 2025 | CVPR | MBQ: Modality-Balanced Quantization for Large Vision-Language Models. | Shiyao Li, Yingchun Hu, Xuefei Ning, Xihui Liu, Ke Hong, Xiaotao Jia, Xiuhong Li, Yaqi Yan, Pei Ran, Guohao Dai, Shengen Yan, Huazhong Yang, Yu Wang |
| 2025 | ICCV | FrameFusion: Combining Similarity and Importance for Video Token Reduction on Large Vision Language Models. | Tianyu Fu, Tengxuan Liu, Qinghao Han, Guohao Dai, Shengen Yan, Huazhong Yang, Xuefei Ning, Yu Wang |
| 2025 | ICCV | Dlfr-Gen: Diffusion-Based Video Generation With Dynamic Latent Frame Rate. | Zhihang Yuan, Rui Xie, Yuzhang Shang, Hanling Zhang, Siyuan Wang, Shengen Yan, Guohao Dai, Yu Wang |
| 2025 | ICCV | DiTFastAttnV2: Head-Wise Attention Compression for Multi-Modality Diffusion Transformers. | Hanling Zhang, Rundong Su, Zhihang Yuan, Pengtao Chen, Mingzhu Shen, Yibo Fan, Shengen Yan, Guohao Dai, Yu Wang |
| 2025 | ICLR | Linear Combination of Saved Checkpoints Makes Consistency and Diffusion Models Better. | Enshu Liu, Junyi Zhu, Zinan Lin, Xuefei Ning, Shuaiqi Wang, Matthew B. Blaschko, Sergey Yekhanin, Shengen Yan, Guohao Dai, Huazhong Yang, Yu Wang |
| 2025 | ICLR | ViDiT-Q: Efficient and Accurate Quantization of Diffusion Transformers for Image and Video Generation. | Tianchen Zhao, Tongcheng Fang, Haofeng Huang, Rui Wan, Widyadewi Soedarmadji, Enshu Liu, Shiyao Li, Zinan Lin, Guohao Dai, Shengen Yan, Huazhong Yang, Xuefei Ning, Yu Wang |
| 2025 | WWW | AgentSociety Challenge: Designing LLM Agents for User Modeling and Recommendation on Web Platforms. | Yuwei Yan, Yu Shang, Qingbin Zeng, Yu Li, Keyu Zhao, Zhiheng Zheng, Xuefei Ning, Tianji Wu, Shengen Yan, Yu Wang, Fengli Xu, Yong Li |
| 2024 | DAC | A Holistic Functionalization Approach to Optimizing Imperative Tensor Programs in Deep Learning. | Jinming Ma, Xiuhong Li, Zihan Wang, Xingcheng Zhang, Shengen Yan, Yuting Chen, Yueqian Zhang, Minxi Jin, Lijuan Jiang, Yun Liang, Chao Yang, Dahua Lin |
| 2024 | ECCV | MixDQ: Memory-Efficient Few-Step Text-to-Image Diffusion Models with Metric-Decoupled Mixed Precision Quantization. | Tianchen Zhao, Xuefei Ning, Tongcheng Fang, Enshu Liu, Guyue Huang, Zinan Lin, Shengen Yan, Guohao Dai, Yu Wang |
| 2024 | ICML | Evaluating Quantized Large Language Models. | Shiyao Li, Xuefei Ning, Luning Wang, Tengxuan Liu, Xiangsheng Shi, Shengen Yan, Guohao Dai, Huazhong Yang, Yu Wang |
| 2023 | HPCA | Chimera: An Analytical Optimizing Framework for Effective Compute-intensive Operators Fusion. | Size Zheng, Siyuan Chen, Peidi Song, Renze Chen, Xiuhong Li, Shengen Yan, Dahua Lin, Jingwen Leng, Yun Liang |
| 2022 | ICPP | EasyView: Enabling and Scheduling Tensor Views in Deep Learning Compilers. | Lijuan Jiang, Ping Xu, Qianchao Zhu, Xiuhong Li, Shengen Yan, Xingcheng Zhang, Dahua Lin, Wenjing Ma, Zhouyang Li, Jun Liu, Jinming Ma, Minxi Jin, Chao Yang |
| 2022 | ISCA | AMOS: enabling automatic mapping for tensor computations on spatial accelerators with hardware abstraction. | Size Zheng, Renze Chen, Anjiang Wei, Yicheng Jin, Qin Han, Liqiang Lu, Bingyang Wu, Xiuhong Li, Shengen Yan, Yun Liang |
| 2021 | SC | Characterization and prediction of deep learning workloads in large-scale GPU datacenters. | Qinghao Hu, Peng Sun, Shengen Yan, Yonggang Wen, Tianwei Zhang |
| 2020 | ICDCS | Elan: Towards Generic and Efficient Elastic Training for Deep Learning. | Lei Xie, Jidong Zhai, Baodong Wu, Yuanbo Wang, Xingcheng Zhang, Peng Sun, Shengen Yan |
| 2020 | ICPADS | Accelerating Deep Learning Tasks with Optimized GPU-assisted Image Decoding. | Lipeng Wang, Qiong Luo, Shengen Yan |
| 2020 | ICPP | DIESEL: A Dataset-Based Distributed Storage and Caching System for Large-Scale Deep Learning Training. | Lipeng Wang, Songgao Ye, Baichen Yang, Youyou Lu, Hequan Zhang, Shengen Yan, Qiong Luo |
| 2019 | PPoPP | A coordinated tiling and batching framework for efficient GEMM on GPUs. | Xiuhong Li, Yun Liang, Shengen Yan, Liancheng Jia, Yinghan Li |
| 2017 | DAC | Exploring Heterogeneous Algorithms for Accelerating Deep Convolutional Neural Networks on FPGAs. | Qingcheng Xiao, Yun Liang, Liqiang Lu, Shengen Yan, Yu-Wing Tai |
| 2017 | FCCM | Evaluating Fast Algorithms for Convolutional Neural Networks on FPGAs. | Liqiang Lu, Yun Liang, Qingcheng Xiao, Shengen Yan |
| 2017 | SmartComp | Towards Distributed Machine Learning in Shared Clusters: A Dynamically-Partitioned Approach. | Peng Sun, Yonggang Wen, Ta Nguyen Binh Duong, Shengen Yan |
| 2016 | ICPADS | Timed Dataflow: Reducing Communication Overhead for Distributed Machine Learning Systems. | Peng Sun, Yonggang Wen, Ta Nguyen Binh Duong, Shengen Yan |
| 2014 | ICPADS | A fast integral image generation algorithm on GPUs. | Qingqing Dang, Shengen Yan, Ren Wu |
| 2014 | ISPASS | Understanding the tradeoffs between software-managed vs. hardware-managed caches in GPUs. | Chao Li, Yi Yang, Hongwen Dai, Shengen Yan, Frank Mueller, Huiyang Zhou |
| 2014 | PPoPP | yaSpMV: yet another SpMV framework on GPUs. | Shengen Yan, Chao Li, Yunquan Zhang, Huiyang Zhou |
| 2013 | HPCC | CLSIFT: An Optimization Study of the Scale Invariance Feature Transform on GPUs. | Weiyan Wang, Yunquan Zhang, Guoping Long, Shengen Yan, Haipeng Jia |
| 2013 | PPoPP | StreamScan: fast scan algorithms for GPUs without global barrier synchronization. | Shengen Yan, Guoping Long, Yunquan Zhang |
| 2012 | EuroPar | GPURoofline: A Model for Guiding Performance Optimizations on GPUs. | Haipeng Jia, Yunquan Zhang, Guoping Long, Jianliang Xu, Shengen Yan, Yan Li |
| 2012 | ICA3PP | An Insightful Program Performance Tuning Chain for GPU Computing. | Haipeng Jia, Yunquan Zhang, Guoping Long, Shengen Yan |