Skip to content

Zhenhua Zhu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

46

Venues

14

Active years

2006–2026

Best venue rank

A*

Where they publish

Papers

46 indexed papers, newest first.

YearVenueTitleAuthors
2026ASPDACSpAct-NDP: Efficient LLM Inference via Sparse Activation on NDP-GPU Heterogeneous Architecture.Jiaming Xu, Tongxin Xie, Yongkang Zhou, Jinhao Li, Yaoxiu Lian, Zhenhua Zhu, Yu Wang, Guohao Dai
2026DATECIM-Tuner: Balancing the Compute and Storage Capacity of SRAM-CIM Accelerator via Hardware-mapping Co-exploration.Jinwu Chen, Yuhui Shi, He Wang, Zhe Jiang, Jun Yang, Xin Si, Zhenhua Zhu
2026DATEPICoSNN: Partially Incoherent Configurable Optical Computing Architecture for SNN Acceleration.Bowen Duan, Zhenhua Zhu, Zhengyang Duan, Huazhong Yang, Yuan Xie, Yu Wang
2026DATEFlashGEMM: Mesh-Aware Efficient GEMM for 3D-Stacked LLM Accelerators.Xin Fan, Chen Bai, Xin Yang, Zhenhua Zhu, Yanhong Wang, Zhao Zhang, Yuan Xie
2026DATEEndor: Exploit Nearly-Decode-Only Opportunities of LLM Reasoning on Near-Memory Architecture.Jun Liu, Tianlang Zhao, Shiyi Liu, Jiancai Ye, Lin Li, Zhen Yu, Li Ding, Hao Zhou, Zhenhua Zhu, Xuefei Ning, Yuan Xie, Yu Wang, Guohao Dai
2026EuroSysEfficient and Adaptable Overlapping for Computation and Communication via Signaling and Reordering.Ke Hong, Xiuhong Li, Minxu Liu, Qiuli Mao, Tianqi Wu, Zixiao Huang, Lufang Chen, Zhong Wang, Yichong Zhang, Zhenhua Zhu, Guohao Dai, Yu Wang
2026EuroSysSTAlloc: Enhancing Memory Efficiency in Large-Scale Model Training with Spatio-Temporal Planning.Zixiao Huang, Junhao Hu, Hao Lin, Chunyang Zhu, Yueran Tang, Quanlu Zhang, Zhen Guo, Zhenhua Li, Shengen Yan, Zhenhua Zhu, Guohao Dai, Yu Wang
2026ISCABringing Near Data Processing Into the Low-Bit Floating-Point Era.Tongxin Xie, Mingyu Gao, Zehao Wang, Zhihao Jia, Yuechen Xi, Bing Li, Mo Guang, Jiale Yan, Kaiwen Long, Xingcheng Zhang, Huazhong Yang, Yuan Xie, Zhenhua Zhu, Yu Wang
2025DACPARO: Hardware-Software Co-design with Pattern-aware Reorder-based Attention Quantization in Video Generation Models.Xinhao Yang, Tianchen Zhao, Hongyi Wang, Wenheng Ma, Shulin Zeng, Zhenhua Zhu, Xuefei Ning, Huazhong Yang, Yu Wang
2025DACHPIM-NoC: A Priori-Knowledge-Based Optimization Framework for Heterogeneous PIM-Based NoCs.Shuai Yuan, Angxin Cai, Qiushi Lin, Guoxing Wang, Yu Wang, Zhenhua Zhu, Yanan Sun
2025FPGAFMC-LLM: Enabling FPGAs for Efficient Batched Decoding of 70B+ LLMs with a Memory-Centric Streaming Architecture.Wenheng Ma, Xinhao Yang, Shulin Zeng, Tengxuan Liu, Libo Shen, Hongyi Wang, Shiyao Li, Jiewen Wang, Yuhan Zhang, Hao Guo, Jintao Li, Ziming Zhang, Zhenhua Zhu, Xuefei Ning, Tsung-Yi Ho, Guohao Dai, Yu Wang
2025HPCATB-STC: Transposable Block-wise N: M Structured Sparse Tensor Core.Jun Liu, Shulin Zeng, Junbo Zhao, Li Ding, Zeyu Wang, Jinhao Li, Zhenhua Zhu, Xuefei Ning, Chen Zhang, Yu Wang, Guohao Dai
2025HPCAUniNDP: A Unified Compilation and Simulation Tool for Near DRAM Processing Architectures.Tongxin Xie, Zhenhua Zhu, Bing Li, Yukai He, Cong Li, Guangyu Sun, Huazhong Yang, Yuan Xie, Yu Wang
2025ICCADAccelStack: A Cost-Driven Analysis of 3D-Stacked LLM Accelerators.Chen Bai, Xin Fan, Zhenhua Zhu, Wei Zhang, Yuan Xie
2025ICCADHow Do Errors Impact NN Accuracy on Non-Ideal Analog PIM? Fast Evaluation via an Error-Injected Robustness Metric.Lidong Guo, Zhenhua Zhu, Qiushi Lin, Yuan Xie, Huazhong Yang, Wangyang Fu, Yu Wang
2025MICROREACT3D: Real-time Edge Accelerator for Incremental Training in 3D Gaussian Splatting based SLAM Systems.Hongyi Wang, Zhenhua Zhu, Tianchen Zhao, Yunfei Xiang, Zehao Wang, Jincheng Yu, Huazhong Yang, Yuan Xie, Yu Wang
2024ASPLOSFEASTA: A Flexible and Efficient Accelerator for Sparse Tensor Algebra in Machine Learning.Kai Zhong, Zhenhua Zhu, Guohao Dai, Hongyi Wang, Xinhao Yang, Haoyu Zhang, Jin Si, Qiuli Mao, Shulin Zeng, Ke Hong, Genghan Zhang, Huazhong Yang, Yu Wang
2024DACEPIM: Efficient Processing-In-Memory Accelerators based on Epitome.Chenyu Wang, Zhen Dong, Daquan Zhou, Zhenhua Zhu, Yu Wang, Jiashi Feng, Kurt Keutzer
2024DACDySpMM: From Fix to Dynamic for Sparse Matrix-Matrix Multiplication Accelerators.Hongyi Wang, Kai Zhong, Haoyu Zhang, Shulin Zeng, Zhenhua Zhu, Xinhao Yang, Shuang Wang, Guohao Dai, Huazhong Yang, Yu Wang
2024DATEDyPIM: Dynamic-Inference-Enabled Processing - In-Memory Accelerator.Tongxin Xie, Tianchen Zhao, Zhenhua Zhu, Xuefei Ning, Bing Li, Guohao Dai, Huazhong Yang, Yu Wang
2024ICCADTowards Floating Point-Based Attention-Free LLM: Hybrid PIM with Non-Uniform Data Format and Reduced Multiplications.Lidong Guo, Zhenhua Zhu, Tengxuan Liu, Xuefei Ning, Shiyao Li, Guohao Dai, Huazhong Yang, Wangyang Fu, Yu Wang
2024ICCDMOTPE/D: Hardware and Algorithm Co-design for Reconfigurable Neuromorphic Processor.Yuan Li, Renzhi Chen, Zhijie Yang, Xun Xiao, Jingyue Zhao, Zhenhua Zhu, Huadong Dai, Yuhua Tang, Weixia Xu, Li Luo, Lei Wang
2023DACMemory-Efficient and Real-Time SPAD-based dToF Depth Sensor with Spatial and Statistical Correlation.Shiyao Li, Zhenhua Zhu, Yu Zhu, Qingpeng Zhu, Jiangwei Zhang, Wenxiu Sun, Guohao Dai, Fei Qiao, Huazhong Yang, Yu Wang
2023DACProcessing-In-Hierarchical-Memory Architecture for Billion-Scale Approximate Nearest Neighbor Search.Zhenhua Zhu, Jun Liu, Guohao Dai, Shulin Zeng, Bing Li, Huazhong Yang, Yu Wang
2023DACPIM-HLS: An Automatic Hardware Generation Tool for Heterogeneous Processing-In-Memory-based Neural Network Accelerators.Yu Zhu, Zhenhua Zhu, Guohao Dai, Fengbin Tu, Hanbo Sun, Kwang-Ting Cheng, Huazhong Yang, Yu Wang
2023DATECLAP: Locality Aware and Parallel Triangle Counting with Content Addressable Memory.Tianyu Fu, Chiyue Wei, Zhenhua Zhu, Shang Yang, Zhongming Yu, Guohao Dai, Huazhong Yang, Yu Wang
2023DATEMinimizing Communication Conflicts in Network-On-Chip Based Processing-In-Memory Architecture.Hanbo Sun, Tongxin Xie, Zhenhua Zhu, Guohao Dai, Huazhong Yang, Yu Wang
2023HPCARealizing Extreme Endurance Through Fault-aware Wear Leveling and Improved Tolerance.Jiangwei Zhang, Chong Wang, Zhenhua Zhu, Donald Kline, Alex K. Jones, Huazhong Yang, Yu Wang
2023MICRODF-GAS: a Distributed FPGA-as-a-Service Architecture towards Billion-Scale Graph-based Approximate Nearest Neighbor Search.Shulin Zeng, Zhenhua Zhu, Jun Liu, Haoyu Zhang, Guohao Dai, Zixuan Zhou, Shuangchen Li, Xuefei Ning, Yuan Xie, Huazhong Yang, Yu Wang
2022DATEGibbon: Efficient Co-Exploration of NN Model and Processing-In-Memory Architecture.Hanbo Sun, Chenyu Wang, Zhenhua Zhu, Xuefei Ning, Guohao Dai, Huazhong Yang, Yu Wang
2022DATEExploiting Parallelism with Vertex-Clustering in Processing-In-Memory-based GCN Accelerators.Yu Zhu, Zhenhua Zhu, Guohao Dai, Kai Zhong, Huazhong Yang, Yu Wang
2022ISCADIMMining: pruning-efficient and parallel graph mining on near-memory-computing.Guohao Dai, Zhenhua Zhu, Tianyu Fu, Chiyue Wei, Bangyan Wang, Xiangyu Li, Yuan Xie, Huazhong Yang, Yu Wang
2022MDMOptimizing Graph-based Approximate Nearest Neighbor Search: Stronger and Smarter.Jun Liu, Zhenhua Zhu, Jingbo Hu, Hanbo Sun, Li Liu, Lingzhi Liu, Guohao Dai, Huazhong Yang, Yu Wang
2022WSCField-Based Assessment of Joint Motions in Construction Tasks with and Without Exoskeletons in Support of Worker-Exoskeleton Partnership Modeling and Simulation.Sean Tyler Bennett, Peter Gabriel Adamczyk, Fei Dai, Michael Wehner, Dharmaraj Veeramani, Zhenhua Zhu
2021ASPDACReliability-Aware Training and Performance Modeling for Processing-In-Memory Systems.Hanbo Sun, Zhenhua Zhu, Yi Cai, Shulin Zeng, Kaizhong Qiu, Yu Wang, Huazhong Yang
2021ICCADRerec: In-ReRAM Acceleration with Access-Aware Mapping for Personalized Recommendation.Yitu Wang, Zhenhua Zhu, Fan Chen, Mingyuan Ma, Guohao Dai, Yu Wang, Hai Li, Yiran Chen
2020ASPDACAn Energy-Efficient Quantized and Regularized Training Framework For Processing-In-Memory Accelerators.Hanbo Sun, Zhenhua Zhu, Yi Cai, Xiaoming Chen, Yu Wang, Huazhong Yang
2020DATESecurity Enhancement for RRAM Computing System through Obfuscating Crossbar Row Connections.Minhui Zou, Zhenhua Zhu, Yi Cai, Junlong Zhou, Chengliang Wang, Yu Wang
2019ASPDACLearning the sparsity for ReRAM: mapping and pruning sparse neural network for ReRAM based accelerator.Jilan Lin, Zhenhua Zhu, Yu Wang, Yuan Xie
2019DACA Configurable Multi-Precision CNN Computing Framework Based on Single Bit RRAM.Zhenhua Zhu, Hanbo Sun, Yujun Lin, Guohao Dai, Lixue Xia, Song Han, Yu Wang, Huazhong Yang
2019ICCADA General Logic Synthesis Framework for Memristor-based Logic Design.Zhenhua Zhu, Mingyuan Ma, Jialong Liu, Liying Xu, Xiaoming Chen, Yuchao Yang, Yu Wang, Huazhong Yang
2018ASPDACTraining low bitwidth convolutional neural network on RRAM.Yi Cai, Tianqi Tang, Lixue Xia, Ming Cheng, Zhenhua Zhu, Yu Wang, Huazhong Yang
2018DATERescuing memristor-based computing with non-linear resistance levels.Jilan Lin, Lixue Xia, Zhenhua Zhu, Hanbo Sun, Yi Cai, Hui Gao, Ming Cheng, Xiaoming Chen, Yu Wang, Huazhong Yang
2018ICCADMixed size crossbar based RRAM CNN accelerator with overlapped mapping method.Zhenhua Zhu, Jilan Lin, Ming Cheng, Lixue Xia, Hanbo Sun, Xiaoming Chen, Yu Wang, Huazhong Yang
2017DACTIME: A Training-in-memory Architecture for Memristor-based Deep Neural Networks.Ming Cheng, Lixue Xia, Zhenhua Zhu, Yi Cai, Yuan Xie, Yu Wang, Huazhong Yang
2006CGITrajectory-Based Grasp Interaction for Virtual Environments.Zhenhua Zhu, Shuming Gao, Huagen Wan, Wenzhen Yang