Xiaochun Ye
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
83
Venues
36
Active years
2008–2026
Best venue rank
A*
Where they publish
- CHPCC14 papers
- BEuroPar9 papers
- ADATE7 papers
- A*DAC5 papers
- CICA3PP5 papers
- CISPA4 papers
- AICCAD3 papers
- CICCD3 papers
- AISLPED3 papers
- A*HPCA3 papers
- CISCAS2 papers
- A*ASPLOS1 paper
- A*ISCA1 paper
- A*ICLR1 paper
- AICS1 paper
- A*SIGIR1 paper
- ASDM1 paper
- BIJCNN1 paper
- BSRDS1 paper
- A*AAAI1 paper
- BWCNC1 paper
- BGLOBECOM1 paper
- A*IJCAI1 paper
- CNPC1 paper
- BPIMRC1 paper
- CSEKE1 paper
- BICONIP1 paper
- A*CVPR1 paper
- A*ICCV1 paper
- CIOLTS1 paper
- A*MICRO1 paper
- BATVA1 paper
- CSNPD1 paper
- BTrustCom1 paper
- BICPADS1 paper
- CPDCAT1 paper
Papers
83 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ASPLOS | BitRed: Taming Non-Uniform Bit-Level Sparsity with a Programmable RISC-V ISA for DNN Acceleration. | Yanhuan Liu, Wenming Li, Kunming Zhang, Yuqun Liu, Siao Wen, Lexin Wang, Tianyu Liu, Haibin Wu, Zhihua Fan, Xiaochun Ye, Dongrui Fan, Xuejun An |
| 2026 | DATE | CAMI: A Context-Aware Isolation Architecture for GPU Memories. | Hao Lan, Wei Yan, Qinfen Hao, Xiaochun Ye, Yier Jin, Yong Liu, Ninghui Sun |
| 2026 | DATE | RISC-V ISA Extensions for Vectorized Unstructured Sparse SpMM in LLM Inference. | Tengfei Xia, Zhihua Fan, Jing Xue, Shantian Qin, Xiaochun Ye, Wenming Li |
| 2026 | DATE | A | Zhiyuan Zhang, Zhihua Fan, Wenming Li, Yudong Mu, Yuhang Qiu, Zhen Wang, Xiaochun Ye, Xuejun An |
| 2026 | EuroPar | HGNNMap: Heterogeneous Graph Neural Network-Based Mapping for Spatial Accelerators. | Shengzhong Tang, Zhihua Fan, Tianyu Liu, Xuejun An, Xiaochun Ye, Wenming Li |
| 2026 | ISCA | MLX: Multi-Layer Execution for Structured LLM Workload Acceleration on Spatial Architectures. | Haibin Wu, Wenming Li, Zhihua Fan, Zirui Ma, Yuqun Liu, Tengfei Xia, Yanhuan Liu, Kunming Zhang, Xiaochun Ye, Dongrui Fan, Jian Weng |
| 2025 | DAC | MetaDSE: A Few-shot Meta-learning Framework for Cross-workload CPU Design Space Exploration. | Runzhen Xue, Hao Wu, Mingyu Yan, Ziheng Xiao, Xiaochun Ye, Dongrui Fan |
| 2025 | DATE | Accelerating Authenticated Block Ciphers via RISC-V Custom Cryptography Instructions. | Yuhang Qiu, Wenming Li, Tianyu Liu, Zhen Wang, Zhiyuan Zhang, Zhihua Fan, Xiaochun Ye, Dongrui Fan, Zhimin Tang |
| 2025 | DATE | LiGNN: Accelerating GNN Training Through Locality-Aware Dropout. | Gongjian Sun, Mingyu Yan, Dengke Han, Runzhen Xue, Xiaochun Ye, Dongrui Fan |
| 2025 | EuroPar | ParTEE: A Framework for Secure Parallel Computing of RISC-V Trusted Execution Environments. | Hao Lan, Ziang Zhou, Qi Zhu, Wei Yan, Qinfen Hao, Xiaochun Ye, Yong Liu, Ninghui Sun |
| 2025 | EuroPar | FDHA: Fusion-Driven Heterogeneous Accelerator for Efficient Diffusion Model Inference. | Yudong Mu, Zhihua Fan, Xiaoxia Yao, Wenming Li, Zhiyuan Zhang, Honglie Wang, Xuejun An, Xiaochun Ye |
| 2025 | EuroPar | CGP-Graphless: Towards Efficient Serverless Graph Processing via CPU-GPU Pipelined Collaboration. | Yiming Sun, Jiaqi Zhang, Jie Zhang, Huawei Cao, Xuejun An, Xiaochun Ye |
| 2025 | HPCC | TSCNN: Compressing and Accelerating Sparse CNNs Using Sign-Reserved Toeplitz Filters. | Zhen Wang, Tianyu Liu, Zhihua Fan, Yuhang Qiu, Zhiyuan Zhang, Wenming Li, Xiaochun Ye, Dongrui Fan |
| 2025 | ICA3PP | A GCN Accelerator with Unified Architecture. | Meng Wu, Mingyu Yan, Lei Deng, Wenming Li, Zhimin Zhang, Xiaochun Ye, Dongrui Fan |
| 2025 | ICCAD | J2Place: A Multiphase Clocking-Oriented Length-Matching Placement for Rapid Single-Flux-Quantum Circuits. | Rongliang Fu, Minglei Zhou, Huilong Jiang, Junying Huang, Xiaochun Ye, Tsung-Yi Ho |
| 2025 | ICCAD | CacheGuardian: A Timing Side-Channel Resilient LLC Design. | Ziang Zhou, Qi Zhu, Hao Lan, Huifeng Zhu, Wei Yan, Chenglu Jin, Xuejun An, Xiaochun Ye |
| 2025 | ICCD | TLV-HGNN: Thinking Like a Vertex for Memory-Efficient HGNN Inference. | Dengke Han, Duo Wang, Mingyu Yan, Xiaochun Ye, Dongrui Fan |
| 2025 | ICCD | A Co-Design Framework for Graph Processing on CPU-GPU Heterogeneous Platforms. | Yuan Zhang, Huawei Cao, Yiming Sun, Ming Dun, Jie Zhang, Xiaochun Ye |
| 2025 | ICLR | GPromptShield: Elevating Resilience in Graph Prompt Tuning Against Adversarial Attacks. | Shuhan Song, Ping Li, Ming Dun, Maolei Huang, Huawei Cao, Xiaochun Ye |
| 2025 | ISCAS | StreamDCIM: A Tile-based Streaming Digital CIM Accelerator with Mixed-stationary Cross-forwarding Dataflow for Multimodal Transformer. | Shantian Qin, Ziqing Qiang, Zhihua Fan, Wenming Li, Xuejun An, Xiaochun Ye, Dongrui Fan |
| 2025 | ICS | JBSA: A Bit-Serial Accelerator for Deep Neural Networks Using Superconducting SFQ Logic. | Yang Su, Sheng Li, Huilong Jiang, Haofei Yin, Rongliang Fu, Junying Huang, Xiaochun Ye, Zhimin Zhang, Jie Ren, Xiaoping Gao, Tsung-Yi Ho, Dongrui Fan |
| 2025 | ISCAS | ITERTL: An Iterative Framework for Fine-tuning LLMs for RTL Code Generation. | Peiyang Wu, Nan Guo, Xiao Xiao, Wenming Li, Xiaochun Ye, Dongrui Fan |
| 2025 | ISLPED | A High-Performance Dataflow-Based ORB Extractor Accelerator for SLAM. | Rui Xue, Wenming Li, Haibin Wu, Cheng Guo, Yi Li, Xiaochun Ye, Dongrui Fan |
| 2025 | SIGIR | Leveraging Large Language Models for Effective Label-free Node Classification in Text-Attributed Graphs. | Taiyan Zhang, Renchi Yang, Yurui Lai, Mingyu Yan, Xiaochun Ye, Dongrui Fan |
| 2025 | SDM | Equipping Graph Autoencoders: Revisiting Masking Strategies from a Robustness Perspective. | Shuhan Song, Ping Li, Ming Dun, Yuan Zhang, Huawei Cao, Xiaochun Ye |
| 2024 | DAC | GDR-HGNN: A Heterogeneous Graph Neural Networks Accelerator Frontend with Graph Decoupling and Recoupling. | Runzhen Xue, Mingyu Yan, Dengke Han, Yihan Teng, Zhimin Tang, Xiaochun Ye, Dongrui Fan |
| 2024 | DATE | JPlace: A Clock-Aware Length-Matching Placement for Rapid Single-Flux-Quantum Circuits. | Siyan Chen, Rongliang Fu, Junying Huang, Zhimin Zhang, Xiaochun Ye, Tsung-Yi Ho, Dongrui Fan |
| 2024 | EuroPar | GDL-GNN: Applying GPU Dataloading of Large Datasets for Graph Neural Network Inference. | Haoran Dang, Meng Wu, Mingyu Yan, Xiaochun Ye, Dongrui Fan |
| 2024 | EuroPar | ADE-HGNN: Accelerating HGNNs Through Attention Disparity Exploitation. | Dengke Han, Meng Wu, Runzhen Xue, Mingyu Yan, Xiaochun Ye, Dongrui Fan |
| 2024 | EuroPar | Disttack: Graph Adversarial Attacks Toward Distributed GNN Training. | Yuxiang Zhang, Xin Liu, Meng Wu, Wei Yan, Mingyu Yan, Xiaochun Ye, Dongrui Fan |
| 2024 | HPCC | OBSD: On-The-Fly Block-Wise Sparse Distillation Accelerating SpGEMMs in DNN Applications. | Yanhuan Liu, Wenming Li, Kunming Zhang, Zhihua Fan, Haibin Wu, Lexin Wang, Tianyu Liu, Yuhang Qiu, Zhen Wang, Xiaochun Ye, Dongrui Fan, Xuejun An |
| 2024 | ICA3PP | Accelerating Mini-batch HGNN Training by Reducing CUDA Kernels. | Meng Wu, Jingkai Qiu, Mingyu Yan, Wenming Li, Yang Zhang, Zhimin Zhang, Xiaochun Ye, Dongrui Fan |
| 2024 | IJCNN | A Structure-Aware Graph Representation Learning Optimization. | Ping Li, Shuhan Song, Huawei Cao, Yuan Zhang, Zhimin Tang, Xiaochun Ye |
| 2024 | SRDS | DTC: Real-Time and Accurate Distributed Triangle Counting in Fully Dynamic Graph Streams. | Wei Xuan, Yan Liang, Huawei Cao, Ning Lin, Xiaochun Ye, Dongrui Fan |
| 2023 | AAAI | Simple and Efficient Heterogeneous Graph Neural Network. | Xiaocheng Yang, Mingyu Yan, Shirui Pan, Xiaochun Ye, Dongrui Fan |
| 2023 | DAC | A High-accurate Multi-objective Exploration Framework for Design Space of CPU. | Duo Wang, Mingyu Yan, Xin Liu, Mo Zou, Tianyu Liu, Wenming Li, Xiaochun Ye, Dongrui Fan |
| 2023 | EuroPar | Improving Utilization of Dataflow Architectures Through Software and Hardware Co-Design. | Zhihua Fan, Wenming Li, Shengzhong Tang, Xuejun An, Xiaochun Ye, Dongrui Fan |
| 2023 | HPCC | ROMA: A Reconfigurable On-chip Memory Architecture for Multi-core Accelerators. | Shantian Qin, Wenming Li, Zhihua Fan, Zhen Wang, Tianyu Liu, Haibin Wu, Kunming Zhang, Xuejun An, Xiaochun Ye, Dongrui Fan |
| 2023 | ICCAD | A Transfer Learning Framework for High-Accurate Cross-Workload Design Space Exploration of CPU. | Duo Wang, Mingyu Yan, Yihan Teng, Dengke Han, Haoran Dang, Xiaochun Ye, Dongrui Fan |
| 2023 | ICCD | Alleviating Transfer Latency in DataFlow Accelerator for DSP Applications. | Haibin Wu, Wenming Li, Zhihua Fan, Zhen Wang, Tianyu Liu, Junying Huang, Shengzhong Tang, Yanhuan Liu, Kunming Zhang, Xiaochun Ye, Dongrui Fan |
| 2023 | WCNC | Hardware-in-the-Loop Framework for Testing Wireless V2X Communication. | Anja Dakic, Benjamin Rainer, Markus Hofer, Stefan Zelenbaba, Stefan Teschl, Guo Nan, Peter Priller, Xiaochun Ye, Thomas Zemen |
| 2022 | DAC | Alleviating datapath conflicts and design centralization in graph analytics acceleration. | Haiyang Lin, Mingyu Yan, Duo Wang, Mo Zou, Fengbin Tu, Xiaochun Ye, Dongrui Fan, Yuan Xie |
| 2022 | DATE | LRP: Predictive output activation based on SVD approach for CNN s acceleration. | Xinxin Wu, Zhihua Fan, Tianyu Liu, Wenming Li, Xiaochun Ye, Dongrui Fan |
| 2022 | GLOBECOM | WiLi - Vehicular Wireless Channel Dataset enriched with LiDAR and Radar Data. | Benjamin Rainer, Stefan Zelenbaba, Anja Dakic, Markus Hofer, David Lschenbrand, Thomas Zemen, Xiaochun Ye, Guo Nan, Stefan Teschl, Peter Priller |
| 2022 | HPCC | A Loop Optimization Method for Dataflow Architecture. | Zhihua Fan, Wenming Li, Tianyu Liu, Shengzhong Tang, Zhen Wang, Xuejun An, Xiaochun Ye, Dongrui Fan |
| 2022 | HPCC | Parallel-Friendly and Work-Efficient Single Source Shortest Path Algorithm on Single-Node System. | Jie Zhang, Yuan Zhang, Yiming Sun, Huawei Cao, Xuejun An, Xiaochun Ye |
| 2022 | ICA3PP | MatGraph: An Energy-Efficient and Flexible CGRA Engine for Matrix-Based Graph Analytics. | Long Tan, Mingyu Yan, Duo Wang, Wenming Li, Xiaochun Ye, Dongrui Fan |
| 2022 | ICA3PP | GEM: Execution-Aware Cache Management for Graph Analytics. | Mo Zou, Mingyu Yan, Wenming Li, Zhimin Tang, Xiaochun Ye, Dongrui Fan |
| 2022 | IJCAI | Survey on Graph Neural Network Acceleration: An Algorithmic Perspective. | Xin Liu, Mingyu Yan, Lei Deng, Guoqi Li, Xiaochun Ye, Dongrui Fan, Shirui Pan, Yuan Xie |
| 2022 | NPC | A Routing-Aware Mapping Method for Dataflow Architectures. | Zhihua Fan, Wenming Li, Tianyu Liu, Xuejun An, Xiaochun Ye, Dongrui Fan |
| 2021 | HPCA | Streamline Ring ORAM Accesses through Spatial and Temporal Optimization. | Dingyuan Cao, Mingzhe Zhang, Hang Lu, Xiaochun Ye, Dongrui Fan, Yuezhi Che, Rujia Wang |
| 2021 | ISPA | Alleviating Imbalance in Synchronous Distributed Training of Deep Neural Networks. | Haiyang Lin, Mingyu Yan, Duo Wang, Wenming Li, Xiaochun Ye, Zhimin Tang, Dongrui Fan |
| 2021 | PIMRC | Scalable, resource and locality-aware selection of active scatterers in Geometry-based stochastic channel models. | Benjamin Rainer, Markus Hofer, Stefan Zelenbaba, David Lschenbrand, Thomas Zemen, Xiaochun Ye, Peter Priller |
| 2021 | SEKE | Triangle Counting by Adaptively Resampling over Evolving Graph Streams. | Wei Xuan, Huawei Cao, Mingyu Yan, Zhimin Tang, Xiaochun Ye, Dongrui Fan |
| 2020 | HPCA | HyGCN: A GCN Accelerator with Hybrid Architecture. | Mingyu Yan, Lei Deng, Xing Hu, Ling Liang, Yujing Feng, Xiaochun Ye, Zhimin Zhang, Dongrui Fan, Yuan Xie |
| 2020 | ICA3PP | CTA: A Critical Task Aware Scheduling Mechanism for Dataflow Architecture. | Yan Ou, Chongfei Shen, Yujing Feng, Xinxin Wu, Wenming Li, Xiaochun Ye, Dongrui Fan |
| 2020 | ICONIP | Pixel-Semantic Revising of Position: One-Stage Object Detector with Shared Encoder-Decoder. | Qian Li, Nan Guo, Xiaochun Ye, Dongrui Fan, Zhimin Tang |
| 2020 | ISPA | Highly Efficient and GPU-Friendly Implementation of BFS on Single-node System. | Rongyu Dong, Huawei Cao, Xiaochun Ye, Yuan Zhang, Qinfen Hao, Dongrui Fan |
| 2019 | CVPR | Utilizing the Instability in Weakly Supervised Object Detection. | Boxiao Liu, Yan Gao, Nan Guo, Xiaochun Ye, Fang Wan, Haihang You, Dongrui Fan |
| 2019 | DAC | Magma: A Monolithic 3D Vertical Heterogeneous ReRAM-based Main Memory Architecture. | Farzaneh Zokaee, Mingzhe Zhang, Xiaochun Ye, Dongrui Fan, Lei Jiang |
| 2019 | HPCC | C-MAP: Improving the Effectiveness of Mapping Method for CGRA by Reducing NoC Congestion. | Shuqian An, Mingzhe Zhang, Xiaochun Ye, Da Wang, Hao Zhang, Dongrui Fan, Zhimin Tang |
| 2019 | HPCC | A Sharing Path Awareness Scheduling Algorithm for Dataflow Architecture. | Yi Li, Xu Tan, Rui Xue, Xiaochun Ye, Wenming Li, Da Wang, Hao Zhang, Dongrui Fan |
| 2019 | HPCC | Highly Efficient Breadth-First Search on CPU-Based Single-Node System. | Chenglong Zhang, Huawei Cao, Xiaochun Ye, Guobo Wang, Qinfen Hao, Dongrui Fan |
| 2019 | ICCV | C-MIDN: Coupled Multiple Instance Detection Network With Segmentation Guidance for Weakly Supervised Object Detection. | Gao Yan, Boxiao Liu, Nan Guo, Xiaochun Ye, Fang Wan, Haihang You, Dongrui Fan |
| 2019 | IOLTS | iATPG: Instruction-level Automatic Test Program Generation for Vulnerabilities under DVFS attack. | Kuozhong Zhang, Junying Huang, Jing Ye, Xiaochun Ye, Da Wang, Dongrui Fan, Huawei Li, Xiaowei Li, Zhimin Zhang |
| 2019 | ISLPED | Balancing Memory Accesses for Energy-Efficient Graph Analytics Accelerators. | Mingyu Yan, Xing Hu, Shuangchen Li, Itir Akgun, Han Li, Xin Ma, Lei Deng, Xiaochun Ye, Zhimin Zhang, Dongrui Fan, Yuan Xie |
| 2019 | MICRO | Alleviating Irregularity in Graph Analytics Acceleration: a Hardware/Software Co-Design Approach. | Mingyu Yan, Xing Hu, Shuangchen Li, Abanti Basak, Han Li, Xin Ma, Itir Akgun, Yujing Feng, Peng Gu, Lei Deng, Xiaochun Ye, Zhimin Zhang, Dongrui Fan, Yuan Xie |
| 2018 | HPCA | SmarCo: An Efficient Many-Core Processor for High-Throughput Applications in Datacenters. | Dongrui Fan, Wenming Li, Xiaochun Ye, Da Wang, Hao Zhang, Zhimin Tang, Ninghui Sun |
| 2018 | HPCC | Optimizing the Efficiency of Data Transfer in Dataflow Architectures. | Yujing Feng, Taoran Xiang, Xiaochun Ye, Dongrui Fan, Da Wang, Dongdong Wu, Zhimin Tang |
| 2018 | HPCC | Accelerating CNN Algorithm with Fine-Grained Dataflow Architectures. | Taoran Xiang, Yujing Feng, Xiaochun Ye, Xu Tan, Wenming Li, Yatao Zhu, Meng Wu, Hao Zhang, Dongrui Fan |
| 2018 | ISPA | WEAVER: An Energy Efficient, General-Purpose Acceleration Architecture for String Operations in Big Data Applications. | Wenming Li, Xiaochun Ye, Da Wang, Hao Zhang, Dongdong Wu, Zhimin Zhang, Dongrui Fan |
| 2018 | ISPA | High-Performance and Energy-Efficient Fault Tolerance Scheduling Algorithm Based on Improved TMR for Heterogeneous System. | Shigan Yu, Zhimin Tang, Xiaochun Ye, Zhimin Zhang, Dongrui Fan, Zhiying |
| 2016 | HPCC | ACCC: An Acceleration Mechanism for Character Operation Based on Cache Computing in Big Data Applications. | Yuqiong Qi, Lina Ma, Wenming Li, Xiaochun Ye, Da Wang, Dongrui Fan, Ninghui Sun |
| 2014 | ATVA | Efficiently and Completely Verifying Synchronized Consistency Models. | Yi Lv, Luming Sun, Xiaochun Ye, Dongrui Fan, Peng Wu |
| 2014 | SNPD | Optimizing mapreduce with low memory requirements for shared-memory systems. | Yasong Zheng, Yuanchao Xu, Haibo Meng, Xiaochun Ye, Lingjun Fan, Futao Miao, Dongrui Fan |
| 2013 | HPCC | Low Execution Efficiency: When General Multi-core Processor Meets Wireless Communication Protocol. | Fenglong Song, Yasong Zheng, Futao Miao, Xiaochun Ye, Hao Zhang, Dongrui Fan, Zhiyong Liu |
| 2013 | ISLPED | SimICT: A fast and flexible framework for performance and power evaluation of large-scale architecture. | Xiaochun Ye, Dongrui Fan, Ninghui Sun, Shibin Tang, Mingzhe Zhang, Hao Zhang |
| 2013 | TrustCom | A Path-Adaptive Opto-electronic Hybrid NoC for Chip Multi-processor. | Mingzhe Zhang, Da Wang, Xiaochun Ye, Liqiang He, Dongrui Fan, Zhiyong Liu |
| 2012 | EuroPar | CRAW/P: A Workload Partition Method for the Efficient Parallel Simulation of Manycores. | Shuai Jiao, Paolo Ienne, Xiaochun Ye, Da Wang, Dongrui Fan, Ninghui Sun |
| 2012 | HPCC | PartitionSim: A Parallel Simulator for Many-cores. | Shuai Jiao, Da Wang, Xiaochun Ye, Weizhi Xu, Hao Zhang, Ninghui Sun |
| 2012 | HPCC | ALWP: A Workload Partition Method for the Efficient Parallel Simulation of Manycores. | Shuai Jiao, Da Wang, Xiaochun Ye, Weizhi Xu, Hao Zhang, Ninghui Sun |
| 2012 | ICPADS | Auto-Tuning GEMV on Many-Core GPU. | Weizhi Xu, Zhiyong Liu, Jun Wu, Xiaochun Ye, Shuai Jiao, Da Wang, Fenglong Song, Dongrui Fan |
| 2008 | PDCAT | Efficient Parallelization of a Protein Sequence Comparison Algorithm on Manycore Architecture. | Xiaochun Ye, Van Hoa Nguyen, Dominique Lavenier, Dongrui Fan |