| 2026 | ASPDAC | AC-Refiner: Efficient Arithmetic Circuit Optimization Using Conditional Diffusion Models. | Chenhao Xue, Kezhi Li, Jiaxing Zhang, Yi Ren, Zhengyuan Shi, Chen Zhang, Yibo Lin, Lining Zhang, Qiang Xu, Guangyu Sun |
| 2026 | FAST | Xerxes: Extensive Exploration of Scalable Hardware Systems with CXL-Based Simulation Framework. | Yuda An, Shushu Yi, Bo Mao, Qiao Li, Mingzhe Zhang, Diyu Zhou, Ke Zhou, Nong Xiao, Guangyu Sun, Yingwei Luo, Jie Zhang |
| 2026 | HPCA | COMET: Communication and Memory Co-Design for Fine-Grained AI Inference in MCM Accelerators. | Taishu Sheng, Guangyu Sun, Dezun Dong |
| 2026 | HPCA | Towards Compute-Aware In-Switch Computing for LLMs Tensor-Parallelism on Multi-GPU Systems. | Chen Zhang, Qijun Zhang, Zhuoshan Zhou, Yijia Diao, Haibo Wang, Zhe Zhou, Zhipeng Tu, Zhiyao Li, Guangyu Sun, Zhuoran Song, Zhigang Ji, Jingwen Leng, Minyi Guo |
| 2026 | ISCA | DIAMoND: Dynamic Inference for Adaptive Edge MOE with Heterogeneous In-NAND and Near-DRAM Compute Architecture. | Ling Liang, Tianyang Luo, Shuzhang Zhong, Dongxue Zhao, Qichao Ma, Renjie Wei, Jingyu Wang, Meng Li, Guangyu Sun, Zongwei Wang, Yimao Cai |
| 2026 | ISCA | Tetris: Efficient Long-context LLM Serving with Chunkwise Dynamic Sequence Parallelism. | Cong Li, Yuzhe Yang, Xuegui Zheng, Qifan Yang, Yijin Guan, Size Zheng, Li-Wen Chang, Shufan Liu, Xin Liu, Guangyu Sun |
| 2026 | ISCA | Graph.hls: A Compiler Framework for Composable Graph Accelerator Design. | Feiyang Wu, Xuxiao Yang, Zhuohang Bian, Jing Wang, Ruifan Xu, Guangyu Sun, Yun Liang, Youwei Zhuo |
| 2026 | ISCA | Accelerating MoE with Dynamic In-Switch Computing on Multi-GPUs. | Qijun Zhang, Chen Zhang, Zhuoshan Zhou, Haibo Wang, Zhe Zhou, Zhipeng Tu, Guangyu Sun, Zhiyao Xie, Yijia Diao, Zhigang Ji, Jingwen Leng, Guanghui He, Minyi Guo |
| 2026 | ISCA | MoE-Hub: Taming Software Complexity for Seamless MoE Overlap with Hardware-Accelerated Communication on Multi-GPU Systems. | Zhuoshan Zhou, Chen Zhang, Shuyi Zhang, Qijun Zhang, Haibo Wang, Zhe Zhou, Zhipeng Tu, Guangyu Sun, Yijia Diao, Zhigang Ji, Jingwen Leng, Guanghui He, Minyi Guo |
| 2026 | ISCAS | Phase-Change Memory Based Passive Timing Circuits for DRAM Refresh Management. | Anjunyi Fan, Yingming Lu, Guangyu Sun, Bing Li, Bonan Yan, Yuchao Yang |
| 2025 | ASPLOS | CTXNL: A Software-Hardware Co-designed Solution for Efficient CXL-Based Transaction Processing. | Zhao Wang, Yiqi Chen, Cong Li, Yijin Guan, Dimin Niu, Tianchan Guan, Zhaoyang Du, Xingda Wei, Guangyu Sun |
| 2025 | HPCA | UniNDP: A Unified Compilation and Simulation Tool for Near DRAM Processing Architectures. | Tongxin Xie, Zhenhua Zhu, Bing Li, Yukai He, Cong Li, Guangyu Sun, Huazhong Yang, Yuan Xie, Yu Wang |
| 2025 | ICCAD | Orthrus: Dual-Loop Automated Framework for System-Technology Co-Optimization. | Yi Ren, Baokang Peng, Chenhao Xue, Kairong Guo, Yukun Wang, Guoyao Cheng, Yibo Lin, Lining Zhang, Guangyu Sun |
| 2025 | ISCA | H | Cong Li, Yihan Yin, Xintong Wu, Jingchen Zhu, Zhutianya Gao, Dimin Niu, Qiang Wu, Xin Si, Yuan Xie, Chen Zhang, Guangyu Sun |
| 2025 | ISCA | AIM: Software and Hardware Co-design for Architecture-level IR-drop Mitigation in High-performance PIM. | Yuanpeng Zhang, Xing Hu, Xi Chen, Zhihang Yuan, Cong Li, Jingchen Zhu, Zhao Wang, Chenguang Zhang, Xin Si, Wei Gao, Qiang Wu, Runsheng Wang, Guangyu Sun |
| 2025 | WACV | Navigating Heterogeneity and Privacy in One-Shot Federated Learning with Diffusion Models. | Matas Mendieta, Guangyu Sun, Chen Chen |
| 2024 | ASPLOS | PIM-DL: Expanding the Applicability of Commodity DRAM-PIMs for Deep Learning via Algorithm-System Co-Optimization. | Cong Li, Zhe Zhou, Yang Wang, Fan Yang, Ting Cao, Mao Yang, Yun Liang, Guangyu Sun |
| 2024 | ASPLOS | SpecPIM: Accelerating Speculative Inference on PIM-Enabled System via Architecture-Dataflow Co-Exploration. | Cong Li, Zhe Zhou, Size Zheng, Jiaxi Zhang, Yun Liang, Guangyu Sun |
| 2024 | DAC | A Software-Hardware Co-design Solution for 3D Inner Structure Reconstruction. | Xingchen Li, Zhe Zhou, Qilin Zheng, Guangyu Sun, Qiankun Wang, Chenhao Xue |
| 2024 | DAC | Oltron: Algorithm-Hardware Co-design for Outlier-Aware Quantization of LLMs with Inter-/Intra-Layer Adaptation. | Chenhao Xue, Chen Zhang, Xun Jiang, Zhutianya Gao, Yibo Lin, Guangyu Sun |
| 2024 | DATE | Algorithm-Hardware Co-Design for Energy-Efficient A/D Conversion in ReRAM-Based Accelerators. | Chenguang Zhang, Zhihang Yuan, Xingchen Li, Guangyu Sun |
| 2024 | ECCV | Towards Multi-modal Transformers in Federated Learning. | Guangyu Sun, Matas Mendieta, Aritra Dutta, Xin Li, Chen Chen |
| 2024 | HPCA | StreamPIM: Streaming Matrix Computation in Racetrack Memory. | Yuda An, Yunxiao Tang, Shushu Yi, Li Peng, Xiurui Pan, Guangyu Sun, Zhaochu Luo, Qiao Li, Jie Zhang |
| 2024 | ICCAD | OriGen: Enhancing RTL Code Generation with Code-to-Code Augmentation and Self-Reflection. | Fan Cui, Chenyang Yin, Kexing Zhou, Youwei Xiao, Guangyu Sun, Qiang Xu, Qipeng Guo, Yun Liang, Xingcheng Zhang, Demin Song, Dahua Lin |
| 2024 | MICRO | NeoMem: Hardware/Software Co-Design for CXL-Native Memory Tiering. | Zhe Zhou, Yiqi Chen, Tao Zhang, Yang Wang, Ran Shu, Shuotao Xu, Peng Cheng, Lei Qu, Yongqiang Xiong, Jie Zhang, Guangyu Sun |
| 2023 | DAC | NMExplorer: An Efficient Exploration Framework for DIMM-based Near-Memory Tensor Reduction. | Cong Li, Zhe Zhou, Xingchen Li, Guangyu Sun, Dimin Niu |
| 2023 | HPCA | DIMM-Link: Enabling Efficient Inter-DIMM Communication for Near-Memory Processing. | Zhe Zhou, Cong Li, Fan Yang, Guangyu Sun |
| 2023 | ICCV | FedPerfix: Towards Partial Model Personalization of Vision Transformers in Federated Learning. | Guangyu Sun, Matas Mendieta, Jun Luo, Shandong Wu, Chen Chen |
| 2023 | MICRO | TileFlow: A Framework for Modeling Fusion Dataflow via Tree-based Analysis. | Size Zheng, Siyuan Chen, Siyuan Gao, Liancheng Jia, Guangyu Sun, Runsheng Wang, Yun Liang |
| 2022 | DAC | Tailor: removing redundant operations in memristive analog neural network accelerators. | Xingchen Li, Zhihang Yuan, Guangyu Sun, Liang Zhao, Zhichao Lu |
| 2022 | ECCV | PTQ4ViT: Post-training Quantization for Vision Transformers with Twin Uniform Quantization. | Zhihang Yuan, Chenhao Xue, Yiqi Chen, Qiang Wu, Guangyu Sun |
| 2022 | HPCA | Enabling High-Quality Uncertainty Quantification in a PIM Designed for Bayesian Neural Network. | Xingchen Li, Bingzhe Wu, Guangyu Sun, Zhe Zhang, Zhihang Yuan, Runsheng Wang, Ru Huang, Dimin Niu, Hongzhong Zheng, Zhichao Lu, Liang Zhao, Meng-Fan Marvin Chang, Tianchan Guan, Xin Si |
| 2022 | USENIX | PetS: A Unified Framework for Parameter-Efficient Transformers Serving. | Zhe Zhou, Xuechao Wei, Jiejing Zhang, Guangyu Sun |
| 2021 | DAC | BlockGNN: Towards Efficient GNN Acceleration Using Block-Circulant Weight Matrices. | Zhe Zhou, Bizhao Shi, Zhe Zhang, Yijin Guan, Guangyu Sun, Guojie Luo |
| 2021 | ICCAD | SSR: A Skeleton-based Synthesis Flow for Hybrid Processing-in-RRAM Modes. | Feng Wang, Guangyu Sun, Guojie Luo |
| 2021 | ISCA | PipeZK: Accelerating Zero-Knowledge Proof with a Pipelined Architecture. | Ye Zhang, Shuo Wang, Xian Zhang, Jiangbin Dong, Xingzhong Mao, Fan Long, Cong Wang, Dong Zhou, Mingyu Gao, Guangyu Sun |
| 2020 | AAAI | Characterizing Membership Privacy in Stochastic Gradient Langevin Dynamics. | Bingzhe Wu, Chaochao Chen, Shiwan Zhao, Cen Chen, Yuan Yao, Guangyu Sun, Li Wang, Xiaolu Zhang, Jun Zhou |
| 2020 | DAC | Hardware-assisted Service Live Migration in Resource-limited Edge Computing Systems. | Zhe Zhou, Xintong Li, Xiaoyang Wang, Zheng Liang, Guangyu Sun, Guojie Luo |
| 2020 | ECCV | S2DNAS: Transforming Static CNN Model for Dynamic Inference via Neural Architecture Search. | Zhihang Yuan, Bingzhe Wu, Guangyu Sun, Zheng Liang, Shiwan Zhao, Weichen Bi |
| 2020 | ICCAD | MobiLattice: A Depth-wise DCNN Accelerator with Hybrid Digital/Analog Nonvolatile Processing-In-Memory Block. | Qilin Zheng, Xingchen Li, Zongwei Wang, Guangyu Sun, Yimao Cai, Ru Huang, Yiran Chen, Hai Li |
| 2019 | AAAI | G2C: A Generator-to-Classifier Framework Integrating Multi-Stained Visual Cues for Pathological Glomerulus Classification. | Bingzhe Wu, Xiaolu Zhang, Shiwan Zhao, Lingxi Xie, Caihong Zeng, Zhihong Liu, Guangyu Sun |
| 2019 | CVPR | P3SGD: Patient Privacy Preserving SGD for Regularizing Deep CNNs in Pathological Image Classification. | Bingzhe Wu, Shiwan Zhao, Guangyu Sun, Xiaolu Zhang, Zhong Su, Caihong Zeng, Zhihong Liu |
| 2019 | DAC | ZUMA: Enabling Direct Insertion/Deletion Operations with Emerging Skyrmion Racetrack Memory. | Zheng Liang, Guangyu Sun, Wang Kang, Xing Chen, Weisheng Zhao |
| 2019 | IJCAI | BAYHENN: Combining Bayesian Deep Learning and Homomorphic Encryption for Secure DNN Inference. | Peichen Xie, Bingzhe Wu, Guangyu Sun |
| 2018 | HPCA | RC-NVM: Enabling Symmetric Row and Column Memory Accesses for In-memory Databases. | Peng Wang, Shuo Li, Guangyu Sun, Xiaoyang Wang, Yiran Chen, Hai Li, Jason Cong, Nong Xiao, Tao Zhang |
| 2018 | HPCA | PM3: Power Modeling and Power Management for Processing-in-Memory. | Chao Zhang, Tong Meng, Guangyu Sun |
| 2018 | ICCD | Path Prefetching: Accelerating Index Searches for In-Memory Databases. | Shuo Li, Zhiguang Chen, Nong Xiao, Guangyu Sun |
| 2018 | MICRO | Shadow Block: Accelerating ORAM Accesses with Data Duplication. | Xian Zhang, Guangyu Sun, Peichen Xie, Chao Zhang, Yannan Liu, Lingxiao Wei, Qiang Xu, Chun Jason Xue |
| 2017 | ASPDAC | FPGA-based accelerator for long short-term memory recurrent neural networks. | Yijin Guan, Zhihang Yuan, Guangyu Sun, Jason Cong |
| 2017 | DAC | Toss-up Wear Leveling: Protecting Phase-Change Memories from Inconsistent Write Patterns. | Xian Zhang, Guangyu Sun |
| 2017 | DATE | SPMS: Strand based persistent memory system. | Shuo Li, Peng Wang, Nong Xiao, Guangyu Sun, Fang Liu |
| 2017 | DATE | Protect non-volatile memory from wear-out attack based on timing difference of row buffer hit/miss. | Haiyu Mao, Xian Zhang, Guangyu Sun, Jiwu Shu |
| 2017 | FCCM | FP-DNN: An Automated Framework for Mapping Deep Neural Networks onto FPGAs with RTL-HLS Hybrid Templates. | Yijin Guan, Hao Liang, Ningyi Xu, Wenqiang Wang, Shaoshuai Shi, Xi Chen, Guangyu Sun, Wei Zhang, Jason Cong |
| 2017 | ICANN | Reducing Overfitting in Deep Convolutional Neural Networks Using Redundancy Regularizer. | Bingzhe Wu, Zhichao Liu, Zhihang Yuan, Guangyu Sun, Charles Wu |
| 2017 | ICWS | Hierarchical RNN Networks for Structured Semantic Web API Model Learning and Extraction. | Shengpeng Liu, Ying Li, Guangyu Sun, Binbin Fan, ShuiGuang Deng |
| 2016 | ASPDAC | Performance-centric register file design for GPUs using racetrack memory. | Shuo Wang, Yun Liang, Chao Zhang, Xiaolong Xie, Guangyu Sun, Yongpan Liu, Yu Wang, Xiuhong Li |
| 2016 | ASPDAC | A novel PUF based on cell error rate distribution of STT-RAM. | Xian Zhang, Guangyu Sun, Yaojun Zhang, Yiran Chen, Hai Li, Wujie Wen, Jia Di |
| 2016 | ASPDAC | Pin Tumbler Lock: A shift based encryption mechanism for racetrack memory. | Hongbin Zhang, Chao Zhang, Xian Zhang, Guangyu Sun, Jiwu Shu |
| 2016 | DAC | PDS: pseudo-differential sensing scheme for STT-MRAM. | Wang Kang, Tingting Pang, Bi Wu, Weifeng Lv, Youguang Zhang, Guangyu Sun, Weisheng Zhao |
| 2016 | ICDE | NXgraph: An efficient graph processing system on a single machine. | Yuze Chi, Guohao Dai, Yu Wang, Guangyu Sun, Guoliang Li, Huazhong Yang |
| 2016 | ISLPED | Energy-Efficient CNN Implementation on a Deeply Pipelined FPGA Cluster. | Chen Zhang, Di Wu, Jiayu Sun, Guangyu Sun, Guojie Luo, Jason Cong |
| 2015 | ASPDAC | Quantitative modeling of racetrack memory, a tradeoff among area, performance, and power. | Chao Zhang, Guangyu Sun, Weiqi Zhang, Fan Mi, Hai Li, Weisheng Zhao |
| 2015 | DAC | A STT-RAM-based low-power hybrid register file for GPGPUs. | Gushu Li, Xiaoming Chen, Guangyu Sun, Henry Hoffmann, Yongpan Liu, Yu Wang, Huazhong Yang |
| 2015 | DATE | An energy efficient backup scheme with low inrush current for nonvolatile SRAM in energy harvesting sensor nodes. | Hehe Li, Yongpan Liu, Qinghang Zhao, Yizi Gu, Xiao Sheng, Guangyu Sun, Chao Zhang, Meng-Fan Chang, Rong Luo, Huazhong Yang |
| 2015 | DATE | From device to system: cross-layer design exploration of racetrack memory. | Guangyu Sun, Chao Zhang, Hehe Li, Yue Zhang, Weiqi Zhang, Yizi Gu, Yinan Sun, Jacques-Olivier Klein, Dafine Ravelosona, Yongpan Liu, Weisheng Zhao, Huazhong Yang |
| 2015 | FPGA | Optimizing FPGA-based Accelerator Design for Deep Convolutional Neural Networks. | Chen Zhang, Peng Li, Guangyu Sun, Yijin Guan, Bingjun Xiao, Jason Cong |
| 2015 | HPCA | Coordinated static and dynamic cache bypassing for GPUs. | Xiaolong Xie, Yun Liang, Yu Wang, Guangyu Sun, Tao Wang |
| 2015 | ISCA | Hi-fi playback: tolerating position errors in shift operations of racetrack memory. | Chao Zhang, Guangyu Sun, Xian Zhang, Weiqi Zhang, Weisheng Zhao, Tao Wang, Yun Liang, Yongpan Liu, Yu Wang, Jiwu Shu |
| 2015 | ISCAS | Perspectives of racetrack memory based on current-induced domain wall motion: From device to system. | Yue Zhang, Chao Zhang, Jacques-Olivier Klein, Dafine Ravelosona, Guangyu Sun, Weisheng Zhao |
| 2015 | ISLPED | Leveraging emerging nonvolatile memory in high-level synthesis with loop transformations. | Shuangchen Li, Ang Li, Yuan Zhe, Yongpan Liu, Peng Li, Guangyu Sun, Yu Wang, Huazhong Yang, Yuan Xie |
| 2015 | MICRO | Enabling coordinated register allocation and thread-level parallelism optimization for GPUs. | Xiaolong Xie, Yun Liang, Xiuhong Li, Yudong Wu, Guangyu Sun, Tao Wang, Dongrui Fan |
| 2015 | MICRO | Fork path: improving efficiency of ORAM by removing redundant memory accesses. | Xian Zhang, Guangyu Sun, Chao Zhang, Weiqi Zhang, Yun Liang, Tao Wang, Yiran Chen, Jia Di |
| 2014 | ASPDAC | Prefetching techniques for STT-RAM based last-level cache in CMP systems. | Mengjie Mao, Guangyu Sun, Yong Li, Alex K. Jones, Yiran Chen |
| 2014 | DAC | NoC-Sprinting: Interconnect for Fine-Grained Sprinting in the Dark Silicon Era. | Jia Zhan, Yuan Xie, Guangyu Sun |
| 2014 | EuroSys | An efficient design and implementation of LSM-tree based key-value store on open-channel SSD. | Peng Wang, Guangyu Sun, Song Jiang, Jian Ouyang, Shiding Lin, Chen Zhang, Jason Cong |
| 2014 | HPCA | Adaptive placement and migration policy for an STT-RAM-based hybrid cache. | Zhe Wang, Daniel A. Jimnez, Cong Xu, Guangyu Sun, Yuan Xie |
| 2014 | HPCA | CREAM: A Concurrent-Refresh-Aware DRAM Memory architecture. | Tao Zhang, Matthew Poremba, Cong Xu, Guangyu Sun, Yuan Xie |
| 2014 | ISCA | Half-DRAM: A high-bandwidth and low-power DRAM architecture from the rethinking of fine-grained activation. | Tao Zhang, Ke Chen, Cong Xu, Guangyu Sun, Tao Wang, Yuan Xie |
| 2014 | ISCAS | Rapid design space exploration of two-level unified caches. | Jingyu Deng, Yun Liang, Guojie Luo, Guangyu Sun |
| 2014 | ISLPED | SBAC: a statistics based cache bypassing method for asymmetric-access caches. | Chao Zhang, Guangyu Sun, Peng Li, Tao Wang, Dimin Niu, Yiran Chen |
| 2013 | APWEB | A Probabilistic Data Replacement Strategy for Flash-Based Hybrid Storage System. | Yanfei Lv, Xuexuan Chen, Guangyu Sun, Bin Cui |
| 2013 | CASES | An efficient run-time encryption scheme for non-volatile main memory. | Xian Zhang, Chao Zhang, Guangyu Sun, Jia Di, Tao Zhang |
| 2013 | ICCAD | An efficient compiler framework for cache bypassing on GPUs. | Xiaolong Xie, Yun Liang, Guangyu Sun, Deming Chen |
| 2013 | ICCD | Lazy Precharge: An overhead-free method to reduce precharge overhead for memory parallelism improvement of DRAM system. | Tao Zhang, Cong Xu, Yuan Xie, Guangyu Sun |
| 2013 | ISCAS | Designing scratchpad memory architecture with emerging STT-RAM memory technologies. | Peng Wang, Guangyu Sun, Tao Wang, Yuan Xie, Jason Cong |
| 2013 | ISLPED | Active SSD design for energy-efficiency improvement of web-scale data analysis. | Jian Ouyang, Shiding Lin, Zhenyu Hou, Peng Wang, Yong Wang, Guangyu Sun |
| 2012 | DATE | 3DHLS: Incorporating high-level synthesis in physical planning of three-dimensional (3D) ICs. | Yibo Chen, Guangyu Sun, Qiaosha Zou, Yuan Xie |
| 2012 | DATE | Modeling and design exploration of FBDRAM as on-chip memory. | Guangyu Sun, Cong Xu, Yuan Xie |
| 2012 | ICCAD | Multi-level cell STT-RAM: Is it realistic or just a dream? | Yaojun Zhang, Lu Zhang, Wujie Wen, Guangyu Sun, Yiran Chen |
| 2012 | ISLPED | Improving energy efficiency of write-asymmetric memories by log style write. | Guangyu Sun, Yaojun Zhang, Yu Wang, Yiran Chen |
| 2012 | ISLPED | Energy-efficient GPU design with reconfigurable in-package graphics memory. | Jishen Zhao, Guangyu Sun, Gabriel H. Loh, Yuan Xie |
| 2011 | ASPDAC | A frequent-value based PRAM memory architecture. | Guangyu Sun, Dimin Niu, Jin Ouyang, Yuan Xie |
| 2011 | ICCD | Exploring the vulnerability of CMPs to soft errors with 3D stacked non-volatile memory. | Guangyu Sun, Eren Kursun, Jude A. Rivers, Yuan Xie |
| 2011 | ICCD | Energy-efficient multi-level cell phase-change memory system with data encoding. | Jue Wang, Xiangyu Dong, Guangyu Sun, Dimin Niu, Yuan Xie |
| 2011 | ISCA | Architecting on-chip interconnects for stacked 3D STT-RAM caches in CMPs. | Asit K. Mishra, Xiangyu Dong, Guangyu Sun, Yuan Xie, Narayanan Vijaykrishnan, Chita R. Das |
| 2011 | ISCA | Moguls: a model to explore the memory hierarchy for bandwidth improvements. | Guangyu Sun, Christopher J. Hughes, Changkyu Kim, Jishen Zhao, Cong Xu, Yuan Xie, Yen-Kuang Chen |
| 2010 | DAC | Cost-driven 3D integration with interconnect layers. | Xiaoxia Wu, Guangyu Sun, Xiangyu Dong, Reetuparna Das, Yuan Xie, Chita R. Das, Jian Li |
| 2010 | DATE | Energy- and endurance-aware design of phase change memory caches. | Yongsoo Joo, Dimin Niu, Xiangyu Dong, Guangyu Sun, Naehyuck Chang, Yuan Xie |
| 2010 | HPCA | A Hybrid solid-state storage architecture for the performance, energy consumption, and lifetime improvement. | Guangyu Sun, Yongsoo Joo, Yibo Chen, Dimin Niu, Yuan Xie, Yiran Chen, Hai Li |
| 2009 | ASPDAC | A criticality-driven microarchitectural three dimensional (3D) floorplanner. | Srinath Sridharan, Michael DeBole, Guangyu Sun, Yuan Xie, Vijaykrishnan Narayanan |
| 2009 | HPCA | A novel architecture of the 3D stacked MRAM L2 cache for CMPs. | Guangyu Sun, Xiangyu Dong, Yuan Xie, Jian Li, Yiran Chen |
| 2009 | ICCD | 3D GPU architecture using cache stacking: Performance, cost, power and thermal analysis. | Ahmed Al-Maashri, Guangyu Sun, Xiangyu Dong, Vijay Narayanan, Yuan Xie |
| 2009 | ISLPED | Exploration of 3D stacked L2 cache design for high performance and efficient thermal control. | Guangyu Sun, Xiaoxia Wu, Yuan Xie |
| 2008 | DAC | Circuit and microarchitecture evaluation of 3D stacking magnetic RAM (MRAM) as a universal memory replacement. | Xiangyu Dong, Xiaoxia Wu, Guangyu Sun, Yuan Xie, Hai Li, Yiran Chen |
| 2008 | DATE | A Variation Aware High Level Synthesis Framework. | Feng Wang, Guangyu Sun, Yuan Xie |