Skip to content

Joel S. Emer

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

100

Venues

19

Active years

1984–2026

Best venue rank

A*

Where they publish

Papers

100 indexed papers, newest first.

YearVenueTitleAuthors
2026ASPLOSInsum: Sparse GPU Kernels Simplified and Optimized with Indirect Einsums.Jaeyeon Won, Willow Ahrens, Saman P. Amarasinghe, Joel S. Emer
2026ISCALotus: A Multi-FPGA Task Dataflow Architecture to Accelerate Cycle-Level Simulation.Fares Elsabbagh, Joel S. Emer, Daniel Snchez
2025ASPLOSHopps: Leveraging Sparsity to Accelerate Automata Processing.Xingran Du, Joel S. Emer, Daniel Snchez
2025MICROQuartz: A Reconfigurable, Distributed-Memory Accelerator for Sparse Applications.Courtney Golden, Axel Feldmann, Joel S. Emer, Daniel Snchez
2024ISCAMind the Gap: Attainable Data Movement and Operational Intensity Bounds for Tensor Algorithms.Qijing Huang, Po-An Tsai, Joel S. Emer, Angshuman Parashar
2024ISCATrapezoid: A Versatile Accelerator for Dense and Sparse Matrix Multiplications.Yifan Yang, Joel S. Emer, Daniel Snchez
2024ISPASSArchitecture-Level Modeling of Photonic Deep Neural Network Accelerators.Tanner Andrulis, Gohar Irfan Chaudhry, Vinith M. Suriyakumar, Joel S. Emer, Vivienne Sze
2024ISPASSCiMLoop: A Flexible, Accurate, and Fast Compute-In-Memory Modeling Tool.Tanner Andrulis, Joel S. Emer, Vivienne Sze
2024MICRODelayAVF: Calculating Architectural Vulnerability Factors for Delay Faults.Peter W. Deutsch, Vincent Quentin Ulitzsch, Sudhanva Gurumurthi, Vilas Sridharan, Joel S. Emer, Mengjia Yan
2024MICROAzul: An Accelerator for Sparse Iterative Solvers Leveraging Distributed On-Chip Memory.Axel Feldmann, Courtney Golden, Yifan Yang, Joel S. Emer, Daniel Snchez
2024MICROFuseMax: Leveraging Extended Einsums to Optimize Attention Accelerator Design.Nandeeka Nayak, Xinrui Wu, Toluwanimi O. Odemuyiwa, Michael Pellauer, Joel S. Emer, Christopher W. Fletcher
2023ASPLOSThe Sparse Abstract Machine.Olivia Hsu, Maxwell Strange, Ritvik Sharma, Jaeyeon Won, Kunle Olukotun, Joel S. Emer, Mark A. Horowitz, Fredrik Kjlstad
2023ASPLOSAccelerating Sparse Data Orchestration via Dynamic Reflexive Tiling.Toluwanimi O. Odemuyiwa, Hadi Asghari Moghaddam, Michael Pellauer, Kartik Hegde, Po-An Tsai, Neal Clayton Crago, Aamer Jaleel, John D. Owens, Edgar Solomonik, Joel S. Emer, Christopher W. Fletcher
2023ASPLOSWACO: Learning Workload-Aware Co-optimization of the Format and Schedule of a Sparse Tensor Program.Jaeyeon Won, Charith Mendis, Joel S. Emer, Saman P. Amarasinghe
2023DCCOptimizing Compression Schemes for Parallel Sparse Tensor Algebra.Helen Xu, Tao B. Schardl, Michael Pellauer, Joel S. Emer
2023HPCAISOSceles: Accelerating Sparse CNNs through Inter-Layer Pipelining.Yifan Yang, Joel S. Emer, Daniel Snchez
2023ISCARAELLA: Reforming the Arithmetic for Efficient, Low-Resolution, and Low-Loss Analog PIM: No Retraining Required!Tanner Andrulis, Joel S. Emer, Vivienne Sze
2023ISCAMetior: A Comprehensive Model to Evaluate Obfuscating Side-Channel Defense Schemes.Peter W. Deutsch, Weon Taek Na, Thomas Bourgeat, Joel S. Emer, Mengjia Yan
2023ISPASSLoopTree: Enabling Exploration of Fused-layer Dataflow Accelerators.Michael Gilbert, Yannan Nellie Wu, Angshuman Parashar, Vivienne Sze, Joel S. Emer
2023MICROAccelerating RTL Simulation with Hardware-Software Co-Design.Fares Elsabbagh, Shabnam Sheikhha, Victor A. Ying, Quan M. Nguyen, Joel S. Emer, Daniel Snchez
2023MICROSecureLoop: Design Space Exploration of Secure DNN Accelerators.Kyungmi Lee, Mengjia Yan, Joel S. Emer, Anantha P. Chandrakasan
2023MICROTeAAL: A Declarative Framework for Modeling Sparse Tensor Accelerators.Nandeeka Nayak, Toluwanimi O. Odemuyiwa, Shubham Ugare, Christopher W. Fletcher, Michael Pellauer, Joel S. Emer
2023MICROHighLight: Efficient and Flexible DNN Acceleration with Hierarchical Structured Sparsity.Yannan Nellie Wu, Po-An Tsai, Saurav Muralidharan, Angshuman Parashar, Vivienne Sze, Joel S. Emer
2023MICROTailors: Accelerating Sparse Tensor Algebra by Overbooking Buffer Capacity.Zi Yu Xue, Yannan Nellie Wu, Joel S. Emer, Vivienne Sze
2022ASPLOSDAGguise: mitigating memory timing side channels.Peter W. Deutsch, Yuheng Yang, Thomas Bourgeat, Jules Drean, Joel S. Emer, Mengjia Yan
2022ISPASSRuby: Improving Hardware Efficiency for Tensor Algebra Accelerators Through Imperfect Factorization.Mark Horeni, Pooria Taheri, Po-An Tsai, Angshuman Parashar, Joel S. Emer, Siddharth Joshi
2022MICROSparseloop: An Analytical Approach To Sparse Tensor Accelerator Modeling.Yannan Nellie Wu, Po-An Tsai, Angshuman Parashar, Vivienne Sze, Joel S. Emer
2021ASPLOSGamma: leveraging Gustavson's algorithm to accelerate sparse matrix multiplication.Guowei Zhang, Nithya Attaluri, Joel S. Emer, Daniel Snchez
2021ISCASpZip: Architectural Support for Effective Data Compression In Irregular Applications.Yifan Yang, Joel S. Emer, Daniel Snchez
2021ISPASSArchitecture-Level Energy Estimation for Heterogeneous Computing Systems.Francis Wang, Yannan Nellie Wu, Matthew E. Woicik, Joel S. Emer, Vivienne Sze
2021ISPASSSparseloop: An Analytical, Energy-Focused Design Space Exploration Methodology for Sparse Tensor Accelerators.Yannan Nellie Wu, Po-An Tsai, Angshuman Parashar, Vivienne Sze, Joel S. Emer
2021WCAEMentoring Opportunities in Computer Architecture: Analyzing the Past to Develop the Future.Elba Garza, Gururaj Saileshwar, Udit Gupta, Tianyi Liu, Abdulrahman Mahmoud, Saugata Ghose, Joel S. Emer
2020ISPASSAn Architecture-Level Energy and Area Estimator for Processing-In-Memory Accelerator Designs.Yannan Nellie Wu, Vivienne Sze, Joel S. Emer
2020MICROCaSA: End-to-end Quantitative Security Analysis of Randomly Mapped Caches.Thomas Bourgeat, Jules Drean, Yuheng Yang, Lillian Tsai, Joel S. Emer, Mengjia Yan
2019ASPLOSBuffets: An Efficient and Composable Storage Idiom for Explicit Decoupled Data Orchestration.Michael Pellauer, Yakun Sophia Shao, Jason Clemons, Neal Clayton Crago, Kartik Hegde, Rangharajan Venkatesan, Stephen W. Keckler, Christopher W. Fletcher, Joel S. Emer
2019ICCADMAGNet: A Modular Accelerator Generator for Neural Networks.Rangharajan Venkatesan, Yakun Sophia Shao, Miaorong Wang, Jason Clemons, Steve Dai, Matthew Fojtik, Ben Keller, Alicia Klinefelter, Nathaniel Ross Pinckney, Priyanka Raina, Yanqing Zhang, Brian Zimmer, William J. Dally, Joel S. Emer, Stephen W. Keckler, Brucek Khailany
2019ICCADAccelergy: An Architecture-Level Energy Estimation Methodology for Accelerator Designs.Yannan Nellie Wu, Joel S. Emer, Vivienne Sze
2019ISPASSTimeloop: A Systematic Approach to DNN Accelerator Evaluation.Angshuman Parashar, Priyanka Raina, Yakun Sophia Shao, Yu-Hsin Chen, Victor A. Ying, Anurag Mukkara, Rangharajan Venkatesan, Brucek Khailany, Stephen W. Keckler, Joel S. Emer
2019MICROExTensor: An Accelerator for Sparse Tensor Algebra.Kartik Hegde, Hadi Asghari Moghaddam, Michael Pellauer, Neal Clayton Crago, Aamer Jaleel, Edgar Solomonik, Joel S. Emer, Christopher W. Fletcher
2019MICROSimba: Scaling Deep-Learning Inference with Multi-Chip-Module-Based Architecture.Yakun Sophia Shao, Jason Clemons, Rangharajan Venkatesan, Brian Zimmer, Matthew Fojtik, Nan Jiang, Ben Keller, Alicia Klinefelter, Nathaniel Ross Pinckney, Priyanka Raina, Stephen G. Tell, Yanqing Zhang, William J. Dally, Joel S. Emer, C. Thomas Gray, Brucek Khailany, Stephen W. Keckler
2018DACA modular digital VLSI flow for high-productivity SoC design.Brucek Khailany, Evgeni Khmer, Rangharajan Venkatesan, Jason Clemons, Joel S. Emer, Matthew Fojtik, Alicia Klinefelter, Michael Pellauer, Nathaniel Ross Pinckney, Yakun Sophia Shao, Shreesha Srinath, Christopher Torng, Sam Likun Xi, Yanqing Zhang, Brian Zimmer
2018MICROHarmonizing Speculative and Non-Speculative Execution in Architectures for Ordered Parallelism.Mark C. Jeffrey, Victor A. Ying, Suvinay Subramanian, Hyun Ryong Lee, Joel S. Emer, Daniel Snchez
2018MICRODAWG: A Defense Against Cache Timing Attacks in Speculative Execution Processors.Vladimir Kiriansky, Ilia A. Lebedev, Saman P. Amarasinghe, Srinivas Devadas, Joel S. Emer
2017ACSSCA method to estimate the energy consumption of deep neural networks.Tien-Ju Yang, Yu-Hsin Chen, Joel S. Emer, Vivienne Sze
2017FPGAAutomatic Construction of Program-Optimized FPGA Memory Networks.Hsin-Jung Yang, Kermin Fleming, Felix Winterstein, Annie I. Chen, Michael Adler, Joel S. Emer
2017ISCASCNN: An Accelerator for Compressed-sparse Convolutional Neural Networks.Angshuman Parashar, Minsoo Rhu, Anurag Mukkara, Antonio Puglielli, Rangharajan Venkatesan, Brucek Khailany, Joel S. Emer, Stephen W. Keckler, William J. Dally
2017ISCAFractal: An Execution Model for Fine-Grain Nested Speculative Parallelism.Suvinay Subramanian, Mark C. Jeffrey, Maleen Abeydeera, Hyun Ryong Lee, Victor A. Ying, Joel S. Emer, Daniel Snchez
2017ISCASTowards closing the energy gap between HOG and CNN features for embedded vision (Invited paper).Amr Suleiman, Yu-Hsin Chen, Joel S. Emer, Vivienne Sze
2017ISPASSSASSIFI: An architecture-level fault injection tool for GPU application resilience evaluation.Siva Kumar Sastry Hari, Timothy Tsai, Mark Stephenson, Stephen W. Keckler, Joel S. Emer
2017SCUnderstanding error propagation in deep learning neural network (DNN) accelerators and applications.Guanpeng Li, Siva Kumar Sastry Hari, Michael B. Sullivan, Timothy Tsai, Karthik Pattabiraman, Joel S. Emer, Stephen W. Keckler
2016FPGALMC: Automatic Resource-Aware Program-Optimized Memory Partitioning.Hsin-Jung Yang, Kermin Fleming, Michael Adler, Felix Winterstein, Joel S. Emer
2016ISCAEyeriss: A Spatial Architecture for Energy-Efficient Dataflow for Convolutional Neural Networks.Yu-Hsin Chen, Joel S. Emer, Vivienne Sze
2016MICROData-centric execution of speculative parallel programs.Mark C. Jeffrey, Suvinay Subramanian, Maleen Abeydeera, Joel S. Emer, Daniel Snchez
2015FPLScavenger: Automating the construction of application-optimized memory hierarchies.Hsin-Jung Yang, Kermin Fleming, Michael Adler, Felix Winterstein, Joel S. Emer
2015HPCAHigh performing cache hierarchies for server workloads: Relaxing inclusion to capture the latency benefits of exclusive caches.Aamer Jaleel, Joseph Nuzman, Adrian Moga, Simon C. Steely Jr., Joel S. Emer
2015MICROA scalable architecture for ordered parallelism.Mark C. Jeffrey, Suvinay Subramanian, Cong Yan, Joel S. Emer, Daniel Snchez
2015MICROA fast and accurate analytical technique to compute the AVF of sequential bits in a processor.Steven Raasch, Arijit Biswas, Jon Stephan, Paul Racunas, Joel S. Emer
2014FCCMLEAP Shared Memories: Automating the Construction of FPGA Coherent Memories.Hsin-Jung Yang, Kermin Fleming, Michael Adler, Joel S. Emer
2014FPLThe LEAP FPGA operating system.Kermin Fleming, Hsin-Jung Yang, Michael Adler, Joel S. Emer
2014ISPASSExploiting spatial architectures for edit distance algorithms.Jesmin Jahan Tithi, Neal Clayton Crago, Joel S. Emer
2013FPLOptimizing under abstraction: Using prefetching to improve FPGA performance.Hsin-Jung Yang, Kermin Fleming, Michael Adler, Joel S. Emer
2013ISCATriggered instructions: a control paradigm for spatially-programmed architectures.Angshuman Parashar, Michael Pellauer, Michael Adler, Bushra Ahsan, Neal Clayton Crago, Daniel Lustig, Vladimir Pavlov, Antonia Zhai, Mohit Gambhir, Aamer Jaleel, Randy L. Allmon, Rachid Rayess, Stephen Maresh, Joel S. Emer
2012ASPLOSCRUISE: cache replacement and utility-aware scheduling.Aamer Jaleel, Hashem Hashemi Najaf-abadi, Samantika Subramaniam, Simon C. Steely Jr., Joel S. Emer
2012FPGALeveraging latency-insensitivity to ease multiple FPGA design.Kermin Elliott Fleming, Michael Adler, Michael Pellauer, Angshuman Parashar, Arvind, Joel S. Emer
2012ISCAScheduling heterogeneous multi-cores through performance impact estimation (PIE).Kenzo Van Craeynest, Aamer Jaleel, Lieven Eeckhout, Paolo Narvez, Joel S. Emer
2011FPGALeap scratchpads: automatic memory and cache management for reconfigurable logic.Michael Adler, Kermin Fleming, Angshuman Parashar, Michael Pellauer, Joel S. Emer
2011HPCAHAsim: FPGA-based high-detail multicore simulation using time-division multiplexing.Michael Pellauer, Michael Adler, Michel A. Kinsy, Angshuman Parashar, Joel S. Emer
2011MICROSHiP: signature-based hit predictor for high performance caching.Carole-Jean Wu, Aamer Jaleel, William Hasenplaugh, Margaret Martonosi, Simon C. Steely Jr., Joel S. Emer
2011MICROPACMan: prefetch-aware cache management for high performance caching.Carole-Jean Wu, Aamer Jaleel, Margaret Martonosi, Simon C. Steely Jr., Joel S. Emer
2010ISCAHigh performance cache replacement using re-reference interval prediction (RRIP).Aamer Jaleel, Kevin B. Theobald, Simon C. Steely Jr., Joel S. Emer
2010MEMOCODEDesign contest overview: Combined architecture for network stream categorization and intrusion detection (CANSCID).Michael Pellauer, Abhinav Agarwal, Asif Khan, Man Cheuk Ng, Muralidaran Vijayaraghavan, Forrest Brewer, Joel S. Emer
2010MICROAchieving Non-Inclusive Cache Performance with Inclusive Caches: Temporal Locality Aware (TLA) Cache Management Policies.Aamer Jaleel, Eric Borch, Malini Bhandaru, Simon C. Steely Jr., Joel S. Emer
2009DACSoft connections: addressing the hardware-design modularity problem.Michael Pellauer, Michael Adler, Derek Chiou, Joel S. Emer
2009HPCACAMP: A technique to estimate per-structure power at run-time using a few simple parameters.Michael D. Powell, Arijit Biswas, Joel S. Emer, Shubhendu S. Mukherjee, Basit Riaz Sheikh, Shrirang M. Yardi
2009ISPASSAccelerating architecture research.Joel S. Emer
2008FPGAA-Ports: an efficient abstraction for cycle-accurate performance models on FPGAs.Michael Pellauer, Muralidaran Vijayaraghavan, Michael Adler, Arvind, Joel S. Emer
2008ISPASSQuick Performance Models Quickly: Closely-Coupled Partitioned Simulation on FPGAs.Michael Pellauer, Muralidaran Vijayaraghavan, Michael Adler, Arvind, Joel S. Emer
2007ISCAAdaptive insertion policies for high performance caching.Moinuddin K. Qureshi, Aamer Jaleel, Yale N. Patt, Simon C. Steely Jr., Joel S. Emer
2007ISCALate-binding: enabling unordered load-store queues.Simha Sethumadhavan, Franziska Roesner, Joel S. Emer, Doug Burger, Stephen W. Keckler
2005HPCAThe Soft Error Problem: An Architectural Perspective.Shubhendu S. Mukherjee, Joel S. Emer, Steven K. Reinhardt
2005ISCAComputing Architectural Vulnerability Factors for Address-Based Structures.Arijit Biswas, Paul Racunas, Razvan Cheveresan, Joel S. Emer, Shubhendu S. Mukherjee, Ram Rangan
2004ISCATechniques to Reduce the Soft Error Rate of a High-Performance Microprocessor.Christopher T. Weaver, Joel S. Emer, Shubhendu S. Mukherjee, Steven K. Reinhardt
2004PRDCCache Scrubbing in Microprocessors: Myth or Necessity?Shubhendu S. Mukherjee, Joel S. Emer, Tryggve Fossum, Steven K. Reinhardt
2003MICROA Systematic Methodology to Compute the Architectural Vulnerability Factors for a High-Performance Microprocessor.Shubhendu S. Mukherjee, Christopher T. Weaver, Joel S. Emer, Steven K. Reinhardt, Todd M. Austin
2002ASPLOSA comparative study of arbitration algorithms for the Alpha 21364 pipelined router.Shubhendu S. Mukherjee, Federico Silla, Peter J. Bannon, Joel S. Emer, Steven Lang, David Webb
2002HPCALoose Loops Sink Chips.Eric Borch, Eric Tune, Srilatha Manne, Joel S. Emer
2002ISCATarantula: A Vector Extension to the Alpha Architecture.Roger Espasa, Federico Ardanaz, Julio Gago, Roger Gramunt, Isaac Hernandez, Toni Juan, Joel S. Emer, Stephen Felix, P. Geoffrey Lowney, Matthew Mattina, Andr Seznec
2000HPCACombining Static and Dynamic Branch Prediction to Reduce Destructive Aliasing.Harish Patil, Joel S. Emer
1999ICSReducing cache misses using hardware and software page placement.Timothy Sherwood, Brad Calder, Joel S. Emer
1999MICROThe Use of Multithreading for Exception Handling.Craig B. Zilles, Joel S. Emer, Gurindar S. Sohi
1998ISCAMemory Dependence Prediction Using Store Sets.George Z. Chrysos, Joel S. Emer
1998ISCARetrospective: Characterization of Processor Performance in the VAX-11/780.Joel S. Emer, Douglas W. Clark
1998ISCAA Characterization of Processor Performance in the VAX-11/780.Joel S. Emer, Douglas W. Clark
1997ISCAA Language for Describing Predictors and Its Application to Automatic Synthesis.Joel S. Emer, Nicholas C. Gloy
1996HPCAPredictive Sequential Associative Cache.Brad Calder, Dirk Grunwald, Joel S. Emer
1996ISCAExploiting Choice: Instruction Fetch and Issue on an Implementable Simultaneous Multithreading Processor.Dean M. Tullsen, Susan J. Eggers, Joel S. Emer, Henry M. Levy, Jack L. Lo, Rebecca L. Stamm
1995ISCAInstruction Fetching: Coping with Code Bloat.Richard Uhlig, David Nagle, Trevor N. Mudge, Stuart Sechrest, Joel S. Emer
1995MICROA system level perspective on branch architecture performance.Brad Calder, Dirk Grunwald, Joel S. Emer
1988ICDCSPerformance Considerations for Distributed Services: A Case Study: Mass Storage.Joel S. Emer, K. K. Ramakrishnan
1984ISCAA Characterization of Processor Performance in the VAX-11/780.Joel S. Emer, Douglas W. Clark