| 2025 | DATE | Enabling Security on the Edge: A CHERI Compartmentalized Network Stack. | Donato Ferraro, Andrea Bastoni, Alexander Zuepke, Andrea Marongiu |
| 2023 | DAC | Fine-Grained QoS Control via Tightly-Coupled Bandwidth Monitoring and Regulation for FPGA-based Heterogeneous SoCs. | Gianluca Brilli, Giacomo Valente, Alessandro Capotondi, Paolo Burgio, T. Di Masciov, Paolo Valente, Andrea Marongiu |
| 2022 | DATE | An FPGA Overlay for Efficient Real-Time Localization in 1/10th Scale Autonomous Vehicles. | Andrea Bernardi, Gianluca Brilli, Alessandro Capotondi, Andrea Marongiu, Paolo Burgio |
| 2022 | DATE | Understanding and Mitigating Memory Interference in FPGA-based HeSoCs. | Gianluca Brilli, Alessandro Capotondi, Paolo Burgio, Andrea Marongiu |
| 2022 | DATE | Reconciling QoS and Concurrency in NVIDIA GPUs via Warp-Level Scheduling. | Jayati Singh, Ignacio Saudo Olmedo, Nicola Capodieci, Andrea Marongiu, Marco Caccamo |
| 2021 | DSD | A RISC-V-based FPGA Overlay to Simplify Embedded Accelerator Deployment. | Gianluca Bellocchi, Alessandro Capotondi, Francesco Conti, Andrea Marongiu |
| 2020 | CC | Mixed-data-model heterogeneous compilation and OpenMP offloading. | Andreas Kurth, Koen Wolters, Bjrn Forsberg, Alessandro Capotondi, Andrea Marongiu, Tobias Grosser, Luca Benini |
| 2020 | JSSPP | Evaluating Controlled Memory Request Injection to Counter PREM Memory Underutilization. | Roberto Cavicchioli, Nicola Capodieci, Marco Solieri, Marko Bertogna, Paolo Valente, Andrea Marongiu |
| 2020 | RTAS | Dissecting the CUDA scheduling hierarchy: a Performance and Predictability Perspective. | Ignacio Sanudo Olmedo, Nicola Capodieci, Jorge Luis Martinez, Andrea Marongiu, Marko Bertogna |
| 2019 | DATE | Taming Data Caches for Predictable Execution on GPU-based SoCs. | Bjrn Forsberg, Luca Benini, Andrea Marongiu |
| 2019 | DATE | Design and Evaluation of SmallFloat SIMD extensions to the RISC-V ISA. | Giuseppe Tagliavini, Stefan Mach, Davide Rossi, Andrea Marongiu, Luca Benini |
| 2018 | DATE | HePREM: Enabling predictable GPU execution on heterogeneous SoC. | Bjrn Forsberg, Luca Benini, Andrea Marongiu |
| 2018 | DATE | A transprecision floating-point platform for ultra-low power computing. | Giuseppe Tagliavini, Stefan Mach, Davide Rossi, Andrea Marongiu, Luca Benini |
| 2018 | ICCD | Scalable and Efficient Virtual Memory Sharing in Heterogeneous SoCs with TLB Prefetching and MMU-Aware DMA Engine. | Andreas Kurth, Pirmin Vogel, Andrea Marongiu, Luca Benini |
| 2018 | ISCAS | A Transprecision Floating-Point Architecture for Energy-Efficient Embedded Computing. | Stefan Mach, Davide Rossi, Giuseppe Tagliavini, Andrea Marongiu, Luca Benini |
| 2018 | PPoPP | Combining PREM compilation and ILP scheduling for high-performance and predictable MPSoC execution. | Joel Matejka, Bjrn Forsberg, Michal Sojka, Zdenek Hanzlek, Luca Benini, Andrea Marongiu |
| 2018 | SCOPES | On the Cost of Freedom From Interference in Heterogeneous SoCs. | Bjrn Forsberg, Luca Benini, Andrea Marongiu |
| 2017 | DATE | GPUguard: Towards supporting a predictable execution model for heterogeneous SoC. | Bjrn Forsberg, Andrea Marongiu, Luca Benini |
| 2017 | DATE | Ultra low-power visual odometry for nano-scale unmanned aerial vehicles. | Daniele Palossi, Andrea Marongiu, Luca Benini |
| 2017 | ICCS | GPU-Accelerated Real-Time Path Planning and the Predictable Execution Model. | Bjrn Forsberg, Daniele Palossi, Andrea Marongiu, Luca Benini |
| 2017 | SCOPES | Enabling zero-copy OpenMP offloading on the PULP many-core accelerator. | Alessandro Capotondi, Andrea Marongiu |
| 2017 | SCOPES | On the Accuracy of Near-Optimal CPU-Based Path Planning for UAVs. | Daniele Palossi, Andrea Marongiu, Luca Benini |
| 2016 | CASES | Thrifty-malloc: A HW/SW codesign for the dynamic management of hardware transactional memory in embedded multicore systems. | Thomas Carle, Dimitra Papagiannopoulou, Tali Moreshet, Andrea Marongiu, Maurice Herlihy, R. Iris Bahar |
| 2016 | CASES | Enabling OpenVX support in mW-scale parallel accelerators. | Giuseppe Tagliavini, Germain Haugou, Andrea Marongiu, Luca Benini |
| 2016 | DATE | Enabling the heterogeneous accelerator model on ultra-low power microcontroller platforms. | Francesco Conti, Daniele Palossi, Andrea Marongiu, Davide Rossi, Luca Benini |
| 2016 | DATE | An optimized task-based runtime system for resource-constrained parallel accelerators. | Daniele Cesarini, Andrea Marongiu, Luca Benini |
| 2016 | DSD | A Software Stack for Next-Generation Automotive Systems on Many-Core Heterogeneous Platforms. | Paolo Burgio, Marko Bertogna, Ignacio Sanudo Olmedo, Paolo Gai, Andrea Marongiu, Michal Sojka |
| 2016 | SCOPES | Exploring Single Source Shortest Path Parallelization on Shared Memory Accelerators. | Daniele Palossi, Andrea Marongiu |
| 2015 | CASES | Timing characterization of OpenMP4 tasking model. | Maria A. Serrano, Alessandra Melani, Roberto Vargas, Andrea Marongiu, Marko Bertogna, Eduardo Quiones |
| 2015 | CGO | Runtime Support for Multiple Offload-Based Programming Models on Embedded Manycore Accelerators. | Alessandro Capotondi, Germain Haugou, Andrea Marongiu, Luca Benini |
| 2015 | CGO | An Evaluation of Memory Sharing Performance for Heterogeneous Embedded SoCs with Many-Core Accelerators. | Pirmin Vogel, Andrea Marongiu, Luca Benini |
| 2015 | DAC | Task scheduling strategies to mitigate hardware variability in embedded shared memory clusters. | Abbas Rahimi, Daniele Cesarini, Andrea Marongiu, Rajesh K. Gupta, Luca Benini |
| 2015 | DATE | OpenMP and timing predictability: a possible union? | Roberto Vargas, Eduardo Quiones, Andrea Marongiu |
| 2015 | SCOPES | A framework for optimizing OpenVX applications performance on embedded manycore accelerators. | Giuseppe Tagliavini, Germain Haugou, Andrea Marongiu, Luca Benini |
| 2014 | DATE | A tightly-coupled hardware controller to improve scalability and programmability of shared-memory heterogeneous clusters. | Paolo Burgio, Robin Danilo, Andrea Marongiu, Philippe Coussy, Luca Benini |
| 2014 | DATE | Tightly-coupled hardware support to dynamic parallelism acceleration in embedded shared memory clusters. | Paolo Burgio, Giuseppe Tagliavini, Francesco Conti, Andrea Marongiu, Luca Benini |
| 2014 | DSD | P-SOCRATES: A Parallel Software Framework for Time-Critical Many-Core Systems. | Lus Miguel Pinho, Eduardo Quiones, Marko Bertogna, Andrea Marongiu, Jorge Pereira Carlos, Claudio Scordino, Michele Ramponi |
| 2014 | EUC | A HLS-Based Toolflow to Design Next-Generation Heterogeneous Many-Core Platforms with Shared Memory. | Paolo Burgio, Andrea Marongiu, Philippe Coussy, Luca Benini |
| 2014 | ISCA | On the Relevance of Architectural Awareness for Efficient Fork/Join Support on Cluster-Based Manycores. | Hayder Al-Khalissi, Mladen Berekovic, Andrea Marongiu |
| 2014 | ISCA | A Virtualization Framework for IOMMU-less Many-Core Accelerators. | Christian Pinto, Andrea Marongiu, Luca Benini |
| 2013 | DATE | Enabling fine-grained OpenMP tasking on tightly-coupled shared memory clusters. | Paolo Burgio, Giuseppe Tagliavini, Andrea Marongiu, Luca Benini |
| 2013 | DATE | Variation-tolerant OpenMP tasking on tightly-coupled processor clusters. | Abbas Rahimi, Andrea Marongiu, Paolo Burgio, Rajesh K. Gupta, Luca Benini |
| 2013 | ISCA | Improving the programmability of STHORM-based heterogeneous systems with offload-enabled OpenMP. | Andrea Marongiu, Alessandro Capotondi, Giuseppe Tagliavini, Luca Benini |
| 2013 | ISCA | Transparent and energy-efficient speculation on NUMA architectures for embedded MPSoCs. | Dimitra Papagiannopoulou, R. Iris Bahar, Tali Moreshet, Maurice Herlihy, Andrea Marongiu, Luca Benini |
| 2012 | ASPLOS | Full system simulation of many-core heterogeneous SoCs using GPU and QEMU semihosting. | Shivani Raghav, Andrea Marongiu, Christian Pinto, David Atienza, Martino Ruggiero, Luca Benini |
| 2012 | DATE | Design of a collective communication infrastructure for barrier synchronization in cluster-based nanoscale MPSoCs. | Jos L. Abelln, Juan Fernndez Peinador, Manuel E. Acacio, Davide Bertozzi, Daniele Bortolotti, Andrea Marongiu, Luca Benini |
| 2012 | DATE | Fast and lightweight support for nested parallelism on cluster-based embedded many-cores. | Andrea Marongiu, Paolo Burgio, Luca Benini |
| 2012 | DSD | OpenMP-based Synergistic Parallelization and HW Acceleration for On-Chip Shared-Memory Clusters. | Paolo Burgio, Andrea Marongiu, Dominique Heller, Cyrille Chavet, Philippe Coussy, Luca Benini |
| 2011 | CCGRID | GPGPU-Accelerated Parallel and Fast Simulation of Thousand-Core Platforms. | Christian Pinto, Shivani Raghav, Andrea Marongiu, Martino Ruggiero, David Atienza, Luca Benini |
| 2010 | CASES | Vertical stealing: robust, locality-aware do-all workload distribution for 3D MPSoCs. | Andrea Marongiu, Paolo Burgio, Luca Benini |
| 2010 | DATE | Efficient OpenMP data mapping for multicore platforms with vertically stacked memory. | Andrea Marongiu, Martino Ruggiero, Luca Benini |
| 2010 | DSD | Evaluating OpenMP Support Costs on MPSoCs. | Andrea Marongiu, Paolo Burgio, Luca Benini |
| 2009 | DATE | Efficient OpenMP support and extensions for MPSoCs with explicitly managed memory hierarchy. | Andrea Marongiu, Luca Benini |
| 2009 | SSS | OpenMP Support for NBTI-Induced Aging Tolerance in MPSoCs. | Andrea Marongiu, Andrea Acquaviva, Luca Benini |
| 2008 | DSD | Analysis of Power Management Strategies for a Large-Scale SoC Platform in 65nm Technology. | Andrea Marongiu, Luca Benini, Andrea Acquaviva, Andrea Bartolini |
| 2007 | CASES | Lightweight barrier-based parallelization support for non-cache-coherent MPSoC platforms. | Andrea Marongiu, Luca Benini, Mahmut T. Kandemir |
| 2006 | DSD | Automatic Application Partitioning on FPGA/CPU Systems Based on Detailed Low-Level Information. | Giovanni Busonera, Salvatore Carta, Andrea Marongiu, Luigi Raffo |