Skip to content

Oreste Villa

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

31

Venues

17

Active years

2005–2023

Best venue rank

A*

Where they publish

Papers

31 indexed papers, newest first.

YearVenueTitleAuthors
2023CGOParsimony: Enabling SIMD/Vector Programming in Standard Compiler Flows.Vijay Kandiah, Daniel Lustig, Oreste Villa, David W. Nellans, Nikos Hardavellas
2023HPCAFinePack: Transparently Improving the Efficiency of Fine-Grained Transfers in Multi-GPU Systems.Harini Muthukrishnan, Daniel Lustig, Oreste Villa, Thomas F. Wenisch, David W. Nellans
2021DSNNVBitFI: Dynamic Fault Injection for GPUs.Timothy Tsai, Siva Kumar Sastry Hari, Michael B. Sullivan, Oreste Villa, Stephen W. Keckler
2021HPCANeed for Speed: Experiences Building a Trustworthy System-Level GPU Simulator.Oreste Villa, Daniel Lustig, Zi Yan, Evgeny Bolotin, Yaosheng Fu, Niladrish Chatterjee, Nan Jiang, David W. Nellans
2020HPCAHMG: Extending Cache Coherence Protocols Across Modern Hierarchical Multi-GPU Systems.Xiaowei Ren, Daniel Lustig, Evgeny Bolotin, Aamer Jaleel, Oreste Villa, David W. Nellans
2019MICRONVBit: A Dynamic Binary Instrumentation Framework for NVIDIA GPUs.Oreste Villa, Mark Stephenson, David W. Nellans, Stephen W. Keckler
2018MICROCombining HW/SW Mechanisms to Improve NUMA Performance of Multi-GPU Systems.Vinson Young, Aamer Jaleel, Evgeny Bolotin, Eiman Ebrahimi, David W. Nellans, Oreste Villa
2017ISCAMCM-GPU: Multi-Chip-Module GPUs for Continued Performance Scalability.Akhil Arunkumar, Evgeny Bolotin, Benjamin Y. Cho, Ugljesa Milic, Eiman Ebrahimi, Oreste Villa, Aamer Jaleel, Carole-Jean Wu, David W. Nellans
2017MICROBeyond the socket: NUMA-aware GPUs.Ugljesa Milic, Oreste Villa, Evgeny Bolotin, Akhil Arunkumar, Eiman Ebrahimi, Aamer Jaleel, Alex Ramrez, David W. Nellans
2015CLUSTERHigh-Performance, Distributed Dictionary Encoding of RDF Datasets.Alessandro Morari, Jesse Weaver, Oreste Villa, David J. Haglin, Antonino Tumeo, Vito Giovanni Castellana, John Feo
2014SCScaling the Power Wall: A Path to Exascale.Oreste Villa, Daniel R. Johnson, Mike O'Connor, Evgeny Bolotin, David W. Nellans, Justin Luitjens, Nikolai Sakharnykh, Peng Wang, Paulius Micikevicius, Anthony Scudiero, Stephen W. Keckler, William J. Dally
2013CLUSTERAccelerating subsurface transport simulation on heterogeneous clusters.Oreste Villa, Nitin Gawande, Antonino Tumeo
2013EuroParPower/Performance Trade-Offs of Small Batched LU Based Solvers on GPUs.Oreste Villa, Massimiliano Fatica, Nitin Gawande, Antonino Tumeo
2013FCCMExploring Manycore Multinode Systems for Irregular Applications with FPGA Prototyping.Marco Ceriani, Gianluca Palermo, Simone Secchi, Antonino Tumeo, Oreste Villa
2013SACExploiting points-to maps for de-/serialization code generation.Selim Ciraci, Oreste Villa
2013SCToward a data scalable solution for facilitating discovery of scientific data resources.Alan R. Chappell, Sutanay Choudhury, John Feo, David J. Haglin, Alessandro Morari, Sumit Purohit, Karen Schuchardt, Antonino Tumeo, Jesse Weaver, Oreste Villa
2013RSPYAPPA: A compiler-based parallelization framework for irregular applications on MPSoCs.Silvia Lovergine, Antonino Tumeo, Oreste Villa, Fabrizio Ferrandi
2012CCGRIDA Bandwidth-Optimized Multi-core Architecture for Irregular Applications.Simone Secchi, Antonino Tumeo, Oreste Villa
2012SCA High Performance Computing Network and System Simulator for the Power Grid: NGNS^2.Oreste Villa, Antonino Tumeo, Selim Ciraci, Jeff A. Daily, Jason C. Fuller
2012SBAC-PADEfficient Sorting on the Tilera Manycore Architecture.Alessandro Morari, Antonino Tumeo, Oreste Villa, Simone Secchi, Mateo Valero
2011CCGRIDContention Modeling for Multithreaded Distributed Shared Memory Machines: The Cray XMT.Simone Secchi, Antonino Tumeo, Oreste Villa
2011CLUSTERExploring Fine-Grained Task-Based Execution on Multi-GPU Systems.Long Chen, Oreste Villa, Guang R. Gao
2011SCIrregular applications: architectures & algorithms.John Feo, Oreste Villa, Antonino Tumeo, Simone Secchi
2011SCTowards efficient execution of irregular applications: panel outline.John Feo, Oreste Villa, Antonino Tumeo, Simone Secchi
2010CLUSTERAcceleration of Streamed Tensor Contraction Expressions on GPGPU-Based Clusters.Wenjing Ma, Sriram Krishnamoorthy, Oreste Villa, Karol Kowalski
2010ISCASHigh performance Molecular Dynamic simulation on single and multi-GPU systems.Oreste Villa, Long Chen, Sriram Krishnamoorthy
2008CASESEfficiency and scalability of barrier synchronization on NoC based many-core architectures.Oreste Villa, Gianluca Palermo, Cristina Silvano
2008DSDA Modular Approach to Model Heterogeneous MPSoC at Cycle Level.Matteo Monchiero, Gianluca Palermo, Cristina Silvano, Oreste Villa
2007CLUSTERTransparent system-level migration of PGAS applications using Xen on InfiniBand.Daniele Paolo Scarpazza, Patrick Mullaney, Oreste Villa, Fabrizio Petrini, Vinod Tipparaju, David M. L. Brown, Jarek Nieplocha
2006DATEPower/performance hardware optimization for synchronization intensive applications in MPSoCs.Matteo Monchiero, Gianluca Palermo, Cristina Silvano, Oreste Villa
2005DATEFast Dynamic Memory Integration in Co-Simulation Frameworks for Multiprocessor System on-Chip.Oreste Villa, Patrick Schaumont, Ingrid Verbauwhede, Matteo Monchiero, Gianluca Palermo