Skip to content

Pradeep Dubey

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

43

Venues

16

Active years

1997–2023

Best venue rank

A*

Where they publish

Papers

43 indexed papers, newest first.

YearVenueTitleAuthors
2023QCEHamLib: A Library of Hamiltonians for Benchmarking Quantum Algorithms and Hardware.Nicolas P. D. Sawaya, Daniel Marti-Dafcik, Yang Ho, Daniel P. Tabor, David Esteban Bernal Neira, Alicia B. Magann, Shavindra P. Premaratne, Pradeep Dubey, Anne Y. Matsuura, Nathan Bishop, Wibe A. de Jong, Simon C. Benjamin, Ojas D. Parekh, Norm M. Tubman, Katherine Klymko, Daan Camps
2020ICCADSuSy: A Programming Model for Productive Construction of High-Performance Systolic Arrays on FPGAs.Yi-Hsiang Lai, Hongbo Rong, Size Zheng, Weihao Zhang, Xiuping Cui, Yunshan Jia, Jie Wang, Brendan Sullivan, Zhiru Zhang, Yun Liang, Youhui Zhang, Jason Cong, Nithin George, Jose Alvarez, Christopher J. Hughes, Pradeep Dubey
2019FCCMT2S-Tensor: Productively Generating High-Performance Spatial Hardware for Dense Tensor Computations.Nitish Kumar Srivastava, Hongbo Rong, Prithayan Barua, Guanyu Feng, Huanqi Cao, Zhiru Zhang, David H. Albonesi, Vivek Sarkar, Wenguang Chen, Paul Petersen, Geoff Lowney, Adam Herr, Christopher J. Hughes, Timothy G. Mattson, Pradeep Dubey
2018ICLRMixed Precision Training of Convolutional Neural Networks using Integer Operations.Dipankar Das, Naveen Mellempudi, Dheevatsa Mudigere, Dhiraj D. Kalamkar, Sasikanth Avancha, Kunal Banerjee, Srinivas Sridharan, Karthik Vaidyanathan, Bharat Kaul, Evangelos Georganas, Alexander Heinecke, Pradeep Dubey, Jess Corbal, Nikita Shustrov, Roman Dubtsov, Evarist Fomenko, Vadim O. Pirogov
2017ICLRFaster CNNs with Direct Sparse Convolutions and Guided Pruning.Jongsoo Park, Sheng R. Li, Wei Wen, Ping Tak Peter Tang, Hai Li, Yiran Chen, Pradeep Dubey
2017ISCAScaleDeep: A Scalable Compute Architecture for Learning and Evaluating Deep Networks.Swagath Venkataramani, Ashish Ranjan, Subarno Banerjee, Dipankar Das, Sasikanth Avancha, Ashok Jagannathan, Ajaya Durg, Dheemanth Nagaraj, Bharat Kaul, Pradeep Dubey, Anand Raghunathan
2017SCGalactos: computing the anisotropic 3-point correlation function for 2 billion galaxies.Brian Friesen, Md. Mostofa Ali Patwary, Brian Austin, Nadathur Satish, Zachary Slepian, Narayanan Sundaram, Deborah Bard, Daniel J. Eisenstein, Jack Deslippe, Pradeep Dubey, Prabhat
2017SCDeep learning at 15PF: supervised and semi-supervised classification for scientific data.Thorsten Kurth, Jian Zhang, Nadathur Satish, Evan Racah, Ioannis Mitliagkas, Md. Mostofa Ali Patwary, Tareq M. Malas, Narayanan Sundaram, Wahid Bhimji, Mikhail Smorkalov, Jack Deslippe, Mikhail Shiryaev, Srinivas Sridharan, Prabhat, Pradeep Dubey
2016SCDesigning scalableArif M. Khan, Alex Pothen, Md. Mostofa Ali Patwary, Mahantesh Halappanavar, Nadathur Rajagopalan Satish, Narayanan Sundaram, Pradeep Dubey
2015ISCAArchitecting to achieve a billion requests per second throughput on a single key-value store server platform.Sheng Li, Hyeontaek Lim, Victor W. Lee, Jung Ho Ahn, Anuj Kalia, Michael Kaminsky, David G. Andersen, Seongil O, Sukhan Lee, Pradeep Dubey
2015SCImproving graph partitioning for modern graphs and architectures.Dominique LaSalle, Md. Mostofa Ali Patwary, Nadathur Satish, Narayanan Sundaram, Pradeep Dubey, George Karypis
2015SCHigh-performance algebraic multigrid solver optimized for multi-core based distributed parallel systems.Jongsoo Park, Mikhail Smelyanskiy, Ulrike Meier Yang, Dheevatsa Mudigere, Pradeep Dubey
2015SCBD-CATS: big data clustering at trillion particle scale.Md. Mostofa Ali Patwary, Surendra Byna, Nadathur Rajagopalan Satish, Narayanan Sundaram, Zarija Lukic, Vadim Roytershteyn, Michael J. Anderson, Yushu Yao, Prabhat, Pradeep Dubey
2014ISCAImproving the energy efficiency of Big Cores.Kenneth Czechowski, Victor W. Lee, Ed Grochowski, Ronny Ronen, Ronak Singhal, Richard W. Vuduc, Pradeep Dubey
2014SCPetascale High Order Dynamic Rupture Earthquake Simulations on Heterogeneous Supercomputers.Alexander Heinecke, Alexander Breuer, Sebastian Rettenberger, Michael Bader, Alice-Agnes Gabriel, Christian Pelties, Arndt Bode, William Barth, Xiangke Liao, Karthikeyan Vaidyanathan, Mikhail Smelyanskiy, Pradeep Dubey
2014SCLattice QCD with Domain Decomposition on Intel Xeon Phi Co-Processors.Simon Heybrock, Blint Jo, Dhiraj D. Kalamkar, Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Tilo Wettig, Pradeep Dubey
2014SCEfficient Shared-Memory Implementation of High-Performance Conjugate Gradient Benchmark and its Application to Unstructured Matrices.Jongsoo Park, Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Alexander Heinecke, Dhiraj D. Kalamkar, Xing Liu, Md. Mostofa Ali Patwary, Yutong Lu, Pradeep Dubey
2014SCPardicle: Parallel Approximate Density-Based Clustering.Md. Mostofa Ali Patwary, Nadathur Satish, Narayanan Sundaram, Fredrik Manne, Salman Habib, Pradeep Dubey
2014SIGMODNavigating the maze of graph analytics frameworks using massive graph datasets.Nadathur Satish, Narayanan Sundaram, Md. Mostofa Ali Patwary, Jiwon Seo, Jongsoo Park, Muhammad Amber Hassaan, Shubho Sengupta, Zhaoming Yin, Pradeep Dubey
2013ICSEfficient sparse matrix-vector multiplication on x86-based many-core processors.Xing Liu, Mikhail Smelyanskiy, Edmond Chow, Pradeep Dubey
2013SCTera-scale 1D FFT with low-communication algorithm and Intel Xeon Phi™ coprocessors.Jongsoo Park, Ganesh Bikshandi, Karthikeyan Vaidyanathan, Ping Tak Peter Tang, Pradeep Dubey, Daehyun Kim
2012ISCACan traditional programming bridge the Ninja performance gap for parallel computing applications?Nadathur Satish, Changkyu Kim, Jatin Chhugani, Hideki Saito, Rakesh Krishnaiyer, Mikhail Smelyanskiy, Milind Girkar, Pradeep Dubey
2012RAIDGPP-Grep: High-Speed Regular Expression Processing Engine on General Purpose Processors.Victor C. Valgenti, Jatin Chhugani, Yan Sun, Nadathur Satish, Min Sik Kim, Changkyu Kim, Pradeep Dubey
2012SCBillion-particle SIMD-friendly two-point correlation on large-scale HPC cluster systems.Jatin Chhugani, Changkyu Kim, Hemant Shukla, Jongsoo Park, Pradeep Dubey, John Shalf, Horst D. Simon
2012SCLarge-scale energy-efficient graph traversal: a path to efficient data-intensive supercomputing.Nadathur Satish, Changkyu Kim, Jatin Chhugani, Pradeep Dubey
2012SCAnalysis and Optimization of Financial Analytics Benchmark on Modern Multi- and Many-core IA-Based Architectures.Mikhail Smelyanskiy, Jason Sewall, Dhiraj D. Kalamkar, Nadathur Satish, Pradeep Dubey, Nikita Astafiev, Ilya Burylov, Andrey Nikolaev, Sergey Maidanov, Shuo Li, Sunil Kulkarni, Charles H. Finan, Ekaterina Gonina
2012SCOptimization of geometric multigrid for emerging multi- and manycore processors.Samuel Williams, Dhiraj D. Kalamkar, Amik Singh, Anand M. Deshpande, Brian van Straalen, Mikhail Smelyanskiy, Ann S. Almgren, Pradeep Dubey, John Shalf, Leonid Oliker
2012SIGMODCloudRAMSort: fast and efficient large-scale distributed RAM sort on shared-nothing cluster.Changkyu Kim, Jongsoo Park, Nadathur Satish, Hongrae Lee, Pradeep Dubey, Jatin Chhugani
2011SIGGRAPHPhysBAM: physically based simulation.Pradeep Dubey, Pat Hanrahan, Ronald Fedkiw, Michael Lentine, Craig A. Schroeder
2011SIGGRAPHInteractive hybrid simulation of large-scale traffic.Jason Sewall, David Wilkie, Ming C. Lin, Pradeep Dubey
2011SCHigh-performance lattice QCD for multi-core based parallel systems using a cache-friendly hybrid threaded-MPI approach.Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Jee W. Choi, Blint Jo, Jatin Chhugani, Michael A. Clark, Pradeep Dubey
2010ISCADebunking the 100X GPU vs. CPU myth: an evaluation of throughput computing on CPU and GPU.Victor W. Lee, Changkyu Kim, Jatin Chhugani, Michael Deisher, Daehyun Kim, Anthony D. Nguyen, Nadathur Satish, Mikhail Smelyanskiy, Srinivas Chennupaty, Per Hammarlund, Ronak Singhal, Pradeep Dubey
2010SC3.5-D Blocking Optimization for Stencil Computations on Modern CPUs and GPUs.Anthony D. Nguyen, Nadathur Satish, Jatin Chhugani, Changkyu Kim, Pradeep Dubey
2010SIGMODFAST: fast architecture sensitive tree search on modern CPUs and GPUs.Changkyu Kim, Jatin Chhugani, Nadathur Satish, Eric Sedlar, Anthony D. Nguyen, Tim Kaldewey, Victor W. Lee, Scott A. Brandt, Pradeep Dubey
2010SIGMODFast sort on CPUs and GPUs: a case for bandwidth oblivious SIMD sort.Nadathur Satish, Changkyu Kim, Jatin Chhugani, Anthony D. Nguyen, Victor W. Lee, Daehyun Kim, Pradeep Dubey
2010SCAPLEdestrians: A Least-Effort Approach to Crowd Simulation.Stephen J. Guy, Jatin Chhugani, Sean Curtis, Pradeep Dubey, Ming C. Lin, Dinesh Manocha
2009MIGInteractive Modeling, Simulation and Control of Large-Scale Crowds and Traffic.Ming C. Lin, Stephen J. Guy, Rahul Narain, Jason Sewall, Sachin Patil, Jatin Chhugani, Abhinav Golas, Jur P. van den Berg, Sean Curtis, David Wilkie, Paul Merrell, Changkyu Kim, Nadathur Satish, Pradeep Dubey, Dinesh Manocha
2009SCAClearPath: highly parallel collision avoidance for multi-agent simulation.Stephen J. Guy, Jatin Chhugani, Changkyu Kim, Nadathur Satish, Ming C. Lin, Dinesh Manocha, Pradeep Dubey
2007SCScaling performance of interior-point method on large-scale chip multiprocessor system.Mikhail Smelyanskiy, Victor W. Lee, Daehyun Kim, Anthony D. Nguyen, Pradeep Dubey
2005DaMoNA Characterization of Data Mining Workloads on a Modern Processor.Amol Ghoting, Gregory Buehrer, Srinivasan Parthasarathy, Daehyun Kim, Anthony D. Nguyen, Yen-Kuang Chen, Pradeep Dubey
2005VLDBCache-conscious Frequent Pattern Mining on a Modern Processor.Amol Ghoting, Gregory Buehrer, Srinivasan Parthasarathy, Daehyun Kim, Anthony D. Nguyen, Yen-Kuang Chen, Pradeep Dubey
2000ICIPCompression Tolerant Watermarking for Image Verification.Harpal S. Bassali, Jatin Chhugani, Saurabh Agarwal, Alok Aggarwal, Pradeep Dubey
1997HiPCCharacterizing vulnerability of parallelism to resource constraints.V. Vivekanand, K. Gopinath, Pradeep Dubey