Mikhail Smelyanskiy
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
23
Venues
8
Active years
2001–2022
Best venue rank
A*
Where they publish
Papers
23 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2022 | ICDCS | Supporting Massive DLRM Inference through Software Defined Memory. | Ehsan K. Ardestani, Changkyu Kim, Seung Jae Lee, Luoshang Pan, Jens Axboe, Valmiki Rampersad, Banit Agrawal, Fuxun Yu, Ansha Yu, Trung Le, Hector Yuen, Dheevatsa Mudigere, Shishir Juluri, Akshat Nanda, Manoj Wodekar, Krishnakumar Nair, Maxim Naumov, Chris Petersen, Mikhail Smelyanskiy, Vijay Rao |
| 2022 | ISCA | Software-hardware co-design for fast and scalable training of deep learning recommendation models. | Dheevatsa Mudigere, Yuchen Hao, Jianyu Huang, Zhihao Jia, Andrew Tulloch, Srinivas Sridharan, Xing Liu, Mustafa Ozdal, Jade Nie, Jongsoo Park, Liang Luo, Jie Amy Yang, Leon Gao, Dmytro Ivchenko, Aarti Basant, Yuxi Hu, Jiyan Yang, Ehsan K. Ardestani, Xiaodong Wang, Rakesh Komuravelli, Ching-Hsiang Chu, Serhat Yilmaz, Huayu Li, Jiyuan Qian, Zhuobo Feng, Yinbin Ma, Junjie Yang, Ellie Wen, Hong Li, Lin Yang, Chonglin Sun, Whitney Zhao, Dimitry Melts, Krishna Dhulipala, K. R. Kishore, Tyler Graf, Assaf Eisenman, Kiran Kumar Matam, Adi Gangidi, Guoqiang Jerry Chen, Manoj Krishnan, Avinash Nayak, Krishnakumar Nair, Bharath Muthiah, Mahmoud khorashadi, Pallab Bhattacharya, Petr Lapukhov, Maxim Naumov, Ajit Mathews, Lin Qiao, Mikhail Smelyanskiy, Bill Jia, Vijay Rao |
| 2020 | HPCA | The Architectural Implications of Facebook's DNN-Based Personalized Recommendation. | Udit Gupta, Carole-Jean Wu, Xiaodong Wang, Maxim Naumov, Brandon Reagen, David Brooks, Bradford Cottel, Kim M. Hazelwood, Mark Hempstead, Bill Jia, Hsien-Hsin S. Lee, Andrey Malevich, Dheevatsa Mudigere, Mikhail Smelyanskiy, Liang Xiong, Xuan Zhang |
| 2020 | ISCA | RecNMP: Accelerating Personalized Recommendation with Near-Memory Processing. | Liu Ke, Udit Gupta, Benjamin Youngjae Cho, David Brooks, Vikas Chandra, Utku Diril, Amin Firoozshahian, Kim M. Hazelwood, Bill Jia, Hsien-Hsin S. Lee, Meng Li, Bert Maher, Dheevatsa Mudigere, Maxim Naumov, Martin Schatz, Mikhail Smelyanskiy, Xiaodong Wang, Brandon Reagen, Carole-Jean Wu, Mark Hempstead, Xuan Zhang |
| 2017 | AAAI | Distributed Hessian-Free Optimization for Deep Neural Network. | Xi He, Dheevatsa Mudigere, Mikhail Smelyanskiy, Martin Takc |
| 2017 | ICLR | On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima. | Nitish Shirish Keskar, Dheevatsa Mudigere, Jorge Nocedal, Mikhail Smelyanskiy, Ping Tak Peter Tang |
| 2016 | SC | High performance emulation of quantum circuits. | Thomas Hner, Damian S. Steiger, Mikhail Smelyanskiy, Matthias Troyer |
| 2015 | SC | High-performance algebraic multigrid solver optimized for multi-core based distributed parallel systems. | Jongsoo Park, Mikhail Smelyanskiy, Ulrike Meier Yang, Dheevatsa Mudigere, Pradeep Dubey |
| 2014 | SC | Petascale High Order Dynamic Rupture Earthquake Simulations on Heterogeneous Supercomputers. | Alexander Heinecke, Alexander Breuer, Sebastian Rettenberger, Michael Bader, Alice-Agnes Gabriel, Christian Pelties, Arndt Bode, William Barth, Xiangke Liao, Karthikeyan Vaidyanathan, Mikhail Smelyanskiy, Pradeep Dubey |
| 2014 | SC | Lattice QCD with Domain Decomposition on Intel Xeon Phi Co-Processors. | Simon Heybrock, Blint Jo, Dhiraj D. Kalamkar, Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Tilo Wettig, Pradeep Dubey |
| 2014 | SC | Efficient Shared-Memory Implementation of High-Performance Conjugate Gradient Benchmark and its Application to Unstructured Matrices. | Jongsoo Park, Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Alexander Heinecke, Dhiraj D. Kalamkar, Xing Liu, Md. Mostofa Ali Patwary, Yutong Lu, Pradeep Dubey |
| 2013 | ICS | Efficient sparse matrix-vector multiplication on x86-based many-core processors. | Xing Liu, Mikhail Smelyanskiy, Edmond Chow, Pradeep Dubey |
| 2012 | ISCA | Can traditional programming bridge the Ninja performance gap for parallel computing applications? | Nadathur Satish, Changkyu Kim, Jatin Chhugani, Hideki Saito, Rakesh Krishnaiyer, Mikhail Smelyanskiy, Milind Girkar, Pradeep Dubey |
| 2012 | SC | Efficient backprojection-based synthetic aperture radar computation with many-core processors. | Jongsoo Park, Ping Tak Peter Tang, Mikhail Smelyanskiy, Daehyun Kim, Thomas Benson |
| 2012 | SC | Analysis and Optimization of Financial Analytics Benchmark on Modern Multi- and Many-core IA-Based Architectures. | Mikhail Smelyanskiy, Jason Sewall, Dhiraj D. Kalamkar, Nadathur Satish, Pradeep Dubey, Nikita Astafiev, Ilya Burylov, Andrey Nikolaev, Sergey Maidanov, Shuo Li, Sunil Kulkarni, Charles H. Finan, Ekaterina Gonina |
| 2012 | SC | Optimization of geometric multigrid for emerging multi- and manycore processors. | Samuel Williams, Dhiraj D. Kalamkar, Amik Singh, Anand M. Deshpande, Brian van Straalen, Mikhail Smelyanskiy, Ann S. Almgren, Pradeep Dubey, John Shalf, Leonid Oliker |
| 2011 | SC | High-performance lattice QCD for multi-core based parallel systems using a cache-friendly hybrid threaded-MPI approach. | Mikhail Smelyanskiy, Karthikeyan Vaidyanathan, Jee W. Choi, Blint Jo, Jatin Chhugani, Michael A. Clark, Pradeep Dubey |
| 2010 | ISCA | Debunking the 100X GPU vs. CPU myth: an evaluation of throughput computing on CPU and GPU. | Victor W. Lee, Changkyu Kim, Jatin Chhugani, Michael Deisher, Daehyun Kim, Anthony D. Nguyen, Nadathur Satish, Mikhail Smelyanskiy, Srinivas Chennupaty, Per Hammarlund, Ronak Singhal, Pradeep Dubey |
| 2008 | ISCA | Atomic Vector Operations on Chip Multiprocessors. | Sanjeev Kumar, Daehyun Kim, Mikhail Smelyanskiy, Yen-Kuang Chen, Jatin Chhugani, Christopher J. Hughes, Changkyu Kim, Victor W. Lee, Anthony D. Nguyen |
| 2007 | SC | Scaling performance of interior-point method on large-scale chip multiprocessor system. | Mikhail Smelyanskiy, Victor W. Lee, Daehyun Kim, Anthony D. Nguyen, Pradeep Dubey |
| 2004 | CGO | Probabilistic Predicate-Aware Modulo Scheduling. | Mikhail Smelyanskiy, Scott A. Mahlke, Edward S. Davidson |
| 2003 | CGO | Predicate-Aware Scheduling: A Technique for Reducing Resource Constraints. | Mikhail Smelyanskiy, Scott A. Mahlke, Edward S. Davidson, Hsien-Hsin S. Lee |
| 2001 | HPCA | Stack Value File: Custom Microarchitecture for the Stack. | Hsien-Hsin S. Lee, Mikhail Smelyanskiy, Chris J. Newburn, Gary S. Tyson |