Changkyu Kim
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
28
Venues
16
Active years
2002–2022
Best venue rank
A*
Where they publish
Papers
28 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2022 | HiPC | Building a Performance Model for Deep Learning Recommendation Model Training on GPUs. | Zhongyi Lin, Louis Feng, Ehsan K. Ardestani, Jaewon Lee, John Lundell, Changkyu Kim, Arun Kejariwal, John D. Owens |
| 2022 | ICDCS | Supporting Massive DLRM Inference through Software Defined Memory. | Ehsan K. Ardestani, Changkyu Kim, Seung Jae Lee, Luoshang Pan, Jens Axboe, Valmiki Rampersad, Banit Agrawal, Fuxun Yu, Ansha Yu, Trung Le, Hector Yuen, Dheevatsa Mudigere, Shishir Juluri, Akshat Nanda, Manoj Wodekar, Krishnakumar Nair, Maxim Naumov, Chris Petersen, Mikhail Smelyanskiy, Vijay Rao |
| 2022 | ISPASS | Building a Performance Model for Deep Learning Recommendation Model Training on GPUs. | Zhongyi Lin, Louis Feng, Ehsan K. Ardestani, Jaewon Lee, John Lundell, Changkyu Kim, Arun Kejariwal, John D. Owens |
| 2018 | ASPLOS | WSMeter: A Performance Evaluation Methodology for Google's Production Warehouse-Scale Computers. | Jaewon Lee, Changkyu Kim, Kun Lin, Liqun Cheng, Rama Govindaraju, Jangwoo Kim |
| 2016 | ICDE | Using SSDs to scale up Google Fusion Tables, a database-in-the-cloud. | Yingyi Bu, Felix Halim, Changkyu Kim, Hongrae Lee, Jayant Madhavan |
| 2014 | ACSSC | Joint interference and user association optimization in cellular wireless networks. | Changkyu Kim, Russell Ford, Sundeep Rangan |
| 2014 | ICS | Author retrospective for a NUCA substrate for flexible CMP cache sharing. | Jaehyuk Huh, Changkyu Kim, Hazim Shafi, Lixin Zhang, Doug Burger, Stephen W. Keckler |
| 2013 | ACSSC | Opportunistic third-party backhaul for cellular wireless networks. | Russell Ford, Changkyu Kim, Sundeep Rangan |
| 2013 | SPAA | Locality-aware task management for unstructured parallelism: a quantitative limit study. | Richard M. Yoo, Christopher J. Hughes, Changkyu Kim, Yen-Kuang Chen, Christos Kozyrakis |
| 2012 | ISCA | Can traditional programming bridge the Ninja performance gap for parallel computing applications? | Nadathur Satish, Changkyu Kim, Jatin Chhugani, Hideki Saito, Rakesh Krishnaiyer, Mikhail Smelyanskiy, Milind Girkar, Pradeep Dubey |
| 2012 | RAID | GPP-Grep: High-Speed Regular Expression Processing Engine on General Purpose Processors. | Victor C. Valgenti, Jatin Chhugani, Yan Sun, Nadathur Satish, Min Sik Kim, Changkyu Kim, Pradeep Dubey |
| 2012 | SC | Billion-particle SIMD-friendly two-point correlation on large-scale HPC cluster systems. | Jatin Chhugani, Changkyu Kim, Hemant Shukla, Jongsoo Park, Pradeep Dubey, John Shalf, Horst D. Simon |
| 2012 | SC | Large-scale energy-efficient graph traversal: a path to efficient data-intensive supercomputing. | Nadathur Satish, Changkyu Kim, Jatin Chhugani, Pradeep Dubey |
| 2012 | SIGMOD | CloudRAMSort: fast and efficient large-scale distributed RAM sort on shared-nothing cluster. | Changkyu Kim, Jongsoo Park, Nadathur Satish, Hongrae Lee, Pradeep Dubey, Jatin Chhugani |
| 2011 | ISCA | Moguls: a model to explore the memory hierarchy for bandwidth improvements. | Guangyu Sun, Christopher J. Hughes, Changkyu Kim, Jishen Zhao, Cong Xu, Yuan Xie, Yen-Kuang Chen |
| 2010 | ISCA | Debunking the 100X GPU vs. CPU myth: an evaluation of throughput computing on CPU and GPU. | Victor W. Lee, Changkyu Kim, Jatin Chhugani, Michael Deisher, Daehyun Kim, Anthony D. Nguyen, Nadathur Satish, Mikhail Smelyanskiy, Srinivas Chennupaty, Per Hammarlund, Ronak Singhal, Pradeep Dubey |
| 2010 | SC | 3.5-D Blocking Optimization for Stencil Computations on Modern CPUs and GPUs. | Anthony D. Nguyen, Nadathur Satish, Jatin Chhugani, Changkyu Kim, Pradeep Dubey |
| 2010 | SIGMOD | FAST: fast architecture sensitive tree search on modern CPUs and GPUs. | Changkyu Kim, Jatin Chhugani, Nadathur Satish, Eric Sedlar, Anthony D. Nguyen, Tim Kaldewey, Victor W. Lee, Scott A. Brandt, Pradeep Dubey |
| 2010 | SIGMOD | Fast sort on CPUs and GPUs: a case for bandwidth oblivious SIMD sort. | Nadathur Satish, Changkyu Kim, Jatin Chhugani, Anthony D. Nguyen, Victor W. Lee, Daehyun Kim, Pradeep Dubey |
| 2009 | MIG | Interactive Modeling, Simulation and Control of Large-Scale Crowds and Traffic. | Ming C. Lin, Stephen J. Guy, Rahul Narain, Jason Sewall, Sachin Patil, Jatin Chhugani, Abhinav Golas, Jur P. van den Berg, Sean Curtis, David Wilkie, Paul Merrell, Changkyu Kim, Nadathur Satish, Pradeep Dubey, Dinesh Manocha |
| 2009 | SCA | ClearPath: highly parallel collision avoidance for multi-agent simulation. | Stephen J. Guy, Jatin Chhugani, Changkyu Kim, Nadathur Satish, Ming C. Lin, Dinesh Manocha, Pradeep Dubey |
| 2008 | ISCA | Atomic Vector Operations on Chip Multiprocessors. | Sanjeev Kumar, Daehyun Kim, Mikhail Smelyanskiy, Yen-Kuang Chen, Jatin Chhugani, Christopher J. Hughes, Changkyu Kim, Victor W. Lee, Anthony D. Nguyen |
| 2007 | MICRO | Composable Lightweight Processors. | Changkyu Kim, Simha Sethumadhavan, M. S. Govindan, Nitya Ranganathan, Divya Gulati, Doug Burger, Stephen W. Keckler |
| 2006 | ICCD | Implementation and Evaluation of On-Chip Network Architectures. | Paul Gratz, Changkyu Kim, Robert G. McDonald, Stephen W. Keckler, Doug Burger |
| 2006 | MICRO | Distributed Microarchitectural Protocols in the TRIPS Prototype Processor. | Karthikeyan Sankaralingam, Ramadass Nagarajan, Robert G. McDonald, Rajagopalan Desikan, Saurabh Drolia, M. S. Govindan, Paul Gratz, Divya Gulati, Heather Hanson, Changkyu Kim, Haiming Liu, Nitya Ranganathan, Simha Sethumadhavan, Sadia Sharif, Premkishore Shivakumar, Stephen W. Keckler, Doug Burger |
| 2005 | ICS | A NUCA substrate for flexible CMP cache sharing. | Jaehyuk Huh, Changkyu Kim, Hazim Shafi, Lixin Zhang, Doug Burger, Stephen W. Keckler |
| 2003 | ISCA | Exploiting ILP, TLP and DLP with the Polymorphous TRIPS Architecture. | Karthikeyan Sankaralingam, Ramadass Nagarajan, Haiming Liu, Changkyu Kim, Jaehyuk Huh, Doug Burger, Stephen W. Keckler, Charles R. Moore |
| 2002 | ASPLOS | An adaptive, non-uniform cache structure for wire-delay dominated on-chip caches. | Changkyu Kim, Doug Burger, Stephen W. Keckler |