Skip to content

Changkyu Kim

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

28

Venues

16

Active years

2002–2022

Best venue rank

A*

Where they publish

Papers

28 indexed papers, newest first.

YearVenueTitleAuthors
2022HiPCBuilding a Performance Model for Deep Learning Recommendation Model Training on GPUs.Zhongyi Lin, Louis Feng, Ehsan K. Ardestani, Jaewon Lee, John Lundell, Changkyu Kim, Arun Kejariwal, John D. Owens
2022ICDCSSupporting Massive DLRM Inference through Software Defined Memory.Ehsan K. Ardestani, Changkyu Kim, Seung Jae Lee, Luoshang Pan, Jens Axboe, Valmiki Rampersad, Banit Agrawal, Fuxun Yu, Ansha Yu, Trung Le, Hector Yuen, Dheevatsa Mudigere, Shishir Juluri, Akshat Nanda, Manoj Wodekar, Krishnakumar Nair, Maxim Naumov, Chris Petersen, Mikhail Smelyanskiy, Vijay Rao
2022ISPASSBuilding a Performance Model for Deep Learning Recommendation Model Training on GPUs.Zhongyi Lin, Louis Feng, Ehsan K. Ardestani, Jaewon Lee, John Lundell, Changkyu Kim, Arun Kejariwal, John D. Owens
2018ASPLOSWSMeter: A Performance Evaluation Methodology for Google's Production Warehouse-Scale Computers.Jaewon Lee, Changkyu Kim, Kun Lin, Liqun Cheng, Rama Govindaraju, Jangwoo Kim
2016ICDEUsing SSDs to scale up Google Fusion Tables, a database-in-the-cloud.Yingyi Bu, Felix Halim, Changkyu Kim, Hongrae Lee, Jayant Madhavan
2014ACSSCJoint interference and user association optimization in cellular wireless networks.Changkyu Kim, Russell Ford, Sundeep Rangan
2014ICSAuthor retrospective for a NUCA substrate for flexible CMP cache sharing.Jaehyuk Huh, Changkyu Kim, Hazim Shafi, Lixin Zhang, Doug Burger, Stephen W. Keckler
2013ACSSCOpportunistic third-party backhaul for cellular wireless networks.Russell Ford, Changkyu Kim, Sundeep Rangan
2013SPAALocality-aware task management for unstructured parallelism: a quantitative limit study.Richard M. Yoo, Christopher J. Hughes, Changkyu Kim, Yen-Kuang Chen, Christos Kozyrakis
2012ISCACan traditional programming bridge the Ninja performance gap for parallel computing applications?Nadathur Satish, Changkyu Kim, Jatin Chhugani, Hideki Saito, Rakesh Krishnaiyer, Mikhail Smelyanskiy, Milind Girkar, Pradeep Dubey
2012RAIDGPP-Grep: High-Speed Regular Expression Processing Engine on General Purpose Processors.Victor C. Valgenti, Jatin Chhugani, Yan Sun, Nadathur Satish, Min Sik Kim, Changkyu Kim, Pradeep Dubey
2012SCBillion-particle SIMD-friendly two-point correlation on large-scale HPC cluster systems.Jatin Chhugani, Changkyu Kim, Hemant Shukla, Jongsoo Park, Pradeep Dubey, John Shalf, Horst D. Simon
2012SCLarge-scale energy-efficient graph traversal: a path to efficient data-intensive supercomputing.Nadathur Satish, Changkyu Kim, Jatin Chhugani, Pradeep Dubey
2012SIGMODCloudRAMSort: fast and efficient large-scale distributed RAM sort on shared-nothing cluster.Changkyu Kim, Jongsoo Park, Nadathur Satish, Hongrae Lee, Pradeep Dubey, Jatin Chhugani
2011ISCAMoguls: a model to explore the memory hierarchy for bandwidth improvements.Guangyu Sun, Christopher J. Hughes, Changkyu Kim, Jishen Zhao, Cong Xu, Yuan Xie, Yen-Kuang Chen
2010ISCADebunking the 100X GPU vs. CPU myth: an evaluation of throughput computing on CPU and GPU.Victor W. Lee, Changkyu Kim, Jatin Chhugani, Michael Deisher, Daehyun Kim, Anthony D. Nguyen, Nadathur Satish, Mikhail Smelyanskiy, Srinivas Chennupaty, Per Hammarlund, Ronak Singhal, Pradeep Dubey
2010SC3.5-D Blocking Optimization for Stencil Computations on Modern CPUs and GPUs.Anthony D. Nguyen, Nadathur Satish, Jatin Chhugani, Changkyu Kim, Pradeep Dubey
2010SIGMODFAST: fast architecture sensitive tree search on modern CPUs and GPUs.Changkyu Kim, Jatin Chhugani, Nadathur Satish, Eric Sedlar, Anthony D. Nguyen, Tim Kaldewey, Victor W. Lee, Scott A. Brandt, Pradeep Dubey
2010SIGMODFast sort on CPUs and GPUs: a case for bandwidth oblivious SIMD sort.Nadathur Satish, Changkyu Kim, Jatin Chhugani, Anthony D. Nguyen, Victor W. Lee, Daehyun Kim, Pradeep Dubey
2009MIGInteractive Modeling, Simulation and Control of Large-Scale Crowds and Traffic.Ming C. Lin, Stephen J. Guy, Rahul Narain, Jason Sewall, Sachin Patil, Jatin Chhugani, Abhinav Golas, Jur P. van den Berg, Sean Curtis, David Wilkie, Paul Merrell, Changkyu Kim, Nadathur Satish, Pradeep Dubey, Dinesh Manocha
2009SCAClearPath: highly parallel collision avoidance for multi-agent simulation.Stephen J. Guy, Jatin Chhugani, Changkyu Kim, Nadathur Satish, Ming C. Lin, Dinesh Manocha, Pradeep Dubey
2008ISCAAtomic Vector Operations on Chip Multiprocessors.Sanjeev Kumar, Daehyun Kim, Mikhail Smelyanskiy, Yen-Kuang Chen, Jatin Chhugani, Christopher J. Hughes, Changkyu Kim, Victor W. Lee, Anthony D. Nguyen
2007MICROComposable Lightweight Processors.Changkyu Kim, Simha Sethumadhavan, M. S. Govindan, Nitya Ranganathan, Divya Gulati, Doug Burger, Stephen W. Keckler
2006ICCDImplementation and Evaluation of On-Chip Network Architectures.Paul Gratz, Changkyu Kim, Robert G. McDonald, Stephen W. Keckler, Doug Burger
2006MICRODistributed Microarchitectural Protocols in the TRIPS Prototype Processor.Karthikeyan Sankaralingam, Ramadass Nagarajan, Robert G. McDonald, Rajagopalan Desikan, Saurabh Drolia, M. S. Govindan, Paul Gratz, Divya Gulati, Heather Hanson, Changkyu Kim, Haiming Liu, Nitya Ranganathan, Simha Sethumadhavan, Sadia Sharif, Premkishore Shivakumar, Stephen W. Keckler, Doug Burger
2005ICSA NUCA substrate for flexible CMP cache sharing.Jaehyuk Huh, Changkyu Kim, Hazim Shafi, Lixin Zhang, Doug Burger, Stephen W. Keckler
2003ISCAExploiting ILP, TLP and DLP with the Polymorphous TRIPS Architecture.Karthikeyan Sankaralingam, Ramadass Nagarajan, Haiming Liu, Changkyu Kim, Jaehyuk Huh, Doug Burger, Stephen W. Keckler, Charles R. Moore
2002ASPLOSAn adaptive, non-uniform cache structure for wire-delay dominated on-chip caches.Changkyu Kim, Doug Burger, Stephen W. Keckler