| 2025 | ICS | DeCOS: Data-Efficient Reinforcement Learning for Compiler Optimization Selection Ignited by LLM. | Tianming Cui, Pen-Chung Yew, Stephen McCamant, Antonia Zhai |
| 2025 | ICS | EVeREST-C: An Effective and Versatile Runtime Energy Saving Tool for CPUs. | Anna Yue, Pen-Chung Yew, Sanyam Mehta |
| 2025 | PPoPP | EVeREST: An Effective and Versatile Runtime Energy Saving Tool for GPUs. | Anna Yue, Pen-Chung Yew, Sanyam Mehta |
| 2024 | AsiaCCS | Non-Fusion Based Coherent Cache Randomization Using Cross-Domain Accesses. | Kartik Ramkrishnan, Stephen McCamant, Antonia Zhai, Pen-Chung Yew |
| 2024 | CGO | A System-Level Dynamic Binary Translator Using Automatically-Learned Translation Rules. | Jinhu Jiang, Chaoyi Liang, Rongchao Dong, Zhaohui Yang, Zhongjun Zhou, Wenwen Wang, Pen-Chung Yew, Weihua Zhang |
| 2023 | SC | ReAPER: Region Aware Power and Energy Regulator. | Anna Yue, Torsten Wilde, Steven Martin, Pen-Chung Yew, Sanyam Mehta |
| 2021 | CGO | Variable-Sized Blocks for Locality-Aware SpMV. | Naveen Namashivavam, Sanyam Mehta, Pen-Chung Yew |
| 2021 | CGO | Enhancing Atomic Instruction Emulation for Cross-ISA Dynamic Binary Translation. | Ziyi Zhao, Zhang Jiang, Ying Chen, Xiaoli Gong, Wenwen Wang, Pen-Chung Yew |
| 2021 | ICPP | Ascetic: Enhancing Cross-Iterations Data Efficiency in Out-of-Memory Graph Processing on GPUs. | Ruiqi Tang, Ziyi Zhao, Kailun Wang, Xiaoli Gong, Jin Zhang, Wenwen Wang, Pen-Chung Yew |
| 2020 | CGO | Efficient and scalable cross-ISA virtualization of hardware transactional memory. | Wenwen Wang, Pen-Chung Yew, Antonia Zhai, Stephen McCamant |
| 2020 | ICPP | First Time Miss : Low Overhead Mitigation for Shared Memory Cache Side Channels. | Kartik Ramkrishnan, Stephen McCamant, Pen-Chung Yew, Antonia Zhai |
| 2020 | ICPP | DQEMU: A Scalable Emulator with Retargetable DBT on Distributed Platforms. | Ziyi Zhao, Zhang Jiang, Ximing Liu, Xiaoli Gong, Wenwen Wang, Pen-Chung Yew |
| 2020 | MICRO | More with Less - Deriving More Translation Rules with Less Training Data for DBTs Using Parameterization. | Jinhu Jiang, Rongchao Dong, Zhongjun Zhou, Changheng Song, Wenwen Wang, Pen-Chung Yew, Weihua Zhang |
| 2020 | Middleware | Regaining Lost Seconds: Efficient Page Preloading for SGX Enclaves. | Ximing Liu, Wenwen Wang, Lizhi Wang, Xiaoli Gong, Ziyi Zhao, Pen-Chung Yew |
| 2019 | USENIX | Unleashing the Power of Learning: An Enhanced Learning-Based Approach for Dynamic Binary Translation. | Changheng Song, Wenwen Wang, Pen-Chung Yew, Antonia Zhai, Weihua Zhang |
| 2018 | ASPLOS | Enhancing Cross-ISA DBT Through Automatically Learned Translation Rules. | Wenwen Wang, Stephen McCamant, Antonia Zhai, Pen-Chung Yew |
| 2018 | CCS | Check It Again: Detecting Lacking-Recheck Bugs in OS Kernels. | Wenwen Wang, Kangjie Lu, Pen-Chung Yew |
| 2018 | VEE | Improving Dynamically-Generated Code Performance on Dynamic Binary Translators. | Wenwen Wang, Jiacheng Wu, Xiaoli Gong, Tao Li, Pen-Chung Yew |
| 2017 | ICSE | A formally verified sequentializer for lustre-like concurrent synchronous data-flow programs. | Gang Shi, Yuanke Gan, Shu Shang, Shengyuan Wang, Yuan Dong, Pen-Chung Yew |
| 2017 | Mobisys | Enabling Cross-ISA Offloading for COTS Binaries. | Wenwen Wang, Pen-Chung Yew, Antonia Zhai, Stephen McCamant, Youfeng Wu, Jayaram Bobba |
| 2016 | ICS | TurboTiling: Leveraging Prefetching to Boost Performance of Tiled Codes. | Sanyam Mehta, Rajat Garg, Nishad Trivedi, Pen-Chung Yew |
| 2016 | USENIX | A General Persistent Code Caching Framework for Dynamic Binary Translation (DBT). | Wenwen Wang, Pen-Chung Yew, Antonia Zhai, Stephen McCamant |
| 2015 | ICSE | ReCBuLC: Reproducing Concurrency Bugs Using Local Clocks. | Xiang Yuan, Chenggang Wu, Zhenjiang Wang, Jianjun Li, Pen-Chung Yew, Jeff Huang, Xiaobing Feng, Yanyan Lan, Yunji Chen, Yong Guan |
| 2015 | PLDI | Improving compiler scalability: optimizing large programs at small price. | Sanyam Mehta, Pen-Chung Yew |
| 2014 | DAC | DAPs: Dynamic Adjustment and Partial Sampling for Multithreaded/Multicore Simulation. | Chien-Chih Chen, Yin-Chi Peng, Cheng-Fen Chen, Wei-Shan Wu, Qinghao Min, Pen-Chung Yew, Weihua Zhang, Tien-Fu Chen |
| 2014 | ICS | Multi-stage coordinated prefetching for present-day processors. | Sanyam Mehta, Zhenman Fang, Antonia Zhai, Pen-Chung Yew |
| 2014 | PPoPP | Revisiting loop fusion in the polyhedral framework. | Sanyam Mehta, Pei-Hung Lin, Pen-Chung Yew |
| 2014 | PPoPP | Concurrency bug localization using shared memory access pairs. | Wenwen Wang, Chenggang Wu, Pen-Chung Yew, Xiang Yuan, Zhenjiang Wang, Jianjun Li, Xiaobing Feng |
| 2014 | VEE | Efficient memory virtualization for Cross-ISA system mode emulation. | Chao-Rui Chang, Jan-Jan Wu, Wei-Chung Hsu, Pangfeng Liu, Pen-Chung Yew |
| 2014 | VEE | DBILL: an efficient and retargetable dynamic binary instrumentation framework using llvm backend. | Yi-Hong Lyu, Ding-Yong Hong, Tai-Yi Wu, Jan-Jan Wu, Wei-Chung Hsu, Pangfeng Liu, Pen-Chung Yew |
| 2013 | EuroPar | Synchronization Identification through On-the-Fly Test. | Xiang Yuan, Zhenjiang Wang, Chenggang Wu, Pen-Chung Yew, Wenwen Wang, Jianjun Li, Di Xu |
| 2013 | VEE | Improving dynamic binary optimization through early-exit guided code region formation. | Chun-Chen Hsu, Pangfeng Liu, Jan-Jan Wu, Pen-Chung Yew, Ding-Yong Hong, Wei-Chung Hsu, Chien-Min Wang |
| 2012 | CGO | HQEMU: a multi-threaded and retargetable dynamic binary translator on multicores. | Ding-Yong Hong, Chun-Chen Hsu, Pen-Chung Yew, Jan-Jan Wu, Wei-Chung Hsu, Pangfeng Liu, Chien-Min Wang, Yeh-Ching Chung |
| 2012 | SIGMETRICS | Providing fairness on shared-memory multiprocessors via process scheduling. | Di Xu, Chenggang Wu, Pen-Chung Yew, Jianjun Li, Zhenjiang Wang |
| 2011 | APLAS | SPAS: Scalable Path-Sensitive Pointer Analysis on Full-Sparse SSA. | Yulei Sui, Sen Ye, Jingling Xue, Pen-Chung Yew |
| 2011 | ICPP | LnQ: Building High Performance Dynamic Binary Translators with Existing Compiler Backends. | Chun-Chen Hsu, Pangfeng Liu, Chien-Min Wang, Jan-Jan Wu, Ding-Yong Hong, Pen-Chung Yew, Wei-Chung Hsu |
| 2010 | CGO | An adaptive task creation strategy for work-stealing scheduling. | Lei Wang, Huimin Cui, Yuelu Duan, Fang Lu, Xiaobing Feng, Pen-Chung Yew |
| 2010 | CGO | On improving heap memory layout by dynamic pool allocation. | Zhenjiang Wang, Chenggang Wu, Pen-Chung Yew |
| 2009 | CGO | Detecting and Eliminating Potential Violations of Sequential Consistency for Concurrent C/C++ Programs. | Yuelu Duan, Xiaobing Feng, Lei Wang, Chao Zhang, Pen-Chung Yew |
| 2009 | ISPASS | Exploring speculative parallelism in SPEC2006. | Venkatesan Packirisamy, Antonia Zhai, Wei-Chung Hsu, Pen-Chung Yew, Tin-Fook Ngai |
| 2009 | MICRO | Control flow obfuscation with information flow tracking. | Haibo Chen, Liwei Yuan, Xi Wu, Binyu Zang, Bo Huang, Pen-Chung Yew |
| 2008 | ICCD | Efficiency of thread-level speculation in SMT and CMP architectures - performance, power and thermal perspective. | Venkatesan Packirisamy, Yangchun Luo, Wei-Lung Hung, Antonia Zhai, Pen-Chung Yew, Tin-Fook Ngai |
| 2008 | ISCA | From Speculation to Security: Practical and Efficient Information Flow Tracking Using Speculative Hardware. | Haibo Chen, Xi Wu, Liwei Yuan, Binyu Zang, Pen-Chung Yew, Frederic T. Chong |
| 2008 | PPoPP | Compiler optimizations for parallelizing general-purpose applications under thread-level speculation. | Antonia Zhai, Shengyue Wang, Pen-Chung Yew, Guojin He |
| 2007 | ICPP | Mercury: Combining Performance with Dependability Using Self-virtualization. | Haibo Chen, Rong Chen, Fengzhe Zhang, Binyu Zang, Pen-Chung Yew |
| 2007 | ICPP | COBRA: An Adaptive Runtime Binary Optimization Framework for Multithreaded Applications. | Jinpyo Kim, Wei-Chung Hsu, Pen-Chung Yew |
| 2007 | ICSE | POLUS: A POwerful Live Updating System. | Haibo Chen, Jie Yu, Rong Chen, Binyu Zang, Pen-Chung Yew |
| 2006 | HiPC | Supporting Speculative Multithreading on Simultaneous Multithreaded Processors. | Venkatesan Packirisamy, Shengyue Wang, Antonia Zhai, Wei-Chung Hsu, Pen-Chung Yew |
| 2006 | VEE | Live updating operating systems using virtualization. | Haibo Chen, Rong Chen, Fengzhe Zhang, Binyu Zang, Pen-Chung Yew |
| 2005 | CGO | A General Compiler Framework for Speculative Optimizations Using Data Speculative Code Motion. | Xiaoru Dai, Antonia Zhai, Wei-Chung Hsu, Pen-Chung Yew |
| 2005 | CGO | Performance of Runtime Optimization on BLAST. | Abhinav Das, Jiwei Lu, Howard Chen, Jinpyo Kim, Pen-Chung Yew, Wei-Chung Hsu, Dong-yuan Chen |
| 2005 | ISPA | Using Speculative Multithreading for General-Purpose Applications. | Pen-Chung Yew |
| 2004 | CC | Data Dependence Profiling for Speculative Optimizations. | Tong Chen, Jin Lin, Xiaoru Dai, Wei-Chung Hsu, Pen-Chung Yew |
| 2003 | CGO | Speculative Register Promotion Using Advanced Load Address Table (ALAT). | Jin Lin, Tong Chen, Wei-Chung Hsu, Pen-Chung Yew |
| 2003 | MICRO | The Performance of Runtime Data Cache Prefetching in a Dynamic Optimization System. | Jiwei Lu, Howard Chen, Rao Fu, Wei-Chung Hsu, Bobbie Othmer, Pen-Chung Yew, Dong-yuan Chen |
| 2003 | PLDI | A compiler framework for speculative analysis and optimizations. | Jin Lin, Tong Chen, Wei-Chung Hsu, Pen-Chung Yew, Roy Dz-Ching Ju, Tin-Fook Ngai, Sun Chan |
| 2000 | HPCA | Decoupled Value Prediction on Trace Processors. | Sang Jeong Lee, Yuan Wang, Pen-Chung Yew |
| 1999 | ISCA | Decoupling Local Variable Accesses in a Wide-Issue Superscalar Processor. | Sangyeun Cho, Pen-Chung Yew, Gyungho Lee |
| 1999 | MICRO | Access Region Locality for High-Bandwidth Processor Memory System Design. | Sangyeun Cho, Pen-Chung Yew, Gyungho Lee |
| 1998 | HPCA | Performance Study of a Concurrent Multithreaded Processor. | Jenn-Yuan Tsai, Zhenzhen Jiang, Eric Ness, Pen-Chung Yew |
| 1998 | ICPP | High-Level Information - An Approach for Integrating Front-End and Back-End Compilers. | Sangyeun Cho, Jenn-Yuan Tsai, Yonghong Song, Bixia Zheng, Stephen J. Schwinn, Xin Wang, Qing Zhao, Zhiyuan Li, David J. Lilja, Pen-Chung Yew |
| 1998 | ISCA | Retrospective: The Cedar System. | Alexander V. Veidenbaum, Pen-Chung Yew, David J. Kuck, Constantine D. Polychronopoulos, David A. Padua, Edward S. Davidson, Kyle A. Gallivan |
| 1996 | ICPP | Program Analysis for Cache Coherence: Beyond Procedural Boundaries. | Lynn Choi, Pen-Chung Yew |
| 1996 | ICPP | Let Us Build System-Friendly Networks - Build Them Hierarchically. | William Tsun-Yuk Hsu, Pen-Chung Yew |
| 1996 | ISCA | Compiler and Hardware Support for Cache Coherence in Large-Scale Multiprocessors: Design Considerations and Performance Study. | Lynn Choi, Pen-Chung Yew |
| 1995 | PADS | Partitioning for synchronous parallel simulation. | Pavlos Konas, Pen-Chung Yew |
| 1995 | WSC | Processor Self-Scheduling in Parallel Discrete Event Simulation. | Pavlos Konas, Pen-Chung Yew |
| 1994 | ICPP | Statement Re-ordering for DOACROSS Loops. | Ding-Kai Chen, Pen-Chung Yew |
| 1994 | ICPP | Data Prefetching and Data Forwarding in Shared Memory Multiprocessors. | David K. Poulsen, Pen-Chung Yew |
| 1994 | PADS | Improved parallel architectural simulations on shared-memory multiprocessors. | Pavlos Konas, Pen-Chung Yew |
| 1994 | SC | An efficient algorithm for the run-time parallelization of DOACROSS loops. | Ding-Kai Chen, Josep Torrellas, Pen-Chung Yew |
| 1994 | SC | A compiler-directed cache coherence scheme with improved intertask locality. | Lynn Choi, Pen-Chung Yew |
| 1993 | ISCA | The Cedar System and an Initial Performance Study. | David J. Kuck, Edward S. Davidson, Duncan H. Lawrie, Ahmed H. Sameh, Chuan-Qi Zhu, Alexander V. Veidenbaum, Jeff Konicek, Pen-Chung Yew, Kyle A. Gallivan, William Jalby, Harry A. G. Wijshoff, Randall Bramley, Ulrike Meier Yang, Perry A. Emrath, David A. Padua, Rudolf Eigenmann, Jay P. Hoeflinger, Greg P. Jaxon, Zhiyuan Li, T. Murphy, John T. Andrews, Stephen W. Turner |
| 1993 | SC | Execution-driven tools for parallel simulation of parallel architectures and applications. | David K. Poulsen, Pen-Chung Yew |
| 1992 | ICPP | A Scheme for Effective Execution of Irregular Doacross Loops. | Ding-Kai Chen, Pen-Chung Yew |
| 1991 | ICPP | The Performance of Hierarchical Systems with Wiring Constraints. | William Tsun-Yuk Hsu, Pen-Chung Yew |
| 1991 | ICPP | The Organization of the Cedar System. | Jeff Konicek, Tracy Tilton, Alexander V. Veidenbaum, Chuan-Qi Zhu, Edward S. Davidson, Ruppert A. Downing, Michael J. Haney, Manish Sharma, Pen-Chung Yew, P. Michael Farmwald, David J. Kuck, Daniel M. Lavery, Robert A. Lindsey, D. Pointer, John T. Andrews, Thomas Beck, T. Murphy, Stephen W. Turner, Nancy J. Warter |
| 1991 | ICPP | Efficient Interprocessor Communication on Distributed Shared-Memory Multiprocessors. | Hong-Men Su, Pen-Chung Yew |
| 1991 | ICS | Combining hardware and software cache coherence strategies. | David J. Lilja, Pen-Chung Yew |
| 1991 | ICS | Parallel program behavioral study on a shared-memory multiprocessor. | Hock-Beng Lim, Pen-Chung Yew |
| 1991 | SC | Efficient Doacross execution on distributed shared-memory multiprocessors. | Hong-Men Su, Pen-Chung Yew |
| 1990 | ICPP | Comparing Parallelism Extraction Techniques: Superscalar Processors, Pipelined Processors, and Multiprocessors. | David J. Lilja, Pen-Chung Yew |
| 1990 | ISCA | The Impact of Synchronization and Granularity on Parallel Systems. | Ding-Kai Chen, Hong-Men Su, Pen-Chung Yew |
| 1990 | ICS | Compiler techniques for data synchronization in nested parallel loops. | Peiyi Tang, Pen-Chung Yew, Chuan-Qi Zhu |
| 1989 | COMPSAC | A parallel linked list for shared-memory multiprocessors. | Peiyi Tang, Pen-Chung Yew, Chuan-Qi Zhu |
| 1989 | ICPP | An Empirical Study on Array Subscripts and Data Dependencies. | Zhiyu Shen, Zhiyuan Li, Pen-Chung Yew |
| 1989 | ISCA | On Data Synchronization for Multiprocessors. | Hong-Men Su, Pen-Chung Yew |
| 1989 | ICS | Data dependence analysis on multi-dimensional array references. | Zhiyuan Li, Pen-Chung Yew, Chuan-Qi Zhu |
| 1988 | ICPP | Interprocedural Analysis for Parallel Programs. | Zhiyuan Li, Pen-Chung Yew |
| 1988 | ICS | Impact of self-scheduling order on performance on multiprocessor systems. | Peiyi Tang, Pen-Chung Yew, Chuan-Qi Zhu |
| 1988 | PPoPP | Efficient Interprocedural Analysis for Program Parallelization and Restructuring. | Zhiyuan Li, Pen-Chung Yew |
| 1987 | ICPP | Dynamic Processor Self-Scheduling for General Parallel Nested Loops. | Zhixi Fang, Peiyi Tang, Pen-Chung Yew, Chuan-Qi Zhu |
| 1987 | ICPP | Deadlock Prevention in Processor Self-Scheduling for Parallel Nested Loops. | Zhixi Fang, Peiyi Tang, Pen-Chung Yew, Chuan-Qi Zhu |
| 1987 | ICPP | An Enhancement Scheme for Hypercube Interconnection Networks. | William Tsun-Yuk Hsu, Chuan-Qi Zhu, Pen-Chung Yew |
| 1987 | ICPP | : Data Prefetching In Shared Memory Multiprocessors. | Roland L. Lee, Pen-Chung Yew, Duncan H. Lawrie |
| 1987 | ISCA | Multiprocessor Cache Design Considerations. | Roland L. Lee, Pen-Chung Yew, Duncan H. Lawrie |
| 1986 | ICPP | Processor Self-Scheduling for Multiple-Nested Parallel Loops. | Peiyi Tang, Pen-Chung Yew |
| 1986 | ICPP | Distributing Hot-Spot Addressing in Large Scale Multiprocessor. | Pen-Chung Yew, Nian-Feng Tzeng, Duncan H. Lawrie |
| 1985 | ICPP | The Performance of a Fault-Tolerant Multistage Interconnection Network. | Nian-Feng Tzeng, Pen-Chung Yew, Chuan-Qi Zhu |
| 1985 | ISCA | Fault-Tolerant Scheme for Multistage Interconnection Networks. | Nian-Feng Tzeng, Pen-Chung Yew, Chuan-Qi Zhu |
| 1984 | ICDCS | A Synchronization Scheme and Its Applications for Large Multiprocessor Systems. | Chuan-Qi Zhu, Pen-Chung Yew |
| 1982 | ICDCS | Performance of packet switching in buffered single-stage shuffle-exchange networks. | Pin-Yee Chen, Pen-Chung Yew, Duncan H. Lawrie |
| 1982 | ICPP | A fault tolerant interconnection network using error correcting codes. | J. Edward Lilienkamp, Duncan H. Lawrie, Pen-Chung Yew |