| 2025 | ICS | SmartNIC-GPU-CPU Heterogeneous System for Large Machine Learning Model with Software-Hardware Codesign. | Anqi Guo, Yuchen Hao, Xiteng Yao, Shining Yang, Jianyu Huang, Tony Tong Geng, Martin C. Herbordt |
| 2024 | ICS | SmartFuse: Reconfigurable Smart Switches to Accelerate Fused Collectives in HPC Applications. | Pouya Haghi, Cheng Tan, Anqi Guo, Chunshu Wu, Dongfang Liu, Ang Li, Anthony Skjellum, Tong Geng, Martin C. Herbordt |
| 2023 | ICS | Software-Hardware Co-design of Heterogeneous SmartNIC System for Recommendation Models Inference and Training. | Anqi Guo, Yuchen Hao, Chunshu Wu, Pouya Haghi, Zhenyu Pan, Min Si, Dingwen Tao, Ang Li, Martin C. Herbordt, Tong Geng |
| 2023 | ICS | FLASH: FPGA-Accelerated Smart Switches with GCN Case Study. | Pouya Haghi, William Krska, Cheng Tan, Tong Geng, Po Hao Chen, Connor Greenwood, Anqi Guo, Thomas M. Hines, Chunshu Wu, Ang Li, Anthony Skjellum, Martin C. Herbordt |
| 2023 | SC | FASDA: An FPGA-Aided, Scalable and Distributed Accelerator for Range-Limited Molecular Dynamics. | Chunshu Wu, Tong Geng, Anqi Guo, Sahan Bandara, Pouya Haghi, Chuan Liu, Ang Li, Martin C. Herbordt |
| 2022 | FCCM | FCsN: A FPGA-Centric SmartNIC Framework for Neural Networks. | Anqi Guo, Tong Geng, Yongan Zhang, Pouya Haghi, Chunshu Wu, Cheng Tan, Yingyan Lin, Ang Li, Martin C. Herbordt |
| 2022 | FCCM | COPA Use Case: Distributed Secure Joint Computation. | Rushi Patel, Pouya Haghi, Shweta Jain, Andriy Kot, Venkata Krishnan, Mayank Varia, Martin C. Herbordt |
| 2022 | FPL | H-GCN: A Graph Convolutional Network Accelerator on Versal ACAP Architecture. | Chengming Zhang, Tong Geng, Anqi Guo, Jiannan Tian, Martin C. Herbordt, Ang Li, Dingwen Tao |
| 2022 | FPL | A Framework for Neural Network Inference on FPGA-Centric SmartNICs. | Anqi Guo, Tong Geng, Yongan Zhang, Pouya Haghi, Chunshu Wu, Cheng Tan, Yingyan Lin, Ang Li, Martin C. Herbordt |
| 2022 | FPL | Optimized Mappings for Symmetric Range-Limited Molecular Force Calculations on FPGAs. | Chunshu Wu, Sahan Bandara, Tong Geng, Anqi Guo, Pouya Haghi, Vipin Sachdeva, Woody Sherman, Martin C. Herbordt |
| 2021 | FCCM | Particle Mesh Ewald for Molecular Dynamics in OpenCL on an FPGA Cluster. | Lawrence C. Stewart, Carlo Pascoe, Emery Davis, Brian W. Sherman, Martin C. Herbordt, Vipin Sachdeva |
| 2021 | FCCM | Upgrade of FPGA Range-Limited Molecular Dynamics to Handle Hundreds of Processors. | Chunshu Wu, Tong Geng, Sahan Bandara, Chen Yang, Vipin Sachdeva, Woody Sherman, Martin C. Herbordt |
| 2021 | MICRO | I-GCN: A Graph Convolutional Network Accelerator with Runtime Locality Enhancement through Islandization. | Tong Geng, Chunshu Wu, Yongan Zhang, Cheng Tan, Chenhao Xie, Haoran You, Martin C. Herbordt, Yingyan Lin, Ang Li |
| 2020 | FCCM | FP-AMG: FPGA-Based Acceleration Framework for Algebraic Multigrid Solvers. | Pouya Haghi, Tong Geng, Anqi Guo, Tianqi Wang, Martin C. Herbordt |
| 2020 | FCCM | Accelerating MPI Collectives with FPGAs in the Network and Novel Communicator Support. | Qingqing Xiong, Chen Yang, Pouya Haghi, Anthony Skjellum, Martin C. Herbordt |
| 2020 | FPL | Secret Sharing MPC on FPGAs in the Datacenter. | Pierre-Francois Wolfe, Rushi Patel, Robert Munafo, Mayank Varia, Martin C. Herbordt |
| 2020 | ICS | CSB-RNN: a faster-than-realtime RNN acceleration framework with compressed structured blocks. | Runbin Shi, Peiyan Dong, Tong Geng, Yuhao Ding, Xiaolong Ma, Hayden Kwok-Hay So, Martin C. Herbordt, Ang Li, Yanzhi Wang |
| 2020 | MICRO | AWB-GCN: A Graph Convolutional Network Accelerator with Runtime Workload Rebalancing. | Tong Geng, Ang Li, Runbin Shi, Chunshu Wu, Tianqi Wang, Yanfei Li, Pouya Haghi, Antonino Tumeo, Shuai Che, Steven K. Reinhardt, Martin C. Herbordt |
| 2019 | FCCM | FP-AMR: A Reconfigurable Fabric Framework for Adaptive Mesh Refinement Applications. | Tianqi Wang, Tong Geng, Xi Jin, Martin C. Herbordt |
| 2019 | FCCM | GhostSZ: A Transparent FPGA-Accelerated Lossy Compression Framework. | Qingqing Xiong, Rushi Patel, Chen Yang, Tong Geng, Anthony Skjellum, Martin C. Herbordt |
| 2019 | ICS | O3BNN: an out-of-order architecture for high-performance binarized neural network inference with fine-grained pruning. | Tong Geng, Tianqi Wang, Chunshu Wu, Chen Yang, Wei Wu, Ang Li, Martin C. Herbordt |
| 2019 | SC | BSTC: a novel binarized-soft-tensor-core design for accelerating bit-based approximated neural nets. | Ang Li, Tong Geng, Tianqi Wang, Martin C. Herbordt, Shuaiwen Leon Song, Kevin J. Barker |
| 2019 | SC | Fully integrated FPGA molecular dynamics simulations. | Chen Yang, Tong Geng, Tianqi Wang, Rushi Patel, Qingqing Xiong, Ahmed Sanaullah, Chunshu Wu, Jiayi Sheng, Charles Lin, Vipin Sachdeva, Woody Sherman, Martin C. Herbordt |
| 2018 | FCCM | FPDeep: Acceleration and Load Balancing of CNN Training on FPGA Clusters. | Tong Geng, Tianqi Wang, Ahmed Sanaullah, Chen Yang, Rui Xu, Rushi Patel, Martin C. Herbordt |
| 2018 | FCCM | High Performance Dynamic Communication on Reconfigurable Clusters. | Jiayi Sheng, Chen Yang, Tianqi Wang, Martin C. Herbordt |
| 2018 | FPL | A Framework for Acceleration of CNN Training on Deeply-Pipelined FPGA Clusters with Work and Weight Load Balancing. | Tong Geng, Tianqi Wang, Ahmed Sanaullah, Chen Yang, Rushi Patel, Martin C. Herbordt |
| 2018 | FPL | High Performance Communication on Reconfigurable Clusters. | Jiayi Sheng, Chen Yang, Martin C. Herbordt |
| 2018 | FPL | Accelerating MPI Message Matching through FPGA Offload. | Qingqing Xiong, Anthony Skjellum, Martin C. Herbordt |
| 2017 | FCCM | Bonded Force Computations on FPGAs. | Qingqing Xiong, Martin C. Herbordt |
| 2017 | FPL | HPC on FPGA clouds: 3D FFTs and implications for molecular dynamics. | Jiayi Sheng, Chen Yang, Ahmed Sanaullah, Michael Papamichael, Adrian M. Caulfield, Martin C. Herbordt |
| 2016 | FCCM | FPGA-Accelerated Particle-Grid Mapping. | Ahmed Sanaullah, Arash Khoshparvar, Martin C. Herbordt |
| 2016 | FCCM | Application-Aware Collective Communication (Extended Abstract). | Jiayi Sheng, Qingqing Xiong, Chen Yang, Martin C. Herbordt |
| 2014 | FCCM | 3D FFTs on a Single FPGA. | Benjamin Humphries, Hansen Zhang, Jiayi Sheng, Raphael Landaverde, Martin C. Herbordt |
| 2013 | ACSSC | Architecture/algorithm codesign of molecular dynamics processors. | Martin C. Herbordt |
| 2012 | FCCM | FMSA: FPGA-Accelerated ClustalW-Based Multiple Sequence Alignment through Pipelined Prefiltering. | Atabak Mahram, Martin C. Herbordt |
| 2012 | FPL | CAAD BLASTP 2.0: NCBI BLASTP accelerated with pipelined filters. | Atabak Mahram, Martin C. Herbordt |
| 2011 | FCCM | Efficient Calculation of Pairwise Nonbonded Forces. | Matt Chiu, Md. Ashfaquzzaman Khan, Martin C. Herbordt |
| 2010 | ISCAS | CAAD BLASTn: Accelerated NCBI BLASTn with FPGA prefiltering. | Jin H. Park, Yunfei Qiu, Martin C. Herbordt |
| 2010 | ICS | Fast and accurate NCBI BLASTP: acceleration with multiphase FPGA-based prefiltering. | Atabak Mahram, Martin C. Herbordt |
| 2010 | SC | Towards production FPGA-accelerated molecular dynamics: Progress and challenges. | Matt Chiu, Martin C. Herbordt |
| 2009 | ASPLOS | GPU acceleration of a production molecular docking code. | Bharat Sukhwani, Martin C. Herbordt |
| 2009 | FCCM | CAAD BLASTP: NCBI BLASTP Accelerated with FPGA-Based Accelerated Pre-Filtering. | Jin H. Park, Yunfei Qiu, Martin C. Herbordt |
| 2009 | FPL | Efficient particle-pair filtering for acceleration of molecular dynamics simulation. | Matt Chiu, Martin C. Herbordt |
| 2009 | SC | FPGA-based acceleration of CHARMM-potential minimization. | Bharat Sukhwani, Martin C. Herbordt |
| 2008 | FCCM | An Efficient O(1) Priority Queue for Large FPGA-Based Discrete Event Simulations of Molecular Dynamics. | Martin C. Herbordt, Francois Kosie, Josh Model |
| 2008 | FPL | Acceleration of a production rigid molecule docking code. | Bharat Sukhwani, Martin C. Herbordt |
| 2008 | SC | Performance potential of molecular dynamics simulations on high performance reconfigurable computing systems. | Matt Chiu, Martin C. Herbordt, Martin Langhammer |
| 2007 | FCCM | FPGA-Based Multigrid Computation for Molecular Dynamics Simulations. | Yongfeng Gu, Martin C. Herbordt |
| 2007 | FPL | Discrete Event Simulation of Molecular Dynamics with Configurable Logic. | Josh Model, Martin C. Herbordt |
| 2006 | FCCM | Application-Specific Memory Interleaving Enables High Performance in FPGA-based Grid Computations. | Tom Van Court, Martin C. Herbordt |
| 2006 | FCCM | Integrating FPGA Acceleration into the Protomol Molecular Dynamics Code: Preliminary Report. | Yongfeng Gu, Tom Van Court, Martin C. Herbordt |
| 2006 | FCCM | Single Pass, BLAST-Like, Approximate String Matching on FPGAs. | Martin C. Herbordt, Josh Model, Yongfeng Gu, Bharat Sukhwani, Tom Van Court |
| 2006 | FPL | Application-Specific Memory Interleaving for FPGA-Based Grid Computations: A General Design Technique. | Tom Van Court, Martin C. Herbordt |
| 2006 | FPL | Sizing of Processing Arrays for FPGA-Based Computation. | Tom Van Court, Martin C. Herbordt |
| 2006 | FPL | Improved Interpolation and System Integration for FPGA-Based Molecular Dynamics Simulations. | Yongfeng Gu, Tom Van Court, Martin C. Herbordt |
| 2005 | FCCM | Preliminary Report: FPGA Acceleration of Molecular Dynamics Computations. | Yongfeng Gu, Tom Van Court, Douglas DiSabello, Martin C. Herbordt |
| 2005 | FPL | LAMP: A Tool Suite for Families of FPGA-Based Application Accelerators. | Tom Van Court, Martin C. Herbordt |
| 2005 | FPL | Accelerating Molecular Dynamics Simulations With Configurable Circuits. | Yongfeng Gu, Tom Van Court, Martin C. Herbordt |
| 2004 | FCCM | FPGA Acceleration of Rigid Molecule Interactions. | Tom Van Court, Yongfeng Gu, Martin C. Herbordt |
| 2004 | FPL | Processing Repetitive Sequence Structures with Mismatches at Streaming Rate. | Albert A. Conti, Tom Van Court, Martin C. Herbordt |
| 2004 | FPL | FPGA Acceleration of Rigid Molecule Interactions. | Tom Van Court, Yongfeng Gu, Martin C. Herbordt |
| 2003 | FPL | Case Study of a Functional Genomics Application. | Tom Van Court, Martin C. Herbordt, Richard J. Barton |
| 1997 | SIGMETRICS | Preprototyping SIMD Coprocessors Using Virtual Machine Emulation and Trace Compilation. | Martin C. Herbordt, Owais Kidwai, Charles C. Weems |
| 1995 | ICCD | An empirical study of datapath, memory hierarchy, and network in SIMD array architectures. | Martin C. Herbordt, Charles C. Weems |
| 1995 | ICPP | Experimental Analysis of Some SIMD Array Memory Hierarchies. | Martin C. Herbordt, Charles C. Weems |
| 1991 | CVPR | A computational framework and SIMD algorithms for low-level support of intermediate level vision processing. | Martin C. Herbordt, Charles C. Weems, Michael J. Scudder |
| 1991 | ICPP | Multi-associativity: A Framework for Solving Multiple Non-uniform Problem Instances Simultaneously on SIMD Arrays. | Martin C. Herbordt, Charles C. Weems |
| 1990 | ICPR | Routing on the CAAPP. | Martin C. Herbordt, Charles C. Weems, David B. Shu |
| 1990 | SPAA | Message-Passing Algorithms for a SIMD Torus with Coteries. | Martin C. Herbordt, Charles C. Weems, James C. Corbett |