| 2026 | DATE | SA-ANT: Efficient Low-Bit Group-Wise Quantization for Large Language Models via Sign-Asymmetric Adaptive Numeric Type. | Xinkuang Geng, Siting Liu, Hui Wang, Jie Han, Honglan Jiang |
| 2026 | DATE | HAP: Accelerating DNNs with Resolution-Preserved Quantization by Harnessing Adaptive-Precision. | Erjing Luo, Xinkuang Geng, Honglan Jiang, Leibo Liu, Jie Han |
| 2026 | ISCAS | Approximate Signed Multiplier Designs for Efficient CNN Inference. | Mengshuo Zhang, Wenhui Zhang, Xiaolu Hu, Xinkuang Geng, Honglan Jiang |
| 2025 | DATE | Lookup Table Refactoring: Towards Efficient Logarithmic Number System Addition for Large Language Models. | Xinkuang Geng, Siting Liu, Hui Wang, Jie Han, Honglan Jiang |
| 2025 | DATE | Segment-Wise Accumulation: Low-Error Logarithmic Domain Computing for Efficient Large Language Model Inference. | Xinkuang Geng, Yunjie Lu, Hui Wang, Honglan Jiang |
| 2025 | DATE | A Low-Power Mixed-Precision Integrated Multiply-Accumulate Architecture for Quantized Deep Neural Networks. | Xiaolu Hu, Xinkuang Geng, Zhigang Mao, Jie Han, Honglan Jiang |
| 2024 | DAC | QUQ: Quadruplet Uniform Quantization for Efficient Vision Transformer Inference. | Xinkuang Geng, Siting Liu, Leibo Liu, Jie Han, Honglan Jiang |
| 2024 | DATE | Compact Powers-of-Two: An Efficient Non-Uniform Quantization for Deep Neural Networks. | Xinkuang Geng, Siting Liu, Jianfei Jiang, Kai Jiang, Honglan Jiang |
| 2024 | DATE | A Configurable Approximate Multiplier for CNNs Using Partial Product Speculation. | Xiaolu Hu, Ao Liu, Xinkuang Geng, Zizhong Wei, Kai Jiang, Honglan Jiang |