LLM-Inference-Bench: Inference Benchmarking of Large Language Models on AI Accelerators.
Krishna Teja Chitty-Venkata, Siddhisanket Raskar, Bharat Kale, Farah Ferdaus, Aditya Tanikanti, Ken Raffenetti, Valerie Taylor, Murali Emani, Venkatram Vishwanath
Browse the full SC paper archive.