Skip to content

Vector-Vector-Matrix Architecture: A Novel Hardware-Aware Framework for Low-Latency Inference in NLP Applications.

Matthew Khoury, Rumen Dangovski, Longwu Ou, Preslav Nakov, Yichen Shen, Li Jing

VenueA*EMNLP
Year2020
ProceedingsEMNLP (1)

Browse the full EMNLP paper archive.