Skip to content

Enhancing Multimodal Information Extraction from Visually Rich Documents with 2D Positional Embeddings.

Aresha Arshad, Momina Moetesum, Adnan Ul-Hasan, Faisal Shafait

Year2024
ProceedingsDICTA

Browse the full DICTA paper archive.