NaviDC-OCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
13 Aug 2026
Document parsing aims to transform unstructured documents into structured and machine-readable representations. Recent advances in Vision-Language Models (VLMs) have significantly advanced document parsing. However, existing approaches still face two major challenges.