SOTAVerified

document understanding

Document understanding involves document classification, layout analysis, information extraction, and DocQA.

Papers

Showing 151175 of 309 papers

TitleStatusHype
DocumentNet: Bridging the Data Gap in Document Pre-Training0
Document Image Rectification Bases on Self-Adaptive Multitask Fusion0
Document Layout Analysis with Aesthetic-Guided Image Augmentation0
Document Understanding for Healthcare Referrals0
DocVLM: Make Your VLM an Efficient Reader0
DocXChain: A Powerful Open-Source Toolchain for Document Parsing and Beyond0
DOGE: Towards Versatile Visual Document Grounding and Referring0
DONUT-hole: DONUT Sparsification by Harnessing Knowledge and Optimizing Learning Efficiency0
DrVideo: Document Retrieval Based Long Video Understanding0
DUBLIN -- Document Understanding By Language-Image Network0
Efficient End-to-End Visual Document Understanding with Rationale Distillation0
Efficient layout-aware pretraining for multimodal form understanding0
Enhancing Question Answering on Charts Through Effective Pre-training Tasks0
Enhancing Visual Document Understanding with Contrastive Learning in Large Visual-Language Models0
Enumeration of Extractive Oracle Summaries0
ERNIE-mmLayout: Multi-grained MultiModal Transformer for Document Understanding0
Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling0
Extract with Order for Coherent Multi-Document Summarization0
One-Shot Doc Snippet Detection: Powering Search in Document Beyond Text0
On Scaling Up a Multilingual Vision and Language Model0
OPAD: An Optimized Policy-based Active Learning Framework for Document Content Analysis0
PaddleOCR 3.0 Technical Report0
PDFVQA: A New Dataset for Real-World VQA on PDF Documents0
Point-RFT: Improving Multimodal Reasoning with Visually Grounded Reinforcement Finetuning0
Position Masking for Improved Layout-Aware Document Understanding0
Show:102550
← PrevPage 7 of 13Next →

No leaderboard results yet.