SOTAVerified

Text Spotting

Scene Text Spotting is the combination of Scene Text Detection and Scene Text Recognition in an end-to-end manner. It is the ability to read natural text in the wild.

Papers

Showing 51–75 of 112 papers

TitleStatusHype
OmniParser: A Unified Framework for Text Spotting, Key Information Extraction and Table Recognition—0
TextBlockV2: Towards Precise-Detection-Free Scene Text Spotting with Pre-trained Language Model—0
Efficiently Leveraging Linguistic Priors for Scene Text Spotting—0
Beyond the Mud: Datasets and Benchmarks for Computer Vision in Off-Road Racing—0
Watermark Text Pattern Spotting in Document Images—0
Inverse-like Antagonistic Scene Text Spotting via Reading-Order Estimation and Dynamic Sampling—0
GloTSFormer: Global Video Text Spotting TransformerCode0
OmniParser: A Unified Framework for Text Spotting Key Information Extraction and Table Recognition—0
Word length-aware text spotting: Enhancing detection and recognition in dense text image—0
Harnessing the Power of Multi-Lingual Datasets for Pre-training: Towards Enhancing Text Spotting PerformanceCode0
Diving into the Depths of Spotting Text in Multi-Domain Noisy Scenes—0
STEP -- Towards Structured Scene-Text SpottingCode0
Attention Where It Matters: Rethinking Visual Document Understanding with Selective Region Concentration—0
Deformation Robust Text Spotting with Geometric Prior—0
TextFormer: A Query-based End-to-End Text Spotter with Mixed Supervision—0
ICDAR 2023 Video Text Reading Competition for Dense and Small Text—0
VGTS: Visually Guided Text Spotting for Novel Categories in Historical Manuscripts—0
Video text tracking for dense and small text based on pp-yoloe-r and sort algorithm—0
Modeling Entities as Semantic Points for Visual Information Extraction in the Wild—0
A3S: Adversarial learning of semantic representations for Scene-Text Spotting—0
Real-time End-to-End Video Text Spotter with Contrastive Representation LearningCode0
Single Shot Self-Reliant Scene Text Spotter by Decoupled yet Collaborative Detection and RecognitionCode0
Dynamic Low-Resolution Distillation for Cost-Efficient End-to-End Text Spotting—0
E^2VTS: Energy-Efficient Video Text Spotting from Unmanned Aerial VehiclesCode0
Text Detection & Recognition in the Wild for Robot Localization—0
Show:102550
← PrevPage 3 of 5Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1UNITSF-measure (%) - Strong Lexicon89—Unverified
2DeepSolo (ViTAEv2-S, TextOCR)F-measure (%) - Strong Lexicon88.1—Unverified
3DeepSolo(ResNet-50, TextOCR)F-measure (%) - Strong Lexicon88—Unverified
4DeepSolo(ResNet-50)F-measure (%) - Strong Lexicon86.8—Unverified
5SRTSF-measure (%) - Strong Lexicon85.6—Unverified
6TESTRF-measure (%) - Strong Lexicon85.2—Unverified
7A3SF-measure (%) - Strong Lexicon84.8—Unverified
8GLASSF-measure (%) - Strong Lexicon84.7—Unverified
9SwinTextSpotterF-measure (%) - Strong Lexicon83.9—Unverified
10FOTSF-measure (%) - Strong Lexicon83.6—Unverified
#ModelMetricClaimedVerifiedStatus
1DeepSolo (ViTAEv2-S, TextOCR)F-measure (%) - No Lexicon83.6—Unverified
2DeepSolo (ResNet-50, TextOCR)F-measure (%) - No Lexicon82.5—Unverified
3DeepSolo (ResNet-50)F-measure (%) - No Lexicon79.7—Unverified
4A3SF-measure (%) - No Lexicon79.4—Unverified
5UNITSF-measure (%) - No Lexicon78.7—Unverified
6GLASSF-measure (%) - No Lexicon76.6—Unverified
7DEERF-measure (%) - No Lexicon74.8—Unverified
8SwinTextSpotterF-measure (%) - No Lexicon74.3—Unverified
9TESTRF-measure (%) - No Lexicon73.3—Unverified
10MANGOF-measure (%) - No Lexicon72.9—Unverified
#ModelMetricClaimedVerifiedStatus
1A3SF-measure (%) - No Lexicon64.4—Unverified
2DeepSolo (ResNet-50)F-measure (%) - No Lexicon64.2—Unverified
3SPTSF-measure (%) - No Lexicon63.6—Unverified
4ABINet++F-measure (%) - No Lexicon60.2—Unverified
5TPSNetF-measure (%) - No Lexicon59.7—Unverified
6MANGOF-measure (%) - No Lexicon58.9—Unverified
7ABCNet v2F-measure (%) - No Lexicon57.5—Unverified
8TextPerceptronF-measure (%) - No Lexicon57—Unverified
9TESTRF-measure (%) - No Lexicon56—Unverified
10SwinTextSpotterF-measure (%) - No Lexicon51.8—Unverified
#ModelMetricClaimedVerifiedStatus
1DeepSolo (ViTAEv2-S, TextOCR)F-measure (%) - No Lexicon68.8—Unverified
2DeepSolo (ResNet-50, TextOCR)F-measure (%) - No Lexicon64.6—Unverified
3SwinTextSpotterF-measure (%) - No Lexicon55.4—Unverified
4DeepSolo (ResNet-50)F-measure (%) - No Lexicon48.5—Unverified
5MaskTextSpotter v2F-measure (%) - No Lexicon39—Unverified
6SPTSF-measure (%) - No Lexicon38.3—Unverified
7ABCNet v2F-measure (%) - No Lexicon34.5—Unverified
8TESTRF-measure (%) - No Lexicon34.2—Unverified
9ABCNetF-measure (%) - No Lexicon22.2—Unverified