SOTAVerified

Text Spotting

Scene Text Spotting is the combination of Scene Text Detection and Scene Text Recognition in an end-to-end manner. It is the ability to read natural text in the wild.

Papers

Showing 51–100 of 112 papers

TitleStatusHype
Context-Free TextSpotter for Real-Time and Mobile End-to-End Text Detection and Recognition—0
Deep Neural Network for Semantic-based Text Recognition in Images—0
DEER: Detection-agnostic End-to-End Recognizer for Scene Text Spotting—0
Deformation Robust Text Spotting with Geometric Prior—0
Diving into the Depths of Spotting Text in Multi-Domain Noisy Scenes—0
Mixed Text Recognition with Efficient Parameter Fine-Tuning and Transformer—0
Dynamic Low-Resolution Distillation for Cost-Efficient End-to-End Text Spotting—0
Efficiently Leveraging Linguistic Priors for Scene Text Spotting—0
You Only Recognize Once: Towards Fast Video Text Spotting—0
Enhanced Characterness for Text Detection in the Wild—0
Ensemble Learning for Vietnamese Scene Text Spotting in Urban Environments—0
Hear the Scene: Audio-Enhanced Text Spotting—0
HIP: Hierarchical Point Modeling and Pre-training for Visual Information Extraction—0
ICDAR 2021 Competition on Scene Video Text Spotting—0
ICDAR 2023 Video Text Reading Competition for Dense and Small Text—0
Inductive Visual Localisation: Factorised Training for Superior Generalisation—0
Inverse-like Antagonistic Scene Text Spotting via Reading-Order Estimation and Dynamic Sampling—0
LOGO: Video Text Spotting with Language Collaboration and Glyph Perception Model—0
MANGO: A Mask Attention Guided One-Stage Scene Text Spotter—0
Modeling Entities as Semantic Points for Visual Information Extraction in the Wild—0
OmniParser: A Unified Framework for Text Spotting, Key Information Extraction and Table Recognition—0
OmniParser: A Unified Framework for Text Spotting Key Information Extraction and Table Recognition—0
OmniParser V2: Structured-Points-of-Thought for Unified Visual Text Parsing and Its Generality to Multimodal Large Language Models—0
Reading Text in the Wild with Convolutional Neural Networks—0
A method for detecting text of arbitrary shapes in natural scenes that improves text spotting—0
Scene Text Detection for Augmented Reality -- Character Bigram Approach to reduce False Positive Rate—0
Text-Aware Image Restoration with Diffusion Models—0
TextBlockV2: Towards Precise-Detection-Free Scene Text Spotting with Pre-trained Language Model—0
Text Detection & Recognition in the Wild for Robot Localization—0
TextDragon: An End-to-End Framework for Arbitrary Shaped Text Spotting—0
TextFormer: A Query-based End-to-End Text Spotter with Mixed Supervision—0
Text Perceptron: Towards End-to-End Arbitrary-Shaped Text Spotting—0
Textual Visual Semantic Dataset for Text Spotting—0
Towards End-to-End Text Spotting in Natural Scenes—0
Towards End-to-end Text Spotting with Convolutional Recurrent Neural Networks—0
Towards Unconstrained End-to-End Text Spotting—0
Towards Weakly-Supervised Text Spotting using a Multi-Task Transformer—0
Using Object Information for Spotting Text—0
Video text tracking for dense and small text based on pp-yoloe-r and sort algorithm—0
Watermark Text Pattern Spotting in Document Images—0
1st Place Solution to ICDAR 2021 RRC-ICTEXT End-to-end Text Spotting and Aesthetic Assessment on Integrated Circuit—0
E^2VTS: Energy-Efficient Video Text Spotting from Unmanned Aerial VehiclesCode0
GloTSFormer: Global Video Text Spotting TransformerCode0
FOTS: Fast Oriented Text Spotting with a Unified NetworkCode0
PGNet: Real-time Arbitrarily-Shaped Text Spotting with Point Gathering NetworkCode0
Visual Re-ranking with Natural Language Understanding for Text SpottingCode0
Real-time End-to-End Video Text Spotter with Contrastive Representation LearningCode0
FastTextSpotter: A High-Efficiency Transformer for Multilingual Scene Text SpottingCode0
Open Images V5 Text Annotation and Yet Another Mask Text SpotterCode0
Single Shot Self-Reliant Scene Text Spotter by Decoupled yet Collaborative Detection and RecognitionCode0
Show:102550
← PrevPage 2 of 3Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1UNITSF-measure (%) - Strong Lexicon89—Unverified
2DeepSolo (ViTAEv2-S, TextOCR)F-measure (%) - Strong Lexicon88.1—Unverified
3DeepSolo(ResNet-50, TextOCR)F-measure (%) - Strong Lexicon88—Unverified
4DeepSolo(ResNet-50)F-measure (%) - Strong Lexicon86.8—Unverified
5SRTSF-measure (%) - Strong Lexicon85.6—Unverified
6TESTRF-measure (%) - Strong Lexicon85.2—Unverified
7A3SF-measure (%) - Strong Lexicon84.8—Unverified
8GLASSF-measure (%) - Strong Lexicon84.7—Unverified
9SwinTextSpotterF-measure (%) - Strong Lexicon83.9—Unverified
10FOTSF-measure (%) - Strong Lexicon83.6—Unverified
#ModelMetricClaimedVerifiedStatus
1DeepSolo (ViTAEv2-S, TextOCR)F-measure (%) - No Lexicon83.6—Unverified
2DeepSolo (ResNet-50, TextOCR)F-measure (%) - No Lexicon82.5—Unverified
3DeepSolo (ResNet-50)F-measure (%) - No Lexicon79.7—Unverified
4A3SF-measure (%) - No Lexicon79.4—Unverified
5UNITSF-measure (%) - No Lexicon78.7—Unverified
6GLASSF-measure (%) - No Lexicon76.6—Unverified
7DEERF-measure (%) - No Lexicon74.8—Unverified
8SwinTextSpotterF-measure (%) - No Lexicon74.3—Unverified
9TESTRF-measure (%) - No Lexicon73.3—Unverified
10MANGOF-measure (%) - No Lexicon72.9—Unverified
#ModelMetricClaimedVerifiedStatus
1A3SF-measure (%) - No Lexicon64.4—Unverified
2DeepSolo (ResNet-50)F-measure (%) - No Lexicon64.2—Unverified
3SPTSF-measure (%) - No Lexicon63.6—Unverified
4ABINet++F-measure (%) - No Lexicon60.2—Unverified
5TPSNetF-measure (%) - No Lexicon59.7—Unverified
6MANGOF-measure (%) - No Lexicon58.9—Unverified
7ABCNet v2F-measure (%) - No Lexicon57.5—Unverified
8TextPerceptronF-measure (%) - No Lexicon57—Unverified
9TESTRF-measure (%) - No Lexicon56—Unverified
10SwinTextSpotterF-measure (%) - No Lexicon51.8—Unverified
#ModelMetricClaimedVerifiedStatus
1DeepSolo (ViTAEv2-S, TextOCR)F-measure (%) - No Lexicon68.8—Unverified
2DeepSolo (ResNet-50, TextOCR)F-measure (%) - No Lexicon64.6—Unverified
3SwinTextSpotterF-measure (%) - No Lexicon55.4—Unverified
4DeepSolo (ResNet-50)F-measure (%) - No Lexicon48.5—Unverified
5MaskTextSpotter v2F-measure (%) - No Lexicon39—Unverified
6SPTSF-measure (%) - No Lexicon38.3—Unverified
7ABCNet v2F-measure (%) - No Lexicon34.5—Unverified
8TESTRF-measure (%) - No Lexicon34.2—Unverified
9ABCNetF-measure (%) - No Lexicon22.2—Unverified