SOTAVerified

Named Entity Recognition (NER)

Named Entity Recognition (NER) is a task of Natural Language Processing (NLP) that involves identifying and classifying named entities in a text into predefined categories such as person names, organizations, locations, and others. The goal of NER is to extract structured information from unstructured text data and represent it in a machine-readable format. Approaches typically use BIO notation, which differentiates the beginning (B) and the inside (I) of entities. O is used for non-entity tokens.

Example:

| Mark | Watney | visited | Mars | | --- | ---| --- | --- | | B-PER | I-PER | O | B-LOC |

( Image credit: Zalando )

Papers

Showing 101–150 of 2874 papers

TitleStatusHype
TOE: A Grid-Tagging Discontinuous NER Model Enhanced by Embedding Tag/Word Relations and More Fine-Grained TagsCode1
Autoregressive Structured Prediction with Language ModelsCode1
Unsupervised Text DeidentificationCode1
Multi-Granularity Cross-Modality Representation Learning for Named Entity Recognition on Social MediaCode1
End-to-End Entity Detection with Proposer and RegressorCode1
KPI-EDGAR: A Novel Dataset and Accompanying Metric for Relation Extraction from Financial DocumentsCode1
Style Transfer as Data Augmentation: A Case Study on Named Entity RecognitionCode1
HUE: Pretrained Model and Dataset for Understanding Hanja Documents of Ancient KoreaCode1
SEE-Few: Seed, Expand and Entail for Few-shot Named Entity RecognitionCode1
Deep Span Representations for Named Entity RecognitionCode1
Distilling Causal Effect from Miscellaneous Other-Class for Continual Named Entity RecognitionCode1
Distillation-Resistant Watermarking for Model Protection in NLPCode1
COPNER: Contrastive Learning with Prompt Guiding for Few-shot Named Entity RecognitionCode1
METS-CoV: A Dataset of Medical Entity and Targeted Sentiment on COVID-19 Related TweetsCode1
A general-purpose material property data extraction pipeline from large polymer corpora using Natural Language ProcessingCode1
Application of Deep Learning in Generating Structured Radiology Reports: A Transformer-Based TechniqueCode1
On the Effectiveness of Compact Biomedical TransformersCode1
SCL-RAI: Span-based Contrastive Learning with Retrieval Augmented Inference for Unlabeled Entity Problem in NERCode1
KoCHET: a Korean Cultural Heritage corpus for Entity-related TasksCode1
Optimizing Bi-Encoder for Named Entity Recognition via Contrastive LearningCode1
Domain-Specific NER via Retrieving Correlated SamplesCode1
FactMix: Using a Few Labeled In-domain Examples to Generalize to Cross-domain Named Entity RecognitionCode1
An Embarrassingly Easy but Strong Baseline for Nested Named Entity RecognitionCode1
Good Visual Guidance Make A Better Extractor: Hierarchical Visual Prefix for Multimodal Entity and Relation ExtractionCode1
End-to-End Chinese Speaker IdentificationCode1
Multi-features based Semantic Augmentation Networks for Named Entity Recognition in Threat IntelligenceCode1
A Label-Aware Autoregressive Framework for Cross-Domain NERCode1
MultiNERD: A Multilingual, Multi-Genre and Fine-Grained Dataset for Named Entity Recognition (and Disambiguation)Code1
NERDA-Con: Extending NER models for Continual Learning -- Integrating Distinct Tasks and Updating Distribution ShiftsCode1
Endowing Language Models with Multimodal Knowledge Graph RepresentationsCode1
TOKEN is a MASK: Few-shot Named Entity Recognition with Pre-trained Language ModelsCode1
SsciBERT: A Pre-trained Language Model for Social Science TextsCode1
Enhanced Entity Annotations for Multilingual CorporaCode1
A Twitter Corpus for Named Entity Recognition in TurkishCode1
hmBERT: Historical Multilingual Language Models for Named Entity RecognitionCode1
FinBERT-MRC: financial named entity recognition using BERT under the machine reading comprehension paradigmCode1
RuNNE-2022 Shared Task: Recognizing Nested Named EntitiesCode1
Pre-training Data Quality and Quantity for a Low-Resource Language: New Corpus and BERT Models for MalteseCode1
DeepStruct: Pretraining of Language Models for Structure PredictionCode1
Wojood: Nested Arabic Named Entity Corpus and Recognition using BERTCode1
Hero-Gang Neural Model For Named Entity RecognitionCode1
ViT5: Pretrained Text-to-Text Transformer for Vietnamese Language GenerationCode1
NFLAT: Non-Flat-Lattice Transformer for Chinese Named Entity RecognitionCode1
Ontology-Driven and Weakly Supervised Rare Disease Identification from Clinical NotesCode1
Good Visual Guidance Makes A Better Extractor: Hierarchical Visual Prefix for Multimodal Entity and Relation ExtractionCode1
Wav2Seq: Pre-training Speech-to-Text Encoder-Decoder Models Using Pseudo LanguagesCode1
GNNer: Reducing Overlapping in Span-based NER Using Graph Neural NetworksCode1
Thai Nested Named Entity Recognition CorpusCode1
Polyglot Prompt: Multilingual Multitask PrompTrainingCode1
HiNER: A Large Hindi Named Entity Recognition DatasetCode1
Show:102550
← PrevPage 3 of 58Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1ACE + document-contextF194.6—Unverified
2LUKE 483MF194.3—Unverified
3Co-regularized LUKEF194.22—Unverified
4LUKE + SubRegWeigh (K-means)F194.2—Unverified
5ASP+T5-3BF194.1—Unverified
6FLERT XLM-RF194.09—Unverified
7PL-MarkerF194—Unverified
8CL-KLF193.85—Unverified
9XLNet-GCNF193.82—Unverified
10RoBERTa + SubRegWeigh (K-means)F193.81—Unverified
#ModelMetricClaimedVerifiedStatus
1BERT-MRC+DSCF192.07—Unverified
2PL-MarkerF191.9—Unverified
3Baseline + BSF191.74—Unverified
4Biaffine-NERF191.3—Unverified
5BERT-MRCF191.11—Unverified
6PIQNF190.96—Unverified
7HGNF190.92—Unverified
8Syn-LSTM + BERT (wo doc-context)F190.85—Unverified
9DiffusionNERF190.66—Unverified
10W2NERF190.5—Unverified
#ModelMetricClaimedVerifiedStatus
1BioBERTF189.71—Unverified
2SpanModel + SequenceLabelingModelF189.6—Unverified
3SciFive-BaseF189.39—Unverified
4Spark NLPF189.13—Unverified
5BLSTM-CNN-Char (SparkNLP)F189.13—Unverified
6KeBioLMF189.1—Unverified
7CL-KLF188.96—Unverified
8BioKMNER + BioBERTF188.77—Unverified
9BioLinkBERT (large)F188.76—Unverified
10CompactBioBERTF188.67—Unverified
#ModelMetricClaimedVerifiedStatus
1CL-KLF160.45—Unverified
2RoBERTa + SubRegWeigh (K-means)F160.29—Unverified
3BERT-CRF (Replicated in AdaSeq)F159.69—Unverified
4RoBERTa-BiLSTM-contextF159.61—Unverified
5BERT + RegLERF158.9—Unverified
6TNER -xlm-r-largeF158.5—Unverified
7HGNF157.41—Unverified
8ASA + RoBERTaF157.3—Unverified
9BERTweetF156.5—Unverified
10MINERF154.86—Unverified
#ModelMetricClaimedVerifiedStatus
1Ours: cross-sentence ALBF190.9—Unverified
2GoLLIEF189.6—Unverified
3PromptNER [RoBERTa-large]F188.26—Unverified
4PIQNF187.42—Unverified
5PromptNER [BERT-large]F187.21—Unverified
6DiffusionNERF186.93—Unverified
7BERT-MRCF186.88—Unverified
8UniNER-7BF186.69—Unverified
9Locate and LabelF186.67—Unverified
10BoningKnifeF185.46—Unverified
#ModelMetricClaimedVerifiedStatus
1KeBioLMF182—Unverified
2Spark NLPF181.29—Unverified
3BLSTM-CNN-Char (SparkNLP)F181.29—Unverified
4BINDERF180.3—Unverified
5BioMobileBERTF180.13—Unverified
6BioLinkBERT (large)F180.06—Unverified
7DistilBioBERTF179.97—Unverified
8CompactBioBERTF179.88—Unverified
9BioDistilBERTF179.1—Unverified
10PubMedBERT uncasedF179.1—Unverified
#ModelMetricClaimedVerifiedStatus
1BINDERF191.9—Unverified
2ConNERF191.3—Unverified
3CL-L2F190.99—Unverified
4aimpedF190.95—Unverified
5BertForTokenClassification (Spark NLP)F190.89—Unverified
6BioLinkBERT (large)F190.22—Unverified
7ELECTRAMedF190.03—Unverified
8BLSTM-CNN-Char (SparkNLP)F189.73—Unverified
9Spark NLPF189.73—Unverified
10UniNER-7BF189.34—Unverified