SOTAVerified

Coreference Resolution

Papers

Showing 51–100 of 880 papers

TitleStatusHype
Collecting a Large-Scale Gender Bias Dataset for Coreference Resolution and Machine TranslationCode1
ELIT: Emory Language and Information ToolkitCode1
Towards Consistent Document-level Entity Linking: Joint Models for Entity Linking and Coreference ResolutionCode1
End-to-End AMR Coreference ResolutionCode1
Injecting Knowledge Base Information into End-to-End Joint Entity and Relation Extraction and Coreference ResolutionCode1
Realistic Evaluation Principles for Cross-document Coreference ResolutionCode1
Cross-document Coreference Resolution over Predicted MentionsCode1
RESIN: A Dockerized Schema-Guided Cross-document Cross-lingual Cross-media Information Extraction and Event Tracking SystemCode1
Incorporating Syntax and Semantics in Coreference Resolution with Heterogeneous Graph Attention NetworkCode1
CREAD: Combined Resolution of Ellipses and Anaphora in DialoguesCode1
SciCo: Hierarchical Cross-Document Coreference for Scientific ConceptsCode1
Moving on from OntoNotes: Coreference Resolution Model TransferCode1
WEC: Deriving a Large-scale Cross-document Event Coreference dataset from WikipediaCode1
A Context-Dependent Gated Module for Incorporating Symbolic Semantics into Event Coreference ResolutionCode1
An End-to-end Model for Entity-level Relation Extraction using Multi-instance LearningCode1
Structured Prediction as Translation between Augmented Natural LanguagesCode1
Coreference Resolution without Span RepresentationsCode1
CDLM: Cross-Document Language ModelingCode1
BERT-based Cohesion Analysis of Japanese TextsCode1
Generalizing Cross-Document Event Coreference Resolution Across Multiple CorporaCode1
Neural Coreference Resolution for ArabicCode1
A Linguistic Analysis of Visually Grounded Dialogues Based on Spatial ExpressionsCode1
Universal Natural Language Processing with Limited Annotations: Try Few-shot Textual Entailment as a StartCode1
CoRefi: A Crowd Sourcing Suite for Coreference AnnotationCode1
Learning to Ignore: Long Document Coreference with Bounded Memory Neural NetworksCode1
DWIE: an entity-centric dataset for multi-task document-level information extractionCode1
Revealing the Myth of Higher-Order Inference in Coreference ResolutionCode1
Streamlining Cross-Document Coreference Resolution: Evaluation and ModelingCode1
End-to-End Neural Event Coreference ResolutionCode1
CorefQA: Coreference Resolution as Query-based Span PredictionCode1
AMALGUM -- A Free, Balanced, Multilayer English Web CorpusCode1
Understanding Points of Correspondence between Sentences for Abstractive SummarizationCode1
A Cross-Task Analysis of Text Span RepresentationsCode1
Nurse is Closer to Woman than Surgeon? Mitigating Gender-Biased Proximities in Word EmbeddingsCode1
Active Learning for Coreference Resolution using Discrete AnnotationCode1
Generative Data Augmentation for Commonsense ReasoningCode1
Stanza: A Python Natural Language Processing Toolkit for Many Human LanguagesCode1
An Annotated Dataset of Coreference in English LiteratureCode1
A Cluster Ranking Model for Full Anaphora ResolutionCode1
An Annotated Corpus of Reference Resolution for Interpreting Common GroundingCode1
Coreference Resolution as Query-based Span PredictionCode1
Quoref: A Reading Comprehension Dataset with Questions Requiring Coreferential ReasoningCode1
WinoGrande: An Adversarial Winograd Schema Challenge at ScaleCode1
Coreference Resolution with Entity EqualizationCode1
Evaluating Gender Bias in Machine TranslationCode1
Attention Is (not) All You Need for Commonsense ReasoningCode1
A Surprisingly Robust Trick for Winograd Schema ChallengeCode1
Language Models are Unsupervised Multitask LearnersCode1
Multi-Task Identification of Entities, Relations, and Coreference for Scientific Knowledge Graph ConstructionCode1
Gender Bias in Coreference ResolutionCode1
Show:102550
← PrevPage 2 of 18Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1PaLM 540B (fine-tuned)Accuracy100—Unverified
2Vega v2 6B (KD-based prompt transfer)Accuracy98.6—Unverified
3UL2 20B (fine-tuned)Accuracy98.1—Unverified
4Turing NLR v5 XXL 5.4B (fine-tuned)Accuracy97.3—Unverified
5ST-MoE-32B 269B (fine-tuned)Accuracy96.6—Unverified
6DeBERTa-1.5BAccuracy95.9—Unverified
7T5-XXL 11B (fine-tuned)Accuracy93.8—Unverified
8ST-MoE-L 4.1B (fine-tuned)Accuracy93.3—Unverified
9RoBERTa-WinoGrande 355MAccuracy90.1—Unverified
10Flan-T5 XXL (zero -shot)Accuracy89.82—Unverified
#ModelMetricClaimedVerifiedStatus
1Maverick_mesF183.6—Unverified
2seq2seqF183.3—Unverified
3ASP+T0-3BF182.3—Unverified
4caw-coref + RoBERTaF181.6—Unverified
5LingMessF181.4—Unverified
6wl-coref + RoBERTaF181—Unverified
7U-MEM + LongformerF180.9—Unverified
8longdoc S (OntoNotes + 60k pseudo-singletons)F180.6—Unverified
9G2GT SpanBERT-large reducedF180.5—Unverified
10G2GT SpanBERT-large overlapF180.2—Unverified
#ModelMetricClaimedVerifiedStatus
1Maverick_mesAvg F183.6—Unverified
2seq2seqAvg F183.3—Unverified
3CorefQA + SpanBERT-largeAvg F183.1—Unverified
4ASP+T0-3BAvg F182.3—Unverified
5wl-coref + RoBERTaAvg F181—Unverified
6s2e + Longformer-LargeAvg F180.3—Unverified
7SpanBERT + Cluster MergingAvg F180.2—Unverified
8c2f + SpanBERT-LargeAvg F180.2—Unverified
9CorefQA + SpanBERT-baseAvg F179.9—Unverified
10U-MEM* + SpanBERT-largeAvg F179.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Coref-MTLOverall F192.72—Unverified
2ProBERTOverall F192.5—Unverified
3Maverick_incrOverall F191.2—Unverified
4Full EnsembleOverall F190.2—Unverified
5PeTraF185.3—Unverified
#ModelMetricClaimedVerifiedStatus
1REXELAvg. F195.12—Unverified
2JointAvg. F191.6—Unverified
3KB-bothAvg. F191.5—Unverified
#ModelMetricClaimedVerifiedStatus
1Maverick_mesF166.8—Unverified
2longdoc S (ON + PreCo + LitBank + 30k pseudo-singletons)F162.5—Unverified
3longdoc S (OntoNotes + PreCo + LitBank)F160.3—Unverified
#ModelMetricClaimedVerifiedStatus
1DeepStruct multi-task w/ finetuneAverage F173.1—Unverified
2DeepStruct multi-taskAverage F160.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Maverick_incrAvg F178.3—Unverified
2longdoc S (OntoNotes + PreCo + LitBank)F178.2—Unverified
#ModelMetricClaimedVerifiedStatus
1MTL-corefAvg F168.2—Unverified
2SpanBERTAvg F164.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Maverick_incrF188—Unverified
2longdoc S (OntoNotes + PreCo + LitBank)F187.6—Unverified
#ModelMetricClaimedVerifiedStatus
1BFCR + SpanBERT + Transfer LearningCoNLL F161.4—Unverified
2BFCR + SpanBERTCoNLL F150.4—Unverified
#ModelMetricClaimedVerifiedStatus
1mT0-13BAccuracy81.29—Unverified
2BLOOMZAccuracy69.08—Unverified
#ModelMetricClaimedVerifiedStatus
1mT0-13BAccuracy78.31—Unverified
2BLOOMZAccuracy68.67—Unverified
#ModelMetricClaimedVerifiedStatus
1longdoc S (OntoNotes + PreCo + LitBank)F142.9—Unverified
#ModelMetricClaimedVerifiedStatus
1dali-full-anaphoraAvg F177.9—Unverified