SOTAVerified

Coreference Resolution

Papers

Showing 201–250 of 880 papers

TitleStatusHype
Who are you referring to? Coreference resolution in image narrations—0
Coreference Resolution through a seq2seq Transition-Based System—0
mOKB6: A Multilingual Open Knowledge Base Completion BenchmarkCode0
A hybrid entity-centric approach to Persian pronoun resolution—0
Review of coreference resolution in English and Persian—0
Knowledge-in-Context: Towards Knowledgeable Semi-Parametric Language Models—0
He Said, She Said: Style Transfer for Shifting the Perspective of DialoguesCode0
Investigating the Role of Centering Theory in the Context of Neural Coreference Resolution Systems—0
Joint Coreference Resolution for Zeros and non-Zeros in Arabic—0
Mention Annotations Alone Enable Efficient Domain Adaptation for Coreference ResolutionCode0
ezCoref: Towards Unifying Annotation Guidelines for Coreference ResolutionCode0
Machine Reading, Fast and Slow: When Do Models “Understand” Language?—0
End-to-End Neural Bridging Resolution—0
Coreference Resolution for Polish: Improvements within the CRAC 2022 Shared Task—0
Online Neural Coreference Resolution with Rollback—0
Pipeline Coreference Resolution Model for Anaphoric Identity in Dialogues—0
Evaluating Coreference Resolvers on Community-based Question Answering: From Rule-based to State of the ArtCode0
Investigating Cross-Document Event Coreference for Dutch—0
End-to-end Multilingual Coreference Resolution with Mention Head Prediction—0
Findings of the Shared Task on Multilingual Coreference ResolutionCode0
Machine Reading, Fast and Slow: When Do Models "Understand" Language?—0
ÚFAL CorPipe at CRAC 2022: Effectivity of Multilingual Models for Coreference ResolutionCode0
The Fellowship of the Authors: Disambiguating Names from Social Network Context—0
Efficient and Interpretable Neural Models for Entity Tracking—0
Multilingual Coreference Resolution in Multiparty DialogueCode0
A Simple Unsupervised Approach for Coreference Resolution using Rule-based Weak Supervision—0
Incorporating Subjectivity into Gendered Ambiguous Pronoun (GAP) Resolution using Style Transfer—0
Recognition of They/Them as Singular Personal Pronouns in Coreference ResolutionCode0
Incorporating Centering Theory into Neural Coreference ResolutionCode0
Learning to Embed Multi-Modal Contexts for Situated Conversational Agents—0
Placing (Historical) Facts on a Timeline: A Classification cum Coref Resolution ApproachCode0
Aspect-Based Emotion Analysis and Multimodal Coreference: A Case Study of Customer Comments on Adidas Instagram Posts—0
OpenEL: An Annotated Corpus for Entity Linking and Discourse in Open Domain DialogueCode0
ParCorFull2.0: a Parallel Corpus Annotated with Full CoreferenceCode0
A Cross-document Coreference Dataset for Longitudinal Tracking across Radiology Reports—0
CorefUD 1.0: Coreference Meets Universal Dependencies—0
Towards Coreference Resolution for Early Irish—0
PCR4ALL: A Comprehensive Evaluation Benchmark for Pronoun Coreference Resolution in EnglishCode0
Évaluation comparative de systèmes neuronal et statistique pour la résolution de coréférence en langage parlé (Comparative evaluation of neural and statistical coreference resolution on spoken language )—0
Large Language Models are Few-Shot Clinical Information Extractors—0
Contrastive Representation Learning for Cross-Document Coreference Resolution of Events and Entities—0
Online Coreference Resolution for Dialogue Processing: Improving Mention-Linking on Real-Time Conversations—0
What GPT Knows About Who is WhoCode0
Modeling Task Interactions in Document-Level Joint Entity and Relation Extraction—0
Neural Language Taskonomy: Which NLP Tasks are the most Predictive of fMRI Brain Activity?—0
Graph-combined Coreference Resolution Methods on Conversational Machine Reading Comprehension with Pre-trained Language Model—0
Variational Graph Autoencoding as Cheap Supervision for AMR Coreference Resolution—0
A Methodology for the Comparison of Human Judgments With Metrics for Coreference Resolution—0
Dialogue Meaning Representation for Task-Oriented Dialogue SystemsCode0
Graph Refinement for Coreference Resolution—0
Show:102550
← PrevPage 5 of 18Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1PaLM 540B (fine-tuned)Accuracy100—Unverified
2Vega v2 6B (KD-based prompt transfer)Accuracy98.6—Unverified
3UL2 20B (fine-tuned)Accuracy98.1—Unverified
4Turing NLR v5 XXL 5.4B (fine-tuned)Accuracy97.3—Unverified
5ST-MoE-32B 269B (fine-tuned)Accuracy96.6—Unverified
6DeBERTa-1.5BAccuracy95.9—Unverified
7T5-XXL 11B (fine-tuned)Accuracy93.8—Unverified
8ST-MoE-L 4.1B (fine-tuned)Accuracy93.3—Unverified
9RoBERTa-WinoGrande 355MAccuracy90.1—Unverified
10Flan-T5 XXL (zero -shot)Accuracy89.82—Unverified
#ModelMetricClaimedVerifiedStatus
1Maverick_mesF183.6—Unverified
2seq2seqF183.3—Unverified
3ASP+T0-3BF182.3—Unverified
4caw-coref + RoBERTaF181.6—Unverified
5LingMessF181.4—Unverified
6wl-coref + RoBERTaF181—Unverified
7U-MEM + LongformerF180.9—Unverified
8longdoc S (OntoNotes + 60k pseudo-singletons)F180.6—Unverified
9G2GT SpanBERT-large reducedF180.5—Unverified
10G2GT SpanBERT-large overlapF180.2—Unverified
#ModelMetricClaimedVerifiedStatus
1Maverick_mesAvg F183.6—Unverified
2seq2seqAvg F183.3—Unverified
3CorefQA + SpanBERT-largeAvg F183.1—Unverified
4ASP+T0-3BAvg F182.3—Unverified
5wl-coref + RoBERTaAvg F181—Unverified
6s2e + Longformer-LargeAvg F180.3—Unverified
7SpanBERT + Cluster MergingAvg F180.2—Unverified
8c2f + SpanBERT-LargeAvg F180.2—Unverified
9CorefQA + SpanBERT-baseAvg F179.9—Unverified
10U-MEM* + SpanBERT-largeAvg F179.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Coref-MTLOverall F192.72—Unverified
2ProBERTOverall F192.5—Unverified
3Maverick_incrOverall F191.2—Unverified
4Full EnsembleOverall F190.2—Unverified
5PeTraF185.3—Unverified
#ModelMetricClaimedVerifiedStatus
1REXELAvg. F195.12—Unverified
2JointAvg. F191.6—Unverified
3KB-bothAvg. F191.5—Unverified
#ModelMetricClaimedVerifiedStatus
1Maverick_mesF166.8—Unverified
2longdoc S (ON + PreCo + LitBank + 30k pseudo-singletons)F162.5—Unverified
3longdoc S (OntoNotes + PreCo + LitBank)F160.3—Unverified
#ModelMetricClaimedVerifiedStatus
1DeepStruct multi-task w/ finetuneAverage F173.1—Unverified
2DeepStruct multi-taskAverage F160.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Maverick_incrAvg F178.3—Unverified
2longdoc S (OntoNotes + PreCo + LitBank)F178.2—Unverified
#ModelMetricClaimedVerifiedStatus
1MTL-corefAvg F168.2—Unverified
2SpanBERTAvg F164.6—Unverified
#ModelMetricClaimedVerifiedStatus
1Maverick_incrF188—Unverified
2longdoc S (OntoNotes + PreCo + LitBank)F187.6—Unverified
#ModelMetricClaimedVerifiedStatus
1BFCR + SpanBERT + Transfer LearningCoNLL F161.4—Unverified
2BFCR + SpanBERTCoNLL F150.4—Unverified
#ModelMetricClaimedVerifiedStatus
1mT0-13BAccuracy81.29—Unverified
2BLOOMZAccuracy69.08—Unverified
#ModelMetricClaimedVerifiedStatus
1mT0-13BAccuracy78.31—Unverified
2BLOOMZAccuracy68.67—Unverified
#ModelMetricClaimedVerifiedStatus
1longdoc S (OntoNotes + PreCo + LitBank)F142.9—Unverified
#ModelMetricClaimedVerifiedStatus
1dali-full-anaphoraAvg F177.9—Unverified