SOTAVerified

Dialogue Generation

Dialogue generation is the task of "understanding" natural language inputs - within natural language processing in order to produce output. The systems are usually intended for conversing with humans, for instance back and forth dialogue with a conversation agent like a chatbot. Some example benchmarks for this task (see others such as Natural Language Understanding) include FusedChat and Ubuntu DIalogue Corpus (UDC). Models can be evaluated via metrics such as BLEU, ROUGE, and METEOR albeit with challenges in terms of weak correlation with human judgement, that may be addressed by new ones like UnSupervised and Reference-free (USR) and Metric for automatic Unreferenced dialog evaluation (MaUde).

Papers

Showing 191–200 of 606 papers

TitleStatusHype
DSBERT:Unsupervised Dialogue Structure learning with BERT—0
Rethinking the Alignment of Psychotherapy Dialogue Generation with Motivational Interviewing Strategies—0
Focus on FoCus: Is FoCus focused on Context, Knowledge and Persona?—0
A Joint Training Framework for Open-World Knowledge Graph Embeddings—0
Emotional Support with LLM-based Empathetic Dialogue Generation—0
Building Knowledge-Grounded Dialogue Systems with Graph-Based Semantic Modeling—0
Dolphin: A Challenging and Diverse Benchmark for Arabic NLG—0
Active Defense Against Social Engineering: The Case for Human Language Technology—0
Empathetic Dialogue Generation with Pre-trained RoBERTa-GPT2 and External Knowledge—0
DLVGen: A Dual Latent Variable Approach to Personalized Dialogue Generation—0
Show:102550
← PrevPage 20 of 61Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1LMEDRAvg F121.99—Unverified
2P^2 BotAvg F119.77—Unverified
3TransferTransfoAvg F119.09—Unverified
4Seq2Seq + AttentionAvg F116.18—Unverified
5Synthesizer (R+V)BLEU-114.7—Unverified
6KV Profile MemoryAvg F111.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Classification-based modelSlot Accuracy0.97—Unverified
2Two-in-one modelSlot Accuracy0.97—Unverified
#ModelMetricClaimedVerifiedStatus
1EVAmauve0.97—Unverified
2Per-BOBmauve0.95—Unverified
#ModelMetricClaimedVerifiedStatus
1mm1 in 10 R@25—Unverified
#ModelMetricClaimedVerifiedStatus
1∞-former (Sticky memories)F19.01—Unverified
#ModelMetricClaimedVerifiedStatus
1∞-former (Sticky memories + initialized GPT-2 Small)Perplexity32.48—Unverified
#ModelMetricClaimedVerifiedStatus
1SpaceFusioninterest (human)2.53—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F14.63—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy34.48—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F111.43—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy95.04—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F13.72—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy29.01—Unverified