SOTAVerified

Dialogue Generation

Dialogue generation is the task of "understanding" natural language inputs - within natural language processing in order to produce output. The systems are usually intended for conversing with humans, for instance back and forth dialogue with a conversation agent like a chatbot. Some example benchmarks for this task (see others such as Natural Language Understanding) include FusedChat and Ubuntu DIalogue Corpus (UDC). Models can be evaluated via metrics such as BLEU, ROUGE, and METEOR albeit with challenges in terms of weak correlation with human judgement, that may be addressed by new ones like UnSupervised and Reference-free (USR) and Metric for automatic Unreferenced dialog evaluation (MaUde).

Papers

Showing 176–200 of 606 papers

TitleStatusHype
ChatZero:Zero-shot Cross-Lingual Dialogue Generation via Pseudo-Target Language—0
Are Pre-trained Language Models Knowledgeable to Ground Open Domain Dialogues?—0
Adaptive Bridge between Training and Inference for Dialogue Generation—0
E-CORE: Emotion Correlation Enhanced Empathetic Dialogue Generation—0
A Randomized Link Transformer for Diverse Open-Domain Dialogue Generation—0
SuperChat: Dialogue Generation by Transfer Learning from Vision to Language using Two-dimensional Word Embedding and Pretrained ImageNet CNN Models—0
Generating Personalized Dialogue via Multi-Task Meta-Learning—0
Generating Relevant and Coherent Dialogue Responses using Self-separated Conditional Variational AutoEncoders—0
Goal-Embedded Dual Hierarchical Model for Task-Oriented Dialogue Generation—0
Dynamic Stochastic Decoding Strategy for Open-Domain Dialogue Generation—0
Dynamic Knowledge Graph-based Dialogue Generation with Improved Adversarial Meta-Learning—0
GE-Blender: Graph-Based Knowledge Enhancement for Blender—0
Dynamic Feature Selection with Attention in Incremental Parsing—0
Dynamically Retrieving Knowledge via Query Generation for Informative Dialogue Generation—0
Generalizable and Explainable Dialogue Generation via Explicit Action Learning—0
DSBERT:Unsupervised Dialogue Structure learning with BERT—0
Rethinking the Alignment of Psychotherapy Dialogue Generation with Motivational Interviewing Strategies—0
Focus on FoCus: Is FoCus focused on Context, Knowledge and Persona?—0
A Joint Training Framework for Open-World Knowledge Graph Embeddings—0
Emotional Support with LLM-based Empathetic Dialogue Generation—0
Building Knowledge-Grounded Dialogue Systems with Graph-Based Semantic Modeling—0
Dolphin: A Challenging and Diverse Benchmark for Arabic NLG—0
Active Defense Against Social Engineering: The Case for Human Language Technology—0
Empathetic Dialogue Generation with Pre-trained RoBERTa-GPT2 and External Knowledge—0
DLVGen: A Dual Latent Variable Approach to Personalized Dialogue Generation—0
Show:102550
← PrevPage 8 of 25Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1LMEDRAvg F121.99—Unverified
2P^2 BotAvg F119.77—Unverified
3TransferTransfoAvg F119.09—Unverified
4Seq2Seq + AttentionAvg F116.18—Unverified
5Synthesizer (R+V)BLEU-114.7—Unverified
6KV Profile MemoryAvg F111.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Classification-based modelSlot Accuracy0.97—Unverified
2Two-in-one modelSlot Accuracy0.97—Unverified
#ModelMetricClaimedVerifiedStatus
1EVAmauve0.97—Unverified
2Per-BOBmauve0.95—Unverified
#ModelMetricClaimedVerifiedStatus
1mm1 in 10 R@25—Unverified
#ModelMetricClaimedVerifiedStatus
1∞-former (Sticky memories)F19.01—Unverified
#ModelMetricClaimedVerifiedStatus
1∞-former (Sticky memories + initialized GPT-2 Small)Perplexity32.48—Unverified
#ModelMetricClaimedVerifiedStatus
1SpaceFusioninterest (human)2.53—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F14.63—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy34.48—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F111.43—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy95.04—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F13.72—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy29.01—Unverified