SOTAVerified

Dialogue Generation

Dialogue generation is the task of "understanding" natural language inputs - within natural language processing in order to produce output. The systems are usually intended for conversing with humans, for instance back and forth dialogue with a conversation agent like a chatbot. Some example benchmarks for this task (see others such as Natural Language Understanding) include FusedChat and Ubuntu DIalogue Corpus (UDC). Models can be evaluated via metrics such as BLEU, ROUGE, and METEOR albeit with challenges in terms of weak correlation with human judgement, that may be addressed by new ones like UnSupervised and Reference-free (USR) and Metric for automatic Unreferenced dialog evaluation (MaUde).

Papers

Showing 151–175 of 606 papers

TitleStatusHype
Contrastive Speaker-Aware Learning for Multi-party Dialogue Generation with LLMs—0
A Static and Dynamic Attention Framework for Multi Turn Dialogue Generation—0
Contextual Knowledge Learning For Dialogue Generation—0
Context-dependent Instruction Tuning for Dialogue Response Generation—0
A Stack-Propagation Framework for Low-Resource Personalized Dialogue Generation—0
Almanac: Retrieval-Augmented Language Models for Clinical Medicine—0
A Cause-Effect Look at Alleviating Hallucination of Knowledge-grounded Dialogue Generation—0
Exploring Effective Information Utilization in Multi-Turn Topic-Driven Conversations—0
Context-aware Natural Language Generation for Spoken Dialogue Systems—0
Constructing Emotion Consensus and Utilizing Unpaired Data for Empathetic Dialogue Generation—0
A Speaker-aware Parallel Hierarchical Attentive Encoder-Decoder Model for Multi-turn Dialogue Generation—0
Constructing Emotional Consensus and Utilizing Unpaired Data for Empathetic Dialogue Generation—0
Aligning Dialogue Agents with Global Feedback via Large Language Model Reward Decomposition—0
Evaluate What You Can't Evaluate: Unassessable Quality for Generated Response—0
ConsistentChat: Building Skeleton-Guided Consistent Dialogues for Large Language Models from Scratch—0
Commonsense-Aware Prompting for Controllable Empathetic Dialogue Generation—0
A Shoulder to Cry on: Towards A Motivational Virtual Assistant for Assuaging Mental Agony—0
A Semi-Supervised Stable Variational Network for Promoting Replier-Consistency in Dialogue Generation—0
A Benchmark for Understanding and Generating Dialogue between Characters in Stories—0
Evaluating Gender Bias Transfer from Film Data—0
Combining Curriculum Learning and Knowledge Distillation for Dialogue Generation—0
CoLV: A Collaborative Latent Variable Model for Knowledge-Grounded Dialogue Generation—0
Are Training Samples Correlated? Learning to Generate Dialogue Responses with Multiple References—0
Collaborative Reasoning on Multi-Modal Semantic Graphs for Video-Grounded Dialogue Generation—0
CMed-GPT: Prompt Tuning for Entity-Aware Chinese Medical Dialogue Generation—0
Show:102550
← PrevPage 7 of 25Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1LMEDRAvg F121.99—Unverified
2P^2 BotAvg F119.77—Unverified
3TransferTransfoAvg F119.09—Unverified
4Seq2Seq + AttentionAvg F116.18—Unverified
5Synthesizer (R+V)BLEU-114.7—Unverified
6KV Profile MemoryAvg F111.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Classification-based modelSlot Accuracy0.97—Unverified
2Two-in-one modelSlot Accuracy0.97—Unverified
#ModelMetricClaimedVerifiedStatus
1EVAmauve0.97—Unverified
2Per-BOBmauve0.95—Unverified
#ModelMetricClaimedVerifiedStatus
1mm1 in 10 R@25—Unverified
#ModelMetricClaimedVerifiedStatus
1∞-former (Sticky memories)F19.01—Unverified
#ModelMetricClaimedVerifiedStatus
1∞-former (Sticky memories + initialized GPT-2 Small)Perplexity32.48—Unverified
#ModelMetricClaimedVerifiedStatus
1SpaceFusioninterest (human)2.53—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F14.63—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy34.48—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F111.43—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy95.04—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F13.72—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy29.01—Unverified