Dialogue Generation

Dialogue generation is the task of "understanding" natural language inputs - within natural language processing in order to produce output. The systems are usually intended for conversing with humans, for instance back and forth dialogue with a conversation agent like a chatbot. Some example benchmarks for this task (see others such as Natural Language Understanding) include FusedChat and Ubuntu DIalogue Corpus (UDC). Models can be evaluated via metrics such as BLEU, ROUGE, and METEOR albeit with challenges in terms of weak correlation with human judgement, that may be addressed by new ones like UnSupervised and Reference-free (USR) and Metric for automatic Unreferenced dialog evaluation (MaUde).

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 76–100 of 606 papers

Title	Date	Tasks	Status	Hype	Score
Improving Empathetic Dialogue Generation by Dynamically Infusing Commonsense Knowledge	May 24, 2023	Dialogue GenerationEmpathetic Response Generation	CodeCode Available	1	5
An Equal-Size Hard EM Algorithm for Diverse Dialogue Generation	Sep 29, 2022	DecoderDialogue Generation	CodeCode Available	1	5
InstructDial: Improving Zero and Few-shot Generalization in Dialogue through Instruction Tuning	May 25, 2022	Dialogue EvaluationDialogue Generation	CodeCode Available	1	5
BoB: BERT Over BERT for Training Persona-based Dialogue Models from Limited Personalized Data	Jun 11, 2021	DecoderDialogue Generation	CodeCode Available	1	5
A Batch Normalized Inference Network Keeps the KL Vanishing Away	Apr 27, 2020	Dialogue GenerationLanguage Modeling	CodeCode Available	1	5
DEMO: Reframing Dialogue Interaction with Fine-grained Element Modeling	Dec 6, 2024	Dialogue GenerationImitation Learning	CodeCode Available	1	5
Defending Against Backdoor Attacks in Natural Language Generation	Jun 3, 2021	Backdoor AttackDialogue Generation	CodeCode Available	1	5
An Interpretable Neuro-Symbolic Reasoning Framework for Task-Oriented Dialogue Generation	Mar 11, 2022	Dialogue GenerationTask-Oriented Dialogue Systems	CodeCode Available	1	5
DialoKG: Knowledge-Structure Aware Task-Oriented Dialogue Generation	Apr 19, 2022	Dialogue GenerationKnowledge Distillation	CodeCode Available	1	5
Dialogue Planning via Brownian Bridge Stochastic Process for Goal-directed Proactive Dialogue	May 9, 2023	Dialogue Generation	CodeCode Available	1	5
Bridging Text and Video: A Universal Multimodal Transformer for Video-Audio Scene-Aware Dialog	Feb 1, 2020	Dialogue GenerationMulti-Task Learning	CodeCode Available	1	5
Anno-MI: A Dataset of Expert-Annotated Counselling Dialogues	Apr 27, 2022	Dialogue GenerationNatural Language Understanding	CodeCode Available	1	5
Diverse and Faithful Knowledge-Grounded Dialogue Generation via Sequential Posterior Inference	Jun 1, 2023	Dialogue GenerationDiversity	CodeCode Available	1	5
LingYi: Medical Conversational Question Answering System based on Multi-modal Knowledge Graphs	Apr 20, 2022	Conversational Question AnsweringDialogue Generation	CodeCode Available	1	5
COSPLAY: Concept Set Guided Personalized Dialogue Generation Across Both Party Personas	May 2, 2022	Dialogue Generation	CodeCode Available	1	5
Diversifying Dialog Generation via Adaptive Label Smoothing	May 30, 2021	DecoderDialogue Generation	CodeCode Available	1	5
CASE: Aligning Coarse-to-Fine Cognition and Affection for Empathetic Response Generation	Aug 18, 2022	Dialogue GenerationEmpathetic Response Generation	CodeCode Available	1	5
A Pre-training Based Personalized Dialogue Generation Model with Persona-sparse Data	Nov 12, 2019	AttributeDecoder	CodeCode Available	1	5
Medical Dialogue Generation via Dual Flow Modeling	May 29, 2023	Dialogue GenerationDialogue Understanding	CodeCode Available	1	5
Knowledge Bridging for Empathetic Dialogue Generation	Sep 21, 2020	Dialogue Generation	CodeCode Available	1	5
FaithDial: A Faithful Benchmark for Information-Seeking Dialogue	Apr 22, 2022	Dialogue GenerationHallucination	CodeCode Available	1	5
AugESC: Dialogue Augmentation with Large Language Models for Emotional Support Conversation	Feb 26, 2022	Data AugmentationDialogue Generation	CodeCode Available	1	5
ChiMed-GPT: A Chinese Medical Large Language Model with Full Training Regime and Better Alignment to Human Preferences	Nov 10, 2023	Dialogue GenerationLanguage Modeling	CodeCode Available	1	5
Elastic Weight Removal for Faithful and Abstractive Dialogue Generation	Mar 30, 2023	Dialogue GenerationLanguage Modelling	CodeCode Available	1	5
CoMix: A Comprehensive Benchmark for Multi-Task Comic Understanding	Jul 4, 2024	Dialogue Generationobject-detection	CodeCode Available	1	5

Show:10 25 50

← PrevPage 4 of 25Next →

All datasets Persona-Chat FusedChat Harry Potter Dialogue Dataset Amazon-5 CMU DoG PG-19 Reddit (multi-ref)Twitter Dialogue (Noun)Twitter Dialogue (Tense)Ubuntu Dialogue (Activity)Ubuntu Dialogue (Cmd)Ubuntu Dialogue (Entity)

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	LMEDR	Avg F1	21.99	—	Unverified
2	P^2 Bot	Avg F1	19.77	—	Unverified
3	TransferTransfo	Avg F1	19.09	—	Unverified
4	Seq2Seq + Attention	Avg F1	16.18	—	Unverified
5	Synthesizer (R+V)	BLEU-1	14.7	—	Unverified
6	KV Profile Memory	Avg F1	11.9	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Classification-based model	Slot Accuracy	0.97	—	Unverified
2	Two-in-one model	Slot Accuracy	0.97	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	EVA	mauve	0.97	—	Unverified
2	Per-BOB	mauve	0.95	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	mm	1 in 10 R@2	5	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	∞-former (Sticky memories)	F1	9.01	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	∞-former (Sticky memories + initialized GPT-2 Small)	Perplexity	32.48	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpaceFusion	interest (human)	2.53	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	F1	4.63	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	Accuracy	34.48	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	F1	11.43	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	Accuracy	95.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	F1	3.72	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	Accuracy	29.01	—	Unverified