Dialogue Generation

Dialogue generation is the task of "understanding" natural language inputs - within natural language processing in order to produce output. The systems are usually intended for conversing with humans, for instance back and forth dialogue with a conversation agent like a chatbot. Some example benchmarks for this task (see others such as Natural Language Understanding) include FusedChat and Ubuntu DIalogue Corpus (UDC). Models can be evaluated via metrics such as BLEU, ROUGE, and METEOR albeit with challenges in terms of weak correlation with human judgement, that may be addressed by new ones like UnSupervised and Reference-free (USR) and Metric for automatic Unreferenced dialog evaluation (MaUde).

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 251–275 of 606 papers

Title	Date	Tasks	Status	Hype
RT-KGD: Relation Transition Aware Knowledge-Grounded Dialogue Generation	Jul 17, 2022	Dialogue GenerationKnowledge Graphs	CodeCode Available	0
Scene-Aware Prompt for Multi-modal Dialogue Understanding and Generation	Jul 5, 2022	Dialogue GenerationDialogue Understanding	—Unverified	0
Evaluating Gender Bias Transfer from Film Data	Jul 1, 2022	Dialogue GenerationMachine Translation	—Unverified	0
A Shoulder to Cry on: Towards A Motivational Virtual Assistant for Assuaging Mental Agony	Jul 1, 2022	Dialogue GenerationReinforcement Learning (RL)	—Unverified	0
Modeling Compositionality with Dependency Graph for Dialogue Generation	Jul 1, 2022	Dialogue Generation	—Unverified	0
Towards an open-domain chatbot for language practice	Jul 1, 2022	ChatbotDialogue Generation	CodeCode Available	0
Medical Dialogue Response Generation with Pivotal Information Recalling	Jun 17, 2022	Dialogue GenerationGraph Attention	—Unverified	0
Memory-Based Model Editing at Scale	Jun 13, 2022	counterfactualDialogue Generation	CodeCode Available	1
Grounding in social media: An approach to building a chit-chat dialogue model	Jun 12, 2022	Dialogue GenerationText Generation	—Unverified	0
Learning to Generate Prompts for Dialogue Generation through Reinforcement Learning	Jun 8, 2022	Dialogue GenerationLanguage Modeling	—Unverified	0
A Unifying View On Task-oriented Dialogue Annotation	Jun 1, 2022	Dialogue GenerationDialogue State Tracking	CodeCode Available	0
CPED: A Large-Scale Chinese Personalized and Emotional Dialogue Dataset for Conversational AI	May 29, 2022	Chinese Sentiment AnalysisConversational Response Generation	CodeCode Available	2
Commonsense and Named Entity Aware Knowledge Grounded Dialogue Generation	May 27, 2022	Dialogue Generation	CodeCode Available	0
Keywords and Instances: A Hierarchical Contrastive Learning Framework Unifying Hybrid Granularities for Text Generation	May 26, 2022	Contrastive LearningDialogue Generation	—Unverified	0
ProsocialDialog: A Prosocial Backbone for Conversational Agents	May 25, 2022	Dialogue GenerationDialogue Safety Prediction	CodeCode Available	1
InstructDial: Improving Zero and Few-shot Generalization in Dialogue through Instruction Tuning	May 25, 2022	Dialogue EvaluationDialogue Generation	CodeCode Available	1
DFM: Dialogue Foundation Model for Universal Large-Scale Dialogue-Oriented Task Learning	May 25, 2022	Dialogue GenerationDiversity	—Unverified	0
BanglaNLG and BanglaT5: Benchmarks and Resources for Evaluating Low-Resource Natural Language Generation in Bangla	May 23, 2022	Conditional Text GenerationDialogue Generation	CodeCode Available	1
Robust Task-Oriented Dialogue Generation with Contrastive Pre-training and Adversarial Filtering	May 20, 2022	Contrastive LearningDialogue Generation	—Unverified	0
Self-training with Two-phase Self-augmentation for Few-shot Dialogue Generation	May 19, 2022	Dialogue GenerationLanguage Modelling	CodeCode Available	0
Long-term Control for Dialogue Generation: Methods and Evaluation	May 15, 2022	Dialogue GenerationResponse Generation	CodeCode Available	0
A Simple Contrastive Learning Objective for Alleviating Neural Text Degeneration	May 5, 2022	Contrastive LearningDialogue Generation	CodeCode Available	1
Diversifying Neural Dialogue Generation via Negative Distillation	May 5, 2022	Dialogue Generation	—Unverified	0
Semantic Diversity in Dialogue with Natural Language Inference	May 3, 2022	Dialogue GenerationDiversity	—Unverified	0
COSPLAY: Concept Set Guided Personalized Dialogue Generation Across Both Party Personas	May 2, 2022	Dialogue Generation	CodeCode Available	1

Show:10 25 50

← PrevPage 11 of 25Next →

All datasets Persona-Chat FusedChat Harry Potter Dialogue Dataset Amazon-5 CMU DoG PG-19 Reddit (multi-ref)Twitter Dialogue (Noun)Twitter Dialogue (Tense)Ubuntu Dialogue (Activity)Ubuntu Dialogue (Cmd)Ubuntu Dialogue (Entity)

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	LMEDR	Avg F1	21.99	—	Unverified
2	P^2 Bot	Avg F1	19.77	—	Unverified
3	TransferTransfo	Avg F1	19.09	—	Unverified
4	Seq2Seq + Attention	Avg F1	16.18	—	Unverified
5	Synthesizer (R+V)	BLEU-1	14.7	—	Unverified
6	KV Profile Memory	Avg F1	11.9	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Classification-based model	Slot Accuracy	0.97	—	Unverified
2	Two-in-one model	Slot Accuracy	0.97	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	EVA	mauve	0.97	—	Unverified
2	Per-BOB	mauve	0.95	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	mm	1 in 10 R@2	5	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	∞-former (Sticky memories)	F1	9.01	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	∞-former (Sticky memories + initialized GPT-2 Small)	Perplexity	32.48	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpaceFusion	interest (human)	2.53	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	F1	4.63	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	Accuracy	34.48	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	F1	11.43	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	Accuracy	95.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	F1	3.72	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MrRNN Act.-Ent.	Accuracy	29.01	—	Unverified