SOTAVerified

Dialogue Generation

Dialogue generation is the task of "understanding" natural language inputs - within natural language processing in order to produce output. The systems are usually intended for conversing with humans, for instance back and forth dialogue with a conversation agent like a chatbot. Some example benchmarks for this task (see others such as Natural Language Understanding) include FusedChat and Ubuntu DIalogue Corpus (UDC). Models can be evaluated via metrics such as BLEU, ROUGE, and METEOR albeit with challenges in terms of weak correlation with human judgement, that may be addressed by new ones like UnSupervised and Reference-free (USR) and Metric for automatic Unreferenced dialog evaluation (MaUde).

Papers

Showing 351–400 of 606 papers

TitleStatusHype
Open-domain Dialogue Generation: What We Can Do, Cannot Do, And Should Do Next—0
Open Domain Dialogue Generation with Latent Images—0
ORD: Object Relationship Discovery for Visual Dialogue Generation—0
Pan More Gold from the Sand: Refining Open-domain Dialogue Training with Noisy Self-Retrieval Generation—0
Partner Personas Generation for Diverse Dialogue Generation—0
Persona-Knowledge Dialogue Multi-Context Retrieval and Enhanced Decoding Methods—0
PLATO-K: Internal and External Knowledge Enhanced Dialogue Generation—0
PlugMed: Improving Specificity in Patient-Centered Medical Dialogue Generation using In-Context Learning—0
Policy-driven Knowledge Selection and Response Generation for Document-grounded Dialogue—0
Position Debiasing Fine-Tuning for Causal Perception in Long-Term Dialogue—0
Prediction, Selection, and Generation: Exploration of Knowledge-Driven Conversation System—0
Proactive Assistant Dialogue Generation from Streaming Egocentric Videos—0
Profanity-Avoiding Training Framework for Seq2seq Models with Certified Robustness—0
ProphetChat: Enhancing Dialogue Generation with Simulation of Future Conversation—0
Prototype-to-Style: Dialogue Generation with Style-Aware Editing on Retrieval Memory—0
PsyPlay: Personality-Infused Role-Playing Conversational Agents—0
Queens are Powerful too: Mitigating Gender Bias in Dialogue Generation—0
Ranking Enhanced Dialogue Generation—0
Reasoning in Conversation: Solving Subjective Tasks through Dialogue Simulation for Large Language Models—0
Recent Trends in Personalized Dialogue Generation: A Review of Datasets, Methodologies, and Evaluations—0
Reference-Aware Language Models—0
Refine and Imitate: Reducing Repetition and Inconsistency in Dialogue Generation via Reinforcement Learning and Human Demonstration—0
ReflectDiffu:Reflect between Emotion-intent Contagion and Mimicry for Empathetic Response Generation via a RL-Diffusion Framework—0
Regularizing Dialogue Generation by Imitating Implicit Scenarios—0
RepSum: Unsupervised Dialogue Summarization based on Replacement Strategy—0
Research on emotionally intelligent dialogue generation based on automatic dialogue system—0
Response-act Guided Reinforced Dialogue Generation for Mental Health Counseling—0
Response Generation with Context-Aware Prompt Learning—0
Rethinking the Agreement in Human Evaluation Tasks—0
Retrieval-based Goal-Oriented Dialogue Generation—0
RLAIF vs. RLHF: Scaling Reinforcement Learning from Human Feedback with AI Feedback—0
RMHIDD: A Reddit Mental Health Intervention Dialogue Dataset—0
Robust Task-Oriented Dialogue Generation with Contrastive Pre-training and Adversarial Filtering—0
SalesBot: Transitioning from Chit-Chat to Task-Oriented Dialogues—0
Scene-Aware Prompt for Multi-modal Dialogue Understanding and Generation—0
Self-Attentional Models Application in Task-Oriented Dialogue Generation Systems—0
Self-Attention-Based Message-Relevant Response Generation for Neural Conversation Model—0
Semantic Content Prediction for Generating Interviewing Dialogues to Elicit Users’ Food Preferences—0
Semantic Diversity in Dialogue with Natural Language Inference—0
Semantic Guidance of Dialogue Generation with Reinforcement Learning—0
Sentence Semantic Regression for Text Generation—0
Sentiment Analysis for Reinforcement Learning—0
SEPRG: Sentiment aware Emotion controlled Personalized Response Generation—0
Sequence-Level Certainty Reduces Hallucination In Knowledge-Grounded Dialogue Generation—0
Similarity Based Label Smoothing For Dialogue Generation—0
Similarity-Based Reconstruction Loss for Meaning Representation—0
Simulated Annealing for Emotional Dialogue Systems—0
Single- vs. Dual-Prompt Dialogue Generation with LLMs for Job Interviews in Human Resources—0
STAMPsy: Towards SpatioTemporal-Aware Mixed-Type Dialogues for Psychological Counseling—0
Streamlining Biomedical Research with Specialized LLMs—0
Show:102550
← PrevPage 8 of 13Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1LMEDRAvg F121.99—Unverified
2P^2 BotAvg F119.77—Unverified
3TransferTransfoAvg F119.09—Unverified
4Seq2Seq + AttentionAvg F116.18—Unverified
5Synthesizer (R+V)BLEU-114.7—Unverified
6KV Profile MemoryAvg F111.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Classification-based modelSlot Accuracy0.97—Unverified
2Two-in-one modelSlot Accuracy0.97—Unverified
#ModelMetricClaimedVerifiedStatus
1EVAmauve0.97—Unverified
2Per-BOBmauve0.95—Unverified
#ModelMetricClaimedVerifiedStatus
1mm1 in 10 R@25—Unverified
#ModelMetricClaimedVerifiedStatus
1∞-former (Sticky memories)F19.01—Unverified
#ModelMetricClaimedVerifiedStatus
1∞-former (Sticky memories + initialized GPT-2 Small)Perplexity32.48—Unverified
#ModelMetricClaimedVerifiedStatus
1SpaceFusioninterest (human)2.53—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F14.63—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy34.48—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F111.43—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy95.04—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.F13.72—Unverified
#ModelMetricClaimedVerifiedStatus
1MrRNN Act.-Ent.Accuracy29.01—Unverified