SOTAVerified

Multimodal Emotion Recognition

This is a leaderboard for multimodal emotion recognition on the IEMOCAP dataset. The modality abbreviations are A: Acoustic T: Text V: Visual

Please include the modality in the bracket after the model name.

All models must use standard five emotion categories and are evaluated in standard leave-one-session-out (LOSO). See the papers for references.

Papers

Showing 101–125 of 180 papers

TitleStatusHype
Modality-Collaborative Transformer with Hybrid Feature Reconstruction for Robust Emotion RecognitionCode0
DER-GCN: Dialogue and Event Relation-Aware Graph Convolutional Neural Network for Multimodal Dialogue Emotion Recognition—0
Deep Imbalanced Learning for Multimodal Emotion Recognition in Conversations—0
Accommodating Missing Modalities in Time-Continuous Multimodal Emotion Recognition—0
A Contextualized Real-Time Multimodal Emotion Recognition for Conversational Agents using Graph Convolutional Networks in Reinforcement Learning—0
Learning Noise-Robust Joint Representation for Multimodal Emotion Recognition under Incomplete Data ScenariosCode0
Hierarchical Audio-Visual Information Fusion with Multi-label Joint Decoding for MER 2023—0
Leveraging Label Information for Multimodal Emotion Recognition—0
A Unified Transformer-based Network for multimodal Emotion Recognition—0
Revisiting Disentanglement and Fusion on Modality and Context in Conversational Multimodal Emotion Recognition—0
Emotion recognition based on multi-modal electrophysiology multi-head attention Contrastive Learning—0
TACOformer:Token-channel compounded Cross Attention for Multimodal Emotion Recognition—0
A Comparison of Time-based Models for Multimodal Emotion Recognition—0
EMERSK -- Explainable Multimodal Emotion Recognition with Situational Knowledge—0
Exploring Attention Mechanisms for Multimodal Emotion Recognition in an Emergency Call Center Corpus—0
Modality Influence in Multimodal Machine Learning—0
Interpretable Multimodal Emotion Recognition using Facial Features and Physiological Signals—0
Versatile audio-visual learning for emotion recognition—0
Noise-Resistant Multimodal Transformer for Emotion Recognition—0
HCAM -- Hierarchical Cross Attention Model for Multi-modal Emotion Recognition—0
An Empirical Study and Improvement for Speech Emotion Recognition—0
Using Auxiliary Tasks In Multimodal Fusion Of Wav2vec 2.0 And BERT For Multimodal Emotion Recognition—0
Knowledge-aware Bayesian Co-attention for Multimodal Emotion Recognition—0
cross-modal fusion techniques for utterance-level emotion recognition from text and speech—0
CSAT‑FTCN: A Fuzzy‑Oriented Model with Contextual Self‑attention Network for Multimodal Emotion Recognition—0
Show:102550
← PrevPage 5 of 8Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F186.52—Unverified
2JoyfulWeighted F185.7—Unverified
3COGMENWeighted F184.5—Unverified
4DANNAccuracy82.7—Unverified
5MMERAccuracy81.7—Unverified
6PATHOSnet v2Accuracy80.4—Unverified
7Self-attention weight correction (A+T)Accuracy76.8—Unverified
8CHFusionAccuracy76.5—Unverified
9bc-LSTMWeighted F174.1—Unverified
10Audio + Text (Stage III)F170.5—Unverified
#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F166.71—Unverified
2Audio + Text (Stage III)Weighted F165.8—Unverified
3JoyfulWeighted F161.77—Unverified
#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F172.81—Unverified
2JoyfulWeighted F170.5—Unverified
#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F144.93—Unverified
#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F166.73—Unverified
#ModelMetricClaimedVerifiedStatus
1SMPLify-Xv2v error52.9—Unverified
#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F174.31—Unverified