SOTAVerified

Multimodal Emotion Recognition

This is a leaderboard for multimodal emotion recognition on the IEMOCAP dataset. The modality abbreviations are A: Acoustic T: Text V: Visual

Please include the modality in the bracket after the model name.

All models must use standard five emotion categories and are evaluated in standard leave-one-session-out (LOSO). See the papers for references.

Papers

Showing 51–75 of 180 papers

TitleStatusHype
Multimodal Emotion Recognition using Audio-Video Transformer Fusion with Cross AttentionCode1
Multimodal Emotion Recognition with High-level Speech and Text FeaturesCode1
COGMEN: COntextualized GNN based Multimodal Emotion recognitioNCode1
Multimodal Emotion Recognition with Transformer-Based Self Supervised Feature FusionCode1
FV2ES: A Fully End2End Multimodal System for Fast Yet Effective Video Emotion Recognition InferenceCode1
Tracing Intricate Cues in Dialogue: Joint Graph Structure and Sentiment Dynamics for Multimodal Emotion RecognitionCode1
Multimodal Speech Emotion Recognition and Ambiguity ResolutionCode0
Combining deep and unsupervised features for multilingual speech emotion recognitionCode0
Multimodal Speech Emotion Recognition Using Audio and TextCode0
Multimodal Sentiment Analysis using Hierarchical Fusion with Context ModelingCode0
Multi Teacher Privileged Knowledge Distillation for Multimodal Expression RecognitionCode0
Multimodal Emotion Recognition Using Deep Canonical Correlation AnalysisCode0
Multi-Modal Emotion recognition on IEMOCAP Dataset using Deep LearningCode0
Multimodal Behavioral Markers Exploring Suicidal Intent in Social Media VideosCode0
Multi-level Fusion of Wav2vec 2.0 and BERT for Multimodal Emotion RecognitionCode0
Complementary Fusion of Multi-Features and Multi-Modalities in Sentiment AnalysisCode0
Leveraging Contrastive Learning and Self-Training for Multimodal Emotion Recognition with Limited Labeled SamplesCode0
Learning Alignment for Multimodal Emotion Recognition from SpeechCode0
Learning Noise-Robust Joint Representation for Multimodal Emotion Recognition under Incomplete Data ScenariosCode0
Modality-Collaborative Transformer with Hybrid Feature Reconstruction for Robust Emotion RecognitionCode0
Investigation of Multimodal Features, Classifiers and Fusion Methods for Emotion RecognitionCode0
Attentive Modality Hopping Mechanism for Speech Emotion RecognitionCode0
Feature-Based Dual Visual Feature Extraction Model for Compound Multimodal Emotion RecognitionCode0
VISTANet: VIsual Spoken Textual Additive Net for Interpretable Multimodal Emotion RecognitionCode0
End-to-End Multimodal Emotion Recognition using Deep Neural NetworksCode0
Show:102550
← PrevPage 3 of 8Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F186.52—Unverified
2JoyfulWeighted F185.7—Unverified
3COGMENWeighted F184.5—Unverified
4DANNAccuracy82.7—Unverified
5MMERAccuracy81.7—Unverified
6PATHOSnet v2Accuracy80.4—Unverified
7Self-attention weight correction (A+T)Accuracy76.8—Unverified
8CHFusionAccuracy76.5—Unverified
9bc-LSTMWeighted F174.1—Unverified
10Audio + Text (Stage III)F170.5—Unverified
#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F166.71—Unverified
2Audio + Text (Stage III)Weighted F165.8—Unverified
3JoyfulWeighted F161.77—Unverified
#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F172.81—Unverified
2JoyfulWeighted F170.5—Unverified
#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F144.93—Unverified
#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F166.73—Unverified
#ModelMetricClaimedVerifiedStatus
1SMPLify-Xv2v error52.9—Unverified
#ModelMetricClaimedVerifiedStatus
1GraphSmileWeighted F174.31—Unverified