SOTAVerified

Spoken Language Understanding

Papers

Showing 1–25 of 550 papers

TitleStatusHype
MMSU: A Massive Multi-task Spoken Language Understanding and Reasoning BenchmarkCode7
LauraGPT: Listen, Attend, Understand, and Regenerate Audio with GPTCode2
SyllableLM: Learning Coarse Semantic Units for Speech Language ModelsCode2
Speech Model Pre-training for End-to-End Spoken Language UnderstandingCode2
Using Speech Synthesis to Train End-to-End Spoken Language Understanding ModelsCode2
Large Language Models for Expansion of Spoken Language Understanding Systems to New LanguagesCode1
Injecting Word Information with Multi-Level Word Adapter for Chinese Spoken Language UnderstandingCode1
Jointly Encoding Word Confusion Network and Dialogue Context with BERT for Spoken Language UnderstandingCode1
ESPnet-ONNX: Bridging a Gap Between Research and ProductionCode1
Contrastive Learning for Improving ASR Robustness in Spoken Language UnderstandingCode1
Adapting Pretrained Transformer to Lattices for Spoken Language UnderstandingCode1
ITALIC: An Italian Intent Classification DatasetCode1
Joint Multiple Intent Detection and Slot Filling with Supervised Contrastive Learning and Self-DistillationCode1
Knowledge Distillation from BERT Transformer to Speech Transformer for Intent ClassificationCode1
ESPnet-SLU: Advancing Spoken Language Understanding through ESPnetCode1
BLSP: Bootstrapping Language-Speech Pre-training via Behavior Alignment of Continuation WritingCode1
A Survey on Spoken Language Understanding: Recent Advances and New FrontiersCode1
Bootstrapping meaning through listening: Unsupervised learning of spoken sentence embeddingsCode1
A Co-Interactive Transformer for Joint Slot Filling and Intent DetectionCode1
Comparative layer-wise analysis of self-supervised speech modelsCode1
Cross-lingual Spoken Language Understanding with Regularized Representation AlignmentCode1
Data Augmentation for Spoken Language Understanding via Pretrained Language ModelsCode1
A Label-Aware BERT Attention Network for Zero-Shot Multi-Intent Detection in Spoken Language UnderstandingCode1
A Hierarchical Decoding Model For Spoken Language Understanding From Unaligned DataCode1
AISHELL-NER: Named Entity Recognition from Chinese SpeechCode1
Show:102550
← PrevPage 1 of 22Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1Finstreder (Conformer + AMT, character-based)Accuracy (%)99.8—Unverified
2UniverSLUAccuracy (%)99.8—Unverified
3E2E SLP two-stepAccuracy (%)99.7—Unverified
4textual-kd-sluAccuracy (%)99.7—Unverified
5Wav2Vec2.0-ClassifierAccuracy (%)99.7—Unverified
6Finstreder (Quartznet + AMT)Accuracy (%)99.7—Unverified
7Wav2vec 2.0 SSLAccuracy (%)99.6—Unverified
8Finstreder (Conformer)Accuracy (%)99.5—Unverified
9AT-ATAccuracy (%)99.5—Unverified
10BERT, AC PretrainingAccuracy (%)99.4—Unverified
#ModelMetricClaimedVerifiedStatus
1Finstreder (Conformer, character-based)Accuracy (%)89—Unverified
2Finstreder (Conformer)Accuracy (%)88—Unverified
3AT-ATAccuracy (%)84.9—Unverified
4Finstreder (Quartznet)Accuracy (%)84.8—Unverified
5SnipsAccuracy (%)84.2—Unverified
6GoogleAccuracy (%)79.3—Unverified
7Real + syntheticAccuracy (%)71.4—Unverified
#ModelMetricClaimedVerifiedStatus
1Finstreder (Conformer, character-based)Accuracy-EN (%)87.9—Unverified
2Finstreder (Conformer)Accuracy-EN (%)80.4—Unverified
3Finstreder (Quartznet)Accuracy-EN (%)77.6—Unverified
4SnipsAccuracy-EN (%)68.7—Unverified
5GoogleAccuracy-EN (%)47.8—Unverified
#ModelMetricClaimedVerifiedStatus
1ALBERTF1 score77.1—Unverified
2SpeechBERTF1 score71.75—Unverified
3QANet + GANF1 score63.11—Unverified
4BaselineF1 score58.71—Unverified
#ModelMetricClaimedVerifiedStatus
1Finstreder (Conformer)Accuracy (%)95.4—Unverified
2Finstreder (Quartznet)Accuracy (%)90—Unverified
3BaselineAccuracy (%)81.6—Unverified