SOTAVerified

Speech-to-Text Translation

Translate audio signals of speech in one language into text in a foreign language, either in an end-to-end or cascade manner.

Papers

Showing 76–100 of 146 papers

TitleStatusHype
Revisiting End-to-End Speech-to-Text Translation From Scratch—0
PaddleSpeech: An Easy-to-Use All-in-One Speech ToolkitCode6
SAMU-XLSR: Semantically-Aligned Multimodal Utterance-level Cross-Lingual Speech Representation—0
Cross-modal Contrastive Learning for Speech TranslationCode1
Wav2Seq: Pre-training Speech-to-Text Encoder-Decoder Models Using Pseudo LanguagesCode1
Learning Adaptive Segmentation Policy for End-to-End Simultaneous Translation—0
NAIST Simultaneous Speech-to-Text Translation System for IWSLT 2022—0
LibriS2S: A German-English Speech-to-Speech Translation CorpusCode0
Enhanced Direct Speech-to-Speech Translation Using Self-supervised Pre-training and Data Augmentation—0
XTREME-S: Evaluating Cross-lingual Speech Representations—0
STEMM: Self-learning with Speech-text Manifold Mixup for Speech TranslationCode1
A^3T: Alignment-Aware Acoustic and Text Pretraining for Speech Synthesis and EditingCode1
SHAS: Approaching optimal Segmentation for End-to-End Speech TranslationCode1
CVSS Corpus and Massively Multilingual Speech-to-Speech TranslationCode2
Regularizing End-to-End Speech Translation with Triangular Decomposition AgreementCode1
Cross-modal Contrastive Learning for Speech Translation—0
Improve Sinhala Speech Recognition Through e2e LF-MMI Model—0
An Experiment on Speech-to-Text Translation Systems for Manipuri to English on Low Resource Setting—0
Decision Attentive Regularization to Improve Simultaneous Speech Translation Systems—0
Learning When to Translate for Streaming SpeechCode1
Speechformer: Reducing Information Loss in Direct Speech TranslationCode0
Infusing Future Information into Monotonic Attention Through Language Models—0
Improving Speech Translation by Understanding and Learning from the Auxiliary Text Translation Task—0
Pay Better Attention to Attention: Head Selection in Multilingual and Multi-Domain Sequence Modeling—0
Direct Simultaneous Speech-to-Text Translation Assisted by Synchronized Streaming ASR—0
Show:102550
← PrevPage 4 of 6Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1Task Modulation + Multitask Learning(ASR/MT) + Data AugmentationCase-sensitive sacreBLEU28.88—Unverified
2Wav2Vec2.0+mBART+AdaptorsCase-sensitive sacreBLEU28.22—Unverified
3Transformer + Meta Learning(ASR/MT) + Data AugmentationCase-sensitive sacreBLEU27.51—Unverified
4Transformer with AdaptersCase-sensitive sacreBLEU24.63—Unverified
5Dual-decoder TransformerCase-sensitive sacreBLEU23.63—Unverified
6SpeechformerCase-sensitive sacreBLEU23.6—Unverified
7Transformer + ASR PretrainCase-sensitive sacreBLEU22.8—Unverified
8Transformer + ASR PretrainCase-sensitive sacreBLEU22.7—Unverified
#ModelMetricClaimedVerifiedStatus
1Transformer with AdaptersCase-sensitive sacreBLEU28.73—Unverified
2SpeechformerCase-sensitive sacreBLEU28.5—Unverified
3Dual-decoder TransformerCase-sensitive sacreBLEU28.12—Unverified
4Transformer + ASR Pretrain + SpecAugCase-sensitive sacreBLEU27.4—Unverified
5Transformer + ASR PretrainCase-sensitive sacreBLEU26.8—Unverified
#ModelMetricClaimedVerifiedStatus
1Dual-decoder TransformerCase-sensitive sacreBLEU33.45—Unverified
2Transformer + ASR Pretrain + SpecAugCase-sensitive sacreBLEU33.3—Unverified
3Transformer + ASR PretrainCase-sensitive sacreBLEU32.3—Unverified
#ModelMetricClaimedVerifiedStatus
1SeamlessM4T LargeBLEU30.6—Unverified
2SeamlessM4T MediumBLEU26.6—Unverified
#ModelMetricClaimedVerifiedStatus
1SeamlessM4T LargeBLEU34.1—Unverified
2SeamlessM4T MediumBLEU29.8—Unverified
#ModelMetricClaimedVerifiedStatus
1SeamlessM4T LargeBLEU21.5—Unverified
2SeamlessM4T MediumBLEU19.2—Unverified
#ModelMetricClaimedVerifiedStatus
1SeamlessM4T LargeBLEU24—Unverified
2SeamlessM4T MediumBLEU20.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Transformer + ASR Pretrain + SpecAugCase-insensitive sacreBLEU17.2—Unverified
2Transformer + ASR PretrainCase-insensitive sacreBLEU16.5—Unverified
#ModelMetricClaimedVerifiedStatus
1MediBeng Whisper TinyBleu0.98—Unverified
2Whisper TinyBleu0.3—Unverified
#ModelMetricClaimedVerifiedStatus
1Transformer with AdaptersSacreBLEU26.61—Unverified
2Dual-decoder TransformerSacreBLEU25.62—Unverified
#ModelMetricClaimedVerifiedStatus
1SpeechformerCase-sensitive sacreBLEU27.7—Unverified