SOTAVerified

Speech-to-Text Translation

Translate audio signals of speech in one language into text in a foreign language, either in an end-to-end or cascade manner.

Papers

Showing 76–100 of 146 papers

TitleStatusHype
Strategies for improving low resource speech to text translation relying on pre-trained ASR models—0
StreamAtt: Direct Streaming Speech-to-Text Translation with Attention-based Audio History Selection—0
Subtitles to Segmentation: Improving Low-Resource Speech-to-TextTranslation Pipelines—0
Subtitles to Segmentation: Improving Low-Resource Speech-to-Text Translation Pipelines—0
TASK AWARE MULTI-TASK LEARNING FOR SPEECH TO TEXT TASKS—0
The USFD Spoken Language Translation System for IWSLT 2014—0
Towards Measuring Fairness in AI: the Casual Conversations Dataset—0
Towards speech-to-text translation without speech recognition—0
Towards the evaluation of automatic simultaneous speech translation from a communicative perspective—0
Towards Unsupervised Speech-to-Text Translation—0
Unsupervised Cross-Modal Alignment of Speech and Text Embedding Spaces—0
Unveiling the Role of Pretraining in Direct Speech Translation—0
Using of heterogeneous corpora for training of an ASR system—0
When End-to-End is Overkill: Rethinking Cascaded Speech-to-Text Translation—0
XTREME-S: Evaluating Cross-lingual Speech Representations—0
A Comparative Study on End-to-end Speech to Text Translation—0
AdaST: Dynamically Adapting Encoder States in the Decoder for End-to-End Speech-to-Text Translation—0
Analyzing ASR pretraining for low-resource speech-to-text translation—0
An Experiment on Speech-to-Text Translation Systems for Manipuri to English on Low Resource Setting—0
A Survey on Speech Large Language Models—0
AudioPaLM: A Large Language Model That Can Speak and Listen—0
Balancing Speech Understanding and Generation Using Continual Pre-training for Codec-based Speech LLM—0
Bridging the Modality Gap for Speech-to-Text Translation—0
Can We Achieve High-quality Direct Speech-to-Speech Translation without Parallel Speech Data?—0
Cross-lingual topic prediction for speech using translations—0
Show:102550
← PrevPage 4 of 6Next →

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1Task Modulation + Multitask Learning(ASR/MT) + Data AugmentationCase-sensitive sacreBLEU28.88—Unverified
2Wav2Vec2.0+mBART+AdaptorsCase-sensitive sacreBLEU28.22—Unverified
3Transformer + Meta Learning(ASR/MT) + Data AugmentationCase-sensitive sacreBLEU27.51—Unverified
4Transformer with AdaptersCase-sensitive sacreBLEU24.63—Unverified
5Dual-decoder TransformerCase-sensitive sacreBLEU23.63—Unverified
6SpeechformerCase-sensitive sacreBLEU23.6—Unverified
7Transformer + ASR PretrainCase-sensitive sacreBLEU22.8—Unverified
8Transformer + ASR PretrainCase-sensitive sacreBLEU22.7—Unverified
#ModelMetricClaimedVerifiedStatus
1Transformer with AdaptersCase-sensitive sacreBLEU28.73—Unverified
2SpeechformerCase-sensitive sacreBLEU28.5—Unverified
3Dual-decoder TransformerCase-sensitive sacreBLEU28.12—Unverified
4Transformer + ASR Pretrain + SpecAugCase-sensitive sacreBLEU27.4—Unverified
5Transformer + ASR PretrainCase-sensitive sacreBLEU26.8—Unverified
#ModelMetricClaimedVerifiedStatus
1Dual-decoder TransformerCase-sensitive sacreBLEU33.45—Unverified
2Transformer + ASR Pretrain + SpecAugCase-sensitive sacreBLEU33.3—Unverified
3Transformer + ASR PretrainCase-sensitive sacreBLEU32.3—Unverified
#ModelMetricClaimedVerifiedStatus
1SeamlessM4T LargeBLEU30.6—Unverified
2SeamlessM4T MediumBLEU26.6—Unverified
#ModelMetricClaimedVerifiedStatus
1SeamlessM4T LargeBLEU34.1—Unverified
2SeamlessM4T MediumBLEU29.8—Unverified
#ModelMetricClaimedVerifiedStatus
1SeamlessM4T LargeBLEU21.5—Unverified
2SeamlessM4T MediumBLEU19.2—Unverified
#ModelMetricClaimedVerifiedStatus
1SeamlessM4T LargeBLEU24—Unverified
2SeamlessM4T MediumBLEU20.9—Unverified
#ModelMetricClaimedVerifiedStatus
1Transformer + ASR Pretrain + SpecAugCase-insensitive sacreBLEU17.2—Unverified
2Transformer + ASR PretrainCase-insensitive sacreBLEU16.5—Unverified
#ModelMetricClaimedVerifiedStatus
1MediBeng Whisper TinyBleu0.98—Unverified
2Whisper TinyBleu0.3—Unverified
#ModelMetricClaimedVerifiedStatus
1Transformer with AdaptersSacreBLEU26.61—Unverified
2Dual-decoder TransformerSacreBLEU25.62—Unverified
#ModelMetricClaimedVerifiedStatus
1SpeechformerCase-sensitive sacreBLEU27.7—Unverified