Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 2026–2050 of 3012 papers

Title	Date	Tasks	Status
Speech Rate Calculations with Short Utterances: A Study from a Speech-to-Speech, Machine Translation Mediated Map Task	May 1, 2018	Automatic Speech Recognition (ASR)Machine Translation	—Unverified
Speech Recognition by Simply Fine-tuning BERT	Jan 30, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech recognition for air traffic control via feature learning and end-to-end training	Nov 4, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition for Automatically Assessing Afrikaans and isiXhosa Preschool Oral Narratives	Jan 11, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech recognition for medical conversations	Nov 20, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition Front End Without Information Loss	Dec 24, 2013	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition on TV Series with Video-guided Post-Correction	Jun 8, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition Rescoring with Large Speech-Text Foundation Models	Sep 25, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition Web Services for Dutch	May 1, 2014	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition with no speech or with noisy speech	Mar 2, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech recognition with quaternion neural networks	Nov 21, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition with Quaternion Neural Networks	Oct 15, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Reconstruction from Silent Tongue and Lip Articulation By Pseudo Target Generation and Domain Adversarial Training	Apr 12, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Retrieval-Augmented Generation without Automatic Speech Recognition	Dec 21, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Technology for Everyone: Automatic Speech Recognition for Non-Native English with Transfer Learning	Oct 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Technology for Everyone: Automatic Speech Recognition for Non-Native English	Nov 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech To Semantics: Improve ASR and NLU Jointly via All-Neural Interfaces	Aug 14, 2020	AllAutomatic Speech Recognition	—Unverified
Speech-to-SQL Parsing: Error Correction with Multi-modal Representations	Nov 16, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech-to-SQL: Towards Speech-driven SQL Query Generation From Natural Language Question	Jan 4, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech-T: Transducer for Text to Speech and Beyond	Dec 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Spelling Correction through Rewriting of Non-Autoregressive ASR Lattices	Sep 24, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
SpellMapper: A non-autoregressive neural spellchecker for ASR customization with candidate retrieval based on n-gram mappings	Jun 4, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Spell my name: keyword boosted speech recognition	Oct 6, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Spike-Triggered Contextual Biasing for End-to-End Mandarin Speech Recognition	Oct 7, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
SpliceOut: A Simple and Efficient Audio Augmentation Method	Sep 30, 2021	Audio ClassificationAutomatic Speech Recognition	—Unverified

Show:10 25 50

← PrevPage 82 of 121Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified