Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 2601–2650 of 3012 papers

Title	Date	Tasks	Status
Speech recognition for air traffic control via feature learning and end-to-end training	Nov 4, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition for Automatically Assessing Afrikaans and isiXhosa Preschool Oral Narratives	Jan 11, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech recognition for medical conversations	Nov 20, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition Front End Without Information Loss	Dec 24, 2013	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition on TV Series with Video-guided Post-Correction	Jun 8, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition Rescoring with Large Speech-Text Foundation Models	Sep 25, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition Web Services for Dutch	May 1, 2014	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition with no speech or with noisy speech	Mar 2, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech recognition with quaternion neural networks	Nov 21, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Recognition with Quaternion Neural Networks	Oct 15, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Reconstruction from Silent Tongue and Lip Articulation By Pseudo Target Generation and Domain Adversarial Training	Apr 12, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Retrieval-Augmented Generation without Automatic Speech Recognition	Dec 21, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Technology for Everyone: Automatic Speech Recognition for Non-Native English with Transfer Learning	Oct 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech Technology for Everyone: Automatic Speech Recognition for Non-Native English	Nov 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech To Semantics: Improve ASR and NLU Jointly via All-Neural Interfaces	Aug 14, 2020	AllAutomatic Speech Recognition	—Unverified
Speech-to-SQL Parsing: Error Correction with Multi-modal Representations	Nov 16, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech-to-SQL: Towards Speech-driven SQL Query Generation From Natural Language Question	Jan 4, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speech-T: Transducer for Text to Speech and Beyond	Dec 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Spelling Correction through Rewriting of Non-Autoregressive ASR Lattices	Sep 24, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
SpellMapper: A non-autoregressive neural spellchecker for ASR customization with candidate retrieval based on n-gram mappings	Jun 4, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Spell my name: keyword boosted speech recognition	Oct 6, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Spike-Triggered Contextual Biasing for End-to-End Mandarin Speech Recognition	Oct 7, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
SpliceOut: A Simple and Efficient Audio Augmentation Method	Sep 30, 2021	Audio ClassificationAutomatic Speech Recognition	—Unverified
Spoken Grammar Assessment Using LLM	Oct 2, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Spoken Language Translation for Polish	Nov 24, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
SpokesBiz -- an Open Corpus of Conversational Polish	Dec 19, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
SRU++: Pioneering Fast Recurrence with Attention for Speech Recognition	Oct 11, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
SSHR: Leveraging Self-supervised Hierarchical Representations for Multilingual Automatic Speech Recognition	Sep 29, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
SSNCSE_NLP@LT-EDI-ACL2022: Speech Recognition for Vulnerable Individuals in Tamil using pre-trained XLSR models	May 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Stabilising and accelerating light gated recurrent units for automatic speech recognition	Feb 16, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
StableEmit: Selection Probability Discount for Reducing Emission Latency of Streaming Monotonic Attention ASR	Jul 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
StableQuant: Layer Adaptive Post-Training Quantization for Speech Foundation Models	Apr 21, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Stacked Acoustic-and-Textual Encoding: Integrating the Pre-trained Models into Speech Translation Encoders	May 12, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
StarGAN-VC+ASR: StarGAN-based Non-Parallel Voice Conversion Regularized by Automatic Speech Recognition	Aug 10, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Start-Before-End and End-to-End: Neural Speech Translation by AppTek and RWTH Aachen University	Jul 1, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Statistical Beamformer Exploiting Non-stationarity and Sparsity with Spatially Constrained ICA for Robust Speech Recognition	Jun 13, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Statistical Testing on ASR Performance via Blockwise Bootstrap	Dec 19, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
STC Speaker Recognition Systems for the VOiCES From a Distance Challenge	Apr 12, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
STC speaker recognition systems for the NIST SRE 2021	Nov 3, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
STOP: A dataset for Spoken Task Oriented Semantic Parsing	Jun 29, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Stream attention-based multi-array end-to-end speech recognition	Nov 12, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Streaming Attention-Based Models with Augmented Memory for End-to-End Speech Recognition	Nov 3, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Streaming Audio-Visual Speech Recognition with Alignment Regularization	Nov 3, 2022	Audio-Visual Speech RecognitionAutomatic Speech Recognition	—Unverified
Streaming automatic speech recognition with the transformer model	Jan 8, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Streaming End-to-End ASR based on Blockwise Non-Autoregressive Models	Jul 20, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Streaming End-to-End Multilingual Speech Recognition with Joint Language Identification	Sep 13, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Streaming Target-Speaker ASR with Neural Transducer	Sep 9, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Streaming, fast and accurate on-device Inverse Text Normalization for Automatic Speech Recognition	Nov 7, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Streaming Models for Joint Speech Recognition and Translation	Jan 22, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Streaming Noise Context Aware Enhancement For Automatic Speech Recognition in Multi-Talker Environments	May 17, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 53 of 61Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified