Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1401–1450 of 3012 papers

Title	Date	Tasks	Status
An Investigation of Monotonic Transducers for Large-Scale Automatic Speech Recognition	Apr 19, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Blending LLMs into Cascaded Speech Translation: KIT's Offline Speech Translation System for IWSLT 2024	Jun 24, 2024	Action DetectionActivity Detection	—Unverified
Improved Conformer-based End-to-End Speech Recognition Using Neural Architecture Search	Apr 12, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improved Consistency Training for Semi-Supervised Sequence-to-Sequence ASR via Speech Chain Reconstruction and Self-Transcribing	May 14, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improved Contextual Recognition In Automatic Speech Recognition Systems By Semantic Lattice Rescoring	Oct 14, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improved far-field speech recognition using Joint Variational Autoencoder	Apr 24, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
An investigation of modularity for noise robustness in conformer-based ASR	Sep 9, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improved low-resource Somali speech recognition by semi-supervised acoustic and language model training	Jul 6, 2019	Acoustic ModellingAutomatic Speech Recognition	—Unverified
Improved Mask-CTC for Non-Autoregressive End-to-End ASR	Oct 26, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling	Dec 21, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improved Robustness to Disfluencies in RNN-Transducer Based Speech Recognition	Dec 11, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improved Self-Supervised Multilingual Speech Representation Learning Combined with Auxiliary Language Information	Dec 7, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improved Speech Pre-Training with Supervision-Enhanced Acoustic Unit	Dec 7, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improved Training Techniques for Online Neural Machine Translation	Sep 25, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improved Transcription and Indexing of Oral History Interviews for Digital Humanities Research	May 1, 2018	Automatic Speech Recognition (ASR)Robust Speech Recognition	—Unverified
Improve Sinhala Speech Recognition Through e2e LF-MMI Model	Dec 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Advanced Long-context End-to-end Speech Recognition Using Context-expanded Transformers	Apr 19, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Accented Speech Recognition with Multi-Domain Training	Mar 14, 2023	Accented Speech RecognitionAutomatic Speech Recognition	—Unverified
Improving Accent Identification and Accented Speech Recognition Under a Framework of Self-supervised Learning	Sep 15, 2021	Accented Speech RecognitionAutomatic Speech Recognition	—Unverified
Improving accuracy of rare words for RNN-Transducer through unigram shallow fusion	Nov 30, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving ASR Contextual Biasing with Guided Attention	Jan 16, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Confusion2Vec: Towards Enriching Vector Space Word Representations with Representational Ambiguities	Nov 8, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Self-Supervised Learning for Multi-Channel Neural Transducer	Aug 6, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Black-box Speech Recognition using Semantic Parsing	Nov 1, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving callsign recognition with air-surveillance data in air-traffic communication	Aug 27, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Character Error Rate Is Not Equal to Having Clean Speech: Speech Enhancement for ASR Systems with Black-box Acoustic Models	Oct 12, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Code-switched ASR with Linguistic Information	Oct 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Code-Switching and Named Entity Recognition in ASR with Speech Editing based Data Augmentation	Jun 14, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Neural Biasing for Contextual Speech Recognition by Early Context Injection and Text Perturbation	Jul 14, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Confidence Estimation on Out-of-Domain Data for End-to-End Speech Recognition	Oct 7, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Contextual Spelling Correction by External Acoustics Attention and Semantic Aware Data Augmentation	Feb 22, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Cross-Lingual Transfer Learning for End-to-End Speech Recognition with Speech Translation	Jun 9, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving CTC-AED model with integrated-CTC and auxiliary loss regularization	Aug 15, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving CTC-based ASR Models with Gated Interlayer Collaboration	May 25, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Construction of a Large-scale Japanese ASR Corpus on TV Recordings	Mar 26, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Data Driven Inverse Text Normalization using Data Augmentation	Jul 20, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Distinction between ASR Errors and Speech Disfluencies with Feature Space Interpolation	Aug 4, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Dysarthric Speech Intelligibility Using Cycle-consistent Adversarial Training	Jan 10, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving EEG based Continuous Speech Recognition	Nov 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving End-to-End Bangla Speech Recognition with Semi-supervised Training	Nov 1, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving End-to-End Speech Processing by Efficient Text Data Utilization with Latent Synthesis	Oct 9, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving End-to-end Speech Recognition with Pronunciation-assisted Sub-word Modeling	Nov 10, 2018	Automatic Speech Recognition (ASR)speech-recognition	—Unverified
Enhancing Lyrics Transcription on Music Mixtures with Consistency Loss	Jun 3, 2025	Automatic Lyrics TranscriptionAutomatic Speech Recognition	—Unverified
Improving Fast-slow Encoder based Transducer with Streaming Deliberation	Dec 15, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Frame-level Classifier for Word Timings with Non-peaky CTC in End-to-End Automatic Speech Recognition	Jun 9, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Generalization of Deep Neural Network Acoustic Models with Length Perturbation and N-best Based Label Smoothing	Mar 29, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Hybrid CTC/Attention End-to-end Speech Recognition with Pretrained Acoustic and Language Model	Dec 14, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving Hypernasality Estimation with Automatic Speech Recognition in Cleft Palate Speech	Aug 10, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Enhancing Low-Resource ASR through Versatile TTS: Bridging the Data Gap	Oct 22, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
An Investigation of Hybrid architectures for Low Resource Multilingual Speech Recognition system in Indian context	Dec 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 29 of 61Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified