Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1251–1300 of 3012 papers

Title	Date	Tasks	Status
Can We Trust Explainable AI Methods on ASR? An Evaluation on Phoneme Recognition	May 29, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fine-Tuning Automatic Speech Recognition for People with Parkinson's: An Effective Strategy for Enhancing Speech Technology Accessibility	Sep 29, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A Recorded Debating Dataset	Sep 19, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fast Entropy-Based Methods of Word-Level Confidence Estimation for End-To-End Automatic Speech Recognition	Dec 16, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Can We Train a Language Model Inside an End-to-End ASR Model? - Investigating Effective Implicit Language Modeling	Oct 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
FastCorrect: Fast Error Correction with Edit Alignment for Automatic Speech Recognition	May 9, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Can Visual Context Improve Automatic Speech Recognition for an Embodied Agent?	Oct 21, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Adversarial Speaker Adaptation	Apr 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
FastCorrect 2: Fast Error Correction on Multiple Candidates for Automatic Speech Recognition	Sep 29, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Flexible Multichannel Speech Enhancement for Noise-Robust Frontend	Jun 6, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Flexi-Transducer: Optimizing Latency, Accuracy and Compute forMulti-Domain On-Device Scenarios	Apr 6, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
FluentNet: End-to-End Detection of Speech Disfluency with Deep Learning	Sep 23, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Focused Discriminative Training For Streaming CTC-Trained Automatic Speech Recognition Models	Aug 23, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Foreign English Accent Adjustment by Learning Phonetic Patterns	Jul 9, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fast Contextual Adaptation with Neural Associative Memory for On-Device Personalized Speech Recognition	Oct 5, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Free English and Czech telephone speech corpus shared under the CC-BY-SA 3.0 license	May 1, 2014	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Cantonese Automatic Speech Recognition Using Transfer Learning from Mandarin	Nov 21, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Frequency Domain Multi-channel Acoustic Modeling for Distant Speech Recognition	Apr 28, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Audio to Semantics: Approaches to end-to-end spoken language understanding	Sep 24, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From English to More Languages: Parameter-Efficient Model Reprogramming for Cross-Lingual Speech Recognition	Jan 19, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Human Language Technology to Human Language Science	Jul 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Senones to Chenones: Tied Context-Dependent Graphemes for Hybrid Speech Recognition	Oct 2, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Statistical Methods to Pre-Trained Models; A Survey on Automatic Speech Recognition for Resource Scarce Urdu Language	Nov 20, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fast Context-Biasing for CTC and Transducer ASR models with CTC-based Word Spotter	Jun 11, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fast and Robust Unsupervised Contextual Biasing for Speech Recognition	May 4, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Weak Labels to Strong Results: Utilizing 5,000 Hours of Noisy Classroom Transcripts with Minimal Accurate Data	May 20, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
FT Speech: Danish Parliament Speech Corpus	May 25, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Full-text Error Correction for Chinese Speech Recognition with Large Language Model	Sep 12, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A Wav2vec2-Based Experimental Study on Self-Supervised Learning Methods to Improve Child Speech Recognition	Apr 6, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fully Learnable Front-End for Multi-Channel Acoustic Modeling using Semi-Supervised Learning	Feb 1, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fully Neural Network Based Speech Recognition on Mobile and Embedded Devices	Dec 1, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Arabic Language WEKA-Based Dialect Classifier for Arabic Automatic Speech Recognition Transcripts	Dec 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fast and Accurate OOV Decoder on High-Level Features	Jul 19, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fusing ASR Outputs in Joint Training for Speech Emotion Recognition	Oct 29, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fast and Accurate Capitalization and Punctuation for Automatic Speech Recognition Using Transformer and Chunk Merging	Aug 7, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
FusionFormer: Fusing Operations in Transformer for Efficient Streaming Speech Recognition	Oct 31, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Falling silent, lost for words ... Tracing personal involvement in interviews with Dutch war veterans	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
G2G: TTS-Driven Pronunciation Learning for Graphemic Hybrid ASR	Oct 22, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Gated Recurrent Fusion with Joint Training Framework for Robust End-to-End Speech Recognition	Nov 9, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
G-Augment: Searching for the Meta-Structure of Data Augmentation Policies for ASR	Oct 19, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Calibration of Phone Likelihoods in Automatic Speech Recognition	Jun 14, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
GEC-RAG: Improving Generative Error Correction via Retrieval-Augmented Generation for Automatic Speech Recognition Systems	Jan 18, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Gender and Dialect Bias in YouTube's Automatic Captions	Apr 1, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Gender Representation in French Broadcast Corpora and Its Impact on ASR Performance	Aug 23, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Generating diverse and natural text-to-speech samples using a quantized fine-grained VAE and auto-regressive prosody prior	Feb 6, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Generating Human Readable Transcript for Automatic Speech Recognition with Pre-trained Language Model	Feb 22, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Adversarial Meta Sampling for Multilingual Low-Resource Speech Recognition	Dec 22, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Generating Synthetic Audio Data for Attention-Based Speech Recognition Systems	Dec 19, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A Conformer-based Waveform-domain Neural Acoustic Echo Canceller Optimized for ASR Accuracy	May 6, 2022	Acoustic echo cancellationAutomatic Speech Recognition	—Unverified
AccentDB: A Database of Non-Native English Accents to Assist Neural Speech Recognition	May 16, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 26 of 61Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified