Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1251–1300 of 3012 papers

Title	Date	Tasks	Status
Cascade RNN-Transducer: Syllable Based Streaming On-device Mandarin Speech Recognition with a Syllable-to-Character Converter	Nov 17, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fine-Tuning Automatic Speech Recognition for People with Parkinson's: An Effective Strategy for Enhancing Speech Technology Accessibility	Sep 29, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fine-tuning pre-trained models for Automatic Speech Recognition, experiments on a fieldwork corpus of Japhug (Trans-Himalayan family)	May 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Articulatory and bottleneck features for speaker-independent ASR of dysarthric speech	May 16, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fine-Tuning Whisper for Inclusive Prosodic Stress Analysis	Mar 3, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
CASSANDRA: A multipurpose configurable voice-enabled human-computer-interface	Apr 1, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Environment-aware Reconfigurable Noise Suppression	Jan 29, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Entity resolution for noisy ASR transcripts	Nov 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Causal Analysis of ASR Errors for Children: Quantifying the Impact of Physiological, Cognitive, and Extrinsic Factors	Feb 12, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Flexible Multichannel Speech Enhancement for Noise-Robust Frontend	Jun 6, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Flexi-Transducer: Optimizing Latency, Accuracy and Compute forMulti-Domain On-Device Scenarios	Apr 6, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
FluentNet: End-to-End Detection of Speech Disfluency with Deep Learning	Sep 23, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Focused Discriminative Training For Streaming CTC-Trained Automatic Speech Recognition Models	Aug 23, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Foreign English Accent Adjustment by Learning Phonetic Patterns	Jul 9, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Blockwise Streaming Transformer for Spoken Language Understanding and Simultaneous Speech Translation	Apr 19, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Free English and Czech telephone speech corpus shared under the CC-BY-SA 3.0 license	May 1, 2014	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Entity Linking for Spoken Language	May 1, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Frequency Domain Multi-channel Acoustic Modeling for Distant Speech Recognition	Apr 28, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Audio to Semantics: Approaches to end-to-end spoken language understanding	Sep 24, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From English to More Languages: Parameter-Efficient Model Reprogramming for Cross-Lingual Speech Recognition	Jan 19, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Human Language Technology to Human Language Science	Jul 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Senones to Chenones: Tied Context-Dependent Graphemes for Hybrid Speech Recognition	Oct 2, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Statistical Methods to Pre-Trained Models; A Survey on Automatic Speech Recognition for Resource Scarce Urdu Language	Nov 20, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Ensemble knowledge distillation of self-supervised speech models	Feb 24, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Blind Signal Dereverberation for Machine Speech Recognition	Sep 30, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Weak Labels to Strong Results: Utilizing 5,000 Hours of Noisy Classroom Transcripts with Minimal Accurate Data	May 20, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
FT Speech: Danish Parliament Speech Corpus	May 25, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Full-text Error Correction for Chinese Speech Recognition with Large Language Model	Sep 12, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
An Investigation on Applying Acoustic Feature Conversion to ASR of Adult and Child Speech	May 25, 2022	AttributeAutomatic Speech Recognition	—Unverified
A Complementary Joint Training Approach Using Unpaired Speech and Text for Low-Resource Automatic Speech Recognition	Apr 5, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fully Neural Network Based Speech Recognition on Mobile and Embedded Devices	Dec 1, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Challenges of Computational Processing of Code-Switching	Oct 7, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fundamental Frequency Feature Normalization and Data Augmentation for Child Speech Recognition	Feb 18, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fusing ASR Outputs in Joint Training for Speech Emotion Recognition	Oct 29, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Efficiently Fusing Pretrained Acoustic and Linguistic Encoders for Low-resource Speech Recognition	Jan 17, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
FusionFormer: Fusing Operations in Transformer for Efficient Streaming Speech Recognition	Oct 31, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Fusion Models for Improved Visual Captioning	Oct 28, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
G2G: TTS-Driven Pronunciation Learning for Graphemic Hybrid ASR	Oct 22, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Gated Recurrent Fusion with Joint Training Framework for Robust End-to-End Speech Recognition	Nov 9, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
G-Augment: Searching for the Meta-Structure of Data Augmentation Policies for ASR	Oct 19, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Gaussian Kernelized Self-Attention for Long Sequence Data and Its Application to CTC-based Speech Recognition	Feb 18, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
GEC-RAG: Improving Generative Error Correction via Retrieval-Augmented Generation for Automatic Speech Recognition Systems	Jan 18, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Gender and Dialect Bias in YouTube's Automatic Captions	Apr 1, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Gender Representation in French Broadcast Corpora and Its Impact on ASR Performance	Aug 23, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Generating diverse and natural text-to-speech samples using a quantized fine-grained VAE and auto-regressive prosody prior	Feb 6, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Generating Human Readable Transcript for Automatic Speech Recognition with Pre-trained Language Model	Feb 22, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Generating Robust Audio Adversarial Examples using Iterative Proportional Clipping	Sep 25, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Generating Synthetic Audio Data for Attention-Based Speech Recognition Systems	Dec 19, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Ensemble Chinese End-to-End Spoken Language Understanding for Abnormal Event Detection from audio stream	Oct 19, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Enriching ASR Lattices with POS Tags for Dependency Parsing	Sep 1, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 26 of 61Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified