Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1726–1750 of 3012 papers

Title	Date	Tasks	Status
AeGAN: Time-Frequency Speech Denoising via Generative Adversarial Networks	Oct 21, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Performance Analysis of Speech Encoders for Low-Resource SLU and ASR in Tunisian Dialect	Jul 5, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Global Performance Disparities Between English-Language Accents in Automatic Speech Recognition	Aug 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Performance Monitoring for End-to-End Speech Recognition	Apr 9, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Performant ASR Models for Medical Entities in Accented Speech	Jun 18, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
The Recognition Of Persian Phonemes Using PPNet	Dec 17, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
persoDA: Personalized Data Augmentation for Personalized ASR	Jan 15, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Adversarial Data Augmentation for Dysarthric and Elderly Speech Recognition	May 13, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Automatic Speech Recognition Trained on Small Disordered Speech Datasets	Oct 9, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Keyphrase Detection using Speaker and Environment Information	Apr 28, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Predictive ASR for Latency Reduction in Voice Assistants	May 23, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Query Rewriting in Conversational AI Agents	Nov 9, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Speech Recognition for Children with Test-Time Adaptation	Sep 19, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
DITTO: Data-efficient and Fair Targeted Subset Selection for ASR Accent Adaptation	Oct 10, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
PhaseFool: Phase-oriented Audio Adversarial Examples via Energy Dissipation	Sep 29, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phoneme-Based Contextualization for Cross-Lingual Speech Recognition in End-to-End Models	Jun 21, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phoneme Recognition with Large Hierarchical Reservoirs	Dec 1, 2010	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phone Merging For Code-Switched Speech Recognition	Jul 1, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phoneme transcription of endangered languages: an evaluation of recent ASR architectures in the single speaker scenario	May 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonemic and Graphemic Multilingual CTC Based Speech Recognition	Nov 13, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonemic Representation and Transcription for Speech to Text Applications for Under-resourced Indigenous African Languages: The Case of Kiswahili	Oct 29, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonemic Transcription of Low-Resource Languages: To What Extent can Preprocessing be Automated?	May 1, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonetically Balanced Code-Mixed Speech Corpus for Hindi-English Automatic Speech Recognition	May 1, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonetic and Graphemic Systems for Multi-Genre Broadcast Transcription	Feb 1, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonetic-assisted Multi-Target Units Modeling for Improving Conformer-Transducer ASR system	Nov 3, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 70 of 121Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified