Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 2301–2350 of 3012 papers

Title	Date	Tasks	Status
Global Performance Disparities Between English-Language Accents in Automatic Speech Recognition	Aug 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Performance Monitoring for End-to-End Speech Recognition	Apr 9, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Performant ASR Models for Medical Entities in Accented Speech	Jun 18, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
The Recognition Of Persian Phonemes Using PPNet	Dec 17, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
persoDA: Personalized Data Augmentation for Personalized ASR	Jan 15, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Adversarial Data Augmentation for Dysarthric and Elderly Speech Recognition	May 13, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Automatic Speech Recognition Trained on Small Disordered Speech Datasets	Oct 9, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Keyphrase Detection using Speaker and Environment Information	Apr 28, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Predictive ASR for Latency Reduction in Voice Assistants	May 23, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Query Rewriting in Conversational AI Agents	Nov 9, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Personalized Speech Recognition for Children with Test-Time Adaptation	Sep 19, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
DITTO: Data-efficient and Fair Targeted Subset Selection for ASR Accent Adaptation	Oct 10, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
PhaseFool: Phase-oriented Audio Adversarial Examples via Energy Dissipation	Sep 29, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phoneme-Based Contextualization for Cross-Lingual Speech Recognition in End-to-End Models	Jun 21, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phoneme Recognition with Large Hierarchical Reservoirs	Dec 1, 2010	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phone Merging For Code-Switched Speech Recognition	Jul 1, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phoneme transcription of endangered languages: an evaluation of recent ASR architectures in the single speaker scenario	May 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonemic and Graphemic Multilingual CTC Based Speech Recognition	Nov 13, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonemic Representation and Transcription for Speech to Text Applications for Under-resourced Indigenous African Languages: The Case of Kiswahili	Oct 29, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonemic Transcription of Low-Resource Languages: To What Extent can Preprocessing be Automated?	May 1, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonetically Balanced Code-Mixed Speech Corpus for Hindi-English Automatic Speech Recognition	May 1, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonetic and Graphemic Systems for Multi-Genre Broadcast Transcription	Feb 1, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonetic-assisted Multi-Target Units Modeling for Improving Conformer-Transducer ASR system	Nov 3, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Phonological Pun-derstanding	Jun 1, 2016	Automatic Speech Recognition (ASR)Speech Recognition	—Unverified
Pitch-Aware RNN-T for Mandarin Chinese Mispronunciation Detection and Diagnosis	Jun 7, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
PI-Whisper: Designing an Adaptive and Incremental Automatic Speech Recognition System for Edge Devices	Jun 21, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
pMCT: Patched Multi-Condition Training for Robust Speech Recognition	Jul 11, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
PM-MMUT: Boosted Phone-Mask Data Augmentation using Multi-Modeling Unit Training for Phonetic-Reduction-Robust E2E Speech Recognition	Dec 13, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Polyphonic pitch detection with convolutional recurrent neural networks	Feb 4, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Post-decoder Biasing for End-to-End Speech Recognition of Multi-turn Medical Interview	Mar 1, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Post-Stroke Speech Transcription Challenge (Task B): Correctness Detection in Anomia Diagnosis with Imperfect Transcripts	Jun 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
power-law nonlinearity with maximally uniform distribution criterion for improved neural network training in automatic speech recognition	Dec 22, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Practical Application of Domain Dependent Confidence Measurement for Spoken Language Understanding Systems	Jun 1, 2018	Automatic Speech Recognition (ASR)Feature Engineering	—Unverified
Practical Speech Recognition with HTK	Aug 6, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Precise Detection of Speech Endpoints Dynamically: A Wavelet Convolution based approach	Apr 17, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predicting Causes of Reformulation in Intelligent Assistants	Jul 13, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predicting Compact Phrasal Rewrites with Large Language Models for ASR Post Editing	Jan 23, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predicting lexical skills from oral reading with acoustic measures	Dec 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predicting Multi-Codebook Vector Quantization Indexes for Knowledge Distillation	Oct 31, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predicting positive transfer for improved low-resource speech recognition using acoustic pseudo-tokens	Feb 3, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Prediction of Listener Perception of Argumentative Speech in a Crowdsourced Dataset Using (Psycho-)Linguistic and Fluency Features	Nov 13, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Prediction of speech intelligibility with DNN-based performance measures	Mar 17, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predictive Speech Recognition and End-of-Utterance Detection Towards Spoken Dialog Systems	Sep 30, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Preliminary Study on SSCF-derived Polar Coordinate for ASR	Nov 30, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Preparation of Bangla Speech Corpus from Publicly Available Audio \& Text	May 1, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pretraining Approaches for Spoken Language Recognition: TalTech Submission to the OLR 2021 Challenge	May 14, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pre-training for Spoken Language Understanding with Joint Textual and Phonetic Representation Learning	Apr 21, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pre-training in Deep Reinforcement Learning for Automatic Speech Recognition	Oct 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pre-Training Transformer Decoder for End-to-End ASR Model with Unpaired Speech Data	Mar 31, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Privacy attacks for automatic speech recognition acoustic models in a federated learning framework	Nov 6, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 47 of 61Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified