Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1751–1800 of 3012 papers

Title	Date	Tasks	Status
Phonological Pun-derstanding	Jun 1, 2016	Automatic Speech Recognition (ASR)Speech Recognition	—Unverified
Pitch-Aware RNN-T for Mandarin Chinese Mispronunciation Detection and Diagnosis	Jun 7, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
PI-Whisper: Designing an Adaptive and Incremental Automatic Speech Recognition System for Edge Devices	Jun 21, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
pMCT: Patched Multi-Condition Training for Robust Speech Recognition	Jul 11, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
PM-MMUT: Boosted Phone-Mask Data Augmentation using Multi-Modeling Unit Training for Phonetic-Reduction-Robust E2E Speech Recognition	Dec 13, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Polyphonic pitch detection with convolutional recurrent neural networks	Feb 4, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Post-decoder Biasing for End-to-End Speech Recognition of Multi-turn Medical Interview	Mar 1, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Post-Stroke Speech Transcription Challenge (Task B): Correctness Detection in Anomia Diagnosis with Imperfect Transcripts	Jun 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
power-law nonlinearity with maximally uniform distribution criterion for improved neural network training in automatic speech recognition	Dec 22, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Practical Application of Domain Dependent Confidence Measurement for Spoken Language Understanding Systems	Jun 1, 2018	Automatic Speech Recognition (ASR)Feature Engineering	—Unverified
Practical Speech Recognition with HTK	Aug 6, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Precise Detection of Speech Endpoints Dynamically: A Wavelet Convolution based approach	Apr 17, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predicting Causes of Reformulation in Intelligent Assistants	Jul 13, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predicting Compact Phrasal Rewrites with Large Language Models for ASR Post Editing	Jan 23, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predicting lexical skills from oral reading with acoustic measures	Dec 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predicting Multi-Codebook Vector Quantization Indexes for Knowledge Distillation	Oct 31, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predicting positive transfer for improved low-resource speech recognition using acoustic pseudo-tokens	Feb 3, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Prediction of Listener Perception of Argumentative Speech in a Crowdsourced Dataset Using (Psycho-)Linguistic and Fluency Features	Nov 13, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Prediction of speech intelligibility with DNN-based performance measures	Mar 17, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Predictive Speech Recognition and End-of-Utterance Detection Towards Spoken Dialog Systems	Sep 30, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Preliminary Study on SSCF-derived Polar Coordinate for ASR	Nov 30, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Preparation of Bangla Speech Corpus from Publicly Available Audio \& Text	May 1, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pretraining Approaches for Spoken Language Recognition: TalTech Submission to the OLR 2021 Challenge	May 14, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pre-training for Spoken Language Understanding with Joint Textual and Phonetic Representation Learning	Apr 21, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pre-training in Deep Reinforcement Learning for Automatic Speech Recognition	Oct 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pre-Training Transformer Decoder for End-to-End ASR Model with Unpaired Speech Data	Mar 31, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Privacy attacks for automatic speech recognition acoustic models in a federated learning framework	Nov 6, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Privacy-Preserving Adversarial Representation Learning in ASR: Reality or Illusion?	Nov 12, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Private Language Model Adaptation for Speech Recognition	Sep 28, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Probing self-attention in self-supervised speech models for cross-linguistic differences	Sep 4, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Probing Speech Emotion Recognition Transformers for Linguistic Knowledge	Apr 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Probing Statistical Representations For End-To-End ASR	Nov 3, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Probing the Information Encoded in Neural-based Acoustic Models of Automatic Speech Recognition Systems	Feb 29, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
PROCTER: PROnunciation-aware ConTextual adaptER for personalized speech recognition in neural transducers	Mar 30, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
PRoDeliberation: Parallel Robust Deliberation for End-to-End Spoken Language Understanding	Jun 12, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Progress in Multilingual Speech Recognition for Low Resource Languages Kurmanji Kurdish, Cree and Inuktut	Jun 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Progressive Down-Sampling for Acoustic Encoding	Nov 16, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Progressive Joint Modeling in Unsupervised Single-channel Overlapped Speech Recognition	Jul 21, 2017	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Progressive Multi-Scale Self-Supervised Learning for Speech Recognition	Dec 7, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Progressive unsupervised domain adaptation for ASR using ensemble models and multi-stage training	Feb 7, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Promptformer: Prompted Conformer Transducer for ASR	Jan 14, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Prompting Large Language Models with Speech Recognition Abilities	Jul 21, 2023	Abstractive Text SummarizationAutomatic Speech Recognition	—Unverified
Prompting Whisper for Improved Verbatim Transcription and End-to-end Miscue Detection	May 29, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pronunciation-aware unique character encoding for RNN Transducer-based Mandarin speech recognition	Jul 29, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pronunciation Dictionary-Free Multilingual Speech Synthesis by Combining Unsupervised and Supervised Phonetic Representations	Jun 2, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pronunciation Modeling of Foreign Words for Mandarin ASR by Considering the Effect of Language Transfer	Oct 7, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Pronunciation Variants and ASR of Colloquial Speech: A Case Study on Czech	May 1, 2018	Automatic Speech Recognition (ASR)Speech Recognition	—Unverified
Pseudo Label Is Better Than Human Label	Mar 22, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
PSRB: A Comprehensive Benchmark for Evaluating Persian ASR Systems	May 27, 2025	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Punctuation Prediction in Spontaneous Conversations: Can We Mitigate ASR Errors with Retrofitted Word Embeddings?	Apr 13, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 36 of 61Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified