Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1351–1400 of 3012 papers

Title	Date	Tasks	Status
Homogeneous Speaker Features for On-the-Fly Dysarthric and Elderly Speaker Adaptation	Jul 8, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Homophone-based Label Smoothing in End-to-End Automatic Speech Recognition	Apr 7, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Houston we have a Divergence: A Subgroup Performance Analysis of ASR Models	Mar 31, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Enhancing Speech Large Language Models with Prompt-Aware Mixture of Audio Encoders	Feb 21, 2025	Audio captioningAutomatic Speech Recognition	—Unverified
Blending LSTMs into CNNs	Nov 19, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
How Bad Are Artifacts?: Analyzing the Impact of Speech Enhancement Errors on ASR	Jan 18, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
How does end-to-end speech recognition training impact speech enhancement artifacts?	Nov 20, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
An Investigation of Monotonic Transducers for Large-Scale Automatic Speech Recognition	Apr 19, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
How Might We Create Better Benchmarks for Speech Recognition?	Aug 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Comparative Analysis of the wav2vec 2.0 Feature Extractor	Aug 8, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
How to Learn a New Language? An Efficient Solution for Self-Supervised Learning Models Unseen Languages Adaption in Low-Resource Scenario	Nov 27, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
How to Scale Up Kernel Methods to Be As Good As Deep Neural Nets	Nov 14, 2014	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
How to Train Dependency Parsers with Inexact Search for Joint Sentence Boundary Detection and Parsing of Entire Documents	Aug 1, 2016	Automatic Speech Recognition (ASR)Boundary Detection	—Unverified
How transferable are features in convolutional neural network acoustic models across languages?	Oct 22, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Comparing Discrete and Continuous Space LLMs for Speech Recognition	Sep 1, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
HTEC: Human Transcription Error Correction	Sep 18, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Blending LLMs into Cascaded Speech Translation: KIT's Offline Speech Translation System for IWSLT 2024	Jun 24, 2024	Action DetectionActivity Detection	—Unverified
Experiments on Turkish ASR with Self-Supervised Speech Representation Learning	Oct 13, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Human and Automatic Speech Recognition Performance on German Oral History Interviews	Jan 18, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Human-Informed Speakers and Interpreters Analysis in the WAW Corpus and an Automatic Method for Calculating Interpreters' D\'ecalage	Sep 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Human Listening and Live Captioning: Multi-Task Training for Speech Enhancement	Jun 5, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Comparing Two Basic Methods for Discriminating Between Similar Languages and Varieties	Dec 1, 2016	Automatic Speech Recognition (ASR)General Classification	—Unverified
Huqariq: A Multilingual Speech Corpus of Native Languages of Peru for Speech Recognition	Jul 12, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Huqariq: A Multilingual Speech Corpus of Native Languages of Peru forSpeech Recognition	Jun 1, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Comparison of Grapheme-to-Phoneme Conversion Methods on a Myanmar Pronunciation Dictionary	Dec 1, 2016	Active LearningAutomatic Speech Recognition	—Unverified
Hybrid Autoregressive Transducer (hat)	Mar 12, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Hybrid CTC-Attention based End-to-End Speech Recognition using Subword Units	Jul 13, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Comparison of Lattice-Free and Lattice-Based Sequence Discriminative Training Criteria for LVCSR	Jul 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Hybridized Feature Extraction and Acoustic Modelling Approach for Dysarthric Speech Recognition	Jun 6, 2015	Acoustic ModellingAutomatic Speech Recognition	—Unverified
Comparison of Self-Supervised Speech Pre-Training Methods on Flemish Dutch	Sep 29, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
H_eval: A new hybrid evaluation metric for automatic speech recognition tasks	Nov 3, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Hybrid Transducer and Attention based Encoder-Decoder Modeling for Speech-to-Text Tasks	May 4, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
An investigation of modularity for noise robustness in conformer-based ASR	Sep 9, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling	Dec 21, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Hypothesis Stitcher for End-to-End Speaker-attributed ASR on Long-form Multi-talker Recordings	Jan 6, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Advanced Long-context End-to-end Speech Recognition Using Context-expanded Transformers	Apr 19, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
ICMC-ASR: The ICASSP 2024 In-Car Multi-Channel Automatic Speech Recognition Challenge	Jan 7, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Ideal-LLM: Integrating Dual Encoders and Language-Adapted LLM for Multilingual Speech-to-Text	Sep 17, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Identifying dialects with textual and acoustic cues	Apr 1, 2017	Automatic Speech Recognition (ASR)Speech Recognition	—Unverified
Identifying Introductions in Podcast Episodes from Automatically Generated Transcripts	Oct 14, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Identifying Teacher Questions Using Automatic Speech Recognition in Classrooms	Sep 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
IE-CPS Lexicon: An Automatic Speech Recognition Oriented Indian-English Pronunciation Dictionary	Dec 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
ILASR: Privacy-Preserving Incremental Learning for Automatic Speech Recognition at Production Scale	Jul 19, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Impact of ASR on Alzheimer's Disease Detection: All Errors are Equal, but Deletions are More Equal than Others	Apr 2, 2019	AllAlzheimer's Disease Detection	—Unverified
Impact of ASR on Alzheimer’s Disease Detection: All Errors are Equal, but Deletions are More Equal than Others	Nov 1, 2020	AllAutomatic Speech Recognition	—Unverified
Impact of Dataset on Acoustic Models for Automatic Speech Recognition	Mar 25, 2022	Acoustic ModellingAutomatic Speech Recognition	—Unverified
Impact of Experiencing Misrecognition by Teachable Agents on Learning and Rapport	Jun 11, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
ASR in German: A Detailed Error Analysis	Apr 12, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Importance of Different Temporal Modulations of Speech: A Tale of Two Perspectives	Mar 31, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Self-Supervised Learning for Multi-Channel Neural Transducer	Aug 6, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 28 of 61Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified