Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 1376–1400 of 3012 papers

Title	Date	Tasks	Status
Hybrid Autoregressive Transducer (hat)	Mar 12, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Hybrid CTC-Attention based End-to-End Speech Recognition using Subword Units	Jul 13, 2018	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Comparison of Lattice-Free and Lattice-Based Sequence Discriminative Training Criteria for LVCSR	Jul 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Hybridized Feature Extraction and Acoustic Modelling Approach for Dysarthric Speech Recognition	Jun 6, 2015	Acoustic ModellingAutomatic Speech Recognition	—Unverified
Comparison of Self-Supervised Speech Pre-Training Methods on Flemish Dutch	Sep 29, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
H_eval: A new hybrid evaluation metric for automatic speech recognition tasks	Nov 3, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Hybrid Transducer and Attention based Encoder-Decoder Modeling for Speech-to-Text Tasks	May 4, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
An investigation of modularity for noise robustness in conformer-based ASR	Sep 9, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Enhancing Multilingual ASR for Unseen Languages via Language Embedding Modeling	Dec 21, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Hypothesis Stitcher for End-to-End Speaker-attributed ASR on Long-form Multi-talker Recordings	Jan 6, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Advanced Long-context End-to-end Speech Recognition Using Context-expanded Transformers	Apr 19, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
ICMC-ASR: The ICASSP 2024 In-Car Multi-Channel Automatic Speech Recognition Challenge	Jan 7, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Ideal-LLM: Integrating Dual Encoders and Language-Adapted LLM for Multilingual Speech-to-Text	Sep 17, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Identifying dialects with textual and acoustic cues	Apr 1, 2017	Automatic Speech Recognition (ASR)Speech Recognition	—Unverified
Identifying Introductions in Podcast Episodes from Automatically Generated Transcripts	Oct 14, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Identifying Teacher Questions Using Automatic Speech Recognition in Classrooms	Sep 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
IE-CPS Lexicon: An Automatic Speech Recognition Oriented Indian-English Pronunciation Dictionary	Dec 1, 2021	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
ILASR: Privacy-Preserving Incremental Learning for Automatic Speech Recognition at Production Scale	Jul 19, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Impact of ASR on Alzheimer's Disease Detection: All Errors are Equal, but Deletions are More Equal than Others	Apr 2, 2019	AllAlzheimer's Disease Detection	—Unverified
Impact of ASR on Alzheimer’s Disease Detection: All Errors are Equal, but Deletions are More Equal than Others	Nov 1, 2020	AllAutomatic Speech Recognition	—Unverified
Impact of Dataset on Acoustic Models for Automatic Speech Recognition	Mar 25, 2022	Acoustic ModellingAutomatic Speech Recognition	—Unverified
Impact of Experiencing Misrecognition by Teachable Agents on Learning and Rapport	Jun 11, 2023	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
ASR in German: A Detailed Error Analysis	Apr 12, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Importance of Different Temporal Modulations of Speech: A Tale of Two Perspectives	Mar 31, 2022	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Self-Supervised Learning for Multi-Channel Neural Transducer	Aug 6, 2024	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 56 of 121Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified