Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 2901–2950 of 3012 papers

Title	Date	Tasks	Status
Developing language technology tools and resources for a resource-poor language: Sindhi	Jun 1, 2016	Automatic Speech Recognition (ASR)Machine Translation	—Unverified
An Empirical Study of Automatic Chinese Word Segmentation for Spoken Language Understanding and Named Entity Recognition	Jun 1, 2016	Automatic Speech Recognition (ASR)Chinese Word Segmentation	—Unverified
An Attentional Model for Speech Translation Without Transcription	Jun 1, 2016	Automatic Speech Recognition (ASR)model	—Unverified
Using Related Languages to Enhance Statistical Language Models	Jun 1, 2016	Automatic Speech Recognition (ASR)Domain Adaptation	—Unverified
A Joint Model of Orthography and Morphological Segmentation	Jun 1, 2016	Automatic Speech Recognition (ASR)Keyword Spotting	—Unverified
Phonological Pun-derstanding	Jun 1, 2016	Automatic Speech Recognition (ASR)Speech Recognition	—Unverified
Lecture Translator - Speech translation framework for simultaneous lecture translation	Jun 1, 2016	Automatic Speech Recognition (ASR)Machine Translation	—Unverified
The IBM Speaker Recognition System: Recent Advances and Error Analysis	May 5, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A Corpus of Read and Spontaneous Upper Saxon German Speech for ASR Evaluation	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Falling silent, lost for words ... Tracing personal involvement in interviews with Dutch war veterans	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Towards Automatic Transcription of ILSE â€• an Interdisciplinary Longitudinal Study of Adult Development and Aging	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
The SI TEDx-UM speech database: a new Slovenian Spoken Language Resource	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
The ILMT-s2s Corpus â€• A Multimodal Interlingual Map Task Corpus	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Enhanced CORILGA: Introducing the Automatic Phonetic Alignment Tool for Continuous Speech	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Generating Task-Pertinent sorted Error Lists for Speech Recognition	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
The DIRHA Portuguese Corpus: A Comparison of Home Automation Command Detection and Recognition in Simulated and Real Data.	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Operational Assessment of Keyword Search on Oral History	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Endangered Language Documentation: Bootstrapping a Chatino Speech Corpus, Forced Aligner, ASR	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A Comparative Analysis of Crowdsourced Natural Language Corpora for Spoken Dialog Systems	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Joining-in-type Humanoid Robot Assisted Language Learning System	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Using the TED Talks to Evaluate Spoken Post-editing of Machine Translation	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Collecting Resources in Sub-Saharan African Languages for Automatic Speech Recognition: a Case Study of Wolof	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Designing a Speech Corpus for the Development and Evaluation of Dictation Systems in Latvian	May 1, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Character-Level Neural Translation for Multilingual Media Monitoring in the SUMMA Project	Apr 5, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Adaptive Frequency Cepstral Coefficients for Word Mispronunciation Detection	Feb 25, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
The IBM 2016 Speaker Recognition System	Feb 23, 2016	2kAutomatic Speech Recognition	—Unverified
Signer-independent Fingerspelling Recognition with Deep Neural Network Adaptation	Feb 13, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Automatic recognition of element classes and boundaries in the birdsong with variable sequences	Jan 23, 2016	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Sparse Non-negative Matrix Language Modeling	Jan 1, 2016	Automatic Speech Recognition (ASR)Language Modeling	—Unverified
The 2015 Sheffield System for Transcription of Multi-Genre Broadcast Media	Dec 21, 2015	Acoustic ModellingAutomatic Speech Recognition	—Unverified
Spoken Language Translation for Polish	Nov 24, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Blending LSTMs into CNNs	Nov 19, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Enhancements in statistical spoken language translation by de-normalization of ASR results	Nov 18, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Latent Dirichlet Allocation Based Organisation of Broadcast Media Archives for Deep Neural Network Adaptation	Nov 16, 2015	Acoustic ModellingAutomatic Speech Recognition	—Unverified
Towards Structured Deep Neural Network for Automatic Speech Recognition	Nov 8, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
類神經網路訓練結合環境群集及專家混合系統於強健性語音辨識(Automatic Speech Recognition using Neural Network based Acoustic Model with the Environment Clustering and Mixture of Experts Algorithms) [In Chinese]	Oct 1, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Noise Robust IOA/CAS Speech Separation and Recognition System For The Third 'CHIME' Challenge	Sep 21, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
The USFD Spoken Language Translation System for IWSLT 2014	Sep 13, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Data-selective Transfer Learning for Multi-Domain Speech Recognition	Sep 8, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Unsupervised Domain Discovery using Latent Dirichlet Allocation for Acoustic Modelling in Speech Recognition	Sep 8, 2015	Acoustic ModellingAutomatic Speech Recognition	—Unverified
Enhancement and Recognition of Reverberant and Noisy Speech by Extending Its Coherence	Sep 2, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
EESEN: End-to-End Speech Recognition using Deep RNN Models and WFST-based Decoding	Jul 29, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Neural NILM: Deep Neural Networks Applied to Energy Disaggregation	Jul 23, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Incremental LSTM-based Dialog State Tracker	Jul 13, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Driving ROVER with Segment-based ASR Quality Estimation	Jul 1, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Nonparametric Bayesian Double Articulation Analyzer for Direct Language Acquisition from Continuous Speech Signals	Jun 22, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Recognize Foreign Low-Frequency Words with Similar Pairs	Jun 16, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Hybridized Feature Extraction and Acoustic Modelling Approach for Dysarthric Speech Recognition	Jun 6, 2015	Acoustic ModellingAutomatic Speech Recognition	—Unverified
Towards Structured Deep Neural Network for Automatic Speech Recognition	Jun 3, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Recurrent Neural Network Training with Dark Knowledge Transfer	May 18, 2015	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 59 of 61Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified