Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 2326–2350 of 3012 papers

Title	Date	Tasks	Status	Hype
Continuous Speech Recognition using EEG and Video	Dec 16, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Synchronous Speech Recognition and Speech-to-Text Translation with Interactive Decoding	Dec 16, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available	0
Common Voice: A Massively-Multilingual Speech Corpus	Dec 13, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available	1
On Neural Phone Recognition of Mixed-Source ECoG Signals	Dec 12, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Leveraging End-to-End Speech Recognition with Neural Architecture Search	Dec 11, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
SpecAugment on Large Scale Datasets	Dec 11, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Audio-attention discriminative language model for ASR rescoring	Dec 6, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Semantic Mask for Transformer based End-to-End Speech Recognition	Dec 6, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available	0
Deep Contextualized Acoustic Representations For Semi-Supervised Speech Recognition	Dec 3, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available	1
Improving Voice Separation by Incorporating End-to-end Speech Recognition	Nov 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available	0
Kurdish (Sorani) Speech to Text: Presenting an Experimental Dataset	Nov 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available	0
Designing the Next Generation of Intelligent Personal Robotic Assistants for the Physically Impaired	Nov 28, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
ASR is all you need: cross-modal distillation for lip reading	Nov 28, 2019	AllAutomatic Speech Recognition	—Unverified	0
ATCSpeech: a multilingual pilot-controller speech corpus from real Air Traffic Control environment	Nov 26, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Independent language modeling architecture for end-to-end ASR	Nov 25, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Improving EEG based Continuous Speech Recognition	Nov 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Cantonese Automatic Speech Recognition Using Transfer Learning from Mandarin	Nov 21, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
On using 2D sequence-to-sequence models for speech recognition	Nov 20, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
CAT: CRF-based ASR Toolkit	Nov 20, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available	0
Deep Spiking Neural Networks for Large Vocabulary Automatic Speech Recognition	Nov 19, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available	0
3-D Feature and Acoustic Modeling for Far-Field Speech Recognition	Nov 13, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Privacy-Preserving Adversarial Representation Learning in ASR: Reality or Illusion?	Nov 12, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Data Efficient Direct Speech-to-Text Translation with Modality Agnostic Meta-Learning	Nov 11, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Listen and Fill in the Missing Letters: Non-Autoregressive Transformer for Speech Recognition	Nov 10, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Evaluating Voice Conversion-based Privacy Protection against Informed Attackers	Nov 10, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0

Show:10 25 50

← PrevPage 94 of 121Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified