Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 2351–2400 of 3012 papers

Title	Date	Tasks	Status
Audio-attention discriminative language model for ASR rescoring	Dec 6, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Semantic Mask for Transformer based End-to-End Speech Recognition	Dec 6, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Kurdish (Sorani) Speech to Text: Presenting an Experimental Dataset	Nov 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Improving Voice Separation by Incorporating End-to-end Speech Recognition	Nov 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Designing the Next Generation of Intelligent Personal Robotic Assistants for the Physically Impaired	Nov 28, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
ASR is all you need: cross-modal distillation for lip reading	Nov 28, 2019	AllAutomatic Speech Recognition	—Unverified
ATCSpeech: a multilingual pilot-controller speech corpus from real Air Traffic Control environment	Nov 26, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Independent language modeling architecture for end-to-end ASR	Nov 25, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving EEG based Continuous Speech Recognition	Nov 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Cantonese Automatic Speech Recognition Using Transfer Learning from Mandarin	Nov 21, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
On using 2D sequence-to-sequence models for speech recognition	Nov 20, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
CAT: CRF-based ASR Toolkit	Nov 20, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Deep Spiking Neural Networks for Large Vocabulary Automatic Speech Recognition	Nov 19, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
3-D Feature and Acoustic Modeling for Far-Field Speech Recognition	Nov 13, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Privacy-Preserving Adversarial Representation Learning in ASR: Reality or Illusion?	Nov 12, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Data Efficient Direct Speech-to-Text Translation with Modality Agnostic Meta-Learning	Nov 11, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Listen and Fill in the Missing Letters: Non-Autoregressive Transformer for Speech Recognition	Nov 10, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Evaluating Voice Conversion-based Privacy Protection against Informed Attackers	Nov 10, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Speaker Adaptation for Attention-Based End-to-End Speech Recognition	Nov 9, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A Simplified Fully Quantized Transformer for End-to-end Speech Recognition	Nov 9, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Investigation of Error Simulation Techniques for Learning Dialog Policies for Conversational Error Recovery	Nov 8, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Europarl-ST: A Multilingual Corpus For Speech Translation Of Parliamentary Debates	Nov 8, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A comparison of end-to-end models for long-form speech recognition	Nov 6, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
RNN-T For Latency Controlled ASR With Improved Beam Search	Nov 5, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
SHARP: An Adaptable, Energy-Efficient Accelerator for Recurrent Neural Network	Nov 4, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Data Augmentation for End-to-End Speech Translation: FBK@IWSLT ‘19	Nov 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Entity resolution for noisy ASR transcripts	Nov 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Chameleon: A Language Model Adaptation Toolkit for Automatic Speech Recognition of Conversational Speech	Nov 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Transformer-based Cascaded Multimodal Speech Translation	Oct 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Does Speech enhancement of publicly available data help build robust Speech Recognition Systems?	Oct 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving sequence-to-sequence speech recognition training with on-the-fly data augmentation	Oct 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
DFSMN-SAN with Persistent Memory Model for Automatic Speech Recognition	Oct 28, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Unsupervised pre-training for sequence to sequence speech recognition	Oct 28, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Sequence-to-sequence Automatic Speech Recognition with Word Embedding Regularization and Fused Decoding	Oct 28, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Meta Learning for End-to-End Low-Resource Speech Recognition	Oct 26, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Confidence Estimation for Black Box Automatic Speech Recognition Systems Using Lattice Recurrent Neural Networks	Oct 25, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Towards Online End-to-end Transformer Automatic Speech Recognition	Oct 25, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
L2RS: A Learning-to-Rescore Mechanism for Automatic Speech Recognition	Oct 25, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Recognizing long-form speech using streaming end-to-end models	Oct 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Analyzing the impact of speaker localization errors on speech separation for automatic speech recognition	Oct 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Pre-training in Deep Reinforcement Learning for Automatic Speech Recognition	Oct 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
ESPnet-TTS: Unified, Reproducible, and Integratable Open Source End-to-End Text-to-Speech Toolkit	Oct 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
A practical two-stage training strategy for multi-stream end-to-end speech recognition	Oct 23, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Analyzing ASR pretraining for low-resource speech-to-text translation	Oct 23, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
RNN based Incremental Online Spoken Language Understanding	Oct 23, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Correction of Automatic Speech Recognition with Transformer Sequence-to-sequence Model	Oct 23, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Robust Neural Machine Translation for Clean and Noisy Speech Transcripts	Oct 22, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Word-level Embeddings for Cross-Task Transfer Learning in Speech Processing	Oct 22, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
G2G: TTS-Driven Pronunciation Learning for Graphemic Hybrid ASR	Oct 22, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
AeGAN: Time-Frequency Speech Denoising via Generative Adversarial Networks	Oct 21, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified

Show:10 25 50

← PrevPage 48 of 61Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified