Automatic Speech Recognition (ASR)

Automatic Speech Recognition (ASR) involves converting spoken language into written text. It is designed to transcribe spoken words into text in real-time, allowing people to communicate with computers, mobile devices, and other technology using their voice. The goal of Automatic Speech Recognition is to accurately transcribe speech, taking into account variations in accent, pronunciation, and speaking style, as well as background noise and other factors that can affect speech quality.

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 2351–2400 of 3012 papers

Title	Date	Tasks	Status
Speaker Adaptation for Attention-Based End-to-End Speech Recognition	Nov 9, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A Simplified Fully Quantized Transformer for End-to-end Speech Recognition	Nov 9, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Europarl-ST: A Multilingual Corpus For Speech Translation Of Parliamentary Debates	Nov 8, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Investigation of Error Simulation Techniques for Learning Dialog Policies for Conversational Error Recovery	Nov 8, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A comparison of end-to-end models for long-form speech recognition	Nov 6, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
RNN-T For Latency Controlled ASR With Improved Beam Search	Nov 5, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
SHARP: An Adaptable, Energy-Efficient Accelerator for Recurrent Neural Network	Nov 4, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Data Augmentation for End-to-End Speech Translation: FBK@IWSLT ‘19	Nov 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Entity resolution for noisy ASR transcripts	Nov 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Chameleon: A Language Model Adaptation Toolkit for Automatic Speech Recognition of Conversational Speech	Nov 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Does Speech enhancement of publicly available data help build robust Speech Recognition Systems?	Oct 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Transformer-based Cascaded Multimodal Speech Translation	Oct 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving sequence-to-sequence speech recognition training with on-the-fly data augmentation	Oct 29, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Unsupervised pre-training for sequence to sequence speech recognition	Oct 28, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
DFSMN-SAN with Persistent Memory Model for Automatic Speech Recognition	Oct 28, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Sequence-to-sequence Automatic Speech Recognition with Word Embedding Regularization and Fused Decoding	Oct 28, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Meta Learning for End-to-End Low-Resource Speech Recognition	Oct 26, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Towards Online End-to-end Transformer Automatic Speech Recognition	Oct 25, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Confidence Estimation for Black Box Automatic Speech Recognition Systems Using Lattice Recurrent Neural Networks	Oct 25, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
L2RS: A Learning-to-Rescore Mechanism for Automatic Speech Recognition	Oct 25, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Analyzing the impact of speaker localization errors on speech separation for automatic speech recognition	Oct 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Recognizing long-form speech using streaming end-to-end models	Oct 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
ESPnet-TTS: Unified, Reproducible, and Integratable Open Source End-to-End Text-to-Speech Toolkit	Oct 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
Pre-training in Deep Reinforcement Learning for Automatic Speech Recognition	Oct 24, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A practical two-stage training strategy for multi-stream end-to-end speech recognition	Oct 23, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Correction of Automatic Speech Recognition with Transformer Sequence-to-sequence Model	Oct 23, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Analyzing ASR pretraining for low-resource speech-to-text translation	Oct 23, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
RNN based Incremental Online Spoken Language Understanding	Oct 23, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
G2G: TTS-Driven Pronunciation Learning for Graphemic Hybrid ASR	Oct 22, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Robust Neural Machine Translation for Clean and Noisy Speech Transcripts	Oct 22, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Word-level Embeddings for Cross-Task Transfer Learning in Speech Processing	Oct 22, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available
AeGAN: Time-Frequency Speech Denoising via Generative Adversarial Networks	Oct 21, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Neuro-SERKET: Development of Integrative Cognitive System through the Composition of Deep Probabilistic Generative Models	Oct 20, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Multi-Talker MVDR Beamforming Based on Extended Complex Gaussian Mixture Model	Oct 17, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Transformer ASR with Contextual Block Processing	Oct 16, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Lead2Gold: Towards exploiting the full potential of noisy transcriptions for speech recognition	Oct 16, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Analyzing Large Receptive Field Convolutional Networks for Distant Speech Recognition	Oct 15, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
VAIS ASR: Building a conversational speech recognition system using language model combination	Oct 12, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Hear "No Evil", See "Kenansville": Efficient and Transferable Black-Box Attacks on Speech Recognition and Voice Identification Systems	Oct 11, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Query-by-example on-device keyword spotting	Oct 11, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
One-To-Many Multilingual End-to-end Speech Translation	Oct 8, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
A Case Study on Combining ASR and Visual Features for Generating Instructional Video Captions	Oct 7, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Adapting a FrameNet Semantic Parser for Spoken Language Understanding Using Adversarial Learning	Oct 7, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Modeling Confidence in Sequence-to-Sequence Models	Oct 4, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Neural Zero-Inflated Quality Estimation Model For Automatic Speech Recognition System	Oct 3, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
From Senones to Chenones: Tied Context-Dependent Graphemes for Hybrid Speech Recognition	Oct 2, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
使用生成對抗網路於強健式自動語音辨識的應用(Exploiting Generative Adversarial Network for Robustness Automatic Speech Recognition)	Oct 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Multilingual End-to-End Speech Translation	Oct 1, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
End-to-End Code-Switching ASR for Low-Resourced Language Pairs	Sep 27, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified
Improving RNN Transducer Modeling for End-to-End Speech Recognition	Sep 26, 2019	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	CodeCode Available

Show:10 25 50

← PrevPage 48 of 61Next →

All datasets LRS2 RealMAN Sagalee HUI speech corpus LRS3-TED M-AILabs speech dataset The Spoken Wikipedia Corpora Voxforge German VoxPopuli

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	TM-CTC	Test WER	10.1	—	Unverified
2	TM-seq2seq	Test WER	9.7	—	Unverified
3	CTC/attention	Test WER	8.2	—	Unverified
4	LF-MMI TDNN	Test WER	6.7	—	Unverified
5	Whisper-LLaMA	Test WER	6.6	—	Unverified
6	End2end Conformer	Test WER	3.9	—	Unverified
7	End2end Conformer	Test WER	3.7	—	Unverified
8	MoCo + wav2vec (w/o extLM)	Test WER	2.7	—	Unverified
9	CTC/Attention	Test WER	1.5	—	Unverified
10	Whisper	Test WER	1.3	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SpatialNet	CER	14.5	—	Unverified
2	CleanMel-L-mask	CER	14.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer	Test WER	15.32	—	Unverified
2	Whisper-largev3-finetuned	Test WER	10.82	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	1.89	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DistillAV	WER	1.4	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	4.28	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	8.04	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer	WER (%)	3.36	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Conformer Transducer (German)	WER (%)	8.98	—	Unverified