Speech Enhancement

Speech Enhancement is a signal processing task that involves improving the quality of speech signals captured under noisy or degraded conditions. The goal of speech enhancement is to make speech signals clearer, more intelligible, and more pleasant to listen to, which can be used for various applications such as voice recognition, teleconferencing, and hearing aids. A representative Github project with online demo : ClearerVoice-Studio.

( Image credit: A Fully Convolutional Neural Network For Speech Enhancement )

Papers

Recently Added Most Hyped Most Active Needs Verification Most Verified

Showing 751–800 of 982 papers

Title	Date	Tasks	Status	Hype
Resource-Efficient Speech Mask Estimation for Multi-Channel Speech Enhancement	Jul 22, 2020	BIG-bench Machine LearningSpeech Enhancement	—Unverified	0
Instantaneous PSD Estimation for Speech Enhancement based on Generalized Principal Components	Jul 1, 2020	Speech Enhancement	CodeCode Available	1
CLC: Complex Linear Coding for the DNS 2020 Challenge	Jun 23, 2020	Speech Enhancement	CodeCode Available	1
Unsupervised Sound Separation Using Mixture Invariant Training	Jun 23, 2020	Domain AdaptationSpeech Enhancement	—Unverified	0
Real Time Speech Enhancement in the Waveform Domain	Jun 23, 2020	CPUData Augmentation	CodeCode Available	2
Boosting Objective Scores of a Speech Enhancement Model by MetricGAN Post-processing	Jun 18, 2020	Speech Enhancement	—Unverified	0
An Iterative Graph Spectral Subtraction Method for Speech Enhancement	Jun 15, 2020	Speech Enhancement	—Unverified	0
SE-MelGAN -- Speaker Agnostic Rapid Speech Enhancement	Jun 13, 2020	CPUGPU	—Unverified	0
HiFi-GAN: High-Fidelity Denoising and Dereverberation Based on Speech Deep Features in Adversarial Networks	Jun 10, 2020	DenoisingSpeech Dereverberation	CodeCode Available	1
A fully recurrent feature extraction for single channel speech enhancement	Jun 9, 2020	Speech Enhancement	CodeCode Available	0
A non-causal FFTNet architecture for speech enhancement	Jun 8, 2020	Speech Enhancement	CodeCode Available	1
Dilated U-net based approach for multichannel speech enhancement from First-Order Ambisonics recordings	Jun 2, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Phase-aware Single-stage Speech Denoising and Dereverberation with U-Net	Jun 1, 2020	DenoisingSpeech Denoising	CodeCode Available	0
Similarity-and-Independence-Aware Beamformer: Method for Target Source Extraction using Magnitude Spectrogram as Reference	Jun 1, 2020	Speech Enhancement	—Unverified	0
SNR-Based Teachers-Student Technique for Speech Enhancement	May 29, 2020	Speech Enhancement	—Unverified	0
Sub-Band Knowledge Distillation Framework for Speech Enhancement	May 29, 2020	Knowledge DistillationSpeech Enhancement	—Unverified	0
Noise Robust TTS for Low Resource Speakers using Pre-trained Model and Speech Enhancement	May 26, 2020	DecoderSpeech Enhancement	—Unverified	0
Lite Audio-Visual Speech Enhancement	May 24, 2020	Data CompressionDenoising	CodeCode Available	1
SERIL: Noise Adaptive Speech Enhancement using Regularization-based Incremental Learning	May 24, 2020	Incremental LearningSpeech Enhancement	CodeCode Available	1
TinyLSTMs: Efficient Neural Speech Enhancement for Hearing Aids	May 20, 2020	Model CompressionQuantization	CodeCode Available	1
The INTERSPEECH 2020 Deep Noise Suppression Challenge: Datasets, Subjective Testing Framework, and Challenge Results	May 16, 2020	Speech Enhancement	—Unverified	0
Sparse Mixture of Local Experts for Efficient Speech Enhancement	May 16, 2020	Speech DenoisingSpeech Enhancement	CodeCode Available	0
Speaker Re-identification with Speaker Dependent Speech Enhancement	May 15, 2020	Speaker RecognitionSpeech Enhancement	—Unverified	0
Adversarial Feature Learning and Unsupervised Clustering based Speech Synthesis for Found Data with Acoustic and Textual Noise	Apr 28, 2020	ClusteringData Augmentation	—Unverified	0
On the Role of Visual Cues in Audiovisual Speech Enhancement	Apr 25, 2020	Self-Supervised LearningSpeech Enhancement	—Unverified	0
Towards a Competitive End-to-End Speech Recognition for CHiME-6 Dinner Party Transcription	Apr 22, 2020	Data AugmentationSpeech Enhancement	CodeCode Available	0
CHiME-6 Challenge:Tackling Multispeaker Speech Recognition for Unsegmented Recordings	Apr 20, 2020	speaker-diarizationSpeaker Diarization	—Unverified	0
SNR-Based Features and Diverse Training Data for Robust DNN-Based Speech Enhancement	Apr 7, 2020	DiversitySpeech Enhancement	—Unverified	0
WaveCRN: An Efficient Convolutional Recurrent Neural Network for End-to-end Speech Enhancement	Apr 6, 2020	DenoisingSpeech Denoising	CodeCode Available	1
Characterizing Speech Adversarial Examples Using Self-Attention U-Net Enhancement	Mar 31, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Improving noise robust automatic speech recognition with single-channel time-domain enhancement network	Mar 9, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Tackling real noisy reverberant meetings with all-neural source separation, counting, and diarization system	Mar 9, 2020	Allspeaker-diarization	—Unverified	0
Phonetic Feedback for Speech Enhancement With and Without Parallel Speech Data	Mar 3, 2020	Speech Enhancement	CodeCode Available	1
Deep Residual-Dense Lattice Network for Speech Enhancement	Feb 27, 2020	Speech Enhancement	CodeCode Available	1
iSEGAN: Improved Speech Enhancement Generative Adversarial Networks	Feb 20, 2020	Speech Enhancement	CodeCode Available	1
Efficient Trainable Front-Ends for Neural Speech Enhancement	Feb 20, 2020	Speech Enhancement	—Unverified	0
Consistency-aware multi-channel speech enhancement using deep neural networks	Feb 14, 2020	Speech Enhancement	—Unverified	0
Speech Enhancement using Self-Adaptation and Multi-Head Self-Attention	Feb 14, 2020	Multi-Task LearningSpeaker Identification	—Unverified	0
Stable Training of DNN for Speech Enhancement based on Perceptually-Motivated Black-Box Cost Function	Feb 14, 2020	Reinforcement LearningSpeech Enhancement	—Unverified	0
Boosted Locality Sensitive Hashing: Discriminative Binary Codes for Source Separation	Feb 14, 2020	Binary ClassificationDenoising	CodeCode Available	0
DNN-Based Distributed Multichannel Mask Estimation for Speech Enhancement in Microphone Arrays	Feb 13, 2020	Speech Enhancement	—Unverified	0
Weighted Speech Distortion Losses for Neural-network-based Real-time Speech Enhancement	Feb 12, 2020	Speech Enhancement	CodeCode Available	1
Robust Multi-channel Speech Recognition using Frequency Aligned Network	Feb 6, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
Tensor-to-Vector Regression for Multi-channel Speech Enhancement based on Tensor-Train Network	Feb 3, 2020	regressionSpeech Enhancement	CodeCode Available	1
Single Channel Speech Enhancement Using Temporal Convolutional Recurrent Neural Networks	Feb 2, 2020	Speech Enhancement	—Unverified	0
Channel-Attention Dense U-Net for Multichannel Speech Enhancement	Jan 30, 2020	Speech Enhancement	CodeCode Available	1
Deep Xi as a Front-End for Robust Automatic Speech Recognition	Jan 28, 2020	Automatic Speech RecognitionAutomatic Speech Recognition (ASR)	—Unverified	0
CLCNet: Deep learning-based Noise Reduction for Hearing Aids using Complex Linear Coding	Jan 28, 2020	Speech Enhancement	—Unverified	0
Noise dependent Super Gaussian-Coherence based dual microphone Speech Enhancement for hearing aid application using smartphone	Jan 27, 2020	Speech Enhancement	—Unverified	0
The INTERSPEECH 2020 Deep Noise Suppression Challenge: Datasets, Subjective Speech Quality and Testing Framework	Jan 23, 2020	Speech Enhancement	—Unverified	0

Show:10 25 50

← PrevPage 16 of 20Next →

All datasets VoiceBank + DEMAND Deep Noise Suppression (DNS) Challenge CHiME-3 EARS-WHAM EasyCom DNS Challenge VB-DemandEx WHAMR!WSJ0 + DEMAND + RNNoise RealMAN VoiceBank+DEMAND DEMAND

Benchmark Results

#	Model	Metric	Claimed	Verified	Status
1	ROSE-CD(PESQ)	PESQ (wb)	3.99	—	Unverified
2	PESQetarian	PESQ (wb)	3.82	—	Unverified
3	Mamba-SEUNet L (+PCS)	PESQ (wb)	3.73	—	Unverified
4	Schrödinger bridge (PESQ loss)	PESQ (wb)	3.7	—	Unverified
5	SEMamba (+PCS)	PESQ (wb)	3.69	—	Unverified
6	ZipEnhancer (S, \lamba_6 = 0)	PESQ (wb)	3.63	—	Unverified
7	PrimeK-Net	PESQ (wb)	3.61	—	Unverified
8	ZipEnhancer (S, \lamba_6 = 0.2)	PESQ (wb)	3.61	—	Unverified
9	MP-SENet	PESQ (wb)	3.6	—	Unverified
10	PCS_CS_WAVLM	PESQ (wb)	3.54	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	BSRNN-S + MGD	SI-SDR-WB	21.4	—	Unverified
2	DTLN	SI-SDR-WB	16.34	—	Unverified
3	Non-Real-Time MultiScale+	SI-SDR-WB	16.22	—	Unverified
4	ZipEnhancer (M)	PESQ-WB	3.81	—	Unverified
5	TF-Locoformer (M)	PESQ-WB	3.72	—	Unverified
6	ZipEnhancer (S)	PESQ-WB	3.69	—	Unverified
7	MambAttention	PESQ-WB	3.67	—	Unverified
8	MP-SENet	PESQ-WB	3.62	—	Unverified
9	xLSTM-SENet	PESQ-WB	3.59	—	Unverified
10	BSRNN-S + MRSD	PESQ-WB	3.53	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Inter-Channel Conv-TasNet	SDR	19.67	—	Unverified
2	CA Dense U-Net (Complex)	SDR	18.64	—	Unverified
3	Dense U-Net (Complex)	SDR	18.4	—	Unverified
4	Dense U-Net (Real)	SDR	16.86	—	Unverified
5	U-Net (Real)	SDR	15.97	—	Unverified
6	Noisy/unprocessed	SDR	6.5	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Schrödinger Bridge (PESQ loss)	PESQ-WB	3.09	—	Unverified
2	SGMSE+	PESQ-WB	2.5	—	Unverified
3	Demucs v4	PESQ-WB	2.37	—	Unverified
4	Schrödinger Bridge	PESQ-WB	2.33	—	Unverified
5	Conv-TasNet	PESQ-WB	2.31	—	Unverified
6	CDiffuSE	PESQ-WB	1.6	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	ReVISE (ch2)	Audio Quality MOS	4.19	—	Unverified
2	ReVISE (bf)	Audio Quality MOS	4.11	—	Unverified
3	Demucs (ch2)	Audio Quality MOS	2.95	—	Unverified
4	Demucs (bf)	Audio Quality MOS	2.39	—	Unverified
5	MaxDI (Baseline)	PESQ	1.17	—	Unverified
6	DAJA (MVDR,HMA,1000) (Overlapped Speech)	SDR	-4.76	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	ZipEnhancer (M)	PESQ-NB	4.08	—	Unverified
2	DCCRN-MC	PESQ-NB	3.21	—	Unverified
3	DCCRN-M	PESQ-NB	3.15	—	Unverified
4	DCCRN	PESQ-NB	3.04	—	Unverified
5	RNN-Modulation	PESQ-WB	2.75	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	MambAttention	ESTOI	0.8	—	Unverified
2	SEMamba	ESTOI	0.8	—	Unverified
3	xLSTM-SENet	ESTOI	0.8	—	Unverified
4	MP-SENet	ESTOI	0.79	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SepFormer	PESQ	2.84	—	Unverified
2	DTLN	PESQ	2.23	—	Unverified
3	Unprocessed	PESQ	1.83	—	Unverified
4	Non-Real-Time MultiScale+	PESQ	1.52	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DCUNet-MC	PESQ-NB	3.44	—	Unverified
2	DCCRN-M	PESQ-NB	3.28	—	Unverified
3	DCUNet	PESQ-NB	3.25	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	CleanMel-L-map	DNSMOS	3.82	—	Unverified
2	SpatialNet	DNSMOS BAK	3.43	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	rose_cd(PESQ )	PESQ	3.99	—	Unverified
2	ROSE-CD	PESQ	3.49	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Wave-U-Net	CBAK	3.24	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Audio-Visual concat-ref	PESQ	2.7	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SE-MelGAN	Audio Quality MOS	3.1	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	DeFT-AN	PESQ	3.01	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	Audio-Visual concat-ref	PESQ	3.03	—	Unverified

#	Model	Metric	Claimed	Verified	Status
1	SepFormer	PESQ	3.07	—	Unverified