SOTAVerified

Audio Super-Resolution

Audio super-resolution, especially speech, refers to the process of reconstructing high-resolution music signals from their low-resolution counterparts. Essentially, it enhances the quality of a speech signal by increasing its sampling rate or bandwidth while preserving naturalness and intelligibility. A representative Github project for speech super-resolution is ClearerVoice-Studio.

Papers

No papers found.

Benchmark Results

#ModelMetricClaimedVerifiedStatus
1U-NetLog-Spectral Distance3.1—Unverified
2U-Net + TFiLMLog-Spectral Distance1.8—Unverified
3U-Net + AFiLMLog-Spectral Distance1.7—Unverified
4TUNetLog-Spectral Distance1.36—Unverified
5TUNet + MSM pre-trainingLog-Spectral Distance1.28—Unverified
6NVSRLog-Spectral Distance0.78—Unverified
7CMGANLog-Spectral Distance0.76—Unverified
#ModelMetricClaimedVerifiedStatus
1U-NetLog-Spectral Distance3.4—Unverified
2U-Net + TFiLMLog-Spectral Distance2—Unverified
3U-Net + AFiLMLog-Spectral Distance1.5—Unverified
#ModelMetricClaimedVerifiedStatus
1U-NetLog-Spectral Distance3.2—Unverified
2U-Net + TFiLMLog-Spectral Distance2.5—Unverified
3U-Net + AFiLMLog-Spectral Distance2.3—Unverified
#ModelMetricClaimedVerifiedStatus
1U-Net and ResNetSNR35.26—Unverified