SOTAVerified

Audio Signal Processing

This is a general task that covers transforming audio inputs into audio outputs, not limited to existing PaperWithCode categories of Source Separation, Denoising, Classification, Recognition, etc.

Papers

Showing 1–50 of 70 papers

TitleStatusHype
DiffusionRIR: Room Impulse Response Interpolation using Diffusion Models—0
TorchFX: A modern approach to Audio DSP with PyTorch and GPU accelerationCode2
Sound Field Estimation: Theories and Applications—0
Bridging The Multi-Modality Gaps of Audio, Visual and Linguistic for Speech Enhancement—0
Comparative Analysis of Mel-Frequency Cepstral Coefficients and Wavelet Based Audio Signal Processing for Emotion Detection and Mental Health Assessment in Spoken Speech—0
Detecting abnormal heart sound using mobile phones and on-device IConNet—0
Manikin-Recorded Cardiopulmonary Sounds Dataset Using Digital StethoscopeCode1
Blind Localization of Early Room Reflections with Arbitrary Microphone Array—0
Audio-Driven Reinforcement Learning for Head-Orientation in Naturalistic EnvironmentsCode0
Classification of Heart Sounds Using Multi-Branch Deep Convolutional Network and LSTM-CNN—0
Spectral Mapping of Singing Voices: U-Net-Assisted Vocal SegmentationCode1
AudioSetMix: Enhancing Audio-Language Datasets with LLM-Assisted Augmentations—0
Comparative Study of State-based Neural Networks for Virtual Analog Audio Effects Modeling—0
Overview of the L3DAS23 Challenge on Audio-Visual Extended Reality—0
A Survey on Data Augmentation in Large Model EraCode2
HAAQI-Net: A Non-intrusive Neural Music Audio Quality Assessment Model for Hearing AidsCode1
Unsupervised Harmonic Parameter Estimation Using Differentiable DSP and Spectral Optimal TransportCode1
Study of speaker localization under dynamic and reverberant environments—0
HPCNeuroNet: Advancing Neuromorphic Audio Signal Processing with Transformer-Enhanced Spiking Neural Networks—0
Neural Harmonium: An Interpretable Deep Structure for Nonlinear Dynamic System Identification with Application to Audio Processing—0
Speaker localization using direct path dominance test based on sound field directivity—0
Audio signal based danger detection using signal processing and deep learningCode0
Instabilities in Convnets for Raw AudioCode0
Neural Architectures Learning Fourier Transforms, Signal Processing and Much More....—0
Compositional nonlinear audio signal processing with Volterra series—0
MF-PAM: Accurate Pitch Estimation through Periodicity Analysis and Multi-level Feature FusionCode1
Acoustic Scene Clustering Using Joint Optimization of Deep Embedding Learning and Clustering Iteration—0
Subspace-Configurable NetworksCode0
Novel features for the detection of bearing faults in railway vehicles—0
Human Behavior in the Time of COVID-19: Learning from Big Data—0
Content Adaptive Front End For Audio Classification—0
MYRiAD: A Multi-Array Room Acoustic DatabaseCode0
A Comparison of Audio Preprocessing Techniques and Deep Learning Algorithms for Raga Recognition—0
High Fidelity Neural Audio CompressionCode4
A Unifying View on Blind Source Separation of Convolutive Mixtures based on Independent Component Analysis—0
Context-sensitive neocortical neurons transform the effectiveness and efficiency of neural information processing—0
Sound2Synth: Interpreting Sound via FM Synthesizer Parameters EstimationCode1
Declipping of Speech Signals Using Frequency Selective Extrapolation—0
Bi-Sampling Approach to Classify Music Mood leveraging Raga-Rasa Association in Indian Classical Music—0
Manifold learning-supported estimation of relative transfer functions for spatial filtering—0
Full Attention Bidirectional Deep Learning Structure for Single Channel Speech Enhancement—0
Blind Identification of State-Space Models in Physical Coordinates—0
Differentiable Signal Processing With Black-Box Audio EffectsCode1
BeamLearning: an end-to-end Deep Learning approach for the angular localization of sound sources using raw multichannel acoustic pressure data—0
Visualization of Linear Operations in the Spherical Harmonics DomainCode0
DeepSpectrumLite: A Power-Efficient Transfer Learning Framework for Embedded Speech and Audio Processing from Decentralised DataCode1
L3DAS21 Challenge: Machine Learning for 3D Audio Signal ProcessingCode1
Melon Playlist Dataset: a public dataset for audio-based playlist generation and music taggingCode0
A Survey on Deep Reinforcement Learning for Audio-Based Applications—0
Upsampling artifacts in neural audio synthesisCode1
Show:102550
← PrevPage 1 of 2Next →

No leaderboard results yet.