ESC-50
Canonical15papers using it
2021first seen
2,000 labeled environmental-sound clips across 50 classes.
Papers using ESC-50 (15)
- Optimizing Neural Architectures for Hindi Speech Separation and Enhancement in Noisy EnvironmentsFrom Physics to Representation: Audio Learning with Synthetic Pre-training via Procedural GenerationWhisper-AuT: Domain-Adapted Audio Encoder for Efficient Audio-LLM TrainingAaSP: Aliasing-aware Self-Supervised Pre-Training for Audio Spectrogram TransformersAudio Super-Resolution with Latent Bridge ModelsImpairments are Clustered in Latents of Deep Neural Network-based Speech
Quality ModelsCMKD: CNN/Transformer-Based Cross-Model Knowledge Distillation for Audio
ClassificationHTS-AT: A Hierarchical Token-Semantic Audio Transformer for Sound
Classification and DetectionMasked Spectrogram Prediction For Self-Supervised Audio Pre-TrainingStudy of positional encoding approaches for Audio Spectrogram
TransformersSemanticAC: Semantics-Assisted Framework for Audio ClassificationAdapter Incremental Continual Learning of Efficient Audio Spectrogram
TransformersTransformer-based Sequence Labeling for Audio Classification based on
MFCCsOn the choice of the optimal temporal support for audio classification
with Pre-trained embeddingsEpisodic fine-tuning prototypical networks for optimization-based
few-shot learning: Application to audio classification