← all datasets

AudioCaps

Emerging
1papers using it
2024first seen

AudioCaps is a dataset that contains audio clips paired with descriptive captions, used to evaluate the performance of models in generating audio from textual descriptions.

Papers using AudioCaps (1)

AudioCaps β€” datasets β€” reinforcement-learning