AVE
Emerging4papers using it
2025first seen
The 'AVE' dataset is used to evaluate multimodal tasks, specifically focusing on audio-visual interactions.
Papers using AVE (4)
- TB-AVA: Text as a Semantic Bridge for Audio-Visual Parameter Efficient FinetuningCoLA: Cross-Modal Low-rank Adaptation for Multimodal Downstream TasksCAE-AV: Improving Audio-Visual Learning via Cross-modal Interactive EnrichmentQuantifying Multimodal Imbalance: A GMM-Guided Adaptive Loss for Audio-Visual Learning