EuroParl-ST
Emerging4papers using it
2022first seen
Dataset Card for "Europarl-ST" Dataset Summary Europarl-ST is a Multilingual Speech Translation Corpus, that contains paired audio-text samples for Speech Translation, constructed using the debates carried out in the European Parliament in the period between 2008 and 2012. Languages Spanish, German, English, French, Du
Papers using EuroParl-ST (4)
- SpeechMatrix: A Large-Scale Mined Corpus of Multilingual
Speech-to-Speech TranslationsJoint Pre-Training with Speech and Bilingual Text for Direct Speech to
Speech TranslationNon-Parametric Domain Adaptation for End-to-End Speech TranslationSample, Translate, Recombine: Leveraging Audio Alignments for Data
Augmentation in End-to-end Speech Translation