Constarium
← Search

Data · dataset · 2022

mbarnig/lb-de-fr-en-pt-12800-TTS-CORPUS

Listed in Hugging Face Datasets

Description

This custom multilingual-multispeaker TTS speech corpus contains 12.800 balanced samples with audio files (wav format sampled with 16000 Hz) and related transcriptions (csv format with two columns) from 18 speakers. The dataset has been assembled from the following sources: VCTK : 428 + 426 + 426 english male samples (p259, p274, p286) (CC BY 4.0) LJSpeech : 1280 english female samples (public domain) m-ailabs : 1280 french male samples (public free licence) SIWIS : 1024 french… See the full description on the dataset page: huggingface.co/datasets/mbarnig/lb-de-fr-en-pt-12800-TTS-CORPUS.

Links

Topics

Inferred from text
Audio 75%
Provenance · 1 source records, 9 field assertions
SourceKeyLast seenRaw
Hugging Face Datasetsmbarnig/lb-de-fr-en-pt-12800-TTS-CORPUS12 d agoJSON v1
FieldAssertionExtractorEvidence
access_levelsource · Hugging Faceconnector:huggingface@1.0.0/gated
concepts[field].local:field:computer-science-aimapping · Hugging Faceconnector:huggingface@1.0.0
concepts[modality].local:modality:audioenrichment · Hugging Facekeyword-concept-rules@1.0.0title+description (75%)
created_datesource · Hugging Faceconnector:huggingface@1.0.0
descriptionsource · Hugging Faceconnector:huggingface@1.0.0/description
licensesource · Hugging Faceconnector:huggingface@1.0.0/tags[license:*]
publication_datesource · Hugging Faceconnector:huggingface@1.0.0
titlesource · Hugging Faceconnector:huggingface@1.0.0/id
updated_datesource · Hugging Faceconnector:huggingface@1.0.0