Constarium
← Search

Data · dataset · 2022

Tibetan dialect speech synthesis dataset

Listed in ScienceDB

The dataset is compressed into Tibetan Dialect Speech Synthesis Data Set.zip.

Description

It comprises 3 large-size folders (ad, kb, wz), each large folder comprises 4 middle-size folders (e.g. ad1, ad2, ad3, and ad4 under ad), and each multiple-size folder comprises multiple small folders (e.g. ad1-1, ad1-2... ad1-10 under ad1), in which *.wav is voice data, and *.txt is text data. In total, the dataset includes: (1) 4684 *.wav audio files, with a total length of more than 10 hours and a data volume of 8.01GB, including 2.45GB for Amdo, 2.13GB for Kangba and 3.34GB for Weizang; (2) 65 *.txt text files, with data volume of 1.631MB, and a total of 4684 sentences. 

Links

Where it is published

Catalogue records · 1

Topics

Inferred from text
Audio 75% · Text 75%
Provenance · 1 source records, 12 field assertions
SourceKeyLast seenRaw
ScienceDB10.11922/sciencedb.j00001.003579 d agoJSON v1
FieldAssertionExtractorEvidence
access_levelsource · scidb cnconnector:scidb_cn@1.0.0
concepts[field].local:field:earth-environmentalmapping · scidb cnconnector:scidb_cn@1.0.0
concepts[field].local:field:engineeringmapping · scidb cnconnector:scidb_cn@1.0.0
concepts[field].local:field:humanitiesmapping · scidb cnconnector:scidb_cn@1.0.0
concepts[field].local:field:life-sciencesmapping · scidb cnconnector:scidb_cn@1.0.0
concepts[field].local:field:social-sciencemapping · scidb cnconnector:scidb_cn@1.0.0
concepts[modality].local:modality:audioenrichment · scidb cnkeyword-concept-rules@1.0.0title+description (75%)
concepts[modality].local:modality:textenrichment · scidb cnkeyword-concept-rules@1.0.0title+description (75%)
descriptionsource · scidb cnconnector:scidb_cn@1.0.0/metadata/dc/description
licensesource · scidb cnconnector:scidb_cn@1.0.0/metadata/dc/rights
publication_datesource · scidb cnconnector:scidb_cn@1.0.0
titlesource · scidb cnconnector:scidb_cn@1.0.0/metadata/dc/title