Constarium
← Search

Data · dataset · 2025

IARPA Babel Telugu Language Pack IARPA-babel303b-v1.0a

Listed in UC Berkeley Library Dataverse

IARPA Babel Telugu Language Pack IARPA-babel303b-v1.0a was developed by Appen for the IARPA (Intelligence Advanced Research Projects Activity) Babel program.

Description

It contains approximately 201 hours of Telugu conversational and scripted telephone speech collected in 2013 and 2014 along with corresponding transcripts. The Babel program focuses on underserved languages and seeks to develop speech recognition technology that can be rapidly applied to any human language to support keyword search performance over large amounts of recorded speech.

Links

Where it is published

Catalogue records · 1

Topics

Stated by source
Social Sciences
From keywords
Social Science
Inferred from text
Audio 65%
Provenance · 1 source records, 9 field assertions
SourceKeyLast seenRaw
UC Berkeley Library Dataversedoi:10.60503/D3/ONGAPL8 d agoJSON v1
FieldAssertionExtractorEvidence
concepts[field].dataverse_subject:social-sciencessource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0/subjects
concepts[field].local:field:social-sciencemapping · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0/subjects
concepts[modality].local:modality:audioenrichment · datasets lib berkeley edukeyword-concept-rules@1.0.0title+description (65%)
created_datesource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0
descriptionsource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0/description
publication_datesource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0
titlesource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0/name
updated_datesource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0
version_labelsource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0