Constarium
← Search

Data · dataset · 2025

Chinese Sentence Pattern Structure Treebank

Listed in UC Berkeley Library Dataverse

Chinese Sentence Pattern Structure Treebank (the SPS Treebank) was developed at Beijing Normal University and Peking University.

Description

It contains 5,016 sentences and 119,627 tokens syntactically annotated following the concept of sentence constituent analysis which emphasizes sentence pattern structure. This concept is based on linguist Jinxi Li's The New Chinese Grammar.

The source data consists of 27 chapters extracted from modern Mandarin and ancient Chinese works.

Links

Where it is published

Catalogue records · 1

Topics

Stated by source
Social Sciences
From keywords
Social Science
Provenance · 1 source records, 8 field assertions
SourceKeyLast seenRaw
UC Berkeley Library Dataversedoi:10.60503/D3/0CQSMN10 d agoJSON v1
FieldAssertionExtractorEvidence
concepts[field].dataverse_subject:social-sciencessource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0/subjects
concepts[field].local:field:social-sciencemapping · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0/subjects
created_datesource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0
descriptionsource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0/description
publication_datesource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0
titlesource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0/name
updated_datesource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0
version_labelsource · datasets lib berkeley educonnector:datasets_lib_berkeley_edu@1.0.0