Data · dataset · 2024
Adaptación a lenguaje claro de fraseología administrativa
Listed in e-cienciaDatos
Description
Descripción del proyecto El contenido de este dataset es resultado de la investigación llevada a cabo en el proyecto "Tecnologías de la Información y la Comunicación para la e-Administración: hacia la mejora de la comunicación entre Administración y ciudadanía a través del lenguaje claro" (TIC-eADMIN), cuyo principal objetivo era desarrollar, en el contexto de la e-Administración, una herramienta TIC en línea de ayuda a la redacción de textos administrativos en español por parte de empleados públicos, para contribuir a que los textos que reciba la ciudadanía estén redactados en lenguaje claro.
Esta herramienta ya se ha desarrollado y puede utilizarse gratuitamente en línea desde el siguiente enlace: www.sistema-artext.com. Asimismo, uno de los objetivos específicos del proyecto era analizar y sistematizar los rasgos lingüísticos prototípicos de algunos géneros textuales del ámbito de la Administración. Descripción del dataset Este dataset contiene un único fichero.
Read the rest (11 more)
En ese fichero se incluyen cinco fichas con información lingüística a nivel textual sobre los apartados y los contenidos prototípicos de cinco géneros textuales del ámbito de la Administración pública española. Además, a nivel léxico, incluye una selección de frases extraídas de un corpus de textos reales que se puede utilizar para expresar esos contenidos, así como la adaptación de esas frases a las principales recomendaciones de lenguaje claro para el español.
Para cada par de frases (original-adaptación), se indican las recomendaciones de lenguaje claro que se han aplicado y el número de veces que se ha aplicado cada recomendación. Los resultados de este dataset se han obtenido a partir del análisis de un corpus de textos procedentes del Ayuntamiento de Madrid. Los cinco géneros textuales que se analizan son: acta de inspección, contrato, requerimiento, resolución dirigida a un particular y resolución publicada en portales institucionales.
La información que contiene este dataset se ha integrado en el sistema arText para ayudar al personal público a estructurar y redactar estos géneros textuales dirigidos a la ciudadanía. Metodología (empleada para la recogida o generación de los datos) La metodología empleada para la obtención de los datos incluye 7 etapas: Etapa 1. Selección de los cinco géneros textuales objeto del estudio.
Los criterios de selección de los géneros son: frecuencia y dificultad de escritura de los géneros por parte del alumnado universitario de derecho y del personal público, y cantidad de texto libre presente en modelos o plantillas. Para obtener esta información se llevaron a cabo dos encuestas: una al alumnado de la UNED y otra al personal del Ayuntamiento de Madrid. Etapa 2.
Compilación del corpus. El corpus está formado por 100 textos (20 por cada género textual) generados por el Ayuntamiento de Madrid, institución que se ha tomado como caso de estudio. Esta cantidad es estadísticamente representativa para el análisis de textos de ámbitos especializados, según se indica en investigaciones previas.
Etapa 3. Selección de los rasgos lingüísticos que se tienen en cuenta para el análisis del corpus. Los rasgos que se analizan son: a nivel textual, los apartados, los títulos y los contenidos, y a nivel léxico, la fraseología.
Etapa 4. Anotación del corpus mediante la herramienta ATLAS.ti. La anotación se lleva a cabo manualmente.
Etapa 5. Análisis de los rasgos textuales. Se determinan los apartados, títulos y contenidos prototípicos de cada uno de los cinco géneros textuales objeto del estudio.
Se consideran prototípicos los rasgos que aparecen en un 50 % o más de los textos del corpus. Adicionalmente, los rasgos que aparecen en entre un 40 % y un 50 % de los textos del corpus se consideran opcionales. Etapa 6.
Selección y adaptación a lenguaje claro de la fraseología. Se seleccionan algunas frases representativas para expresar los contenidos de cada género textual y se adaptan manualmente a las principales recomendaciones de lenguaje claro para el español. Etapa 7.
Cuantificación de las recomendaciones de lenguaje claro empleadas en la clarificación. Se contabiliza el número de veces se han aplicado las recomendaciones de lenguaje claro para cada par de frases (original-adaptación). También se indica el total de veces que se utiliza cada recomendación en función del género textual.
Links
Where it is published
- Dataverse dataset page edatos.consorciomadrono.es/dataset.xhtml?persistentId=doi%3A10.21950%2FZF2KRC ↗
landing page · from edatos consorciomadrono es
- DOI doi.org/10.21950/zf2krc ↗
DOI / persistent id · from edatos consorciomadrono es
Catalogue records · 1
- Dataverse API edatos.consorciomadrono.es/api/datasets/:persistentId/?persistentId=doi%3A10.21950%2FZF2K… ↗
metadata API · from edatos consorciomadrono es
Topics
- Stated by source
- Artes y humanidades
Provenance · 1 source records, 7 field assertions
| Source | Key | Last seen | Raw |
|---|---|---|---|
| e-cienciaDatos | doi:10.21950/ZF2KRC | 10 d ago | JSON v1 |
| Field | Assertion | Extractor | Evidence |
|---|---|---|---|
| concepts[field].dataverse_subject:artes-y-humanidades | source · edatos consorciomadrono es | connector:edatos_consorciomadrono_es@1.0.0 | /subjects |
| created_date | source · edatos consorciomadrono es | connector:edatos_consorciomadrono_es@1.0.0 | |
| description | source · edatos consorciomadrono es | connector:edatos_consorciomadrono_es@1.0.0 | /description |
| publication_date | source · edatos consorciomadrono es | connector:edatos_consorciomadrono_es@1.0.0 | |
| title | source · edatos consorciomadrono es | connector:edatos_consorciomadrono_es@1.0.0 | /name |
| updated_date | source · edatos consorciomadrono es | connector:edatos_consorciomadrono_es@1.0.0 | |
| version_label | source · edatos consorciomadrono es | connector:edatos_consorciomadrono_es@1.0.0 |