Procesamiento del lenguaje natural y fijación del texto. Experiencias en torno a la constitución de un corpus diacrónico de sonetos

Esta contribución surge en el contexto de desarrollo del corpus de sonetos DISCO (Diachronic Spanish Sonnet Corpus), un corpus de 4530 sonetos en español compuestos entre el siglo xvi y el xx por autores de diversas procedencias (Europa, Latinoamérica y Filipinas). Este recurso contiene las anotacio...

Descripción completa

Detalles Bibliográficos
Autores: Bermúdez Sabel, Helena|||0000-0002-8627-1367, Martínez Cantón, Clara Isabel|||0000-0003-0781-2418, Ruiz Fabo, Pablo|||0000-0002-4349-4835
Tipo de recurso: capítulo de libro
Fecha de publicación:2024
País:España
Institución:Universitat Autònoma de Barcelona
Repositorio:Dipòsit Digital de Documents de la UAB
Idioma:español
OAI Identifier:oai:ddd.uab.cat:292186
Acceso en línea:https://ddd.uab.cat/record/292186
Access Level:acceso abierto
Palabra clave:Corpus
Soneto
Procesamiento del lenguaje natural
Anotación
Edición digital
Versificación sonnet
Natural language processing
Annotation
Scholarly editing
Versification
id ES_2aa79f5302dd4ef76469ab1bbbdbbee8
oai_identifier_str oai:ddd.uab.cat:292186
network_acronym_str ES
network_name_str España
repository_id_str
spelling Procesamiento del lenguaje natural y fijación del texto. Experiencias en torno a la constitución de un corpus diacrónico de sonetosNatural Language Processing and Text Curation. Experiences within the Development of a Diachronic Sonnet CorpusBermúdez Sabel, Helena|||0000-0002-8627-1367Martínez Cantón, Clara Isabel|||0000-0003-0781-2418Ruiz Fabo, Pablo|||0000-0002-4349-4835CorpusSonetoProcesamiento del lenguaje naturalAnotaciónEdición digitalVersificación sonnetNatural language processingAnnotationScholarly editingVersificationEsta contribución surge en el contexto de desarrollo del corpus de sonetos DISCO (Diachronic Spanish Sonnet Corpus), un corpus de 4530 sonetos en español compuestos entre el siglo xvi y el xx por autores de diversas procedencias (Europa, Latinoamérica y Filipinas). Este recurso contiene las anotaciones de diferentes fenómenos de versificación que han sido obtenidas a partir de técnicas del procesamiento del lenguaje natural (PLN). En este artículo presentamos cómo los resultados de la anotación automática pueden ser utilizados para detectar problemas de transmisión textual. Uno de los objetivos de esta contribución es el de proporcionar claves sobre posibles flujos de trabajo que, ayudándose de herramientas de PLN, permitan detectar posibles errores textuales, centrando así los esfuerzos de revisión manual en pasajes concretos.We present work carried out within the development of DISCO, the Diachronic Spanish Sonnet Corpus project, which consists of 4,530 sonnets in Spanish from Europe, Latin America and the Philippines, including texts from the 15th to the 20th centuries. The resource offers versification annotations obtained automatically through tools based on Natural Language Processing (NLP). In this article, we present how automatic annotation results can be exploited to detect textual transmission errors. Drawing on our experience with DISCO, we present observations towards the creation of workflows assisted by NLP-based tools, which can help detect possible textual errors, thus allowing us to focus on specific passages for our manual correction effort.Universitat Autònoma de Barcelona. Servei de Publicacions 22024-01-0120242024-01-01Capítol de llibrehttp://purl.org/coar/resource_type/c_3248VoRhttp://purl.org/coar/version/c_970fb48d4fbd8a85info:eu-repo/semantics/bookPartapplication/pdfhttps://ddd.uab.cat/record/292186reponame:Dipòsit Digital de Documents de la UABinstname:Universitat Autònoma de BarcelonaEspañolspaMinisterio de Economía y Competitividad https://doi.org/10.13039/501100003329 FFI2015-65093-PAgencia Estatal de Investigación https://doi.org/10.13039/501100011033 PID2019-107928GB-I00open accesshttp://purl.org/coar/access_right/c_abf2Aquest document està subjecte a una llicència d'ús Creative Commons. Es permet la reproducció total o parcial, la distribució, la comunicació pública de l'obra i la creació d'obres derivades, fins i tot amb finalitats comercials, sempre i quan es reconegui l'autoria de l'obra original.https://creativecommons.org/licenses/by/4.0/info:eu-repo/semantics/openAccessoai:ddd.uab.cat:2921862026-06-06T12:50:31Z
dc.title.none.fl_str_mv Procesamiento del lenguaje natural y fijación del texto. Experiencias en torno a la constitución de un corpus diacrónico de sonetos
Natural Language Processing and Text Curation. Experiences within the Development of a Diachronic Sonnet Corpus
title Procesamiento del lenguaje natural y fijación del texto. Experiencias en torno a la constitución de un corpus diacrónico de sonetos
spellingShingle Procesamiento del lenguaje natural y fijación del texto. Experiencias en torno a la constitución de un corpus diacrónico de sonetos
Bermúdez Sabel, Helena|||0000-0002-8627-1367
Corpus
Soneto
Procesamiento del lenguaje natural
Anotación
Edición digital
Versificación sonnet
Natural language processing
Annotation
Scholarly editing
Versification
title_short Procesamiento del lenguaje natural y fijación del texto. Experiencias en torno a la constitución de un corpus diacrónico de sonetos
title_full Procesamiento del lenguaje natural y fijación del texto. Experiencias en torno a la constitución de un corpus diacrónico de sonetos
title_fullStr Procesamiento del lenguaje natural y fijación del texto. Experiencias en torno a la constitución de un corpus diacrónico de sonetos
title_full_unstemmed Procesamiento del lenguaje natural y fijación del texto. Experiencias en torno a la constitución de un corpus diacrónico de sonetos
title_sort Procesamiento del lenguaje natural y fijación del texto. Experiencias en torno a la constitución de un corpus diacrónico de sonetos
dc.creator.none.fl_str_mv Bermúdez Sabel, Helena|||0000-0002-8627-1367
Martínez Cantón, Clara Isabel|||0000-0003-0781-2418
Ruiz Fabo, Pablo|||0000-0002-4349-4835
author Bermúdez Sabel, Helena|||0000-0002-8627-1367
author_facet Bermúdez Sabel, Helena|||0000-0002-8627-1367
Martínez Cantón, Clara Isabel|||0000-0003-0781-2418
Ruiz Fabo, Pablo|||0000-0002-4349-4835
author_role author
author2 Martínez Cantón, Clara Isabel|||0000-0003-0781-2418
Ruiz Fabo, Pablo|||0000-0002-4349-4835
author2_role author
author
dc.subject.none.fl_str_mv Corpus
Soneto
Procesamiento del lenguaje natural
Anotación
Edición digital
Versificación sonnet
Natural language processing
Annotation
Scholarly editing
Versification
topic Corpus
Soneto
Procesamiento del lenguaje natural
Anotación
Edición digital
Versificación sonnet
Natural language processing
Annotation
Scholarly editing
Versification
description Esta contribución surge en el contexto de desarrollo del corpus de sonetos DISCO (Diachronic Spanish Sonnet Corpus), un corpus de 4530 sonetos en español compuestos entre el siglo xvi y el xx por autores de diversas procedencias (Europa, Latinoamérica y Filipinas). Este recurso contiene las anotaciones de diferentes fenómenos de versificación que han sido obtenidas a partir de técnicas del procesamiento del lenguaje natural (PLN). En este artículo presentamos cómo los resultados de la anotación automática pueden ser utilizados para detectar problemas de transmisión textual. Uno de los objetivos de esta contribución es el de proporcionar claves sobre posibles flujos de trabajo que, ayudándose de herramientas de PLN, permitan detectar posibles errores textuales, centrando así los esfuerzos de revisión manual en pasajes concretos.
publishDate 2024
dc.date.none.fl_str_mv 2
2024-01-01
2024
2024-01-01
dc.type.none.fl_str_mv Capítol de llibre
http://purl.org/coar/resource_type/c_3248
VoR
http://purl.org/coar/version/c_970fb48d4fbd8a85
dc.type.openaire.fl_str_mv info:eu-repo/semantics/bookPart
format bookPart
dc.identifier.none.fl_str_mv https://ddd.uab.cat/record/292186
url https://ddd.uab.cat/record/292186
dc.language.none.fl_str_mv Español
spa
language_invalid_str_mv Español
language spa
dc.relation.none.fl_str_mv Ministerio de Economía y Competitividad https://doi.org/10.13039/501100003329 FFI2015-65093-P
Agencia Estatal de Investigación https://doi.org/10.13039/501100011033 PID2019-107928GB-I00
dc.rights.none.fl_str_mv open access
http://purl.org/coar/access_right/c_abf2
https://creativecommons.org/licenses/by/4.0/
dc.rights.openaire.fl_str_mv info:eu-repo/semantics/openAccess
rights_invalid_str_mv open access
http://purl.org/coar/access_right/c_abf2
https://creativecommons.org/licenses/by/4.0/
eu_rights_str_mv openAccess
dc.format.none.fl_str_mv application/pdf
dc.publisher.none.fl_str_mv Universitat Autònoma de Barcelona. Servei de Publicacions
publisher.none.fl_str_mv Universitat Autònoma de Barcelona. Servei de Publicacions
dc.source.none.fl_str_mv reponame:Dipòsit Digital de Documents de la UAB
instname:Universitat Autònoma de Barcelona
instname_str Universitat Autònoma de Barcelona
reponame_str Dipòsit Digital de Documents de la UAB
collection Dipòsit Digital de Documents de la UAB
repository.name.fl_str_mv
repository.mail.fl_str_mv
_version_ 1869405086196695040
score 15,301603