Dataset FallacyES

Este recurso recopila falacias en español de dos fuentes diferenciadas. Por un lado, se han revisado y traducido las falacias prototípicas del conjunto de datos Logic en su versión corregida (https://github.com/tmakesense/logicalfallacy/tree/main/dataset-fixed), y se han añadido ejemplos similares n...

Descripción completa

Detalles Bibliográficos
Autores: Cruz Mata, Fermín, Troyano Jiménez, José Antonio, Enríquez de Salamanca Ros, Fernando, Ortega Rodríguez, Francisco Javier
Tipo de recurso: conjunto de datos
Fecha de publicación:2025
País:España
Institución:Universidad de Sevilla (US)
Repositorio:idUS. Depósito de Investigación de la Universidad de Sevilla
OAI Identifier:oai:idus.us.es:11441/167050
Acceso en línea:https://hdl.handle.net/11441/167050
https://doi.org/10.12795/11441/167050
Access Level:acceso abierto
Palabra clave:Procesamiento de lenguaje natural (PLN)
Detección de falacias
Natural Language Processing (NLP)
Fallacy detection
id ES_87abbdd2051d4ec2fe29b71e99eb0de5
oai_identifier_str oai:idus.us.es:11441/167050
network_acronym_str ES
network_name_str España
repository_id_str
spelling Dataset FallacyESCruz Mata, FermínTroyano Jiménez, José AntonioEnríquez de Salamanca Ros, FernandoOrtega Rodríguez, Francisco JavierProcesamiento de lenguaje natural (PLN)Detección de falaciasNatural Language Processing (NLP)Fallacy detectionEste recurso recopila falacias en español de dos fuentes diferenciadas. Por un lado, se han revisado y traducido las falacias prototípicas del conjunto de datos Logic en su versión corregida (https://github.com/tmakesense/logicalfallacy/tree/main/dataset-fixed), y se han añadido ejemplos similares no falaces, para habilitar la experimentación en detección además de en clasificación de falacias. Por otra parte, se han localizado y anotado ejemplos de falacias espontáneas a partir de los comentarios a noticias publicadas en la web de agregación de noticias meneame.net (http://old.meneame.net). También en este caso se han incluido ejemplos de textos no falaces extraídos de los mismos comentarios. La inclusión de este tipo de falacias surge de la observación del carácter en ocasiones poco realista de las falacias que llamamos prototípicas. Todo el proceso de anotación fue llevado a cabo por cuatro anotadores, dividiendo las tareas en grupos iguales y realizando reuniones posteriores para revisar los resultados obtenidos.The use of fallacies in public debates in political, health, economic and social contexts is detrimental in that it hinders understanding between the parties and facilitates the manipulation of public opinion and the propagation of misinformation. Recently, datasets containing various types of fallacies have become available, allowing experimentation in tasks such as automatic fallacy classification. Here, we present the first corpus of fallacies in Spanish, with two distinct sections: one formed by prototypical examples extracted from educational materials, and the other by spontaneous examples extracted from on-line comments to news items. Both sections include examples of non-fallacious texts of similar subject matter.FallacyES-prototypical.csv FallacyES-spontaneous.csvLenguajes y Sistemas InformáticosTIC134: Sistemas InformáticosMinisterio de Ciencia e Innovación (MICIN). EspañaAgencia Estatal de Investigación. España2025info:eu-repo/semantics/datasetDatasettext/csvtext/csvtext/csvtext/plainhttps://hdl.handle.net/11441/167050https://doi.org/10.12795/11441/167050reponame:idUS. Depósito de Investigación de la Universidad de Sevillainstname:Universidad de Sevilla (US)EspañolLogical Fallacy Dataset (https://github.com/tmakesense/logical-fallacy/tree/main/dataset-fixed)LOGIC (https://github.com/causalNLP/logical-fallacy ) (open-source MIT license for non-commercial use)old.meneame.net (https://creativecommons.org/licenses/by/3.0/)Cruz Mata, F., Troyano Jiménez, J.A., Enríquez de Salamanca Ros, F. y Ortega Rodríguez, F.J. (2023). Detección y clasificación de falacias prototípicas y espontáneas en español. Procesamiento del Lenguaje Natural, 71, 53-62. https://doi.org/10.26342/2023-71-4https://hdl.handle.net/11441/165798PID2021-12300510.13039/501100011033info:eu-repo/semantics/openAccessoai:idus.us.es:11441/1670502026-06-17T12:51:07Z
dc.title.none.fl_str_mv Dataset FallacyES
title Dataset FallacyES
spellingShingle Dataset FallacyES
Cruz Mata, Fermín
Procesamiento de lenguaje natural (PLN)
Detección de falacias
Natural Language Processing (NLP)
Fallacy detection
title_short Dataset FallacyES
title_full Dataset FallacyES
title_fullStr Dataset FallacyES
title_full_unstemmed Dataset FallacyES
title_sort Dataset FallacyES
dc.creator.none.fl_str_mv Cruz Mata, Fermín
Troyano Jiménez, José Antonio
Enríquez de Salamanca Ros, Fernando
Ortega Rodríguez, Francisco Javier
author Cruz Mata, Fermín
author_facet Cruz Mata, Fermín
Troyano Jiménez, José Antonio
Enríquez de Salamanca Ros, Fernando
Ortega Rodríguez, Francisco Javier
author_role author
author2 Troyano Jiménez, José Antonio
Enríquez de Salamanca Ros, Fernando
Ortega Rodríguez, Francisco Javier
author2_role author
author
author
dc.contributor.none.fl_str_mv Lenguajes y Sistemas Informáticos
TIC134: Sistemas Informáticos
Ministerio de Ciencia e Innovación (MICIN). España
Agencia Estatal de Investigación. España
dc.subject.none.fl_str_mv Procesamiento de lenguaje natural (PLN)
Detección de falacias
Natural Language Processing (NLP)
Fallacy detection
topic Procesamiento de lenguaje natural (PLN)
Detección de falacias
Natural Language Processing (NLP)
Fallacy detection
description Este recurso recopila falacias en español de dos fuentes diferenciadas. Por un lado, se han revisado y traducido las falacias prototípicas del conjunto de datos Logic en su versión corregida (https://github.com/tmakesense/logicalfallacy/tree/main/dataset-fixed), y se han añadido ejemplos similares no falaces, para habilitar la experimentación en detección además de en clasificación de falacias. Por otra parte, se han localizado y anotado ejemplos de falacias espontáneas a partir de los comentarios a noticias publicadas en la web de agregación de noticias meneame.net (http://old.meneame.net). También en este caso se han incluido ejemplos de textos no falaces extraídos de los mismos comentarios. La inclusión de este tipo de falacias surge de la observación del carácter en ocasiones poco realista de las falacias que llamamos prototípicas. Todo el proceso de anotación fue llevado a cabo por cuatro anotadores, dividiendo las tareas en grupos iguales y realizando reuniones posteriores para revisar los resultados obtenidos.
publishDate 2025
dc.date.none.fl_str_mv 2025
dc.type.none.fl_str_mv info:eu-repo/semantics/dataset
Dataset
format dataset
dc.identifier.none.fl_str_mv https://hdl.handle.net/11441/167050
https://doi.org/10.12795/11441/167050
url https://hdl.handle.net/11441/167050
https://doi.org/10.12795/11441/167050
dc.language.none.fl_str_mv Español
language_invalid_str_mv Español
dc.relation.none.fl_str_mv Logical Fallacy Dataset (https://github.com/tmakesense/logical-fallacy/tree/main/dataset-fixed)
LOGIC (https://github.com/causalNLP/logical-fallacy ) (open-source MIT license for non-commercial use)
old.meneame.net (https://creativecommons.org/licenses/by/3.0/)
Cruz Mata, F., Troyano Jiménez, J.A., Enríquez de Salamanca Ros, F. y Ortega Rodríguez, F.J. (2023). Detección y clasificación de falacias prototípicas y espontáneas en español. Procesamiento del Lenguaje Natural, 71, 53-62. https://doi.org/10.26342/2023-71-4
https://hdl.handle.net/11441/165798
PID2021-123005
10.13039/501100011033
dc.rights.none.fl_str_mv info:eu-repo/semantics/openAccess
eu_rights_str_mv openAccess
dc.format.none.fl_str_mv text/csv
text/csv
text/csv
text/plain
dc.source.none.fl_str_mv reponame:idUS. Depósito de Investigación de la Universidad de Sevilla
instname:Universidad de Sevilla (US)
instname_str Universidad de Sevilla (US)
reponame_str idUS. Depósito de Investigación de la Universidad de Sevilla
collection idUS. Depósito de Investigación de la Universidad de Sevilla
repository.name.fl_str_mv
repository.mail.fl_str_mv
_version_ 1869412478960533504
score 15.812429