Detección de lenguaje ofensivo en redes sociales

Desde su aparición a principios de la década de los 2000, el uso de las redes sociales se ha ido incrementando entre usuarios de todas las edades y procedencias del mundo. Este crecimiento masivo ha llevado a un aumento significativo en la interacción y la comunicación en línea. Las redes sociales s...

Descripción completa

Detalles Bibliográficos
Autor: Ezquerro Abad, Paula
Tipo de recurso: tesis de maestría
Fecha de publicación:2023
País:España
Institución:Universidad Nacional de Educación a Distancia
Repositorio:e-spacio. Repositorio Institucional de la UNED
Idioma:español
OAI Identifier:oai:e-spacio.uned.es:20.500.14468/24156
Acceso en línea:https://hdl.handle.net/20.500.14468/24156
Access Level:acceso abierto
Palabra clave:3304 Tecnología de los ordenadores
id ES_1d680fe913a8d5582da2bd73a5de8ffd
oai_identifier_str oai:e-spacio.uned.es:20.500.14468/24156
network_acronym_str ES
network_name_str España
repository_id_str
dc.title.none.fl_str_mv Detección de lenguaje ofensivo en redes sociales
title Detección de lenguaje ofensivo en redes sociales
spellingShingle Detección de lenguaje ofensivo en redes sociales
Ezquerro Abad, Paula
3304 Tecnología de los ordenadores
title_short Detección de lenguaje ofensivo en redes sociales
title_full Detección de lenguaje ofensivo en redes sociales
title_fullStr Detección de lenguaje ofensivo en redes sociales
title_full_unstemmed Detección de lenguaje ofensivo en redes sociales
title_sort Detección de lenguaje ofensivo en redes sociales
dc.creator.none.fl_str_mv Ezquerro Abad, Paula
author Ezquerro Abad, Paula
author_facet Ezquerro Abad, Paula
author_role author
dc.contributor.none.fl_str_mv Pérez Martín, Jorge
Rodrigo Yuste, Álvaro
e-Spacio UNED
dc.subject.none.fl_str_mv 3304 Tecnología de los ordenadores
topic 3304 Tecnología de los ordenadores
description Desde su aparición a principios de la década de los 2000, el uso de las redes sociales se ha ido incrementando entre usuarios de todas las edades y procedencias del mundo. Este crecimiento masivo ha llevado a un aumento significativo en la interacción y la comunicación en línea. Las redes sociales son la principal herramienta de comunicación y una de las principales fuentes de información entre la mayor parte de la población mundial. Sin embargo, a pesar de traer consigo una amplia gama de beneficios, recientemente han surgido desafíos relacionados con el lenguaje ofensivo y el discurso de odio en ellas. Todas las redes sociales disponen de sistemas de moderación, algunos de los cuales son manuales y bastante tediosos. Hoy en día, sigue siendo un reto conseguir un sistema que sea rápido, eficaz y que aprenda igual de rápido que evoluciona el lenguaje humano. Las redes sociales serían un ecosistema mucho más seguro y sano si se consiguieran detectar este tipo de mensajes y frenar su publicación en tiempo real. En este trabajo se estudia la idoneidad de los modelos basados en Transformers, considerados el estado del arte en el campo del procesamiento de lenguaje natural, para detectar mensajes ofensivos en redes sociales. Se investigan los modelos más actuales de esta área para encontrar aquel que esté más cerca de lograr el objetivo. Se han realizado experimentos entrenando con fuentes de datos diferentes a las que fueron entrenados para probar si mejora su generalización. Una vez realizados los experimentos que se detallan en este trabajo se ha llegado a la conclusión de que actualmente se dispone de una serie de modelos pre-entrenados que pueden suponer una muy buena base para el desarrollo de estos sistemas. Estos modelos requieren de una correcta fase de entrenamiento que permita mejorar sus métricas y generalizarlo a todas las redes sociales y usuarios del mundo.
publishDate 2023
dc.date.none.fl_str_mv 2023
2023-01-01
2023
2023-01-01
2024
2024-10-29
dc.type.none.fl_str_mv master thesis
http://purl.org/coar/resource_type/c_bdcc
dc.type.openaire.fl_str_mv info:eu-repo/semantics/masterThesis
format masterThesis
dc.identifier.none.fl_str_mv https://hdl.handle.net/20.500.14468/24156
url https://hdl.handle.net/20.500.14468/24156
dc.language.none.fl_str_mv Español
spa
language_invalid_str_mv Español
language spa
dc.rights.none.fl_str_mv open access
http://purl.org/coar/access_right/c_abf2
info:eu-repo/semantics/openAccess
http://creativecommons.org/licenses/by-nc-nd/4.0/deed.es
rights_invalid_str_mv open access
http://purl.org/coar/access_right/c_abf2
http://creativecommons.org/licenses/by-nc-nd/4.0/deed.es
eu_rights_str_mv openAccess
dc.format.none.fl_str_mv application/pdf
dc.source.none.fl_str_mv reponame:e-spacio. Repositorio Institucional de la UNED
instname:Universidad Nacional de Educación a Distancia
instname_str Universidad Nacional de Educación a Distancia
reponame_str e-spacio. Repositorio Institucional de la UNED
collection e-spacio. Repositorio Institucional de la UNED
repository.name.fl_str_mv
repository.mail.fl_str_mv
_version_ 1869404278226944000
spelling Detección de lenguaje ofensivo en redes socialesEzquerro Abad, Paula3304 Tecnología de los ordenadoresDesde su aparición a principios de la década de los 2000, el uso de las redes sociales se ha ido incrementando entre usuarios de todas las edades y procedencias del mundo. Este crecimiento masivo ha llevado a un aumento significativo en la interacción y la comunicación en línea. Las redes sociales son la principal herramienta de comunicación y una de las principales fuentes de información entre la mayor parte de la población mundial. Sin embargo, a pesar de traer consigo una amplia gama de beneficios, recientemente han surgido desafíos relacionados con el lenguaje ofensivo y el discurso de odio en ellas. Todas las redes sociales disponen de sistemas de moderación, algunos de los cuales son manuales y bastante tediosos. Hoy en día, sigue siendo un reto conseguir un sistema que sea rápido, eficaz y que aprenda igual de rápido que evoluciona el lenguaje humano. Las redes sociales serían un ecosistema mucho más seguro y sano si se consiguieran detectar este tipo de mensajes y frenar su publicación en tiempo real. En este trabajo se estudia la idoneidad de los modelos basados en Transformers, considerados el estado del arte en el campo del procesamiento de lenguaje natural, para detectar mensajes ofensivos en redes sociales. Se investigan los modelos más actuales de esta área para encontrar aquel que esté más cerca de lograr el objetivo. Se han realizado experimentos entrenando con fuentes de datos diferentes a las que fueron entrenados para probar si mejora su generalización. Una vez realizados los experimentos que se detallan en este trabajo se ha llegado a la conclusión de que actualmente se dispone de una serie de modelos pre-entrenados que pueden suponer una muy buena base para el desarrollo de estos sistemas. Estos modelos requieren de una correcta fase de entrenamiento que permita mejorar sus métricas y generalizarlo a todas las redes sociales y usuarios del mundo.Since its appearance in the early 2000s, the use of social networks has increased among users of all ages and backgrounds around the world. This massive growth has led to a significant increase in online interaction and communication. Social networks are the main communication tool and one of the main sources of information among most of the world's population. However, despite bringing a wide range of benefits, challenges related to offensive language and hate speech in them have recently emerged. All social networks have moderation systems, some of which are manual and quite tedious. Today, it remains a challenge to achieve a system that is fast, efficient and that learns as quickly as human language evolves. Social networks would be a much safer a nd healthier ecosystem if these types of messages could be detected and their publication stopped in real time. This project studies the suitability of Transformers based models, considered the state of the art in the field of natural language processing, to detect offensive messages on social networks. The most current models in this area are investigated to find t he one that is closest to achieving the objective. Experiments have been carried out training with data sources different from those on which they were trained to test if their generalization improves. Once the experiments detailed in this work have been carried out, it has been concluded that there is currently a series of pre trained models that can provide a very good basis for the development of these systems. These models require a correct training phase that allows them to improve their metrics and generalize them to all social networks and users in the world.Pérez Martín, JorgeRodrigo Yuste, Álvaroe-Spacio UNED20242024-10-2920232023-01-0120232023-01-01master thesishttp://purl.org/coar/resource_type/c_bdccinfo:eu-repo/semantics/masterThesisapplication/pdfhttps://hdl.handle.net/20.500.14468/24156reponame:e-spacio. Repositorio Institucional de la UNEDinstname:Universidad Nacional de Educación a DistanciaEspañolspaopen accesshttp://purl.org/coar/access_right/c_abf2info:eu-repo/semantics/openAccesshttp://creativecommons.org/licenses/by-nc-nd/4.0/deed.esoai:e-spacio.uned.es:20.500.14468/241562026-06-06T12:38:31Z
score 15.812455