Expansión fonética de la consulta para la recuperación de información en documentos hablados

El enfoque tradicional para la búsqueda de información en grandes colecciones de documentos hablados consiste en integrar métodos de reconocimiento automático del habla (RAH) y técnicas de recuperación de información (RI) usadas para texto escrito. Una desventaja de este enfoque es su dependencia a...

Descripción completa

Detalles Bibliográficos
Autores: Alejandro Reyes-Barragán, Luis Villaseñor-Pineda, Manuel Montes-y-Gómez
Tipo de recurso: artículo
Estado:Versión publicada
Fecha de publicación:2011
País:México
Institución:Instituto Nacional de Astrofísica, Óptica y Electrónica
Repositorio:Redalyc-INAOE
OAI Identifier:oai:redalyc.org:515751747006
Acceso en línea:https://www.redalyc.org/articulo.oa?id=515751747006
Access Level:acceso abierto
Palabra clave:Computación
Documentos hablados
Codificación fonética
Expansión de la consulta
Recuperación de Información
id MX_91a0aa4e8d5f07b65b2aa3b6c5e2d527
oai_identifier_str oai:redalyc.org:515751747006
network_acronym_str MX
network_name_str México
repository_id_str
spelling Expansión fonética de la consulta para la recuperación de información en documentos habladosAlejandro Reyes-BarragánLuis Villaseñor-PinedaManuel Montes-y-GómezComputaciónDocumentos habladosCodificación fonéticaExpansión de la consultaRecuperación de InformaciónEl enfoque tradicional para la búsqueda de información en grandes colecciones de documentos hablados consiste en integrar métodos de reconocimiento automático del habla (RAH) y técnicas de recuperación de información (RI) usadas para texto escrito. Una desventaja de este enfoque es su dependencia a la precisión del sistema de RAH, pues los errores generados por éste impactan fuertemente en la máquina de RI. Con el objetivo de reducir el impacto de los errores de transcripción, especialmente los de sustitución, en este trabajo se propone expandir las consultas con palabras fonéticamente similares y con ello ampliar las posibilidades de emparejar las palabras mal transcritas en los documentos. Los resultados alcanzados en dos colecciones de documentos hablados con características muy disímiles demuestran la pertinencia del método propuesto, el cual logró mejorar el MAP respecto a una expansión tradicional hasta en un 3.68%.Sociedad Española para el Procesamiento del Lenguaje Natural2011info:eu-repo/semantics/publishedVersioninfo:eu-repo/semantics/articleapplication/pdf1135-5948https://www.redalyc.org/articulo.oa?id=515751747006Procesamiento del Lenguaje Natural (España) Num.47reponame:Redalyc-INAOEinstname:Instituto Nacional de Astrofísica, Óptica y Electrónicainstacron:INAOEeshttp://www.redalyc.org/revista.oa?id=5157Procesamiento del Lenguaje Naturalinfo:eu-repo/semantics/openAccessoai:redalyc.org:5157517470062024-08-23T18:15:25Z
dc.title.none.fl_str_mv Expansión fonética de la consulta para la recuperación de información en documentos hablados
title Expansión fonética de la consulta para la recuperación de información en documentos hablados
spellingShingle Expansión fonética de la consulta para la recuperación de información en documentos hablados
Alejandro Reyes-Barragán
Computación
Documentos hablados
Codificación fonética
Expansión de la consulta
Recuperación de Información
title_short Expansión fonética de la consulta para la recuperación de información en documentos hablados
title_full Expansión fonética de la consulta para la recuperación de información en documentos hablados
title_fullStr Expansión fonética de la consulta para la recuperación de información en documentos hablados
title_full_unstemmed Expansión fonética de la consulta para la recuperación de información en documentos hablados
title_sort Expansión fonética de la consulta para la recuperación de información en documentos hablados
dc.creator.none.fl_str_mv Alejandro Reyes-Barragán
Luis Villaseñor-Pineda
Manuel Montes-y-Gómez
author Alejandro Reyes-Barragán
author_facet Alejandro Reyes-Barragán
Luis Villaseñor-Pineda
Manuel Montes-y-Gómez
author_role author
author2 Luis Villaseñor-Pineda
Manuel Montes-y-Gómez
author2_role author
author
dc.subject.none.fl_str_mv Computación
Documentos hablados
Codificación fonética
Expansión de la consulta
Recuperación de Información
topic Computación
Documentos hablados
Codificación fonética
Expansión de la consulta
Recuperación de Información
description El enfoque tradicional para la búsqueda de información en grandes colecciones de documentos hablados consiste en integrar métodos de reconocimiento automático del habla (RAH) y técnicas de recuperación de información (RI) usadas para texto escrito. Una desventaja de este enfoque es su dependencia a la precisión del sistema de RAH, pues los errores generados por éste impactan fuertemente en la máquina de RI. Con el objetivo de reducir el impacto de los errores de transcripción, especialmente los de sustitución, en este trabajo se propone expandir las consultas con palabras fonéticamente similares y con ello ampliar las posibilidades de emparejar las palabras mal transcritas en los documentos. Los resultados alcanzados en dos colecciones de documentos hablados con características muy disímiles demuestran la pertinencia del método propuesto, el cual logró mejorar el MAP respecto a una expansión tradicional hasta en un 3.68%.
publishDate 2011
dc.date.none.fl_str_mv 2011
dc.type.none.fl_str_mv info:eu-repo/semantics/publishedVersion
info:eu-repo/semantics/article
format article
status_str publishedVersion
dc.identifier.none.fl_str_mv 1135-5948
https://www.redalyc.org/articulo.oa?id=515751747006
identifier_str_mv 1135-5948
url https://www.redalyc.org/articulo.oa?id=515751747006
dc.language.none.fl_str_mv es
language_invalid_str_mv es
dc.relation.none.fl_str_mv http://www.redalyc.org/revista.oa?id=5157
dc.rights.none.fl_str_mv Procesamiento del Lenguaje Natural
info:eu-repo/semantics/openAccess
rights_invalid_str_mv Procesamiento del Lenguaje Natural
eu_rights_str_mv openAccess
dc.format.none.fl_str_mv application/pdf
dc.publisher.none.fl_str_mv Sociedad Española para el Procesamiento del Lenguaje Natural
publisher.none.fl_str_mv Sociedad Española para el Procesamiento del Lenguaje Natural
dc.source.none.fl_str_mv Procesamiento del Lenguaje Natural (España) Num.47
reponame:Redalyc-INAOE
instname:Instituto Nacional de Astrofísica, Óptica y Electrónica
instacron:INAOE
instname_str Instituto Nacional de Astrofísica, Óptica y Electrónica
instacron_str INAOE
institution INAOE
reponame_str Redalyc-INAOE
collection Redalyc-INAOE
repository.name.fl_str_mv
repository.mail.fl_str_mv
_version_ 1858176131275948032
score 15.812455