Expansión fonética de la consulta para la recuperación de información en documentos hablados
El enfoque tradicional para la búsqueda de información en grandes colecciones de documentos hablados consiste en integrar métodos de reconocimiento automático del habla (RAH) y técnicas de recuperación de información (RI) usadas para texto escrito. Una desventaja de este enfoque es su dependencia a...
| Autores: | , , |
|---|---|
| Tipo de recurso: | artículo |
| Estado: | Versión publicada |
| Fecha de publicación: | 2011 |
| País: | México |
| Institución: | Instituto Nacional de Astrofísica, Óptica y Electrónica |
| Repositorio: | Redalyc-INAOE |
| OAI Identifier: | oai:redalyc.org:515751747006 |
| Acceso en línea: | https://www.redalyc.org/articulo.oa?id=515751747006 |
| Access Level: | acceso abierto |
| Palabra clave: | Computación Documentos hablados Codificación fonética Expansión de la consulta Recuperación de Información |
| id |
MX_91a0aa4e8d5f07b65b2aa3b6c5e2d527 |
|---|---|
| oai_identifier_str |
oai:redalyc.org:515751747006 |
| network_acronym_str |
MX |
| network_name_str |
México |
| repository_id_str |
|
| spelling |
Expansión fonética de la consulta para la recuperación de información en documentos habladosAlejandro Reyes-BarragánLuis Villaseñor-PinedaManuel Montes-y-GómezComputaciónDocumentos habladosCodificación fonéticaExpansión de la consultaRecuperación de InformaciónEl enfoque tradicional para la búsqueda de información en grandes colecciones de documentos hablados consiste en integrar métodos de reconocimiento automático del habla (RAH) y técnicas de recuperación de información (RI) usadas para texto escrito. Una desventaja de este enfoque es su dependencia a la precisión del sistema de RAH, pues los errores generados por éste impactan fuertemente en la máquina de RI. Con el objetivo de reducir el impacto de los errores de transcripción, especialmente los de sustitución, en este trabajo se propone expandir las consultas con palabras fonéticamente similares y con ello ampliar las posibilidades de emparejar las palabras mal transcritas en los documentos. Los resultados alcanzados en dos colecciones de documentos hablados con características muy disímiles demuestran la pertinencia del método propuesto, el cual logró mejorar el MAP respecto a una expansión tradicional hasta en un 3.68%.Sociedad Española para el Procesamiento del Lenguaje Natural2011info:eu-repo/semantics/publishedVersioninfo:eu-repo/semantics/articleapplication/pdf1135-5948https://www.redalyc.org/articulo.oa?id=515751747006Procesamiento del Lenguaje Natural (España) Num.47reponame:Redalyc-INAOEinstname:Instituto Nacional de Astrofísica, Óptica y Electrónicainstacron:INAOEeshttp://www.redalyc.org/revista.oa?id=5157Procesamiento del Lenguaje Naturalinfo:eu-repo/semantics/openAccessoai:redalyc.org:5157517470062024-08-23T18:15:25Z |
| dc.title.none.fl_str_mv |
Expansión fonética de la consulta para la recuperación de información en documentos hablados |
| title |
Expansión fonética de la consulta para la recuperación de información en documentos hablados |
| spellingShingle |
Expansión fonética de la consulta para la recuperación de información en documentos hablados Alejandro Reyes-Barragán Computación Documentos hablados Codificación fonética Expansión de la consulta Recuperación de Información |
| title_short |
Expansión fonética de la consulta para la recuperación de información en documentos hablados |
| title_full |
Expansión fonética de la consulta para la recuperación de información en documentos hablados |
| title_fullStr |
Expansión fonética de la consulta para la recuperación de información en documentos hablados |
| title_full_unstemmed |
Expansión fonética de la consulta para la recuperación de información en documentos hablados |
| title_sort |
Expansión fonética de la consulta para la recuperación de información en documentos hablados |
| dc.creator.none.fl_str_mv |
Alejandro Reyes-Barragán Luis Villaseñor-Pineda Manuel Montes-y-Gómez |
| author |
Alejandro Reyes-Barragán |
| author_facet |
Alejandro Reyes-Barragán Luis Villaseñor-Pineda Manuel Montes-y-Gómez |
| author_role |
author |
| author2 |
Luis Villaseñor-Pineda Manuel Montes-y-Gómez |
| author2_role |
author author |
| dc.subject.none.fl_str_mv |
Computación Documentos hablados Codificación fonética Expansión de la consulta Recuperación de Información |
| topic |
Computación Documentos hablados Codificación fonética Expansión de la consulta Recuperación de Información |
| description |
El enfoque tradicional para la búsqueda de información en grandes colecciones de documentos hablados consiste en integrar métodos de reconocimiento automático del habla (RAH) y técnicas de recuperación de información (RI) usadas para texto escrito. Una desventaja de este enfoque es su dependencia a la precisión del sistema de RAH, pues los errores generados por éste impactan fuertemente en la máquina de RI. Con el objetivo de reducir el impacto de los errores de transcripción, especialmente los de sustitución, en este trabajo se propone expandir las consultas con palabras fonéticamente similares y con ello ampliar las posibilidades de emparejar las palabras mal transcritas en los documentos. Los resultados alcanzados en dos colecciones de documentos hablados con características muy disímiles demuestran la pertinencia del método propuesto, el cual logró mejorar el MAP respecto a una expansión tradicional hasta en un 3.68%. |
| publishDate |
2011 |
| dc.date.none.fl_str_mv |
2011 |
| dc.type.none.fl_str_mv |
info:eu-repo/semantics/publishedVersion info:eu-repo/semantics/article |
| format |
article |
| status_str |
publishedVersion |
| dc.identifier.none.fl_str_mv |
1135-5948 https://www.redalyc.org/articulo.oa?id=515751747006 |
| identifier_str_mv |
1135-5948 |
| url |
https://www.redalyc.org/articulo.oa?id=515751747006 |
| dc.language.none.fl_str_mv |
es |
| language_invalid_str_mv |
es |
| dc.relation.none.fl_str_mv |
http://www.redalyc.org/revista.oa?id=5157 |
| dc.rights.none.fl_str_mv |
Procesamiento del Lenguaje Natural info:eu-repo/semantics/openAccess |
| rights_invalid_str_mv |
Procesamiento del Lenguaje Natural |
| eu_rights_str_mv |
openAccess |
| dc.format.none.fl_str_mv |
application/pdf |
| dc.publisher.none.fl_str_mv |
Sociedad Española para el Procesamiento del Lenguaje Natural |
| publisher.none.fl_str_mv |
Sociedad Española para el Procesamiento del Lenguaje Natural |
| dc.source.none.fl_str_mv |
Procesamiento del Lenguaje Natural (España) Num.47 reponame:Redalyc-INAOE instname:Instituto Nacional de Astrofísica, Óptica y Electrónica instacron:INAOE |
| instname_str |
Instituto Nacional de Astrofísica, Óptica y Electrónica |
| instacron_str |
INAOE |
| institution |
INAOE |
| reponame_str |
Redalyc-INAOE |
| collection |
Redalyc-INAOE |
| repository.name.fl_str_mv |
|
| repository.mail.fl_str_mv |
|
| _version_ |
1858176131275948032 |
| score |
15.812455 |