Segmentación automática de noticias mediante procesamiento de formas prosódicas

La segmentación automatizada de noticias en tiempo real es un problema que ha tenido un abordaje fundamentalmente lingüístico y de procesamiento de la señal en los últimos años. El trabajo que presentamos tiene un enfoque sustancialmente diferente: desde una perspectiva comunicológica, se toman las...

Descripción completa

Detalles Bibliográficos
Autor: Mas Manchón, Lluís
Tipo de recurso: artículo
Estado:Versión publicada
Fecha de publicación:2014
País:España
Institución:Varias* (Consorci de Biblioteques Universitáries de Catalunya, Centre de Serveis Científics i Acadèmics de Catalunya)
Repositorio:Recercat. Dipósit de la Recerca de Catalunya
OAI Identifier:oai:recercat.cat:10230/59252
Acceso en línea:http://hdl.handle.net/10230/59252
http://dx.doi.org/10.4067/S0718-33052014000300008
Access Level:acceso abierto
Palabra clave:Locución informativa
Segmentación automática
Formas prosódicas
Cepstrum
Estilización macromelódica
id ES_dca82e8a1742545cd88051c6d7dabf3f
oai_identifier_str oai:recercat.cat:10230/59252
network_acronym_str ES
network_name_str España
repository_id_str
spelling Segmentación automática de noticias mediante procesamiento de formas prosódicasAutomatic segmentation of news through prosodic forms processingMas Manchón, LluísLocución informativaSegmentación automáticaFormas prosódicasCepstrumEstilización macromelódicaLa segmentación automatizada de noticias en tiempo real es un problema que ha tenido un abordaje fundamentalmente lingüístico y de procesamiento de la señal en los últimos años. El trabajo que presentamos tiene un enfoque sustancialmente diferente: desde una perspectiva comunicológica, se toman las formas prosódicas típicas del discurso informativo y se intentan programar mediante el procesamiento cepstrum en el entorno Labview. Después de numerosas pruebas se fijan los diferentes parámetros de procesamiento y estilización de la curva macromelódica basada en los máximos de pitch (parábolas). Se formula un algoritmo de segmentación automática de noticias a partir de la detección de pausas y el análisis de formas prosódicas de inicio y final de noticia. Sobre una muestra de cinco informativos reales emitidos en el canal español Cuatro en julio de 2009, el entorno detecta 98 pausas y etiqueta correctamente (corte/no corte) el 76% de las mismas. La totalidad de los cortes estaban contenidos en las 98 pausas localizadas, de los cuales el algoritmo pasa por alto 9 y genera 15 errores de cortes mal emplazados. Tanto la lingüística computacional como el procesamiento del habla pueden tener un importante margen de mejora si también se asume la perspectiva comunicológica: agrupar datos acústicos como variables complejas asociadas a cada acto de comunicación. Para futuros trabajos, este algoritmo puede ser mejorado si se complementa con sistemas de identificación de locutores, discriminación de ruidos y word spotting.Universidad de Tarapacá202420242014info:eu-repo/semantics/articleinfo:eu-repo/semantics/publishedVersionapplication/pdfapplication/pdfhttp://hdl.handle.net/10230/59252http://dx.doi.org/10.4067/S0718-33052014000300008reponame:Recercat. Dipósit de la Recerca de Catalunyainstname:Varias* (Consorci de Biblioteques Universitáries de Catalunya, Centre de Serveis Científics i Acadèmics de Catalunya)EspañolRevista chilena de ingeniería. 2014 Sep;22(3):374-83All the contents of this journal, except where otherwise noted, is licensed under a Creative Commons Attribution License.http://creativecommons.org/licenses/by/4.0/deed.eninfo:eu-repo/semantics/openAccessoai:recercat.cat:10230/592522026-05-29T05:05:01Z
dc.title.none.fl_str_mv Segmentación automática de noticias mediante procesamiento de formas prosódicas
Automatic segmentation of news through prosodic forms processing
title Segmentación automática de noticias mediante procesamiento de formas prosódicas
spellingShingle Segmentación automática de noticias mediante procesamiento de formas prosódicas
Mas Manchón, Lluís
Locución informativa
Segmentación automática
Formas prosódicas
Cepstrum
Estilización macromelódica
title_short Segmentación automática de noticias mediante procesamiento de formas prosódicas
title_full Segmentación automática de noticias mediante procesamiento de formas prosódicas
title_fullStr Segmentación automática de noticias mediante procesamiento de formas prosódicas
title_full_unstemmed Segmentación automática de noticias mediante procesamiento de formas prosódicas
title_sort Segmentación automática de noticias mediante procesamiento de formas prosódicas
dc.creator.none.fl_str_mv Mas Manchón, Lluís
author Mas Manchón, Lluís
author_facet Mas Manchón, Lluís
author_role author
dc.subject.none.fl_str_mv Locución informativa
Segmentación automática
Formas prosódicas
Cepstrum
Estilización macromelódica
topic Locución informativa
Segmentación automática
Formas prosódicas
Cepstrum
Estilización macromelódica
description La segmentación automatizada de noticias en tiempo real es un problema que ha tenido un abordaje fundamentalmente lingüístico y de procesamiento de la señal en los últimos años. El trabajo que presentamos tiene un enfoque sustancialmente diferente: desde una perspectiva comunicológica, se toman las formas prosódicas típicas del discurso informativo y se intentan programar mediante el procesamiento cepstrum en el entorno Labview. Después de numerosas pruebas se fijan los diferentes parámetros de procesamiento y estilización de la curva macromelódica basada en los máximos de pitch (parábolas). Se formula un algoritmo de segmentación automática de noticias a partir de la detección de pausas y el análisis de formas prosódicas de inicio y final de noticia. Sobre una muestra de cinco informativos reales emitidos en el canal español Cuatro en julio de 2009, el entorno detecta 98 pausas y etiqueta correctamente (corte/no corte) el 76% de las mismas. La totalidad de los cortes estaban contenidos en las 98 pausas localizadas, de los cuales el algoritmo pasa por alto 9 y genera 15 errores de cortes mal emplazados. Tanto la lingüística computacional como el procesamiento del habla pueden tener un importante margen de mejora si también se asume la perspectiva comunicológica: agrupar datos acústicos como variables complejas asociadas a cada acto de comunicación. Para futuros trabajos, este algoritmo puede ser mejorado si se complementa con sistemas de identificación de locutores, discriminación de ruidos y word spotting.
publishDate 2014
dc.date.none.fl_str_mv 2014
2024
2024
dc.type.none.fl_str_mv info:eu-repo/semantics/article
info:eu-repo/semantics/publishedVersion
format article
status_str publishedVersion
dc.identifier.none.fl_str_mv http://hdl.handle.net/10230/59252
http://dx.doi.org/10.4067/S0718-33052014000300008
url http://hdl.handle.net/10230/59252
http://dx.doi.org/10.4067/S0718-33052014000300008
dc.language.none.fl_str_mv Español
language_invalid_str_mv Español
dc.relation.none.fl_str_mv Revista chilena de ingeniería. 2014 Sep;22(3):374-83
dc.rights.none.fl_str_mv http://creativecommons.org/licenses/by/4.0/deed.en
info:eu-repo/semantics/openAccess
rights_invalid_str_mv http://creativecommons.org/licenses/by/4.0/deed.en
eu_rights_str_mv openAccess
dc.format.none.fl_str_mv application/pdf
application/pdf
dc.publisher.none.fl_str_mv Universidad de Tarapacá
publisher.none.fl_str_mv Universidad de Tarapacá
dc.source.none.fl_str_mv reponame:Recercat. Dipósit de la Recerca de Catalunya
instname:Varias* (Consorci de Biblioteques Universitáries de Catalunya, Centre de Serveis Científics i Acadèmics de Catalunya)
instname_str Varias* (Consorci de Biblioteques Universitáries de Catalunya, Centre de Serveis Científics i Acadèmics de Catalunya)
reponame_str Recercat. Dipósit de la Recerca de Catalunya
collection Recercat. Dipósit de la Recerca de Catalunya
repository.name.fl_str_mv
repository.mail.fl_str_mv
_version_ 1869421788908224512
score 15.812455