Segmentação automática de vídeo em cenas baseada em coerência entre tomadas

A popularização de aplicativos e dispositivos capazes de produzir, exibir e editar conteúdos multimídia fez surgir a necessidade de se adaptar, modificar e customizar diferentes tipos de mídia a diferentes necessidades do usuário. Nesse contexto, a área de Personalização e Adaptação de Conteúdo busc...

ver descrição completa

Detalhes bibliográficos
Autor: Trojahn, Tiago Henrique
Tipo de documento: dissertação
Estado:Versão publicada
Data de publicação:2014
País:Brasil
Recursos:Universidade de São Paulo (USP)
Repositório:Biblioteca Digital de Teses e Dissertações da USP
Idioma:português
OAI Identifier:oai:teses.usp.br:tde-20052014-152446
Acesso em linha:http://www.teses.usp.br/teses/disponiveis/55/55134/tde-20052014-152446/
Access Level:Acceso aberto
Palavra-chave:Coerência visual
Digital video segmentation
Personalização e adaptação de conteúdo
Personalization and content adaptation
Scene segmentation
Segmentação de vídeo digital
Segmentação em cenas
Visual coherence
Descrição
Resumo:A popularização de aplicativos e dispositivos capazes de produzir, exibir e editar conteúdos multimídia fez surgir a necessidade de se adaptar, modificar e customizar diferentes tipos de mídia a diferentes necessidades do usuário. Nesse contexto, a área de Personalização e Adaptação de Conteúdo busca desenvolver soluções que atendam a tais necessidades. Sistemas de personalização, em geral, necessitam conhecer os dados presentes na mídia, surgindo, assim, a necessidade de uma indexação do conteúdo presente na mídia. No caso de vídeo digital, os esforços para a indexação automática utilizam como passo inicial a segmentação de vídeos em unidades de informação menores, como tomadas e cenas. A segmentação em cenas, em especial, é um desafio para pesquisadores graças a enorme variedade entre os vídeos e a própria ausência de um consenso na definição de cena. Diversas técnicas diferentes para a segmentação em cenas são reportadas na literatura. Uma técnica, em particular, destaca-se pelo baixo custo computacional: a técnica baseada em coerências visual. Utilizando-se operações de histogramas, a técnica objetiva-se a comparar tomadas adjacentes em busca de similaridades que poderiam indicar a presença de uma cena. Para melhorar os resultados obtidos, autores de trabalhos com tal enfoque utilizam-se de outras características, capazes de medir a \"quantidade de movimento\" das cenas, como os vetores de movimento. Assim, este trabalho apresenta uma técnica de segmentação de vídeo digital em tomadas e em cenas através da coerência visual e do fluxo óptico. Apresenta-se, ainda, uma série de avaliações de eficácia e de desempenho da técnica ao segmentar em tomadas e em cenas uma base de vídeo do domínio filmes