Segmentação de imagens de pessoas em tempo real para videoconferências

Orientador(a) (dc.contributor.advisor)Oliveira, Luiz Paulo Luna de
Lattes Orientador(a) (dc.contributor.advisorLattes)http://lattes.cnpq.br/0625922822611048pt_BR
Autor(a) (dc.contributor.author)Parolin, Alessandro
Autor(a) Lattes (dc.contributor.authorLattes)http://lattes.cnpq.br/6931013337647100pt_BR
Data de Disponibilização (dc.date.accessioned)2015-03-16T14:26:47Z
dc.date.available (dc.date.available)2015-03-16T14:26:47Z
Data da defesa / Data do evento (dc.date.issued)2011-03-22
Abstract (dc.description.abstract)Object segmentation has been discussed on Computer Vision and Image processing fields for quite some time. Recently, given the hardware evolution and popularization of the World Wide Web, videoconferences have been the main discussion in this area. This technique brings advantages to many fields, such as telemedicine, education (distance learning), and mainly to the business world. Many companies use videoconferences for worldwide meetings, in order to save a substantial amount o f resources. However, videoconferences still do not provide the same experience a s people have when they are in the same room. Therefore, in this paper we propose the development of a system to segment the image of a person who is attending the videoconference, in order to allow future processing that may increase the experience of being in the same room. For instance, the background of the scene could be replaced by a standard one for all participants. The proposed system uses a dynamic programming algorithm guided by energies, such as image edges, motion and probabilistic information. After extensive tests, we could conclude that the results obtained are comparable to other state of the art works and the system is able to execute in real time at 8 FPS. The advantage of the proposed system when compared to others is that no previous training is required in order to perform the segmentationen
Resumo (dc.description.resumo)Segmentação de objetos em imagens e vídeos é uma área relativamente antiga na área de processamento de imagens e visão computacional. De fato, recentemente, devido à grande evolução dos sistemas computacionais em termos de hardware e à popularização da internet, uma aplicação de segmentação de imagens de pessoas que vem ganhando grande destaque na área acadêmica e comercial são as videoconferências. Esse tipo de aplicação traz benefícios a diferentes áreas, como telemedicina, educação à distância, e principalmente empresarial. Diversas empresas utilizam esse tipo de recurso para realizar reuniões/conferências a nível global economizando quantias consideráveis de recursos. No entanto, videoconferências ainda não proporcionam a mesma experiência que as pessoas têm quando estão num mesmo ambiente. Portanto, esse trabalho propõe o desenvolvimento de um sistema de segmentação da imagem do locutor, específico para videoconferências, a fim de permitir futuros processamentos que aumentem a sensação de imersão dos participantes, como por exemplo, a substituição do fundo da imagem por um fundo padrão em todos ambientes. O sistema proposto utiliza basicamente um algoritmo de programação dinâmica guiado por energias extraídas da imagem, envolvendo informações de borda, movimento e probabilidade. Através de diversos testes realizados, observou-se que o sistema apresenta resultados equiparáveis aos do estado da arte do tema, sendo capaz de ser executado em tempo real a uma taxa de 8 FPS, mesmo com um código não otimizado. O grande diferencial do sistema proposto é que nenhum tipo de treinamento prévio é necessário para efetuar a segmentaçãopt_BR
Agência de fomento (dc.description.sponsorship)HP - Hewlett-Packard Brasil Ltdapt_BR
Agência de fomento (dc.description.sponsorship)Milton Valentept_BR
URI (dc.identifier.uri)http://www.repositorio.jesuita.org.br/handle/UNISINOS/3005
Idioma (dc.language)pt_BRpt_BR
Nome da instituição (dc.publisher)Universidade do Vale do Rio dos Sinospt_BR
País da Instituição (dc.publisher.country)Brasilpt_BR
Departamento (dc.publisher.department)Escola Politécnicapt_BR
Sigla da Instituição (dc.publisher.initials)Unisinospt_BR
Programa (dc.publisher.program)Programa de Pós-Graduação em Computação Aplicadapt_BR
Direitos de acesso ao documento (dc.rights)openAccesspt_BR
Assunto (dc.subject)Videoconferênciaspt_BR
Assunto (dc.subject)Processamento de imagenspt_BR
Assunto (dc.subject)Detecção de facespt_BR
Assunto (dc.subject)Segmentação de objetospt_BR
Assunto (dc.subject)Visão computacionalpt_BR
Assunto (dc.subject)Interação homem-máquinapt_BR
Assunto (dc.subject)Human segmentationen
Assunto (dc.subject)Image processingen
Assunto (dc.subject)Computer visionen
Assunto (dc.subject)Face detectionen
Tema (CNPq) (dc.subject.cnpq)ACCNPQ::Ciências Exatas e da Terra::Ciência da Computaçãopt_BR
Título (dc.title)Segmentação de imagens de pessoas em tempo real para videoconferênciaspt_BR
Tipo de arquivo (dc.type)Dissertaçãopt_BR

Arquivos

Pacote original

Agora exibindo 1 - 1 de 1
Carregando...
Imagem de Miniatura
Nome:
segmentacao_imagens.pdf
Tamanho:
6.17 MB
Formato:
Adobe Portable Document Format
Descrição:
segmentacao_imagens

Licença do pacote

Agora exibindo 1 - 1 de 1
Carregando...
Imagem de Miniatura
Nome:
license.txt
Tamanho:
2.05 KB
Formato:
Item-specific license agreed upon to submission
Descrição: