Identificação de atividade de voz baseada em vídeo

Orientador(a) (dc.contributor.advisor)Villamil, Marta Becker
Lattes Orientador(a) (dc.contributor.advisorLattes)http://lattes.cnpq.br/8408262156304669pt_BR
Autor(a) (dc.contributor.author)Scott, Dariopt_BR
Autor(a) Lattes (dc.contributor.authorLattes)http://lattes.cnpq.br/0234951091078070pt_BR
Data de Disponibilização (dc.date.accessioned)2015-03-05T14:01:22Z
dc.date.available (dc.date.available)2015-03-05T14:01:22Z
Data da defesa / Data do evento (dc.date.issued)2010-03-30
Abstract (dc.description.abstract)Currently, there are several works with many di_erent approaches to image processing for detection of voice activity (VAD). Its applications cross over di_erent areas, such as voice commands in vehicles and videoconferencing. The motivation of this work consists in building an algorithm that contributes to the improvement of techniques image processing applied to detect voice activity on video. The issue already presents a great diversity of approaches. However, the focus of this work lies in _nding alternatives to improve the extraction of a skin and non-skin color model and, from there, extract a classi_er to identify the activity of speech more accurately. Existing algorithms of face detection and classi_cation of the lips were used and improved. Through the creation of patches under the eyes, a model was created to determine the individual characteristics of skin color using the mean and standard deviation of the pixels of the patches and the mouth area. The results are presented based on two approaches.en
Resumo (dc.description.resumo)Atualmente, existem diversos trabalhos com as mais variadas abordagens relativas ao processamento de imagens digitais para detecção de atividade de voz (VAD). As suas aplicações perpassam diferentes áreas, como por exemplo, comandos de voz em veículos e videoconferência. A motivação deste trabalho constitui-se na construção de um algoritmo que contribua para o aperfeiçoamento das técnicas de processamento de imagens aplicadas para a detecção de atividade de voz em vídeos. A problemática envolvida já apresenta uma grande diversidade de abordagens. No entanto, o foco deste trabalho situa-se na busca de alternativas para a melhoria na extração de um modelo de cor de pele e não-pele e, a partir daí, extrair um classificador para identificar a atividade de fala com mais precisão. Algoritmos já existentes de identificação de face e de classificação dos lábios foram utilizados e aprimorados. Através da criação de patches abaixo dos olhos, foi criado um modelo para determinar as características individuais de cor dept_BR
Agência de fomento (dc.description.sponsorship)Hewlett-Packard Brasil Ltdapt_BR
URI (dc.identifier.uri)http://www.repositorio.jesuita.org.br/handle/UNISINOS/2285
Idioma (dc.language)pt_BRpt_BR
Nome da instituição (dc.publisher)Universidade do Vale do Rio do Sinospt_BR
País da Instituição (dc.publisher.country)Brasilpt_BR
Departamento (dc.publisher.department)Escola Politécnicapt_BR
Sigla da Instituição (dc.publisher.initials)UNISINOSpt_BR
Programa (dc.publisher.program)Programa de Pós-Graduação em Computação Aplicadapt_BR
Direitos de acesso ao documento (dc.rights)openAccesspt_BR
Assunto (dc.subject)detecção de falapt_BR
Assunto (dc.subject)modelo de cor de pelept_BR
Assunto (dc.subject)processamento de imagempt_BR
Assunto (dc.subject)image processingen
Assunto (dc.subject)skin color modelen
Assunto (dc.subject)voice activity detectionen
Tema (CNPq) (dc.subject.cnpq)Ciências Exatas e da Terrapt_BR
Título (dc.title)Identificação de atividade de voz baseada em vídeopt_BR
Tipo de arquivo (dc.type)Dissertaçãopt_BR

Arquivos

Pacote original

Agora exibindo 1 - 1 de 1
Carregando...
Imagem de Miniatura
Nome:
DarioScottComputacaoAplicada.pdf
Tamanho:
1.57 MB
Formato:
Adobe Portable Document Format
Descrição:
DarioScottComputacaoAplicada