[pt] MEDIDAS DE SIMILARIDADE ENTRE SÉRIES TEMPORAIS

[pt] Atualmente, uma tarefa muito importante na mineração de dados é compreender como extrair os dados mais informativos dentre um número muito grande de dados. Uma vez que todos os campos de conhecimento apresentam uma grande quantidade de dados que precisam ser reduzidas até as informações mais re...

Descripción completa

Detalles Bibliográficos
Autor: JOSE LUIZ DO NASCIMENTO DE AGUIAR
Tipo de recurso: tesis doctoral
Estado:Versión publicada
Fecha de publicación:2016
País:Brasil
Institución:Pontifícia Universidade Católica do Rio de Janeiro (PUC-RIO)
Repositorio:Repositório Institucional da PUC-RIO (Projeto Maxwell)
Idioma:portugués
OAI Identifier:oai:MAXWELL.puc-rio.br:27789
Acceso en línea:https://www.maxwell.vrac.puc-rio.br/colecao.php?strSecao=resultado&nrSeq=27789&idi=1
https://www.maxwell.vrac.puc-rio.br/colecao.php?strSecao=resultado&nrSeq=27789&idi=2
http://doi.org/10.17771/PUCRio.acad.27789
Access Level:acceso abierto
Palabra clave:[pt] SERIE TEMPORAL
[pt] APRENDIZADO DE MAQUINA
[pt] METODOS DE MEDIDA DE SIMILARIDADE
[pt] SIMILARIDADE
[en] TIME SERIE
[en] MACHINE LEARNING
[en] SIMILARITY
Descripción
Sumario:[pt] Atualmente, uma tarefa muito importante na mineração de dados é compreender como extrair os dados mais informativos dentre um número muito grande de dados. Uma vez que todos os campos de conhecimento apresentam uma grande quantidade de dados que precisam ser reduzidas até as informações mais representativas, a abordagem das séries temporais é definitivamente um método muito forte para representar e extrair estas informações. No entanto nós precisamos ter uma ferramenta apropriada para inferir os dados mais significativos destas séries temporais, e para nos ajudar, podemos utilizar alguns métodos de medida de similaridade para saber o grau de igualdade entre duas séries temporais, e nesta pesquisa nós vamos realizar um estudo utilizando alguns métodos de similaridade baseados em medidas de distância e aplicar estes métodos em alguns algoritmos de clusterização para fazer uma avaliação de se existe uma combinação (método de similaridade baseado em distância / algoritmo de clusterização) que apresenta uma performance melhor em relação a todos os outros utilizados neste estudo, ou se existe um método de similaridade baseado em distância que mostra um desempenho melhor que os demais.