Delayed Transfer Entropy applied to Big Data

Dourado, Jonas Rossi

doi:10.11606/D.18.2019.tde-19022019-134228

Início

Servicios

Disertación de Maestría

DOI

https://doi.org/10.11606/D.18.2019.tde-19022019-134228

Documento

Disertación de Maestría

Autor

Dourado, Jonas Rossi (Catálogo USP)

Nombre completo

Jonas Rossi Dourado

Instituto/Escuela/Facultad

Escola de Engenharia de São Carlos

Área de Conocimiento

Sistemas Dinámicos

Fecha de Defensa

2018-11-30

Publicación

São Carlos, 2018

Director

Maciel, Carlos Dias (Catálogo USP)

Tribunal

Maciel, Carlos Dias (Presidente)
Delbem, Alexandre Cláudio Botazzo
Shinoda, Ailton Akira

Título en inglés

Delayed Transfer Entropy applied to Big Data

Palabras clave en inglés

Big Data analysis
Causality
Delayed Transfer Entropy
Heterogeneous computer cluster
Parallelism strategies
Surrogate

Resumen en inglés

Recent popularization of technologies such as Smartphones, Wearables, Internet of Things, Social Networks and Video streaming increased data creation. Dealing with extensive data sets led the creation of term big data, often defined as when data volume, acquisition rate or representation demands nontraditional approaches to data analysis or requires horizontal scaling for data processing. Analysis is the most important Big Data phase, where it has the objective of extracting meaningful and often hidden information. One example of Big Data hidden information is causality, which can be inferred with Delayed Transfer Entropy (DTE). Despite DTE wide applicability, it has a high demanding processing power which is aggravated with large datasets as those found in big data. This research optimized DTE performance and modified existing code to enable DTE execution on a computer cluster. With big data trend in sight, this results may enable bigger datasets analysis or better statistical evidence.

Título en portugués

Delayed Transfer Entropy aplicado a Big Data

Palabras clave en portugués

Análise de Big Data
Causalidade
Cluster heterogêneo de computadores
Delayed Transfer Entropy
Estratégias de paralelismo
Surrogate

Resumen en portugués

A recente popularização de tecnologias como Smartphones, Wearables, Internet das Coisas, Redes Sociais e streaming de Video aumentou a criação de dados. A manipulação de grande quantidade de dados levou a criação do termo Big Data, muitas vezes definido como quando o volume, a taxa de aquisição ou a representação dos dados demanda abordagens não tradicionais para analisar ou requer uma escala horizontal para o processamento de dados. A análise é a etapa de Big Data mais importante, tendo como objetivo extrair informações relevantes e às vezes escondidas. Um exemplo de informação escondida é a causalidade, que pode ser inferida utilizando Delayed Transfer Entropy (DTE). Apesar do DTE ter uma grande aplicabilidade, ele possui uma grande demanda computacional, esta última, é agravada devido a grandes bases de dados como as encontradas em Big Data. Essa pesquisa otimizou e modificou o código existente para permitir a execução de DTE em um cluster de computadores. Com a tendência de Big Data em vista, esse resultado pode permitir bancos de dados maiores ou melhores evidências estatísticas.

ADVERTENCIA - La consulta de este documento queda condicionada a la aceptación de las siguientes condiciones de uso:
Este documento es únicamente para usos privados enmarcados en actividades de investigación y docencia. No se autoriza su reproducción con finalidades de lucro. Esta reserva de derechos afecta tanto los datos del documento como a sus contenidos. En la utilización o cita de partes del documento es obligado indicar el nombre de la persona autora.

Jonas.pdf (5.17 Mbytes)

Fecha de Publicación

2019-03-15

Trabajos derivados

ADVERTENCIA: Aprenda que son los trabajos derivados haciendo clic aquí.