商品簡介
No mundo atual, em r嫚ido crescimento, analis嫥os fontes de dados distribu獮as que publicam at?gigabytes de dados todos os dias, acumulando ao longo de v嫫ios meses ?escala dos terabytes. Isto levanta o desafio de como armazenar de forma eficiente estes conjuntos de dados distribu獮os, tanto em caches de trabalho para acesso r嫚ido em tempo real como em formas arquivadas que podem ser reinstaladas para an嫮ise de dados offline. Neste documento, apresentamos os servi蔞s de processamento necess嫫ios para aceder a v嫫ios conjuntos de dados em simult滱eo para produzir resultados inteligentes de fus緌 de dados, que s緌 posteriormente disponibilizados aos decisores em tempo real. Uma vez que ?dif獳il analisar todos os resultados de forma eficiente, temos de encontrar uma solu誽o para tornar o processamento mais r嫚ido e mais eficiente. Neste caso, estamos a conceber um m彋odo que utiliza metatags para reduzir o tempo de processamento e a carga dos sistemas existentes. Os metatags definem basicamente os v嫫ios atributos dos ficheiros de dados e d緌-nos op踥es para aceder aos ficheiros com base na sele誽o dos atributos. No sistema proposto, a sem滱tica leve e a sem滱tica pesada est緌 a ser separadas com base no tamanho. Os ficheiros de tamanho superior a 10 s緌 adicionados ?lista de peso pesado e os ficheiros de tamanho inferior a 10 s緌 adicionados ?lista de peso leve.