商品簡介
Dans le monde actuel en pleine croissance, nous avons analys?des sources de donn嶪s distribu嶪s qui publient jusqu'?des gigaoctets de donn嶪s chaque jour, s'accumulant sur une p廨iode de plusieurs mois pour atteindre l'嶰helle du t廨aoctet. Cela pose le probl鋗e du stockage efficace de ces ensembles de donn嶪s distribu嶪s, ?la fois dans des caches de travail pour un acc鋊 rapide en temps r嶪l et dans des formes archiv嶪s qui peuvent 皻re r嶯nt嶲r嶪s pour l'analyse des donn嶪s hors ligne. Dans cet article, nous avons pr廥ent?les services de traitement n嶰essaires pour acc嶮er simultan幦ent ?plusieurs ensembles de donn嶪s afin de produire des r廥ultats intelligents de fusion de donn嶪s, qui sont ensuite mis ?la disposition des d嶰ideurs en temps r嶪l. Comme il est difficile d'analyser efficacement tous les r廥ultats, nous devons trouver une solution pour rendre le traitement plus rapide et plus efficace. Nous concevons ici une m彋hode utilisant les m彋abalises pour r嶮uire le temps de traitement et la charge des syst鋗es existants. Les m彋abalises d嶨inissent essentiellement les diff廨ents attributs des fichiers de donn嶪s et nous fournissent des options pour acc嶮er aux fichiers sur la base de la s幨ection des attributs. Dans le syst鋗e propos? la s幦antique l嶲鋨e et la s幦antique lourde sont s廧ar嶪s en fonction de leur taille. Les noms sup廨ieurs ?10 sont ajout廥 ?la liste des noms lourds et les noms inf廨ieurs ?10 sont ajout廥 ?la liste des noms l嶲ers.