A Fast Distributed Mining of Association Rules In
Horizontally Distributed Database

Rajkumar.S; V.Elavarasi

Abstracto

A Fast Distributed Mining of Association Rules In Horizontally Distributed Database

Rajkumar.S , V.Elavarasi

Data mining can extract important knowledge from large data collections, but sometimes these collections are split among various parties. This paper addresses a fast distributed mining of association rules over horizontally distributed data. While preparing a data set for analysis is generally the most time consuming task in a data mining,requiring numerous complex SQL queries, joining tables and aggregating columns. Existing SQL aggregations have limitations to prepare data sets because they return one column per aggregated group. In general, a significant manual effort is required to build data sets, where a horizontal layout is required. The proposed is simple, yet powerful, methods to generate SQL code to return aggregated columns in a horizontal tabular layout, returning a set of numbers instead of one number per row. This new class of functions is called horizontal aggregations. Horizontal aggregations build data sets with a horizontal de normalized layout (e.g. point-dimension, observation-variable, instance-feature), which is the standard layout required by most data mining algorithms. The proposed method used three categories to evaluate horizontal aggregations: CASE: Exploiting the programming CASE construct; SPJ: Based on standard relational algebra operators (SPJ queries); PIVOT: Using the PIVOT operator, which is offered by some DBMSs. Experiments with large tables compare the proposed query evaluation methods. A CASE method has similar speed to the PIVOT operator and it is much faster than the SPJ method. In general, the CASE and PIVOT methods exhibit linear scalability, whereas the SPJ method does not.

Descargo de responsabilidad: este resumen se tradujo utilizando herramientas de inteligencia artificial y aún no ha sido revisado ni verificado.

Aspectos destacados de la revista

Adaptado Algoritmos numéricos avanzados Almacenamiento de datos Arquitecturas informáticas avanzadas Banda Ancha y Redes Inteligentes Bioinformática y Biología Computacional Computación autónoma y consciente del contexto Computación Grid Estructura de datos Middleware basado en agentes Protocolo de comunicación CDMA/GSM Reconocimiento de patrones/imágenes de inteligencia artificial Red ad hoc Robótica Seguridad de la base de datos Sensores inalámbricos Sistemas de seguridad Software de código abierto Tecnología de radar Tecnología tranquila

Indexado en

Índice Copérnico

Academic Keys

CiteFactor

Cosmos SI

Búsqueda de referencia

Universidad Hamdard

Catálogo mundial de revistas científicas

Factor de impacto de revistas innovadoras internacionales (IIJIF)

Instituto Internacional de Investigación Organizada (I2OR)

Cosmos

Revistas internacionales

Ciencias farmacéuticas Ciencias Generales Ciencias Médicas Ingeniería

Revista internacional de investigación innovadora en ingeniería informática y de comunicaciones

Abstracto

A Fast Distributed Mining of Association Rules In Horizontally Distributed Database

Aspectos destacados de la revista

Indexado en

Revistas internacionales

Dirección