商品簡介
Data Mining kann zur Aufdeckung von Mustern in Daten verwendet werden, wird aber oft nur an Stichproben von Daten durchgefrt. Der Mining-Prozess ist unwirksam, wenn die Stichproben keine gute Repr酲entation der Gesamtheit der Daten sind. Data Mining kann keine Muster entdecken, die in der Gesamtheit der Daten vorhanden sind, wenn diese Muster nicht in der untersuchten Stichprobe vorhanden sind. Die Unf鄣igkeit, Muster zu finden, kann ein Grund f Streitigkeiten zwischen Kunden und Dienstleistern sein. Data Mining ist also nicht narrensicher, kann aber nzlich sein, wenn ausreichend repr酲entative Datenproben gesammelt werden. Die Entdeckung eines bestimmten Musters in einem bestimmten Datensatz bedeutet nicht zwangsl酳fig, dass das Muster auch an anderer Stelle in den gr?eren Daten, aus denen diese Stichprobe gezogen wurde, zu finden ist. Ein wichtiger Teil des Prozesses ist die 鈁erprung und Validierung von Mustern in anderen Datenproben.