Zuhause Persönliche Finanzen Die Grenzen der Daten in Predictive Analytics - Dummies

Die Grenzen der Daten in Predictive Analytics - Dummies

Video: COMPUTERWOCHE Round Table: Predictive Analytics - wo Mehrwert noch an Grenzen stößt 2025

Video: COMPUTERWOCHE Round Table: Predictive Analytics - wo Mehrwert noch an Grenzen stößt 2025
Anonim

Wie bei vielen Aspekten eines Geschäftssystems sind Daten eine menschliche Schöpfung - daher ist es wahrscheinlich, dass die Benutzerfreundlichkeit eingeschränkt wird, wenn Sie zuerst erhalte es. Hier finden Sie eine Übersicht über einige Einschränkungen, denen Sie wahrscheinlich begegnen werden:

  • Die Daten können unvollständig sein. Fehlende Werte, selbst das Fehlen eines Abschnitts oder eines wesentlichen Teils der Daten, können die Benutzerfreundlichkeit einschränken.

    Zum Beispiel können Ihre Daten nur eine oder zwei Bedingungen einer größeren Menge abdecken, die Sie modellieren möchten - wie bei einem Modell zur Analyse der Aktienmarkt-Performance nur Daten aus den letzten 5 Jahren verfügbar sind, die beide verzerrt die Daten und das Modell zur Annahme eines Bullenmarktes.

    In dem Moment, in dem der Markt eine Korrektur erfährt, die zu einem Bärenmarkt führt, passt sich das Modell nicht an - einfach weil es nicht mit Daten, die einen Bärenmarkt darstellen, trainiert und getestet wurde.

    Stellen Sie sicher, dass Sie sich einen Zeitrahmen ansehen, der Ihnen ein vollständiges Bild der natürlichen Schwankungen Ihrer Daten vermittelt. Ihre Daten sollten nicht durch Saisonalität beschränkt sein.

  • Wenn Sie Daten aus Umfragen verwenden, denken Sie daran, dass Personen nicht immer genaue Informationen bereitstellen. Nicht jeder wird wahrheitsgemäß beantworten, wie oft er trainiert - oder wie viele alkoholische Getränke er konsumiert - pro Woche. Die Leute mögen nicht so unehrlich sein wie selbstbewusst, aber die Daten sind immer noch verzerrt.

  • Daten aus verschiedenen Quellen können in Qualität und Format variieren. Daten, die aus so unterschiedlichen Quellen wie Umfragen, E-Mails, Dateneingabeformularen und der Unternehmenswebsite gesammelt werden, haben unterschiedliche Attribute und Strukturen. Daten aus verschiedenen Quellen haben möglicherweise keine große Kompatibilität zwischen Datenfeldern. Solche Daten erfordern eine umfangreiche Vorverarbeitung, bevor sie analysefähig ist. Die beigefügte Seitenleiste enthält ein Beispiel.

Daten aus mehreren Quellen können Unterschiede in der Formatierung, doppelte Datensätze und Inkonsistenzen in zusammengeführten Datenfeldern aufweisen. Erwarten Sie eine lange Zeit damit, diese Daten zu säubern - und die Zuverlässigkeit noch länger zu bestätigen.

Um die Einschränkungen Ihrer Daten zu bestimmen, gehen Sie folgendermaßen vor:

  • Überprüfen Sie alle Variablen, die Sie in Ihrem Modell verwenden.

  • Bewerten Sie den Umfang der Daten, insbesondere im Laufe der Zeit, damit Ihr Modell die Saisonalitätsfalle vermeiden kann.

  • Überprüfen Sie fehlende Werte, identifizieren Sie sie und bewerten Sie ihre Auswirkungen auf die Gesamtanalyse.

  • Achten Sie auf Extremwerte (Ausreißer) und entscheiden Sie, ob diese in die Analyse einbezogen werden sollen.

  • Bestätigen Sie, dass der Pool von Trainings- und Testdaten groß genug ist.

  • Stellen Sie sicher, dass Datentyp (Ganzzahlen, Dezimalwerte oder Zeichen usw.) korrekt ist, und legen Sie die obere und untere Grenze der möglichen Werte fest.

  • Achten Sie besonders auf die Datenintegration, wenn Ihre Daten aus mehreren Quellen stammen.

Stellen Sie sicher, dass Sie Ihre Datenquellen und deren Auswirkungen auf die Gesamtqualität Ihrer Daten verstehen.

  • Wählen Sie einen relevanten Datensatz aus, der für die gesamte Population repräsentativ ist.

  • Wählen Sie die richtigen Parameter für Ihre Analyse aus.

Lassen Sie sich auch nach all dieser Sorgfalt und Aufmerksamkeit nicht wundern, wenn Ihre Daten noch Vorverarbeitung benötigen, bevor Sie sie genau analysieren können. Die Vorverarbeitung dauert oft lange und ist mit erheblichem Aufwand verbunden, da mehrere Probleme im Zusammenhang mit den Originaldaten angegangen werden müssen. Dazu gehören:

  • Alle Werte fehlen in den Daten.

  • In den Daten vorhandene Inkonsistenzen und / oder Fehler.

  • Alle Duplikate oder Ausreißer in den Daten.

  • Jede Normalisierung oder andere Transformation der Daten.

  • Alle abgeleiteten Daten, die für die Analyse benötigt werden.

Die Grenzen der Daten in Predictive Analytics - Dummies

Die Wahl des Herausgebers

Photoshop 7 Navigationswerkzeuge - dummies

Photoshop 7 Navigationswerkzeuge - dummies

Photoshop 7 bietet alle Möglichkeiten, durch die Funktionen zu navigieren, egal ob Sie eine Mac oder ein Windows-System. In der folgenden Tabelle finden Sie Informationen zum Scrollen, Zoomen und Durchlaufen von Photoshop 7: Action Windows Mac Scrollen Sie mit der Leertaste + ziehen Sie die Leertaste + Strg + Leertaste + klicken Sie auf Apple Command + Leertaste + klicken Sie auf Vergrößern und ändern ...

Photoshop 7 Mal- und bearbeitungswerkzeuge - dummies

Photoshop 7 Mal- und bearbeitungswerkzeuge - dummies

In Photoshop 7 sind die Tastenkombinationen für Mal- und Bearbeitungswerkzeuge meist das Gleiche, ob Sie ein Windows-basiertes System oder einen Mac verwenden. Der einzige Unterschied besteht im letzten Eintrag in der folgenden Tabelle, in der die Verknüpfungen angezeigt werden: Erhöhen der Pinselgröße] Verringern der Pinselgröße [Ändern der Deckkraft oder des Werkzeugflusses 1, ...

Photoshop 7 Paletten-Werkzeuge - Dummies

Photoshop 7 Paletten-Werkzeuge - Dummies

Die Paletten von Photoshop 7 geben Ihnen Zugriff auf Gruppen verwandter Werkzeuge. Wenn Sie sich also auf Farbe konzentrieren, können Sie die Farbpalette aufziehen und Ihre Photoshop-Bilder mit einem Regenbogen von Schattierungen beleben. Die folgende Tabelle zeigt den Zugriff auf die verschiedenen Photoshop 7-Paletten in Windows- und Mac-Systemen: Palette / Aktion ...

Die Wahl des Herausgebers

Fantasy Fußball für Dummies Cheat Sheet - Dummies

Fantasy Fußball für Dummies Cheat Sheet - Dummies

Fantasy Fußball ist ein Spaß, wettbewerbsfähig und süchtig machendes Hobby. Bringen Sie Ihre Fantasy-Saison in Schwung, indem Sie Spieler entwerfen, um ein solides Team aufzubauen und Coaching-Tipps verwenden, um Ihr Team stark zu machen. Wenn Sie eine Position verbessern müssen, probieren Sie einige Strategien für den Handel mit Spielern und den Erwerb freier Agenten aus. Halten Sie einen Führer handlich von ...

Wie Fantasy-Fußball-Playoffs funktionieren - Dummies

Wie Fantasy-Fußball-Playoffs funktionieren - Dummies

Wenn du das Ende deiner Fantasy-Football-Saison erreichst, wenn sie vorbei ist Nun, Sie sind vielleicht im Streit, um die Playoffs zu machen. Wenn das der Fall ist, herzlichen Glückwunsch! Mit diesen Rechten geht es um dieses Spiel, und Sie sind dem ultimativen Preis einen Schritt näher. Wenn nicht, fühle dich nicht schlecht. ...

Bereiten Sie Ihre Fantasy Football Roster für die Draft - Dummies

Bereiten Sie Ihre Fantasy Football Roster für die Draft - Dummies

Vor, wenn Sie Ihre Fantasy Football League erforschen und herausfinden Wie viele Dienstplan-Spots Sie haben, können Sie Ihre Aufmerksamkeit darauf lenken, Ihren Entwurf basierend auf diesen Anforderungen vorzubereiten. Sie können Ihren eigenen Dienstplan-Spickzettel aus CheatSheet War Room ausdrucken. Neben dem Listenblatt finden Sie weitere kostenlose druckbare Fantasy-Fußball ...

Die Wahl des Herausgebers

Erstellen eines neuen Dokuments aus CSS-Starterseiten in Dreamweaver CS6 - Dummies

Erstellen eines neuen Dokuments aus CSS-Starterseiten in Dreamweaver CS6 - Dummies

Adobe Dreamweaver CS6 bietet Ihnen eine Bibliothek von Beispielseiten mit CSS-basierten Layouts als Alternative zum Neuanfang. Diese CSS-Beispielseiten enthalten nützliche und allgemeine Layoutideen, und da sie mit CSS-Positionierung erstellt werden, sind sie sehr flexibel. Sie können sie direkt im Bedienfeld "CSS-Stile" oder im Eigenschafteninspektor ändern. ...