Herunterladen Inhalt Inhalt Diese Seite drucken

Kapitel 2. Spss Modeler-Integration; Unterstützte Knoten - Ibm Spss Benutzerhandbuch

Inhaltsverzeichnis

Kapitel 2. SPSS Modeler-Integration

SPSS Modeler ist eine Data-Mining-Workbench, die über einen visuellen Ansatz für die Analyse verfügt.
Jede einzelne Aktion in einem Job, vom Zugriff auf eine Datenquelle über die Zusammenführung von
Datensätzen bis zur Ausgabe einer neuen Datei oder zur Erstellung eines Modells, wird durch einen Kno-
ten im Erstellungsbereich dargestellt. Diese Aktionen werden miteinander verknüpft, damit ein Analyse-
datenstrom gebildet wird. So erstellen Sie einen Analysedatenstrom, der mit Analytic Server ausgeführt
wird:
1. Der Datenstrom muss mit einem Analytic Server-Quellenknoten beginnen.
2. Erstellen Sie den mittleren Teil des Datenstroms wie üblich in der Modeler-Schnittstelle und wählen
Sie dabei von Analytic Server unterstützte Prozessknoten (Feld- oder Datensatzoperationen) aus. Die
Modeller-Palette enthält eine Analytic Server-Anzeige mit den unterstützten Knoten.
3. Für die Fertigstellung des Datenstroms gibt es mehrere Optionen.
v Wählen Sie einen von Analytic Server unterstützten Endknoten (Ausgabe, Diagramm, Export oder
Modellierung) aus. In diesem Fall übertragt Modeler den gesamten Datenstrom mit einer Push-
Operation an Analytic Server. Analytic Server koordiniert die erforderlichen Jobs im Hadoop-Clus-
ter und stellt Modeler die Ergebnisse zur Verfügung. Modeler verwendet die Ergebnisse und stellt
sie dar, als wäre der Datenstrom lokal verarbeitet worden.
v Wenn Sie einen Endknoten auswählen, der von Analytic Server nicht unterstützt wird, überträgt
Modeler so viel wie möglich vom Datenstrom mit einer Push-Operation an Analytic Server und be-
ginnt dann mit dem Extrahieren von Datensätzen aus Hadoop (Pull-Operation). Beachten Sie, dass
Analytic Server ein Scoring für Modelle durchführen kann, die zurzeit mit Analytic Server nicht er-
stellt werden können. Das heißt, dass Sie einen Datenstrom so strukturieren können, dass mit Ana-
lytic Server eine statistisch gültige Teilstichprobe Ihrer Big Data gezogen und anschließend mit Mo-
deller "lokal" ein Modell erstellt wird. Das resultierende Modellnugget kann dann in einen Scoring-
Datenstrom eingeschlossen werden, der vollständig in Analytic Server ausgeführt wird.
Anmerkung: Sie können die maximale Anzahl der Datensätze festlegen, die SPSS Modeler in den
Analytic Server-Datenstromeigenschaften aus Hadoop herunterlädt.
Unterstützte Knoten
Viele SPSS Modeler-Knoten werden für die Ausführung in HDFS unterstützt, bei der Ausführung be-
stimmter Knoten gibt es jedoch möglicherweise einige Unterschiede und einige Knoten werden zurzeit
nicht unterstützt. In diesem Thema wird die aktuelle Unterstützungsstufe detailliert beschrieben.
Anmerkung: Informationen zur regulären Operation dieser Knoten finden Sie in der Dokumentation zu
SPSS Modeler.
Allgemein
v Einige Zeichen, die normalerweise in einem Modeler-Feldnamen in Anführungszeichen zuläs-
sig sind, werden von Analytic Server nicht akzeptiert.
v Damit ein Modeler-Datenstrom in Analytic Server ausgeführt werden kann, muss er mit min-
destens einem Analytic Server-Quellenknoten beginnen und mit einem einzelnen Modellie-
rungsknoten oder Analytic Server-Exportknoten enden.
v Es wird empfohlen, den Speicher von stetigen Zielen als Speicher für reelle Zahlen und nicht
als Speicher für ganze Zahlen festzulegen. Scoring-Modelle schreiben immer reelle Werte in die
Ausgabedatendateien für stetige Ziele, während das Ausgabedatenmodell für die Scores dem
Speicher des Ziels folgt. Wenn ein stetiges Ziel über einen Speicher für ganze Zahlen verfügt,
25
Inhaltsverzeichnis
loading

Inhaltsverzeichnis