Phasen von Essbase-Dataloads
Sie können die Performance von Dataloads in Essbase Block Storage-(BSO-)Cubes verbessern, wenn Sie die Phasen des Dataload-Prozesses kennen und erfahren, wie Sie die Aufgaben optimieren und parallelisieren.
Dieser Abschnitt gilt nicht für Aggregate Storage-Cubes.
Das Laden einer großen Datenquelle in einen Essbase-Cube kann lange dauern. Sie können den Prozess verkürzen, indem Sie die Zeit minimieren, die Essbase beim Lesen und Parsen der Quelldaten sowie beim Lesen und Schreiben in den Cube aufwendet.
Essbase lädt Datenblock für Block. Für jede eindeutige Kombination von dünn besetzten Dimensionselementen enthält ein Datenblock die Daten für alle dicht besetzten Dimensionskombinationen. Dabei wird davon ausgegangen, dass mindestens eine Zelle Daten enthält. Für einen schnelleren Zugriff auf Blockspeicherorte verwendet Essbase einen Index. Jeder Eintrag im Index entspricht einem Datenblock. Siehe Sparse and Dense Dimensions, Selection of Dense and Sparse Dimensions und Dense and Sparse Selection Scenarios.
Essbase verarbeitet den Dataload in einer Pipeline mit fünf Phasen.
Für das Laden von Freeform-Daten sind die Stufen:
-
Eingabe - Essbase erfasst Eingaben aus Datei- oder SQL-Verbindung
-
Tokenisieren - Essbase trennt Eingabefelder von Datensätzen und erstellt Token.
-
Konvertieren - Essbase konvertiert Token in Elementelemente
-
Vorbereitung – Essbase ordnet die Daten vor dem Einfügen in Blöcke an
-
Schreiben – Essbase fügt die Daten in Blöcke im Speicher ein und schreibt die Blöcke dann auf den Datenträger. Dabei wird der richtige Block auf der Festplatte mithilfe des Index ermittelt, der aus Zeigern besteht, die auf dünn besetzten Schnittmengen basieren.
Beim Dataload auf Basis von Regeldateien gibt es folgende Phasen:
-
Eingabe - Essbase erfasst Eingaben aus Datei- oder SQL-Verbindung
-
Vor-Regel - Essbase liest Dataload-Datensätze
-
Regel - Essbase wendet Regeln, die in der Regeldatei eingebettet sind, auf Dataload-Datensätze an
-
Vorbereitung – Essbase ordnet die Daten vor dem Einfügen in Blöcke an
-
Schreiben – Essbase fügt die Daten in Blöcke im Speicher ein und schreibt die Blöcke dann auf den Datenträger. Dabei wird der richtige Block auf der Festplatte mithilfe des Index ermittelt, der aus Zeigern besteht, die auf dünn besetzten Schnittmengen basieren.
Hinweis:
Bei Aggregate Storage-Datenbanken gilt die fünfte Phase nicht.
Dieser Vorgang wird wiederholt, bis alle Daten geladen sind. Wenn Sie einen oder mehrere Verarbeitungsthreads in jeder Phase verwenden, kann Essbase einige Prozesse parallel ausführen. Siehe Paralleles Dataload.
Bei den Beispielen in diesem Kapitel wird davon ausgegangen, dass Sie mit den Informationen in diesem Thema vertraut sind: Datenquellen.