Zum Hauptinhalt wechseln
Workday User Guide
Zuletzt aktualisiert: 2023-06-23
Konzept: Dataset-Pipelines

Konzept: Dataset-Pipelines

Datasets enthalten eine oder mehrere Pipelines. Eine Pipeline ist ein Container mit Phasen, die den Workflow für die Transformation von Daten in einem Dataset modellieren. Sie besteht aus einer sortierten Liste von Phasen, von denen jede definiert, wie die Daten an diesem Punkt in der Pipeline geändert werden sollen. Pipelines können eine oder mehrere Phasen enthalten.
Jedes Dataset hat eine primäre Pipeline und möglicherweise keine oder mehr zusätzliche Pipelines.
Die erste Phase in einer Pipeline übernimmt Daten aus der Dataset-Quelle. Phasen, die nach der ersten Phase in einer Pipeline aufgeführt sind, verwenden die Ausgabe der vorherigen Pipeline als Eingabe für die aktuelle Phase. Wenn Sie mit ETL-Workflows (Extrahieren, Transformieren und Laden) vertraut sind, ist jede Phase ein Schritt in einer Entwicklungspipeline.
Die letzte Phase jeder Pipeline ist die Ausgabe dieser Pipeline. Die Ausgabe der primären Pipeline ist die Ausgabe des gesamten Datasets. Wenn Sie ein Dataset veröffentlichen, wird daher die Ausgabe der primären Pipeline als Daten in der Prism-Datenquelle realisiert.