Daten aus Fabric OneLake importieren

Power Automate Process Mining bietet Ihnen die Möglichkeit, Ereignisprotokolldaten direkt von Fabric OneLake über Fabric Lakehouse zu lesen und zu speichern. Durch die direkte Verbindung mit Ihrem OneLake vereinfacht dieses Feature die ETL-Verwaltung (Extrahieren, Transformieren, Laden).

Diese Funktion unterstützt derzeit die Erfassung der folgenden Daten:

Tabellen und Ansichten

  • Delta-Tabellen
    • Einzelne Delta-Tabelle in Fabric Lakehouse.
  • Materialisierte Ansichten
    • Einzelne materialisierte Sicht in Fabric Lakehouse.

Dateien und Ordner

  • CSV
    • Einzelne CSV-Datei.
    • Ordner mit mehreren CSV-Dateien, die dieselbe Struktur haben. Alle Dateien wurden eingelesen.
  • Parquet
    • Einzelne Parquet-Datei.
    • Ordner mit mehreren Parquet-Dateien, die die gleiche Struktur haben. Alle Dateien werden erfasst.
  • Delta-Parquet
    • Ordner, der eine Delta-Parquet-Struktur enthält.

Anforderungen

  • Stellen Sie sicher, dass die Option Benutzer können mit Apps außerhalb von Fabric auf Daten zugreifen, die in OneLake gespeichert sind in den OneLake-Mandanteneinstellungen aktiviert ist.

  • Ein Fabric-Arbeitsbereich, der sich vom standardmäßigen Bereich Mein Arbeitsbereich unterscheidet.

  • Die Rolle für die Administration muss dem Benutzenden zugewiesen werden, der den Arbeitsbereich für die Umgebung für die anderen Benutzenden in derselben Umgebung erstmals einrichtet.

  • Der Fabric-Arbeitsbereich muss für den Prozesseinblicke-Produktionsdienstprinzipal mit der Rolle Admin freigegeben werden. Führen Sie die Schritte unter Azure-Tools installieren aus, um den Dienstprinzipal „Process Insights Prod“ zu registrieren.

    Screenshot der Einstellungen des Fabric-Arbeitsbereichs mit Freigabe für den Prozesseinblickedienstprinzipal

  • Ein Fabric Lakehouse muss in diesem Arbeitsbereich mit den Daten in unterstützten Formaten erstellt werden.

  • CSV-Daten in Ihrem Lakehouse sollten die folgenden Anforderungen an das CSV-Dateiformat erfüllen:

    • Komprimierungstyp:: Keiner
    • Spaltentrennzeichen: Komma (,)
    • Zeilentrennzeichen: Standard und Kodierung. Zum Beispiel: Standard (\r,\n oder \r\n)

    Screenshot der Anzeige der Dateiformateinstellungen.

  • Alle Daten müssen im endgültigen Ereignisprotokollformat vorliegen und die unter Datenanforderungen aufgeführten Anforderungen erfüllen. Die Daten sollten bereit sein, dem Process-Mining-Schema zugeordnet zu werden. Nach der Ingestion steht keine Datentransformation zur Verfügung.

  • Die Größe (Breite) der Kopfzeile ist derzeit auf 1 MB begrenzt.

Wichtig

Stellen Sie sicher, dass der in Ihrer CSV-Datei dargestellte Zeitstempel dem ISO 8601-Standardformat entspricht (z. B. YYYY-MM-DD HH:MM:SS.sss oder YYYY-MM-DDTHH:MM:SS.sss).

Verbinden mit Fabric OneLake

  1. Wählen Sie links im Navigationsbereich Process Mining>Hier beginnen.

  2. Wählen Sie im Feld "Prozessname " den Prozesstyp aus, und geben Sie einen Namen für Ihren Prozess ein.

  3. Wählen Sie unter der Überschrift "Datenquelle" die Option "OneLake>Continue" aus.

    Screenshot des Schritts „Einen neuen Prozess erstellen“.

  4. Wählen Sie einen optionalen Power BI oder Fabric Arbeitsbereich aus, oder wählen Sie Skip aus.

  5. Wählen Sie auf dem Bildschirm Verbindungseinrichtung Ihren Fabric-Arbeitsplatz aus dem Dropdownmenü aus. Dadurch wird das Lakehouse-Dropdownmenü befüllt. Wählen Sie im Menü das Lakehouse aus, das Ihre Daten enthält, und klicken Sie auf Weiter.

  6. Durchsuchen Sie die Ordnerstruktur des Lakehouse und wählen Sie die Delta-Tabelle, die Datei oder den Ordner aus, die bzw. der die Ereignisprotokolldaten enthält.

    Sie können entweder eine einzelne Delta-Tabelle, eine einzelne Datei oder einen Ordner mit mehreren Dateien auswählen. Alle Dateien müssen die gleichen Header und das gleiche Format haben.

  7. Wählen Sie Weiter.

  8. Auf dem Bildschirm Daten zuordnen ordnen Sie Ihre Daten dem erforderlichen Schema zu.

    Screenshot des Bildschirms „Daten zuordnen“.

  9. Schließen Sie die Verbindung ab, indem Sie Speichern und analysieren auswählen.

Einstellungen für inkrementelle Datenaktualisierung festlegen

Sie können einen aus Fabric OneLake erfassten Prozess nach einem Zeitplan entweder vollständig oder inkrementell aktualisieren. Obwohl es keine Aufbewahrungsrichtlinien gibt, können Sie Daten mit einer der folgenden Methoden inkrementell erfassen:

Wenn Sie im vorherigen Abschnitt eine einzelne Delta-Tabelle ausgewählt haben, fügen Sie weitere Daten an die ausgewählte Tabelle an.

Wenn Sie eine einzelne Datei im vorherigen Abschnitt ausgewählt haben, hängen Sie weitere Daten an die ausgewählte Datei an.

Wenn Sie einen Ordner im vorherigen Abschnitt ausgewählt haben, fügen Sie inkrementelle Dateien zum ausgewählten Ordner hinzu.

Wichtig

Wenn Sie inkrementelle Dateien zu einem ausgewählten Ordner oder Unterordner hinzufügen, stellen Sie sicher, dass Sie die Reihenfolge der Inkrementierung angeben, indem Sie Dateien mit Datumsangaben wie JJMMTT.csv oder JJJJMMTTHHMMSS.csv benennen.

Um einen Prozess zu aktualisieren:

  1. Gehen Sie zur Seite Details des Prozesses.

  2. Aktualisierungseinstellungen auswählen.

  3. Gehen Sie auf dem Bildschirm Aktualisierung planen wie folgt vor:

    1. Aktivieren Sie den Schalter Daten auf dem neuesten Stand halten.
    2. Wählen Sie in der Dropdownliste Daten aktualisieren alle die Häufigkeit der Aktualisierung aus.
    3. In den Feldern Anfangen bei wählen Sie das Datum und die Uhrzeit der Aktualisierung aus.
    4. Aktivieren Sie den Umschalter für inkrementelle Aktualisierung.