Importar datos desde Fabric OneLake

Power Automate Process Mining le permite almacenar y leer datos de registro de eventos directamente desde Fabric OneLake a través de Fabric Lakehouse. Esta característica simplifica la administración ETL (extracción, transformación y carga), ya que se conecta directamente a su OneLake.

Actualmente, esta característica admite la ingesta de lo siguiente:

Tablas y vistas

  • Tablas Delta
    • Una sola tabla Delta en Fabric Lakehouse.
  • Vistas materializadas
    • Vista materializada única en Fabric Lakehouse.

Archivos y carpetas

  • CSV
    • Archivo CSV único.
    • Carpeta con varios archivos CSV que tienen la misma estructura. Se han ingerido todos los archivos.
  • Parquet
    • Un solo archivo parquet.
    • Carpeta con varios archivos parquet que tienen la misma estructura. Todos los archivos se ingieren.
  • Delta-parquet
    • Carpeta que contiene una estructura delta-parquet.

Requisitos previos

  • Asegúrese de que la opción Usuarios puedan acceder a los datos almacenados en OneLake con aplicaciones externas a Fabric esté activada en la configuración del inquilino de OneLake.

  • Un área de trabajo de Fabric que es diferente de Mi área de trabajo predeterminada.

  • El rol de Administrador debe atribuirse al usuario que realiza la configuración inicial del espacio de trabajo del entorno para los demás usuarios del mismo entorno.

  • El espacio de trabajo de Fabric debe compartirse con la Entidad de servicio de Process Insight Prod con un rol de administrador. Para registrar la entidad de servicio Process Insights Prod, siga los pasos descritos en Instalar herramientas de Azure.

    Captura de pantalla de la configuración del espacio de trabajo de Fabric con el uso compartido para el servicio principal de Información de procesos.

  • Se debe crear un Lakehouse de Fabric en este espacio de trabajo que contenga los datos en formatos compatibles.

  • Los datos CSV de tu Lakehouse deben cumplir los siguientes requisitos del formato de archivo CSV:

    • Tipo de compresión: Ninguna
    • Delimitador de columna: Coma (,)
    • Delimitador de fila: Predeterminado y codificación. Por ejemplo, Predeterminado (\r,\n o \r\n)

    Captura de la pantalla de configuración de formato de archivo

  • Todos los datos deben estar en formato de registro de eventos final y cumplir con los requisitos enumerados en Requisitos de datos. Los datos deben estar listos para ser mapeados al esquema de minería de procesos. No hay transformación de datos disponible después de la ingestión.

  • El tamaño (ancho) de la fila del encabezado está actualmente limitado a 1 MB.

Importante

Asegúrese de que la marca de tiempo representada en su archivo CSV siga el formato estándar ISO 8601 (por ejemplo, YYYY-MM-DD HH:MM:SS.sss o YYYY-MM-DDTHH:MM:SS.sss).

Conéctese a Fabric OneLake

  1. En el panel de navegación de la izquierda, seleccione Process mining>Empezar aquí.

  2. En el campo Nombre del proceso, seleccione el tipo de proceso y escriba un nombre para el proceso.

  3. En el encabezado Origen de datos, seleccione OneLake>Continuar.

    Captura de la pantalla del paso

  4. Seleccione un área de trabajo de Power BI o Fabric opcional o seleccione Skip.

  5. En la pantalla de Configuración de la conexión, seleccione el Area de trabajo de Fabric en el menú desplegable. Esto rellena el menú desplegable de Lakehouse. En el menú, seleccione el lakehouse que contiene sus datos y seleccione Siguiente.

  6. Recorra la estructura de carpetas de Lakehouse y seleccione la tabla Delta, el archivo Delta o la carpeta Delta que contiene los datos de registro de eventos.

    Puede seleccionar una sola tabla Delta, un solo archivo o una carpeta con varios archivos. Todos los archivos deben tener los mismos encabezados y formato.

  7. Seleccione Siguiente.

  8. En la pantalla Asignar sus datos, asigne sus datos al esquema requerido.

    Captura de pantalla de la pantalla Asignar sus datos.

  9. Complete la conexión seleccionando Guardar y analizar.

Definir la configuración de actualización incremental de datos

Puede actualizar un proceso que se ingiere desde Fabric OneLake de acuerdo con una programación mediante una actualización completa o incremental. Aunque no hay políticas de retención, puede ingerir datos de forma incremental utilizando uno de los siguientes métodos:

Si seleccionó una sola tabla Delta en la sección anterior, agregue más datos a la tabla seleccionada.

Si seleccionó un fila única en la sección anterior, agregue más datos al archivo seleccionado.

Si seleccionó una carpeta en la sección anterior, agregue archivos incrementales a la carpeta seleccionada.

Importante

Cuando agregue archivos incrementales a una carpeta o subcarpeta seleccionada, asegúrese de indicar el orden de incremento nombrando archivos con fechas como AAAAMMDD.csv o AAAAMMDDHHMMSS.csv.

Para actualizar un proceso:

  1. Ve a la página Detalles del proceso.

  2. Seleccione Configuración de actualización.

  3. Sobre la pantalla Programar actualización, complete los siguientes pasos:

    1. Active la opción Mantenga los datos actualizados.
    2. En las listas desplegalbes Actualizar datos cada, seleccione la frecuencia de la actualización.
    3. En los campos Empieza a las, seleccione la fecha y la hora de la actualización.
    4. Active la opción Actualización incremental.