Preguntas frecuentes sobre la creación de una réplica de Snowflake en Microsoft Fabric

En este artículo se responde a las preguntas más frecuentes sobre la creación de reflejos de Snowflake en Microsoft Fabric.

Características y funcionalidades

¿Hay una zona de ensayo o aterrizaje para Snowflake? De ser así, ¿está fuera de OneLake?

Para Snowflake, sí utilizamos una zona de aterrizaje para almacenar en OneLake tanto la instantánea como los datos de cambios, con el fin de mejorar el rendimiento, ya que convertimos estos archivos de la zona de aterrizaje a Delta VertiParquet.

¿Qué tipos de objetos de Snowflake se pueden replicar?

Las tablas administradas, las tablas y las vistas de Iceberg se admiten para la replicación. No se admiten tablas externas, transitorias, temporales y dinámicas. Para las tablas Iceberg, se requiere una conexión de almacenamiento al almacenamiento subyacente de la tabla Iceberg durante la configuración. Para obtener más información sobre los problemas conocidos de las vistas (como la asignación de tipos de datos), consulte la sección Limitaciones.

¿Cómo se administran las conexiones?

Seleccione el icono de configuración y, a continuación, seleccione Gestionar conexiones y puertas de enlace. También puede eliminar las conexiones existentes de esta página.

¿Qué métodos de autenticación se admiten para la creación de reflejos de Snowflake?

Se admiten los siguientes métodos de autenticación:

  • Nombre de usuario y contraseña: autenticación nativa de Snowflake
  • Microsoft Entra ID (SSO): inicio de sesión único a través de Entra ID
  • Autenticación de pares de claves: par de claves RSA para escenarios de cuentas de servicio

Rentabilidad

¿Cómo puedo reducir los costes de computación de Snowflake derivados de la replicación?

  1. Reutilización de un almacén existente. Configure la creación de reflejo para usar el mismo almacenamiento de Snowflake que las aplicaciones ya usan para actualizar las tablas de origen. Esto evita el coste adicional de activar un almacén de duplicación dedicado e independiente. Cuando la aplicación actualiza una tabla, el replicador de duplicación detecta los cambios casi de inmediato mientras el almacén de datos sigue activo. 2. Refleje solo las tablas que necesita. Evite la creación de reflejo de toda una base de datos cuando solo necesite un subconjunto de tablas. La replicación a gran escala puede provocar un consumo significativo en Snowflake y picos de capacidad en Fabric. 3. Monitorice las reinicializaciones inesperadas. Un reseed vuelve a leer la tabla completa y supone un coste de cómputo proporcional a su tamaño. Consulte la página Estado de la creación de reflejo para ver las tablas que muestran repetidamente el comportamiento de copia inicial. 4. Use los presupuestos de Snowflake y los límites de crédito. Configure monitores de recursos y presupuestos de Snowflake para limitar los costes de computación relacionados con la replicación.

¿Cómo se controlan las tarifas de entrada?

Fabric no cobra por las tarifas de entrada en OneLake for Mirroring.

¿Cómo se gestionan las tarifas de salida?

Si se hospeda fuera de Azure, consulte la documentación de Snowflake y la de su proveedor de nube para conocer los costes de salida de datos. Si está alojado en Azure, pero en una región distinta de aquella en la que se encuentra su capacidad de Fabric, se cobrará tráfico de salida de datos. Si se hospeda en Azure en la misma región, no hay salida de datos.

¿Admite la replicación en espejo la programación o ventanas de replicación?

No. La duplicación se realiza de forma continua y actualmente no permite configurar programaciones de replicación ni ventanas temporales. El replicador consulta los cambios de manera continua, lo que genera un uso continuo de cómputo en Snowflake. Si necesita limitar la capacidad de procesamiento durante determinados períodos, puede detener y volver a iniciar manualmente la replicación, pero tenga en cuenta que volver a iniciarla provoca una resincronización completa de todas las tablas replicadas.

Performance

¿Cuánto tarda la replicación inicial?

Depende del tamaño de los datos que se van a incorporar.

¿Cuánto tiempo se tarda en replicar inserciones, actualizaciones o eliminaciones?

Latencia casi en tiempo real.

¿Los informes de Power BI usarán el modo Direct Lake?

Sí, las tablas son todas las tablas delta ordenadas por v.

Solución de problemas de creación de reflejo de Snowflake en Microsoft Fabric

¿Cuáles son los estados de replicación?

¿Se puede acceder a la creación de reflejo de Snowflake a través de Power BI Gateway o detrás de un firewall?

Sí, admitimos la replicación a través de una puerta de enlace de datos local y a través de una puerta de enlace de datos de red virtual (VNet).

¿Qué ocurre al iniciar la duplicación?

Los datos de las tablas de origen se reinicializarán. Cada vez que se detiene y se vuelve a iniciar, se recupera de nuevo la tabla completa.

¿Qué ocurre si deselecciono una tabla de Mirroring?

Detenemos la creación de reflejo de esa tabla específica y la eliminamos de OneLake.

Si elimino el reflejo, ¿afecta a la base de datos reflejada de origen?

No, simplemente eliminamos las tablas de transmisión.

¿Puedo reflejar la misma base de datos varias veces?

Sí, puedes, pero no deberías necesitarlo. Una vez que los datos están en Fabric, se pueden compartir desde allí.

¿Puedo reflejar tablas específicas de mi base de datos de origen?

Sí, se pueden seleccionar tablas específicas durante la configuración de creación de reflejo.

¿Qué desencadena una reinicialización completa?

Un reseed (recarga completa de datos) se activa con cualquiera de las siguientes acciones:

  • Cambios de DDL que modifican la marca de tiempo DDL de una tabla, por ejemplo, ALTER TABLE operaciones que agregan o quitan columnas.
  • Herramientas de modificación de esquemas como dbt que quitan y vuelven a crear tablas según una programación.
  • Detener y reiniciar la creación de reflejos a través del portal o la API de Fabric.
  • Una pausa de capacidad ampliada. Si la capacidad de Fabric se pausa durante un período prolongado, la replicación podría reinicializarse al reanudarse.

¿Cómo puedo solucionar problemas de resegundos inesperados o continuos?

Si ves que las tablas vuelven a realizar la copia inicial (reinicialización) en lugar de la sincronización incremental:

  1. Compruebe si hay cambios en el esquema ascendente. Compruebe si una herramienta como dbt está modificando las definiciones de tabla en una programación periódica. Incluso los cambios menores de DDL pueden desencadenar una reinicialización.
  2. Revise la página Estado de creación de reflejo. Busque tablas que muestren marcas de tiempo de copia inicial repetidas a intervalos regulares.
  3. Pausar los cambios en el esquema durante el reflejo activo. Si las ejecuciones de dbt son la causa, programándolas durante las ventanas de mantenimiento o pausando la creación de reflejo antes de ejecutar cambios en el esquema.
  4. Supervise el uso del almacén de Snowflake. Consulte las vistas de uso de la cuenta en Snowflake para comprobar si las consultas relacionadas con la replicación están dominando el consumo de cómputo.
  5. Recuerde que cada reseed procesa todos los datos de la tabla y genera costes de procesamiento en Snowflake proporcionales al tamaño de la tabla. proporcional al tamaño de la tabla.

Gobernanza de datos

¿Los datos salen en algún momento del arrendatario de Fabric de los clientes?

No.

¿Los datos se almacenan provisionalmente fuera de un entorno de cliente?

No, los datos no se almacenan provisionalmente fuera del entorno del cliente, se almacenan provisionalmente en OneLake del cliente.

Licenciamiento

¿Cuáles son las opciones de licencias para Fabric Mirroring?

Se requiere una capacidad de Power BI Premium, una capacidad de Fabric o una capacidad de evaluación. Para obtener más información sobre las licencias, vea Licencias de Microsoft Fabric.

¿Cuáles son los costes de proceso de Fabric asociados al reflejo?

La capacidad de proceso de Fabric usada para replicar sus datos en Fabric OneLake es gratuita. El costo de almacenamiento de creación de reflejo es gratis hasta un límite basado en la capacidad. Para obtener más información, consulte Costo de creación de reflejo y precios de Microsoft Fabric. La capacidad de proceso para consultar datos mediante SQL, Power BI o Spark se factura a las tarifas habituales.