Perguntas frequentes sobre espelhamento de floco de neve no Microsoft Fabric

Este artigo responde a perguntas frequentes sobre Espelhamento de Snowflake no Microsoft Fabric.

Recursos e funcionalidades

Há uma zona de preparo ou de aterrissagem para Snowflake? Se a resposta for sim, ela fica fora do OneLake?

Para o Snowflake, usamos uma zona de aterrissagem para armazenar tanto os dados de instantâneo quanto os dados de alterações no OneLake, a fim de melhorar o desempenho, pois estamos convertendo esses arquivos nas zonas de aterrissagem para o formato Delta VertiParquet.

Quais tipos de objeto Snowflake podem ser replicados?

Há suporte para tabelas gerenciadas, tabelas iceberg e exibições para replicação. Não há suporte para tabelas externas, transitórias, temporárias e dinâmicas. Para tabelas Iceberg, é necessária uma conexão de armazenamento com o armazenamento subjacente da tabela Iceberg durante a configuração. Para obter detalhes sobre problemas conhecidos com exibições (como mapeamento de tipo de dados), consulte Limitações.

Como faço para gerenciar conexões?

Selecione o ícone de engrenagem de configurações e, em seguida, selecione Gerenciar a conexão e os gateways. Você também pode excluir conexões existentes desta página.

Quais métodos de autenticação são compatíveis com o espelhamento do Snowflake?

Há suporte para os seguintes métodos de autenticação:

  • Nome de usuário e senha — autenticação nativa do Snowflake
  • Microsoft Entra ID (SSO) – Logon único via Entra ID
  • Autenticação de par de chaves — par de chaves RSA para cenários de contas de serviço

Eficiência de custo

Como posso reduzir os custos de computação do Snowflake com o espelhamento?

  1. Reutilizar um armazém existente. Configure o espelhamento para usar o mesmo armazém Snowflake que seus aplicativos já usam para atualizar as tabelas de origem. Isso evita o custo adicional de ativar um warehouse separado e dedicado ao espelhamento. Quando o aplicativo atualiza uma tabela, o replicador de espelhamento pega as alterações quase imediatamente enquanto o warehouse ainda está ativo. 2. Espelhar somente as tabelas de que você precisa. Evite espelhar um banco de dados inteiro quando precisar apenas de um subconjunto de tabelas. O espelhamento em grande escala pode causar um consumo significativo do Snowflake e picos na capacidade do Fabric. 3. Monitore a ocorrência de ressemeaduras inesperadas. Uma nova propagação lê novamente a tabela completa e gera custo computacional proporcional ao seu tamanho. Verifique a página Status do Espelhamento para obter tabelas que mostram repetidamente o comportamento de cópia inicial. 4. Use orçamentos e limites de crédito do Snowflake. Defina monitores e orçamentos de recursos do Snowflake para limitar os custos de computação relacionados ao espelhamento.

Como as taxas de entrada são tratadas?

Fabric não cobra taxas de entrada no OneLake para Espelhamento.

Como as taxas de saída são tratadas?

Se estiver hospedado fora do Azure, consulte a documentação da Snowflake e do seu provedor de nuvem para saber os custos de egresso. Se estiver hospedado no Azure, mas em uma região diferente da capacidade do Fabric, a saída de dados será cobrada. Se estiver hospedado no Azure na mesma região, não haverá saída de dados.

O espelhamento dá suporte a janelas de agendamento ou replicação?

Não. O espelhamento é executado continuamente e atualmente não dá suporte à configuração de agendas de replicação ou janelas baseadas em tempo. O replicador verifica alterações continuamente, o que gera consumo contínuo de computação do Snowflake. Se você precisar limitar a computação durante determinados períodos, poderá parar e reiniciar manualmente o espelhamento, mas observe que a reinicialização dispara uma relançamento completa de todas as tabelas espelhadas.

Performance

Quanto tempo leva a replicação inicial?

Depende do tamanho dos dados que estão sendo trazidos.

Quanto tempo leva para replicar inserções/atualizações/exclusões?

Latência próxima do tempo real.

Os relatórios do Power BI usarão o modo Direct Lake?

Sim, as tabelas são todas tabelas delta ordenadas por v.

Solucionar problemas de espelhamento de floco de neve no Microsoft Fabric

Quais são os status de replicação?

O Espelhamento Snowflake pode ser acessado por meio do Gateway do Power BI ou atrás de um firewall?

Sim, damos suporte ao espelhamento por meio de um gateway de dados local (on-premises) e por meio de um gateway de dados de Rede Virtual (VNet).

O que acontece ao iniciar o espelhamento?

Os dados das tabelas de origem serão reinicializados. Sempre que você interromper e reiniciar, a tabela inteira será recuperada novamente.

O que acontece se eu desmarcar uma tabela do Mirroring?

Paramos de espelhar essa tabela específica e excluí-la do OneLake.

Se eu excluir o Espelho, isso afetará o banco de dados espelhado de origem?

Não, apenas removemos as tabelas de streaming.

Posso espelhar o mesmo banco de dados várias vezes?

Sim, você pode, mas não precisa. Depois que os dados estiverem no Fabric, eles poderão ser compartilhados a partir daí.

Posso espelhar tabelas específicas do meu banco de dados de origem?

Sim, tabelas específicas podem ser selecionadas durante a configuração de Espelhamento.

O que aciona um reseed completo?

Um reseed (recarregamento completo dos dados) é acionado por qualquer um dos itens a seguir:

  • Alterações de DDL que modificam o timestamp de DDL de uma tabela, como, por exemplo, ALTER TABLE operações que adicionam ou removem colunas.
  • Ferramentas de modificação de esquema, como o dbt, que excluem e recriam tabelas de forma programada.
  • Interrompendo e reiniciando o espelhamento por meio do portal ou da API do Fabric.
  • Uma pausa na capacidade expandida. Se a capacidade do Fabric ficar em pausa por um longo período, o espelhamento poderá ser reinicializado quando ela for retomada.

Como solucionar problemas relacionados à ressemeadura inesperada ou contínua?

Se você vir tabelas repetidamente sendo submetidas à cópia inicial ("reseed") em vez da sincronização incremental:

  1. Verifique se houve alterações no schema upstream. Verifique se uma ferramenta como o dbt está modificando definições de tabela de forma recorrente. Até mesmo pequenas alterações de DDL podem acionar uma nova propagação.
  2. Examine a página Status do Espelhamento. Procure por tabelas que mostrem registros de data e hora da cópia inicial repetidos em intervalos regulares.
  3. Pausar alterações de esquema durante o espelhamento ativo. Se as execuções de dbt forem a causa, agende-as durante as janelas de manutenção ou pause o espelhamento antes de executar alterações de esquema.
  4. Monitore o uso do armazém Snowflake. Verifique as views de uso da conta do Snowflake para verificar se as consultas relacionadas ao espelhamento estão consumindo a maior parte da capacidade computacional.
  5. Lembre-se de que cada ressemeadura processa todos os dados da tabela e gera custo de computação do Snowflake proporcional ao tamanho da tabela. proporcional ao tamanho da tabela.

Governança de dados

Os dados saem em algum momento do locatário do Fabric do cliente?

Não.

Os dados são armazenados fora de um ambiente do cliente?

Não, os dados não são armazenados temporariamente fora do ambiente do cliente; eles são armazenados temporariamente no OneLake do cliente.

Licenciamento

Quais são as opções de licenciamento para o Fabric Mirroring?

É necessário um Power BI Premium, uma capacidade do Fabric ou uma capacidade de avaliação. Para obter mais informações sobre licenciamento, consulte licenças do Microsoft Fabric.

Quais são os custos de computação do Fabric associados ao Espelhamento?

A computação de malha usada para replicar seus dados no Fabric OneLake é gratuita. O custo do armazenamento por espelhamento é gratuito até um limite baseado na capacidade. Para obter mais informações, consulte Custo de espelhamento e Preços do Microsoft Fabric. A computação para consultar dados usando SQL, Power BI ou Spark é cobrada a taxas regulares.