Índices de filtro de Bloom (obsoletos)

Important

Não use índices de filtro Bloom. Azure Databricks preteriu esse recurso e recomenda remover todos os índices de filtro Bloom existentes de suas tabelas.

Os índices de filtro Bloom são um mecanismo legado de filtragem de dados que o Azure Databricks não recomenda mais para nenhuma carga de trabalho. Eles adicionam sobrecarga de escrita, são difíceis de ajustar e foram substituídos por alternativas mais eficazes.

Em vez disso, use os seguintes recursos:

  • E/S preditiva: em computação habilitada para Photon com o Databricks Runtime 12.2 ou superior, a E/S preditiva realiza automaticamente a omissão de arquivos para todas as colunas. Ele substitui completamente os índices de filtro de Bloom, que apenas adicionam sobrecarga de gravação quando o Photon está habilitado.
  • Clustering Liquid: no Databricks Runtime 13.3 e versões posteriores, o clustering Liquid melhora o omissão de dados ao organizar os dados com base em colunas frequentemente filtradas.

Remover índices de filtro bloom existentes

Se você tiver índices de filtro Bloom existentes em suas tabelas, remova-os para eliminar a sobrecarga de gravação desnecessária.

DROP BLOOMFILTER INDEX ON TABLE table_name

Para obter detalhes da sintaxe, consulte DROP BLOOM FILTER INDEX.

Depois de remover todos os índices de filtro bloom, execute VACUUM para limpar os arquivos de índice subjacentes no _delta_index diretório.