Código de depuração usando Databricks Connect para a extensão IDE Databricks

Este artigo descreve como utilizar a integração Databricks Connect na extensão do IDE Databricks para executar e depurar ficheiros Python (.py) individuais. Para informações sobre a extensão, consulte a extensão do IDE Databricks.

A integração do Databricks Connect também permite executar e depurar células de cadernos. Veja : Executar e depurar células de cadernos com Databricks Conecte-se usando a extensão IDE Databricks.

Requisitos

Antes de poder usar o Databricks Connect a partir da extensão IDE do Databricks, deve primeiro cumprir os requisitos do Databricks Connect. Estes requisitos incluem coisas como um espaço de trabalho com Unity Catalog, requisitos de computação e requisitos de versão para a instalação local de Python.

Ativar um ambiente virtual em Python

Ativa um Python virtual environment para o teu projeto Python. Os ambientes virtuais em Python ajudam a garantir que o seu projeto utiliza versões compatíveis dos pacotes Python e Python (neste caso, o pacote Databricks Connect).

No painel Configuração:

  1. Clique no item vermelho Ativar Ambiente Virtual sob Python Ambiente.
  2. Na Paleta de Comandos, selecione Venv ou Conda.
  3. Selecione as dependências que deseja instalar, se houver.

Instalar o Databricks Connect

Na vista Configuration sob Ambiente Python:

  1. Clique no botão vermelho Install databricks-connect play.
  2. Anexe um cluster.
    • Se a seção Cluster ainda não estiver configurada na extensão, a seguinte mensagem será exibida: "Anexe um cluster para usar o Databricks Connect". Clique em Anexar Cluster e selecione um cluster que atenda aos requisitos do Databricks Connect.
    • Se a secção Cluster estiver configurada, mas o cluster não for compatível com o Databricks Connect, clique no botão vermelho Databricks Connect desativado, clique em Ligar Clustere selecione um cluster compatível.
  3. Se o pacote Databricks Connect (e suas dependências) ainda não estiver instalado, a seguinte mensagem será exibida: "Para depuração interativa e preenchimento automático, você precisa do Databricks Connect. Gostaria de instalá-lo no ambiente <environment-name>." Clique em Install (Instalar).
  4. Na barra de estado Visual Studio Code, se aparecer o botão vermelho Databricks Connect desativado, clique nele e complete as instruções no ecrã para o ativar.
  5. Depois de aparecer o botão "Databricks Connect ativado", estará pronto para usar o Databricks Connect.

Nota

Se você usar o Poetry, poderá sincronizar seus pyproject.toml arquivos e poetry.lock com o pacote Databricks Connect instalado (e suas dependências) executando o seguinte comando. Certifica-te de substituir 16.4.1 pela versão do pacote Databricks Connect que corresponde à que foi instalada pela extensão IDE Databricks para o teu projeto.

poetry add databricks-connect==16.4.1

Executa ou depura o teu código Python

Depois de ativar o Databricks Connect, execute ou depure o seu ficheiro de Python (.py):

  1. No teu projeto, abre o ficheiro Python que quiseres executar ou depurar.

  2. Defina quaisquer pontos de interrupção de depuração dentro do ficheiro Python.

  3. Clique no ícone Executar no Databricks ao lado da lista de guias do editor e, em seguida, clique em Depurar arquivo atual comDatabricks Connect.

    Depurar ficheiro atual a partir do ícone

    A saída aparece no painel Debug Console .

    Você também pode clicar com o botão direito do mouse no arquivo .py e, em seguida, clicar em Executar Databricks>Depurar arquivo atual com o Databricks Connect.

    Depurar arquivo atual do menu de contexto