Grupo de comandos air

Importante

Esse recurso está em Visualização Pública.

O air grupo de comandos dentro da CLI Databricks submete e gerencia cargas de trabalho da GPU, como treinamento e inferência, com o tempo de execução de IA.

Para campos de configuração de carga de trabalho, veja referência Workload YAML. Para enviar sua primeira carga de trabalho, veja o início rápido da CLI do Databricks para AI Runtime.

Databricks Air Run

Submeta uma carga de trabalho a partir de uma configuração YAML. A saída inclui o ID de execução de trabalho e o URL de execução de trabalhos.

databricks air run --file YAML_PATH [flags]

Arguments

None

Opções

-f, --file string

    Caminho para a configuração YAML da carga de trabalho. Essa opção é obrigatória.

--watch

    Fluxo de nó 0 logs até que a execução atinja um estado terminal. Padrão: false.

--override stringArray

    Substitua um campo YAML usando FIELD_PATH=VALUE. Repita essa opção para sobrescrever vários campos.

--dry-run

    Valide a configuração sem submeter uma carga de trabalho. Padrão: false.

--idempotency-key string

    Devolva uma execução existente quando a chave já foi usada anteriormente. Sobrescreve idempotency_token no YAML. Máximo: 64 caracteres.

Sinalizadores globais

Examples

O exemplo a seguir apresenta uma carga de trabalho a partir de train.yaml:

databricks air run --file train.yaml

Passe um caminho de configuração como argumento separado para -h exibir ajuda na configuração da carga de trabalho:

databricks air run -h config
databricks air run -h config.compute
databricks air run -h config.compute.accelerator_type

Databricks Air Get

Obtenha detalhes para uma corrida.

databricks air get JOB_RUN_ID [flags]

Arguments

JOB_RUN_ID

    Um ID de execução de trabalho retornado por databricks air run.

Opções

Sinalizadores globais

Databricks Air List

A lista é executada. Por padrão, o comando lista as execuções ativas enviadas pelo usuário atual.

databricks air list [flags]

Arguments

None

Opções

--limit int

    Número máximo de corridas para mostrar. Padrão: 20.

--all-status

    Inclua as corridas em estados terminais. Padrão: false.

--all-users

    Inclua sequências enviadas por outros usuários. Padrão: false.

--filter stringArray

    O filtro roda usando KEY=VALUE. Repita essa opção para exigir múltiplas condições. As teclas suportadas são accelerator_type, experiment, num_accelerators, e user.

Sinalizadores globais

Databricks Air Logs

Transmita ou busque logs para uma corrida.

databricks air logs JOB_RUN_ID [flags]

Arguments

JOB_RUN_ID

    Um ID de execução de trabalho retornado por databricks air run.

Opções

--node int

    Selecione um índice de nós baseado em zero. Padrão: 0.

--tail int

    Número de loglines existentes para imprimir. Padrão: 10000.

--minutes int

    Buscar registros dos últimos minutos. Não é possível combinar com --tail. Padrão: 0.

--retry int

    Selecione uma tentativa de retentativa. 0 é a tentativa inicial e -1 é a mais recente. Padrão: -1.

--download-to string

    Baixe os registros completos em um diretório. Baixa todos os nós, a menos que --node esteja configurado. Não é possível combinar com --tail ou --minutes.

Sinalizadores globais

Databricks Air Cancel

Cancele uma ou mais execuções pelo ID de execução do trabalho, ou cancele todas as execuções ativas enviadas pelo usuário atual.

databricks air cancel [JOB_RUN_ID...] [flags]

Arguments

JOB_RUN_ID

    Um ou mais IDs de trabalho feitos. Não é possível combinar com --all.

Opções

--all

    Cancele todas as execuções ativas enviadas pelo usuário atual. Padrão: false.

-y, --yes

    Pule o prompt de confirmação usado por --all. Padrão: false.

Sinalizadores globais

Lista de piscinas de ar Databricks

Liste a capacidade da GPU provisionada disponível para o workspace atual.

Use o ID de capacidade provisionado em compute.pool_id.

databricks air pools list [flags]

Arguments

None

Opções

Sinalizadores globais

Databricks Air pools obtêm

Obtenha detalhes sobre a capacidade da GPU provisionada.

databricks air pools get [POOL_ID] [flags]

Arguments

POOL_ID

    O ID de capacidade provisionado. O argumento é opcional apenas quando o espaço de trabalho tem exatamente uma capacidade provisionada.

Opções

Sinalizadores globais

Databricks Air Images Push

Envie uma imagem de contêiner para o Registro de Artefatos.

Para pré-requisitos e instruções para empurrar uma imagem, veja Push imagens com a Cli de Databricks.

databricks air images push [flags]

Arguments

None

Opções

-s, --source string

    A imagem do contêiner de origem como um nome com uma tag opcional (NAME[:TAG]) ou um digest (NAME@DIGEST). Se omitido em um terminal interativo, o prompt de comando mostra o valor.

--catalog string

    O catálogo do Catálogo Unity de destino. Se omitido em um terminal interativo, o prompt de comando mostra o valor.

--schema string

    O esquema do Catálogo Unity de destino. Se omitido em um terminal interativo, o prompt de comando mostra o valor.

--artifact string

    O artefato de destino como ARTIFACT[:TAG]. O padrão é o nome da imagem de origem e a tag, ou a latest tag quando a fonte não tem tag.

--pull

    Extraia a imagem de origem do registro antes de fazer push em vez de reutilizar uma imagem local disponível. Padrão: false.

Sinalizadores globais

Databricks Air Convert-to-DABs

Converta uma configuração YAML de carga de trabalho em um Databricks Asset Bundle. Esse comando local escreve databricks.yml e lança arquivos sob generated_artifacts/.

Esse comando é uma ponte opcional para um fluxo de trabalho avançado de produção. Você pode continuar usando databricks air run sem precisar converter a configuração.

Para o fluxo de trabalho em bundles, veja Agendar cargas de trabalho da GPU e tarefas de composição.

databricks air convert-to-dabs YAML_PATH [flags]

Arguments

YAML_PATH

    O caminho para a configuração YAML da carga de trabalho.

Opções

--output-dir string

    Diretório onde o comando escreve o bundle. A fonte do código deve estar dentro desse diretório. Padrão: o diretório que contém o arquivo YAML de entrada.

--force

    Sobrescreva arquivos de bundle gerados que já existem. Padrão: false.

Sinalizadores globais

Sinalizadores globais

--debug

  Indica se deve habilitar o registro em log de depuração.

-h ou --help

    Exiba ajuda para a CLI do Databricks ou o grupo de comandos relacionado ou o comando relacionado.

--log-file corda

    Uma cadeia de caracteres que representa o arquivo onde serão gravados os logs de saída. Caso esse sinalizador não seja especificado, o padrão é registrar os logs de saída no stderr.

--log-format formato

    O tipo de formato de log, text ou json. O valor padrão é text.

--log-level corda

    Uma cadeia de caracteres que representa o nível de formato de log. Se não for especificado, o nível de formato de log será desabilitado.

-o, --output tipo

    O tipo de saída do comando, text ou json. O valor padrão é text.

-p, --profile corda

    O nome do perfil no arquivo ~/.databrickscfg, que deverá ser usado para executar o comando. Se esse sinalizador não for especificado, se existir, o perfil nomeado DEFAULT será usado.

--progress-format formato

    O formato para exibir logs de progresso: default, append, inplace ou json

-t, --target corda

    Se aplicável, o destino do pacote a ser usado

Migrar a partir da linha de comando legada de Python

A CLI Databricks e a CLI obsoleta baseada air em Python usam nomes e flags de comandos diferentes. Atualize scripts usando os seguintes mapeamentos:

CLI de Python CLI do Databricks
air run -f train.yaml databricks air run -f train.yaml
air run -f train.yaml --override A=X B=Y databricks air run -f train.yaml --override A=X --override B=Y
air get run <run-id> databricks air get <run-id>
air list runs databricks air list --all-status
air list runs --active databricks air list
air -h config databricks air run -h config
air logs <run-id> databricks air logs <run-id>
air cancel <run-id> databricks air cancel <run-id>

Recursos adicionais