Selecciona y configura recursos de cómputo en Azure Databricks

Intermedio
Ingeniero de datos
Azure Databricks

Azure Databricks proporciona varias opciones de proceso optimizadas para diferentes cargas de trabajo. En este módulo se explora cómo elegir el tipo de proceso adecuado, configurar las opciones de rendimiento, administrar permisos de acceso e instalar bibliotecas. Aprenderá a usar el proceso sin servidor frente al proceso clásico, cómo optimizar los clústeres para el costo y el rendimiento, y los procedimientos recomendados para proteger los recursos de proceso.

Objetivos de aprendizaje

Al término de este módulo, sabrá hacer lo siguiente:

  • Elección de los tipos de proceso adecuados para diferentes cargas de trabajo de Azure Databricks
  • Configuración de los valores de rendimiento de proceso, incluidos los tipos de nodo, el escalado automático y la finalización
  • Habilitar características de cómputo como la aceleración de Photon y seleccionar las versiones adecuadas de Databricks Runtime.
  • Configuración de permisos de acceso a la computación y los modos de acceso de grupos dedicados
  • Instalación y administración de bibliotecas en recursos de proceso mediante varios métodos

Requisitos previos

Se deben completar los siguientes requisitos previos:

  • Conocimientos básicos de los conceptos de Azure Databricks
  • Familiaridad con la administración de catálogos y áreas de trabajo de Unity
  • Conocimientos básicos de Spark y arquitectura de clústeres