Auswählen und Konfigurieren von Compute in Azure Databricks

Fortgeschrittene Anfänger
Technische Fachkraft für Daten
Azure Databricks

Azure Databricks bietet mehrere Computeoptionen, die für unterschiedliche Workloads optimiert sind. In diesem Modul wird erläutert, wie Sie den richtigen Computetyp auswählen, Leistungseinstellungen konfigurieren, Zugriffsberechtigungen verwalten und Bibliotheken installieren. Sie erfahren, wann Sie serverlose und klassische Compute verwenden, wie Sie Cluster für Kosten und Leistung optimieren und bewährte Methoden zum Sichern von Computeressourcen verwenden.

Lernziele

Am Ende dieses Moduls können Sie:

  • Auswählen geeigneter Computetypen für verschiedene Azure Databricks-Workloads
  • Konfigurieren der Rechenleistungseinstellungen, einschließlich Knotentypen, automatischer Skalierung und Beendigung.
  • Aktivieren Sie Rechenfunktionen wie die Photon-Beschleunigung und wählen Sie geeignete Databricks Runtime-Versionen
  • Konfigurieren von Rechnerzugriffsberechtigungen und dedizierten Gruppenzugriffsmodi
  • Installieren und Verwalten von Bibliotheken auf Computeressourcen mithilfe verschiedener Methoden

Voraussetzungen

Die folgenden Voraussetzungen sollten erfüllt werden:

  • Grundlegendes Verständnis von Azure Databricks-Konzepten
  • Vertrautheit mit Unity-Katalog sowie Arbeitsbereichsverwaltung
  • Wissen über Spark-Grundlagen und Clusterarchitektur