Auswählen und Konfigurieren von Compute in Azure Databricks
Fortgeschrittene Anfänger
Technische Fachkraft für Daten
Azure Databricks
Azure Databricks bietet mehrere Computeoptionen, die für unterschiedliche Workloads optimiert sind. In diesem Modul wird erläutert, wie Sie den richtigen Computetyp auswählen, Leistungseinstellungen konfigurieren, Zugriffsberechtigungen verwalten und Bibliotheken installieren. Sie erfahren, wann Sie serverlose und klassische Compute verwenden, wie Sie Cluster für Kosten und Leistung optimieren und bewährte Methoden zum Sichern von Computeressourcen verwenden.
Lernziele
Am Ende dieses Moduls können Sie:
- Auswählen geeigneter Computetypen für verschiedene Azure Databricks-Workloads
- Konfigurieren der Rechenleistungseinstellungen, einschließlich Knotentypen, automatischer Skalierung und Beendigung.
- Aktivieren Sie Rechenfunktionen wie die Photon-Beschleunigung und wählen Sie geeignete Databricks Runtime-Versionen
- Konfigurieren von Rechnerzugriffsberechtigungen und dedizierten Gruppenzugriffsmodi
- Installieren und Verwalten von Bibliotheken auf Computeressourcen mithilfe verschiedener Methoden
Voraussetzungen
Die folgenden Voraussetzungen sollten erfüllt werden:
- Grundlegendes Verständnis von Azure Databricks-Konzepten
- Vertrautheit mit Unity-Katalog sowie Arbeitsbereichsverwaltung
- Wissen über Spark-Grundlagen und Clusterarchitektur