Selecteren en configureren van compute in Azure Databricks

Gevorderd
Data Engineer
Azure Databricks

Azure Databricks biedt meerdere rekenopties die zijn geoptimaliseerd voor verschillende workloads. In deze module wordt beschreven hoe u het juiste rekentype kiest, prestatie-instellingen configureert, toegangsmachtigingen beheert en bibliotheken installeert. U leert wanneer u serverloze versus klassieke berekeningen gebruikt, hoe u clusters optimaliseert voor kosten en prestaties en aanbevolen procedures voor het beveiligen van rekenresources.

Leerdoelen

Aan het einde van deze module kunt u het volgende doen:

  • De juiste rekentypen kiezen voor verschillende Azure Databricks-workloads
  • Instellingen voor rekenprestaties configureren, waaronder knooppunttypen, automatisch schalen en beĆ«indiging
  • Rekenfuncties zoals Photon-versnelling inschakelen en de juiste Databricks Runtime-versies selecteren
  • Compute-toegangsmachtigingen en toegewezen groepstoegangsmodi configureren
  • Bibliotheken op rekenresources installeren en beheren met behulp van verschillende methoden

Vereisten

De volgende vereisten moeten worden voltooid:

  • Basiskennis van Azure Databricks-concepten
  • Bekendheid met Unity Catalog en werkruimtebeheer
  • Kennis van de basisprincipes en clusterarchitectuur van Spark