Selecteren en configureren van compute in Azure Databricks
Gevorderd
Data Engineer
Azure Databricks
Azure Databricks biedt meerdere rekenopties die zijn geoptimaliseerd voor verschillende workloads. In deze module wordt beschreven hoe u het juiste rekentype kiest, prestatie-instellingen configureert, toegangsmachtigingen beheert en bibliotheken installeert. U leert wanneer u serverloze versus klassieke berekeningen gebruikt, hoe u clusters optimaliseert voor kosten en prestaties en aanbevolen procedures voor het beveiligen van rekenresources.
Leerdoelen
Aan het einde van deze module kunt u het volgende doen:
- De juiste rekentypen kiezen voor verschillende Azure Databricks-workloads
- Instellingen voor rekenprestaties configureren, waaronder knooppunttypen, automatisch schalen en beƫindiging
- Rekenfuncties zoals Photon-versnelling inschakelen en de juiste Databricks Runtime-versies selecteren
- Compute-toegangsmachtigingen en toegewezen groepstoegangsmodi configureren
- Bibliotheken op rekenresources installeren en beheren met behulp van verschillende methoden
Vereisten
De volgende vereisten moeten worden voltooid:
- Basiskennis van Azure Databricks-concepten
- Bekendheid met Unity Catalog en werkruimtebeheer
- Kennis van de basisprincipes en clusterarchitectuur van Spark