Wybieranie i konfigurowanie obliczeń w usłudze Azure Databricks
Usługa Azure Databricks oferuje wiele opcji obliczeniowych zoptymalizowanych pod kątem różnych obciążeń. W tym module opisano sposób wybierania odpowiedniego typu obliczeniowego, konfigurowania ustawień wydajności, zarządzania uprawnieniami dostępu i instalowania bibliotek. Dowiesz się, kiedy używać obliczeń bezserwerowych i klasycznych, jak zoptymalizować klastry pod kątem kosztów i wydajności oraz najlepsze rozwiązania dotyczące zabezpieczania zasobów obliczeniowych.
Cele szkolenia
Po ukończeniu tego modułu będziesz wiedzieć, jak wykonać następujące czynności:
- Wybieranie odpowiednich typów obliczeniowych dla różnych obciążeń usługi Azure Databricks
- Konfigurowanie ustawień wydajności obliczeniowej, w tym typów węzłów, skalowania automatycznego i kończenia
- Włącz funkcje obliczeniowe, takie jak przyspieszanie Photon, i wybierz odpowiednie wersje środowiska Databricks Runtime
- Konfigurowanie uprawnień dostępu do zasobów obliczeniowych i trybów dostępu dedykowanej grupy
- Instalowanie bibliotek obliczeniowych i zarządzanie nimi przy użyciu różnych metod
Wymagania wstępne
Należy wykonać następujące wymagania wstępne:
- Podstawowa wiedza na temat pojęć związanych z usługą Azure Databricks
- Znajomość zarządzania katalogiem Unity oraz zarządzania obszarem roboczym
- Znajomość podstaw platformy Spark i architektury klastra