Azure Databricks でコンピューティングを選択して構成する
中級
データ エンジニア
Azure Databricks
Azure Databricks には、さまざまなワークロード用に最適化された複数のコンピューティング オプションが用意されています。 このモジュールでは、適切なコンピューティングの種類の選択、パフォーマンス設定の構成、アクセス許可の管理、ライブラリのインストールを行う方法について説明します。 サーバーレスコンピューティングとクラシック コンピューティングのどちらを使用するか、コストとパフォーマンスのためにクラスターを最適化する方法、コンピューティング リソースをセキュリティで保護するためのベスト プラクティスについて説明します。
学習の目的
このモジュールを終了すると、次のことができるようになります。
- さまざまな Azure Databricks ワークロードに適したコンピューティングの種類を選択する
- ノードの種類、自動スケール、終了などのコンピューティング パフォーマンス設定を構成する
- Photon アクセラレーションなどのコンピューティング機能を有効にし、適切な Databricks Runtime バージョンを選択する
- コンピューティング アクセス許可と専用グループ アクセス モードを構成する
- さまざまな方法を使用してコンピューティング リソースにライブラリをインストールおよび管理する
前提条件
次の前提条件を満たす必要があります。
- Azure Databricks の概念の基本的な理解
- Unity カタログとワークスペースの管理に関する知識
- Spark の基礎とクラスター アーキテクチャに関する知識