Zarządzanie podstawowymi środowiskami przestrzeni roboczej

Na tej stronie wyjaśniono, jak tworzyć podstawowe środowiska obszarów roboczych i zarządzać nimi w obszarze roboczym. Środowiska podstawowe obszaru roboczego umożliwiają administratorom obszarów roboczych tworzenie wstępnie utworzonych, buforowanych środowisk dla notesów bezserwerowych i zarządzanie nimi.

Ważne

Środowiska bazowe obszaru roboczego mogą być teraz używane z funkcją Zarządzanie zależnościami za pomocą środowisk.

Permissions

  • Tylko administratorzy obszaru roboczego mogą tworzyć podstawowe środowiska obszaru roboczego i zarządzać nimi.
  • Wszyscy użytkownicy obszaru roboczego mają dostęp do podstawowych środowisk obszaru roboczego.
  • Wszyscy użytkownicy obszaru roboczego mogą tworzyć niestandardowe specyfikacje środowiska bezserwerowego.

Jak działają środowiska podstawowe obszaru roboczego w Azure Databricks

W Azure Databricks środowisko bazowe to udostępnialna specyfikacja YAML, która definiuje wersję środowiska bezserwerowego oraz zestaw dodatkowych zależności Python. Administratorzy obszarów roboczych tworzą środowiska podstawowe i zarządzają nimi, aby użytkownicy mogli szybko zacząć od spójnego, buforowanego środowiska i opcjonalnie dodawać własne biblioteki. Użytkownicy wybierają te środowiska bazowe z notebooków bezserwerowych oraz z klasycznych zasobów obliczeniowych, które zarządzają zależnościami za pomocą środowisk.

Środowiska bazowe dostarczane przez Databricks

Databricks udostępnia gotowe środowiska bazowe, które można ustawić jako domyślne środowisko robocze:

  • ML: To podstawowe środowisko z pakietami Python i pakietami systemowymi z Databricks Runtime for Machine Learning, które są preinstalowane. To środowisko służy do migrowania klasycznego środowiska Databricks Runtime na potrzeby obciążeń Machine Learning do bezserwerowych zasobów obliczeniowych. Zobacz Środowisko podstawowe uczenia maszynowego.
  • Sztuczna inteligencja: zoptymalizowane pod kątem sztucznej inteligencji środowisko podstawowe ze wstępnie zainstalowanymi bibliotekami uczenia maszynowego (ML). Ta opcja jest wyświetlana tylko w przypadku wybrania akceleratora (GPU). Zobacz środowisko AI.

Korzystanie ze środowisk podstawowych obszaru roboczego

Użytkownicy mogą wybrać środowisko podstawowe obszaru roboczego z menu rozwijanego Środowisko podstawowe w okienku bocznym Środowisko . Podstawowe środowiska obszaru roboczego są widoczne w menu rozwijanym obok innych opcji, takich jak Standard, ML, AI i Custom.

Po wybraniu bazowego środowiska roboczego, wstępnie utworzone środowisko buforowane jest ładowane szybko, skracając czas uruchamiania notatników i zadań. W przypadku zadań użycie środowisk podstawowych obszaru roboczego zwiększa efektywność, ponieważ zależności są już zapisane w pamięci podręcznej.

Aby uzyskać instrukcje dotyczące konfigurowania środowisk podstawowych w notesach, zobacz Wybieranie środowiska podstawowego. Aby uzyskać instrukcje dotyczące używania zarządzanych środowisk bazowych w zadaniach, zobacz Konfigurowanie środowiska pod kątem zadań podrzędnych. Instrukcje dotyczące wyboru środowiska bazowego na klasycznym komputerze, które zarządza zależnościami od środowisk, można znaleźć w artykule Używaj środowisk w notatniku.

Tworzenie i eksportowanie specyfikacji środowiska

Najprostszym sposobem na stworzenie poprawnej specyfikacji YAML jest zbudowanie środowiska w panelu bocznym Środowisko , a następnie użycie przycisku Eksport środowiska do pobrania pliku YAML.

  1. Otwórz notatnik i połącz się z usługą obliczeń bezserwerowych.
  2. Kliknij przycisk Environment icon.ikonę Środowisko Środowisko.Środowisko w panelu bocznym notatnika.
  3. W obszarze Środowisko podstawowe wybierz pozycję Standardowa lub użyj opcji Więcej , aby wybrać określoną wersję środowiska. Usługa Databricks zaleca korzystanie z najnowszej wersji środowiska bezserwerowego obsługiwanej w twoim obszarze roboczym.
  4. W polu Zależności dodaj dowolne zależności, które chcesz, aby miało środowisko podstawowe. Kliknij pozycję Dodaj zależność po wprowadzeniu każdej zależności. Aby uzyskać więcej instrukcji dotyczących dodawania zależności, zobacz Dodawanie zależności do notesu.
  5. Kliknij Apply na dole panelu środowiska, aby upewnić się, że specyfikacja jest poprawna.
  6. Kliknij ikonę menu kebabu, ikonę menu kebabu. na dole panelu środowiska, następnie kliknij Eksportuj środowisko.
  7. Nadaj plikowi YAML nazwę i dodaj go do folderu obszaru roboczego lub woluminu Unity Catalog.

Przykładowa specyfikacja środowiska

Poniższy przykład YAML jest oparty na specyfikacji środowiska projektów MLflow. Definiuje środowisko podstawowe z kilkoma zależnościami biblioteki:

environment_version: '5'
dependencies:
  - --index-url https://pypi.org/simple
  - -r "/Workspace/Shared/requirements.txt"
  - my-library==6.1
  - /Workspace/Shared/Path/To/simplejson-3.19.3-py3-none-any.whl
  - git+https://github.com/databricks/databricks-cli

Dodawanie środowiska podstawowego do obszaru roboczego

Aby dodać specyfikację środowiska jako środowisko podstawowe do obszaru roboczego:

  1. W obszarze roboczym przejdź do pozycji Ustawienia.
  2. W sekcji Administrowanie obszarem roboczym wybierz Obliczenia.
  3. Obok pozycji Podstawowe środowiska dla obliczeń bezserwerowych kliknij pozycję Zarządzaj.
  4. Kliknij pozycję Utwórz.
  5. Nadaj swojemu środowisku podstawowemu nazwę. Jest to nazwa, którą użytkownicy zobaczą w menu rozwijanym Środowisko podstawowe .
  6. Wybierz plik YAML specyfikacji środowiska przy użyciu selektora plików. Możesz przeglądać pliki obszaru roboczego lub woluminy katalogu Unity.
  7. Wybierz, czy środowisko podstawowe ma być ustawione jako domyślne dla wszystkich nowych notatników.
  8. (Opcjonalnie) Aby ustawić niestandardowy identyfikator podstawowego środowiska, rozwiń węzeł Zaawansowane i wprowadź wartość w polu Identyfikator środowiska podstawowego. Identyfikator musi zawierać tylko małe litery, cyfry i łączniki bez łączników wiodących ani końcowych. Jeśli nie podasz identyfikatora, Azure Databricks wygeneruje go automatycznie. Nie można edytować identyfikatora po utworzeniu środowiska podstawowego.
  9. Kliknij pozycję Utwórz.

Środowisko podstawowe rozpocznie kompilowanie. Sprawdź kolumnę Stan na liście środowisk podstawowych. Zostanie ona zmieniona na Gotowe do użycia , gdy będzie gotowa.

Kompilowanie na potrzeby przetwarzania bezserwerowego procesora GPU (AI Runtime)

Ważne

Ta funkcja jest dostępna w publicznej wersji testowej.

Podczas tworzenia środowiska podstawowego można opcjonalnie włączyć pole wyboru Build for Serverless GPU Compute (Kompilowanie bezserwerowych obliczeń gpu ), aby skompilować środowisko dla obciążeń procesora GPU. Spowoduje to utworzenie wersji środowiska podstawowego zgodnej z GPU, która pojawi się na karcie GPU.

Strona zarządzania środowiskami podstawowymi ma dwie karty:

  • CPU: wyświetla listę podstawowych środowisk obliczeniowych bez udziału serwerów (obciążeń niezwiązanych z procesorami GPU).
  • GPU: wyświetla listę podstawowych środowisk dla środowiska uruchomieniowego AI. Na tej karcie wyświetlane są również wiersze środowisk AI, które odpowiadają bazowym środowiskom AI. Więcej informacji znajdziesz w Środowisku sztucznej inteligencji Databricks.

Standard Latest odnosi się do najnowszej stabilnej standardowej podstawowej wersji środowiska dostarczonej przez usługę Databricks.

Uwaga / Notatka

Rekordy użycia skojarzone z tworzeniem i odświeżaniem środowisk podstawowych mają kolumnę ustawioną billing_origin_product na BASE_ENVIRONMENTS. Ponadto określony identyfikator środowiska podstawowego jest wypełniany w kolumnie usage_metadata.base_environment_id .

Ustawianie domyślnego środowiska podstawowego obszaru roboczego

Domyślnie notesy bezserwerowe w obszarze roboczym nie używają środowiska podstawowego. Administratorzy obszaru roboczego mogą domyślnie wybrać środowisko podstawowe, które ma być stosowane do wszystkich nowych notatników.

  1. W obszarze roboczym przejdź do pozycji Ustawienia.
  2. W sekcji Administrowanie obszarem roboczym wybierz Obliczenia.
  3. Obok pozycji Podstawowe środowiska dla obliczeń bezserwerowych kliknij pozycję Zarządzaj.
  4. Kliknij ikonę gwiazdki obok środowiska podstawowego, aby ustawić ją jako domyślną.

Wszystkie nowe notesy bezserwerowe będą teraz korzystać z wybranego środowiska podstawowego jako domyślnego.

Aktualizowanie środowiska podstawowego

Możesz edytować plik środowiska podstawowego, aby zaktualizować numery wersji lub dodać lub usunąć zależności. Aby zmienić wersję środowiska lub zależności, edytuj źródłowy plik YAML bezpośrednio.

Na liście środowisk podstawowych kliknij ścieżkę pliku YAML środowiska podstawowego, które chcesz zaktualizować. Spowoduje to otwarcie pliku na nowej karcie. Możesz tam przejrzeć lub zaktualizować zawartość pliku. Zmiany są zapisywane automatycznie.

Po wprowadzeniu aktualizacji do specyfikacji YAML należy odświeżyć środowisko podstawowe, aby notesy i zadania pobierały najnowszą konfigurację.

  1. Obok środowiska podstawowego, które chcesz odświeżyć, kliknij ikonę menu kebab. Następnie wybierz opcję Odśwież.
  2. Kliknij przycisk Potwierdź.

Nowe sesje używają teraz zaktualizowanego środowiska podstawowego. Aby pobrać aktualizacje, należy ponownie uruchomić istniejące sesje notatnika.

Ograniczenia

Środowiska podstawowe mają następujące ograniczenia:

  • Środowiska podstawowe w zadaniach są obsługiwane tylko w przypadku notebooków, skryptów Pythona i kół Python (Python wheel). Inne typy zadań nie są obsługiwane. Obsługa podstawowych środowisk obszarów roboczych w zadaniach jest w wersji beta.
  • Potoki Lakeflow nie obsługują środowisk bazowych.
  • Zainstalowane w czasie wykonywania są tylko te pakiety Python, które znajdują się na liście zależności.
  • Środowisko bezserwerowe w wersji 1 nie jest obsługiwane. Użyj wersji 2 lub nowszej.
  • Środowiska podstawowe są dostępne dla wszystkich użytkowników obszaru roboczego.
  • Obszary robocze są ograniczone do 10 środowisk podstawowych.