Samouczek: kopiowanie danych do systemu plików Azure Data Box Heavy za pośrednictwem systemu plików NFS

W tym samouczku opisano, jak połączyć się z urządzeniem Azure Data Box Heavy i skopiować na nie dane z komputera-hosta za pomocą lokalnego internetowego interfejsu użytkownika.

W tym poradniku nauczysz się, jak:

  • Prerequisites
  • Nawiązywanie połączenia z urządzeniem Data Box Heavy
  • Kopiowanie danych do urządzenia Data Box Heavy

Prerequisites

Przed rozpoczęciem upewnij się, że:

  1. Ukończyłeś Samouczek: Konfigurowanie Azure Data Box Heavy.
  2. Otrzymano urządzenie Data Box Heavy, a stan zamówienia w portalu to Dostarczono.
  3. Masz komputer hosta zawierający dane, które chcesz skopiować do urządzenia Data Box Heavy. Komputer-host musi
    • Uruchom obsługiwany system operacyjny.
    • Połączenie z siecią o dużej szybkości. W przypadku najszybszych szybkości kopiowania dwa połączenia 40 GbE (jedno na węzeł) mogą być używane równolegle. Jeśli nie masz dostępnego połączenia 40 GbE, zalecamy posiadanie co najmniej dwóch połączeń 10 GbE (po jednym na węzeł).

Nawiązywanie połączenia z urządzeniem Data Box Heavy

Na podstawie wybranego konta magazynu usługa Data Box Heavy tworzy maksymalnie:

  • Trzy udziały dla każdego skojarzonego konta magazynu dla kont GPv1 i GPv2.
  • Jeden udział dla pamięci masowej Premium.
  • Jeden udział dla konta usługi Blob Storage.

Te udziały są tworzone na obu węzłach urządzenia.

W obszarze blokowych obiektów blob i stronicowych obiektów blob:

  • Jednostki pierwszego poziomu to kontenery.
  • Encje drugiego poziomu to obiekty blob.

W obszarze Udziały dla Azure Files:

  • Jednostki pierwszego poziomu to udziały.
  • Jednostki drugiego poziomu to pliki.

W poniższej tabeli przedstawiono ścieżkę UNC do udziałów na urządzeniu Data Box Heavy oraz adres URL ścieżki w usłudze Azure Storage, do którego są przekazywane dane. Końcowy adres URL ścieżki usługi Azure Storage można wyprowadzić na podstawie ścieżki udziału UNC.

Magazyn ścieżka UNC
Blokowe obiekty blob platformy Azure
  • Ścieżka UNC do udziałów: //<DeviceIPAddress>/<StorageAccountName_BlockBlob>/<ContainerName>/files/a.txt
  • Adres URL usługi Azure Storage: https://<StorageAccountName>.blob.core.windows.net/<ContainerName>/files/a.txt
  • Azure stronicowe obiekty blob
  • Ścieżka UNC do udziałów: //<DeviceIPAddress>/<StorageAccountName_PageBlob>/<ContainerName>/files/a.txt
  • Adres URL usługi Azure Storage: https://<StorageAccountName>.blob.core.windows.net/<ContainerName>/files/a.txt
  • Azure Files
  • Ścieżka UNC do udziałów: //<DeviceIPAddress>/<StorageAccountName_AzFile>/<ShareName>/files/a.txt
  • Adres URL usługi Azure Storage: https://<StorageAccountName>.file.core.windows.net/<ShareName>/files/a.txt
  • Jeśli używasz komputera hosta z systemem Linux, wykonaj następujące kroki, aby skonfigurować urządzenie, aby zezwolić na dostęp do klientów NFS.

    1. Podaj adresy IP dozwolonych klientów, którzy mogą uzyskiwać dostęp do zasobu. W lokalnym internetowym interfejsie użytkownika przejdź do strony Łączenie i kopiowanie . W obszarze Ustawienia NFS kliknij Dostęp klienta NFS.

      Konfigurowanie dostępu klienta NFS 1

    2. Podaj adres IP klienta NFS i kliknij przycisk Dodaj. Powtarzając ten krok, możesz skonfigurować dostęp dla wielu klientów NFS. Kliknij przycisk OK.

      Konfigurowanie dostępu klienta NFS 2

    3. Upewnij się, że na komputerze hosta z systemem Linux zainstalowano obsługiwaną wersję klienta NFS. Użyj konkretnej wersji dla określonej dystrybucji systemu Linux.

    4. Po zainstalowaniu klienta NFS użyj następującego polecenia, aby zamontować udział NFS na Twoim urządzeniu Data Box.

      sudo mount <Data Box Heavy device IP>:/<NFS share on Data Box Heavy device> <Path to the folder on local Linux computer>

      Poniższy przykład pokazuje, jak połączyć się przez system NFS z udziałem usługi Data Box Heavy. Adres IP urządzenia Data Box Heavy to 10.161.23.130, udział Mystoracct_Blob jest zamontowany na maszynie wirtualnej ubuntuVM; punktem montowania jest /home/databoxheavyubuntuhost/databoxheavy.

      sudo mount -t nfs 10.161.23.130:/Mystoracct_Blob /home/databoxheavyubuntuhost/databoxheavy

      W przypadku klientów mac należy dodać dodatkową opcję w następujący sposób:

      sudo mount -t nfs -o sec=sys,resvport 10.161.23.130:/Mystoracct_Blob /home/databoxheavyubuntuhost/databoxheavy

      Zawsze utwórz w udziale folder na pliki, które zamierzasz skopiować, a następnie skopiuj pliki do tego folderu. Folder utworzony w obiektach blob blokowych i stronicowanych reprezentuje kontener, do którego dane są przesyłane jako obiekty blob. Nie można kopiować plików bezpośrednio do folderu głównego na koncie magazynu.

    Kopiowanie danych do urządzenia Data Box Heavy

    Po nawiązaniu połączenia z udziałami Data Box Heavy następnym krokiem jest skopiowanie danych. Przed rozpoczęciem kopiowania danych zapoznaj się z następującymi zagadnieniami:

    • Upewnij się, że skopiujesz dane do udziałów odpowiadających odpowiedniemu formatowi danych. Na przykład skopiuj dane blokowych obiektów blob do udziału dla blokowych obiektów blob. Skopiuj dyski VHD do stronicowanych obiektów blob. Jeśli format danych nie jest zgodny z odpowiednim typem udziału, w późniejszym kroku przekazywanie danych do Azure zakończy się niepowodzeniem.

    • Podczas kopiowania danych upewnij się, że rozmiar danych jest zgodny z limitami wielkości opisanymi w dokumencie Azure Storage i limity usługi Data Box Heavy.

    • Jeśli dane, które są przekazywane przez urządzenie Data Box Heavy, są współbieżnie przekazywane przez inne aplikacje poza urządzeniem Data Box Heavy, może to spowodować niepowodzenie zadania przekazywania i uszkodzenie danych.

    • Zalecamy, aby jednocześnie nie używać protokołu SMB i NFS ani kopiowania tych samych danych do tego samego miejsca docelowego na Azure. W takich przypadkach nie można określić końcowego wyniku.

    • Zawsze utwórz w udziale folder na pliki, które zamierzasz skopiować, a następnie skopiuj pliki do tego folderu. Folder utworzony w obiektach blob blokowych i stronicowanych reprezentuje kontener, do którego dane są przesyłane jako obiekty blob. Nie można kopiować plików bezpośrednio do folderu głównego na koncie magazynu.

    • W przypadku pozyskiwania katalogów i nazw plików z uwzględnieniem wielkości liter z udziału NFS do systemu NFS na urządzeniu Data Box Heavy:

      • Wielkość liter jest zachowywana w nazwie.
      • Nazwy plików są niewrażliwe na wielkość liter.

      Na przykład jeśli kopiowanie SampleFile.txt i Samplefile.Txt, przypadek zostanie zachowany w nazwie podczas kopiowania do urządzenia, ale drugi plik zastąpi pierwszy, ponieważ są one traktowane jako ten sam plik.

    Jeśli używasz komputera hosta z systemem Linux, użyj narzędzia do kopiowania podobnego do narzędzia Robocopy. Niektóre alternatywy dostępne w systemie Linux to rsync, FreeFileSync, Unison lub Ultracopier.

    Polecenie cp jest jedną z najlepszych opcji kopiowania katalogu. Aby uzyskać więcej informacji na temat użycia, przejdź do stron cp man.

    Jeśli używasz opcji rsync dla kopiowania wielowątkowego, postępuj zgodnie z następującymi wytycznymi:

    • Zainstaluj pakiet CIFS Utils lub NFS Utils w zależności od systemu plików używanego przez klienta systemu Linux.

      sudo apt-get install cifs-utils

      sudo apt-get install nfs-utils

    • Zainstaluj Rsync i Parallel (różni się w zależności od wersji rozproszonej systemu Linux).

      sudo apt-get install rsync

      sudo apt-get install parallel

    • Utwórz punkt instalacji.

      sudo mkdir /mnt/databoxheavy

    • Zainstaluj wolumin.

      sudo mount -t NFS4 //Databox-heavy-IP-Address/share_name /mnt/databoxheavy

    • Odzwierciedl strukturę katalogów folderu.

      rsync -za --include='*/' --exclude='*' /local_path/ /mnt/databoxheavy

    • Kopiowanie plików.

      cd /local_path/; find -L . -type f | parallel -j X rsync -za {} /mnt/databoxheavy/{}

      gdzie j określa stopień równoległości, X = liczba równoległych kopii

      Zalecamy rozpoczęcie od 16 równoległych kopii i zwiększenie liczby wątków w zależności od dostępnych zasobów.

    Ważne

    Następujące typy plików systemu Linux nie są obsługiwane: linki symboliczne, pliki znaków, pliki blokowe, gniazda i potoki. Te typy plików spowodują błędy podczas kroku Przygotowywanie do wysłania .

    Otwórz folder docelowy, aby wyświetlić i zweryfikować skopiowane pliki. Jeśli podczas procesu kopiowania występują błędy, pobierz pliki błędów, aby rozwiązać problemy. Aby uzyskać więcej informacji, zobacz Wyświetlanie dzienników błędów podczas kopiowania danych do urządzenia Data Box Heavy. Aby uzyskać szczegółową listę błędów podczas kopiowania danych, zobacz Rozwiązywanie problemów z urządzeniem Data Box Heavy.

    Aby zapewnić integralność danych, suma kontrolna jest obliczana na bieżąco podczas kopiowania danych. Po zakończeniu kopiowania sprawdź ilość używanego i wolnego miejsca na urządzeniu.

    Sprawdzanie wolnego i używanego miejsca na pulpicie nawigacyjnym

    Następne kroki

    W tym samouczku przedstawiono zagadnienia dotyczące urządzenia Azure Data Box Heavy, takie jak:

    • Prerequisites
    • Nawiązywanie połączenia z urządzeniem Data Box Heavy
    • Kopiowanie danych do urządzenia Data Box Heavy

    Przejdź do następnego samouczka, aby dowiedzieć się, jak odesłać urządzenie Data Box do firmy Microsoft.