Självstudie: Kopiera data till Azure Data Box Heavy via NFS

I den här självstudien beskrivs hur du ansluter till och kopierar data från värddatorn med hjälp av det lokala webbgränssnittet till din Azure Data Box Heavy.

I den här tutorialen lär du dig följande:

  • Prerequisites
  • Anslut till Data Box Heavy
  • Kopiera data till Data Box Heavy

Prerequisites

Innan du börjar bör du kontrollera att:

  1. Du har slutfört självstudien: Konfigurera Azure Data Box Heavy.
  2. Du har tagit emot din Data Box Heavy och orderstatusen i portalen är Levererad.
  3. Du har en värddator som har de data som du vill kopiera över till Data Box Heavy. Din värddator måste
    • Köra ett operativsystem som stöds.
    • Vara ansluten till en höghastighetsnätverk. För snabbaste kopieringshastigheter kan två 40 GbE-anslutningar (en per nod) användas parallellt. Om du inte har 40 GbE-anslutning tillgänglig rekommenderar vi att du har minst två 10 GbE-anslutningar (en per nod).

Anslut till Data Box Heavy

Baserat på det valda lagringskontot skapar Data Box Heavy upp till:

  • Tre fildelningar för varje associerat lagringskonto för GPv1 och GPv2.
  • En resursdelning för Premium Storage.
  • En resursdelning för bloblagringskonto.

Dessa resursdelningar skapas på enhetens båda noder.

Under blockblob- och sidblobresurser:

  • Entiteter på första nivån är containrar.
  • Entiteter på andra nivån är blobar.

Under fildelningar för Azure Files:

  • Entiteter på den första nivån är delningar.
  • Entiteter på andra nivån är filer.

Följande tabell visar UNC-sökvägen till utdelningarna på din Data Box Heavy samt URL:en till Azure Storage-sökvägen dit data laddas upp. Den slutliga URL:en för Azure Storage-sökvägen kan härledas från UNC-resurssökvägen.

Storage UNC-sökväg
Azure Blockera blobar
  • UNC-sökväg till delningar: //<DeviceIPAddress>/<StorageAccountName_BlockBlob>/<ContainerName>/files/a.txt
  • Azure Storage URL:https://<StorageAccountName>.blob.core.windows.net/<ContainerName>/files/a.txt
  • Azure sidblobar
  • UNC-sökväg till delningar: //<DeviceIPAddress>/<StorageAccountName_PageBlob>/<ContainerName>/files/a.txt
  • Azure Storage URL:https://<StorageAccountName>.blob.core.windows.net/<ContainerName>/files/a.txt
  • Azure Files
  • UNC-sökväg till delningar: //<DeviceIPAddress>/<StorageAccountName_AzFile>/<ShareName>/files/a.txt
  • Azure Storage URL:https://<StorageAccountName>.file.core.windows.net/<ShareName>/files/a.txt
  • Om du använder en Linux-värddator utför du följande steg för att konfigurera enheten så att den tillåter åtkomst till NFS-klienter.

    1. Ange IP-adresserna för de tillåtna klienterna som har åtkomst till resursen. I det lokala webbgränssnittet går du till Sidan Anslut och kopiera . Under NFS-inställningar klickar du på NFS-klientåtkomst.

      Konfigurera NFS-klientåtkomst 1

    2. Ange IP-adressen för NFS-klienten och klicka på Lägg till. Du kan konfigurera åtkomst för flera NFS-klienter genom att upprepa det här steget. Klicka på OK.

      Konfigurera NFS-klientåtkomst 2

    3. Kontrollera att Linux-värddatorn har en version av NFS-klienten som stöds installerad. Använd den specifika versionen för din Linux-distribution.

    4. När NFS-klienten har installerats använder du följande kommando för att montera NFS-resursen på Data Box-enheten:

      sudo mount <Data Box Heavy device IP>:/<NFS share on Data Box Heavy device> <Path to the folder on local Linux computer>

      I följande exempel visas hur du ansluter via NFS till en Data Box Heavy-resurs. IP-adressen för Data Box Heavy är 10.161.23.130 och resursen Mystoracct_Blob är monterad på ubuntuVM, med monteringspunkten /home/databoxheavyubuntuhost/databoxheavy.

      sudo mount -t nfs 10.161.23.130:/Mystoracct_Blob /home/databoxheavyubuntuhost/databoxheavy

      För Mac-klienter måste du lägga till ytterligare ett alternativ på följande sätt:

      sudo mount -t nfs -o sec=sys,resvport 10.161.23.130:/Mystoracct_Blob /home/databoxheavyubuntuhost/databoxheavy

      Skapa alltid en mapp för de filer som du tänker kopiera under resursen och kopiera sedan filerna till mappen. Mappen som skapas under blockblob- och sidblobresurser representerar en container till vilken data laddas upp som blobar. Du kan inte kopiera filer direkt till rotmappen i lagringskontot.

    Kopiera data till Data Box Heavy

    När du är ansluten till Data Box Heavy-resurserna är nästa steg att kopiera data. Innan du påbörjar datakopian bör du gå igenom följande överväganden:

    • Se till att du kopierar data till resurser som motsvarar rätt dataformat. Kopiera till exempel blockblobdata till resursen för blockblobar. Kopiera VHD:er till sidblobar. Om dataformatet inte matchar lämplig resurstyp misslyckas dataöverföringen till Azure i ett senare steg.

    • När du kopierar data ser du till att datastorleken överensstämmer med de storleksgränser som beskrivs i gränserna för Azure lagring och Data Box Heavy.

    • Om data, som laddas upp av Data Box Heavy, laddas upp samtidigt av andra program utanför Data Box Heavy, kan detta resultera i fel i uppladdningsjobbet och skadade data.

    • Vi rekommenderar att du inte använder både SMB och NFS samtidigt eller kopierar samma data till samma slutmål på Azure. I sådana fall kan det slutliga resultatet inte fastställas.

    • Skapa alltid en mapp för de filer som du tänker kopiera under resursen och kopiera sedan filerna till mappen. Mappen som skapas under blockblob- och sidblobresurser representerar en container till vilken data laddas upp som blobar. Du kan inte kopiera filer direkt till rotmappen i lagringskontot.

    • Om du importerar skiftlägeskänsliga katalog- och filnamn från en NFS-resurs till en NFS-resurs på Data Box Heavy:

      • Ärendet bevaras i namnet.
      • Filerna är skiftlägesokänsliga.

      Om du till exempel kopierar SampleFile.txt och Samplefile.Txtbevarar ärendet i namnet när det kopieras till enheten, men den andra filen skriver över den första eftersom dessa betraktas som samma fil.

    Om du använder en Linux-värddator använder du ett kopieringsverktyg som liknar Robocopy. Några av alternativen som är tillgängliga i Linux är rsync, FreeFileSync, Unison eller Ultracopier.

    Kommandot cp är ett av de bästa alternativen för att kopiera en katalog. Mer information om användningen finns på cp man-sidor.

    Om du använder rsync-alternativet för en kopia med flera trådar följer du dessa riktlinjer:

    • Installera CIFS Utils - eller NFS Utils-paketet beroende på vilket filsystem din Linux-klient använder.

      sudo apt-get install cifs-utils

      sudo apt-get install nfs-utils

    • Installera Rsync och Parallel (varierar beroende på den Linux-distribuerade versionen).

      sudo apt-get install rsync

      sudo apt-get install parallel

    • Skapa en monteringspunkt.

      sudo mkdir /mnt/databoxheavy

    • Montera lagringsvolymen.

      sudo mount -t NFS4 //Databox-heavy-IP-Address/share_name /mnt/databoxheavy

    • Spegla mappens katalogstruktur.

      rsync -za --include='*/' --exclude='*' /local_path/ /mnt/databoxheavy

    • Kopiera filer.

      cd /local_path/; find -L . -type f | parallel -j X rsync -za {} /mnt/databoxheavy/{}

      där j anger antalet parallelliseringar, X = antal parallella kopior

      Vi rekommenderar att du börjar med 16 parallella kopior och ökar antalet trådar beroende på vilka resurser som är tillgängliga.

    Viktigt

    Följande Linux-filtyper stöds inte: symboliska länkar, teckenfiler, blockfiler, sockets och pipes. Dessa filtyper resulterar i fel under steget Förbered för att skicka .

    Öppna målmappen för att visa och verifiera de kopierade filerna. Om du har några fel under kopieringsprocessen laddar du ned felfilerna för felsökning. Mer information finns i Visa felloggar under datakopiering till Data Box Heavy. En detaljerad lista över fel under datakopiering finns i Felsöka problem med Data Box Heavy.

    För att säkerställa dataintegriteten beräknas kontrollsumman direkt medan data kopieras. När kopieringen är klar kontrollerar du det använda utrymmet och det lediga utrymmet på enheten.

    Kontrollera ledigt och använt utrymme på instrumentpanelen

    Nästa steg

    I den här självstudien om Azure Data Box Heavy har du bland annat lärt dig att:

    • Prerequisites
    • Anslut till Data Box Heavy
    • Kopiera data till Data Box Heavy

    Gå vidare till nästa självstudie och lär dig hur du skickar tillbaka din Data Box-enhet till Microsoft.