Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
Azure Data Lake Storage använder ett hierarkiskt namnområde för att ge filsystemprestanda i objektlagringsskala och pris. Den här funktionen organiserar samlingen av objekt och filer i ett konto i en hierarki med kataloger och kapslade underkataloger, ungefär som filsystemet på datorn. När du aktiverar ett hierarkiskt namnområde kan ett lagringskonto erbjuda skalbarhet och kostnadseffektivitet för objektlagring, tillsammans med filsystemssemantik som analysmotorer och ramverk tycker är bekanta.
Fördelarna med ett hierarkiskt namnområde
Filsystem som implementerar ett hierarkiskt namnområde över blobdata har följande fördelar:
Atomisk katalogmanipulering: Objektet lagrar ungefärlig en kataloghierarki genom att anta en konvention om inbäddning av snedstreck (/) i objektnamnet för att ange sökvägssegment. Den här konventionen fungerar för att organisera objekt, men den ger ingen hjälp för åtgärder som att flytta, byta namn på eller ta bort kataloger. Utan verkliga kataloger måste program bearbeta potentiellt miljontals enskilda blobar för att uppnå uppgifter på katalognivå. Däremot hanterar ett hierarkiskt namnområde dessa uppgifter genom att uppdatera en enda post (den överordnade katalogen).
Den här optimeringen är särskilt viktig för många ramverk för stordataanalys. Verktyg som Hive och Spark skriver ofta utdata till tillfälliga platser och byter sedan namn på platsen när jobbet avslutas. Utan ett hierarkiskt namnområde kan den här namnbytesåtgärden ofta ta längre tid än själva analysprocessen. Kortare svarstid för jobb är lika med lägre total ägandekostnad (TCO) för analysarbetsbelastningar.
Välbekant gränssnittsformat: Både utvecklare och användare förstår filsystem. När du flyttar till molnet behöver du inte lära dig något nytt lagringsparadigm eftersom Data Lake Storage exponerar samma filsystemgränssnitt som används av datorer, stora som små.
En av anledningarna till att objektlagring historiskt sett inte stöder en hierarkisk namnrymd är att en hierarkisk namnrymd begränsar skalbarheten. Men Data Lake Storage hierarkiska namnområdet skalas linjärt och försämrar inte datakapaciteten eller prestandan.
Bestäm om du vill aktivera ett hierarkiskt namnområde
När du har aktiverat ett hierarkiskt namnområde för ditt konto kan du inte återställa det till ett platt namnområde. Därför bör du överväga om det är lämpligt att aktivera ett hierarkiskt namnområde baserat på typen av objektlagringsarbetsbelastningar. Information om hur du aktiverar ett hierarkiskt namnområde för arbetsbelastningar, program, kostnader, tjänstintegreringar, verktyg, funktioner och dokumentation finns i Uppgradera Azure Blob Storage med Azure Data Lake Storage-funktioner.
Vissa arbetsbelastningar kanske inte får någon fördel genom att aktivera ett hierarkiskt namnområde. Exempel är säkerhetskopior, avbildningslagring och andra program där objektorganisationen lagras separat från själva objekten (till exempel i en separat databas).
Även om stödet för Blob Storage-funktioner och Azure tjänstekosystem fortsätter att växa, stöds inte vissa funktioner och Azure tjänster ännu i konton som har ett hierarkiskt namnområde. Se Kända problem.
Arbetsbelastningar som drar nytta av ett hierarkiskt namnområde
I allmänhet aktiverar du ett hierarkiskt namnområde för lagringsarbetsbelastningar som är utformade för filsystem som manipulerar kataloger. Det här villkoret omfattar alla arbetsbelastningar för analysbearbetning. Datauppsättningar som kräver en hög grad av organisation har också nytta av att aktivera ett hierarkiskt namnområde.
Använd en TCO-analys för att avgöra om ett hierarkiskt namnområde ska aktiveras. Generellt sett kräver förbättringar av svarstiden för arbetsbelastningar på grund av lagringsacceleration beräkningsresurser under kortare tid. Svarstiden för många arbetsbelastningar kan förbättras på grund av atomisk katalogmanipulering som ett hierarkiskt namnområde aktiverar. I många arbetsbelastningar representerar beräkningsresursen mer än 85% av den totala kostnaden, så även en blygsam minskning av arbetsbelastningsfördröjningen motsvarar en betydande mängd TCO-besparingar. Även om aktiveringen av ett hierarkiskt namnområde ökar lagringskostnaderna sänks TCO fortfarande på grund av minskade beräkningskostnader.
Information om hur du analyserar skillnader i datalagringspriser, transaktionspriser och prissättning för lagringskapacitetsreservationer mellan konton som har ett platt namnområde jämfört med ett hierarkiskt namnområde finns i Azure Data Lake Storage prissättning.
Information om hur du aktiverar ett hierarkiskt namnområde finns i Skapa ett lagringskonto som ska användas med Azure Data Lake Storage (nya konton) eller Uppgradera Azure Blob Storage med Azure Data Lake Storage funktioner (befintliga konton).
Nästa steg
- Aktivera ett hierarkiskt namnområde när du skapar ett nytt lagringskonto. Se Skapa ett lagringskonto som ska användas med Azure Data Lake Storage.
- Aktivera ett hierarkiskt namnområde på ett befintligt lagringskonto. Se Uppgradera Azure Blob Storage med Azure Data Lake Storage-funktioner.