Definiera en Zone Down-övning i Infrastructure Resiliency Manager (förhandsversion)

Den här artikeln beskriver hur du definierar ett test för zonbortfall (förhandsversion) i Infrastructure Resiliency Manager. Den här funktionen simulerar ett fel i tillgänglighetszonen och validerar programmets återhämtning. Den omfattar även konfigurering av Chaos-arbetsytor, hantering av identiteter, utformning av fel och verifiering av servicegruppens beredskap för zonfel.

Förutsättningar

Innan du definierar ett detaljtest i zonen nedåt kontrollerar du att du granskar följande förutsättningar:

  • Kontrollera att din befintliga tjänstgrupp har de resurser som krävs.
  • Konfigurera behörigheter för Azure rollbaserad åtkomstkontroll (RBAC). Se supportmatrisen.
  • Konfigurera en återställningsplan för din tjänstgrupp.
  • Registrera Microsoft.Chaos, Microsoft.Insights, Microsoft.OperationalInsights och Microsoft.Automation resursproviderns namnområden i prenumerationen där Chaos Workspace skapas.

Registrera resursproviderns namnområden

Med resursproviderns namnrymder kan du aktivera design, genomförande och övervakning av övningar samt skapandet av den övervakningskonfiguration som krävs.

Följ dessa steg för att registrera ett namnområde för resursprovidern:

  1. I portalen Azure går du till Prenumerationer och väljer den prenumeration där du vill registrera resursprovidrar.
  2. I fönstret Prenumerationer väljer du Inställningar>Resursprovidrar.
  3. I fönstret Resource providers söker du i resursproviderns namnområde (till exempel Microsoft. Chaos), välj det i listan och välj Register.

Registreringen slutförs cirka 15–20 minuter.

Skapa en definition av en simulering av avbrott i en tillgänglighetszon

Med drilldefinitionen kan du ange parametrar för en Zone Down-drill och förbereda den för körning. Du kan konfigurera inkluderade resurser, utforma fel för resurser som stöds och bekräfta beredskapen före körningen.

Om du vill definiera ett visningstest för nedimulering av tillgänglighetszoner följer du dessa steg:

  1. I Azure-portalen går du till Tjänstgrupper och väljer den tjänstgrupp som du vill definiera detaljnivån för.

  2. I rutan valda tjänstgruppen väljer du Resiliency>Drills.

    Skärmbild som visar hur du påbörjar skapandet av en drill-instans.

  3. I panelen Drills väljer du + Skapa drill.

  4. På panelen Skapa Availability Zone Down Drill, på fliken Grundläggande, anger du ett namn för övningsinstansen. Välj Subscription och Region för att associera med Chaos Workspace och Log Analytics Workspace.

    Prenumerationen eller regionen för Availability Zone Down-drillövningen kan skilja sig från prenumerationen eller regionen för tjänstegruppen.

  5. På fliken Behörigheter väljer du Systemtilldelad identitet eller användartilldelad identitet som gör att du på ett säkert sätt kan hämta servicegruppsresurser, köra återställningsplaner och hantera mått.

    Du kan använda samma identitet för felinmatning eller välja en annan.

    Skärmbild som visar hur du tilldelar behörighet för drilldown-instansen.

  6. På fliken Granska + skapa granskar du konfigurationen och väljer Skapa för att bekräfta skapandet av drill-instansen.

Note

Du kan koppla varje tjänstgrupp till en drillinstans.

Granska och konfigurera resurser för drillfunktionen

Du kan granska behörigheter, kontrollera att resurser ingår, bedöma om mätvärdena är redo och inkludera nödvändiga resurser för att säkerställa att övningen genomförs korrekt.

Följ dessa steg om du vill granska och konfigurera resurser för övningen:

  1. I rutan valda tjänstgruppen väljer du Resiliency>Drills.

  2. I fönstret Borrningar väljer du den borrinstans som du skapade.

Granska status för tilldelning av drillroll

Om du vill granska status för drillrollstilldelning följer du dessa steg:

  1. I fönstret för den valda drillningsinstansen väljer du Inställningar>Identitet och behörigheter.

  2. I fönstret Identitet och behörigheter går du till Rolltilldelningsstatus och väljer Visa information.

  3. I fönstret Detaljgranska rolltilldelning granskar du listan över identiteter och deras motsvarande rolltilldelningsstatus.

Note

Om det finns fel i Drills status för rolltilldelning, utvärdera statusen igen genom att välja Utvärdera beredskapen för rolltilldelning.

Skärmbild som visar hur du kontrollerar om tilldelningen av drillrollen är klar.

Granska de resurser som ingår i övningen

Drilldown för Zone down gör att du kan granska de resurser som ingår i drilldownen. Borrningen utför följande åtgärder:

  • Innehåller resurser med en inbyggd lösning för zonåterhämtning som standard; dessa resurser kvalificerar sig för felinjektion.
  • Associerar en återställningsplan med tjänstgruppen för resurser som kräver manuell redundans (till exempel Virtual Machines med Azure Site Recovery).
  • Exkluderar resurser som saknar inbyggd zonindelad återhämtning, inte ingår i en återställningsplan eller som inte stöder zonindelad återhämtningsidentifiering för resurstypen.

Följ dessa steg för att inkludera resurser i övningen:

  1. I panelen för den valda drill-instansen väljer du Inställningar>Drill-omfattning.

    Skärmbild som visar hur man visar drillinformation.

  2. Välj Visa information under Resurser som undantas från detaljgranskning på fliken Återhämtningslösningar i fönstret Detaljnivåomfång.

  3. I fönstret Visa information och inkludera resurser lägger du till en exkluderad resurs, väljer resursen i listan och väljer Inkludera resurser.

Granska mätvärdena

Följ dessa steg för att granska mätvärdena för drillkörning:

  1. I panelen för den valda drill-instansen väljer du Inställningar>Övervakning.
  2. I rutan Övervakning granskar du listan över resurser och deras respektive status för mätvärdesberedskap för genomförande av drill-down.

Designfel för resurser som stöds och som inte stöds

Så här utformar du fel för resurser som stöds och som inte stöds i övningen:

  1. I panelen för den valda drill-instansen väljer du Inställningar>Drill-omfattning.

  2. I fönstret Drills scope, på fliken Fault designer, väljer du en resurs i listan och väljer Redigera fel för att granska eller ändra motsvarande feldesignstatus för resursen.

    Skärmbild som visar hur du redigerar felinformation.

  3. För felinformationskonfiguration av resurstyp som inte stöds definierar du anpassad fellogik med Azure Runbooks i fönstret Fault och väljer Spara.

    Om du använder anpassade fel via runbooks, ska du inkludera följande obligatoriska parametrar som ska skickas till runbooken:

    • ResourceIds
    • Duration
    • FaultLocation (zon för närvarande)
  4. För att slutföra rolltilldelningen går du till fliken Feldesigner , väljer en resurstyp i listan och väljer Inkludera och förbereder för felinmatning eller Undanta från felinmatning.

Alla resurser visas som standard i statusen Behöver uppmärksamhet . Om du vill felsöka beredskapsproblem väljer du Behöver uppmärksamhet som motsvarar varje resurs. Du kan ange felvaraktighet för tidskonfigurationen för felinmatning (standardtiden är 10 minuter).

Verifiera beredskap och åtgärda konfigurationsavvikelser

När felutformningen är klar granskar du beredskapen i alla sammanfattningswidgetar.

Följ dessa steg för att granska och åtgärda konfigurationsavvikelser:

  1. I rutan vald drill-instans väljer du Översikt>Synkronisera igen och kontrollera beredskap.

  2. Om statusen Körningsberedskap för drill visar Inte redo, markerar du statusen och granskar de fel som har flaggats.

  3. I fönstret Körberedskapsstatus för Drill-körning åtgärdar du felen som visas och kör sedan beredskapskontrollen igen. Statusen ändras till Klar.

Uppdatera drillinstansen efter varje redigering.

Nästa steg

Kör tillgänglighetszonen Nedåt i Infrastrukturåterhämtningshanteraren (förhandsversion).