Notatka
Dostęp do tej strony wymaga autoryzacji. Może spróbować zalogować się lub zmienić katalogi.
Dostęp do tej strony wymaga autoryzacji. Możesz spróbować zmienić katalogi.
Azure Elastic SAN to natywna dla chmury usługa sieci magazynowania (SAN), która zapewnia skalowalne, ekonomiczne, wysokiej wydajności i kompleksowe rozwiązanie magazynu dla wielu opcji obliczeniowych. Elastyczna sieć SAN umożliwia tworzenie woluminów i zarządzanie nimi, które są dyskami wirtualnymi, które można łączyć z maszynami wirtualnymi, kontenerami lub innymi usługami Azure za pośrednictwem protokołu iSCSI.
W przypadku korzystania z platformy Azure niezawodność jest wspólną odpowiedzialnością. Microsoft oferuje szereg funkcjonalności wspierających odporność i odzyskiwanie. Odpowiadasz za zrozumienie, jak te możliwości działają w ramach wszystkich używanych usług oraz za wybór tych, które są potrzebne do osiągnięcia Twoich celów biznesowych i celów dotyczących niezawodności.
W tym artykule opisano, jak zapewnić odporność Azure Elastic SAN na różne potencjalne awarie i problemy, w tym błędy przejściowe, awarie strefy dostępności i awarie całego regionu. Opisuje również opcje tworzenia kopii zapasowych i odzyskiwania oraz wyróżnia kluczowe informacje o umowie dotyczącej poziomu usług (SLA) Azure Elastic SAN.
Zalecenia dotyczące wdrażania produkcyjnego pod kątem niezawodności
Skorzystaj z poniższych zaleceń dotyczących obciążeń produkcyjnych:
- Użyj magazynu strefowo nadmiarowego (ZRS): Magazyn ZRS rozkłada kopie danych w trzech strefach dostępności.
- Skonfiguruj dostęp do sieci, aby zmniejszyć ręczną interwencję podczas awarii strefy: Prywatne punkty końcowe umożliwiają automatyczne przełączanie strefy w tryb failover bez ręcznej interwencji, podczas gdy punkty końcowe usługi mogą wymagać interwencji ręcznej.
- W przypadku obciążeń wymagających odzyskiwania po awarii między regionami: Regularnie twórz migawki woluminów i eksportuj je do migawek dysków zarządzanych na potrzeby ochrony danych. Skopiuj kopie migawkowe do regionu dodatkowego, który jest geograficznie oddalony od regionu podstawowego.
Omówienie architektury niezawodności
Elastyczna sieć SAN ma hierarchię zasobów trzech poziomów:
- Elastyczna sieć SAN: zasób najwyższego poziomu, w którym konfigurowana jest nadmiarowość, przydzielanie pojemności magazynu i ustawianie limitów wydajności. Liczba jednostek bazowych przydzielonych do elastycznej sieci SAN określa całkowitą liczbę operacji wejścia/wyjścia na sekundę i przepustowość dostępną w całej elastycznej sieci SAN.
- Grupy woluminów: konstrukcje zarządzania używane do zarządzania woluminami na dużą skalę. Ustawienia dostępu do sieci, takie jak prywatne punkty końcowe lub punkty końcowe usługi, są konfigurowane na poziomie grupy woluminów i dziedziczone przez wszystkie woluminy w grupie.
- Woluminy: Woluminy przechowywania wydzielone z całkowitej pojemności sieci SAN. Woluminy są połączone z zasobami obliczeniowymi za pośrednictwem protokołu iSCSI.
Aby uzyskać więcej informacji na temat wdrażanych zasobów, zobacz Elastic SAN resources (Elastyczne zasoby sieci SAN).
Wewnętrznie elastyczna sieć SAN przechowuje dane w klastrach magazynu. Podczas konfigurowania elastycznej sieci SAN do korzystania z magazynu lokalnie nadmiarowego (LRS) dane są replikowane trzy razy w jednym klastrze magazynu w jednym centrum danych. Magazyn strefowo nadmiarowy (ZRS) można skonfigurować do przechowywania kopii danych w trzech strefach dostępności. Aby uzyskać więcej informacji, zobacz Odporność na błędy strefy dostępności.
Odporność na błędy przejściowe
Błędy przejściowe to krótkotrwałe, sporadyczne awarie w komponentach. Występują one często w środowisku rozproszonym, takich jak chmura, i są one normalną częścią operacji. Błędy przejściowe naprawiają się po krótkim czasie. Ważne jest, aby aplikacje mogły obsługiwać błędy przejściowe, zwykle ponawiając próby żądań, których dotyczy problem.
Wszystkie aplikacje hostowane w chmurze powinny postępować zgodnie ze wskazówkami dotyczącymi obsługi błędów przejściowych platformy Azure podczas komunikowania się z dowolnymi interfejsami API hostowanymi w chmurze, bazami danych i innymi składnikami. Aby uzyskać więcej informacji, zobacz Zalecenia dotyczące obsługi błędów przejściowych.
Jeśli połączenie iSCSI z woluminem Elastic SAN zostanie przerwane, inicjator iSCSI na kliencie automatycznie spróbuje ponownie nawiązać połączenie. Podczas ponownego nawiązywania połączenia może wystąpić krótka pauza w operacjach we/wy. Skonfiguruj inicjator iSCSI przy użyciu odpowiednich ustawień ponownego próbowania i limitu czasu dla obsługi przejściowych przerw. Aby uzyskać szczegółowe zalecenia dotyczące ustawień iSCSI i MPIO, zobacz Optymalizowanie wydajności elastycznej sieci SAN.
Odporność na błędy strefy dostępności
Strefy dostępności są fizycznie oddzielnymi grupami centrów danych w regionie świadczenia usługi Azure. Gdy jedna strefa ulegnie awarii, usługi mogą przejść w tryb failover do jednej z pozostałych stref.
Azure Elastic SAN można skonfigurować do używania magazynu strefowo nadmiarowego (ZRS), co oznacza, że dane są replikowane synchronicznie w trzech strefach dostępności w regionie. Redundancja strefowa pomaga osiągnąć odporność i niezawodność prac obciążeń produkcyjnych.
Podejście do łączności wpływa na zdolność obciążenia do przełączania w tryb failover w sposób niewidoczny podczas awarii strefy. Użyj prywatnych punktów końcowych, aby nawiązać połączenie z woluminami. Prywatne punkty końcowe obsługują automatyczne przełączanie awaryjne. Jeśli używasz punktów końcowych usługi, tryb przełączania awaryjnego może wymagać manualnej interwencji. Aby uzyskać więcej informacji na temat podejść do łączności, zobacz Dowiedz się więcej o konfiguracjach sieci dla elastycznej sieci SAN.
Użycie magazynu lokalnie nadmiarowego (LRS) pozostawia elastyczną sieć SAN bez ochrony przed awariami strefy dostępności. Magazyn LRS sprawia, że elastyczna sieć SAN jest niezonowa , przechowując dane w pojedynczej strefie dostępności, a nie dystrybuując je między strefami przy użyciu magazynu ZRS.
Requirements
Obsługa regionów: Strefowo nadmiarowe elastyczne zasoby sieci SAN można wdrożyć w podzestawie regionów. Aby uzyskać listę regionów, zobacz Cele skalowania dla elastycznej sieci SAN.
Cost
Podczas tworzenia Elastycznego SAN z ZRS, koszt jest wyższy niż w przypadku LRS. Aby uzyskać więcej informacji na temat cen, zobacz Azure Elastic SAN cennik.
Konfiguruj obsługę stref dostępności
Utwórz nową elastyczną sieć SAN z opcją ZRS: Po utworzeniu elastycznej sieci SAN i wybraniu ZRS jako opcji nadmiarowości, elastyczna sieć SAN jest automatycznie strefowo nadmiarowy. Nie można zmienić opcji nadmiarowości po utworzeniu elastycznej sieci SAN. Aby uzyskać więcej informacji na temat tworzenia nowego elastycznego zasobu sieci SAN, zobacz Wdrażanie elastycznej sieci SAN.
Włącz nadmiarowość strefową w istniejącej elastycznej sieci SAN LRS: Nie można bezpośrednio przekonwertować elastycznej sieci SAN LRS na ZRS. Aby przeprowadzić migrację, utwórz migawkę woluminów elastycznej sieci SAN, wyeksportuj je do migawek dysków zarządzanych, wdróż nową elastyczną sieć SAN w usłudze ZRS, a następnie utwórz woluminy w nowej elastycznej sieci SAN przy użyciu tych migawek dysków. Aby uzyskać więcej informacji, zobacz Snapshot Azure Elastic SAN woluminów.
Zachowanie, gdy wszystkie strefy są w dobrej kondycji
W tej sekcji opisano, czego można oczekiwać podczas konfigurowania Elastycznego SAN pod kątem redundancji stref, podczas gdy wszystkie strefy są operacyjne.
Operacja między strefami: Podczas nawiązywania połączenia z woluminem Elastic SAN połączenie iSCSI kieruje się do klastra w jednej ze stref dostępności. Platforma automatycznie kieruje ruch między strefami.
Replikacja danych między strefami: Gdy klient zapisuje dane w woluminie elastic SAN, dane są zapisywane synchronicznie w klastrach w trzech strefach dostępności przed potwierdzeniem operacji zapisu. Replikacja synchroniczna zapewnia wysoki poziom spójności danych i zapewnia brak utraty danych podczas awarii strefy.
Wdrażanie sieci SAN typu ZRS Elastic zapewnia większą niezawodność niż sieć SAN typu LRS Elastic, ale wiąże się z większym opóźnieniem zapisu. Przeprowadź test porównawczy Elastic SAN i symuluj obciążenie aplikacji, aby porównać opóźnienia między LRS a ZRS i sprawdzić, czy wpływa to na obciążenie.
Zachowanie podczas awarii strefy
W tej sekcji opisano, czego można oczekiwać podczas konfigurowania elastycznej sieci SAN pod kątem nadmiarowości stref i awarii w jednej ze stref.
Wykrywanie i reagowanie: Elastyczna platforma SAN wykrywa błędy w strefie dostępności. Nie musisz nic robić, aby zainicjować przełączenie awaryjne w ZRS Elastic SANs.
Powiadomienie: Firma Microsoft nie powiadamia cię automatycznie, gdy strefa nie działa. Można jednak użyć Azure Service Health aby zrozumieć ogólną kondycję usługi, w tym wszelkie błędy strefy, i skonfigurować alerty Service Health w celu powiadamiania o problemach.
Aktywne żądania: Gdy strefa dostępności stanie się niedostępna, usługa może zakończyć operacje we/wy będące w toku, które łączą się z replikami w dotkniętej strefie, i należy ponowić te operacje. Jeśli używasz prywatnych punktów końcowych, usługa automatycznie przejmie tryb failover. Jeśli używasz punktów końcowych usługi, może być konieczne ponowne uruchomienie inicjatora iSCSI, aby przełączyć się do zdrowej strefy.
Oczekiwana utrata danych: Elastyczna sieć SAN zapobiega utracie danych podczas awarii strefy przez synchronicznie replikowanie danych w trzech strefach dostępności.
Oczekiwany przestój: W przypadku korzystania z prywatnych punktów końcowych tryb failover strefy odbywa się automatycznie. Możesz doświadczyć pogorszenia dostępności i wydajności przez kilka minut po przełączeniu na tryb failover, gdy sieć SAN się zbalansuje.
W przypadku korzystania z punktów końcowych usługi elastyczna sieć SAN nie przełącza się automatycznie do strefy w dobrej kondycji. Może być konieczne ponowne uruchomienie inicjatora iSCSI, aby zainicjować przejście w tryb failover do innej strefy w dobrej kondycji.
Przekierowywanie ruchu: Gdy strefa jest niedostępna, platforma Elastic SAN wykrywa utratę strefy i kieruje ruch do pozostałych stref w dobrej kondycji.
Aby zapewnić automatyczne przełączenie strefy na tryb zapasowy bez ręcznej interwencji, użyj prywatnych punktów końcowych, aby nawiązać połączenie z Elastic SAN. W przypadku korzystania z punktów końcowych usługi zamiast prywatnych punktów końcowych może być konieczne ręczne ponowne uruchomienie inicjatora iSCSI w celu zainicjowania przejścia w tryb failover do strefy w dobrej kondycji.
Odzyskiwanie strefy
Po odzyskaniu strefy dostępności platforma Elastic SAN automatycznie przywraca normalne operacje i wznawia replikację w trzech strefach. Nie musisz podejmować żadnych działań.
Testowanie pod kątem niepowodzeń strefy
Platforma Azure Elastic SAN zarządza routingiem ruchu, trybem failover i odzyskiwaniem strefy dla zasobów strefowo nadmiarowych. Ponieważ ta funkcja jest w pełni zarządzana, nie trzeba weryfikować procesów awarii strefy dostępności.
Odporność na awarie całego regionu
Azure Elastic SAN jest usługą jednoregionową. Jeśli region stanie się niedostępny, zasób elastycznej sieci SAN jest również niedostępny. Nie ma wbudowanej replikacji między regionami ani trybu failover dla elastycznej sieci SAN. Odpowiadasz za tworzenie architektury własnego rozwiązania do odzyskiwania po awarii w wielu regionach, jeśli obciążenie wymaga odporności na poziomie regionu.
Niestandardowe rozwiązania wieloregionowe zapewniające odporność
Odpowiadasz za wdrożenie odzyskiwania po awarii w wielu regionach dla danych w usłudze Elastic SAN. Zalecaną metodą jest użycie migawek woluminów:
Regularnie twórz migawki. Użyj migawek woluminów do przechwytywania punktowych kopii woluminów Elastycznej SAN.
Cel punktu odzyskiwania (RPO) zależy od tego, jak często tworzysz i kopiujesz migawki do regionu zapasowego. Im częściej tworzysz migawki i kopiujesz je, tym mniejsza będzie potencjalna utrata danych podczas awarii.
Eksportowanie migawek do migawek dysku zarządzanego.Wyeksportuj migawki woluminu do migawek dysku zarządzanego, które można skopiować do innych regionów.
Kopiowanie migawek do regionu pomocniczego.Skopiuj migawkę przyrostową do nowego regionu , który jest geograficznie odległy od regionu podstawowego. Zmniejsza to ryzyko wystąpienia awarii w wielu regionach.
Przywracanie z migawek. W scenariuszu odzyskiwania po awarii utwórz nowe woluminy na pomocniczym Elastic SAN z kopiowanych migawek zarządzanych dysków.
Cel czasu odzyskiwania (RTO) zależy od rozmiaru danych, czasu potrzebnego do skopiowania migawek między regionami oraz czasu potrzebnego do wdrożenia i skonfigurowania nowej elastycznej sieci SAN w regionie pomocniczym. Aby skrócić czas odzyskiwania, rozważ wdrożenie pomocniczej elastycznej sieci SAN w regionie odzyskiwania przed wystąpieniem awarii. Pomaga to również uniknąć ograniczeń pojemności podczas przestoju.
Tworzenie kopii zapasowej i przywracanie
W przypadku większości rozwiązań nie należy polegać wyłącznie na kopiach zapasowych. Zamiast tego skorzystaj z innych możliwości opisanych w tym przewodniku, aby spełnić wymagania dotyczące odporności. Jednak kopie zapasowe chronią przed pewnymi zagrożeniami, których nie zapewniają inne podejścia. Aby uzyskać więcej informacji, zobacz Co to jest nadmiarowość, replikacja i kopia zapasowa?.
Elastyczna sieć SAN obsługuje dwa typy kopii zapasowych:
Azure Elastic SAN backup: Ta funkcja Azure Backup oferuje w pełni zarządzane rozwiązanie do planowania kopii zapasowych, ustawiania osi czasu wygaśnięcia punktów odzyskiwania i odzyskiwania danych na nowy wolumin. Pomaga chronić przed utratą danych przed przypadkowymi usunięciami, oprogramowaniem wymuszającym okup i aktualizacjami aplikacji. Aby uzyskać więcej informacji, zobacz Azure Elastic SAN backup (wersja zapoznawcza).
Ważna
Ponieważ to rozwiązanie jest objęte dodatkowymi warunkami firmy Microsoft dotyczącymi wersji zapoznawczych platformy Azure, użyj go do testowania, a nie do użytku produkcyjnego.
Migawki: Alternatywnie, można tworzyć i zarządzać migawkami w oparciu o wymagania dotyczące ochrony danych.
Azure Elastic SAN obsługuje migawki woluminów na potrzeby ochrony danych. Migawki są przyrostowymi, punktowymi kopiami woluminów, które zużywają miejsce z całkowitej pojemności Elastic SAN. Aby chronić dane, należy regularnie tworzyć migawki. Częstotliwość zależy od tego, ile danych można sobie pozwolić na utratę (cel punktu odzyskiwania). Migawki można utworzyć ręcznie lub zbudować własną automatyzację, aby wykonywać je według harmonogramu.
Migawki są przechowywane w tej samej elastycznej sieci SAN co woluminy i używają tego samego ustawienia nadmiarowości. Aby chronić przed awariami obejmującymi cały region, wyeksportuj migawki do migawek dysków zarządzanych i skopiuj je do innego regionu. Aby uzyskać więcej szczegółów, zobacz Eksportowanie migawki woluminu i Kopiowanie migawki przyrostowej do nowego regionu.
Możesz utworzyć nowy wolumin Elastic SAN na podstawie migawki lub migawki z dysku zarządzanego. Aby uzyskać więcej informacji, zobacz Tworzenie woluminu na podstawie migawki.
Odporność usługi na prace konserwacyjne
Firma Microsoft regularnie stosuje aktualizacje usług i wykonuje inną konserwację. Platforma Azure automatycznie obsługuje te działania, zapewniając bezproblemową i przejrzystą konserwację. Podczas zdarzeń konserwacji nie przewiduje się przestoju, chyba że poinformowano Cię o zaplanowanej konserwacji Azure Service Health.
Umowa dotycząca poziomu usług
Umowa dotycząca poziomu usług (SLA) dla usług platformy Azure opisuje oczekiwaną dostępność każdej usługi oraz warunki, które rozwiązanie musi spełnić, aby osiągnąć te oczekiwania dotyczące dostępności. Aby uzyskać więcej informacji, zobacz Umowy SLA dotyczące usług online.