Automatyzacja przepływu pracy w agencie SRE Azure

Operacyjne przepływy pracy obejmują wiele narzędzi i wymagają, aby ktoś zapamiętał, co będzie dalej. Stan można sprawdzić w jednym systemie, podjąć decyzję, wykonać w innym i powiadomić zespół w trzeciej. Każde przekazanie zwiększa opóźnienie i ryzyko.

Wskazówka

Automatyzacja przepływu pracy ułatwia:

  • Obsługa incydentów od początku do końca bez budzenia nikogo
  • Automatyczne uruchamianie zaplanowanych zadań z nadzorem człowieka w razie potrzeby
  • Spójne stosowanie wiedzy z poprzednich zdarzeń za każdym razem

Jak działa automatyzacja przepływu pracy

Co osiągniesz:

  • Zautomatyzowane przepływy pracy uruchamiane zgodnie z harmonogramem lub w odpowiedzi na zdarzenia
  • Agenci niestandardowi z określonymi narzędziami do wyspecjalizowanych zadań
  • Kompleksowe przepływy: wyzwalanie → badanie działania → → powiadamianie

Gdy wyzwalacz zostanie wyzwolony (zaplanowany czas lub zdarzenie), agent:

  1. Odbiera wyzwalacz. Zaplanowane zadanie jest uruchamiane lub zdarzenie pasuje do planu reagowania.
  2. Wywołuje agenta niestandardowego. Skonfigurowany agent niestandardowy rozpoczyna działanie, używając swoich narzędzi i instrukcji.
  3. Uruchamia przepływ pracy. Agent celny prowadzi dochodzenie, podejmuje działania i w razie potrzeby koordynuje działania z innymi agentami celnymi.
  4. Powiadamia zespół. Wyniki są publikowane w usłudze Teams, wiadomości e-mail lub na platformie incydentów.

Każdy agent dostosowany ma dostęp do określonych narzędzi (z łączników) i postępuje zgodnie z instrukcjami, działając autonomicznie lub za zgodą, w zależności od trybu pracy.

Co sprawia, że różni się to

W przeciwieństwie do skryptów agent dostosowuje się, gdy wzorce się zmieniają. Skrypty są przerywane, gdy dane wejściowe różnią się. Agent podejmuje decyzje o tym, co zrobić, na podstawie swoich ustaleń.

W przeciwieństwie do Runbook agent faktycznie wykonuje przepływ pracy, zamiast go tylko dokumentować. Runbooki informują ludzi, co należy zrobić. Twój agent to robi.

W przeciwieństwie do automatyzacji w stylu IFTTT agent bada przed działaniem. Nie jest ona wykonywana ślepo, gdy wyzwalacz jest uruchamiany. Zamiast tego ocenia sytuację i decyduje o odpowiedniej reakcji.

Przed i po

przed po
Sprawdzanie stanu w narzędziu do monitorowania Agent wykonuje zapytania automatycznie
Decydowanie o tym, co należy zrobić na podstawie danych Przyczyny agenta i proponowanie akcji
Wykonaj poprawkę w innym systemie Agent wykonuje swoje zadania przez połączone narzędzia.
Powiadamianie zespołu w usłudze Slack/Teams Agent wysyła powiadomienie kontekstowe
Rejestrowanie, co się stało Agent rejestruje akcje w wątku

Tworzenie przepływu pracy

Przepływy pracy łączą trzy bloki konstrukcyjne:

Blok konstrukcyjny Do czego służy Gdzie skonfigurować
Łączniki Udostępnianie narzędzi z systemów zewnętrznych (Outlook, Teams, GitHub, PagerDuty) Łączniki konstruktora >
Agenci niestandardowi Wyspecjalizowani pracownicy z określonymi ustawieniami dostępu do narzędzi i autonomii Kanwa agenta konstruktora >
Wyzwalacze Uruchamianie przepływów pracy zgodnie z harmonogramem lub w odpowiedzi na zdarzenia Zaplanowane zadania/plany reagowania na zdarzenia

Aby uzyskać instrukcje krok po kroku, zobacz Krok 5: Automatyzowanie przepływów pracy w przewodniku wprowadzającym.

Przykład: codzienny raport kondycji z pocztą e-mail

Ten przepływ pracy sprawdza kondycję zasobów platformy Azure i wysyła wiadomość e-mail z podsumowaniem.

  1. Łącznik: Dodaj Wyślij wiadomość e-mail (Office 365 Outlook)
  2. Agent niestandardowy: tworzenie health-reporter za pomocą SendOutlookEmail narzędzia
  3. Zaplanowane zadanie: Dołącz do agenta niestandardowego z monitem:
Check the health of Azure resources in prod-rg:
1. Query Azure Resource Health for any degraded resources
2. Check Application Insights for error rate trends
3. Summarize findings
4. Email the report using SendOutlookEmail

Agent codziennie uruchamia, bada i wysyła wiadomość e-mail, nie wymagając żadnych ręcznych działań.

Delegowanie agenta niestandardowego

Jeśli przepływ pracy wymaga innej wiedzy w różnych krokach, użyj wielu agentów niestandardowych:

Krok Agent dedykowany Dlaczego
Diagnostyka bazy danych @DatabaseExpert Wyspecjalizowane zapytania KQL
Wysyłanie powiadomień @Notifier Narzędzia poczty e-mail i aplikacji Teams
Tworzenie zdarzeń @IncidentCreator PagerDuty/Integracja z usługą ServiceNow

Koordynator przypisuje zadania do dostosowanych agentów zgodnie z potrzebami. Zobacz Agenci niestandardowi.

Najlepsze rozwiązania

Practice Dlaczego ma to znaczenie
Najpierw przetestuj na placu zabaw Przed dołączeniem do wyzwalacza sprawdź zachowanie niestandardowego agenta
Uruchom w trybie przeglądu Weryfikowanie wyroku agenta przed pełną automatyzacją
Testowanie za pomocą polecenia "Uruchom zadanie teraz" Weryfikowanie zaplanowanych przepływów pracy przed produkcją
Jedno narzędzie na każdego agenta niestandardowego Łatwiejsze przeprowadzanie inspekcji, debugowania i aktualizowania
Używanie nazw opisowych email-health-report Vs custom-agent-1

Przed dołączeniem zaplanowanego zadania przetestuj agenta niestandardowego:

  1. Przejdź do Builder → Agent Canvas
  2. Wybierz widok testowego placu zabaw
  3. Wybierz agenta niestandardowego z listy rozwijanej i wybierz pozycję Zastosuj
  4. Wpisz planowane instrukcje na panelu Test i sprawdź, czy agent wykonuje je poprawnie

Gdy masz pewność co do zachowania, przymocuj wyzwalacz.

Wprowadzenie

Resource Czego się nauczysz
Krok 5. Automatyzowanie przepływów pracy Tworzenie zautomatyzowanej kontroli kondycji przy użyciu powiadomień e-mail
Tworzenie zaplanowanego zadania Samouczek krok po kroku dotyczący zaplanowanych automatyzacji
Zdolność Co dodaje
Zaplanowane zadania Proaktywne monitorowanie i cykliczne wzorce zadań
Wdrożenie środków łagodzących Możliwe działania w przepływach pracy
Wysyłanie powiadomień Wzorce powiadomień i kanały
Reagowanie na zdarzenia Wyzwalacze dla planu reakcji
Agenci niestandardowi Szczegółowa konfiguracja agenta niestandardowego
Łączniki Dostępne integracje narzędzi