Operations Hub i Azure SRE-agent

SRE Agent Operations Hub ger dig insyn i realtid om hur din Azure SRE-agent presterar mellan incidenter, automatiseringar, integreringar och drifthälsa på ett och samma ställe. I stället för att kontrollera enskilda trådar, konfigurationssidor och automatiseringar separat ser du de enhetliga signaler som är viktiga: agenthälsa, väntande åtgärder, anslutningsberedskap och automatiseringstillförlitlighet.

Tip

Viktiga punkter:

  • Se incidentanalys, automationshälsa och dagliga mått på en instrumentpanel, ingen växling mellan sidor.
  • Tre flikar: Översikt (mått och systemhälsa), Incidentanalys (sparade timmar, lösningsfrekvenser, tidsåtgång), Automation (aktivitets- och utlösar-KPI:er).
  • Välj ett valfritt KPI-kort för att gå ned till detaljerade diagram och uppdelningar.
  • Tillgänglig för alla agenter. Visas automatiskt i sidopanelen.

Vad är Operations Hub?

Operations Hub konsoliderar driftsinformation om din SRE-agent till tre fokuserade instrumentpaneler. Utan en central vy återskapar team agenttillståndet manuellt genom att öppna enskilda incidenttrådar, kontrollera automatiseringar en i taget och granska integreringar på separata sidor. Den här manuella metoden blir ohanterlig när din miljö växer. Operations Hub flyttar ditt team från reaktiv undersökning till proaktiv hantering genom att visa ledande indikatorer på problem innan de påverkar incidenthantering.

Så här fungerar Instrumentpanelen för Operations Hub

Operations Hub kombinerar övervakning i tre flikar som är tillgängliga från sidopanelen. Välj Operations Hub i det vänstra sidofältet för att öppna instrumentpanelen.

Skärmbild av fliken Översikt för Operations Hub som visar statusfältet, måttdiagrammet och väntande åtgärder och avsnitten SystemHälsa.

Fliken Översikt

Fråga: Vad behöver min uppmärksamhet just nu?

Standardvyn visar agentens driftstatus snabbt:

Avsnitt Vad det visar
Statusfältet Hälsa för datakällans anslutning, vilka anslutningar som är konfigurerade och vilka som behöver åtgärdas. Välj Slutför konfigurationen för att konfigurera saknade källor direkt.
Diagram över mätvärden Dagliga volymer efter källa, daglig aktiv flödesförbrukning (AAU) eller dagliga anpassade verktygsanrop. Välj i listrutan.
Väntande åtgärder Antal konversationstrådar som väntar på dina indata, inklusive godkännanden, frågor, incidentindata och väntande kommandokörningar.
Systemhälsa Liveagentens processstatus och anslutningens hälsa.

Använd väljaren Tidsintervall högst upp för att justera rapporteringsperioden (standard: de senaste 7 dagarna). Välj Uppdatera för att läsa in de senaste data.

Fliken Analys av incidenter

Fråga: Hjälper agenten verkligen vid incidenter?

Incidentanalys mäter effektivitet, inte bara aktivitet. En instrumentpanel för interaktiv analys med fyra KPI-kort:

Kort Vad det visar
Beräknad teknisk tid sparad Det totala antalet timmar som din agent har sparat in, med möjlighet att visa en daglig uppdelning
Lösningsfrekvens som stöds av agent Andel incidenter som har lösts, uppdelat efter utfall: åtgärdade av agent, åtgärdade av människa (med hjälp av agent), åtgärdade av människa (utan agent) och pågående
Mediantid för att minimera P50-jämförelse, agentmatchningstid jämfört med mänsklig lösningstid
IntentMet-utvärderingspoäng Kvalitetsklassificering (1–5 skala med stjärnvisualisering) baserat på hur effektivt agenten löste incidenter

Skärmbild av fliken Incidentanalys som visar fyra KPI-kort för sparad tid, matchningshastighet, mediantid för att minimera och IntentMet-poäng.

Välj ett KPI-kort för att expandera en visning av detaljnivån med detaljerade diagram. Under KPI-korten visas diagrammet Incidentvolym och utfall, som visar incidenttrender över tid.

Fliken Automatisering

Fråga: Är mina återkommande och händelsedrivna arbetsflöden felfria och tillförlitliga?

En instrumentpanel för övervakning av schemalagda uppgifter och HTTP-utlösare:

Kort Vad det visar
Totalt antal automatiseringar Antal aktiva automatiseringar, uppdelade efter schemalagda uppgifter och utlösare
Totalt antal körningar Körningsantal med trendjämförelse jämfört med föregående period
Framgångsgrad Procentandel lyckade körningar med antal lyckade/misslyckade körningar
Genomsnittlig körningsvaraktighet Medel exekveringstid med median och P95-percentil

Skärmbild av fliken Automation som visar fyra KPI-kort och automationsöversiktslistan med enskilda automatiseringsposter.

Under KPI-korten visar avsnittet Översikt över Automation varje automatisering med sin typ (schemalagd aktivitet eller HTTP-utlösare), schema, autonomiläge, antal körningar och lyckad hastighet. Expandera valfritt kort för att se en AI-genererad sammanfattning av de senaste körningarna.

Använd sökrutan och typfiltret för att hitta specifika automatiseringar.

Så här förbättrar Operations Hub proaktiv hantering

Operations Hub flyttar ditt team från reaktiv undersökning till proaktiv hantering. I stället för att identifiera problem när du har öppnat en tråd eller granskat misslyckade arbetsflöden ser du inledande indikatorer tidigt:

  • Ackumulering av väntande åtgärder: Åtgärder som väntar på godkännande eller inmatning från användaren.
  • Försämring av anslutningen: Integrationens hälsa försämras över tid.
  • Aktivitetstrenden ändras: Skiftar i agentanvändningsmönster.
  • Minskning av automatiseringstillförlitlighet: Öka felfrekvensen eller körningens varaktighet.
  • Incidenteffektivitetsförskjutningar: Ändringar som tyder på minskad incidenthanteringspåverkan.

Den här proaktiva synligheten skapar förtroende för din SRE-agent. Du kan lita mer säkert på agenten när du kan övervaka dess beteende snabbt, i stället för bara när problem uppstår.

När du ska använda Operations Hub

Använd Operations Hub när du behöver:

  • Övervaka övergripande agenthälsa: Hämta en systemvy i stället för att kontrollera enskilda komponenter.

  • Spåra bidrag till incidenthanteringen: Mät om agenten förbättrar dina utfall vid incidenter.

  • Hantera automatiseringstillförlitlighet: Identifiera mönster i automatiseringsprestanda innan de orsakar avbrott.

  • Upprätta driftbaslinjer: Förstå normalt beteende för att upptäcka avvikelser tidigt.

Före och efter användning av Operations Hub

före Efter
Kontrollera agenthälsa Besök flera sidor: Övervaka, Inställningar, enskilda uppgifter Öppna Operations Hub: en instrumentpanel, tre flikar
Incidentanalys Gå till separata mätvärdesvyer, jämför manuellt Fliken Incidentanalys med KPI-kort och diagram med ökad detaljnivå
Automatiseringsövervakning Välj varje schemalagd aktivitet individuellt Fliken Automation visar alla automatiseringar med hälsoindikatorer
AAU-förbrukning Gå till Inställningar > Agentförbrukning Översiktsflikens måttdiagram innehåller AAU-data
Väntande godkännanden Sök igenom chatttrådar efter objekt som väntar på indata Väntande åtgärder visas på fliken Översikt

Limitations

  • Operations Hub visar data för de senaste 30 dagarna som standard. Åtkomst till historiska data utöver den här perioden kräver arkiveringsfrågor.

  • Automation Analytics stöder för närvarande körningar som utlöses från Operations Hubs gränssnitt. Webhook- och programmatiska utlösare visar begränsad synlighet i tidiga versioner.