Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
Under incidenter hittar du ofta kontext utspridd över larm, instrumentpaneler, ärenden och arkiv. Azure SRE Agent ansluter till dina Azure-resurser, observabilitetsverktyg, incidentplattformar och källkodsarkiv så att du kan undersöka problem med mer operativ kontext på ett och samma ställe. Använd det för att samla signaler, jämföra aktuella problem med tidigare undersökningar och köra styrd automation inom konfigurerade behörigheter, körlägen och policyer.
Detta kan du göra
Azure SRE Agent hjälper ditt team att utreda incidenter och agera snabbare. Den samlar in kontext, identifierar sannolika orsaker och föreslår eller, när den konfigureras, utför åtgärder för att mildra dem.
Till exempel, under en minnesrelaterad incident kan SRE-agenten:
- Upptäck minnestrender: Sök applikationsinsikter för att identifiera en minnestrend som började 40 minuter före varningen
- Korrelera distributioner: Koppla trenden till en GitHub-repository-distributionshändelse två timmar tidigare
- Föreslå åtgärder: Identifiera den specifika commit och föreslå att starta om den drabbade podden eller justera minnesskalningströskeln (horisontell pod-autoscaler, eller HPA)
- Förifyll incidentärenden: Skapa ett ServiceNow-, PagerDuty- eller ärende i incidentkanalen med hela utredningssammanfattningen ifylld i förväg
Dessa konfigurerade arbetsflöden meddelar rätt personer medan SRE-agenten arbetar med ett föreslaget åtgärdsförslag. I granskningsläge granskar en SRE-agentadministratör sammanfattningen med bifogad runbook-kontext och godkänner åtgärder som kräver godkännande. Utredningen håller sig i en tråd, vilket minskar verktygsbytet. Om agenten automatiskt applicerar en åtgärd eller väntar på godkännande beror på ditt konfigurerade körläge.
Detta mönster gäller över konfigurerade Azure-tjänster och integrationer, inklusive beräkning, lagring, nätverk, data samt relaterade övervaknings- och hanteringstjänster. Utöka det med tillåtna Azure CLI-operationer genom färdigheter, godkända runbooks eller anpassade agenter. Använd agentkrokar för att lägga till kontrollpunkter för styrning som kan tillåta eller blockera handlingar.
Agentens arbete följer tre mönster:
Automatisera incidenter: Vid beredskap frågar agenten dina övervakningsverktyg, korrelerar signaler mellan system, identifierar sannolik grundorsak och föreslår åtgärder.
Automatisera schemalagda arbetsflöden: Schemalägg proaktiva hälsokontroller, efterlevnadskontroller och rutinmässiga operativa uppgifter. Resultat visas i din anslutna incidentplattform eller meddelandekanal.
Undersök och ge råd: Ställ frågor på naturligt språk om din miljö, som "vad har förändrats under den senaste timmen?" eller "varför är denna tjänst nedsatt?", och få jordnära svar med källhänvisningar.
Så här fungerar det
SRE Agent kombinerar Azure-specifik produktkunskap med anpassning som du kontrollerar. Som standard kan den fråga och agera på Azure-resurser inom tilldelade behörigheter, med inbyggt beteende för vanliga operativa uppgifter.
Agenten arbetar via fem förlängningspunkter som du kan anpassa:
Kunskaper: Diskreta funktioner, inklusive Marketplace-runbooks och Azure CLI skript, som utökar agentens operativa räckvidd utan att kräva anpassad kod.
Anpassade agenter: Specialbyggda agenter för specifika operativa domäner. Flera specialiserade agenter levereras färdiga att använda, och du kan bygga din egen i agentbyggaren. Se Anpassade agenter.
Python verktyg: Anpassad logik, datatransformeringar och API-integreringar för scenarier som kräver kod i stället för konfiguration.
MCP-servrar: Anslut till förkonfigurerade partnerkopplingar för observabilitetsplattformar som Datadog, Splunk, New Relic, Dynatrace och Elasticsearch, eller koppla vilket specialverktyg som helst via Model Context Protocol-standarden. Se MCP-kontakter och verktyg.
Agentkrokar: Händelseutlösta automationer som körs vid definierade punkter i agentens livscykel, till exempel efter att ett verktyg körts eller när agenten stannar. Använd krokar för att framtvinga principer, generera telemetri eller integrera med externa arbetsflöden för godkännande. Se Agent hooks.
Varje föreslaget verktygsanrop passerar styrningskontroller innan det körs, så ditt team definierar gränserna även för helt automatiserade arbetsflöden. Mer information finns i Säkerhet och styrning.
Integrations
Azure SRE Agent kopplas till de verktyg som ditt team redan använder:
Övervakning och observerbarhet:
- Azure Monitor (mått, loggar, aviseringar, arbetsböcker)
- Programinsikter
- Log Analytics
Incidenthantering:
- Azure Monitor-aviseringar
- PagerDuty
- ServiceNow
Källkontroll och CI/CD:
- GitHub (lagringsplatser, problem)
- Azure DevOps (lagringsplatser, arbetsobjekt)
Datakällor:
- Azure Data Explorer-kluster (Kusto)
- MCP-servrar (Model Context Protocol)
Kommunikation och meddelanden:
- Microsoft Teams
- Outlook
Beroende på din konfiguration erbjuder Azure SRE Agent även hanterade kopplingar, ett separat kopplingssystem som kan koppla din agent till SaaS-tjänster som Google Drive, SharePoint, Notion och Confluence.
Säkerhet och styrning
Säkerhets- och plattformsteam kan tillämpa lager-på-lager-kontroller över nätverk, identitet, auktorisation och organisatorisk styrning:
Nätverksisolering: VNet-integration leder agentens arbetsyttrafik genom ditt virtuella nätverk. Reglerna för din nätverkssäkerhetsgrupp (NSG) gäller medan din privata DNS löser förfrågningar. När du konfigurerar nätverksrouting, DNS och behörigheter korrekt kan du nå privata endpoints, interna API:er och låsta resurser som vilken annan resurs som helst i ditt virtuella nätverk (VNet).
Identitet och RBAC: Agenten autentiserar med hanterad identitet och arbetar under Azure rollbaserad åtkomstkontroll (RBAC). För källkod låter GitHub Enterprise-support agenten autentisera sig som en styrd tjänsteidentitet via en Bring Your Own GitHub App-modell.
Åtkomstkontroll på verktygsnivå: Ställ in varje verktyg som agenten använder för att tillåta, be om eller neka. Administratörer sätter upp globala skyddsräcken, teamledare anpassar varje anpassad agent och användare godkänner verktyg i sin konversation. De tillgängliga alternativen, standardinställningarna och prioritetsordningen beror på tillämpningsområdet och den gällande policyn. För detaljer, se verktygsåtkomstpolicys.
Infrastruktur som kod: Distribuera agenten, dess nätverkskonfiguration, dess identitet och dess verktygspolicys via Bicep-mallar (Azure:s infrastructure-as-code-språk) och Azure CLI via samma CI/CD-pipelines som du använder för alla andra Azure-resurser.
Reglerad kompetensdistribution: Plattformsteam kan publicera godkända färdigheter i ett privat GitHub-arkiv genom att använda Private Plugins Marketplace. Agenter i hela klienten installerar godkända kompetenser från samma styrda katalog.
Återanvänd operativt kontext
Azure SRE Agent behåller kontext från tidigare undersökningar och använder bakgrundsinsiktsgenerering och sessionsinsikter för att känna igen återkommande mönster eller relaterad kontext. Behållen kontext kan inkludera grundorsaker, upplösningssteg, preferenser och operativa mönster. Att återanvända det kan minska behovet av upprepad inhämtning av kontext, minska beroendet av odokumenterad personberoende kunskap och ge ingenjörer i beredskap mer enhetlig initial information.
Tip
Exempel från teamet: En ny ingenjör börjar gå jour. Agenten känner redan till distributionsmönster, tidigare incidenter och teamrutiner, så de börjar med mer kontext från dag ett.
Soloexempel: Du åker på semester. Agentens dokumenterade operativa sammanhang är tillgängligt för den som tar över, så att personen inte behöver börja från början.
| Scenen | Vad händer |
|---|---|
| Inledande konfiguration | Koppla ihop dina verktyg och använd inbyggd Azure-kunskap under en utredning. |
| Efter upprepade undersökningar | Behållen kontext kan inkludera miljötopologi, återkommande felmönster och eskaleringspreferenser. |
| När delad kontext byggs upp | Teammedlemmar kan återanvända tidigare grundorsaker och lösningssteg med mindre beroende av odokumenterad individuell kunskap. |
Get started
Välj den väg som passar ditt mål: schemalägg en uppgift, hantera en incident eller bygg en anpassad agent.
Använd schemalagda uppgifter för att automatisera rutinmässigt driftarbete (hälsokontroller, rensning och efterlevnadssvepning) utan att skriva infrastrukturkod.
Välj fliken Schemalägg aktiviteter .
Ange uppgiftsdetaljer.
Definiera schemat för att köra aktiviteten.
Skapa anpassade agentinstruktioner för uppgiften.
Välj Skapa schemalagd aktivitet.
Du ser resultat från din schemalagda uppgift i din anslutna incidentplattform eller notifikationskanal.
Relaterat innehåll
Använd dessa resurser för att planera driftsättning, styrning, fakturering och teamintroduktion:
| Resource | Det här hittar du |
|---|---|
| Priser och fakturering | Användningsbaserad prissättning mätt i Azure Agent Units (AAU), plus kapacitetsplanering |
| Säkerhetsöversikt | Datahantering, integritet och exekveringsisolering |
| Skapa och konfigurera | Distribuera en agent och ge den tillgång till utvalda Azure-resurser. |
| Teamuppsättning och roller samt användarroller och behörigheter | Hur roller styr vem som kan chatta, godkänna och administrera agenten, samt hur man lär agenten om ditt team, dina tjänster och rutiner |