Nota
O acesso a esta página requer autorização. Pode tentar iniciar sessão ou alterar os diretórios.
O acesso a esta página requer autorização. Pode tentar alterar os diretórios.
Uma plataforma de incidentes é o sistema que informa o seu agente quando algo corre mal. Se ligar a sua plataforma de incidentes ao seu agente, este pode receber alertas, investigar problemas e agir automaticamente. Não tens de esperar que alguém comece uma conversa.
Sem uma plataforma de incidentes, o seu agente é reativo: os utilizadores fazem perguntas e investiga a pedido. Com uma plataforma de incidentes conectada, o seu agente torna-se proativo: detém os incidentes no momento em que ocorrem.
Plataformas suportadas
| Plataforma | O que oferece |
|---|---|
| Azure Monitor | Pode ligar-se através do assistente e os alertas dos grupos de recursos geridos são recebidos automaticamente. O Azure Monitor junta alertas recorrentes num único tópico. Não precisas de apresentar quaisquer credenciais. |
| PagerDuty | Alerta para incidentes e oferece gestão de chamadas com integração baseada em API. |
| ServiceNow | Integra-se com a gestão de serviços de TI empresarial. |
Apenas uma plataforma de incidente pode estar ativa de cada vez. Mudar para outra plataforma desliga a atual.
O que a conexão de uma plataforma de incidentes permite
Depois de ligar uma plataforma de incidentes ao seu agente, este adquire várias funcionalidades, incluindo receção automática de incidentes e interação com incidentes. As secções seguintes fornecem mais detalhes sobre estas capacidades.
Receção automática de incidentes
Os incidentes chegam ao seu agente no momento em que são criados na sua plataforma. Ninguém precisa de copiar e colar alertas, nem iniciar uma investigação manualmente. O agente apanha os incidentes automaticamente.
Cartões de incidente detalhados
Incidentes recebidos de todas as plataformas suportadas, incluindo PagerDuty, ServiceNow e Azure Monitor, são exibidos na interface de chat como rich cards. Cada cartão mostra:
| Campo | Detalhes |
|---|---|
| Distintivo de severidade | Codificado por cores por prioridade (por exemplo, P1/Sev0 = vermelho, P2/Sev1 = laranja) |
| Marca temporal | Quando o incidente aconteceu |
| Title | Título do incidente com prefixo de plataforma |
| Situação | Estado atual (por exemplo, "Desencadeado" ou "Confirmado") |
| Description | Resumo do incidente |
| Plano de resposta | Ligação ao plano de resposta que trata do incidente (se configurado) |
| Ver detalhes | Ligação ao incidente na sua plataforma de origem |
Os cartões enriquecidos substituem as notificações de incidentes em texto simples usadas anteriormente, facilitando a visualização dos detalhes do incidente num instante.
Interação incidente
O seu agente pode ler e responder ao incidente. Estas ferramentas estão disponíveis automaticamente quando se liga à plataforma correspondente.
| Plataforma | Capacidades de leitura | Capacidades de escrita |
|---|---|---|
| Azure Monitor | Detalhes do alerta, gravidade, recursos afetados | Confirmar alertas, fechar alertas |
| PagerDuty | Detalhes do incidente, diagnósticos | Reconhecer, decidir, acrescentar notas |
| ServiceNow | Detalhes do incidente | Publicar entradas de discussão, reconhecer, resolver |
Planos de resposta
Os planos de resposta definem o que o seu agente faz quando surgem tipos específicos de incidentes. Configura regras com base na gravidade do incidente, padrões de título ou outros critérios, e o agente segue automaticamente o plano. Para saber mais, consulte Planos de resposta a incidentes.
Um plano de resposta pode:
Executa passos específicos de investigação.
Use conectores e ferramentas específicas.
Operar a um nível de autonomia definido (desde "apenas recolher informações" até "tomar medidas corretivas").
Repetir automaticamente a análise (até um limite configurável), antes de encaminhar para intervenção humana.
Os planos de resposta transformam o seu agente de um assistente de uso geral num respondedor de incidentes, com procedimentos definidos para tipos de incidentes conhecidos.
Plano de resposta rápida
Importante
Quando se liga pela primeira vez a uma plataforma de incidentes, é criado automaticamente um plano de resposta rápida predefinido. Se criares os teus próprios planos de resposta, o plano de início rápido corre em paralelo com eles e pode fazer com que os incidentes sejam encaminhados para o agente alfandegário errado ou processados duas vezes. Para evitar conflitos, vá a Builder>Planos de resposta a incidentes, mude para a Vista de tabela e elimine o plano de arranque rápido.
Quando liga uma plataforma de incidentes, pode ativar esta funcionalidade para criar automaticamente um plano de resposta predefinido. Este plano permite-lhe começar imediatamente:
| Plataforma | Elementos padrão de planos | Nível de autonomia |
|---|---|---|
| Azure Monitor | Alertas Sev0, Sev1, Sev2 | Autônomo |
| PagerDuty | Incidentes P1 | Autônomo |
O Azure Monitor suporta todos os níveis de gravidade (Sev0–Sev4). O plano de início rápido visa por defeito os alertas de maior prioridade. Pode personalizar esta funcionalidade para incluir outras gravidades ou criar planos separados para alertas de menor prioridade.
O plano de início rápido cria um plano de resposta chamado quickstart_handler assim:
- Corresponde os incidentes por prioridade ou gravidade.
- Abrange todos os serviços afetados.
- Funciona em modo totalmente autónomo.
- Pode ser personalizada ou desligada mais tarde.
Pode personalizar este plano padrão ou criar outros planos de resposta com diferentes filtros e níveis de autonomia.
Acompanhar o valor dos incidentes
Pode acompanhar o valor dos incidentes para aprender como o seu agente lida com os incidentes ao longo do tempo. Na interface de utilizador do Azure SRE Agent, vê esta informação acedendo a Monitor>métricas de incidentes. Para obter mais informações, veja Acompanhar o valor do incidente.
| Métrico | O que mostra |
|---|---|
| Incidentes analisados | Incidentes totais que o agente processa. |
| Mitigado pelo agente | Incidentes que o agente resolve de forma autónoma. |
| Assistido por um agente | Incidentes em que o agente ajuda e o utilizador conclui a resolução. |
| Mitigado pelo utilizador | Incidentes que o utilizador resolve com informações fornecidas pelo agente. |
| Ação do utilizador pendente | Incidentes à espera de intervenção humana. |
Use estas métricas para compreender a eficácia do seu agente e identificar planos de resposta que possa precisar de ajustar.
Plataformas incidentes vs. conectores
As plataformas de incidentes e os conectores funcionam em conjunto. O seu agente utiliza ambos os elementos: a plataforma de gestão de incidentes aciona a investigação, e os conectores fornecem as ferramentas para investigar.
| Comparison | Plataformas de gestão de incidentes | Conectores |
|---|---|---|
| Purpose | De onde vêm os alertas | Dados e ações que o agente pode usar |
| Configurado em | Builder → plataforma de incidentes | Construtor → conectores |
| Direction | Fluxo de entrada (os incidentes convergem para o agente) | Saída (o agente contacta os sistemas) |
| Exemplo | O PagerDuty envia um alerta → o agente investigar | O agente questiona Kusto → encontra a causa raiz |
Conteúdo relacionado
- Tutorial: Defina planos de resposta: Guia passo a passo para criar o seu plano de resposta inicial.
- Planos de resposta a incidentes: Como os planos de resposta encaminham incidentes para agentes alfandegários.
- Automatizar a resposta a incidentes: Capacidades de automação de incidentes de ponta a ponta.
- Acompanhe o valor do incidente: Meça o impacto da resolução de incidentes pelo seu agente.
- Monitorizar a utilização dos agentes: Acompanhar a utilização, insights da sessão e atividade dos agentes.
- PagerDuty: Configuração e capacidades específicas do PagerDuty.
- ServiceNow: Configuração e capacidades específicas do ServiceNow.
- Azure Monitor Alerts: alertas Azure Monitor, fusão de alertas recorrentes e mapeamento de gravidade.
- Conectores: Como os conectores fornecem ferramentas para investigação.