Observação
O acesso a essa página exige autorização. Você pode tentar entrar ou alterar diretórios.
O acesso a essa página exige autorização. Você pode tentar alterar os diretórios.
O Hub de Operações do Agente SRE fornece visibilidade em tempo real de como seu agente SRE Azure se comporta em incidentes, automações, integrações e integridade operacional em um só lugar. Em vez de verificar threads individuais, páginas de configuração e automações separadamente, você vê os sinais unificados que importam: integridade do agente, ações pendentes, prontidão do conector e confiabilidade da automação.
Dica
Pontos principais:
- Consulte análise de incidentes, integridade da automação e métricas diárias em um painel, sem alternância entre páginas.
- Três guias: Visão geral (métricas e integridade do sistema), Análise de Incidentes (horas salvas , taxas de resolução, tempo de mitigação), Automação (KPIs de tarefa e gatilho).
- Selecione qualquer cartão de KPI para explorar gráficos detalhados e discriminações.
- Disponível para todos os agentes. Aparece automaticamente na barra lateral.
O que é o Hub de Operações?
O Operations Hub consolida a inteligência operacional sobre o agente SRE em três painéis focados. Sem uma exibição central, as equipes recompilam o estado do agente manualmente abrindo threads de incidente individuais, verificando automações um a um e revisando integrações entre páginas separadas. Essa abordagem manual torna-se incontrolável à medida que seu ambiente cresce. O Operations Hub move sua equipe da investigação reativa para o gerenciamento proativo, apresentando os principais indicadores de problemas antes que eles afetem a resposta a incidentes.
Como funciona o painel do Hub de Operações
O Operations Hub combina o monitoramento em três guias acessíveis a partir da barra lateral. Selecione o Hub de Operações na barra lateral esquerda para abrir o painel.
Aba Visão geral
Pergunta: O que precisa da minha atenção agora?
A exibição padrão mostra o status operacional do agente rapidamente:
| Seção | O que ele mostra |
|---|---|
| Barra de estado | Integridade da conexão da fonte de dados, quais conectores estão configurados e que precisam de atenção. Selecione Concluir configuração para configurar fontes ausentes diretamente. |
| Gráfico de métricas | Volume diário por origem, AAU (consumo de fluxo ativo diário) ou chamadas de ferramenta personalizada diárias. Selecione na lista suspensa. |
| Ações pendentes | Contagem de tópicos de conversa aguardando sua ação, incluindo aprovações, perguntas, intervenções em incidentes e execuções de comandos pendentes. |
| Saúde do sistema | Status do processo do agente humano e da integridade do conector. |
Use o seletor de intervalo de tempo na parte superior para ajustar o período de relatório (padrão: últimos 7 dias). Selecione Atualizar para carregar os dados mais recentes.
Aba Análise de incidentes
Pergunta: O agente está realmente ajudando durante incidentes?
A análise de incidentes mede a eficácia, não apenas a atividade. Um painel de análise interativa com quatro cartões KPI:
| Cartão | O que ele mostra |
|---|---|
| Tempo estimado de engenharia economizado | Total de horas que seu agente economizou, com detalhamento diário |
| Taxa de resolução assistida por agente | Percentual de incidentes resolvidos, com detalhamento de resultados: agente atenuado, atenuado por humanos (agente assistido), atenuado por humanos (sem agente) e em andamento |
| Tempo médio para atenuar | Comparação P50, tempo de resolução do agente versus tempo de resolução humana |
| Pontuação de avaliação de IntentMet | Classificação de qualidade (escala de 1 a 5 com visualização de estrela) com base na eficiência com que o agente resolveu incidentes |
Selecione qualquer cartão KPI para expandir uma exibição detalhada com gráficos detalhados. Abaixo dos cartões KPI, o gráfico Volume e Resultados de Incidentes mostra tendências de incidentes ao longo do tempo.
Aba de Automação
Pergunta: Meus fluxos de trabalho recorrentes e controlados por eventos são saudáveis e confiáveis?
Um painel para monitorar tarefas agendadas e gatilhos HTTP:
| Cartão | O que ele mostra |
|---|---|
| Total de Automações | Contagem de automações ativas, divididas por tarefas agendadas e gatilhos |
| Total de Execuções | Contagem de execuções com comparação de tendência com o período anterior |
| Taxa de sucesso | Porcentagem de execuções bem-sucedidas com contagens de sucesso/falha |
| Duração da execução do Avg | Tempo médio de execução com mediana e percentil P95 |
Abaixo dos cartões KPI, a seção Visão Geral da Automação lista cada automação com seu tipo (Tarefa Agendada ou Gatilho HTTP), agendamento, modo de autonomia, contagem de execuções e taxa de êxito. Expanda qualquer cartão para ver um resumo gerado por IA de execuções recentes.
Use a caixa de pesquisa e o filtro Tipo para localizar automações específicas.
Como o Operations Hub melhora o gerenciamento proativo
O Hub de Operações desloca sua equipe de investigação reativa para gerenciamento proativo. Em vez de descobrir problemas depois de abrir um thread ou examinar fluxos de trabalho com falha, você verá indicadores principais mais cedo:
- Acúmulo de ações pendentes: ações aguardando aprovação ou interação do usuário.
- Degradação do conector: integridade da integração em declínio ao longo do tempo.
- Alterações de tendência de atividade: mudanças nos padrões de uso do agente.
- Diminuição da confiabilidade da automação: aumentando as taxas de falha ou a duração da execução.
- Mudanças de eficácia de incidentes: alterações que sugerem redução do impacto na resposta a incidentes.
Essa visibilidade proativa cria confiança em seu Agente SRE. Você pode confiar com mais confiança no agente quando puder monitorar seu comportamento rapidamente, em vez de apenas depois que ocorrerem problemas.
Quando usar o Operations Hub
Use o Operations Hub quando precisar:
Monitore a integridade geral do agente: obtenha uma exibição do sistema em vez de verificar componentes individuais.
Monitore a contribuição para a resposta a incidentes: meça se o agente melhora os resultados dos seus incidentes.
Gerenciar a confiabilidade da automação: identifique padrões no desempenho da automação antes que eles causem interrupções.
Estabelecer linhas de base operacionais: entenda o comportamento normal para detectar anomalias antecipadamente.
Antes e depois de usar o Operations Hub
| Antes | Depois | |
|---|---|---|
| Verificando a integridade do agente | Visite várias páginas: Monitorar, Configurações, tarefas individuais | Abrir o hub de operações: um painel, três guias |
| Análise de incidentes | Vá para visualizações separadas de métricas, faça a referência cruzada manualmente | Guia Análise de Incidentes com cartões KPI e gráficos detalhados |
| Monitoramento de automação | Selecionar cada tarefa agendada individualmente | A aba Automação exibe todas as automações com indicadores de saúde |
| Consumo de AAU | Ir para Configurações > Consumo do agente | O gráfico de métricas da guia Visão geral inclui dados do AAU |
| Aprovações pendentes | Verifique tópicos de chat em busca de itens aguardando resposta | Contagem de ações pendentes visíveis na guia Visão geral |
Limitações
O Hub de Operações exibe dados dos últimos 30 dias por padrão. O acesso a dados históricos além desse período requer consultas de arquivamento.
Atualmente, as análises de automação oferecem suporte a execuções iniciadas pela interface do usuário do Operations Hub. Webhook e gatilhos programáticos têm visibilidade limitada nas versões iniciais.