Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
Le hub d’opérations de l’agent SRE vous offre une visibilité en temps réel sur la façon dont votre agent SRE Azure s’exécute sur les incidents, les automatisations, les intégrations et l’intégrité opérationnelle dans un seul endroit. Au lieu de vérifier les threads individuels, les pages de configuration et les automatisations séparément, vous voyez les signaux unifiés qui importent : intégrité de l’agent, actions en attente, préparation du connecteur et fiabilité de l’automatisation.
Tip
Points clés :
- Consultez l’analytique des incidents, l’intégrité de l’automatisation et les métriques quotidiennes dans un tableau de bord, sans basculer entre les pages.
- Trois onglets : Vue d’ensemble (métriques et intégrité du système), Analyse des incidents (heures enregistrées, taux de résolution, atténuation du délai d’atténuation), Automatisation (tâche et indicateurs de performance clés du déclencheur).
- Sélectionnez n’importe quelle carte d’indicateur de performance clé pour explorer les graphiques détaillés et les répartitions.
- Disponible pour tous les agents. Apparaît automatiquement dans la barre latérale.
Qu’est-ce que l’Operations Hub ?
Operations Hub consolide l’intelligence opérationnelle sur votre agent SRE dans trois tableaux de bord ciblés. Sans vue centrale, les équipes régénèrent l’état de l’agent manuellement en ouvrant des threads d’incident individuels, en vérifiant les automatisations une par une et en examinant les intégrations entre des pages distinctes. Cette approche manuelle devient inmanageable à mesure que votre environnement augmente. Operations Hub déplace votre équipe de l’investigation réactive vers la gestion proactive en exposant les indicateurs de début des problèmes avant qu’elles n’affectent la réponse aux incidents.
Fonctionnement du tableau de bord Operations Hub
Operations Hub combine la surveillance en trois onglets accessibles à partir de la barre latérale. Sélectionnez Operations Hub dans la barre latérale gauche pour ouvrir le tableau de bord.
Onglet Vue d’ensemble
Question: Qu’est-ce qui a besoin de mon attention pour l’instant ?
La vue par défaut affiche l’état opérationnel de votre agent en un clin d’œil :
| Rubrique | Ce qu’il montre |
|---|---|
| Barre d’état | État de la connexion à la source de données, connecteurs configurés et connecteurs nécessitant une attention. Sélectionnez Terminer l’installation pour configurer directement les sources manquantes. |
| Graphique des métriques | Volume quotidien par source, consommation quotidienne de flux actif (AAU) ou appels d’outils personnalisés quotidiens. Sélectionnez-le dans la liste déroulante. |
| Actions en attente | Nombre de threads de conversation en attente de votre entrée, notamment les approbations, les questions, les entrées d’incident et les exécutions de commandes en attente. |
| Intégrité du système | État du processus de l’agent actif et état de santé du connecteur. |
Utilisez le sélecteur d’intervalle de temps en haut pour ajuster la période de rapport (valeur par défaut : 7 derniers jours). Sélectionnez Actualiser pour charger les données les plus récentes.
Onglet Analyse des incidents
Question: L’agent aide-t-il réellement pendant les incidents ?
L’analytique des incidents mesure l’efficacité, pas seulement l’activité. Tableau de bord d’analytique interactive avec quatre cartes KPI :
| Carte | Ce qu’il montre |
|---|---|
| Temps d’ingénierie estimé économisé | Nombre total d’heures économisées par votre agent, avec une ventilation quotidienne détaillée |
| Taux de résolution pris en charge par l’agent | Pourcentage d’incidents résolus, avec répartition des résultats : agent atténué, atténué par l’homme (agent assisté), atténuation humaine (aucun agent) et en cours |
| Temps médian d’atténuation | Comparaison P50, temps de résolution de l’agent et temps de résolution humaine |
| Score d’évaluation IntentMet | Évaluation de la qualité (1 à 5 échelle avec visualisation en étoile) en fonction de la façon dont l’agent a résolu efficacement les incidents |
Sélectionnez n’importe quelle carte d’indicateur de performance clé pour développer une vue d’exploration vers le bas avec des graphiques détaillés. Sous les cartes KPI, le graphique Volume et Résultats des incidents affiche les tendances des incidents au fil du temps.
Onglet Automatisation
Question: Mes workflows récurrents et pilotés par les événements sont-ils sains et fiables ?
Tableau de bord pour la surveillance des tâches planifiées et des déclencheurs HTTP :
| Carte | Ce qu’il montre |
|---|---|
| Total Automations | Nombre d’automatisations actives, fractionnées par tâches planifiées et déclencheurs |
| Nombre total d’exécutions | Nombre d’exécutions avec comparaison de tendances à la période précédente |
| Taux de réussite | Pourcentage d’exécutions réussies avec nombre de réussites/échecs |
| Durée moyenne de l’exécution | Temps d’exécution moyen avec médiane et 95e percentile |
Sous les cartes KPI, la section Vue d’ensemble d’Automation répertorie chaque automatisation avec son type (tâche planifiée ou déclencheur HTTP), la planification, le mode d’autonomie, le nombre d’exécutions et le taux de réussite. Dépliez une carte pour voir un résumé des exécutions récentes généré par l’IA.
Utilisez la zone de recherche et le filtre Type pour rechercher des automatisations spécifiques.
Comment Operations Hub améliore la gestion proactive
Operations Hub déplace votre équipe de l’investigation réactive vers la gestion proactive. Au lieu de découvrir les problèmes après avoir ouvert un fil ou examiné des flux de travail en échec, vous voyez rapidement des signaux avant-coureurs :
- Accumulation d’actions en attente : actions en attente d’approbation ou d’intervention de l’utilisateur.
- Dégradation du connecteur : l’intégrité de l’intégration diminue au fil du temps.
- Changements de tendance d’activité : décalages dans les modèles d’utilisation de l’agent.
- Déclin de fiabilité de l’automatisation : augmentation des taux d’échec ou durée d’exécution.
- Changements d’efficacité des incidents : les modifications suggèrent une réduction de l’impact sur la réponse aux incidents.
Cette visibilité proactive génère une confiance dans votre agent SRE. Vous pouvez vous appuyer plus en toute confiance sur l’agent lorsque vous pouvez surveiller son comportement en un clin d’œil, au lieu de seulement après des problèmes.
Quand utiliser Operations Hub
Utilisez Operations Hub lorsque vous devez :
Surveiller l’intégrité globale de l’agent : obtenez une vue système plutôt que de vérifier les composants individuels.
Suivez la contribution à la réponse aux incidents : mesurez si l’agent améliore vos résultats de gestion des incidents.
Gérer la fiabilité de l’automatisation : identifiez les modèles dans les performances d’automatisation avant qu’ils ne provoquent des pannes.
Établir des bases de référence opérationnelles : comprendre le comportement normal pour repérer les anomalies au début.
Avant et après l’utilisation d’Operations Hub
| Avant | Après | |
|---|---|---|
| Vérification de l’intégrité de l’agent | Visitez plusieurs pages : Surveiller, Paramètres, tâches individuelles | Ouvrir Operations Hub : un tableau de bord, trois onglets |
| Analyse des incidents | Accédez à des vues distinctes des métriques, effectuez manuellement des recoupements | Onglet Analyse des incidents avec des cartes d’indicateurs clés de performance et des graphiques d’exploration détaillée |
| Supervision de l’automatisation | Sélectionner chaque tâche planifiée individuellement | L’onglet Automatisation affiche toutes les automatisations avec des indicateurs d’état |
| Consommation d’AAU | Accédez à Paramètres > Consommation de l’agent | Le graphique des métriques de l’onglet Vue d’ensemble comprend des données AAU |
| Approbations en attente | Analyser les threads de conversation pour les éléments en attente d’entrée | Nombre d’actions en attente visible sous l’onglet Vue d’ensemble |
Limitations
Operations Hub affiche les données des 30 derniers jours par défaut. L’accès aux données historiques au-delà de cette période nécessite des requêtes d’archivage.
L’analytique Automation prend actuellement en charge les exécutions déclenchées à partir de l’interface utilisateur Operations Hub. Les déclencheurs webhook et programmatiques affichent une visibilité limitée dans les premières versions.