Führen Sie Ihre erste Untersuchung mit dem Azure SRE-Agent aus

Geschätzte Zeit: 5 Minuten

Bitten Sie den Makler, ein Problem anhand des mit Ihrem Makler verbundenen Kontexts zu untersuchen.

Tipp

Neue Kunden können den SRE Agent bewerten, ohne die Always On-Gebühren für die ersten 30 Tage zu bezahlen. Weitere Informationen finden Sie unter SRE-Agent bewerten.

Was Sie erreichen

Nach Abschluss dieses Leitfadens:

  • Bitten Sie den Agent, ein Liveproblem im Chat zu untersuchen
  • Sieh zu, wie sie den Code, die Protokolle und Azure-Ressourcen nutzt, die ihm zur Verfügung stehen
  • Überprüfen Sie eine Diagnose, die auf den zugehörigen Quellen basiert

Voraussetzungen

Anforderung Einzelheiten
Abgeschlossene Schritte 1–2 Erstellen und einrichten und Team-Onboarding.
Empfohlener Kontext Verbinden Sie Code, Logs und Azure-Ressourcen für reichhaltigere Ergebnisse. Sie können auch mit einer teilweisen Konfiguration weiter Untersuchungen vornehmen.

Tipp

Man kann eine Untersuchung weiterhin ohne alle Datenquellen durchführen, aber die Ergebnisse sind mit Code und Telemetrie reichhaltiger. Optionaler Azure-Ressourcenzugriff kann Live-Ressourcenkontext hinzufügen. Informationen zum Abschließen des Setups finden Sie unter "Abschließen des Setups".

Starten der Untersuchung

Öffnen Sie einen neuen Chatthread, und beschreiben Sie das Problem, das der Agent untersuchen soll.

  1. Wähle Neuen Thread in der linken Seitenleiste.

  2. Beschreiben Sie das Problem, das Sie untersuchen möchten. Achten Sie darauf, welche Dienst- oder Ressourcengruppe betroffen ist. Beispiel:

    "Benutzer melden, dass das Feature "Zu Warenkorb hinzufügen" in unserer App beschädigt ist. Die Einkaufswagen-API gibt Fehler zurück. Können Sie die Container-Apps in der Ressourcengruppe untersuchen?"

  3. Wählen Sie "Senden" aus.

Screenshot der Chateingabe mit einer Untersuchungsanfrage, die eine fehlerhafte Einkaufswagen-API beschreibt.

Sehen Sie sich die Arbeit des Agenten an

Der Agent erstellt einen Untersuchungsplan und führt ihn schritt für Schritt aus. Sie können jede Phase in Echtzeit beobachten.

Phase 1: Lesekontext: Der Agent liest die Wissensdateien, die er während des Onboardings erstellt hat, einschließlich Architekturdokumenten, Teamkontext und Runbooks, um sich zu orientieren.

Phase 2: Code erkunden: Wenn Sie ein Code-Repository verbinden, liest der Agent relevante Quelldateien, sucht nach Codepfaden, die mit dem Problem zusammenhängen, und verfolgt die Anrufkette.

Screenshot des Agents, der Quellcodedateien liest und einen Speicherverlust in CartController.cs identifiziert.

Phase 3: Abfrage von Azure-Ressourcen: Wenn Sie Azure-Ressourcen und Logging-Anbieter verbinden, prüft der Agent den aktuellen Ressourcenzustand und die verfügbare Telemetrie.

Phase 4: Stellen Sie die Diagnose: Basierend auf den vorliegenden Beweisen kann der Makler folgende Details vorlegen:

  • Root Cause: Der spezifische Codefehler oder das Konfigurationsproblem mit Datei- und Zeilenangaben.
  • Beweise: Codeschnipsel, Protokolle und Ressourcendetails, die die Entdeckung stützen.
  • Empfohlene Lösung: Genau was zu ändern ist, mit einem Code diff, der Zeilen anzeigt, die entfernt oder geändert werden sollen.

Screenshot des Agents, der die Ursachenanalyse mit einem Codekorrektur- und Absturzprotokollnachweis präsentiert.

Kontrollpunkt: Die Antwort identifiziert die verwendeten Quellen und erklärt die Diagnose oder die nächste benötigte Datenquelle. Wenn Sie Code, Protokolle und Azure-Ressourcen verbinden, kann die Antwort Codereferenzen, Telemetriebeweise und eine empfohlene Lösung enthalten.

Tipp

Versuchen Sie, eine Frage über etwas in Ihrer Umgebung zu stellen.

  • "Überprüfen Sie den Status der Container-Apps in der Ressourcengruppe X."
  • "Wir sehen 5xx-Fehler in unserer API. Können Sie untersuchen?"
  • "Welche letzten Änderungen wurden für unseren Back-End-Dienst bereitgestellt?"

Nächster Schritt