Środowisko testowe agenta w Agencie Azure SRE

Przetestuj zachowanie agenta niestandardowego w czasie rzeczywistym przed wdrożeniem zmian. Edytuj instrukcje, narzędzia i przekazy, otrzymując natychmiastową informację zwrotną w układzie z podzielonym ekranem. Oceń jakość agenta za pomocą oceniania opartego na sztucznej inteligencji i szybkich poprawek.

Problem

Tworzenie efektywnych konfiguracji agentów jest procesem iteracyjnym. Piszesz instrukcje, przypisujesz narzędzia i konfigurujesz przekazywanie. Może się okazać, że agent błędnie rozumie intencję lub nie ma krytycznego narzędzia dopiero po wdrożeniu. Każdy cykl edycji, wdrażania, testowania i naprawiania marnuje czas i ryzyko zakłócania przepływów pracy produkcyjnych.

Bez dedykowanego środowiska testowego wdrażasz zmiany, aby zobaczyć, jak zachowują się. Testujesz w konwersacjach na żywo, które wpływają na rzeczywiste wątki. Domyślasz się, czy instrukcje są wystarczająco jasne.

Jak działa plac zabaw

Plac zabaw to dedykowany widok na Kanwie Agenta wraz z widokami Kanwy i Tabeli. Wybierz pozycję Test playground z przełącznika widoku, aby wejść do środowiska z podziałem ekranu, gdzie edytujesz i testujesz.

Zrzut ekranu przedstawiający układ podzielonego ekranu w agent playground z edytorem formularzy po lewej stronie i panelem testowym czatu po prawej stronie.

Wybierz, co chcesz przetestować

Użyj listy rozwijanej Agent niestandardowy/Narzędzie u góry, aby wybrać, co należy przetestować.

Encja Co można przetestować
Agent niestandardowy Instrukcje, narzędzia, przekazywanie i pamięć podczas czatu na żywo
Twój agent Zastąp monit koordynatora i przetestuj zachowanie routingu
Narzędzie systemowe Wykonywanie wbudowanych narzędzi z parametrami niestandardowymi
Narzędzie Kusto Uruchamianie zapytań względem połączonych klastrów

Zrzut ekranu przedstawiający listę rozwijaną selektora jednostek z agentami niestandardowymi i narzędziami dostępnych do testowania.

Edytowanie i testowanie obok siebie

W przypadku agentów niestandardowych plac zabaw dzieli się na dwa panele.

Edytor:

  • Widok formularza: Edycja niestandardowej nazwy agenta, instrukcji, instrukcji przekazania, przekazywania niestandardowych agentów, narzędzi oraz dostępu do bazy wiedzy.
  • Widok YAML: edytuj pełną konfigurację agenta jako YAML.

Testowanie:

  • Karta testu: Porozmawiaj z agentem za pomocą bieżącej konfiguracji.
  • Karta Oceny: Uruchamianie analizy jakości opartej na sztucznej inteligencji.

Uwaga / Notatka

Kiedy modyfikujesz konfigurację, czat jest wyłączony do momentu, gdy wybierzesz Zastosuj, aby zapisać zmiany lub Odrzuć, aby przywrócić. To zachowanie uniemożliwia testowanie nieaktualnych konfiguracji. Wybranie pozycji Zastosuj uruchamia również nowy wątek czatu, aby można było przetestować zaktualizowaną konfigurację od podstaw.

Co sprawia, że takie podejście różni się

W przeciwieństwie do testowania konwersacji na żywo plac zabaw zapewnia izolowane środowisko, w którym zmiany nie wpływają na wątki produkcyjne. Układ ekranu podzielonego oznacza, że efekt instrukcji zmienia się natychmiast bez przełączania między widokami lub oczekiwania na wdrożenia.

Funkcja oceny wykracza poza testowanie ręczne. Sztuczna inteligencja analizuje konfigurację agenta i zachowanie czatu, aby napotkać problemy, których możesz przegapić: niejasne instrukcje, brakujące narzędzia, luki bezpieczeństwa i niezgodność intencji.

przed po
Wdrażanie zmian, a następnie testowanie w rozmowie na żywo Natychmiastowe testowanie w izolowanym środowisku
Zgadnij, czy instrukcje są jasne Uzyskiwanie wyników jasności opartych na sztucznej inteligencji
Odnajdywanie brakujących narzędzi podczas zdarzeń Proaktywna ocena ujawnia luki w narzędziach
Przełączanie między wieloma kartami do edycji i testowania Użyj ekranu podzielonego z edytorem i czatem obok siebie

Ocena jakości agenta

Karta Ocena zawiera ocenę jakości opartej na sztucznej inteligencji dla konfiguracji agenta. Wybierz pozycję Oceń , aby przeanalizować bieżącą konfigurację i ostatnie zachowanie czatu.

Ocena zwraca następujące wyniki:

Ocena Co mierzy
Ogólnie Łączny wynik jakości (0–100)
Dopasowanie intencji Jak dobrze zachowanie agenta jest zgodne z celem (1–5)
Kompletność Czy monit obejmuje wskazówki dotyczące roli, celu i działania
Dopasowanie narzędzia Czy są skonfigurowane odpowiednie narzędzia
Jasność monitu Jak jasne i możliwe jest działanie instrukcji
Możliwość działania Czy odpowiedzi obejmują konkretne, wykonywalne następne kroki
Safety Obsługa błędów, komunikaty potwierdzające i zabezpieczenia

Szybkie poprawki

Gdy ocena identyfikuje ulepszenia, wybierz pozycję Przejrzyj i zastosuj , aby otworzyć okno dialogowe szybkich poprawek. Wybierz żądane poprawki, wyświetl podgląd różnic YAML, a następnie użyj przycisku Akceptuj wybrane poprawki . Możesz kontynuować edytowanie lub zapisywanie natychmiast.

Wskazówka

Uruchom ocenę po przeprowadzeniu kilku próbnych konwersacji. Ocena uwzględnia działanie czatu oraz konfigurację dla dokładniejszego oceniania.

Uwaga / Notatka

Jeśli zmienisz konfigurację agenta po uruchomieniu oceny, wyniki zostaną oznaczone jako nieaktualne i zostanie wyświetlony monit o ponowne oszacowanie. Podobnie nowa aktywność na czacie po ocenie oznacza wyniki jako nieaktualne. Ponownie oceń, aby uzyskać informacje odzwierciedlające najnowsze testy.

Testowanie narzędzi w izolacji

Narzędzia systemowe i narzędzia Kusto można testować niezależnie od placu zabaw agenta.

Narzędzia systemowe

Wybierz narzędzie systemowe z listy rozwijanej Agent niestandardowy/Narzędzie , aby niezależnie przetestować wbudowane funkcje. Wprowadź wartości parametrów i wybierz opcję Wykonaj narzędzie, aby wyświetlić nieprzetworzone dane wyjściowe JSON.

Narzędzia Kusto

Wybierz narzędzie Kusto, aby przetestować zapytanie względem połączonych klastrów. Na panelu testowym są wyświetlane wyniki zapytania z liczbami wierszy, kolumnami i czasem wykonywania. Dostosuj język KQL i uruchom ponownie.

Aby uzyskać instrukcje krok po kroku, zobacz Testowanie narzędzia na placu zabaw.

Konfiguracja wspomagana przez sztuczną inteligencję

Plac zabaw zawiera dwie funkcje wsparcia sztucznej inteligencji do doskonalenia niestandardowych instrukcji agenta:

  • Uściślij za pomocą sztucznej inteligencji: ponownie napisz instrukcje i opis przekazywania. Ta funkcja bezpośrednio zastępuje bieżący tekst wersją ulepszoną przez sztuczną inteligencję, dlatego przed zapisaniem przejrzyj zmiany.
  • Wyświetl sugestie dotyczące sztucznej inteligencji: otwiera panel tylko do odczytu wraz z formularzem zawierającym zalecenia dotyczące sztucznej inteligencji: sugestie dotyczące ulepszeń, ostrzeżenia dotyczące potencjalnych problemów oraz ulepszone wersje instrukcji i opisu przekazywania. Ta funkcja nie modyfikuje konfiguracji. Użyj go jako odwołania podczas edytowania.

Wprowadzenie

Resource Czego się uczysz
Testowanie narzędzia na placu zabaw Przewodnik krok po kroku interfejsu placu zabaw
Resource Opis
Agenci niestandardowi Jak działają agenci niestandardowi i kiedy ich używać
Narzędzia Kusto Tworzenie zapytań KQL wielokrotnego użytku dla agenta
Wykonywanie kodu w języku Python Tworzenie niestandardowych narzędzi języka Python