Kjør en evaluering av en agent (forhåndsversjon)

[Denne artikkelen er forhåndsutgitt dokumentasjon og kan endres.]

Etter at du har laget et testsett med samtaler, kjør en evaluering for å måle agentens prestasjoner. Evalueringen behandler hver samtale og gir poengbaserte resultater basert på valgt testmetode.

Viktig!

  • Dette er en produksjonsklar evalueringsfunksjonalitet.
  • Produksjonsklare forhåndsversjoner er underlagt tilleggsvilkår for bruk.

Forutsetninger

For å gjennomføre en evaluering av en agent:

  1. Åpne agenten i Copilot Studio.
  2. Velg Evaluer-fanen.
  3. I nedtrekksmenyen for evaluering velger du evalueringen du vil gjennomføre.
  4. Legg til minst én samtale i testsettet hvis du ikke allerede har gjort det.
  5. Bekreft følgende i panelet Konfigurer testsett:
    • Evalueringen Navn er angitt.
    • Testmetoden er konfigurert (for eksempel Generell kvalitet).
  6. Velg Evaluer for å starte evalueringen. Evalueringen behandler hver samtale i testsettet. Avhengig av antall samtaler kan denne prosessen ta flere minutter.

Tips

Kjør den samme evalueringen flere ganger. Hver runde lagres separat, slik at du kan sammenligne resultater på tvers av løp og se hvordan endringer i agenten din påvirker kvaliteten.

Kjør en evaluering på nytt

Etter at du har endret agentens instruksjoner, kunnskap eller verktøy, kjør evalueringen på nytt for å måle effekten:

  1. I Evaluer-fanen velger du evalueringen du vil kjøre på nytt, fra rullegardinlisten Evaluering.
  2. Under Nylige resultater velger du Evaluer testsett på nytt eller velger ikonet for Evaluer testsett i testsettet for å starte en ny kjøring.
  3. Sammenlign resultatene fra den nye serien med tidligere kjøringer for å se om endringene forbedret eller forringet ytelsen.