Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
Dit artikel is documentatie voorafgaand aan de release en kan nog wijzigen.
Het tabblad Evalueren in de nieuwe agentervaring biedt gestructureerde, herhaalbare tests voor uw agent. Gebruik evaluaties om de kwaliteit van agenten te meten over testcases heen, verbeterden in de tijd te volgen en het gedrag van je agent te valideren voordat je het publiceert.
Important
- Dit is een productieklare preview-functie.
- Op productieklare previews zijn aanvullende gebruiksvoorwaarden van toepassing.
Wat is agentenevaluatie?
Met agentevaluatie kunt u de reacties van uw agent systematisch testen aan de hand van kwaliteitsnormen. In plaats van elk scenario handmatig te testen in het tabblad Preview , maak je evaluaties met testgesprekken, definieer hoe je antwoorden moet meten en voer je de evaluaties uit om kwantitatieve resultaten te krijgen.
Evaluatie helpt je vragen zoals deze te beantwoorden:
- Reageert de agent correct in een reeks verwachte scenario's?
- Heeft een configuratiewijziging de kwaliteit van de reacties verbeterd of verslechterd?
- Belt de agent tools wanneer het hoort?
belangrijke concepten
De volgende concepten zijn essentieel bij het uitvoeren van evaluaties in Copilot Studio:
Gesprekken
Een gesprek is een testcase die een scenario vertegenwoordigt dat u door uw agent wilt laten afhandelen. Elk gesprek bevat gebruikersberichten en optioneel verwachte reacties van de agent. Organiseer gesprekken in evaluaties. Maak gesprekken handmatig aan, genereer ze met AI, of upload ze vanuit een CSV-bestand.
Evaluations
Een evaluatie is een benoemde testset die gesprekken combineert met een testmethode. U maakt evaluaties aan via het tabblad Evalueren, voegt er gesprekken aan toe en voert ze vervolgens uit om gescoorde resultaten te genereren.
Testmethodes
Testmethoden definiƫren hoe de antwoorden van de agent worden gescoord. Momenteel is de enige beschikbare testmethode General quality, een AI-gebaseerde beoordeling van of antwoorden voldoen aan kwaliteitsnormen, zoals relevantie en volledigheid.
Note
De testmethode Algemene kwaliteit vergelijkt antwoorden niet met verwachte antwoorden.
Gebruikersprofiel
Evaluaties worden uitgevoerd onder een gebruikersprofiel. Beheer welk geauthenticeerd profiel de evaluatie uitvoert zodat de tools en verbindingen van de agent volledig testbaar zijn.
Evaluatieworkflow
Volg deze stappen om een makelaar te beoordelen:
- Een evaluatie maken: Start een nieuwe evaluatie op het tabblad Evalueren. Lees meer in Maak een testset voor een agent aan.
- Gesprekken toevoegen: Voeg testgesprekken toe door ze handmatig te schrijven, te genereren met AI of een CSV-bestand te uploaden.
- Configureren: Geef de evaluatie een naam, selecteer een testmethode, kies de agentversie en stel het gebruikersprofiel in.
- Voer de evaluatie uit: Selecteer Evalueren om de test uit te voeren en wacht op de resultaten. Lees meer in Voer een evaluatie uit voor een makelaar.
- Resultaten bekijken: Analyseer de scores en identificeer verbeterpunten. Lees meer in Bekijk evaluatieresultaten voor een makelaar.
- Herhaal: Pas de instructies, kennis of tools van je makelaar aan en voer vervolgens de evaluatie opnieuw uit om de impact te meten.