Notitie
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen u aan te melden of de directory te wijzigen.
Voor toegang tot deze pagina is autorisatie vereist. U kunt proberen de mappen te wijzigen.
Het bouwen van een effectieve agent gaat verder dan alleen het schrijven van instructies en het verbinden van gegevens en tools. Na de implementatie moeten teams het gedrag van agenten continu evalueren, diagnosticeren en verbeteren om ervoor te zorgen dat het voldoet aan de verwachtingen van zakelijke, kwaliteits- en veiligheidseisen.
Deze reeks artikelen introduceert een praktisch kader voor de verbeteringsfase van de levenscyclus van de agentontwikkeling. Het kader helpt u om evaluatieresultaten (scores, mislukte testcases en regressies) om te zetten in duidelijke, geprioriteerde acties.
Gebruik dit kader wanneer u evaluatieresultaten hebt en moet beslissen wat u hierna wilt doen. Veelvoorkomende scenario's:
- Een evaluatieset scoort onder een verwachte drempel.
- Specifieke testcases falen en de oorzaak is onduidelijk.
- De scores verbeteren op het ene gebied, maar verslechteren op een ander.
- Meerdere evaluatiesets falen en prioriteiten zijn onduidelijk.
- Het gedrag van een agent verandert onverwacht na een update.
Dit kader gaat ervan uit dat u al slagings- of mislukkingsresultaten hebt voor individuele testcases over een of meer evaluatiesets.
Fooi
Voordat u dit sorteer- en herstelsysteem gebruikt, stelt u evaluaties in en voert deze uit voor uw agent. Lees meer over het ontwerpen van een iteratief evaluatiekader.
Volgende stap
Begrijp de doelstellingen van het sorteer- en herstelkader, inclusief de structuur en ontwerpprincipes ervan.