Bemærk
Adgang til denne side kræver godkendelse. Du kan prøve at logge på eller ændre mapper.
Adgang til denne side kræver godkendelse. Du kan prøve at ændre mapper.
Udviklingen af en effektiv agent handler om mere end blot at forfatte instruktioner og forbinde data og værktøjer. Efter implementering skal teams kontinuerligt evaluere, diagnosticere og forbedre agentens adfærd for at sikre, at den lever op til forretnings-, kvalitets- og sikkerhedskrav.
Denne artikelserie introducerer en praktisk struktur for forbedringsfasen af agentens udviklingslivscyklus. Strukturen hjælper dig med at bruge evalueringsresultater (scores, fejlede testcases og regressioner) og omsætte dem til klare, prioriterede handlinger.
Brug denne struktur, når du har evalueringsresultater og skal beslutte, hvad du skal gøre som næste skridt. Almindelige scenarier omfatter:
- Et evalueringssæt scorer under en forventet tærskel.
- Specifikke testcases fejler, og den underliggende årsag er uklar.
- Scorerne forbedres på ét område, men går tilbage på et andet.
- Flere evalueringssæt fejler, og prioriteterne er uklare.
- Agentens adfærd ændrer sig uventet efter en opdatering.
Denne struktur antager, at du allerede har resultater for bestået/ikke-bestået for individuelle testcases på tværs af et eller flere evalueringssæt.
Tip
Inden du tager denne prioriterings- og afhjælpningsstruktur i brug, skal du indstille og gennemføre evalueringer for din agent. Læs mere om design af en iterativ evalueringsstruktur.
Næste trin
Forstå målene med prioriterings- og afhjælpningsstrukturen, herunder dets ramme og designprincipper.