Förklara agentens livscykel – planera, agera, utvärdera
Agentsystem fattar inte ett enda beslut och slutar. De fungerar genom cykler. En grundläggande modell är livscykeln för plan → agera → utvärdera. Den här livscykeln är inte en engångssekvens. Det är en loop: agenter planerar, agerar och utvärderar upprepade gånger tills uppgiften uppfyller definierade framgångsvillkor.
I den här lektionen får du lära dig
Hur planen → agera → utvärdera livscykeln fungerar i praktiken
Hur planering, åtgärd och utvärdering implementeras i GitHub arbetsflöden
Så här driver feedbacksignaler iteration och slutförande
Plan
I planeringsfasen tolkar agenten målet och avgör vilka steg som krävs för att slutföra det. I högkvalitativa system är planer inte dolda interna tillstånd. De är strukturerade, granskningsbara artefakter som gör metoden begriplig och utvärderad.
Exempel på planering av artefakter i GitHub är:
En strukturerad plan i beskrivningen av pull-begäran
Ett länkat problem eller en checklista som beskriver omfångs- och framgångskriterier
Tip
Planer blir mer granskningsbara när de inkluderar omfång (vad som kommer att ändras), framgångskriterier (hur du vet att det fungerade) och en återställnings- eller eskaleringsväg.
Act
I åtgärdsfasen utför agenten planen i förvaret. Detta kan omfatta:
Skapa en gren
Ändra filer och skicka incheckningar
Öppna eller uppdatera en pull-begäran
Svara på granskningsfeedback med revisioner
Det här är viktigt eftersom körningen är begränsad: åtgärder utförs i ett specifikt repo, på en branch och via arbetsflöden för pull request istället för okontrollerade direkta ändringar av standardbranchen.
Evaluate
I utvärderingsfasen använder agenten och de människor som övervakar den signaler från utvecklingssystemet för att utvärdera resultaten. I GitHub omfattar vanliga utvärderingssignaler:
Arbetsflödeskörningar och statuskontroller (build/test/lint)
Feedback om kodgranskning (begärda ändringar, godkännanden)
Säkerhetssignaler (kodgenomsökningsresultat, aviseringar för hemlig genomsökning, beroendeaviseringar)
När det konfigureras av ett arkiv eller en organisationspolicy kan skydd som grenskydd och regeluppsättningar kräva att kontroller godkänns innan ändringar kan slås ihop, vilket gör utvärderingen till en verkställbar barriär istället för ett informellt förslag.
För säkerhetsorienterat arbete omfattar utvärderingen ofta:
Kodgenomsökning (inklusive arbetsflöden för SARIF-uppladdning)
Aviseringar om hemlig genomsökning
Push-skydd för att förhindra att stödda hemligheter begås
Dessa funktioner förstärker en viktig lektion: agentutvärderingen måste baseras på systemsignaler, inte i agentens förtroende.
Utvärdering är inte det sista steget. Om kontrollerna misslyckas, riskerna kvarstår eller kraven inte uppfylls fortsätter livscykeln: agenten måste revidera planen, justera sina åtgärder och omvärdera tills resultatet är acceptabelt eller överlämnat till en människa.
När en agent till exempel föreslår en beroendeuppdatering i en pull-begäran definierar planen vilka paketändringar som ska göras, åtgärden uppdaterar filerna, och utvärderingen sker genom CI-kontroller och säkerhetssignaler.
Om arbetsflöden misslyckas eller om säkerhetsrisken inte är löst är arbetet inte slutfört. Livscykeln måste upprepas: revidera planen, justera ändringen eller eskalera till en person.
Ett högkvalitativt agentsystem gör varje fas synlig
Planen kan inspekteras.
Åtgärden begränsas till lagringsplatsens arbetsflöden.
Utvärderingen använder objektiva signaler.
När någon del saknas försämras förtroendet: planerna blir ogenomskinliga, åtgärderna blir riskfyllda och resultatet blir svårt att verifiera.
Livscykeln för planering, verkande och utvärdering är den operativa kärnan i agentiska system. Den förklarar hur agenter går från avsikt till körning; och hur GitHubs kontroller, arbetsflöden, granskningar och säkerhetssignaler ger feedback som möjliggör en säker iteration.
När du förstår hur en agent beter sig blir nästa fråga var det beteendet styrs. I nästa enhet kommer du att undersöka GitHub som system of record och kontrollplan för agentarbetsflöden.
Jag rekommenderar att du nämner detta tidigare, antingen i avsnittet Utvärdera eller i introduktionen, för att göra det omedelbart klart att plan/agera/utvärdera är en loop och inte en linjär sekvens. Det skulle hjälpa eleverna att veta detta från början i stället för att upptäcka det i scenariot.