Förklara agentens livscykel – planera, agera, utvärdera

Slutförd

Agentsystem fattar inte ett enda beslut och slutar. De fungerar genom cykler. En grundläggande modell är livscykeln för plan → agera → utvärdera. Den här livscykeln är inte en engångssekvens. Det är en loop: agenter planerar, agerar och utvärderar upprepade gånger tills uppgiften uppfyller definierade framgångsvillkor.

Copilot presentationsbild som visar ett agent-livscykeldiagram med tre steg: Planera, Agera och Utvärdera, anslutna i en loop.

I den här lektionen får du lära dig

  • Hur planen → agera → utvärdera livscykeln fungerar i praktiken

  • Hur planering, åtgärd och utvärdering implementeras i GitHub arbetsflöden

  • Så här driver feedbacksignaler iteration och slutförande

Plan

I planeringsfasen tolkar agenten målet och avgör vilka steg som krävs för att slutföra det. I högkvalitativa system är planer inte dolda interna tillstånd. De är strukturerade, granskningsbara artefakter som gör metoden begriplig och utvärderad.

Exempel på planering av artefakter i GitHub är:

  • En strukturerad plan i beskrivningen av pull-begäran

  • Ett länkat problem eller en checklista som beskriver omfångs- och framgångskriterier

Tip

Planer blir mer granskningsbara när de inkluderar omfång (vad som kommer att ändras), framgångskriterier (hur du vet att det fungerade) och en återställnings- eller eskaleringsväg.

Act

I åtgärdsfasen utför agenten planen i förvaret. Detta kan omfatta:

  • Skapa en gren

  • Ändra filer och skicka incheckningar

  • Öppna eller uppdatera en pull-begäran

  • Svara på granskningsfeedback med revisioner

Det här är viktigt eftersom körningen är begränsad: åtgärder utförs i ett specifikt repo, på en branch och via arbetsflöden för pull request istället för okontrollerade direkta ändringar av standardbranchen.

Evaluate

I utvärderingsfasen använder agenten och de människor som övervakar den signaler från utvecklingssystemet för att utvärdera resultaten. I GitHub omfattar vanliga utvärderingssignaler:

  • Arbetsflödeskörningar och statuskontroller (build/test/lint)

  • Feedback om kodgranskning (begärda ändringar, godkännanden)

  • Säkerhetssignaler (kodgenomsökningsresultat, aviseringar för hemlig genomsökning, beroendeaviseringar)

När det konfigureras av ett arkiv eller en organisationspolicy kan skydd som grenskydd och regeluppsättningar kräva att kontroller godkänns innan ändringar kan slås ihop, vilket gör utvärderingen till en verkställbar barriär istället för ett informellt förslag.

För säkerhetsorienterat arbete omfattar utvärderingen ofta:

  • Kodgenomsökning (inklusive arbetsflöden för SARIF-uppladdning)

  • Aviseringar om hemlig genomsökning

  • Push-skydd för att förhindra att stödda hemligheter begås

Dessa funktioner förstärker en viktig lektion: agentutvärderingen måste baseras på systemsignaler, inte i agentens förtroende.

Utvärdering är inte det sista steget. Om kontrollerna misslyckas, riskerna kvarstår eller kraven inte uppfylls fortsätter livscykeln: agenten måste revidera planen, justera sina åtgärder och omvärdera tills resultatet är acceptabelt eller överlämnat till en människa.

När en agent till exempel föreslår en beroendeuppdatering i en pull-begäran definierar planen vilka paketändringar som ska göras, åtgärden uppdaterar filerna, och utvärderingen sker genom CI-kontroller och säkerhetssignaler.

Om arbetsflöden misslyckas eller om säkerhetsrisken inte är löst är arbetet inte slutfört. Livscykeln måste upprepas: revidera planen, justera ändringen eller eskalera till en person.

Ett högkvalitativt agentsystem gör varje fas synlig

  • Planen kan inspekteras.

  • Åtgärden begränsas till lagringsplatsens arbetsflöden.

  • Utvärderingen använder objektiva signaler.

När någon del saknas försämras förtroendet: planerna blir ogenomskinliga, åtgärderna blir riskfyllda och resultatet blir svårt att verifiera.

Livscykeln för planering, verkande och utvärdering är den operativa kärnan i agentiska system. Den förklarar hur agenter går från avsikt till körning; och hur GitHubs kontroller, arbetsflöden, granskningar och säkerhetssignaler ger feedback som möjliggör en säker iteration.

När du förstår hur en agent beter sig blir nästa fråga var det beteendet styrs. I nästa enhet kommer du att undersöka GitHub som system of record och kontrollplan för agentarbetsflöden.

Jag rekommenderar att du nämner detta tidigare, antingen i avsnittet Utvärdera eller i introduktionen, för att göra det omedelbart klart att plan/agera/utvärdera är en loop och inte en linjär sekvens. Det skulle hjälpa eleverna att veta detta från början i stället för att upptäcka det i scenariot.