Explicar o ciclo de vida do agente – planejar, agir, avaliar

Concluído

Os sistemas agêncicos não tomam uma decisão e param. Eles operam através de ciclos. Um modelo fundamental é o ciclo de vida do plano → ato → avaliar. Esse ciclo de vida não é uma sequência única. É um loop: os agentes planejam, atuam e avaliam repetidamente até que a tarefa atenda aos critérios de sucesso definidos.

Copilot apresentando um diagrama de ciclo de vida do agente com três etapas - Planejar, Agir e Avaliar - conectadas em um ciclo circular.

Nesta unidade, você aprenderá

  • Como o plano → agir → avaliar o ciclo de vida funciona na prática

  • Como o planejamento, a ação e a avaliação são implementados em fluxos de trabalho GitHub

  • Como os sinais de feedback conduzem a iteração e conclusão

Plano

Na fase de planejamento, o agente interpreta a meta e determina quais etapas são necessárias para concluí-la. Em sistemas de alta qualidade, os planos não são estados internos ocultos. Eles são artefatos estruturados e revisíveis que tornam a abordagem compreensível e avaliável.

Exemplos de artefatos de planejamento em GitHub incluem:

  • Um plano estruturado na descrição do pull request

  • Um problema vinculado ou uma lista de verificação que descreve o escopo e os critérios de êxito

Dica

Os planos se tornam mais revisíveis quando incluem escopo (o que mudará), critérios de sucesso (como você saberá que funcionou) e um caminho de reversão ou escalonamento.

Agir

Na fase de ação, o agente executa o plano no repositório. São elas:

  • Criando um ramo

  • Alterando arquivos e enviando confirmações por push

  • Abrir ou atualizar uma solicitação de pull

  • Respondendo a feedback de revisão com ajustes

Isso importa porque mantém a execução limitada: as ações ocorrem em um repositório específico, em um branch e por meio de fluxos de trabalho de pull request, em vez de alterações diretas e descontroladas no branch padrão.

Evaluate

Na fase de avaliação, o agente e os humanos que o supervisionam usam sinais do sistema de desenvolvimento para avaliar os resultados. Em GitHub, os sinais de avaliação comuns incluem:

  • Execuções de fluxo de trabalho e verificações de status (build/test/lint)

  • Comentários de revisão de código (alterações solicitadas, aprovações)

  • Sinais de segurança (resultados de verificação de código, alertas de verificação de segredo, alertas de dependência)

Quando configuradas por política de repositório ou organização, proteções como regras e proteção de ramificações podem exigir que verificações sejam aprovadas antes que mudanças sejam mescladas, transformando a avaliação em um portão de imposição, ao invés de uma sugestão informal.

Para o trabalho orientado à segurança, a avaliação geralmente inclui:

  • Verificação de código (incluindo fluxos de trabalho para upload de SARIF)

  • Alertas de verificação de credenciais

  • Proteção por push para impedir que segredos com suporte sejam confirmados

Esses recursos reforçam uma lição importante: a avaliação do agente deve ser fundamentada em sinais do sistema, não na confiança do agente.

A avaliação não é a etapa final. Se as verificações falharem, os riscos permanecerem ou os requisitos não forem atendidos, o ciclo de vida continuará: o agente deve revisar o plano, ajustar suas ações e reavaliar até que o resultado seja aceitável ou entregue a um humano.

Por exemplo, quando um agente propõe uma atualização de dependência em um pull request, o plano define quais pacotes precisam de alterações, a ação atualiza os arquivos e a avaliação ocorre por meio de verificações de CI e sinais de segurança.

Se os fluxos de trabalho falharem ou a vulnerabilidade permanecer não resolvida, o trabalho não será concluído. O ciclo de vida deve ser cíclico: revisar o plano, ajustar a alteração ou escalar para um humano.

Um sistema de agente de alta qualidade torna todas as fases visíveis

  • O plano é inspecionável.

  • A ação é limitada a fluxos de trabalho do repositório.

  • A avaliação usa sinais objetivos.

Quando qualquer peça está ausente, a confiança degrada: os planos se tornam opacos, as ações se tornam arriscadas e os resultados se tornam difíceis de validar.

O ciclo de vida de planejamento, atuação e avaliação é o núcleo operacional dos sistemas agentes. Ele explica como os agentes passam da intenção para a execução e como as verificações, fluxos de trabalho, revisões e sinais de segurança do GitHub fornecem feedback que permite uma iteração segura.

Depois de entender como um agente se comporta, a próxima pergunta se torna onde esse comportamento é controlado. Na próxima unidade, você examinará GitHub como o sistema de registro e plano de controle para fluxos de trabalho do agente.

Recomendamos mencionar isso anteriormente, na seção Avaliar ou na introdução, para deixar imediatamente claro que o plano/ato/avaliação é um loop e não uma sequência linear. Isso ajudaria os aprendizes a saber isso desde o início, em vez de descobri-lo no cenário.