Expliquer le cycle de vie de l’agent - planifier, agir, évaluer
Les systèmes agentiques ne font pas une décision et ne s’arrêtent pas. Ils fonctionnent à travers des cycles. Un modèle fondamental est le cycle de vie du plan → agir → évaluer. Ce cycle de vie n’est pas une séquence ponctuelle. Il s’agit d’une boucle : les agents planifient, agissent et évaluent à plusieurs reprises jusqu’à ce que la tâche réponde à des critères de réussite définis.
Dans cette unité, vous allez apprendre
Comment le plan → agir → évaluer le cycle de vie fonctionne en pratique
Comment la planification, l’action et l’évaluation sont implémentées dans GitHub flux de travail
Comment les signaux de retour influencent l’itération et la finalisation
Plan
Au cours de la phase de planification, l’agent interprète l’objectif et détermine les étapes nécessaires pour le terminer. Dans les systèmes de haute qualité, les plans ne sont pas cachés dans les états internes. Ils sont des artefacts structurés et modifiables qui rendent l’approche compréhensible et évaluée.
Voici quelques exemples d’artefacts de planification dans GitHub :
Plan structuré dans la description de la pull request
Problème lié ou liste de contrôle décrivant l’étendue et les critères de réussite
Conseil / Astuce
Les plans deviennent plus évaluables lorsqu’ils incluent l’étendue (ce qui changera), les critères de réussite (comment vous saurez qu'il ait fonctionné) et un plan de rétablissement ou d’escalade.
Agir
Dans la phase d’action, l’agent exécute le plan dans le référentiel. Cela peut inclure :
Création d’une branche
Modification des fichiers et envoi de commits
Ouverture ou mise à jour d'un pull request
Réponse aux commentaires suite aux révisions
Cela est important, car il conserve l’exécution limitée : les actions se produisent dans un référentiel spécifique, sur une branche et via des workflows de pull request plutôt que de subir des modifications directes et non contrôlées de la branche par défaut.
Evaluate
Au cours de la phase d’évaluation, l’agent et les humains qui le supervisent utilisent des signaux du système de développement pour évaluer les résultats. Dans GitHub, les signaux d’évaluation courants sont les suivants :
Exécutions de flux de travail et vérifications d’état (build/test/lint)
Commentaires sur la révision du code (modifications demandées, approbations)
Signaux de sécurité (résultats de l’analyse du code, alertes d’analyse de secrets, alertes de dépendance)
Lorsqu’elles sont configurées par référentiel ou par stratégie d’organisation, les protections telles que les ensembles de règles et la protection des branches peuvent exiger que les vérifications soient réussies avant que les modifications puissent être fusionnées, transformant ainsi l'évaluation en une étape contraignante plutôt qu'une simple suggestion informelle.
Pour le travail orienté sécurité, l’évaluation comprend souvent :
Analyse du code (y compris les flux de travail de chargement SARIF)
Alertes d’analyse de secrets
Protection contre la transmission afin d'empêcher la validation des secrets pris en charge
Ces fonctionnalités renforcent une leçon clé : l’évaluation de l’agent doit être fondée sur les signaux système, et non dans la confiance de l’agent.
L’évaluation n’est pas la dernière étape. Si les vérifications échouent, que les risques restent ou que les exigences ne sont pas remplies, le cycle de vie se poursuit : l’agent doit réviser le plan, ajuster ses actions et réévaluer jusqu’à ce que le résultat soit acceptable ou remis à un humain.
Par exemple, lorsqu’un agent propose une mise à jour de dépendance dans un pull request, le plan définit quelles modifications de package doivent être effectuées, l’action met à jour les fichiers, et l’évaluation se fait par le biais de vérifications d'intégration continue (CI) et de signaux de sécurité.
Si les flux de travail échouent ou si la vulnérabilité reste non résolue, le travail n’est pas terminé. Le cycle de vie doit boucler : réviser le plan, ajuster le changement ou remonter à un humain.
Un système d’agents de haute qualité rend visible chaque étape
Le plan est inspectable.
L’action est liée aux flux de travail du référentiel.
L’évaluation utilise des signaux objectifs.
Lorsqu’un élément est manquant, la confiance se dégrade : les plans deviennent opaques, les actions deviennent risquées et les résultats deviennent difficiles à valider.
Le cycle de vie de la planification, de l’action et de l’évaluation est le cœur opérationnel des systèmes agentiques. Il explique comment les agents passent de l'intention à l'exécution -and comment les vérifications, flux de travail, révisions et signaux de sécurité GitHub fournissent des commentaires qui permettent une itération sécurisée.
Une fois que vous comprenez comment un agent se comporte, la question suivante devient où ce comportement est contrôlé. Dans l'unité suivante, vous allez examiner GitHub en tant que système d'enregistrement et de plan de contrôle pour les flux de travail de l'agent.
Je vous recommande de mentionner cela précédemment, soit dans la section Évaluer, soit dans l’introduction, pour qu’il soit immédiatement clair que le plan/acte/évaluer est une boucle et non une séquence linéaire. Il aiderait les apprenants à le connaître dès le départ au lieu de le découvrir dans le scénario.