Tester vos agents

Effectué

Étant donné qu’un agent se compose d’instructions, de rubriques, d’outils et de connaissances, chaque composant doit fonctionner correctement et travailler ensemble comme prévu. Vous devez vérifier comment l’agent guide les clients dans les conversations et s’assurer que le flux de conversation se comporte comme prévu.

La surface de test dépend du harnais de l’agent :

  • GitHub Copilot harnais : utilisez la préversion pour tester l’agent de manière interactive, évaluer pour exécuter des jeux de tests et surveiller pour passer en revue les tâches et l’activité terminées.
  • Harnais standard : utilisez le panneau Tester votre agent pour tester les conversations. Utilisez le mappage d’activités pour l’orchestration ou le suivi des rubriques génératives pour l’orchestration classique.

Le reste de cette unité décrit les tests dans l’expérience de harnais standard.

Volet de test

Vous pouvez tester votre agent en temps réel à l’aide du panneau d’agent de test, que vous pouvez activer en sélectionnant Test dans le coin supérieur droit de l’application. Pour masquer le volet de test, sélectionnez à nouveau le bouton Tester .

Le panneau Tester votre agent interagit avec votre agent comme un utilisateur. Lorsque vous saisissez du texte dans la fenêtre Agent de test, les informations sont présentées comme elles le seraient à un utilisateur.

En testant fréquemment vos agents tout au long du processus de création, vous pouvez vous assurer que la conversation se déroule comme prévu. Si le dialogue ne reflète pas votre intention, vous pouvez le modifier et l’enregistrer. Le contenu le plus récent est intégré à l’agent de test et vous pouvez le retester.

Test de l’orchestration classique

Si vous avez activé l’orchestration classique, votre agent contient probablement plusieurs rubriques. Lorsque vous interagissez avec une rubrique spécifique, il peut être utile que l’application vous redirige vers cette rubrique.

Vous pouvez accomplir cette tâche en définissant Le suivi entre les rubriques sur Activé en haut du panneau Test.

Effectuez le suivi entre les rubriques, ainsi que l’agent, car il implémente différentes rubriques. Par exemple, la saisie de « hello » déclenche la rubrique Message d’accueil, et l’application ouvre la rubrique et affiche son chemin de conversation. À mesure que chaque rubrique est affichée, vous pouvez observer comment le chemin progresse, ce qui vous aide à évaluer vos rubriques.

Test de l’orchestration de l’IA générative

Si vous avez activé l’orchestration de l’IA générative, l’agent peut sélectionner plusieurs outils ou rubriques à la fois. Une fois les connaissances, les outils et les rubriques sélectionnés, l’agent génère un plan qui détermine son ordre d’exécution. Vous pouvez afficher ce plan et les étapes en cours d’exécution.

Vous pouvez accomplir cette tâche en définissant Afficher la carte d’activité lors du test sur Activé en haut du panneau Test.

Le mappage d’activités est un mappage visuel de la séquence d’entrées, de décisions et de sorties de votre agent au sein d’une session.

Test des valeurs de variables

Vous pouvez observer les valeurs de vos variables pendant que vous testez votre agent.

  1. Sélectionnez Variables dans la barre d’outils secondaire. Le panneau Variables s’affiche.

  2. Passez à l’onglet Tester et développez les catégories de variables souhaitées. À mesure que vous poursuivez votre conversation de test, vous pouvez surveiller la valeur des variables utilisées.

Test des réponses génératives

Dans l’orchestration classique, l’agent peut utiliser des réponses génératives comme secours lorsqu’il ne peut pas identifier une rubrique qui fournit une réponse acceptable. Dans l’orchestration générative, l’agent peut rechercher de manière proactive des sources de connaissances configurées dans le cadre de son plan.

Lorsque vous testez les fonctionnalités de réponse générative, vous devez poser une question pertinente aux sources de données que vous avez définies pour l’IA générative, mais cela ne peut pas être répondu par l’un de vos sujets. Votre agent trouve la réponse correcte à l’aide des sources de données définies.

Une fois qu’une réponse s’affiche, vous pouvez poser d’autres questions complémentaires. L’agent se souvient du contexte, donc vous n’avez pas besoin de fournir d’autres précisions. Par exemple, si vous avez demandé à un agent connecté à Microsoft Learn comme source de données une question telle que « Qu’est-ce qu’une instruction IF utilisée dans Microsoft Excel ? » l’agent retourne des détails sur la fonction d’instruction IF. Ensuite, si vous lui demandez ce qui suit : « Donnez-moi un exemple », l’agent se rend compte que vous parlez toujours de Microsoft Excel et vous donne un exemple.

Ensuite, vous allez examiner comment surveiller les performances de l’agent.