Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
Évitez les problèmes de performance des assistants conversationnels en comprenant les points de défaillance courants et en suivant les meilleures pratiques.
Quotas et limites
Comprenez les quotas et les limites, comme le RPM (requêtes par minute, où une requête est un message envoyé à un assistant) et le nombre de requêtes Power Platform autorisées dans un délai de 24 heures.
Des quotas s’appliquent à vos assistants, ainsi que les contraintes de capacité associées à un plan Microsoft Copilot Studio.
Optimisez votre assistant pour la performance
Pour optimiser les performances de votre assistant, adoptez les meilleures pratiques suivantes :
- Placez stratégiquement les appels API et les invocations de connecteurs dans vos flux de conversation pour éviter que les utilisateurs attendent plusieurs complétions.
- Le cas échéant, stockez les informations récupérées dans des variables, au lieu d’effectuer plusieurs appels d’API ou invocations de flux.
- Les flux de cloud invoqués par les assistants de Copilot Studio peuvent introduire de la latence. Privilégiez l’utilisation de appels de connecteur directs ou du nœud « Send HTTP Request ».
- Comprenez le compromis entre performance et complexité entre la CLN classique et l’orchestration générative dans Copilot Studio. Les modèles de compréhension du langage naturel (CLN) fonctionnent bien pour des intentions spécifiques, mais rencontrent des difficultés avec des requêtes complexes. Les modèles d’IA générative gèrent une gamme plus large d’entrées, mais peuvent introduire de la latence.
- Activer le mode express.
Optimisez votre flux de cloud pour la performance
Si votre assistant appelle un flux de cloud Power Automate, assurez-vous que ces flux de cloud sont optimisés.
Assurez-vous de comprendre les limites de restriction et de capacité dans Power Automate et Power Platform. Le respect de ces limites améliore l’évolutivité et les performances des flux.
En savoir plus sur la résolution des problèmes de flux lents.
Note
Les flux Power Automate et les flux d’assistants prennent en charge les intégrations de RVI mais ne sont pas recommandés comme principal mécanisme d’intégration pour les flux d’appels sensibles à la latence et à forte simultanéité. Leur modèle d’exécution synchrone et leurs limites de limitation de service peuvent introduire une latence supplémentaire qui devient plus prononcée à mesure que le volume d’appels augmente. Évaluez des schémas d’intégration alternatifs lorsque des performances prévisibles à faible latence sont requises.