Anbefalte fremgangsmåter for å forbedre ytelsen til samtaleagenter

Unngå ytelsesproblemer med samtaleagenter ved å forstå vanlige feilpunkter og følge beste praksis.

Kvoter og begrensninger

Forstå kvoter og grenser, som RPM (forespørsler per minutt, der en forespørsel er en melding sendt til en agent) og antall Power Platform-forespørsler som er tillatt innenfor en 24-timers tidsramme.

Kvoter gjelder for agentene dine sammen med kapasitetsbegrensningene som følger med en Microsoft Copilot Studio-plan.

Optimaliser agenten din for ytelse

For å optimalisere agentens ytelse, vurder følgende beste praksiser:

  • Legg API-kall og koblingskall strategisk inn i samtaleflytene dine for å unngå at brukerne må vente på flere resultater.
  • Der det er relevant, lagre innhentet informasjon ved hjelp av variabler, i stedet for å utføre flere API-kall eller flytinvokasjoner.
  • Skyflyter som utløses fra Copilot Studio-agenter kan føre til forsinkelser. Du kan bruke direkte koblingskall eller Send HTTP Request-noden i stedet.
  • Forstå avveiningen mellom ytelse og kompleksitet mellom Classic NLU og generativ iverksetting i Copilot Studio. Modeller for naturlig språkforståelse (NLU) fungerer godt for spesifikke intents, men sliter med komplekse spørringer. generativ kunstig intelligens-modeller håndterer et bredere spekter av input, men kan introdusere latens.
  • Aktiver ekspressmodus.

Optimaliser skyflyten for ytelse

Hvis agenten kaller opp en Power Automate-flyt, må du kontrollere at skyflytene er optimalisert.

Notat

Power Automate-flyter og agentflyter støtter IVR-integrasjoner, men anbefales ikke som hovedintegrasjonsmekanisme for latens-sensitive samtaleflyter med høy samtidighet. Den synkrone utførelsesmodellen og tjenestebegrensningene kan introdusere ekstra forsinkelse som blir mer fremtredende etter hvert som samtalevolumet øker. Evaluer alternative integrasjonsmønstre når forutsigbar ytelse med lav latens er et krav.