Konfigurer sanntidsagenter

Merknad

Denne artikkelen beskriver funksjoner som brukes i agenter eller agentstrømmer drevet av standardledningsnettet.

For å deployere en sanntidsagent, aktiver sanntidsmodellen, konfigurer kjerneinnstillingene for agenten, og sett deretter opp de nødvendige kanalspesifikke funksjonene. Du kan distribuere samme agent til talekanalen, digitale meldingskanaler, eller begge deler.

Merknad

Sanntidsagenter er i forhåndsversjon for digitale meldingskanaler. Forhåndsversjonsfunksjonene er ikke ment for produksjonsbruk og kan ha begrenset funksjonalitet. Disse funksjonene er underlagt ekstra vilkår for bruk. Microsoft gir dem før en offisiell lansering slik at kundene kan få tidlig tilgang og gi tilbakemeldinger.

Sett opp og aktiver sanntidsagenter

  1. Opprett en ny agent, og konfigurer de grunnleggende detaljene, for eksempel et beskrivende navn og formålet med agenten i beskrivelsen.

  2. Gå til agentens stemmeinnstillinger og slå på Aktiver stemme. I Tale-type, velg Real-time.

    Important

    Denne innstillingen er et engangsvalg. Etter at du har valgt sanntid, kan du ikke bytte tilbake til en grunnleggende agenttype. For å bruke en enkel agent, opprett en ny agent. Denne innstillingen er nødvendig selv om du bruker agenten på en digital meldingskanal.

  3. Velg modellen du vil bruke, GPT-Realtime, GPT-Realtime-Mini, eller GPT-5-Chat (forhåndsvisning). GPT-5-Chat (Forhåndsvisning) er en tekst-LLM-stemmemodell som genererer stemmesvar gjennom Microsoft Neural Text-to-Speech (TTS).
    Lær mer om hvordan disse modellene fungerer basert på deres støttede regioner og utrullingshensyn. Tabellen nedenfor beskriver scenarioene der du kan bruke ulike modeller.

    Scenario GPT-Realtime GPT-5-Chat (forhåndsvisning)
    Samtalestil Innebygde tale-til-tale-interaksjoner Tale konverteres til tekst for resonnement og syntetiseres deretter tilbake til tale
    Ventetid Laveste latens for naturlige samtaler Høyere latens enn GPT-Realtime
    Stemmetilpasning Støtter de innebygde sanntidstalealternativene som er tilgjengelige for sanntids stemmeagenter Støtter Microsoft Neural Text-to-Speech (TTS), inkludert et bredere talekatalog og tilpassede stemmemodeller
    Opplevelser med merkevarestemmer Begrensede tilpasningsmuligheter Anbefalt når du trenger en tilpasset eller merkevaretilpasset stemmeopplevelse
    Regional utplasseringsfleksibilitet Begrenset til støttede sanntidsmodellregioner Større fleksibilitet gjennom talegjenkjenning og TTS-tjenester
    Best egnet for Naturlige talesamtaler med lav forsinkelse og interaksjoner uten faste rammer Scenarier som krever avansert stemmetilpasning, tilpassede stemmer, samsvarskrav eller regional distribusjonsfleksibilitet

    Tips

    • Bruk GPT-Realtime når naturlig samtalekvalitet og lav ventetid er hovedkravene.
    • Bruk GPT-Realtime-Mini (Forhåndsvisning) for scenarioer som krever raske taleinteraksjoner med lavere latens og ressursbruk.
    • Bruk GPT-5-Chat (Forhåndsvisning) når stemmetilpasning, tilpassede stemmemodeller eller distribusjonsfleksibilitet er viktigere enn responsforsinkelse.
  4. Gå til agentens sikkerhetsinnstillinger , og velg Ingen godkjenning.

Kunnskap og verktøy

Du kan konfigurere agenten til å bruke kunnskap og verktøy. Finn ut mer i sammendrag av kunnskapskilder, Legg til verktøy i egendefinerte agenter og Verktøy, kunnskap, MCP og API.

Nestede agenter (forhåndsvisning)

Agenter i sanntid støtter kun barneagenter.

Important

Sørg for at underordnede agentbeskrivelser ikke overlapper med emnebeskrivelser. Definer eksplisitt aktiveringsrekkefølge i agentens instruksjoner.

Emner

Sanntidsagenter støtter alle temaer som er konfigurert i Copilot Studio. Bruk emner for å definere deterministiske atferder som hilsener, forretningsregler og eskalering, mens modellen du valgte håndterer samtalesvar under kjøring. Finn ut mer i Velg hvordan du kontrollerer samtalen.

Beste fremgangsmåter

  • Bruk emner bare når deterministisk virkemåte er nødvendig.

  • Bruk statisk tekst i hilsningsmeldinger for det raskeste første svaret. Dynamiske meldinger med variabler og uttrykk øker den innledende ventetiden.

  • Deaktiver temaet Samtalestart hvis du vil at sanntidsagentmodellen skal håndtere hilsenen. Ellers spilles hilsenen som er konfigurert i samtalestartemnet , i stedet for talemodellhilsenen.

  • La agentmodellen i sanntid håndtere generelle samtaler og oppfølgingsspørsmål.

  • Inkluder en eksplisitt handling i emnet Ved feil , for eksempel overføring eller avslutt samtale. Feilbehandling bare for meldinger er ikke tilstrekkelig. Uten et deterministisk neste steg kan kundene oppleve stillhet for taleagenter eller fastlåste samtaler for meldingskanaler, noe som fører til forvirring og dårlig kundeopplevelse.

  • Bruk eksplisitte emne- og verktøybeskrivelser til å erklære eierskap for datainnsamling. Finn ut mer i Skrive effektive emne- og verktøybeskrivelser.

Støtte for emnenode

Følgende liste beskriver temastøtte i sanntidsagenter:

Betingelsesnode

Funksjon Kundestøtte
Hvis/Else-forgrening Støttes
Power Fx-uttrykk Støttes
Reprosessering av sporutfylling Støttes

Meldingsnode

Funksjonen Kundestøtte
Grunnleggende melding Støttes
Meldingsvariasjoner Støttes
Variabelinnsetting Støttes
SSML Kun talekanal
Rich Media/Dynamiske kort  Støttes kun for digitale meldingskanaler. Denne funksjonen er i forhåndsversjon. 
Hurtigsvar Støttes kun for digitale meldingskanaler. Denne funksjonen er i forhåndsversjon. 

Spørsmål-noden

Funksjon Kundestøtte
Ledetekst Støttes
Automatisk sperring Støttes ikke
Utfylling av spor Støttes
Hopp-over atferd/Grådig utfylling av spor Støttes
Spør igjen / Prøv på nytt Støttes
Ugyldig svarbehandling Støttes
Emneavbrudd Støttes
Forstyrrelse Støttes kun for talekanal.
Egendefinert reprompt-melding Støttes
DTMF inndata Støttes kun for talekanal.
Registrering av stillhet Støttes kun for talekanal.

HTTP-node

Funksjonen Kundestøtte
HTTP-metoder: GET, POST, PUT, PATCH, DELETE Støttes
URL-endepunkter Støttes
Hoder og nyttelaster Støttes
Svaranalyse og skjema Støttes
Variabelkartlegging Støttes
Feilbehandling Støttes

Verktøynode

Funksjon Kundestøtte
Power Automate-flyt Støttes
Aktivering av verktøy Støttes
Inndata-/utdatakartlegging Støttes
Ny ledetekst Støttes

Sett variabelverdiknute

Funksjonen Kundestøtte
Direkte tildeling Støttes
Uttrykkstilordning Støttes
Variabel til variabel Støttes

Emnebehandlingsnode

Funksjonen Kundestøtte
Avslutt gjeldende emne Støttes
Avslutte alle emner Støttes
Avslutt samtale Støttes
Gå til trinn Støttes
Brukerinndata for intensjonsgjenkjenning Støttes
Gå til et annet emne Støttes

Overfør samtalenode

Funksjonen Kundestøtte
Overfør til agent Støttes
Overføring av eksternt telefonnummer Støttes kun for talekanal. 

Avansert

Funksjon Kundestøtte
Opprett generative svar Støttes

Systemutløserstøtte

Utløser Kundestøtte Detaljer
Ved samtalestart Støttes Starter når en ny samtale begynner
På Snakk med representant Støttes Overføringer til menneskelig agent
Ukjent emne/ukjent hensikt Støttes ikke Tilbakefall når ingen emne samsvarer
OnSelectIntent (flere emner samsvarer) Støttes ikke Entydighet mellom lignende emner
Tilbakestill samtale (OnSystemRedirect) Støttes Fjerner variabler og starter flyten på nytt
Ved pålogging Støttes ikke
Ukjent DTMF-tastetrykk Støttes Ukartlagt tastaturinput. Gjelder kun for talekanal.
Agenten velger / Brukeren sier et uttrykk Støttes Agent velger emne basert på hensikt
En melding er mottatt Støttes ikke Øker ventetiden
En egendefinert klienthendelse oppstår Støttes ikke Bare ved øktstart
Samtaleoppdateringen Støttes ikke Medlemmer lagt til eller fjernet, øktendringer
Den påkalles Støttes ikke Krever synkron brukergrensesnitt
Det er omadressert Støttes
Brukeren er inaktiv i en spesifisert periode. Støttes Tidsavbrudd ved brukerinaktivitet. Gjelder kun digitale meldingskanaler.
Registrering av stillhet Støttes Gjelder kun for talekanal.
En plan fullføres Støttes ikke
AI-respons generert Støttes ikke
Ved feil Støttes Håndterer orkestreringsfeil

Sende variabler mellom emner og språkmodellen

Når du bruker emner i en hybrid samtaleflyt, er det viktig å forstå hvordan du sender variabler mellom emner og språkmodellen i sanntid for å bygge pålitelige, staselige interaksjoner. Denne prosessen gjelder på tvers av kanaler.

Denne funksjonaliteten fungerer gjennom følgende prosess:

  • Du sender inndatavariabler som er definert i et emne til emnet på aktiveringstidspunktet, slik at språkmodellen kan gi strukturerte data til den deterministiske flyten.

  • Du returnerer utdatavariabler definert i et emne til språkmodellen på slutten av emnekjøringen som strukturerte nøkkelverdipar.

  • Utdata fra verktøykall følger samme mønster.

  • Språkmodellen fylles ut med samtalekontekst, inkludert nøkkelverdipar for verktøyanrop. Du returnerer imidlertid bare eksplisitt definerte utdatavariabler som strukturerte data.

  • Variabelbeskrivelsen hjelper modellen å forstå hvordan variabelen skal brukes under en samtale. Gi klare og beskrivende definisjoner.

Finn ut mer i Behandle emneinndata og -utdata.

Flerspråklig støtte

Legg til alle sekundære språk du vil bruke. Lokaliseringsstrenger kreves ikke for sanntidsflyter. For deterministiske emnemeldinger må du imidlertid oppgi de oversatte meldingene. Finn ut mer i Konfigurer og opprett flerspråklige agenter.

Sanntidsmodellen kan forstå og svare på mange språk. Microsoft validerer imidlertid ikke formelt alle språk for generell tilgjengelighet.

Per juni 2026 er følgende språk formelt validert:

  • Nederlandsk (Nederland) (nl-NL)
  • Engelsk (Australia) (en-AU)
  • Engelsk (USA) (en-US)
  • Engelsk (Storbritannia) (en-GB)
  • Fransk (Canada) (fr-CA)
  • Fransk (Frankrike) (fr-FR)
  • Tysk (Tyskland) (de-DE)
  • Italiensk (Italia) (it-IT)
  • portugisisk (Brasil) (pt-BR)
  • Spansk (Spania) (es-ES)
  • Spansk (USA) (es-US)

Microsoft fortsetter å validere andre språk og legger dem til etter at sertifiseringen er fullført. Du kan legge til et hvilket som helst språk som støttes av Copilot Studio. Språk som ikke er fullstendig sertifisert for kvalitet på GA-nivå, bør imidlertid testes grundig før produksjonsdistribusjon.

Important

Teknisk språkfunksjonalitet er ikke lik et støttet eller sertifisert språk. Hvis du har tenkt å distribuere agenter på andre språk enn engelsk, bør du utføre omfattende testing med virkelige innringere og anropsflyter før du går direkte.

Kontekstvariabler

En sanntidsagent støtter kontekstvariabler som gjør at den kan oppføre seg mer intelligent ved å bære informasjon om samtalen og kunden. De tilgjengelige kontekstvariablene avhenger av kanalen. Dette settet omfatter:

Kontekstvariabel Beskrivelse
Kanal-ID Identifiserer kommunikasjonskanalen som brukes for samhandlingen. Gjelder kun for talekanal.
Telefonnummer for anroper (ANI) Det opprinnelige telefonnummeret til anroperen. Gjelder kun for talekanal.
Anropsnummer (DNIS) Måltelefonnummeret som anroperen ringte. Gjelder kun for talekanal.
Samtale-ID En unik identifikator for den aktive samtaleøkten.
SIP-overskrifter Støttet SIP-header-nøkkel-verdi-par knyttet til samtalen. Gjelder kun for talekanal.
Gjeldende dato (UTC) Gjeldende dato i Coordinated Universal Time (UTC), angitt ved kjøretid for å tillate datobevisste svar.
Gjeldende klokkeslett (UTC) Gjeldende tid i Coordinated Universal Time (UTC), angitt ved kjøretid for å tillate tidsbevisste svar.

Lær mer om alle andre kontekstvariabler, inkludert digital melding og tilpassede kontekstvariabler, i Configure context variables for agents.

Kanalspesifikke innstillinger

Agentstemme

Velg stemmen agenten bruker ved å velge agenten din og gå til Innstillinger>voice select-tale>. Sanntidsagenter støtter følgende stemmer:

  • Legering
  • Ash
  • Ballade
  • Coral
  • Ekko
  • Sage
  • Glimmer
  • Vers
  • Marin
  • Cedar

Merknad

  • Agentens stemme er for din sanntidsagent og er ikke den som er konfigurert i Copilot Service administrasjonssenter.
  • For å matche Dynamics-systemets meldingsstemmer med din sanntidsagent, bruk kun følgende støttede stemmer: Alloy, Echo, Shimmer eller Ash.
  • Agenter som bruker Text LLM, GPT-5-Chat (Preview), genererer stemmesvar gjennom Microsoft Neural Text-to-Speech (TTS). Denne modellen støtter et bredere stemmekatalog og tilpassede stemmemodeller, noe som gjør den egnet for organisasjoner som krever merkevarebaserte stemmeopplevelser eller avansert stemmetilpasning.

Talefølsomhet

Talefølsomhet taleaktivitetsregistrering (VAD) bestemmer når agenten skal svare etter at innringeren er ferdig med å snakke.

Forståelse av VAD-typer

Sanntidsagenter støtter to VAD-tilnærminger:

Skjermbilde av dialogboksen Talefølsomhet.

Serverbasert VAD – basert på lyd (stillhet)

  • Oppdager slutten av talen basert på lydsignaler (lydvarighet, volum)

  • Reagerer raskt når stillhet oppdages

  • Best for strukturerte interaksjoner, korte svar, støyende miljøer

Semantisk VAD – basert på setningskontekst

  • Bestemmer fullførelse basert på betydningen av det som ble sagt

  • Tilpasser seg naturlige pauser, fyllord, etterfølgende tale

  • Best for: Samtaleinteraksjoner, komplekse spørsmål, åpne diskusjoner

Velg riktig VAD

Bruk serverbasert VAD når alle følgende betingelser er oppfylt:

  • Samhandlinger er strukturert (menynavigasjon i IVR-stil).
  • Svarene er korte og forutsigbare.
  • Bakgrunnsstøy er en bekymring (semantisk VAD kan vente for lenge).
  • Du vil ha rask og presis replikkveksling.

Bruk semantisk VAD når alle følgende betingelser er sanne:

  • Samtaler er åpne.
  • Innringere kan nøle eller bruke fyllord ("um", "la meg tenke ...").
  • Spørsmålene er komplekse (innringere forklarer situasjoner).
  • Naturlig samtaleflyt prioriteres.

Konfigurer serverbasert VAD

Gå til Innstillinger>>Taleinnstillinger>Taleinndatafølsomhet>>basert på lyd (stillhet).

Skjermbilde av dialogboksen Talefølsomhet når du er satt til Basert på lyd (stillhet).

Parameter Beskrivelse Forhåndsinnstilt Anbefalt område
Terskel Følsomhet for tale kontra støy (0-1 skala) 0.6 0.5-0.7
Prefiksutfylling (ms) Lyd som fanges opp før tale starter 300 ms 200–500 ms
Stillhetsvarighet (ms) Stillhet kreves for å avslutte svingen 750 ms 750-1000 ms

Terskel

  • Lavere (0,3-0,4): Mer følsom; plukker opp stille tale, kan utløse bakgrunnsstøy.
  • Høyere (0,7-0,9): Mindre følsom; krever høyere tale, reduserer falske utløsere.
  • Anbefalt: Start med 0,5; øk hvis bakgrunnsstøy forårsaker falske triggere.

Prefiksutfylling

  • Fanger opp lyd før talegjenkjenning (hindrer at det kuttes av det første ordet).
  • Lavere (200 ms): Raskere respons; kan gå glipp av første stavelse.
  • Høyere (500 ms): Sikrere fangst; liten forsinkelse.
  • Anbefalt: 300 ms (god balanse).

Stillhetens varighet

  • Hvor lenge innringeren må være stille før agenten svarer.
  • Lavere (500 ms): Rask svinging; kan avbryte hvis anroperen stanser midt i tanken.
  • Høyere (1000 ms): Mer tålmodig; kan føles treg.
  • Anbefalt: Start med 750 ms.

Konfigurer semantisk VAD

Gå til Innstillinger>>Taleinnstillinger>Taleinndatafølsomhet>>basert på setningskontekst.

Skjermbilde av dialogboksen Talefølsomhet når den er satt til Basert på setningskontekst.

Parameter: Iver (hvor raskt agenten reagerer etter semantisk fullføring)

Innstilling Virkemåte Best egnet for
Lav Venter lenger, veldig tålmodig Innringere som tenker høyt, hyppige pauser
Middels Balansert (standard) Generelle samtaler
Høy Reagerer raskt Raske interaksjoner, enkle spørsmål

DTMF-konfigurasjon

Dual-Tone Multi-Frequency (DTMF) lar innringere taste inn informasjon ved å bruke telefonens tastatur.

Du kan aktivere DTMF for agenten din både på emne- og globalt nivå. Hvis du vil angi den på globalt nivå, velger du agenten din og går til> fortalesamtalevirkemåte>for innstillinger>.

Important

Når du bygger kun DTMF-opplevelser, konfigurere DTMF-inngang for hver inngangsnode, inkludert menyvalg og flersifrede inndata som kontonumre eller PIN-koder. Sørg for at alle mulige kundeinndatastier har tilsvarende DTMF-kartlegginger slik at brukerne kan navigere og fullføre samtalen kun ved hjelp av tastaturinput.

Registrering av stillhet

Stillhetsdeteksjon gjør det mulig for sanntidsagenter å gjenkjenne når en innringer ikke gir noen input i en spesifisert periode. Konfigurer lyddempering som en global stemmeinnstilling for agenten ved å gå til Innstilling> avlydoppførselsstillelse> fortalesamtale>.

Important

  • Stilhetsdeteksjon er ikke slått på som standard. Hvis brukeren ikke snakker, venter agenten på ubestemt tid uten å spørre. Slå eksplisitt på lydløsing og konfigurer en reprompt-melding for å håndtere stille innringere.
  • Standard tidsavbrudd for stillhetsregistrering er 7 000 ms (7 sekunder). Valider denne verdien mot ditt spesifikke brukstilfelle og oppringermiljø før du distribuerer til produksjon. Sju sekunder kan føles for lenge for noen innringere eller for korte for andre, avhengig av samhandlingens natur, for eksempel komplekse spørsmål eller støyende miljøer. Test med virkelige anropsdata for å bestemme riktig terskel for scenarioet.
  • Før du aktiverer gjenkjenning av stillhet, må du kontrollere at virkemåten du konfigurerer i emnet for gjenkjenning av stillhet (for eksempel Escalate, Hang Up, Reprompt) er tilsiktet og passer for brukstilfellet. Feilkonfigurert tilbakefallsvirkemåte, for eksempel utilsiktet å sette tilbakefallet til Escalate når hensikten er å legge på, eller omvendt, kan resultere i uventede anropsresultater.

Forsinkelsesmeldinger

Legg til ventetidsmelding eller musikk til agenten din når bakgrunnsoperasjoner tar lengre tid enn forventet. Hvis du vil konfigurere ventetidsmeldinger, gå til Innstillinger>Tale>Samtalevirkemåte>Ventetidsmeldinger.

Important

Fordi Text LLM sanntidsagentløsningen bruker flere sekvensielle trinn (ASR, LLM, TTS), opplever innringere noen sekunders stillhet mellom å snakke og høre et svar. Sett passende forventninger til brukerne, for eksempel ved å bruke en frase som «Ett øyeblikk, jeg søker opp det for deg...».

Skjermbilde av meldingsdialogboksen Ventetid.

Evaluering av agent i sanntid

Sanntidsagenter støtter å sende tekst under evaluering, men lydbehandling støttes ikke.