Merk
Tilgang til denne siden krever autorisasjon. Du kan prøve å logge på eller endre kataloger.
Tilgang til denne siden krever autorisasjon. Du kan prøve å endre kataloger.
Merknad
Denne artikkelen beskriver funksjoner som brukes i agenter eller agentstrømmer drevet av standardledningsnettet.
For å deployere en sanntidsagent, aktiver sanntidsmodellen, konfigurer kjerneinnstillingene for agenten, og sett deretter opp de nødvendige kanalspesifikke funksjonene. Du kan distribuere samme agent til talekanalen, digitale meldingskanaler, eller begge deler.
Merknad
Sanntidsagenter er i forhåndsversjon for digitale meldingskanaler. Forhåndsversjonsfunksjonene er ikke ment for produksjonsbruk og kan ha begrenset funksjonalitet. Disse funksjonene er underlagt ekstra vilkår for bruk. Microsoft gir dem før en offisiell lansering slik at kundene kan få tidlig tilgang og gi tilbakemeldinger.
Sett opp og aktiver sanntidsagenter
Opprett en ny agent, og konfigurer de grunnleggende detaljene, for eksempel et beskrivende navn og formålet med agenten i beskrivelsen.
Gå til agentens stemmeinnstillinger og slå på Aktiver stemme. I Tale-type, velg Real-time.
Important
Denne innstillingen er et engangsvalg. Etter at du har valgt sanntid, kan du ikke bytte tilbake til en grunnleggende agenttype. For å bruke en enkel agent, opprett en ny agent. Denne innstillingen er nødvendig selv om du bruker agenten på en digital meldingskanal.
Velg modellen du vil bruke, GPT-Realtime, GPT-Realtime-Mini, eller GPT-5-Chat (forhåndsvisning). GPT-5-Chat (Forhåndsvisning) er en tekst-LLM-stemmemodell som genererer stemmesvar gjennom Microsoft Neural Text-to-Speech (TTS).
Lær mer om hvordan disse modellene fungerer basert på deres støttede regioner og utrullingshensyn. Tabellen nedenfor beskriver scenarioene der du kan bruke ulike modeller.Scenario GPT-Realtime GPT-5-Chat (forhåndsvisning) Samtalestil Innebygde tale-til-tale-interaksjoner Tale konverteres til tekst for resonnement og syntetiseres deretter tilbake til tale Ventetid Laveste latens for naturlige samtaler Høyere latens enn GPT-Realtime Stemmetilpasning Støtter de innebygde sanntidstalealternativene som er tilgjengelige for sanntids stemmeagenter Støtter Microsoft Neural Text-to-Speech (TTS), inkludert et bredere talekatalog og tilpassede stemmemodeller Opplevelser med merkevarestemmer Begrensede tilpasningsmuligheter Anbefalt når du trenger en tilpasset eller merkevaretilpasset stemmeopplevelse Regional utplasseringsfleksibilitet Begrenset til støttede sanntidsmodellregioner Større fleksibilitet gjennom talegjenkjenning og TTS-tjenester Best egnet for Naturlige talesamtaler med lav forsinkelse og interaksjoner uten faste rammer Scenarier som krever avansert stemmetilpasning, tilpassede stemmer, samsvarskrav eller regional distribusjonsfleksibilitet Tips
- Bruk GPT-Realtime når naturlig samtalekvalitet og lav ventetid er hovedkravene.
- Bruk GPT-Realtime-Mini (Forhåndsvisning) for scenarioer som krever raske taleinteraksjoner med lavere latens og ressursbruk.
- Bruk GPT-5-Chat (Forhåndsvisning) når stemmetilpasning, tilpassede stemmemodeller eller distribusjonsfleksibilitet er viktigere enn responsforsinkelse.
Gå til agentens sikkerhetsinnstillinger , og velg Ingen godkjenning.
Kunnskap og verktøy
Du kan konfigurere agenten til å bruke kunnskap og verktøy. Finn ut mer i sammendrag av kunnskapskilder, Legg til verktøy i egendefinerte agenter og Verktøy, kunnskap, MCP og API.
Nestede agenter (forhåndsvisning)
Agenter i sanntid støtter kun barneagenter.
Important
Sørg for at underordnede agentbeskrivelser ikke overlapper med emnebeskrivelser. Definer eksplisitt aktiveringsrekkefølge i agentens instruksjoner.
Emner
Sanntidsagenter støtter alle temaer som er konfigurert i Copilot Studio. Bruk emner for å definere deterministiske atferder som hilsener, forretningsregler og eskalering, mens modellen du valgte håndterer samtalesvar under kjøring. Finn ut mer i Velg hvordan du kontrollerer samtalen.
Beste fremgangsmåter
Bruk emner bare når deterministisk virkemåte er nødvendig.
Bruk statisk tekst i hilsningsmeldinger for det raskeste første svaret. Dynamiske meldinger med variabler og uttrykk øker den innledende ventetiden.
Deaktiver temaet Samtalestart hvis du vil at sanntidsagentmodellen skal håndtere hilsenen. Ellers spilles hilsenen som er konfigurert i samtalestartemnet , i stedet for talemodellhilsenen.
La agentmodellen i sanntid håndtere generelle samtaler og oppfølgingsspørsmål.
Inkluder en eksplisitt handling i emnet Ved feil , for eksempel overføring eller avslutt samtale. Feilbehandling bare for meldinger er ikke tilstrekkelig. Uten et deterministisk neste steg kan kundene oppleve stillhet for taleagenter eller fastlåste samtaler for meldingskanaler, noe som fører til forvirring og dårlig kundeopplevelse.
Bruk eksplisitte emne- og verktøybeskrivelser til å erklære eierskap for datainnsamling. Finn ut mer i Skrive effektive emne- og verktøybeskrivelser.
Støtte for emnenode
Følgende liste beskriver temastøtte i sanntidsagenter:
Betingelsesnode
| Funksjon | Kundestøtte |
|---|---|
| Hvis/Else-forgrening | Støttes |
| Power Fx-uttrykk | Støttes |
| Reprosessering av sporutfylling | Støttes |
Meldingsnode
| Funksjonen | Kundestøtte |
|---|---|
| Grunnleggende melding | Støttes |
| Meldingsvariasjoner | Støttes |
| Variabelinnsetting | Støttes |
| SSML | Kun talekanal |
| Rich Media/Dynamiske kort | Støttes kun for digitale meldingskanaler. Denne funksjonen er i forhåndsversjon. |
| Hurtigsvar | Støttes kun for digitale meldingskanaler. Denne funksjonen er i forhåndsversjon. |
Spørsmål-noden
| Funksjon | Kundestøtte |
|---|---|
| Ledetekst | Støttes |
| Automatisk sperring | Støttes ikke |
| Utfylling av spor | Støttes |
| Hopp-over atferd/Grådig utfylling av spor | Støttes |
| Spør igjen / Prøv på nytt | Støttes |
| Ugyldig svarbehandling | Støttes |
| Emneavbrudd | Støttes |
| Forstyrrelse | Støttes kun for talekanal. |
| Egendefinert reprompt-melding | Støttes |
| DTMF inndata | Støttes kun for talekanal. |
| Registrering av stillhet | Støttes kun for talekanal. |
HTTP-node
| Funksjonen | Kundestøtte |
|---|---|
| HTTP-metoder: GET, POST, PUT, PATCH, DELETE | Støttes |
| URL-endepunkter | Støttes |
| Hoder og nyttelaster | Støttes |
| Svaranalyse og skjema | Støttes |
| Variabelkartlegging | Støttes |
| Feilbehandling | Støttes |
Verktøynode
| Funksjon | Kundestøtte |
|---|---|
| Power Automate-flyt | Støttes |
| Aktivering av verktøy | Støttes |
| Inndata-/utdatakartlegging | Støttes |
| Ny ledetekst | Støttes |
Sett variabelverdiknute
| Funksjonen | Kundestøtte |
|---|---|
| Direkte tildeling | Støttes |
| Uttrykkstilordning | Støttes |
| Variabel til variabel | Støttes |
Emnebehandlingsnode
| Funksjonen | Kundestøtte |
|---|---|
| Avslutt gjeldende emne | Støttes |
| Avslutte alle emner | Støttes |
| Avslutt samtale | Støttes |
| Gå til trinn | Støttes |
| Brukerinndata for intensjonsgjenkjenning | Støttes |
| Gå til et annet emne | Støttes |
Overfør samtalenode
| Funksjonen | Kundestøtte |
|---|---|
| Overfør til agent | Støttes |
| Overføring av eksternt telefonnummer | Støttes kun for talekanal. |
Avansert
| Funksjon | Kundestøtte |
|---|---|
| Opprett generative svar | Støttes |
Systemutløserstøtte
| Utløser | Kundestøtte | Detaljer |
|---|---|---|
| Ved samtalestart | Støttes | Starter når en ny samtale begynner |
| På Snakk med representant | Støttes | Overføringer til menneskelig agent |
| Ukjent emne/ukjent hensikt | Støttes ikke | Tilbakefall når ingen emne samsvarer |
| OnSelectIntent (flere emner samsvarer) | Støttes ikke | Entydighet mellom lignende emner |
| Tilbakestill samtale (OnSystemRedirect) | Støttes | Fjerner variabler og starter flyten på nytt |
| Ved pålogging | Støttes ikke | |
| Ukjent DTMF-tastetrykk | Støttes | Ukartlagt tastaturinput. Gjelder kun for talekanal. |
| Agenten velger / Brukeren sier et uttrykk | Støttes | Agent velger emne basert på hensikt |
| En melding er mottatt | Støttes ikke | Øker ventetiden |
| En egendefinert klienthendelse oppstår | Støttes ikke | Bare ved øktstart |
| Samtaleoppdateringen | Støttes ikke | Medlemmer lagt til eller fjernet, øktendringer |
| Den påkalles | Støttes ikke | Krever synkron brukergrensesnitt |
| Det er omadressert | Støttes | |
| Brukeren er inaktiv i en spesifisert periode. | Støttes | Tidsavbrudd ved brukerinaktivitet. Gjelder kun digitale meldingskanaler. |
| Registrering av stillhet | Støttes | Gjelder kun for talekanal. |
| En plan fullføres | Støttes ikke | |
| AI-respons generert | Støttes ikke | |
| Ved feil | Støttes | Håndterer orkestreringsfeil |
Sende variabler mellom emner og språkmodellen
Når du bruker emner i en hybrid samtaleflyt, er det viktig å forstå hvordan du sender variabler mellom emner og språkmodellen i sanntid for å bygge pålitelige, staselige interaksjoner. Denne prosessen gjelder på tvers av kanaler.
Denne funksjonaliteten fungerer gjennom følgende prosess:
Du sender inndatavariabler som er definert i et emne til emnet på aktiveringstidspunktet, slik at språkmodellen kan gi strukturerte data til den deterministiske flyten.
Du returnerer utdatavariabler definert i et emne til språkmodellen på slutten av emnekjøringen som strukturerte nøkkelverdipar.
Utdata fra verktøykall følger samme mønster.
Språkmodellen fylles ut med samtalekontekst, inkludert nøkkelverdipar for verktøyanrop. Du returnerer imidlertid bare eksplisitt definerte utdatavariabler som strukturerte data.
Variabelbeskrivelsen hjelper modellen å forstå hvordan variabelen skal brukes under en samtale. Gi klare og beskrivende definisjoner.
Finn ut mer i Behandle emneinndata og -utdata.
Flerspråklig støtte
Legg til alle sekundære språk du vil bruke. Lokaliseringsstrenger kreves ikke for sanntidsflyter. For deterministiske emnemeldinger må du imidlertid oppgi de oversatte meldingene. Finn ut mer i Konfigurer og opprett flerspråklige agenter.
Sanntidsmodellen kan forstå og svare på mange språk. Microsoft validerer imidlertid ikke formelt alle språk for generell tilgjengelighet.
Per juni 2026 er følgende språk formelt validert:
- Nederlandsk (Nederland) (nl-NL)
- Engelsk (Australia) (en-AU)
- Engelsk (USA) (en-US)
- Engelsk (Storbritannia) (en-GB)
- Fransk (Canada) (fr-CA)
- Fransk (Frankrike) (fr-FR)
- Tysk (Tyskland) (de-DE)
- Italiensk (Italia) (it-IT)
- portugisisk (Brasil) (pt-BR)
- Spansk (Spania) (es-ES)
- Spansk (USA) (es-US)
Microsoft fortsetter å validere andre språk og legger dem til etter at sertifiseringen er fullført. Du kan legge til et hvilket som helst språk som støttes av Copilot Studio. Språk som ikke er fullstendig sertifisert for kvalitet på GA-nivå, bør imidlertid testes grundig før produksjonsdistribusjon.
Important
Teknisk språkfunksjonalitet er ikke lik et støttet eller sertifisert språk. Hvis du har tenkt å distribuere agenter på andre språk enn engelsk, bør du utføre omfattende testing med virkelige innringere og anropsflyter før du går direkte.
Kontekstvariabler
En sanntidsagent støtter kontekstvariabler som gjør at den kan oppføre seg mer intelligent ved å bære informasjon om samtalen og kunden. De tilgjengelige kontekstvariablene avhenger av kanalen. Dette settet omfatter:
| Kontekstvariabel | Beskrivelse |
|---|---|
| Kanal-ID | Identifiserer kommunikasjonskanalen som brukes for samhandlingen. Gjelder kun for talekanal. |
| Telefonnummer for anroper (ANI) | Det opprinnelige telefonnummeret til anroperen. Gjelder kun for talekanal. |
| Anropsnummer (DNIS) | Måltelefonnummeret som anroperen ringte. Gjelder kun for talekanal. |
| Samtale-ID | En unik identifikator for den aktive samtaleøkten. |
| SIP-overskrifter | Støttet SIP-header-nøkkel-verdi-par knyttet til samtalen. Gjelder kun for talekanal. |
| Gjeldende dato (UTC) | Gjeldende dato i Coordinated Universal Time (UTC), angitt ved kjøretid for å tillate datobevisste svar. |
| Gjeldende klokkeslett (UTC) | Gjeldende tid i Coordinated Universal Time (UTC), angitt ved kjøretid for å tillate tidsbevisste svar. |
Lær mer om alle andre kontekstvariabler, inkludert digital melding og tilpassede kontekstvariabler, i Configure context variables for agents.
Kanalspesifikke innstillinger
Agentstemme
Velg stemmen agenten bruker ved å velge agenten din og gå til Innstillinger>voice select-tale>. Sanntidsagenter støtter følgende stemmer:
- Legering
- Ash
- Ballade
- Coral
- Ekko
- Sage
- Glimmer
- Vers
- Marin
- Cedar
Merknad
- Agentens stemme er for din sanntidsagent og er ikke den som er konfigurert i Copilot Service administrasjonssenter.
- For å matche Dynamics-systemets meldingsstemmer med din sanntidsagent, bruk kun følgende støttede stemmer: Alloy, Echo, Shimmer eller Ash.
- Agenter som bruker Text LLM, GPT-5-Chat (Preview), genererer stemmesvar gjennom Microsoft Neural Text-to-Speech (TTS). Denne modellen støtter et bredere stemmekatalog og tilpassede stemmemodeller, noe som gjør den egnet for organisasjoner som krever merkevarebaserte stemmeopplevelser eller avansert stemmetilpasning.
Talefølsomhet
Talefølsomhet taleaktivitetsregistrering (VAD) bestemmer når agenten skal svare etter at innringeren er ferdig med å snakke.
Forståelse av VAD-typer
Sanntidsagenter støtter to VAD-tilnærminger:
Serverbasert VAD – basert på lyd (stillhet)
Oppdager slutten av talen basert på lydsignaler (lydvarighet, volum)
Reagerer raskt når stillhet oppdages
Best for strukturerte interaksjoner, korte svar, støyende miljøer
Semantisk VAD – basert på setningskontekst
Bestemmer fullførelse basert på betydningen av det som ble sagt
Tilpasser seg naturlige pauser, fyllord, etterfølgende tale
Best for: Samtaleinteraksjoner, komplekse spørsmål, åpne diskusjoner
Velg riktig VAD
Bruk serverbasert VAD når alle følgende betingelser er oppfylt:
- Samhandlinger er strukturert (menynavigasjon i IVR-stil).
- Svarene er korte og forutsigbare.
- Bakgrunnsstøy er en bekymring (semantisk VAD kan vente for lenge).
- Du vil ha rask og presis replikkveksling.
Bruk semantisk VAD når alle følgende betingelser er sanne:
- Samtaler er åpne.
- Innringere kan nøle eller bruke fyllord ("um", "la meg tenke ...").
- Spørsmålene er komplekse (innringere forklarer situasjoner).
- Naturlig samtaleflyt prioriteres.
Konfigurer serverbasert VAD
Gå til Innstillinger>>Taleinnstillinger>Taleinndatafølsomhet>>basert på lyd (stillhet).
| Parameter | Beskrivelse | Forhåndsinnstilt | Anbefalt område |
|---|---|---|---|
| Terskel | Følsomhet for tale kontra støy (0-1 skala) | 0.6 | 0.5-0.7 |
| Prefiksutfylling (ms) | Lyd som fanges opp før tale starter | 300 ms | 200–500 ms |
| Stillhetsvarighet (ms) | Stillhet kreves for å avslutte svingen | 750 ms | 750-1000 ms |
Terskel
- Lavere (0,3-0,4): Mer følsom; plukker opp stille tale, kan utløse bakgrunnsstøy.
- Høyere (0,7-0,9): Mindre følsom; krever høyere tale, reduserer falske utløsere.
- Anbefalt: Start med 0,5; øk hvis bakgrunnsstøy forårsaker falske triggere.
Prefiksutfylling
- Fanger opp lyd før talegjenkjenning (hindrer at det kuttes av det første ordet).
- Lavere (200 ms): Raskere respons; kan gå glipp av første stavelse.
- Høyere (500 ms): Sikrere fangst; liten forsinkelse.
- Anbefalt: 300 ms (god balanse).
Stillhetens varighet
- Hvor lenge innringeren må være stille før agenten svarer.
- Lavere (500 ms): Rask svinging; kan avbryte hvis anroperen stanser midt i tanken.
- Høyere (1000 ms): Mer tålmodig; kan føles treg.
- Anbefalt: Start med 750 ms.
Konfigurer semantisk VAD
Gå til Innstillinger>>Taleinnstillinger>Taleinndatafølsomhet>>basert på setningskontekst.
Parameter: Iver (hvor raskt agenten reagerer etter semantisk fullføring)
| Innstilling | Virkemåte | Best egnet for |
|---|---|---|
| Lav | Venter lenger, veldig tålmodig | Innringere som tenker høyt, hyppige pauser |
| Middels | Balansert (standard) | Generelle samtaler |
| Høy | Reagerer raskt | Raske interaksjoner, enkle spørsmål |
DTMF-konfigurasjon
Dual-Tone Multi-Frequency (DTMF) lar innringere taste inn informasjon ved å bruke telefonens tastatur.
Du kan aktivere DTMF for agenten din både på emne- og globalt nivå. Hvis du vil angi den på globalt nivå, velger du agenten din og går til> fortalesamtalevirkemåte>for innstillinger>.
Important
Når du bygger kun DTMF-opplevelser, konfigurere DTMF-inngang for hver inngangsnode, inkludert menyvalg og flersifrede inndata som kontonumre eller PIN-koder. Sørg for at alle mulige kundeinndatastier har tilsvarende DTMF-kartlegginger slik at brukerne kan navigere og fullføre samtalen kun ved hjelp av tastaturinput.
Registrering av stillhet
Stillhetsdeteksjon gjør det mulig for sanntidsagenter å gjenkjenne når en innringer ikke gir noen input i en spesifisert periode. Konfigurer lyddempering som en global stemmeinnstilling for agenten ved å gå til Innstilling> avlydoppførselsstillelse> fortalesamtale>.
Important
- Stilhetsdeteksjon er ikke slått på som standard. Hvis brukeren ikke snakker, venter agenten på ubestemt tid uten å spørre. Slå eksplisitt på lydløsing og konfigurer en reprompt-melding for å håndtere stille innringere.
- Standard tidsavbrudd for stillhetsregistrering er 7 000 ms (7 sekunder). Valider denne verdien mot ditt spesifikke brukstilfelle og oppringermiljø før du distribuerer til produksjon. Sju sekunder kan føles for lenge for noen innringere eller for korte for andre, avhengig av samhandlingens natur, for eksempel komplekse spørsmål eller støyende miljøer. Test med virkelige anropsdata for å bestemme riktig terskel for scenarioet.
- Før du aktiverer gjenkjenning av stillhet, må du kontrollere at virkemåten du konfigurerer i emnet for gjenkjenning av stillhet (for eksempel Escalate, Hang Up, Reprompt) er tilsiktet og passer for brukstilfellet. Feilkonfigurert tilbakefallsvirkemåte, for eksempel utilsiktet å sette tilbakefallet til Escalate når hensikten er å legge på, eller omvendt, kan resultere i uventede anropsresultater.
Forsinkelsesmeldinger
Legg til ventetidsmelding eller musikk til agenten din når bakgrunnsoperasjoner tar lengre tid enn forventet. Hvis du vil konfigurere ventetidsmeldinger, gå til Innstillinger>Tale>Samtalevirkemåte>Ventetidsmeldinger.
Important
Fordi Text LLM sanntidsagentløsningen bruker flere sekvensielle trinn (ASR, LLM, TTS), opplever innringere noen sekunders stillhet mellom å snakke og høre et svar. Sett passende forventninger til brukerne, for eksempel ved å bruke en frase som «Ett øyeblikk, jeg søker opp det for deg...».
Evaluering av agent i sanntid
Sanntidsagenter støtter å sende tekst under evaluering, men lydbehandling støttes ikke.