Nota
O acesso a esta página requer autorização. Pode tentar iniciar sessão ou alterar os diretórios.
O acesso a esta página requer autorização. Pode tentar alterar os diretórios.
Note
Este artigo descreve as funcionalidades usadas em agentes ou fluxos de agentes alimentados pelo arnês padrão.
Os agentes em tempo real permitem conversas naturais e conscientes do contexto através de canais de voz e mensagens digitais. Os clientes podem interagir diretamente com um agente alimentado por IA e receber respostas imediatas e relevantes, sem depender dos tradicionais menus interativos de resposta por voz (IVR) ou de experiências scriptadas. Para canais de voz, os agentes em tempo real suportam interações totalmente orientadas por voz via PSTN e SIP, incluindo entrada multifrequência de tom duplo (DTMF), barge-in, deteção de atividade de voz (VAD) e outras capacidades de telefonia.
Pode usar a mesma configuração de agente em tempo real tanto em canais de voz como de mensagens digitais, proporcionando uma experiência consistente independentemente da forma como os clientes decidam interagir.
Note
- Os agentes em tempo real estão em pré-visualização para os canais de mensagens digitais. As funcionalidades de pré-visualização não se destinam a utilização em produção e podem ter uma funcionalidade restrita. Estas caraterísticas estão sujeitas aos termos de utilização suplementares e estão disponíveis antes do lançamento oficial para que os clientes possam obter acesso antecipado e fornecer feedback.
- Aprenda sobre agentes básicos na visão geral de agentes básicos.
- Saiba mais sobre o desenvolvimento de agentes em Visão Geral da otimização de design de agentes em tempo real.
A tabela seguinte descreve as capacidades fornecidas pelos agentes em tempo real:
| Capacidade | Description |
|---|---|
| Compreensão da linguagem natural | Compreende as intenções dos clientes sem exigir frases específicas ou opções de menu. |
| Implementação multicanal | Implemente o mesmo agente para voz, mensagens digitais (pré-visualização), ou ambos. |
| Design nativo de voz | Desenvolvido especificamente para interação oral com um fluxo de conversa natural. Aplicável apenas ao canal de voz. |
| Resposta em tempo real | Latência mínima com turnos instantâneos e pausas naturais. |
| Consciência do contexto | Mantém o estado da conversa e faz referência a interações anteriores. |
| Suporte multilíngue | Compreende e responde em várias línguas. |
| Integração flexível | Liga-se a CRMs, bases de conhecimento, APIs e fluxos do Power Automate. |
| Controlo determinístico | Combina conversa de IA com fluxos estruturados de tópicos para conformidade e consistência. |
| Modelo de voz de LLM de texto | Utiliza uma arquitetura de voz baseada em texto que converte a fala em texto, utiliza o modelo GPT-5-Chat (Preview) para compreender a intenção e gerar respostas, e depois sintetiza a resposta de volta à fala. Este modelo suporta personalização avançada de voz através do Microsoft Neural Text-to-Speech (TTS), incluindo modelos de voz personalizados e maior flexibilidade de implementação. |
Pré-requisitos
Antes de começar, certifique-se de que tem os seguintes pré-requisitos para licença, função e autorização:
- Dynamics 365 Contact Center com os seguintes canais configurados conforme as suas necessidades. Para saber mais, consulte Canais de Provisão no Dynamics 365 Contact Center.
- Canal de voz e encaminhamento de chamadas
- Canais de mensagens digitais
- Função de administrador omnicanal com permissões para configurar canais de voz ou mensagens e o fluxo de trabalho necessário.
- Copilot Studio para criação e configuração de agentes.
- Papel de criador do Copilot Studio com permissões para criar e configurar agentes.
Note
- Para obter informações mais completas e atualizadas sobre licenciamento e faturação do Copilot Studio, consulte o Guia de Licenciamento Microsoft Copilot Studio.
- Para informações mais completas e atualizadas sobre o licenciamento e a faturação do Dynamics 365 Contact Center, consulte o Guia de Licenciamento Microsoft Dynamics 365.
Pré-requisitos regionais
Esta funcionalidade utiliza GPT-Realtime, GPT-Realtime-Mini (Pré-visualização) ou GPT-5-Chat (Pré-visualização).
- O GPT-Realtime está alojado na América do Norte e pode processar dados fora da geografia Azure do recurso de IA quando utiliza uma implementação Global Standard.
- O GPT-Realtime-Mini (Pré-visualização) está alojado na Austrália e pode processar dados fora da geografia Azure do recurso de IA quando se utiliza uma implementação de Global Standard.
- O GPT-5-Chat (Pré-visualização) suporta processamento de dados dentro da região nos Estados Unidos, União Europeia, Reino Unido e Austrália quando implementado numa região suportada.
O armazenamento de dados mantém-se na geografia Azure do recurso de IA.
Saiba mais em Compreender os tipos de implementação em Microsoft Foundry Models e Dados, privacidade e segurança para Azure Direct Models no Microsoft Foundry.
Note
A partir de julho de 2026, aplicam-se as seguintes limitações regionais:
- Os clientes da América do Norte podem usar o GPT-Realtime e o GPT-5-Chat (Pré-visualização) sem configuração regional adicional.
- Os clientes australianos podem usar GPT-Realtime-Mini (Pré-visualização) e GPT-5-Chat (Pré-visualização) sem configuração regional adicional.
- Os clientes da EU Data Boundary podem usar GPT-5-Chat (Pré-visualização) com processamento de dados na região, mas não podem usar GPT-Realtime nem GPT-Realtime-Mini (Pré-visualização), porque esses modelos requerem processamento entre regiões geográficas.
- Os clientes do Reino Unido podem usar o GPT-5-Chat (Pré-visualização) com processamento de dados na região, mas o GPT-Realtime e o GPT-Realtime-Mini (Pré-visualização) requerem processamento cruzado geográfico.
- Os clientes noutras regiões têm de permitir o processamento entre regiões para GPT-Realtime e GPT-Realtime-Mini (Pré-visualização). A disponibilidade regional do GPT-5-Chat (Preview) depende do suporte regional de implantação.
IA responsável e aviso de conformidade
As avaliações de segurança e IA responsável da Microsoft encontraram limitações comportamentais relevantes para a segurança que poderiam resultar num risco maior de o agente produzir conteúdos potencialmente prejudiciais. Os clientes devem tomar medidas para mitigar estes riscos, conforme detalhado na nota de transparência para agentes em tempo real.
És o único responsável por utilizar o Dynamics 365, esta funcionalidade e qualquer funcionalidade ou serviço relacionado, em conformidade com todas as leis aplicáveis. Os clientes também são responsáveis por cumprir as políticas da Microsoft. Estas políticas incluem o Código de Conduta dos Serviços de IA Empresarial da Microsoft.
Limitações conhecidas
As seguintes limitações aplicam-se a agentes em tempo real para canais de mensagens digitais enquanto a funcionalidade está em pré-visualização:
- Autenticação: OAuth e autenticação Microsoft não são suportadas. Configura o agente sem autenticação. Saiba mais em Configurar autenticação de utilizadores.
- Duração da conversa: Conversas que ultrapassam os 60 minutos escalam automaticamente para um agente humano.
- Análises: Os relatórios de análise do Copilot Studio podem estar incompletos para agentes em tempo real. Saiba mais na visão geral de Analytics.
O registo de transcrições de conversas para agentes de voz Text LLM é limitado. Algumas mudanças de conversa e respostas dos agentes podem não ser captadas nas transcrições das chamadas, o que pode afetar a análise e a monitorização.