Perguntas frequentes sobre a Conexão de Dados do Microsoft Graph

O Data Connect do Microsoft Graph permite que os desenvolvedores criem aplicativos que os clientes podem fornecer acesso gerenciado a seus conjuntos de dados em escala do Microsoft Graph. Este artigo fornece dicas que ajudam você a aproveitar o recurso Microsoft Graph Data Connect. Para obter uma introdução ao Data Connect do Microsoft Graph, consulte a visão geral.

Para obter mais dúvidas, consulte solução de problemas ou crie uma nova solicitação de Suporte do Azure com as seguintes seleções:

  • Tipo de serviço: escolha APIs do Microsoft Graph High-Capacity
  • Tipo de problema: escolha Microsoft Graph Data Connect (MGDC)

Uma captura de tela que mostra a seleção de tópicos em uma solicitação de Suporte do Azure para se referir a um problema com o Microsoft Graph Data Connect.

A Conexão de Dados do Microsoft Graph é adequada para mim?

O Microsoft Graph Data Connect e as APIs do Microsoft Graph fornecem acesso aos mesmos dados subjacentes, mas de maneiras muito diferentes. O Microsoft Graph Data Connect foi projetado para extrair grandes quantidades de conjuntos de dados em massa, escalonáveis para toda a sua organização; enquanto as APIs do Microsoft Graph são adequadas para acessar uma pequena quantidade de dados de usuários e grupos selecionados em sua organização.

Por exemplo, você pode usar o Microsoft Graph Data Connect para fazer uma extração inicial dos dados de email do último ano e, em seguida, usar as APIs do Microsoft Graph para analisar emails em tempo real no futuro. O Microsoft Graph Data Connect e as APIs do Microsoft Graph são ferramentas diferentes para trabalhos diferentes. É importante pensar sobre o qual método de acesso melhor se encaixa em seu cenário. Para obter mais informações, consulte Quando devo usar a API do Graph ou o Microsoft Graph Data Connect.

Quais são alguns cenários para os quais as empresas usam dados do Microsoft 365?

Há vários casos de uso que podem ser alimentados por dados do Microsoft 365. A seguir estão alguns dos principais cenários nos quais os clientes estão interessados:

  • Análise de relacionamento com o cliente: para líderes de negócios comerciais, vá além dos insights tradicionais de CRM e entenda as interações e relacionamentos com os clientes com base em padrões de comunicação e colaboração.

  • Análise de processos de negócios: para melhores operações, veja como o trabalho realmente flui pela organização no dia-a-dia. Identifique os processos manuais e os gargalos do fluxo de trabalho que devem ser automatizados ou otimizados.

  • Análise de segurança e conformidade: para proteger dados confidenciais, saiba como os funcionários estão usando e compartilhando informações confidenciais. Implemente detecção de anomalias, inteligência de ameaças, análise de log de auditoria, gerenciamento de riscos e análise forense legal.

  • People Productivity Analytics: para impulsionar a transformação, exporte suas métricas de produtividade do Viva para que você possa converter insights em soluções com adoção digital, reuniões e conteúdo inteligentes, locais de trabalho híbridos e mudança cultural.

Qual a diferença entre o Viva Insights e o Microsoft Graph Data Connect?  

O Viva Insights e o Microsoft Graph Data Connect são complementares. Embora ambos dependam do Microsoft 365, o Viva Insights e o Data Connect atendem a públicos e necessidades diferentes.

Quando os clientes estão procurando insights e análises além do Viva Insights, o Data Connect fornece a extensibilidade para fornecer requisitos personalizados. Por exemplo, ele oferece registros e transcrições de chamadas do Teams, bem como conjuntos de dados do SharePoint Online, que não estão atualmente no escopo do Viva Insights. Além disso, os dados brutos do Data Connect fornecem detalhes granulares que, de outra forma, não estariam disponíveis no Viva Insights.

Há alguma sobrecarga inicial com o Microsoft Graph Data Connect?

Como o Data Connect foi projetado para extrair grandes quantidades de dados em massa, ocorre alguma sobrecarga antes que os dados possam ser extraídos. Essa sobrecarga é de aproximadamente 45 minutos, ou seja, todos os pipelines levarão no mínimo esse tempo, independentemente do tamanho dos dados. Se a sobrecarga inicial for muito longa para seu caso de uso, crie uma nova solicitação de Suporte do Azure, incluindo os detalhes mencionados na seção anterior.

Em quais regiões o Microsoft Graph Data Connect está disponível?

O Microsoft Graph Data Connect está disponível atualmente em várias regiões nas seguintes geografias: América do Norte, Europa, Ásia-Pacífico, Reino Unido e Austrália. Outras regiões estarão disponíveis no futuro.

Para obter uma lista de regiões e mapeamentos do Office para o Azure, consulte Conjunto de dados, regiões e coletores.

Quais conjuntos de dados estão disponíveis por meio do Microsoft Graph Data Connect?

Os seguintes tipos de conjuntos de dados estão disponíveis:

  • Básico: conjuntos de dados gerados a partir de conteúdo bruto criado pelo cliente e entradas de aplicativos e serviços do Microsoft 365 (por exemplo, conjuntos de dados do Microsoft Entra ID, Outlook ou Teams). 

  • Limpo: conjuntos de dados gerados por normalização e eliminação de duplicação de conjuntos de dados básicos ou conjuntos de dados criados a partir de sinais de atividade ou comportamento do usuário no Microsoft 365 (por exemplo, conjuntos de dados do SharePoint, Office 365).  

  • Coletado: conjuntos de dados gerados de forma personalizada para um caso de uso específico ou cenários de análise, ou conjuntos de dados de aplicativos de análise do Microsoft 365 internos para extensibilidade, por exemplo, métricas do Viva Insights).

Vários conjuntos de dados para cada um dos seguintes estão disponíveis:

  • Teams
  • Outlook
  • Microsoft Entra ID
  • OneDrive/Sharepoint
  • Viva Insights

Novos conjuntos de dados são adicionados ao Microsoft Graph Data Connect regularmente. Para obter uma lista completa, consulte Conjunto de dados, regiões e coletores.

Quais conjuntos de dados estão em versão prévia e quais estão geralmente disponíveis?

Para obter informações sobre conjuntos de dados que geralmente estão disponíveis ou apenas em visualização, consulte Conjunto de dados, regiões e coletores.

Como a cobrança é calculada?

O Microsoft Graph Data Connect cobra os clientes mensalmente e também faz arredondamento fracionável ao calcular a fatura. Cada execução de pipeline é cobrada separadamente.

Por exemplo, um cliente tem 20 execuções de pipeline no mês, cada uma resultando em 500 linhas. No total, o cliente executa pipelines para 10.000 linhas naquele mês. No entanto, sua conta não será de 10.000 linhas/1000 linhas = 10 unidades.

Em vez disso, o cliente será cobrado por 20 unidades porque o Microsoft Graph Data Connect arredonda frações. Como 500 linhas/1000 linhas = 0,5 e 0,5 é uma fração, ele arredonda para 1. O cliente é cobrado uma unidade por execução de pipeline, o que resulta em 20 unidades cobradas no total.

O que posso fazer se um conjunto de dados ainda não tiver suporte para meu locatário?

Para conjuntos de dados de visualização, verifique se você atende aos critérios descritos em Conjuntos de dados, regiões e coletores. Esses conjuntos de dados estão disponíveis apenas para clientes que optaram por eles explicitamente.

Para dúvidas, crie uma nova solicitação de Suporte do Azure, incluindo os detalhes mencionados na seção anterior.

Para quais cenários o Microsoft Graph Data Connect é melhor?

As organizações que podem explorar grandes conjuntos de dados que potencializem suas ferramentas de produtividade podem obter insights incríveis sobre os desafios e as oportunidades que podem encontrar. Os clientes criam aplicativos em vários cenários, como redes organizacionais para análise de produtividade de pessoas, compartilhamento excessivo de informações para análise de segurança e conformidade, pontos fortes do relacionamento com vendedores para análise de relacionamento com o cliente e muito mais.

É possível que meus dados permaneçam dentro da assinatura da organização com a Conexão de Dados do Microsoft Graph?

O Microsoft Graph Data Connect respeita o limite do locatário organizacional ao fornecer os conjuntos de dados solicitados. Os recursos do Azure e os serviços do Microsoft 365 devem estar localizados na mesma locação do Microsoft Entra para acessar seu conjunto de dados do Microsoft 365. O acesso ao conjunto de dados entre locatários não está disponível no momento.

As entidades de serviços são requeridas com a Conexão de Dados do Microsoft Graph?

Ao criar o pipeline do Azure Synapse ou do Data Factory, você precisa fornecer uma entidade de serviço ao serviço vinculado do Microsoft 365. No Azure, uma entidade de serviço é uma identidade de segurança que representa um aplicativo ou serviço (e não um usuário). O Data Connect usa essa entidade de serviço como sua identidade ao obter acesso autorizado aos dados do Microsoft 365.

Se você criar um Aplicativo Gerenciado do Azure para que outras pessoas usem em seus locatários, você ainda irá fornecer uma entidade de serviço para uso do aplicativo. A entidade de serviço ficará armazenada em seu (do fornecedor) locatário. No entanto, se o aplicativo precisar de outras entidades de serviço, seu cliente (instalador) irá criá-las em seu próprio locatário. Por exemplo, o pipeline do Azure Synapse ou do Azure Data Factory provavelmente precisa de acesso a um recurso de armazenamento no Azure. O cliente criaria a entidade de serviço com permissões para a conta de armazenamento para uso do pipeline.

Para obter mais informações sobre como criar seu aplicativo com o Azure Synapse ou o Azure Data Factory, consulte o início rápido do Data Connect.

Desde que o escopo dos dados que estão sendo extraídos permaneça o mesmo para conjuntos de dados, colunas, usuários e coletor, a execução do pipeline não exigirá uma nova solicitação de consentimento. Em vez disso, o pipeline usa o consentimento ativo aprovado. Executar um pipeline com o mesmo escopo para datas diferentes não requer um novo consentimento.

Posso eliminar a duplicação de emails quando necessário?

Quando você extrair emails do conjunto de dados Message, geralmente haverá vários objetos JSON para o mesmo email. Essas duplicatas existem porque, quando um email é enviado para várias pessoas, há uma cópia do email na caixa de correio de cada destinatário. Como o conjunto de dados é extraído de cada caixa de correio, haverá todas as cópias entre os usuários. Em alguns cenários, talvez seja necessário manter cada cópia, mas em outros talvez você queira remover as duplicatas.

Você pode eliminar as duplicatas dos objetos JSON exportados baseados em internetMessageId das mensagens: duas mensagens com o mesmo internetMessageId são cópias duplicadas da mesma instância. Como as duplicatas podem existir em diferentes blobs, você deve eliminar as duplicatas em todos os blobs em vez de fazer isso em cada blob separadamente.

Posso usar o campo puser para determinar a relevância do usuário?

Os dados extraídos incluem algumas propriedades meta que não existem se forem usadas as APIs correspondentes do Microsoft Graph. Especificamente, o campo puser pode ser útil para determinar de quais usuários os dados foram extraídos. No cenário em que você tem duas cópias do mesmo email em caixas de correio diferentes, você pode usar o campo puser para determinar as caixas de correio de origem das cópias. O campo puser também é útil para conjuntos de dados, como o conjunto de dados Manager. O JSON exportado inclui informações sobre um gerenciador, mas isso é útil apenas se você souber o que gerenciam. O campo puser indicará qual gerenciador corresponde ao objeto JSON.

A configuração do locatário no modo híbrido é compatível?

Se sua configuração do Microsoft 365 tiver alguns usuários no Exchange Online e alguns usuários no Exchange local, os usuários que estão no Exchange local não terão suporte. Infelizmente, o Data Connect atualmente não tem suporte para usuários locais do Exchange.

Há suporte para contas de recursos?

Atualmente não apoiamos o acesso a mensagens ou eventos a partir de contas de recursos.

Por que às vezes vejo vários arquivos por execução de pipeline do ADF, mas outras vezes vejo apenas um arquivo por execução?

O Data Connect do Microsoft Graph leva a lista de usuários para cada execução de pipeline e, em seguida, distribui a extração e curadoria do conjunto de dados em vários trabalhos executados em paralelo. Para cada execução paralela, um arquivo de saída é gerado no coletor de dados definido por você. Para alguns casos, se a lista de usuários for pequena, eles podem ser mapeados em um trabalho de extração e curadoria e, nesses casos, apenas um arquivo de saída seria gerado no coletor de dados.