Agentes no Microsoft Foundry

O Foundry Agent Service é uma plataforma gerenciada para criar, implantar e dimensionar agentes de IA. Desenvolva com qualquer framework, qualquer modelo compatível do catálogo de modelos do Foundry e um único ponto de entrada para inferência de modelos e ferramentas.

A foundry atende a você em qualquer lugar do espectro de código declarativo a completo: defina um agente de prompt e deixe o Foundry executá-lo, empacote seu próprio código como um agente hospedado ou chame a API de Respostas de um agente que você já executou em outro lugar. Escolha como criar aborda cada opção.

Serviço de Agente: Visão Geral

Componente O que ele faz
Ambiente de execução do agente Hospeda e dimensiona agentes de prompt e agentes hospedados. Gerencia conversas, invocações de ferramentas e ciclo de vida do agente.
Caixas de ferramentas Faça a curadoria de um conjunto de ferramentas uma vez, como: pesquisa na Web, pesquisa de arquivos, interpretador de código, servidores MCP e funções personalizadas. Em seguida, compartilhe-os entre agentes por meio de um único ponto de extremidade MCP gerenciado com autenticação centralizada, governança e controle de versão.
Modelos Funciona com muitos modelos do catálogo de modelos do Foundry, como GPT-4o, Llama e DeepSeek. Troque modelos sem alterar o código do agente.
Observabilidade Rastreamento de ponta a ponta, métricas, avaliações e integração do Application Insights. Veja cada decisão que seu agente toma e meça sua qualidade.
Otimização O otimizador de agente (versão preliminar) avalia o comportamento do agente e gera automaticamente melhores instruções, habilidades, descrições de ferramentas e seleções de modelo para agentes de prompt e agentes hospedados.
Identidade &segurança Microsoft Entra Identity, RBAC, filtros de conteúdo e isolamento de rede virtual. Confiança de nível empresarial incorporada.
Publicação Controle de versão de agentes, crie endpoints estáveis e compartilhe-os por meio do Microsoft Teams, Microsoft 365 Copilot e o Registro de Agentes Entra.

Escolher como criar

Dica

Criando seu primeiro agente? Comece com um agente de prompt usando o portal do Foundry ou o início rápido para criar um agente de prompt com código.

O Foundry oferece várias maneiras de criar, desde uma única chamada a um modelo até um agente totalmente conteinerizado. Escolha seu caminho com base no que você está tentando fazer:

  • Deseja o mínimo para gerenciar?Comece com um agente de prompt. Configurar instruções, um modelo e ferramentas; A Foundry a executa sem código ou infraestrutura.
  • Quer controle total no Foundry?Implantar um agente hospedado. Traga seu próprio código e estrutura em um contêiner; o Foundry o executa com um ponto de extremidade gerenciado, escalabilidade e gerenciamento de identidade.
  • Já executou o código do agente em outro lugar?Chame a API de Respostas diretamente para usar modelos e ferramentas do Foundry, sem nenhum recurso de agente para gerenciar.

Agentes de prompt e agentes hospedados são os dois tipos de agentes no Foundry. A próxima seção divide o valor de cada um para que você possa escolher com confiança.

Tipos de agente

O Serviço de Agente oferece dois tipos de agente. Sua escolha define o quanto você cria em comparação com o quanto o Foundry gerencia:

  • Agentes de prompt: o caminho mais rápido. Defina instruções, um modelo e ferramentas e o Foundry executa o agente para você sem código ou infraestrutura para gerenciar.
  • Agentes hospedados: o máximo de controle. Traga seu próprio código e framework, e Foundry o executa em um contêiner com endpoint gerenciado, escalabilidade e identidade.

Agentes de prompt

Você define os agentes de prompt inteiramente por meio da configuração, incluindo instruções, seleção de modelo e ferramentas. Crie-os no portal do Foundry para um início rápido ou defina-os programaticamente com os SDKs ou a API REST para integrar com seus fluxos de trabalho de CI/CD. De qualquer forma, o Foundry executa o agente para você. Não há nenhum código de aplicativo a ser mantido e nenhum contêiner ou pacote para otimizar, dimensionar ou monitorar a segurança.

Dois caminhos para começar:

  • Portal-first: crie um agente interativamente no portal do Foundry, teste-o no playground e depois chame-o a partir do código do aplicativo.
  • Code-first: defina o agente usando o SDK ou a API REST no pipeline de implantação, habilitando o controle de versão, a revisão de código e a distribuição automatizada.

Melhor para: introdução rápida, ferramentas internas, agentes de produção que não precisam de lógica de orquestração personalizada e equipes que desejam um runtime gerenciado sem sobrecarga de infraestrutura.

Agentes hospedados

Hosted agents são agentes baseados em código que você cria com Agent FrameworkLangGraph, o SDK OpenAI Agents, o SDK do agente Anthropic, o SDK GitHub Copilot, ou seu próprio código. Envie seu agente como uma imagem de contêiner ou um arquivo .zip do código-fonte (o Foundry cria a imagem para você quando você traz um arquivo .zip) e o Foundry a executa com um ponto de extremidade gerenciado, dimensionamento automático, uma identidade de Microsoft Entra dedicada, persistência de estado no nível da sessão e observabilidade de ponta a ponta.

Nos bastidores, o código do agente chama o endpoint do seu projeto Foundry para inferência de modelos e orquestração de ferramentas, dando acesso aos modelos do Foundry disponíveis no catálogo e a um conjunto unificado de ferramentas da plataforma: ferramentas padrão, como busca de arquivos, interpretador de código e pesquisa na web, além de ferramentas adicionais como SharePoint, WorkIQ e Fabric IQ.

Melhor para: agentes que fazem chamadas ao seu próprio código personalizado; secundariamente, lógica de orquestração personalizada, sistemas multiagente e protocolos personalizados (webhooks, voz, AG-UI) nos quais você deseja ter controle total sobre a lógica do agente, enquanto o Foundry cuida da hospedagem, do dimensionamento e da identidade.

Comparar tipos de agente

Agentes de prompt Agentes hospedados
Superfície de criação Portal, SDK ou REST Agent Framework, LangGraph, OpenAI Agents SDK, Anthropic Agent SDK, GitHub Copilot SDK, código personalizado
Modelos Foundry + ferramentas da plataforma Sim Sim (via a API Responses no endpoint do projeto Foundry)
Suporte a habilidades Sim Sim
Código de runtime a ser mantido Nenhum Sim, sua lógica de agente
Computação a ser gerenciada Nenhum, totalmente gerenciado Computação de contêiner, gerenciada pela Foundry
Endpoint gerenciado Sim Sim
Autoscale Automático, gerenciado pela Foundry; escala de acordo com o volume de solicitações Automático, gerenciado pela Foundry; dimensiona instâncias de contêiner por sessão e volume de solicitação
Identidade do agente (Entra) Sim Automático, dedicado para cada agente
Modelo de custo Inferência por chamada + uso de ferramenta Inferência por chamada + uso de ferramentas + computação em contêineres
Melhor para Início rápido, agentes de produção sem orquestração personalizada Agentes que chamam código personalizado; em segundo lugar, lógica de orquestração personalizada

Usar a API de Respostas para agentes efêmeros

Ao chamar a API de Respostas diretamente do seu próprio código, você cria um agente efêmero: a definição do agente (instruções, ferramentas e modelo) reside no código do aplicativo, em vez de como um recurso persistente na Foundry. Cada chamada monta o agente em seu processo e o executa na API de Respostas, portanto, não há nenhum agente para criar, atualizar ou excluir no Foundry.

Use esse padrão quando desejar:

  • Lógica do agente enviada com seu aplicativo. As versões das definições ficam junto com o restante do seu código, por meio do controle de versão e da revisão de código, em vez de mantê-las como um recurso separado do Foundry que alguém precisa manter sincronizado com o aplicativo.
  • Recursos do Foundry sem a sobrecarga do recurso. Você ainda obtém modelos de catálogo, ferramentas de plataforma, dados com escopo de projeto, autenticação On-Behalf-Of, além de governança e observabilidade em nível de projeto. Tudo via ponto de extremidade de projeto no Foundry.

Confira o início rápido: use a API de Respostas para obter informações.

Suporte ao modelo

O Serviço de Agente funciona com muitos modelos disponíveis no catálogo do Foundry. Para obter a lista completa, consulte o portal do Foundry.

Ferramentas e caixas de ferramentas

Os agentes atuam no mundo por meio de ferramentas. A Foundry oferece ferramentas internas, como pesquisa na Web, pesquisa de arquivos, interpretador de código e memória, ao mesmo tempo em que permite adicionar ferramentas personalizadas por meio de funções, especificações OpenAPI e servidores MCP. Para o conjunto completo, consulte a visão geral da caixa de ferramentas.

Uma caixa de ferramentas agrupa essas ferramentas em uma única unidade reutilizável. Você faz a curadoria das ferramentas uma vez, e o Foundry as expõe em um ponto de extremidade gerenciado compatível com MCP, que pode ser consumido por qualquer agente ou runtime, independentemente da estrutura. As caixas de ferramentas centralizam a autenticação, a governança e o controle de versão, para que você atualize as ferramentas em um único lugar em vez de religar todos os agentes. Crie uma nova versão, teste-a e promova-a para o padrão quando estiver pronto. Para saber mais, confira o que é a Caixa de Ferramentas na Foundry?.

Conectar-se e autenticar-se a servidores remotos MCP

O Foundry dá suporte a servidores MCP remotos que você pode adicionar ao seu agente, como o servidor MCP Azure DevOps. Conecte sua organização Azure DevOps para habilitar o acesso ao agente e configure um subconjunto de ferramentas disponíveis para controlar quais ações os agentes podem executar. Você também pode conectar servidores MCP personalizados hospedados no Azure Functions usando o ponto de extremidade de webhook do MCP do Functions (/runtime/webhooks/mcp) para expor ferramentas personalizadas aos seus agentes.

As opções de autenticação com suporte para servidores MCP e outras conexões de ferramenta incluem:

  • Acesso baseado em chave
  • Microsoft Entra (usando a identidade gerenciada do agente ou a identidade gerenciada do projeto)
  • Passagem de identidade OAuth (On-Behalf-Of)
  • Acesso não autenticado, quando apropriado

Essas opções de autenticação também se aplicam ao conectar servidores MCP remotos, com credenciais e escopos gerenciados na configuração da ferramenta.

Ciclo de vida de desenvolvimento

O Serviço de Agente dá suporte ao fluxo de trabalho completo de compilação-teste-implantação-monitoramento:

  1. Criar: defina um agente de prompt no portal ou com o SDK ou escreva um agente hospedado que chame a API de Respostas.
  2. Testar: converse com seu agente no playground de agentes ou execute localmente. As integrações de servidor MCP, incluindo servidores MCP personalizados hospedados em Azure Functions, podem ser exercidas diretamente no playground para validar a conectividade, as permissões e o comportamento da ferramenta antes da publicação.
  3. Rastreamento: inspecione cada chamada de modelo, invocação de ferramenta e decisão com rastreamento de agentes.
  4. Avaliar: execute avaliações para medir a qualidade e capturar regressões.
  5. Otimizar: aprimore automaticamente as instruções do agente hospedado usando o otimizador do agente.
  6. Publicar: Promova seu agente a um recurso gerenciado com um endpoint estável.
  7. Monitorar: acompanhe o desempenho e a confiabilidade com métricas de serviço e painéis.

Para obter um passo a passo detalhado, consulte o ciclo de vida de desenvolvimento do Agente.

Funcionalidades da empresa

O Serviço de Agente fornece infraestrutura de nível empresarial para cada agente que você implantar:

  • Identidade do agente: cada agente pode ter uma identidade de Microsoft Entra dedicada, permitindo acesso seguro e com escopo a recursos e APIs sem compartilhar credenciais. As identidades de agentes podem autenticar-se em servidores MCP externos, incluindo aqueles hospedados no Azure Functions, e a passagem OAuth On-Behalf-Of (OBO) é suportada quando configurada.
  • Rede privada: Execute agentes em sua rede virtual do Azure para garantir isolamento total da rede e conformidade com os requisitos de residência de dados. A rede privada está disponível para agentes de prompt. Os agentes hospedados oferecem suporte ao Bring-Your-Own Rede Virtual do Azure (BYO VNet), onde cada sessão ocorre em um "sandbox" isolado de VM conectado à sua VNet.
  • Controle de acesso baseado em funções: permissões granulares por meio do Microsoft Entra e do Azure RBAC. Controlar quem pode criar, invocar e gerenciar agentes.
  • Segurança de conteúdo: filtros de conteúdo integrados ajudam a mitigar os riscos de injeção de prompt (incluindo injeção entre prompts) e a evitar saídas inseguras.

Para obter instruções de configuração de ambiente, consulte Configurar seu ambiente.

Publicação e compartilhamento

O Serviço de Agente fornece controle de versão e publicação internos para que seus agentes possam passar do desenvolvimento para a produção com confiança.

  • Controle de versão: à medida que você itera em seu agente, são capturados instantâneos automáticos das versões. Reverta para qualquer versão anterior ou compare as alterações entre as versões.
  • Publicação: promova um agente para um recurso gerenciado com um ponto de extremidade estável. Os agentes publicados herdam a identidade da empresa e os controles de acesso configurados para seu projeto e podem ser invocados programaticamente.
  • Distribuição: compartilhe agentes publicados por meio de Microsoft 365 Copilot e Teams e do Registro de Agentes do Entra, colocando seus agentes onde seus usuários já trabalham. O Serviço de Agente do Foundry dá suporte aos Protocolos OpenResponses e Activity para a publicação no Microsoft 365, ao Protocolo Invocations para a integração flexível de ponto de extremidade com aplicativos e serviços personalizados e ao Protocolo A2A (versão prévia) para a comunicação entre agentes.

Segurança, privacidade e conformidade

O Serviço de Agente foi projetado para cargas de trabalho corporativas em que você precisa de controles fortes sobre identidade, rede, manipulação de dados e segurança.

  • Controles de segurança: use proteções integradas para ajudar a minimizar saídas não seguras e mitigar os riscos de injeção de solicitação, incluindo ataques de injeção de solicitação cruzada (XPIA).
  • Isolamento de rede e controles de residência de dados: use redes virtuais e traga seus próprios recursos para atender às suas necessidades.
  • Traga seus próprios recursos: use seus próprios recursos do Azure (por exemplo, armazenamento, Pesquisa de IA do Azure  e Azure Cosmos DB para estado de conversa) para atender às necessidades operacionais e de conformidade. Consulte Usar seus próprios recursos.
  • Diretrizes de IA Responsável: para obter um conjunto mais amplo de recomendações e recursos de governança, consulte Responsible AI for Microsoft Foundry.