Nota
O acesso a esta página requer autorização. Pode tentar iniciar sessão ou alterar os diretórios.
O acesso a esta página requer autorização. Pode tentar alterar os diretórios.
Importante
A memória (pré-visualização) no Foundry Agent Service e na API Memory Store (pré-visualização) são licenciadas para si como parte da sua subscrição de Azure e estão sujeitas a termos aplicáveis a "Pré-visualizações" nos Termos do Produto Microsoft, no Adendo Microsoft Produtos e Serviços de Proteção de Dados e nos Termos Suplementares de Utilização Suplementar para Microsoft Azure Pré-visualizações.
A mais recente pré-visualização oferece novas capacidades e melhorias, incluindo:
- Operações de itens de memória para criar, ler, atualizar, listar e eliminar registos individuais de memória.
- Controlos de retenção predefinidos ao nível do armazenamento, incluindo TTL predefinido para armazenamentos de memória recém-criados.
- Comportamento direto do comando de memória sincronizada para lembrar ou esquecer.
Memória no Microsoft Foundry Agent Service é uma solução gerida de memória de longo prazo. Permite a continuidade do agente entre sessões, dispositivos e fluxos de trabalho. Ao criar e gerir armazenamentos de memória, pode criar agentes que mantenham as preferências dos utilizadores, mantenham o histórico de conversas e proporcionem experiências personalizadas.
Este artigo oferece uma visão geral da memória dos agentes, incluindo os seus conceitos, casos de uso e limitações. Para instruções de utilização, consulte Criar e usar memória no Foundry Agent Service.
O que é a memória?
A memória é conhecimento persistente retido por um agente ao longo das sessões. Geralmente, a memória do agente divide-se em duas categorias:
A memória de curto prazo acompanha a conversa da sessão atual e mantém o contexto imediato para as interações em curso. Os frameworks de orquestração de agentes normalmente gerem esta memória como parte do contexto da sessão.
A memória a longo prazo mantém o conhecimento destilado ao longo das sessões. O modelo pode recordar e construir sobre interações anteriores com o utilizador ao longo do tempo. A memória de longo prazo requer um sistema persistente que extraia, consolide e gere o conhecimento.
A memória no Foundry Agent Service foi concebida para memória de longo prazo. Extrai informação significativa das conversas, consolida-a em conhecimento duradouro e torna-a disponível ao longo das sessões.
Como funciona a memória
Nos bastidores, as memórias são armazenadas como itens num armazenamento de memória gerido. O sistema pode aplicar lógica de consolidação e resolução de conflitos quando aplicável, como para fundir informações duplicadas ou sobrepostas de perfis de utilizador.
Nota
O comportamento de consolidação pode variar consoante o tipo de memória e pode mudar durante a pré-visualização. Para o comportamento mais recente, veja Criar e usar memória no Foundry Agent Service.
A memória opera nas seguintes fases:
Extração: Quando um utilizador interage com um agente, o sistema extrai ativamente informações-chave da conversa, como preferências do utilizador, factos e contexto relevante. Por exemplo, preferências como "alérgico a laticínios" e resumos de atividades recentes são identificadas e armazenadas.
Consolidação: As memórias extraídas são consolidadas para manter o armazenamento de memória eficiente e relevante. O sistema utiliza LLMs para fundir tópicos semelhantes ou duplicados, de modo a que o agente não armazene informação redundante. Factos contraditórios, como uma nova alergia, são resolvidos para assegurar uma memória precisa.
Recuperação: Quando o agente precisa de recordar informação, procura no armazenamento de memória as memórias mais relevantes. Isto permite ao agente revelar rapidamente o contexto certo, tornando as conversas naturais e informadas. Para melhores resultados, recupere informações estáveis do perfil do utilizador cedo na conversa para que o agente possa personalizar as respostas.
Aqui está um exemplo de como a memória pode melhorar e personalizar as interações entre um agente de receitas e um utilizador que anteriormente expressou uma alergia alimentar:
Dica
Precisa de ajuda para decidir quando usar a memória? Considere estas orientações:
- Use a memória para captar contexto específico do utilizador ou do agente que é aprendido e persiste através das interações ao longo do tempo.
- Use uma base de conhecimento Foundry IQ para fundamentar o seu agente em conteúdos organizacionais curados.
- Use a ferramenta de pesquisa de ficheiros para pesquisar documentos fornecidos pelos utilizadores durante uma interação.
Tipos de memória
A memória no Foundry Agent Service extrai e armazena três tipos de memória de longo prazo:
| Tipo de memória | Descrição | Orientação de recuperação | Configuração |
|---|---|---|---|
| Memória do perfil de utilizador | Preferências duradouras do utilizador e contexto pessoal, como preferência linguística, padrões de produtos ou necessidades de acessibilidade. | Recupere perto do início de cada conversa para estabelecer um contexto estável de personalização. | Ativado por padrão. Para configurar e desativar, veja Criar um armazenamento de memória. |
| Memória resumida do chat | Resumos destilados de temas e tópicos de conversas anteriores. | Recuperar por turno usando mensagens de conversa atuais para mostrar o contexto de continuidade relevante. | Ativado por padrão. Para configurar e desativar, veja Criar um armazenamento de memória. |
| Memória processual | Procedimentos reutilizáveis e padrões de funcionamento inferidos a partir de interações anteriores. | Recuperar quando o utilizador pede um fluxo de trabalho ou tarefa recorrente que o agente já tenha tratado antes. | Ativado por padrão. Para configurar e desativar, veja Criar um armazenamento de memória. |
Gestão e retenção de memória
A funcionalidade Memória no Foundry Agent Service suporta controlos granulares de gestão e retenção para cenários de produção:
- CRUD de memória ao nível do item: Criar, ler, atualizar, listar e eliminar itens de memória individuais.
- Retenção padrão ao nível da loja: Defina um TTL predefinido (segundos) para entradas de memória criadas numa loja.
- Comandos de memória direta: Aplique um comportamento imediato de lembrar ou esquecer quando os utilizadores solicitarem explicitamente alterações de memória.
Com estes controlos, pode equilibrar a qualidade da personalização com os requisitos de privacidade, conformidade e ciclo de vida dos dados.
Trabalhar com memória
Existem duas formas de usar a memória para interações com agentes:
Ferramenta de pesquisa de memória: Anexe a ferramenta de pesquisa de memória a um assistente de comando para permitir a leitura e escrita na memória de armazenamento durante as conversas. Esta abordagem é ideal para a maioria dos cenários porque simplifica a gestão da memória. Para mais informações, consulte Utilizar memórias via uma ferramenta de agente.
APIs de armazenamento de memória: Interaja diretamente com o armazenamento de memória usando as APIs de baixo nível. Esta abordagem proporciona mais controlo e flexibilidade para casos de uso avançados, incluindo controlo direto sobre registos individuais de memória, comportamento de retenção e operações explícitas do ciclo de vida da memória. Para mais informações, consulte Usar memórias via APIs.
Casos de uso
Os exemplos seguintes ilustram como a memória pode potenciar vários tipos de agentes.
Um agente de apoio ao cliente que se lembre do seu nome, problemas e resoluções anteriores, números de tickets e o seu método de contacto preferido (chat, email ou chamada de retorno). Esta memória ajuda-o a evitar repetir informação, tornando as conversas mais eficientes e satisfatórias.
Um assistente de compras pessoal que se lembre do seu tamanho em marcas específicas, cores preferidas, devoluções anteriores e compras recentes. O agente pode sugerir itens relevantes assim que você começa uma sessão e evitar recomendar produtos que já possui.
Riscos de segurança
Quando trabalha com memória no Foundry Agent Service, o grande modelo de linguagem (LLM) extrai e consolida memórias com base em conversas. Proteger a memória contra ameaças como injeção rápida e corrupção de memória. Estes riscos surgem quando dados incorretos ou prejudiciais são armazenados na memória do agente, podendo influenciar as respostas e ações do agente.
Para mitigar riscos de segurança, considere estas ações:
Use Segurança de conteúdo de IA do Azure e a sua deteção de injeção de solicitação: Valide todos os prompts que entram ou saem do sistema de memória para prevenir conteúdo malicioso.Realizar testes de ataque e adversariais: Teste regularmente o seu agente para vulnerabilidades de injeção através de exercícios adversariais controlados.
Limitações e quotas
As seguintes limitações e quotas aplicam-se à memória no Foundry Agent Service. Para limitações e quotas mais amplas, consulte Limites de Serviço de Agentes de Fundição, quotas e apoio regional.
Limitações
Atualmente, a memória requer implementações compatíveis de chats e modelos de embedding do Azure OpenAI. Para obter uma lista dos modelos suportados, consulte Modelos do Foundry vendidos pela Azure.
Para APIs de memória de baixo nível, deve definir
scopeexplicitamente em cada pedido. A resolução automática de escopo a partir da identidade do chamador só é suportada quando usar a ferramenta de pesquisa de memória comscopeconfigurado para{{$userId}}. Para mais informações, consulte Compreender o âmbito.A integração com redes virtuais (VNet) não é suportada para armazenamentos de memória.
Nota
Na versão preliminar mais recente, algumas opções predefinidas do arquivo de memória (como ativar a memória procedural e definir um TTL predefinido) são configuradas aquando da criação do arquivo. Verifique o suporte para atualizações pós-criação na versão da sua API.
Quotas
- Escopos máximos por armazenamento de memória: 100
- Memórias máximas por âmbito: 10.000
- Memórias de pesquisa: 1.000 pedidos por minuto
- Atualizar memórias: 1.000 pedidos por minuto
Disponibilidade regional
A memória está disponível nas seguintes regiões:
- Leste da Austrália
- Sul do Brasil
- Leste do Canadá
- E.U.A. Leste 2
- Centro de França
- Norte de Itália
- Leste do Japão
- Coreia Central
- E.U.A. Centro-Norte
- Leste da Noruega
- Norte da África do Sul
- Sul da Índia
- Suécia Central
- Norte da Suíça
- Norte dos E.A.U.
- Sul do Reino Unido
- E.U.A. Oeste
- E.U.A. Oeste 2
- E.U.A. Oeste 3
Preços
A memória encontra-se atualmente em pré-visualização pública. O preço e a faturação da memória e da API de Armazenamento de Memória podem mudar durante a pré-visualização.
És cobrado pelo uso do chat subjacente e pelos modelos de embedding que configuras. Para informações atualizadas sobre preços, verifique Preços do Serviço de Agente de Fundição.
Conteúdo relacionado
- Siga a configuração de ponta a ponta: Crie e use memória no Foundry Agent Service
- Confirmar disponibilidade de modelos: Modelos Azure OpenAI e regiões para o Serviço do Agente Foundry
- Constrói um agente completo: Microsoft Foundry quickstart