Modelos de Claude no Microsoft Foundry

Os modelos Claude da Anthropic trazem recursos avançados de IA de conversa para Microsoft Foundry, fornecendo compreensão e geração de linguagem de última geração para aplicativos inteligentes. Os modelos Claude se destacam em raciocínio complexo, geração de código e tarefas multimodais, incluindo análise de imagem. Este artigo descreve os modelos Claude disponíveis, como eles são hospedados e cobrados, as APIs compatíveis, os recursos, os limites de uso e as práticas recomendadas.

Para implantar e chamar um modelo claude, consulte Implantar e usar modelos Claude no Microsoft Foundry.

Importante

Os itens marcados (versão prévia) neste artigo estão atualmente em versão prévia pública. Essa versão prévia é fornecida sem um contrato de nível de serviço e não recomendamos isso para cargas de trabalho de produção. Alguns recursos podem não ter suporte ou podem ter restrição de recursos. Para obter mais informações, consulte Termos de Uso Complementares para Versões Prévias do Microsoft Azure.

Como os modelos Claude são hospedados e faturados

Microsoft Foundry oferece modelos Claude em duas versões:

  • Versão 1: Hospedada na infraestrutura da Anthropic; esses modelos são executados na infraestrutura da Anthropic (fora do Azure).
  • Versão 2: Hospedados no Azure; esses modelos são executados integralmente na infraestrutura do Azure e estão todos em disponibilidade geral (GA).

Nem todos os modelos estão disponíveis em ambas as versões. O estágio de ciclo de vida de um modelo, como Visualização ou Disponibilidade Geral, pode ser diferente entre as duas versões. Para obter a disponibilidade por modelo e o status do ciclo de vida, consulte os modelos claude disponíveis.

Para comparar as duas opções de hospedagem em termos de residência de dados, SLAs, canais de suporte, conformidade e processo de compra, consulte Comparar modelos Claude hospedados no Azure e pela Anthropic.

Note

Você acessa os modelos Claude no Microsoft Foundry por meio de Modelos do Foundry de parceiros e da comunidade. Modelos de parceiros e da comunidade vendidos e operados pela Anthropic são Produtos que Não São da Microsoft, conforme os Termos do Produto.

Os modelos Claude no Foundry exigem uma assinatura do Azure Marketplace e são cobrados por meio das Unidades de Consumo Claude (CCU). Verifique se você possui as permissões necessárias para se inscrever em ofertas de modelo antes de implantar. Para obter detalhes sobre preços, consulte a cobrança de Claude Consumption Units (CCU) no Microsoft Foundry.

Modelos de Claude disponíveis

Importante

Os seguintes modelos Claude estão em conformidade com o padrão de marca d’água da UE: claude-mythos-5-1, claude-fable-5-1 e claude-fable-5. Enquanto claude-fable-5 usa marca d'água de chave única, claude-mythos-5-1 e claude-fable-5-1 usam chave dupla (2 chaves entrelaçadas e C2PA), da seguinte forma:

  • Marca d'água em texto entrelaçado (segunda chave): uma segunda chave é adicionada para a detecção de marca d'água entrelaçada, conforme as normas da UE. A aplicação de marca d’água ocorre no servidor no momento da geração; não há nenhuma alteração nas estruturas das solicitações ou respostas. Uma API independente de detecção de marca d'água está em acesso antecipado e não faz parte do escopo de lançamento do Foundry.
  • Marca d'água C2PA: marcação de procedência de conteúdo C2PA, processada no lado do servidor/cliente pelas interfaces da Anthropic. Nenhuma alteração de forma de API.

A tabela a seguir compara a disponibilidade do modelo para ambas as versões de modelos Claude no Foundry. Para obter detalhes sobre os recursos referenciados na tabela, consulte a seção Recursos e recursos avançados .

Para ver os erros que podem ocorrer ao implantar ou chamar modelos Claude, consulte Implantar e usar modelos Claude: Solução de problemas.

Modelo Disponibilidade Janela de contexto/Saída máxima Principais funcionalidades Melhor para
claude-mythos-5-1 1
  • Hospedado na infraestrutura da Anthropic: prévia de pesquisa com acesso restrito
1M/128K
  • Biologia e ciências da vida
  • Segurança cibernética (casos de uso defensivo priorizados): descoberta de vulnerabilidades, auditoria de superfície de ataque, agrupamento vermelho, inteligência contra ameaças
  • Codificação autônoma
  • Agentes de execução prolongada
claude-mythos-5 1
  • Hospedado na infraestrutura da Anthropic: prévia de pesquisa com acesso restrito
1M/128K
  • Biologia e ciências da vida
  • Segurança cibernética (casos de uso defensivo priorizados): descoberta de vulnerabilidades, auditoria de superfície de ataque, agrupamento vermelho, inteligência contra ameaças
  • Codificação autônoma
  • Agentes de execução prolongada
claude-fable-5-1
  • Hospedado na infraestrutura de Anthropic: versão prévia
1M/128K
  • Pensamento adaptável
  • Trabalho de longa duração
  • Pesquisa científica com autoverificação
  • Trabalho de conhecimento; lidar com o trabalho de conhecimento desafiador com menos supervisão prática
  • Recusa stop_reason com base em políticas de salvaguarda de dupla utilização2
  • Veja as novidades de Claude Fable 5.1 e Claude Mythos 5.1
  • Agentes de execução prolongada
  • Codificação e agentes, com um raciocínio mais profundo para fluxos de trabalho corporativos
  • Ciência e pesquisa gerais
  • Análise financeira
  • Visão
claude-fable-5
  • Hospedado na infraestrutura de Anthropic: versão prévia
1M/128K
  • Pensamento adaptável
  • Raciocínio sobre bases de código completas e contexto de projetos de vários dias
  • Trabalho independente mais longo do que qualquer modelo anterior de Claude
  • Autoverificação
  • Orquestração de subagentes
  • Recusa stop_reason com base em políticas de salvaguarda de dupla utilização2
  • Consulte Migração para Claude Fable 5.1 e Claude Mythos 5.1
  • Cybersecurity
  • Codificação autônoma
  • Agentes de execução prolongada
  • Codificação e agentes, com um raciocínio mais profundo para fluxos de trabalho corporativos
claude-mythos-preview 1
  • Hospedado na infraestrutura da Anthropic: prévia de pesquisa com acesso restrito
1M/128K
  • Segurança cibernética (casos de uso defensivo priorizados)
  • Codificação autônoma
  • Agentes de execução prolongada
claude-opus-5
  • Hospedado no Azure: GA
  • Hospedado na infraestrutura de Anthropic: GA
1M/128K
  • Pensamento adaptável com xhigh e max níveis de esforço
  • Raciocínio sobre bases de código completas e contexto de projetos de vários dias
  • Controles de esforço por turno3
  • No meio da conversa3role:"system"
  • Limites de tokens3 (task_budget)
  • Veja as novidades em Claude Opus 5
  • Inteligência Near-Fable para programação de longo prazo e orquestração complexa de agentes.
  • Agentes de execução prolongada
  • Fluxos de trabalho corporativos
  • Análise financeira
  • Uso do computador
claude-opus-4-8
  • Hospedado no Azure: GA
  • Hospedado na infraestrutura de Anthropic: GA
1M/128K
  • Raciocínio adaptativo com nível de esforço xhigh
  • Raciocínio sobre bases de código completas e contexto de projetos de vários dias
  • Entrada de imagem de alta resolução (até 2576px/3,75MP)
  • Consulte Migrando para Claude Opus 5
  • Coding
  • Agentes de execução prolongada
  • Análise financeira
  • Cybersecurity
  • Uso do computador
claude-opus-4-7
  • Hospedado na infraestrutura de Anthropic: GA
1M/128K
  • Pensamento adaptável
  • Raciocínio sobre bases de código inteiras
  • Entrada de imagem de alta resolução (até 2576px/3,75MP)
  • Consulte Migrando para Claude Opus 5
  • Coding
  • Fluxos de trabalho corporativos
  • Agentes de execução prolongada
  • Raciocínio multimodal
  • Análise financeira
  • Cybersecurity
claude-opus-4-6
  • Hospedado na infraestrutura de Anthropic: GA
1M/128K
  • Pensamento adaptável
  • Entrada de imagem e texto
  • Uso do computador
  • Uso avançado de ferramentas (pesquisa, chamada programática, exemplos)
  • Consulte Migrando para Claude Opus 5
  • Coding
  • Agentes empresariais
claude-opus-4-5
  • Hospedado na infraestrutura de Anthropic: GA
200K/64K
  • Pensamento estendido
  • Entrada de imagem e texto
  • Uso do computador
  • Uso avançado de ferramentas (pesquisa, chamada programática, exemplos)
  • Consulte Migrando para Claude Opus 5
  • Coding
  • Agentes
  • Uso do computador
  • Fluxos de trabalho corporativos
claude-sonnet-5
  • Hospedado no Azure: GA
  • Hospedado na infraestrutura de Anthropic: GA
1M/128K
  • Pensamento adaptável
  • xhigh nível de esforço
  • Raciocínio sobre bases de código completas e contexto de projetos de vários dias
  • A entrada de imagem de res alta (até 2576px/3,75MP) está ativada por padrão
  • No meio da conversa3role:"system"
  • Limites de tokens3 (task_budget)
  • Veja as novidades no Claude Sonnet 5
  • Coding
  • Agentes de execução prolongada
  • Análise financeira
  • Cybersecurity
  • Uso do computador
claude-sonnet-4-6
  • Hospedado na infraestrutura de Anthropic: GA
1M/128K
  • Pensamento adaptável
  • Entrada de imagem e texto
  • Uso do computador
  • Uso avançado de ferramentas (pesquisa, chamada programática, exemplos)
  • Veja como migrar para o Claude Sonnet 5
  • Coding
  • Agentes
  • Fluxos de trabalho corporativos
claude-sonnet-4-5
  • Hospedado na infraestrutura de Anthropic: GA
200K/64K
  • Agentes e tarefas complexas e de horizonte longo
  • Cargas de trabalho de alto volume
claude-haiku-4-5
  • Hospedado no Azure: GA
  • Hospedado na infraestrutura de Anthropic: GA
200K/64K
  • Pensamento estendido
  • Entrada de imagem e texto
  • Coding
  • Agentes

1Claude Mythos 5-1, Claude Mythos 5 e Claude Mythos Preview só estão disponíveis como visualização de pesquisa fechada. O acesso aos modelos é concedido exclusivamente a critério da Anthropic e priorizado para casos de uso de segurança cibernética defensiva. Confira o cartão do sistema Claude Fable 5.1 &Claude Mythos 5.1, o cartão do sistema Claude Mythos 5 e o cartão do sistema Claude Mythos Preview para obter diretrizes de uso responsável.

2Claude Fable 5 aplica classificadores de entrada/saída adicionais que podem recusar solicitações cujo conteúdo dispara políticas de proteção de uso duplo. Quando ocorre uma recusa, a solicitação retorna uma resposta bem-sucedida (200) com um indicador stop_reason: "refusal" de recusa em vez de conteúdo gerado por modelo. Não cobramos pelos tokens de entrada que forem recusados.

3 Controles de esforço por turno, no meio da conversa e orçamentos de tokens estão atualmente em versão Beta.

Visão geral da API

A tabela a seguir lista as APIs que você pode usar para interagir com ambas as versões dos modelos Claude no Foundry: Hospedadas no Azure e Hospedadas na infraestrutura da Anthropic.

Use os SDKs Anthropic e as seguintes APIs Claude:

Tip

A versão de infraestrutura Hospedada no Anthropic dos modelos Claude no Foundry dá suporte a mais APIs do que as listadas nesta tabela. Você pode vê-los nos documentos da API Claude: visão geral da API.

API Description
Mensagens1 (POST /v1/messages) API de Mensagens Principais: enviar uma lista estruturada de mensagens de entrada com conteúdo de texto ou imagem, incluindo respostas de streaming. O modelo gera a próxima mensagem na conversa.
Contagem de tokens (POST /v1/messages/count_tokens) API de Contagem de Tokens: conte o número de tokens em uma mensagem antes de enviá-la para Claude.

1Você pode chamar a API de Mensagens do anthropic pacote Python, do @anthropic-ai/foundry-sdk pacote JavaScript ou diretamente por meio do REST. O ponto de extremidade de implantação segue o formato https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, e os clientes REST e JavaScript utilizam o cabeçalho anthropic-version: 2023-06-01.

Funcionalidades e recursos avançados

Os modelos claude no Foundry expõem os principais recursos para processar, analisar e gerar conteúdo e ferramentas que permitem que Claude interaja com sistemas externos, execute código e execute tarefas automatizadas. A superfície da API de Claude é organizada em cinco áreas:

As seções e tabelas a seguir resumem as capacidades disponíveis nas versões dos modelos Claude no Foundry hospedadas no Azure e hospedadas na infraestrutura da Anthropic. Salvo indicação em contrário, uma funcionalidade se aplica a ambas as versões.

Tip

A versão de infraestrutura hospedada no Anthropic dos modelos Claude no Foundry dá suporte a mais recursos do que os listados nessas tabelas. Você pode ver a lista completa de recursos no Claude Platform Docs: visão geral dos recursos.

Para obter mais informações sobre os recursos disponíveis e os recursos avançados para modelos Claude no Foundry, consulte o blog do desenvolvedor do Microsoft.

Funcionalidades do modelo

Maneiras de orientar o Claude e suas saídas diretas, incluindo formato de resposta, profundidade de raciocínio e modalidades de entrada.

Característica Description
Mensagens de streaming Ao criar uma Mensagem, defina "stream": true para transmitir incrementalmente a resposta usando SSE (eventos enviados pelo servidor).
A pensar Recursos avançados de raciocínio para tarefas complexas, fornecendo transparência no processo de pensamento passo a passo de Claude antes de fornecer sua resposta final. Consulte Raciocínio e esforço para os thinkingvalores de parâmetro por modelo.
Pensamento adaptável Deixe Claude decidir dinamicamente quando e quanto pensar. Esse recurso é o único modo de pensamento em modelos Claude 4.7 e posteriores. Use o effort parâmetro para controlar a profundidade do pensamento.
Effort Controle quantos tokens o Claude usa ao responder, equilibrando o nível de detalhamento da resposta e a eficiência no uso de tokens. Consulte Raciocínio e esforço para os effortvalores de parâmetro por modelo.
Citações Baseie as respostas de Claude em fontes, incluindo blocos de conteúdo de search_result.
Imagens e visão Processar e analisar o conteúdo de imagens. As implantações hospedadas no Azure aceitam apenas imagens codificadas em base64 ou baseadas em URL.
Suporte a PDF Processe e analise o conteúdo de texto e visual de documentos PDF. Forneça PDFs como base64 ou URL.
Janela de contexto de 1M Até 1 milhão de tokens para processar documentos grandes, bases de código extensas e conversas longas. O suporte está sujeito à elegibilidade do modelo.
Saídas estruturadas Restrinja as respostas de Claude para seguir um esquema JSON específico, usando dois recursos complementares: saídas JSON (o output_config.format parâmetro) para respostas estruturadas e uso estrito de ferramentas (strict: true) para entradas de ferramenta validadas. Para implantações Hospedadas no Azure, as saídas estruturadas também oferecem suporte ao parâmetro legado para saídas JSON (o parâmetro output_format).

Pensamento e esforço

O recurso Thinking permite valores específicos para o thinking tipo de parâmetro, dependendo do modelo, conforme descrito na tabela a seguir. O adaptive tipo configura o recurso de pensamento adaptável , permitindo que o modelo decida se deseja pensar, com base na complexidade da consulta e no nível de esforço. Por exemplo, thinking={"type": "adaptive"}.

Modelo adaptive enabled disabled
claude-mythos-5-1 Yes No No
claude-mythos-5 Yes No No
claude-fable-5-1 Yes No No
claude-fable-5 Yes No No
claude-mythos-preview Yes Yes No
claude-opus-5 Yes No Sim1
claude-opus-4-8 Yes No Yes
claude-opus-4-7 Yes No Yes
claude-opus-4-6 Yes Yes Yes
claude-sonnet-5 Yes No Yes
claude-sonnet-4-6 Yes Yes Yes

1 Pensar só pode estar disabled em esforço high ou abaixo

O recurso Esforço permite níveis específicos effort para cada modelo, conforme descrito na tabela a seguir. O xhigh nível produz o mesmo resultado que max.

Modelo low medium high xhigh max
claude-mythos-5-1 Yes Yes Yes Yes No
claude-mythos-5 Yes Yes Yes Yes No
claude-fable-5-1 Yes Yes Yes Yes No
claude-fable-5 Yes Yes Yes Yes No
claude-opus-5 Yes Yes Yes Yes Yes
claude-opus-4-8 Yes Yes Yes Yes Yes
claude-opus-4-7 Yes Yes Yes Yes Yes
claude-opus-4-6 Yes Yes Yes No Yes
claude-sonnet-5 Yes Yes Yes Yes Yes
claude-sonnet-4-6 Yes Yes Yes No Yes

Tools

Permita que Claude execute ações na Web ou em seu ambiente. Esse recurso consiste em ferramentas integradas que Claude invoca por meio de tool_use. A plataforma executa ferramentas do lado do servidor e você implementa e executa ferramentas do lado do cliente.

Característica Description
Uso da ferramenta com ferramentas executadas pelo cliente Ferramentas personalizadas mais bash, text editor, computer use e memory definidos pela Anthropic. Para obter mais informações sobre essas ferramentas, consulte Bash, Editor de Texto, Uso do Computador e Memória.
Pesquisa na Web Descubra os dados reais atuais de toda a Web a serem usados para aumentar o conhecimento de Claude. Para implantações hospedadas em Azure, há suporte apenas para a versão da web_search_20250305 ferramenta.
Busca na Web Recupere e realize uma análise aprofundada do conteúdo completo de páginas web e documentos PDF especificados, enriquecendo o contexto do Claude com conteúdo da web em tempo real. No Foundry, a busca de Web requer uma implantação hospedada na infraestrutura da Anthropic. Para implantações hospedadas em Azure, há suporte apenas para a versão da web_fetch_20250910 ferramenta.

Infraestrutura de ferramentas

Descobrir, orquestrar e dimensionar o uso da ferramenta.

Característica Description
Streaming de ferramentas com granularidade fina A ferramenta de fluxo usa parâmetros sem buffer ou validação JSON, reduzindo a latência para parâmetros grandes. Requer o anthropic-beta cabeçalho fine-grained-tool-streaming-2025-05-14.
Conector MCP Conecte-se a servidores MCP remotos diretamente da API de Mensagens sem um cliente MCP separado.
Pesquisa de ferramentas Escalone para milhares de ferramentas ao descobrir e carregar dinamicamente ferramentas sob demanda usando busca baseada em regex e BM25, otimizando o uso do contexto e melhorando a precisão da seleção de ferramentas. Para implantações hospedadas no Azure, há suporte para ambas as versões da ferramenta tool_search_tool_regex_20251119 e tool_search_tool_bm25_20251119. Os aliases tool_search_tool_bm25 herdados e tool_search_tool_regex também são aceitos.

Gerenciamento de contexto

Controle e otimize a janela de contexto de Claude para sessões longas.

Característica Description
Cache de prompt automático Simplifique o armazenamento em cache de prompts em um único parâmetro da API. O sistema armazena automaticamente em cache o último bloco em cache em sua solicitação, movendo o ponto de cache para frente à medida que as conversas crescem.
Cache de prompt (5m) Forneça ao Claude mais conhecimento contextual e exemplos de saída para reduzir custos e latência.
Armazenamento em cache de prompt (1 h) Duração estendida do cache de 1 hora para um contexto menos acessado, mas importante, complementando o cache padrão de 5 minutos.
Edição de contexto Gerencie automaticamente o contexto da conversa com estratégias configuráveis, incluindo a limpeza dos resultados de ferramentas e o gerenciamento de blocos de pensamento. Requer o cabeçalho anthropic-beta context-management-2025-06-27.
Contagem de tokens A contagem de tokens permite determinar o número de tokens em uma mensagem antes de enviá-la para Claude, ajudando você a tomar decisões mais bem informadas sobre seus prompts e uso.

Arquivos e ativos

Gerencie os documentos e os dados que você fornece ao Claude.

Característica Description
API de arquivos Atualmente disponível apenas para implantações hospedadas na infraestrutura da Anthropic. Carregue e gerencie arquivos a serem usados com Claude sem recarregar o conteúdo com cada solicitação. Dá suporte a PDFs, imagens e arquivos de texto.

Suporte ao agente

Tipos e regiões de implantação

Os modelos claude no Foundry estão disponíveis para os seguintes tipos de implantação em regiões Azure específicas:

  • Padrão global: todos os modelos Claude (hospedados no Azure e na infraestrutura da Anthropic).
  • Data Zone Standard (EUA): Hospedado nas versões do Azure de claude-opus-5, claude-opus-4-8, e claude-sonnet-5.

Para ver as regiões exatas do Azure onde os modelos Claude estão disponíveis para implantação, consulte Disponibilidade de regiões por tipo de implantação.

Cotas e limites de taxa

Esta seção explica como as implantações compartilham a cota e quais limites de taxa se aplicam a elas. O gerenciamento no nível da assinatura gerencia a cota de implantação. Recursos e regiões compartilham a cota em vez de alocá-la separadamente para cada recurso ou região.

  • Todas as implantações "Global Standard" do mesmo modelo e versão em uma assinatura utilizam um pool de cotas compartilhado entre todas as regiões.
  • Todas as implantações "Data Zone Standard" do mesmo modelo e versão em uma assinatura utilizam um pool de cotas compartilhado dentro de cada zona de dados (por exemplo, EUA).

Para obter mais informações sobre o gerenciamento de cotas dos Modelos do Foundry, consulte cotas e limites dos Modelos do Microsoft Foundry.

ITPM com reconhecimento de cache

No Foundry, os modelos do Claude medem limites de taxa em solicitações por minuto (RPM), tokens de entrada não armazenados em cache por minuto (ITPM) e tokens de saída por minuto (OTPM) para cada modelo.

Para a maioria dos modelos Claude, somente os tokens de entrada não armazenados contam para os limites de taxa do ITPM. Esses tokens incluem:

  • Tokens de entrada – tokens na solicitação após o último ponto de interrupção de cache (entrada não armazenada em cache).

  • Tokens de entrada para criação de cache — tokens gravados no cache, que incluem:

    • Gravação em cache (5 min) TPM — tokens sendo gravados no cache de prompt de 5 minutos.
    • Gravação em cache (1 h) TPM — tokens sendo gravados no cache de prompt de 1 hora.

Tip

O total de tokens de entrada é a soma de tokens de entrada, tokens de entrada para criação de cache e tokens de entrada de leitura de cache (os tokens lidos a partir do cache). No entanto, os tokens de entrada lidos do cache não contam para o ITPM. O OTPM também não conta para o ITPM.

Para obter mais informações sobre limites de taxa e cache, consulte Claude API Docs: Limites de taxa.

Limites de taxa por tipo de assinatura

Seu tipo de assinatura Azure determina seus limites de taxa. As colunas Versão 2: Hospedada no Azure e Versão 1: Hospedada na infraestrutura da Anthropic indicam se há cota disponível para essa combinação de modelo e tipo de implantação. Sim significa que a cota está disponível. N/A significa que a combinação de modelo e versão não tem cota para esse tipo de implantação.

A tabela a seguir lista os limites de taxa. Para aumentar sua cota além dos limites padrão, envie uma solicitação por meio do formulário de solicitação de aumento de cota.

Pago conforme o uso

Modelo Tipo de implantação Versão 2: Hospedado no Azure Versão 1: Hospedada na infraestrutura de Anthropic RPM ITPM OTPM
claude-fable-5-1 Padrão Global N/A Yes 0 0 0
claude-fable-5 Padrão Global N/A Yes 0 0 0
claude-opus-5 Padrão Global Yes Yes 40 40,000 8,000
claude-opus-5 Padrão da Zona de Dados (EUA) Yes N/A 40 40,000 8,000
claude-opus-4-8 Padrão Global Yes Yes 40 40,000 8,000
claude-opus-4-8 Padrão da Zona de Dados (EUA) Yes N/A 40 40,000 8,000
claude-opus-4-7 Padrão Global N/A Yes 40 40,000 8,000
claude-opus-4-6 Padrão Global N/A Yes 40 40,000 8,000
claude-opus-4-5 Padrão Global N/A Yes 40 40,000 8,000
claude-sonnet-5 Padrão Global Yes Yes 40 40,000 8,000
claude-sonnet-5 Padrão da Zona de Dados (EUA) Yes N/A 40 40,000 8,000
claude-sonnet-4-6 Padrão Global N/A Yes 80 80,000 16,000
claude-sonnet-4-5 Padrão Global N/A Yes 80 80,000 16,000
claude-haiku-4-5 Padrão Global Yes Yes 80 80,000 16,000

Considerações sobre IA responsável

Ao usar os modelos Claude no Foundry, considere estas práticas de IA responsáveis:

Práticas recomendadas

Siga estas melhores práticas ao trabalhar com os modelos Claude no Foundry.

Engenharia de prompts

  • Instruções claras: forneça prompts específicos e detalhados.
  • Gerenciamento de contexto: use a janela de contexto disponível efetivamente.
  • Definições de função: use mensagens do sistema para definir a função e o comportamento do assistente.
  • Prompts estruturados: utilize uma formatação consistente para obter melhores resultados.

Otimização de custos

Para otimizar seu uso e evitar a limitação de taxa:

  • Implementar lógica de repetição: manipule 429 respostas com a retirada exponencial.
  • Solicitações em lote: combine vários prompts quando possível.
  • Monitorar o uso do token: acompanhe o consumo de token e os padrões de solicitação.
  • Use modelos apropriados: use o modelo mais econômico para seu caso de uso. Consulte os modelos de Claude disponíveis.