Os modelos Claude na Microsoft Foundry

Os modelos Claude da Anthropic trazem capacidades avançadas de IA conversacional para a Microsoft Foundry, proporcionando compreensão e geração de linguagens de última geração para aplicações inteligentes. Os modelos Claude destacam-se em raciocínio complexo, geração de código e tarefas multimodais, incluindo análise de imagens. Este artigo descreve os modelos Claude disponíveis, como são alojados e faturados, APIs suportadas, capacidades, quotas e melhores práticas.

Para implementar e chamar um modelo Claude, consulte Implementar e usar modelos Claude no Microsoft Foundry.

Importante

Os itens assinalados como (pré-visualização) neste artigo estão atualmente em pré-visualização pública. Esta pré-visualização é fornecida sem um acordo de nível de serviço, e não a recomendamos para trabalhos em produção. Certas funcionalidades podem não ser suportadas ou podem ter capacidades limitadas. Para mais informações, consulte Termos Suplementares de Utilização para Microsoft Azure Previews.

Como os modelos Claude são alojados e faturados

A Microsoft Foundry oferece modelos Claude em duas versões:

  • Versão 1: Alojada na infraestrutura Anthropic; estes modelos correm na infraestrutura da Anthropic (fora do Azure).
  • Versão 2: Alojada no Azure; estes modelos correm na infraestrutura Azure de ponta a ponta e estão todos disponíveis de forma geral (GA).

Nem todos os modelos estão disponíveis em ambas as versões. A fase do ciclo de vida de um modelo, como Pré-visualização ou Disponível em geral, pode diferir entre as duas versões. Para disponibilidade por modelo e estado do ciclo de vida, veja Modelos Claude disponíveis.

Para comparar ambas as opções de alojamento em termos de residência de dados, SLAs, vias de suporte, conformidade e processo de compra, consulte Comparar modelos Claude alojados no Azure e alojados pela Anthropic.

Note

Pode aceder aos modelos Claude no Microsoft Foundry através de Foundry Models de parceiros e da comunidade. Os modelos de parceiros e da comunidade que a Anthropic vende e opera são Produtos Não Microsoft ao abrigo dos Termos do Produto.

Os modelos Claude no Foundry requerem uma subscrição do Azure Marketplace e faturam através das Unidades de Consumo Claude (CCU). Certifique-se de que tem as permissões necessárias para subscrever as ofertas de modelos antes de implementar. Para detalhes sobre preços, consulte faturação das Unidades de Consumo Claude (CCU) no Microsoft Foundry.

Modelos Claude disponíveis

Importante

Os seguintes modelos Claude cumprem a norma da UE relativa a marcas de água: claude-mythos-5-1, claude-fable-5-1 e claude-fable-5. Enquanto claude-fable-5 usa marcação de água com chave única, claude-mythos-5-1 e claude-fable-5-1 usam chave dupla (2 chaves entrelaçadas e C2PA), da seguinte forma:

  • Marcação de água em texto entrelaçado (segunda chave): é acrescentada uma segunda chave para a deteção de marca de água entrelaçada, de acordo com as normas da UE. A marca de água é aplicada no servidor no momento da geração; não há alterações nas estruturas dos pedidos ou das respostas. Uma API separada de deteção de marcas de água está em acesso antecipado e não faz parte do âmbito de lançamento da Foundry.
  • Marcação de água C2PA: marcação de proveniência do conteúdo C2PA, gerida no lado do servidor e do cliente pelas interfaces da Anthropic. Sem alteração de forma da API.

A tabela seguinte compara a disponibilidade dos modelos para ambas as versões dos modelos Claude no Foundry. Para detalhes sobre as funcionalidades referenciadas na tabela, consulte a secção Capacidades e funcionalidades avançadas .

Para erros que possa encontrar ao implementar ou chamar modelos Claude, consulte Deploy e use modelos Claude: Resolução de problemas.

Model Availability Janela de contexto / Saída máxima Capacidades chave Melhor para
claude-mythos-5-1 1
  • Alojado em infraestrutura da Anthropic: Pré-visualização de investigação com acesso restrito
1M / 128K
  • Biologia e ciências da vida
  • Cibersegurança (casos de uso defensivos priorizados): descoberta de vulnerabilidades, auditoria de superfície de ataque, red teaming, inteligência de ameaças
  • Codificação autónoma
  • Agentes de longa duração
claude-mythos-5 1
  • Alojado em infraestrutura da Anthropic: Pré-visualização de investigação com acesso restrito
1M / 128K
  • Biologia e ciências da vida
  • Cibersegurança (casos de uso defensivos priorizados): descoberta de vulnerabilidades, auditoria de superfície de ataque, red teaming, inteligência de ameaças
  • Codificação autónoma
  • Agentes de longa duração
claude-fable-5-1
  • Alojado na infraestrutura da Anthropic: Pré-visualização
1M / 128K
  • Pensamento adaptativo
  • Trabalho de longa duração
  • Investigação científica com auto-verificação
  • Trabalho do conhecimento; lidar com trabalhos de conhecimento desafiantes com menos supervisão prática
  • Recusa stop_reason relativa a políticas de salvaguarda de dupla utilização2
  • Veja o que há de novo em Claude Fable 5.1 e Claude Mythos 5.1
  • Agentes de longa duração
  • Programação e agentes, com raciocínios mais profundos para fluxos de trabalho empresariais
  • Ciência geral e investigação
  • Análise financeira
  • Visão
claude-fable-5
  • Alojado na infraestrutura da Anthropic: Pré-visualização
1M / 128K
  • Pensamento adaptativo
  • Raciocínio aplicado a bases de código completas e ao contexto de projeto ao longo de vários dias
  • Trabalho autónomo mais prolongado do que o de qualquer modelo Claude anterior
  • Auto-verificação
  • Orquestração de subagentes
  • Recusa stop_reason relativa a políticas de salvaguarda de dupla utilização2
  • Ver Migração para Claude Fable 5.1 e Claude Mythos 5.1
  • Cybersecurity
  • Codificação autónoma
  • Agentes de longa duração
  • Programação e agentes, com raciocínios mais profundos para fluxos de trabalho empresariais
claude-mythos-preview 1
  • Alojado em infraestrutura da Anthropic: Pré-visualização de investigação com acesso restrito
1M / 128K
  • Cibersegurança (casos de uso defensivo priorizados)
  • Codificação autónoma
  • Agentes de longa duração
claude-opus-5
  • Alojado no Azure: GA
  • Alojado em infraestrutura Anthropic: GA
1M / 128K
  • Pensamento adaptativo com xhigh e max níveis de esforço
  • Raciocínio aplicado a bases de código completas e ao contexto de projeto ao longo de vários dias
  • Controlos de esforço por turno3
  • A meio de uma conversa3role:"system"
  • Limites de tokens3 (task_budget)
  • Veja o que há de novo em Claude Opus 5
  • Inteligência Near-Fable para programação de longo alcance e orquestração complexa baseada em agentes.
  • Agentes de longa duração
  • Fluxos de trabalho empresariais
  • Análise financeira
  • Utilização do computador
claude-opus-4-8
  • Alojado no Azure: GA
  • Alojado em infraestrutura Anthropic: GA
1M / 128K
  • Raciocínio adaptativo com nível de esforço xhigh
  • Raciocínio aplicado a bases de código completas e ao contexto de projeto ao longo de vários dias
  • Entrada de imagem de alta resolução (até 2576px / 3,75MP)
  • Ver Migração para Claude Opus 5
  • Coding
  • Agentes de longa duração
  • Análise financeira
  • Cybersecurity
  • Utilização do computador
claude-opus-4-7
  • Alojado na infraestrutura da Anthropic: GA
1M / 128K
  • Pensamento adaptativo
  • Raciocínio sobre bases de código inteiras
  • Entrada de imagem de alta resolução (até 2576px / 3,75MP)
  • Ver Migração para Claude Opus 5
  • Coding
  • Fluxos de trabalho empresariais
  • Agentes de longa duração
  • Raciocínio multimodal
  • Análise financeira
  • Cybersecurity
claude-opus-4-6
  • Alojado na infraestrutura da Anthropic: GA
1M / 128K
  • Pensamento adaptativo
  • Introdução de imagem e texto
  • Utilização do computador
  • Uso avançado de ferramentas (pesquisa, chamada programática, exemplos)
  • Ver Migração para Claude Opus 5
  • Coding
  • Agentes empresariais
claude-opus-4-5
  • Alojado na infraestrutura da Anthropic: GA
200K / 64K
  • Pensamento expandido
  • Introdução de imagem e texto
  • Utilização do computador
  • Uso avançado de ferramentas (pesquisa, chamada programática, exemplos)
  • Ver Migração para Claude Opus 5
  • Coding
  • Agentes
  • Utilização do computador
  • Fluxos de trabalho empresariais
claude-sonnet-5
  • Alojado no Azure: GA
  • Alojado em infraestrutura Anthropic: GA
1M / 128K
  • Pensamento adaptativo
  • xhigh Nível de esforço
  • Raciocínio aplicado a bases de código completas e ao contexto de projeto ao longo de vários dias
  • A entrada de imagem de alta resolução (até 2576px / 3,75MP) está ativada por defeito
  • A meio de uma conversa3role:"system"
  • Limites de tokens3 (task_budget)
  • Veja o que há de novo em Claude Soneto 5
  • Coding
  • Agentes de longa duração
  • Análise financeira
  • Cybersecurity
  • Utilização do computador
claude-sonnet-4-6
  • Alojado na infraestrutura da Anthropic: GA
1M / 128K
  • Pensamento adaptativo
  • Introdução de imagem e texto
  • Utilização do computador
  • Uso avançado de ferramentas (pesquisa, chamada programática, exemplos)
  • Consulte Migrar para Claude Sonnet 5
  • Coding
  • Agentes
  • Fluxos de trabalho empresariais
claude-sonnet-4-5
  • Alojado na infraestrutura da Anthropic: GA
200K / 64K
  • Agentes e tarefas complexas e de longo prazo
  • Cargas de trabalho de alto volume
claude-haiku-4-5
  • Alojado no Azure: GA
  • Alojado em infraestrutura Anthropic: GA
200K / 64K
  • Pensamento expandido
  • Introdução de imagem e texto
  • Coding
  • Agentes

1Claude Mythos 5-1, Claude Mythos 5 e Claude Mythos Preview estão disponíveis apenas como pré-visualização de pesquisa bloqueada. O acesso aos modelos é concedido exclusivamente a critério da Anthropic e é prioritário para casos de uso defensivo de cibersegurança. Consulte o cartão de sistema Claude Fable 5.1 & Claude Mythos 5.1, o cartão de sistema Claude Mythos 5 e o cartão de sistema Claude Mythos Preview para orientações sobre uso responsável.

2Claude Fable 5 aplica classificadores adicionais de entrada/saída que podem recusar pedidos cujo conteúdo desencadeia políticas de salvaguarda de dupla utilização. Quando ocorre uma recusa, o pedido devolve uma resposta bem-sucedida (200) com um indicador stop_reason: "refusal" de recusa em vez de conteúdo gerado pelo modelo. Não és cobrado por tokens de entrada que são recusados.

3 controlos do esforço por turno, a meio da conversa e orçamentos de tokens estão atualmente em versão beta.

Visão geral da API

A tabela seguinte lista as APIs que pode utilizar para interagir com as versões Alojadas no Azure e Alojadas na infraestrutura da Anthropic dos modelos Claude no Foundry.

Utilize os SDKs da Anthropic e as seguintes APIs Claude:

Tip

A versão Hosted on Anthropic infrastructure dos modelos Claude no Foundry suporta mais APIs do que as listadas nesta tabela. Pode vê-los na página documentação da API do Claude: visão geral da API.

API Description
Mensagens1 (POST /v1/messages) API de Mensagens Principais: Envie uma lista estruturada de mensagens de entrada com texto ou conteúdos de imagem, incluindo respostas em streaming. O modelo gera a próxima mensagem na conversa.
Contagem de tokens (POST /v1/messages/count_tokens) API de Contagem de Tokens: Conte o número de tokens numa mensagem antes de a enviar para o Claude.

1Pode chamar a API de Mensagens a partir do anthropic pacote Python, do @anthropic-ai/foundry-sdk pacote JavaScript, ou diretamente através do REST. O endpoint de implementação segue a forma https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, e os clientes REST e JavaScript usam o anthropic-version: 2023-06-01 cabeçalho.

Capacidades e funcionalidades avançadas

Os modelos Claude no Foundry expõem capacidades essenciais para processar, analisar e gerar conteúdo, bem como ferramentas que permitem a Claude interagir com sistemas externos, executar código e realizar tarefas automatizadas. A superfície API do Claude está organizada em cinco áreas:

As secções e tabelas seguintes resumem as capacidades disponíveis entre as versões Alojado no Azure e Alojado na infraestrutura da Anthropic dos modelos Claude no Foundry. Salvo indicação, uma funcionalidade aplica-se a ambas as versões.

Tip

A versão alojada na infraestrutura da Anthropic dos modelos Claude no Foundry suporta mais funcionalidades do que as indicadas nestas tabelas. Pode consultar a lista completa de funcionalidades no Claude Platform Docs: Features Overview.

Para mais informações sobre as capacidades e funcionalidades avançadas disponíveis para os modelos Claude no Foundry, consulte o Microsoft Developer Blog.

Capacidades do modelo

Formas de orientar o Claude e as suas saídas diretas, incluindo o formato da resposta, o nível de raciocínio e as modalidades de entrada.

Feature Description
Mensagens em streaming Ao criar uma Mensagem, defina "stream": true o fluxo incremental da resposta usando eventos enviados pelo servidor (SSE).
Pensar Capacidades de raciocínio melhoradas para tarefas complexas, proporcionando transparência sobre o processo de pensamento passo a passo do Claude antes de dar a resposta final. Veja Pensamento e esforço para valores thinking de parâmetros por modelo.
Pensamento adaptativo Deixa Claude decidir dinamicamente quando e quanto pensar. Esta funcionalidade é o único modo de reflexão nos modelos Claude 4.7 e seguintes. Use o effort parâmetro para controlar a profundidade do pensamento.
Esforço Controla quantos tokens o Claude usa ao responder, estabelecendo um equilíbrio entre a minuciosidade da resposta e a eficiência na utilização de tokens. Veja Pensamento e esforço para valores effort de parâmetros por modelo.
Citações Fundamente as respostas do Claude em fontes, incluindo blocos search_resultde conteúdo de resultados de pesquisa.
Imagens e visão Processar e analisar conteúdos a partir de imagens. As implementações alojadas no Azure só aceitam imagens codificadas em base64 ou baseadas em URL.
Suporte para PDF Processar e analisar texto e conteúdo visual a partir de documentos PDF. Forneça PDFs como base64 ou URL.
Janela de contexto de 1 M Até 1 milhão de tokens para processar documentos grandes, bases de código extensas e longas conversas. O apoio está sujeito à elegibilidade do modelo.
Resultados estruturados Restringa as respostas do Claude a seguir um esquema JSON específico, usando duas funcionalidades complementares: saídas JSON (o output_config.format parâmetro) para respostas estruturadas, e uso estrito de ferramentas (strict: true) para entradas validadas da ferramenta. Para implementações Alojadas no Azure, as saídas estruturadas também suportam o parâmetro legado para as saídas JSON (o output_format parâmetro).

Pensamento e esforço

A funcionalidade Pensar permite valores específicos para o thinking tipo de parâmetro, dependendo do modelo, conforme descrito na tabela seguinte. O adaptive tipo configura a funcionalidade de pensamento adaptativo , permitindo ao modelo decidir se deve pensar, com base na complexidade da consulta e no nível de esforço. Por exemplo, thinking={"type": "adaptive"}.

Model adaptive enabled disabled
claude-mythos-5-1 Yes No No
claude-mythos-5 Yes No No
claude-fable-5-1 Yes No No
claude-fable-5 Yes No No
claude-mythos-preview Yes Yes No
claude-opus-5 Yes No Sim1
claude-opus-4-8 Yes No Yes
claude-opus-4-7 Yes No Yes
claude-opus-4-6 Yes Yes Yes
claude-sonnet-5 Yes No Yes
claude-sonnet-4-6 Yes Yes Yes

1 A reflexão pode ser disabled apenas ao nível de esforço high ou inferior

A funcionalidade Esforço permite níveis específicos effort para cada modelo, conforme descrito na tabela seguinte. O xhigh nível produz o mesmo resultado que max.

Model low medium high xhigh max
claude-mythos-5-1 Yes Yes Yes Yes No
claude-mythos-5 Yes Yes Yes Yes No
claude-fable-5-1 Yes Yes Yes Yes No
claude-fable-5 Yes Yes Yes Yes No
claude-opus-5 Yes Yes Yes Yes Yes
claude-opus-4-8 Yes Yes Yes Yes Yes
claude-opus-4-7 Yes Yes Yes Yes Yes
claude-opus-4-6 Yes Yes Yes No Yes
claude-sonnet-5 Yes Yes Yes Yes Yes
claude-sonnet-4-6 Yes Yes Yes No Yes

Tools

Deixe o Claude agir na web ou no seu ambiente. Esta funcionalidade consiste em ferramentas incorporadas que Claude invoca através de tool_use. A plataforma executa ferramentas do lado do servidor, e tu implementas e executas ferramentas do lado do cliente.

Feature Description
Utilização de ferramentas com ferramentas executadas pelo cliente Ferramentas personalizadas, além de bash, text editor, computer use e memory, definidas pela Anthropic. Para mais informações sobre estas ferramentas, veja Bash, Editor de texto, Uso do computador e Memória.
Pesquisa na Web Descubra dados atuais do mundo real de toda a web para usar para complementar o conhecimento de Claude. Para implementações Alojadas no Azure, apenas a web_search_20250305 versão da ferramenta é suportada.
Busca web Recuperar e realizar análises aprofundadas do conteúdo completo de páginas web e documentos PDF especificados, complementando o contexto de Claude com conteúdo web em direto. No Foundry, a pesquisa na web requer uma implementação alojada na infraestrutura da Anthropic. Para implementações Alojadas no Azure, apenas a web_fetch_20250910 versão da ferramenta é suportada.

Infraestrutura de ferramentas

Descubra, orquestre e expanda a utilização de ferramentas.

Feature Description
Transmissão detalhada de ferramentas A ferramenta de stream utiliza parâmetros sem buffering ou validação JSON, reduzindo a latência para parâmetros grandes. Requer o anthropic-beta cabeçalho fine-grained-tool-streaming-2025-05-14.
Conector MCP Liga-te diretamente a servidores MCP remotos a partir da API de Mensagens sem um cliente MCP separado.
Pesquisa por ferramentas Expanda para milhares de ferramentas, descobrindo-as e carregando-as dinamicamente conforme necessário, através de pesquisa baseada em regex e BM25, otimizando a utilização do contexto e melhorando a precisão da seleção de ferramentas. Para implementações do tipo Alojado no Azure, são suportadas tanto as versões da ferramenta tool_search_tool_bm25_20251119 como tool_search_tool_regex_20251119. Os pseudónimos tool_search_tool_bm25 antigos também tool_search_tool_regex são aceites.

Gestão do contexto

Controlar e otimizar a janela de contexto do Claude para sessões de longa duração.

Feature Description
Cache automática de prompts Simplifique a cache de prompts para um único parâmetro da API. O sistema armazena automaticamente em cache o último bloco cacheável do seu pedido, avançando o ponto de cache à medida que as conversas crescem.
Cache de prompts (5m) Forneça ao Claude mais conhecimento prévio e exemplos de resultados para reduzir custos e latência.
Cache de prompts (1 hora) Duração estendida do cache de 1 hora para um contexto menos acedido mas importante, complementando o cache padrão de 5 minutos.
Edição de contexto Gerir automaticamente o contexto da conversa com estratégias configuráveis, incluindo a limpeza dos resultados das ferramentas e a gestão dos blocos de raciocínio. Requer o cabeçalho anthropic-beta context-management-2025-06-27.
Contagem de tokens A contagem de tokens permite-lhe determinar o número de tokens numa mensagem antes de a enviar para o Claude, ajudando-o a tomar decisões informadas sobre os seus prompts e utilização.

Ficheiros e ativos

Gerir os documentos e dados que fornece ao Claude.

Feature Description
API de ficheiros Atualmente disponível apenas em implementações alojadas na infraestrutura da Anthropic. Carregar e gerir ficheiros para usar com Claude sem voltar a carregar conteúdo a cada pedido. Suporta PDFs, imagens e ficheiros de texto.

Suporte a agentes

Tipos de implantação e regiões

Os modelos Claude no Foundry estão disponíveis para os seguintes tipos de implementação em regiões específicas do Azure:

  • Padrão Global: Todos os modelos Claude (hospedados no Azure e na infraestrutura da Anthropic).
  • Data Zone Standard (EUA): Alojado nas versões Azure de claude-opus-5, claude-opus-4-8, e claude-sonnet-5.

Para as regiões exatas do Azure onde os modelos Claude estão disponíveis para implementação, veja Disponibilidade de Região por tipo de implementação.

Quotas e limites de tarifas

Esta secção explica como as implantações partilham quotas e que limites de taxa se aplicam a elas. A gestão ao nível da subscrição gere a quota de implementação. Recursos e regiões partilham a quota em vez de a alocar separadamente para cada recurso ou região.

  • Todas as implementações Global Standard do mesmo modelo e versão numa subscrição utilizam um conjunto comum de quotas partilhado por todas as regiões.
  • Todas as implementações do Data Zone Standard do mesmo modelo e versão numa subscrição são retiradas de um pool de quotas partilhado dentro de cada zona de dados (por exemplo, EUA).

Para mais informações sobre a gestão de quotas para Foundry Models, consulte quotas e limites do Microsoft Foundry Models.

ITPM consciente de cache

Os modelos Claude na Foundry definem limites de taxa em pedidos por minuto (RPM), tokens de entrada não armazenados em cache por minuto (ITPM) e tokens de saída por minuto (OTPM) para cada modelo.

Para a maioria dos modelos Claude, apenas os tokens de entrada não armazenados em cache contam para os seus limites de taxa do ITPM. Estes tokens incluem:

  • Tokens de entrada — tokens no pedido após o último ponto de interrupção da cache (entrada sem cache).

  • Tokens de entrada para criação de cache — tokens escritos em cache, que compreendem:

    • Gravação na cache de prompts 5m TPM — tokens que estão a ser gravados na cache de prompts de 5 minutos.
    • Escrita de cache 1h TPM — tokens a serem escritos na cache de prompt de 1 hora.

Tip

O total de tokens de entrada é a soma dos tokens de entrada, tokens de criação de cache e tokens de leitura de cache (os tokens lidos da cache). No entanto, os tokens de leitura da cache não contam para o ITPM. O OTPM também não conta para o ITPM.

Para mais informações sobre limites de taxa e cache, consulte Claude API Docs: Limites de taxa.

Limites de taxa por tipo de subscrição

O tipo de subscrição do Azure determina os seus limites de taxa. As colunas Versão 2: Alojada no Azure e Versão 1: Alojada na infraestrutura da Anthropic indicam se existe quota disponível para essa combinação de modelo e tipo de implementação. Sim significa que há uma quota disponível. N/A significa que a combinação de modelo e versão não tem quota para esse tipo de implementação.

A tabela seguinte lista os limites de taxa. Para aumentar a sua quota para além dos limites padrão, submeta um pedido através do formulário de pedido de aumento da quota.

Pay-as-you-go

Model Tipo de implantação Versão 2: Alojada no Azure Versão 1: Alojada em infraestrutura da Anthropic RPM ITPM OTPM
claude-fable-5-1 Padrão Global N/A Yes 0 0 0
Claude-Fable-5 Padrão Global N/A Yes 0 0 0
claude-opus-5 Padrão Global Yes Yes 40 40,000 8,000
claude-opus-5 Norma de Zonas de Dados (EUA) Yes N/A 40 40,000 8,000
claude-opus-4-8 Padrão Global Yes Yes 40 40,000 8,000
claude-opus-4-8 Norma de Zonas de Dados (EUA) Yes N/A 40 40,000 8,000
claude-opus-4-7 Padrão Global N/A Yes 40 40,000 8,000
claude-opus-4-6 Padrão Global N/A Yes 40 40,000 8,000
claude-opus-4-5 Padrão Global N/A Yes 40 40,000 8,000
Claude-Sonnet-5 Padrão Global Yes Yes 40 40,000 8,000
Claude-Sonnet-5 Norma de Zonas de Dados (EUA) Yes N/A 40 40,000 8,000
Claude-Sonnet-4-6 Padrão Global N/A Yes 80 80,000 16 000
Claude-Sonnet-4-5 Padrão Global N/A Yes 80 80,000 16 000
claude-haiku-4-5 Padrão Global Yes Yes 80 80,000 16 000

Considerações sobre IA responsável

Ao utilizar modelos Claude no Foundry, considere estas práticas responsáveis de IA:

Melhores práticas

Siga estas melhores práticas ao trabalhar com modelos Claude no Foundry:

Engenharia de prompts

  • Instruções claras: Forneça prompts específicos e detalhados.
  • Gestão de contexto: Utilize eficazmente a janela de contexto disponível.
  • Definições de funções: Use mensagens do sistema para definir o papel e o comportamento do assistente.
  • Prompts estruturados: Use uma formatação consistente para melhores resultados.

Otimização de custos

Para otimizar a sua utilização e evitar limitações de taxas:

  • Implementar lógica de retentativa: Lidar com 429 respostas com recuo exponencial.
  • Pedidos em lote: Combine múltiplos prompts sempre que possível.
  • Monitorizar a utilização de tokens: Acompanhar os padrões de consumo e pedidos de tokens.
  • Use modelos adequados: Use o modelo mais económico para o seu caso de uso. Ver Modelos Claude disponíveis.