Observação
O acesso a essa página exige autorização. Você pode tentar entrar ou alterar diretórios.
O acesso a essa página exige autorização. Você pode tentar alterar os diretórios.
Os modelos Claude da Anthropic trazem recursos avançados de IA de conversa para Microsoft Foundry, fornecendo compreensão e geração de linguagem de última geração para aplicativos inteligentes. Os modelos Claude se destacam em raciocínio complexo, geração de código e tarefas multimodais, incluindo análise de imagem. Este artigo descreve os modelos Claude disponíveis, como eles são hospedados e cobrados, as APIs compatíveis, os recursos, os limites de uso e as práticas recomendadas.
Para implantar e chamar um modelo claude, consulte Implantar e usar modelos Claude no Microsoft Foundry.
Importante
Os itens marcados (versão prévia) neste artigo estão atualmente em versão prévia pública. Essa versão prévia é fornecida sem um contrato de nível de serviço e não recomendamos isso para cargas de trabalho de produção. Alguns recursos podem não ter suporte ou podem ter restrição de recursos. Para obter mais informações, consulte Termos de Uso Complementares para Versões Prévias do Microsoft Azure.
Como os modelos Claude são hospedados e faturados
Microsoft Foundry oferece modelos Claude em duas versões:
- Versão 1: Hospedada na infraestrutura da Anthropic; esses modelos são executados na infraestrutura da Anthropic (fora do Azure).
- Versão 2: Hospedados no Azure; esses modelos são executados integralmente na infraestrutura do Azure e estão todos em disponibilidade geral (GA).
Nem todos os modelos estão disponíveis em ambas as versões. O estágio de ciclo de vida de um modelo, como Visualização ou Disponibilidade Geral, pode ser diferente entre as duas versões. Para obter a disponibilidade por modelo e o status do ciclo de vida, consulte os modelos claude disponíveis.
Para comparar as duas opções de hospedagem em termos de residência de dados, SLAs, canais de suporte, conformidade e processo de compra, consulte Comparar modelos Claude hospedados no Azure e pela Anthropic.
Note
Você acessa os modelos Claude no Microsoft Foundry por meio de Modelos do Foundry de parceiros e da comunidade. Modelos de parceiros e da comunidade vendidos e operados pela Anthropic são Produtos que Não São da Microsoft, conforme os Termos do Produto.
Os modelos Claude no Foundry exigem uma assinatura do Azure Marketplace e são cobrados por meio das Unidades de Consumo Claude (CCU). Verifique se você possui as permissões necessárias para se inscrever em ofertas de modelo antes de implantar. Para obter detalhes sobre preços, consulte a cobrança de Claude Consumption Units (CCU) no Microsoft Foundry.
Modelos de Claude disponíveis
Importante
Os seguintes modelos Claude estão em conformidade com o padrão de marca d’água da UE: claude-mythos-5-1, claude-fable-5-1 e claude-fable-5.
Enquanto claude-fable-5 usa marca d'água de chave única, claude-mythos-5-1 e claude-fable-5-1 usam chave dupla (2 chaves entrelaçadas e C2PA), da seguinte forma:
- Marca d'água em texto entrelaçado (segunda chave): uma segunda chave é adicionada para a detecção de marca d'água entrelaçada, conforme as normas da UE. A aplicação de marca d’água ocorre no servidor no momento da geração; não há nenhuma alteração nas estruturas das solicitações ou respostas. Uma API independente de detecção de marca d'água está em acesso antecipado e não faz parte do escopo de lançamento do Foundry.
- Marca d'água C2PA: marcação de procedência de conteúdo C2PA, processada no lado do servidor/cliente pelas interfaces da Anthropic. Nenhuma alteração de forma de API.
A tabela a seguir compara a disponibilidade do modelo para ambas as versões de modelos Claude no Foundry. Para obter detalhes sobre os recursos referenciados na tabela, consulte a seção Recursos e recursos avançados .
Para ver os erros que podem ocorrer ao implantar ou chamar modelos Claude, consulte Implantar e usar modelos Claude: Solução de problemas.
| Modelo | Disponibilidade | Janela de contexto/Saída máxima | Principais funcionalidades | Melhor para |
|---|---|---|---|---|
claude-mythos-5-1
1 |
|
1M/128K |
|
|
claude-mythos-5
1 |
|
1M/128K |
|
|
claude-fable-5-1 |
|
1M/128K |
|
|
claude-fable-5 |
|
1M/128K |
|
|
claude-mythos-preview
1 |
|
1M/128K |
|
|
claude-opus-5 |
|
1M/128K |
|
|
claude-opus-4-8 |
|
1M/128K |
|
|
claude-opus-4-7 |
|
1M/128K |
|
|
claude-opus-4-6 |
|
1M/128K |
|
|
claude-opus-4-5 |
|
200K/64K |
|
|
claude-sonnet-5 |
|
1M/128K |
|
|
claude-sonnet-4-6 |
|
1M/128K |
|
|
claude-sonnet-4-5 |
|
200K/64K |
|
|
claude-haiku-4-5 |
|
200K/64K |
|
|
1Claude Mythos 5-1, Claude Mythos 5 e Claude Mythos Preview só estão disponíveis como visualização de pesquisa fechada. O acesso aos modelos é concedido exclusivamente a critério da Anthropic e priorizado para casos de uso de segurança cibernética defensiva. Confira o cartão do sistema Claude Fable 5.1 &Claude Mythos 5.1, o cartão do sistema Claude Mythos 5 e o cartão do sistema Claude Mythos Preview para obter diretrizes de uso responsável.
2Claude Fable 5 aplica classificadores de entrada/saída adicionais que podem recusar solicitações cujo conteúdo dispara políticas de proteção de uso duplo. Quando ocorre uma recusa, a solicitação retorna uma resposta bem-sucedida (200) com um indicador stop_reason: "refusal" de recusa em vez de conteúdo gerado por modelo. Não cobramos pelos tokens de entrada que forem recusados.
3 Controles de esforço por turno, no meio da conversa e orçamentos de tokens estão atualmente em versão Beta.
Visão geral da API
A tabela a seguir lista as APIs que você pode usar para interagir com ambas as versões dos modelos Claude no Foundry: Hospedadas no Azure e Hospedadas na infraestrutura da Anthropic.
Use os SDKs Anthropic e as seguintes APIs Claude:
Tip
A versão de infraestrutura Hospedada no Anthropic dos modelos Claude no Foundry dá suporte a mais APIs do que as listadas nesta tabela. Você pode vê-los nos documentos da API Claude: visão geral da API.
| API | Description |
|---|---|
Mensagens1 (POST /v1/messages) |
API de Mensagens Principais: enviar uma lista estruturada de mensagens de entrada com conteúdo de texto ou imagem, incluindo respostas de streaming. O modelo gera a próxima mensagem na conversa. |
Contagem de tokens (POST /v1/messages/count_tokens) |
API de Contagem de Tokens: conte o número de tokens em uma mensagem antes de enviá-la para Claude. |
1Você pode chamar a API de Mensagens do anthropic pacote Python, do @anthropic-ai/foundry-sdk pacote JavaScript ou diretamente por meio do REST. O ponto de extremidade de implantação segue o formato https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, e os clientes REST e JavaScript utilizam o cabeçalho anthropic-version: 2023-06-01.
Funcionalidades e recursos avançados
Os modelos claude no Foundry expõem os principais recursos para processar, analisar e gerar conteúdo e ferramentas que permitem que Claude interaja com sistemas externos, execute código e execute tarefas automatizadas. A superfície da API de Claude é organizada em cinco áreas:
- Funcionalidades do modelo
- Ferramentas
- Infraestrutura de ferramentas
- Gerenciamento de contexto
- Arquivos e ativos
As seções e tabelas a seguir resumem as capacidades disponíveis nas versões dos modelos Claude no Foundry hospedadas no Azure e hospedadas na infraestrutura da Anthropic. Salvo indicação em contrário, uma funcionalidade se aplica a ambas as versões.
Tip
A versão de infraestrutura hospedada no Anthropic dos modelos Claude no Foundry dá suporte a mais recursos do que os listados nessas tabelas. Você pode ver a lista completa de recursos no Claude Platform Docs: visão geral dos recursos.
Para obter mais informações sobre os recursos disponíveis e os recursos avançados para modelos Claude no Foundry, consulte o blog do desenvolvedor do Microsoft.
Funcionalidades do modelo
Maneiras de orientar o Claude e suas saídas diretas, incluindo formato de resposta, profundidade de raciocínio e modalidades de entrada.
| Característica | Description |
|---|---|
| Mensagens de streaming | Ao criar uma Mensagem, defina "stream": true para transmitir incrementalmente a resposta usando SSE (eventos enviados pelo servidor). |
| A pensar | Recursos avançados de raciocínio para tarefas complexas, fornecendo transparência no processo de pensamento passo a passo de Claude antes de fornecer sua resposta final. Consulte Raciocínio e esforço para os thinkingvalores de parâmetro por modelo. |
| Pensamento adaptável | Deixe Claude decidir dinamicamente quando e quanto pensar. Esse recurso é o único modo de pensamento em modelos Claude 4.7 e posteriores. Use o effort parâmetro para controlar a profundidade do pensamento. |
| Effort | Controle quantos tokens o Claude usa ao responder, equilibrando o nível de detalhamento da resposta e a eficiência no uso de tokens. Consulte Raciocínio e esforço para os effortvalores de parâmetro por modelo. |
| Citações | Baseie as respostas de Claude em fontes, incluindo blocos de conteúdo de search_result. |
| Imagens e visão | Processar e analisar o conteúdo de imagens. As implantações hospedadas no Azure aceitam apenas imagens codificadas em base64 ou baseadas em URL. |
| Suporte a PDF | Processe e analise o conteúdo de texto e visual de documentos PDF. Forneça PDFs como base64 ou URL. |
| Janela de contexto de 1M | Até 1 milhão de tokens para processar documentos grandes, bases de código extensas e conversas longas. O suporte está sujeito à elegibilidade do modelo. |
| Saídas estruturadas | Restrinja as respostas de Claude para seguir um esquema JSON específico, usando dois recursos complementares: saídas JSON (o output_config.format parâmetro) para respostas estruturadas e uso estrito de ferramentas (strict: true) para entradas de ferramenta validadas. Para implantações Hospedadas no Azure, as saídas estruturadas também oferecem suporte ao parâmetro legado para saídas JSON (o parâmetro output_format). |
Pensamento e esforço
O recurso Thinking permite valores específicos para o thinking tipo de parâmetro, dependendo do modelo, conforme descrito na tabela a seguir. O adaptive tipo configura o recurso de pensamento adaptável , permitindo que o modelo decida se deseja pensar, com base na complexidade da consulta e no nível de esforço. Por exemplo, thinking={"type": "adaptive"}.
| Modelo | adaptive |
enabled |
disabled |
|---|---|---|---|
claude-mythos-5-1 |
Yes | No | No |
claude-mythos-5 |
Yes | No | No |
claude-fable-5-1 |
Yes | No | No |
claude-fable-5 |
Yes | No | No |
claude-mythos-preview |
Yes | Yes | No |
claude-opus-5 |
Yes | No | Sim1 |
claude-opus-4-8 |
Yes | No | Yes |
claude-opus-4-7 |
Yes | No | Yes |
claude-opus-4-6 |
Yes | Yes | Yes |
claude-sonnet-5 |
Yes | No | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes |
1 Pensar só pode estar disabled em esforço high ou abaixo
O recurso Esforço permite níveis específicos effort para cada modelo, conforme descrito na tabela a seguir. O xhigh nível produz o mesmo resultado que max.
| Modelo | low |
medium |
high |
xhigh |
max |
|---|---|---|---|---|---|
claude-mythos-5-1 |
Yes | Yes | Yes | Yes | No |
claude-mythos-5 |
Yes | Yes | Yes | Yes | No |
claude-fable-5-1 |
Yes | Yes | Yes | Yes | No |
claude-fable-5 |
Yes | Yes | Yes | Yes | No |
claude-opus-5 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-8 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-7 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-6 |
Yes | Yes | Yes | No | Yes |
claude-sonnet-5 |
Yes | Yes | Yes | Yes | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes | No | Yes |
Tools
Permita que Claude execute ações na Web ou em seu ambiente. Esse recurso consiste em ferramentas integradas que Claude invoca por meio de tool_use. A plataforma executa ferramentas do lado do servidor e você implementa e executa ferramentas do lado do cliente.
| Característica | Description |
|---|---|
| Uso da ferramenta com ferramentas executadas pelo cliente | Ferramentas personalizadas mais bash, text editor, computer use e memory definidos pela Anthropic. Para obter mais informações sobre essas ferramentas, consulte Bash, Editor de Texto, Uso do Computador e Memória. |
| Pesquisa na Web | Descubra os dados reais atuais de toda a Web a serem usados para aumentar o conhecimento de Claude. Para implantações hospedadas em Azure, há suporte apenas para a versão da web_search_20250305 ferramenta. |
| Busca na Web | Recupere e realize uma análise aprofundada do conteúdo completo de páginas web e documentos PDF especificados, enriquecendo o contexto do Claude com conteúdo da web em tempo real. No Foundry, a busca de Web requer uma implantação hospedada na infraestrutura da Anthropic. Para implantações hospedadas em Azure, há suporte apenas para a versão da web_fetch_20250910 ferramenta. |
Infraestrutura de ferramentas
Descobrir, orquestrar e dimensionar o uso da ferramenta.
| Característica | Description |
|---|---|
| Streaming de ferramentas com granularidade fina | A ferramenta de fluxo usa parâmetros sem buffer ou validação JSON, reduzindo a latência para parâmetros grandes. Requer o anthropic-beta cabeçalho fine-grained-tool-streaming-2025-05-14. |
| Conector MCP | Conecte-se a servidores MCP remotos diretamente da API de Mensagens sem um cliente MCP separado. |
| Pesquisa de ferramentas | Escalone para milhares de ferramentas ao descobrir e carregar dinamicamente ferramentas sob demanda usando busca baseada em regex e BM25, otimizando o uso do contexto e melhorando a precisão da seleção de ferramentas. Para implantações hospedadas no Azure, há suporte para ambas as versões da ferramenta tool_search_tool_regex_20251119 e tool_search_tool_bm25_20251119. Os aliases tool_search_tool_bm25 herdados e tool_search_tool_regex também são aceitos. |
Gerenciamento de contexto
Controle e otimize a janela de contexto de Claude para sessões longas.
| Característica | Description |
|---|---|
| Cache de prompt automático | Simplifique o armazenamento em cache de prompts em um único parâmetro da API. O sistema armazena automaticamente em cache o último bloco em cache em sua solicitação, movendo o ponto de cache para frente à medida que as conversas crescem. |
| Cache de prompt (5m) | Forneça ao Claude mais conhecimento contextual e exemplos de saída para reduzir custos e latência. |
| Armazenamento em cache de prompt (1 h) | Duração estendida do cache de 1 hora para um contexto menos acessado, mas importante, complementando o cache padrão de 5 minutos. |
| Edição de contexto | Gerencie automaticamente o contexto da conversa com estratégias configuráveis, incluindo a limpeza dos resultados de ferramentas e o gerenciamento de blocos de pensamento. Requer o cabeçalho anthropic-beta context-management-2025-06-27. |
| Contagem de tokens | A contagem de tokens permite determinar o número de tokens em uma mensagem antes de enviá-la para Claude, ajudando você a tomar decisões mais bem informadas sobre seus prompts e uso. |
Arquivos e ativos
Gerencie os documentos e os dados que você fornece ao Claude.
| Característica | Description |
|---|---|
| API de arquivos | Atualmente disponível apenas para implantações hospedadas na infraestrutura da Anthropic. Carregue e gerencie arquivos a serem usados com Claude sem recarregar o conteúdo com cada solicitação. Dá suporte a PDFs, imagens e arquivos de texto. |
Suporte ao agente
- O Microsoft Agent Framework dá suporte à criação de agentes que usam modelos claude.
- Crie agentes de IA personalizados com o SDK do Claude Agent.
Tipos e regiões de implantação
Os modelos claude no Foundry estão disponíveis para os seguintes tipos de implantação em regiões Azure específicas:
- Padrão global: todos os modelos Claude (hospedados no Azure e na infraestrutura da Anthropic).
-
Data Zone Standard (EUA): Hospedado nas versões do Azure de
claude-opus-5,claude-opus-4-8, eclaude-sonnet-5.
Para ver as regiões exatas do Azure onde os modelos Claude estão disponíveis para implantação, consulte Disponibilidade de regiões por tipo de implantação.
Cotas e limites de taxa
Esta seção explica como as implantações compartilham a cota e quais limites de taxa se aplicam a elas. O gerenciamento no nível da assinatura gerencia a cota de implantação. Recursos e regiões compartilham a cota em vez de alocá-la separadamente para cada recurso ou região.
- Todas as implantações "Global Standard" do mesmo modelo e versão em uma assinatura utilizam um pool de cotas compartilhado entre todas as regiões.
- Todas as implantações "Data Zone Standard" do mesmo modelo e versão em uma assinatura utilizam um pool de cotas compartilhado dentro de cada zona de dados (por exemplo, EUA).
Para obter mais informações sobre o gerenciamento de cotas dos Modelos do Foundry, consulte cotas e limites dos Modelos do Microsoft Foundry.
ITPM com reconhecimento de cache
No Foundry, os modelos do Claude medem limites de taxa em solicitações por minuto (RPM), tokens de entrada não armazenados em cache por minuto (ITPM) e tokens de saída por minuto (OTPM) para cada modelo.
Para a maioria dos modelos Claude, somente os tokens de entrada não armazenados contam para os limites de taxa do ITPM. Esses tokens incluem:
Tokens de entrada – tokens na solicitação após o último ponto de interrupção de cache (entrada não armazenada em cache).
Tokens de entrada para criação de cache — tokens gravados no cache, que incluem:
- Gravação em cache (5 min) TPM — tokens sendo gravados no cache de prompt de 5 minutos.
- Gravação em cache (1 h) TPM — tokens sendo gravados no cache de prompt de 1 hora.
Tip
O total de tokens de entrada é a soma de tokens de entrada, tokens de entrada para criação de cache e tokens de entrada de leitura de cache (os tokens lidos a partir do cache). No entanto, os tokens de entrada lidos do cache não contam para o ITPM. O OTPM também não conta para o ITPM.
Para obter mais informações sobre limites de taxa e cache, consulte Claude API Docs: Limites de taxa.
Limites de taxa por tipo de assinatura
Seu tipo de assinatura Azure determina seus limites de taxa. As colunas Versão 2: Hospedada no Azure e Versão 1: Hospedada na infraestrutura da Anthropic indicam se há cota disponível para essa combinação de modelo e tipo de implantação. Sim significa que a cota está disponível. N/A significa que a combinação de modelo e versão não tem cota para esse tipo de implantação.
A tabela a seguir lista os limites de taxa. Para aumentar sua cota além dos limites padrão, envie uma solicitação por meio do formulário de solicitação de aumento de cota.
Pago conforme o uso
| Modelo | Tipo de implantação | Versão 2: Hospedado no Azure | Versão 1: Hospedada na infraestrutura de Anthropic | RPM | ITPM | OTPM |
|---|---|---|---|---|---|---|
| claude-fable-5-1 | Padrão Global | N/A | Yes | 0 | 0 | 0 |
| claude-fable-5 | Padrão Global | N/A | Yes | 0 | 0 | 0 |
| claude-opus-5 | Padrão Global | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-opus-5 | Padrão da Zona de Dados (EUA) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-opus-4-8 | Padrão Global | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-8 | Padrão da Zona de Dados (EUA) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-opus-4-7 | Padrão Global | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-6 | Padrão Global | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-5 | Padrão Global | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-sonnet-5 | Padrão Global | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-sonnet-5 | Padrão da Zona de Dados (EUA) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-sonnet-4-6 | Padrão Global | N/A | Yes | 80 | 80,000 | 16,000 |
| claude-sonnet-4-5 | Padrão Global | N/A | Yes | 80 | 80,000 | 16,000 |
| claude-haiku-4-5 | Padrão Global | Yes | Yes | 80 | 80,000 | 16,000 |
Considerações sobre IA responsável
Ao usar os modelos Claude no Foundry, considere estas práticas de IA responsáveis:
Examine os dados, a privacidade e a segurança dos modelos claude no Microsoft Foundry para entender como seus dados são processados e retidos ao implantar modelos claude.
Configure a segurança de conteúdo de IA durante a inferência de modelos, pois a Foundry não fornece filtragem de conteúdo integrada para modelos Claude no momento da implantação.
Verifique se seus aplicativos estão em conformidade com a Política de Uso Aceitável da Antropic. Além disso, confira detalhes das avaliações de segurança para Claude Fable 5.1 &Claude Mythos 5.1 , Claude Fable 5, Claude Mythos 5, Claude Mythos Preview, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5 e Claude Haiku 4.5.
Práticas recomendadas
Siga estas melhores práticas ao trabalhar com os modelos Claude no Foundry.
Engenharia de prompts
- Instruções claras: forneça prompts específicos e detalhados.
- Gerenciamento de contexto: use a janela de contexto disponível efetivamente.
- Definições de função: use mensagens do sistema para definir a função e o comportamento do assistente.
- Prompts estruturados: utilize uma formatação consistente para obter melhores resultados.
Otimização de custos
Para otimizar seu uso e evitar a limitação de taxa:
- Implementar lógica de repetição: manipule 429 respostas com a retirada exponencial.
- Solicitações em lote: combine vários prompts quando possível.
- Monitorar o uso do token: acompanhe o consumo de token e os padrões de solicitação.
- Use modelos apropriados: use o modelo mais econômico para seu caso de uso. Consulte os modelos de Claude disponíveis.
Conteúdo relacionado
- Implantar e usar modelos Claude na Microsoft Foundry
- Implante modelos Claude no Microsoft Foundry usando Bicep ou Terraform
- Modelos do Foundry de parceiros e da comunidade
- Cobrança por Unidades de Consumo do Claude (CCU) no Microsoft Foundry
- Dados, privacidade e segurança dos modelos Claude no Microsoft Foundry