Nota
O acesso a esta página requer autorização. Pode tentar iniciar sessão ou alterar os diretórios.
O acesso a esta página requer autorização. Pode tentar alterar os diretórios.
Os modelos Claude da Anthropic trazem capacidades avançadas de IA conversacional para a Microsoft Foundry, proporcionando compreensão e geração de linguagens de última geração para aplicações inteligentes. Os modelos Claude destacam-se em raciocínio complexo, geração de código e tarefas multimodais, incluindo análise de imagens. Este artigo descreve os modelos Claude disponíveis, como são alojados e faturados, APIs suportadas, capacidades, quotas e melhores práticas.
Para implementar e chamar um modelo Claude, consulte Implementar e usar modelos Claude no Microsoft Foundry.
Importante
Os itens assinalados como (pré-visualização) neste artigo estão atualmente em pré-visualização pública. Esta pré-visualização é fornecida sem um acordo de nível de serviço, e não a recomendamos para trabalhos em produção. Certas funcionalidades podem não ser suportadas ou podem ter capacidades limitadas. Para mais informações, consulte Termos Suplementares de Utilização para Microsoft Azure Previews.
Como os modelos Claude são alojados e faturados
A Microsoft Foundry oferece modelos Claude em duas versões:
- Versão 1: Alojada na infraestrutura Anthropic; estes modelos correm na infraestrutura da Anthropic (fora do Azure).
- Versão 2: Alojada no Azure; estes modelos correm na infraestrutura Azure de ponta a ponta e estão todos disponíveis de forma geral (GA).
Nem todos os modelos estão disponíveis em ambas as versões. A fase do ciclo de vida de um modelo, como Pré-visualização ou Disponível em geral, pode diferir entre as duas versões. Para disponibilidade por modelo e estado do ciclo de vida, veja Modelos Claude disponíveis.
Para comparar ambas as opções de alojamento em termos de residência de dados, SLAs, vias de suporte, conformidade e processo de compra, consulte Comparar modelos Claude alojados no Azure e alojados pela Anthropic.
Note
Pode aceder aos modelos Claude no Microsoft Foundry através de Foundry Models de parceiros e da comunidade. Os modelos de parceiros e da comunidade que a Anthropic vende e opera são Produtos Não Microsoft ao abrigo dos Termos do Produto.
Os modelos Claude no Foundry requerem uma subscrição do Azure Marketplace e faturam através das Unidades de Consumo Claude (CCU). Certifique-se de que tem as permissões necessárias para subscrever as ofertas de modelos antes de implementar. Para detalhes sobre preços, consulte faturação das Unidades de Consumo Claude (CCU) no Microsoft Foundry.
Modelos Claude disponíveis
Importante
Os seguintes modelos Claude cumprem a norma da UE relativa a marcas de água: claude-mythos-5-1, claude-fable-5-1 e claude-fable-5.
Enquanto claude-fable-5 usa marcação de água com chave única, claude-mythos-5-1 e claude-fable-5-1 usam chave dupla (2 chaves entrelaçadas e C2PA), da seguinte forma:
- Marcação de água em texto entrelaçado (segunda chave): é acrescentada uma segunda chave para a deteção de marca de água entrelaçada, de acordo com as normas da UE. A marca de água é aplicada no servidor no momento da geração; não há alterações nas estruturas dos pedidos ou das respostas. Uma API separada de deteção de marcas de água está em acesso antecipado e não faz parte do âmbito de lançamento da Foundry.
- Marcação de água C2PA: marcação de proveniência do conteúdo C2PA, gerida no lado do servidor e do cliente pelas interfaces da Anthropic. Sem alteração de forma da API.
A tabela seguinte compara a disponibilidade dos modelos para ambas as versões dos modelos Claude no Foundry. Para detalhes sobre as funcionalidades referenciadas na tabela, consulte a secção Capacidades e funcionalidades avançadas .
Para erros que possa encontrar ao implementar ou chamar modelos Claude, consulte Deploy e use modelos Claude: Resolução de problemas.
| Model | Availability | Janela de contexto / Saída máxima | Capacidades chave | Melhor para |
|---|---|---|---|---|
claude-mythos-5-1
1 |
|
1M / 128K |
|
|
claude-mythos-5
1 |
|
1M / 128K |
|
|
claude-fable-5-1 |
|
1M / 128K |
|
|
claude-fable-5 |
|
1M / 128K |
|
|
claude-mythos-preview
1 |
|
1M / 128K |
|
|
claude-opus-5 |
|
1M / 128K |
|
|
claude-opus-4-8 |
|
1M / 128K |
|
|
claude-opus-4-7 |
|
1M / 128K |
|
|
claude-opus-4-6 |
|
1M / 128K |
|
|
claude-opus-4-5 |
|
200K / 64K |
|
|
claude-sonnet-5 |
|
1M / 128K |
|
|
claude-sonnet-4-6 |
|
1M / 128K |
|
|
claude-sonnet-4-5 |
|
200K / 64K |
|
|
claude-haiku-4-5 |
|
200K / 64K |
|
|
1Claude Mythos 5-1, Claude Mythos 5 e Claude Mythos Preview estão disponíveis apenas como pré-visualização de pesquisa bloqueada. O acesso aos modelos é concedido exclusivamente a critério da Anthropic e é prioritário para casos de uso defensivo de cibersegurança. Consulte o cartão de sistema Claude Fable 5.1 & Claude Mythos 5.1, o cartão de sistema Claude Mythos 5 e o cartão de sistema Claude Mythos Preview para orientações sobre uso responsável.
2Claude Fable 5 aplica classificadores adicionais de entrada/saída que podem recusar pedidos cujo conteúdo desencadeia políticas de salvaguarda de dupla utilização. Quando ocorre uma recusa, o pedido devolve uma resposta bem-sucedida (200) com um indicador stop_reason: "refusal" de recusa em vez de conteúdo gerado pelo modelo. Não és cobrado por tokens de entrada que são recusados.
3 controlos do esforço por turno, a meio da conversa e orçamentos de tokens estão atualmente em versão beta.
Visão geral da API
A tabela seguinte lista as APIs que pode utilizar para interagir com as versões Alojadas no Azure e Alojadas na infraestrutura da Anthropic dos modelos Claude no Foundry.
Utilize os SDKs da Anthropic e as seguintes APIs Claude:
Tip
A versão Hosted on Anthropic infrastructure dos modelos Claude no Foundry suporta mais APIs do que as listadas nesta tabela. Pode vê-los na página documentação da API do Claude: visão geral da API.
| API | Description |
|---|---|
Mensagens1 (POST /v1/messages) |
API de Mensagens Principais: Envie uma lista estruturada de mensagens de entrada com texto ou conteúdos de imagem, incluindo respostas em streaming. O modelo gera a próxima mensagem na conversa. |
Contagem de tokens (POST /v1/messages/count_tokens) |
API de Contagem de Tokens: Conte o número de tokens numa mensagem antes de a enviar para o Claude. |
1Pode chamar a API de Mensagens a partir do anthropic pacote Python, do @anthropic-ai/foundry-sdk pacote JavaScript, ou diretamente através do REST. O endpoint de implementação segue a forma https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, e os clientes REST e JavaScript usam o anthropic-version: 2023-06-01 cabeçalho.
Capacidades e funcionalidades avançadas
Os modelos Claude no Foundry expõem capacidades essenciais para processar, analisar e gerar conteúdo, bem como ferramentas que permitem a Claude interagir com sistemas externos, executar código e realizar tarefas automatizadas. A superfície API do Claude está organizada em cinco áreas:
As secções e tabelas seguintes resumem as capacidades disponíveis entre as versões Alojado no Azure e Alojado na infraestrutura da Anthropic dos modelos Claude no Foundry. Salvo indicação, uma funcionalidade aplica-se a ambas as versões.
Tip
A versão alojada na infraestrutura da Anthropic dos modelos Claude no Foundry suporta mais funcionalidades do que as indicadas nestas tabelas. Pode consultar a lista completa de funcionalidades no Claude Platform Docs: Features Overview.
Para mais informações sobre as capacidades e funcionalidades avançadas disponíveis para os modelos Claude no Foundry, consulte o Microsoft Developer Blog.
Capacidades do modelo
Formas de orientar o Claude e as suas saídas diretas, incluindo o formato da resposta, o nível de raciocínio e as modalidades de entrada.
| Feature | Description |
|---|---|
| Mensagens em streaming | Ao criar uma Mensagem, defina "stream": true o fluxo incremental da resposta usando eventos enviados pelo servidor (SSE). |
| Pensar | Capacidades de raciocínio melhoradas para tarefas complexas, proporcionando transparência sobre o processo de pensamento passo a passo do Claude antes de dar a resposta final. Veja Pensamento e esforço para valores thinking de parâmetros por modelo. |
| Pensamento adaptativo | Deixa Claude decidir dinamicamente quando e quanto pensar. Esta funcionalidade é o único modo de reflexão nos modelos Claude 4.7 e seguintes. Use o effort parâmetro para controlar a profundidade do pensamento. |
| Esforço | Controla quantos tokens o Claude usa ao responder, estabelecendo um equilíbrio entre a minuciosidade da resposta e a eficiência na utilização de tokens. Veja Pensamento e esforço para valores effort de parâmetros por modelo. |
| Citações | Fundamente as respostas do Claude em fontes, incluindo blocos search_resultde conteúdo de resultados de pesquisa. |
| Imagens e visão | Processar e analisar conteúdos a partir de imagens. As implementações alojadas no Azure só aceitam imagens codificadas em base64 ou baseadas em URL. |
| Suporte para PDF | Processar e analisar texto e conteúdo visual a partir de documentos PDF. Forneça PDFs como base64 ou URL. |
| Janela de contexto de 1 M | Até 1 milhão de tokens para processar documentos grandes, bases de código extensas e longas conversas. O apoio está sujeito à elegibilidade do modelo. |
| Resultados estruturados | Restringa as respostas do Claude a seguir um esquema JSON específico, usando duas funcionalidades complementares: saídas JSON (o output_config.format parâmetro) para respostas estruturadas, e uso estrito de ferramentas (strict: true) para entradas validadas da ferramenta. Para implementações Alojadas no Azure, as saídas estruturadas também suportam o parâmetro legado para as saídas JSON (o output_format parâmetro). |
Pensamento e esforço
A funcionalidade Pensar permite valores específicos para o thinking tipo de parâmetro, dependendo do modelo, conforme descrito na tabela seguinte. O adaptive tipo configura a funcionalidade de pensamento adaptativo , permitindo ao modelo decidir se deve pensar, com base na complexidade da consulta e no nível de esforço. Por exemplo, thinking={"type": "adaptive"}.
| Model | adaptive |
enabled |
disabled |
|---|---|---|---|
claude-mythos-5-1 |
Yes | No | No |
claude-mythos-5 |
Yes | No | No |
claude-fable-5-1 |
Yes | No | No |
claude-fable-5 |
Yes | No | No |
claude-mythos-preview |
Yes | Yes | No |
claude-opus-5 |
Yes | No | Sim1 |
claude-opus-4-8 |
Yes | No | Yes |
claude-opus-4-7 |
Yes | No | Yes |
claude-opus-4-6 |
Yes | Yes | Yes |
claude-sonnet-5 |
Yes | No | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes |
1 A reflexão pode ser disabled apenas ao nível de esforço high ou inferior
A funcionalidade Esforço permite níveis específicos effort para cada modelo, conforme descrito na tabela seguinte. O xhigh nível produz o mesmo resultado que max.
| Model | low |
medium |
high |
xhigh |
max |
|---|---|---|---|---|---|
claude-mythos-5-1 |
Yes | Yes | Yes | Yes | No |
claude-mythos-5 |
Yes | Yes | Yes | Yes | No |
claude-fable-5-1 |
Yes | Yes | Yes | Yes | No |
claude-fable-5 |
Yes | Yes | Yes | Yes | No |
claude-opus-5 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-8 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-7 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-6 |
Yes | Yes | Yes | No | Yes |
claude-sonnet-5 |
Yes | Yes | Yes | Yes | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes | No | Yes |
Tools
Deixe o Claude agir na web ou no seu ambiente. Esta funcionalidade consiste em ferramentas incorporadas que Claude invoca através de tool_use. A plataforma executa ferramentas do lado do servidor, e tu implementas e executas ferramentas do lado do cliente.
| Feature | Description |
|---|---|
| Utilização de ferramentas com ferramentas executadas pelo cliente | Ferramentas personalizadas, além de bash, text editor, computer use e memory, definidas pela Anthropic. Para mais informações sobre estas ferramentas, veja Bash, Editor de texto, Uso do computador e Memória. |
| Pesquisa na Web | Descubra dados atuais do mundo real de toda a web para usar para complementar o conhecimento de Claude. Para implementações Alojadas no Azure, apenas a web_search_20250305 versão da ferramenta é suportada. |
| Busca web | Recuperar e realizar análises aprofundadas do conteúdo completo de páginas web e documentos PDF especificados, complementando o contexto de Claude com conteúdo web em direto. No Foundry, a pesquisa na web requer uma implementação alojada na infraestrutura da Anthropic. Para implementações Alojadas no Azure, apenas a web_fetch_20250910 versão da ferramenta é suportada. |
Infraestrutura de ferramentas
Descubra, orquestre e expanda a utilização de ferramentas.
| Feature | Description |
|---|---|
| Transmissão detalhada de ferramentas | A ferramenta de stream utiliza parâmetros sem buffering ou validação JSON, reduzindo a latência para parâmetros grandes. Requer o anthropic-beta cabeçalho fine-grained-tool-streaming-2025-05-14. |
| Conector MCP | Liga-te diretamente a servidores MCP remotos a partir da API de Mensagens sem um cliente MCP separado. |
| Pesquisa por ferramentas | Expanda para milhares de ferramentas, descobrindo-as e carregando-as dinamicamente conforme necessário, através de pesquisa baseada em regex e BM25, otimizando a utilização do contexto e melhorando a precisão da seleção de ferramentas. Para implementações do tipo Alojado no Azure, são suportadas tanto as versões da ferramenta tool_search_tool_bm25_20251119 como tool_search_tool_regex_20251119. Os pseudónimos tool_search_tool_bm25 antigos também tool_search_tool_regex são aceites. |
Gestão do contexto
Controlar e otimizar a janela de contexto do Claude para sessões de longa duração.
| Feature | Description |
|---|---|
| Cache automática de prompts | Simplifique a cache de prompts para um único parâmetro da API. O sistema armazena automaticamente em cache o último bloco cacheável do seu pedido, avançando o ponto de cache à medida que as conversas crescem. |
| Cache de prompts (5m) | Forneça ao Claude mais conhecimento prévio e exemplos de resultados para reduzir custos e latência. |
| Cache de prompts (1 hora) | Duração estendida do cache de 1 hora para um contexto menos acedido mas importante, complementando o cache padrão de 5 minutos. |
| Edição de contexto | Gerir automaticamente o contexto da conversa com estratégias configuráveis, incluindo a limpeza dos resultados das ferramentas e a gestão dos blocos de raciocínio. Requer o cabeçalho anthropic-beta context-management-2025-06-27. |
| Contagem de tokens | A contagem de tokens permite-lhe determinar o número de tokens numa mensagem antes de a enviar para o Claude, ajudando-o a tomar decisões informadas sobre os seus prompts e utilização. |
Ficheiros e ativos
Gerir os documentos e dados que fornece ao Claude.
| Feature | Description |
|---|---|
| API de ficheiros | Atualmente disponível apenas em implementações alojadas na infraestrutura da Anthropic. Carregar e gerir ficheiros para usar com Claude sem voltar a carregar conteúdo a cada pedido. Suporta PDFs, imagens e ficheiros de texto. |
Suporte a agentes
- O Microsoft Agent Framework suporta a criação de agentes que utilizam modelos Claude.
- Constrói agentes de IA personalizados com o Claude Agent SDK.
Tipos de implantação e regiões
Os modelos Claude no Foundry estão disponíveis para os seguintes tipos de implementação em regiões específicas do Azure:
- Padrão Global: Todos os modelos Claude (hospedados no Azure e na infraestrutura da Anthropic).
-
Data Zone Standard (EUA): Alojado nas versões Azure de
claude-opus-5,claude-opus-4-8, eclaude-sonnet-5.
Para as regiões exatas do Azure onde os modelos Claude estão disponíveis para implementação, veja Disponibilidade de Região por tipo de implementação.
Quotas e limites de tarifas
Esta secção explica como as implantações partilham quotas e que limites de taxa se aplicam a elas. A gestão ao nível da subscrição gere a quota de implementação. Recursos e regiões partilham a quota em vez de a alocar separadamente para cada recurso ou região.
- Todas as implementações Global Standard do mesmo modelo e versão numa subscrição utilizam um conjunto comum de quotas partilhado por todas as regiões.
- Todas as implementações do Data Zone Standard do mesmo modelo e versão numa subscrição são retiradas de um pool de quotas partilhado dentro de cada zona de dados (por exemplo, EUA).
Para mais informações sobre a gestão de quotas para Foundry Models, consulte quotas e limites do Microsoft Foundry Models.
ITPM consciente de cache
Os modelos Claude na Foundry definem limites de taxa em pedidos por minuto (RPM), tokens de entrada não armazenados em cache por minuto (ITPM) e tokens de saída por minuto (OTPM) para cada modelo.
Para a maioria dos modelos Claude, apenas os tokens de entrada não armazenados em cache contam para os seus limites de taxa do ITPM. Estes tokens incluem:
Tokens de entrada — tokens no pedido após o último ponto de interrupção da cache (entrada sem cache).
Tokens de entrada para criação de cache — tokens escritos em cache, que compreendem:
- Gravação na cache de prompts 5m TPM — tokens que estão a ser gravados na cache de prompts de 5 minutos.
- Escrita de cache 1h TPM — tokens a serem escritos na cache de prompt de 1 hora.
Tip
O total de tokens de entrada é a soma dos tokens de entrada, tokens de criação de cache e tokens de leitura de cache (os tokens lidos da cache). No entanto, os tokens de leitura da cache não contam para o ITPM. O OTPM também não conta para o ITPM.
Para mais informações sobre limites de taxa e cache, consulte Claude API Docs: Limites de taxa.
Limites de taxa por tipo de subscrição
O tipo de subscrição do Azure determina os seus limites de taxa. As colunas Versão 2: Alojada no Azure e Versão 1: Alojada na infraestrutura da Anthropic indicam se existe quota disponível para essa combinação de modelo e tipo de implementação. Sim significa que há uma quota disponível. N/A significa que a combinação de modelo e versão não tem quota para esse tipo de implementação.
A tabela seguinte lista os limites de taxa. Para aumentar a sua quota para além dos limites padrão, submeta um pedido através do formulário de pedido de aumento da quota.
Pay-as-you-go
| Model | Tipo de implantação | Versão 2: Alojada no Azure | Versão 1: Alojada em infraestrutura da Anthropic | RPM | ITPM | OTPM |
|---|---|---|---|---|---|---|
| claude-fable-5-1 | Padrão Global | N/A | Yes | 0 | 0 | 0 |
| Claude-Fable-5 | Padrão Global | N/A | Yes | 0 | 0 | 0 |
| claude-opus-5 | Padrão Global | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-opus-5 | Norma de Zonas de Dados (EUA) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-opus-4-8 | Padrão Global | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-8 | Norma de Zonas de Dados (EUA) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-opus-4-7 | Padrão Global | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-6 | Padrão Global | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-5 | Padrão Global | N/A | Yes | 40 | 40,000 | 8,000 |
| Claude-Sonnet-5 | Padrão Global | Yes | Yes | 40 | 40,000 | 8,000 |
| Claude-Sonnet-5 | Norma de Zonas de Dados (EUA) | Yes | N/A | 40 | 40,000 | 8,000 |
| Claude-Sonnet-4-6 | Padrão Global | N/A | Yes | 80 | 80,000 | 16 000 |
| Claude-Sonnet-4-5 | Padrão Global | N/A | Yes | 80 | 80,000 | 16 000 |
| claude-haiku-4-5 | Padrão Global | Yes | Yes | 80 | 80,000 | 16 000 |
Considerações sobre IA responsável
Ao utilizar modelos Claude no Foundry, considere estas práticas responsáveis de IA:
Revise os dados, privacidade e segurança dos modelos Claude no Microsoft Foundry para compreender como os seus dados são processados e retidos quando implementa modelos Claude.
Configure a segurança de conteúdos de IA durante a inferência do modelo, porque o Foundry não fornece filtragem de conteúdo incorporada para modelos Claude no momento da implementação.
Assegure que as suas candidaturas cumprem a Política de Utilização Aceitável da Anthropic. Veja também detalhes das avaliações de segurança para Claude Fable 5.1 & Claude Mythos 5.1 , Claude Fable 5, Claude Mythos 5, Claude Mythos Preview, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5 e Claude Haiku 4.5.
Melhores práticas
Siga estas melhores práticas ao trabalhar com modelos Claude no Foundry:
Engenharia de prompts
- Instruções claras: Forneça prompts específicos e detalhados.
- Gestão de contexto: Utilize eficazmente a janela de contexto disponível.
- Definições de funções: Use mensagens do sistema para definir o papel e o comportamento do assistente.
- Prompts estruturados: Use uma formatação consistente para melhores resultados.
Otimização de custos
Para otimizar a sua utilização e evitar limitações de taxas:
- Implementar lógica de retentativa: Lidar com 429 respostas com recuo exponencial.
- Pedidos em lote: Combine múltiplos prompts sempre que possível.
- Monitorizar a utilização de tokens: Acompanhar os padrões de consumo e pedidos de tokens.
- Use modelos adequados: Use o modelo mais económico para o seu caso de uso. Ver Modelos Claude disponíveis.
Conteúdo relacionado
- Implementar e usar modelos Claude no Microsoft Foundry
- Implementar modelos Claude no Microsoft Foundry usando Bicep ou Terraform
- Modelos de Foundry de parceiros e comunidade
- Faturação das Unidades de Consumo Claude (CCU) no Microsoft Foundry
- Dados, privacidade e segurança para modelos Claude no Microsoft Foundry