Nota:
El acceso a esta página requiere autorización. Puede intentar iniciar sesión o cambiar directorios.
El acceso a esta página requiere autorización. Puede intentar cambiar los directorios.
Los modelos Claude de Anthropic aportan capacidades avanzadas de IA conversacional a Microsoft Foundry, al proporcionar comprensión y generación del lenguaje de última generación para aplicaciones inteligentes. Los modelos de Claude se destacan en razonamiento complejo, generación de código y tareas multimodales, incluido el análisis de imágenes. En este artículo se describen los modelos de Claude disponibles, cómo se hospedan y facturan, las API admitidas, las funcionalidades, las cuotas y los procedimientos recomendados.
Para implementar y llamar a un modelo de Claude, consulte Implementación y uso de modelos de Claude en Microsoft Foundry.
Importante
Los elementos marcados (versión preliminar) de este artículo se encuentran actualmente en versión preliminar pública. Esta versión preliminar se ofrece sin acuerdo de nivel de servicio y no se recomienda para las cargas de trabajo de producción. Es posible que algunas características no se admitan o que tengan funcionalidades restringidas. Para más información, consulte Términos de uso complementarios para las versiones preliminares de Microsoft Azure.
Cómo se hospedan y facturan los modelos de Claude
Microsoft Foundry ofrece modelos de Claude en dos versiones:
- Versión 1: Alojado en la infraestructura de Anthropic; estos modelos se ejecutan en la infraestructura de Anthropic (fuera de Azure).
- Versión 2: hospedado en Azure; estos modelos se ejecutan en Azure infraestructura de un extremo a otro y están disponibles con carácter general (GA).
No todos los modelos están disponibles en ambas versiones. La fase de ciclo de vida de un modelo, como la versión preliminar o la disponible con carácter general, puede diferir entre las dos versiones. Para obtener información sobre la disponibilidad por modelo y el estado del ciclo de vida, consulte Modelos de Claude disponibles.
Para comparar ambas opciones de hospedaje en términos de residencia de datos, SLA, vías de soporte, cumplimiento normativo y proceso de compra, consulte Comparar los modelos de Claude hospedados en Azure y hospedados por Anthropic.
Nota:
Puedes acceder a los modelos de Claude en Microsoft Foundry a través de Modelos de Foundry de socios y de la comunidad. Los modelos de socios y de la comunidad que Anthropic vende y opera son Productos que no son de Microsoft según los Términos del Producto.
Los modelos de Claude en Foundry requieren una suscripción a Azure Marketplace y se facturan mediante Claude Consumption Units (CCU). Asegúrese de que tiene los permisos necesarios para suscribirse a las ofertas de modelo antes de implementar. Para obtener más información sobre los precios, consulte Facturación de unidades de consumo de Claude (CCU) en Microsoft Foundry.
Modelos de Claude disponibles
Importante
Los siguientes modelos de Claude cumplen con el estándar de marca de agua de la UE: claude-mythos-5-1, claude-fable-5-1y claude-fable-5.
Mientras que claude-fable-5 usa marcas de agua de clave única, claude-mythos-5-1 y claude-fable-5-1 usan doble clave (intercalada de dos claves y C2PA) de la siguiente manera:
- Marcado de agua de texto entrelazado (segunda clave): se añade una segunda clave para detectar marcas de agua entrelazadas según las normas de la UE. El marcado de agua se realiza del lado del servidor en el momento de la generación; no hay ningún cambio en la estructura de las solicitudes ni de las respuestas. Una API independiente de detección de marcas de agua está en acceso anticipado y no forma parte del alcance del lanzamiento de Foundry.
- Marcado con marca de agua C2PA: marcado de procedencia del contenido C2PA, gestionado del lado del servidor y del cliente por las superficies de Anthropic. No se ha cambiado ninguna forma de API.
En la tabla siguiente se compara la disponibilidad del modelo para ambas versiones de los modelos de Claude en Foundry. Para obtener más información sobre las características a las que se hace referencia en la tabla, consulte la sección Funcionalidades y características avanzadas .
Para ver los errores que puede encontrar al implementar o llamar a modelos de Claude, consulte Deploy and use Claude models: Troubleshooting( Implementar y usar modelos de Claude: Solución de problemas).
| Modelo | Availability | Ventana de contexto/Salida máxima | Principales funcionalidades | Más adecuado para |
|---|---|---|---|---|
claude-mythos-5-1
1 |
|
1M/128K |
|
|
claude-mythos-5
1 |
|
1M/128K |
|
|
claude-fable-5-1 |
|
1M/128K |
|
|
claude-fable-5 |
|
1M/128K |
|
|
claude-mythos-preview
1 |
|
1M/128K |
|
|
claude-opus-5 |
|
1M/128K |
|
|
claude-opus-4-8 |
|
1M/128K |
|
|
claude-opus-4-7 |
|
1M/128K |
|
|
claude-opus-4-6 |
|
1M/128K |
|
|
claude-opus-4-5 |
|
200 000 / 64 000 |
|
|
claude-sonnet-5 |
|
1M/128K |
|
|
claude-sonnet-4-6 |
|
1M/128K |
|
|
claude-sonnet-4-5 |
|
200 000 / 64 000 |
|
|
claude-haiku-4-5 |
|
200 000 / 64 000 |
|
|
1Claude Mythos 5-1, Claude Mythos 5 y Claude Mythos Preview solo están disponibles como versión preliminar de investigación cerrada. El acceso a los modelos se concede únicamente a la discreción de Anthropic y se da prioridad a los casos de uso de ciberseguridad defensiva. Vea la tarjeta del sistema Claude Fable 5.1 y Claude Mythos 5.1, la tarjeta del sistema Claude Mythos 5 y la tarjeta del sistema De vista previa de Claude Mythos para obtener instrucciones de uso responsable.
2Claude Fable 5 aplica clasificadores de entrada/salida adicionales que podrían rechazar las solicitudes cuyos contenidos desencadenan directivas de protección de doble uso. Cuando se produce una denegación, la solicitud devuelve una respuesta correcta (200) con un indicador stop_reason: "refusal" de denegación en lugar de contenido generado por el modelo. No se facturan los tokens de entrada que son rechazados.
3 Los controles de esfuerzo por turno, los ajustes a mitad de conversación y los presupuestos de tokens se encuentran actualmente en fase beta.
Introducción a la API
En la tabla siguiente se enumeran las API que puede usar para interactuar tanto con las versiones de los modelos de Claude en Foundry alojadas en Azure como alojadas en la infraestructura de Anthropic.
Use los SDKs Anthropic y las siguientes APIs de Claude:
Sugerencia
La versión de infraestructura hospedada en Anthropic de modelos de Claude en Foundry admite más API que las enumeradas en esta tabla. Puede consultarlos en la página Documentación de la API de Claude: Descripción general de la API.
| API | Description |
|---|---|
Mensajes1 (POST /v1/messages) |
API de mensajes principales: envíe una lista estructurada de mensajes de entrada con contenido de texto o imagen, incluidas las respuestas de streaming. El modelo genera el siguiente mensaje en la conversación. |
Recuento de tokens (POST /v1/messages/count_tokens) |
API de recuento de tokens: cuente el número de tokens de un mensaje antes de enviarlo a Claude. |
1Puede llamar a la API de Messages a través del anthropic paquete de Python, del @anthropic-ai/foundry-sdk paquete de JavaScript o directamente mediante REST. El punto de conexión de implementación tiene la forma https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, y los clientes REST y JavaScript usan el encabezado anthropic-version: 2023-06-01.
Funcionalidades y características avanzadas
Los modelos de Claude en Foundry exponen funcionalidades básicas para procesar, analizar y generar contenido, y herramientas que permiten a Claude interactuar con sistemas externos, ejecutar código y realizar tareas automatizadas. La API de Claude se organiza en cinco áreas:
- Funcionalidades del modelo
- Herramientas
- Infraestructura de herramientas
- Administración de contextos
- Archivos y recursos
Las siguientes secciones y tablas resumen las capacidades disponibles en las versiones de los modelos Claude en Foundry Alojadas en Azure y Alojadas en la infraestructura de Anthropic. A menos que se indique, una funcionalidad se aplica a ambas versiones.
Sugerencia
La versión alojada en la infraestructura de Anthropic de los modelos Claude en Foundry admite más capacidades que las enumeradas en estas tablas. Puede ver la lista completa de funcionalidades en Claude Platform Docs: Información general sobre las características.
Para obtener más información sobre las funcionalidades disponibles y las características avanzadas de los modelos de Claude en Foundry, consulte el blog para desarrolladores de Microsoft.
Funcionalidades del modelo
Formas de orientar a Claude y sus resultados directos, incluyendo el formato de respuesta, la profundidad del razonamiento y las modalidades de entrada.
| Feature | Description |
|---|---|
| Mensajes en streaming | Al crear un mensaje, establezca "stream": true para transmitir la respuesta de forma incremental mediante eventos enviados desde el servidor (SSE). |
| Pensar | Capacidades mejoradas de razonamiento para tareas complejas, lo que proporciona transparencia en el proceso de pensamiento paso a paso de Claude antes de entregar su respuesta final. Consulte Pensamiento y esfuerzo para los thinking valores de parámetro por modelo. |
| Pensamiento adaptable | Deje que Claude decida dinámicamente cuándo y cuánto pensar. Esta función es el único modo de razonamiento en Claude 4.7 y modelos posteriores. Utilice el parámetro effort para controlar la profundidad de razonamiento. |
| Esfuerzo | Controla cuántos tokens utiliza Claude al responder, logrando un equilibrio entre el nivel de detalle de la respuesta y la eficiencia en el uso de tokens. Consulte Pensamiento y esfuerzo para los effort valores de parámetro por modelo. |
| Citas | Basa las respuestas de Claude en fuentes, incluidos los bloques de contenido de search_result. |
| Imágenes y visión | Procese y analice el contenido de las imágenes. Hospedadas en implementaciones de Azure solo aceptan imágenes basadas en direcciones URL o codificadas en base64. |
| Compatibilidad con PDF | Procese y analice el texto y el contenido visual de los documentos PDF. Proporcione archivos PDF como base64 o dirección URL. |
| Ventana de contexto de 1 M | Hasta 1 millón de tokens para procesar documentos grandes, bases de código extensas y conversaciones largas. El soporte técnico está sujeto a la idoneidad del modelo. |
| Salidas estructuradas | Restrinja las respuestas de Claude para seguir un esquema JSON específico, con dos características complementarias: salidas JSON (el output_config.format parámetro) para respuestas estructuradas y uso estricto de herramientas (strict: true) para entradas de herramientas validadas. En el caso de las implementaciones hospedadas en Azure, las salidas estructuradas también admiten el parámetro heredado para las salidas JSON (el output_format parámetro ). |
Pensamiento y esfuerzo
La característica Pensando permite valores específicos para el thinking tipo de parámetro, según el modelo, tal como se describe en la tabla siguiente. El adaptive tipo configura la característica de pensamiento adaptable , lo que permite al modelo decidir si desea pensar, en función de la complejidad de las consultas y el nivel de esfuerzo. Por ejemplo: thinking={"type": "adaptive"}.
| Modelo | adaptive |
enabled |
disabled |
|---|---|---|---|
claude-mythos-5-1 |
Sí | No | No |
claude-mythos-5 |
Sí | No | No |
claude-fable-5-1 |
Sí | No | No |
claude-fable-5 |
Sí | No | No |
claude-mythos-preview |
Sí | Sí | No |
claude-opus-5 |
Sí | No | Sí1 |
claude-opus-4-8 |
Sí | No | Sí |
claude-opus-4-7 |
Sí | No | Sí |
claude-opus-4-6 |
Sí | Sí | Sí |
claude-sonnet-5 |
Sí | No | Sí |
claude-sonnet-4-6 |
Sí | Sí | Sí |
1 El razonamiento solo puede darse disabled con un esfuerzo high o inferior
La característica Esfuerzo permite niveles específicos effort para cada modelo, como se describe en la tabla siguiente. El xhigh nivel genera el mismo resultado que max.
| Modelo | low |
medium |
high |
xhigh |
max |
|---|---|---|---|---|---|
claude-mythos-5-1 |
Sí | Sí | Sí | Sí | No |
claude-mythos-5 |
Sí | Sí | Sí | Sí | No |
claude-fable-5-1 |
Sí | Sí | Sí | Sí | No |
claude-fable-5 |
Sí | Sí | Sí | Sí | No |
claude-opus-5 |
Sí | Sí | Sí | Sí | Sí |
claude-opus-4-8 |
Sí | Sí | Sí | Sí | Sí |
claude-opus-4-7 |
Sí | Sí | Sí | Sí | Sí |
claude-opus-4-6 |
Sí | Sí | Sí | No | Sí |
claude-sonnet-5 |
Sí | Sí | Sí | Sí | Sí |
claude-sonnet-4-6 |
Sí | Sí | Sí | No | Sí |
Tools
Deje que Claude realice acciones en la web o en su entorno. Esta característica consiste en herramientas integradas que Claude invoca a través de tool_use. La plataforma ejecuta herramientas del lado servidor e implementa y ejecuta herramientas del lado cliente.
| Feature | Description |
|---|---|
| Uso de herramientas con herramientas ejecutadas por el cliente | Herramientas personalizadas más las definidas por Anthropic bash, text editor, computer use y memory. Para obtener más información sobre estas herramientas, consulte Bash, Editor de texto, Uso de equipos y Memoria. |
| Búsqueda web | Descubra los datos actuales del mundo real desde toda la web para usarlos para aumentar el conocimiento de Claude. En el caso de las implementaciones hospedadas en Azure, solo se admite la versión de la web_search_20250305 herramienta. |
| Captura web | Recupere y realice un análisis detallado del contenido completo de páginas web y documentos PDF especificados, aumentando el contexto de Claude con contenido web activo. En Foundry, el acceso web requiere una implementación alojada en la infraestructura de Anthropic. En el caso de las implementaciones hospedadas en Azure, solo se admite la versión de la web_fetch_20250910 herramienta. |
Infraestructura de herramientas
Descubre, orquesta y amplía el uso de herramientas.
| Feature | Description |
|---|---|
| Transmisión de herramientas de granularidad fina | La herramienta Stream usa parámetros sin almacenamiento en búfer ni validación json, lo que reduce la latencia de los parámetros grandes. Requiere la cabecera anthropic-betafine-grained-tool-streaming-2025-05-14. |
| Conector MCP | Conéctese a servidores MCP remotos directamente desde la API messages sin un cliente MCP independiente. |
| Búsqueda de herramientas | Amplíe a miles de herramientas descubriéndolas y cargándolas dinámicamente bajo demanda mediante búsquedas basadas en regex y BM25, optimizando el uso del contexto y mejorando la precisión en la selección de herramientas. Para las implementaciones de Alojado en Azure, se admiten ambas versiones de las herramientas: tool_search_tool_bm25_20251119 y tool_search_tool_regex_20251119. También se aceptan los alias heredados tool_search_tool_bm25 y tool_search_tool_regex . |
Administración de contexto
Controle y optimice la ventana de contexto de Claude para sesiones de larga duración.
| Feature | Description |
|---|---|
| Caché automática de prompts | Simplifique el almacenamiento en caché de mensajes en un único parámetro de API. El sistema almacena automáticamente en caché el último bloque almacenable en caché de su solicitud, desplazando el punto de almacenamiento en caché hacia delante a medida que crecen las conversaciones. |
| Almacenamiento en caché de prompts (5 min) | Proporcione a Claude más conocimientos y salidas de ejemplo para reducir los costos y la latencia. |
| Almacenamiento en caché de prompts (1 h) | Duración extendida de la caché de 1 hora para un contexto menos frecuente, pero importante, que complementa la caché estándar de 5 minutos. |
| Edición de contexto | Administre automáticamente el contexto de conversación con estrategias configurables, incluidos borrar los resultados de la herramienta y administrar bloques de pensamiento. Requiere el encabezado anthropic-beta context-management-2025-06-27. |
| Recuento de tokens | El recuento de tokens le permite determinar el número de tokens de un mensaje antes de enviarlo a Claude, lo que le ayuda a tomar decisiones informadas sobre sus avisos y uso. |
Archivos y recursos
Administre los documentos y los datos que proporcione a Claude.
| Feature | Description |
|---|---|
| API de archivos | Actualmente solo está disponible en implementaciones de alojado en la infraestructura de Anthropic. Cargue y administre archivos para usarlos con Claude sin volver a cargar contenido con cada solicitud. Admite archivos PDF, imágenes y texto. |
Soporte para agentes
- Microsoft Agent Framework admite la creación de agentes que usan modelos de Claude.
- Cree agentes de IA personalizados con el SDK del agente de Claude.
Tipos y regiones de implementación
Los modelos de Claude en Foundry están disponibles para los siguientes tipos de implementación en regiones de Azure específicas:
- Estándar global: todos los modelos de Claude (alojados en Azure y en la infraestructura de Anthropic).
-
Estándar de zona de datos (EE. UU.): hospedado en versiones de Azure de
claude-opus-5,claude-opus-4-8yclaude-sonnet-5.
Para consultar las regiones exactas de Azure en las que los modelos de Claude están disponibles para su implementación, consulte Disponibilidad de regiones por tipo de implementación.
Cuotas y límites de tasa
En esta sección se explica cómo los despliegues comparten la cuota y qué límites de tasa se les aplican. La gestión a nivel de suscripción gestiona la cuota de despliegue. Los recursos y las regiones comparten la cuota en lugar de asignarla por separado para cada recurso o región.
- Todas las implementaciones de Global Standard del mismo modelo y versión dentro de una suscripción comparten una misma cuota entre todas las regiones.
- Todas las implementaciones de Data Zone Estándar del mismo modelo y versión en una suscripción se nutren de un fondo común de cuotas compartido dentro de cada zona de datos (por ejemplo, EE. UU.).
Para obtener más información sobre la administración de las cuotas de Foundry Models, consulte Cuotas y límites de Microsoft Foundry Models.
ITPM con reconocimiento de caché
Los modelos de Claude en Foundry miden los límites de tasa en solicitudes por minuto (RPM), tokens de entrada no almacenados en caché por minuto (ITPM) y tokens de salida por minuto (OTPM) para cada modelo.
Para la mayoría de los modelos de Claude, solo los tokens de entrada sin almacenar en caché cuentan con respecto a los límites de velocidad de ITPM. Estos tokens incluyen:
Tokens de entrada : tokens en la solicitud después del último punto de interrupción de caché (entrada sin almacenar en caché).
Tokens de entrada de creación de caché : tokens que se escriben en la memoria caché, que consta de:
- Escritura en caché de 5 m TPM — tokens que se están escribiendo en la caché de indicaciones de 5 minutos.
- Escritura en caché de 1 h TPM: tokens que se escriben en la caché de indicaciones de 1 hora.
Sugerencia
El total de tokens de entrada es la suma de los tokens de entrada, los tokens de entrada para la creación de caché y los tokens de entrada de lectura de caché (los tokens leídos de la caché). Sin embargo, los tokens de entrada de lectura de caché no cuentan para ITPM. OTPM tampoco cuenta para ITPM.
Para obtener más información sobre los límites de velocidad y la memoria caché, consulte Claude API Docs: Límites de velocidad.
Límites de velocidad por tipo de suscripción
El tipo de suscripción de Azure determina los límites de velocidad. Las columnas Versión 2: Alojada en Azure y Versión 1: Alojada en la infraestructura de Anthropic indican si hay cuota disponible para esa combinación de modelo y tipo de implementación. Sí significa que la cuota está disponible. N/A significa que el modelo y la combinación de versión no tienen cuota para ese tipo de implementación.
En la tabla siguiente se enumeran los límites de velocidad. Para aumentar la cuota más allá de los límites predeterminados, envíe una solicitud mediante el formulario de solicitud de aumento de cuota.
Pago por uso
| Modelo | Tipo de implementación | Versión 2: hospedada en Azure | Versión 1: hospedada en la infraestructura de Anthropic | RPM | ITPM | OTPM |
|---|---|---|---|---|---|---|
| claude-fable-5-1 | Estándar global | No disponible | Sí | 0 | 0 | 0 |
| claude-fable-5 | Estándar global | No disponible | Sí | 0 | 0 | 0 |
| claude-opus-5 | Estándar global | Sí | Sí | 40 | 40,000 | 8 000 |
| claude-opus-5 | Estándar de zona de datos (EE. UU.) | Sí | No disponible | 40 | 40,000 | 8 000 |
| claude-opus-4-8 | Estándar global | Sí | Sí | 40 | 40,000 | 8 000 |
| claude-opus-4-8 | Estándar de zona de datos (EE. UU.) | Sí | No disponible | 40 | 40,000 | 8 000 |
| claude-opus-4-7 | Estándar global | No disponible | Sí | 40 | 40,000 | 8 000 |
| claude-opus-4-6 | Estándar global | No disponible | Sí | 40 | 40,000 | 8 000 |
| claude-opus-4-5 | Estándar global | No disponible | Sí | 40 | 40,000 | 8 000 |
| claude-sonnet-5 | Estándar global | Sí | Sí | 40 | 40,000 | 8 000 |
| claude-sonnet-5 | Estándar de zona de datos (EE. UU.) | Sí | No disponible | 40 | 40,000 | 8 000 |
| claude-sonnet-4-6 | Estándar global | No disponible | Sí | 80 | 80,000 | 16 000 |
| claude-sonnet-4-5 | Estándar global | No disponible | Sí | 80 | 80,000 | 16 000 |
| claude-haiku-4-5 | Estándar global | Sí | Sí | 80 | 80,000 | 16 000 |
Consideraciones sobre IA responsable
Al usar modelos de Claude en Foundry, tenga en cuenta estas prácticas de inteligencia artificial responsables:
Revise Datos, privacidad y seguridad de los modelos de Claude en Microsoft Foundry para comprender cómo se procesan y conservan los datos al implementar modelos de Claude.
Configure la seguridad del contenido de IA durante la inferencia del modelo, ya que Foundry no proporciona filtrado de contenido integrado para los modelos de Claude en el momento de la implementación.
Asegúrese de que las aplicaciones cumplen con la directiva de uso aceptable de Anthropic. Vea también los detalles de las evaluaciones de seguridad para Claude Fable 5.1 y Claude Mythos 5.1 , Claude Fable 5, Claude Mythos 5, Claude Mythos Preview, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5 y Claude Haiku 4.5.
procedimientos recomendados
Siga estos procedimientos recomendados al trabajar con modelos de Claude en Foundry:
Ingeniería rápida
- Instrucciones claras: Proporcione avisos específicos y detallados.
- Administración de contextos: use la ventana de contexto disponible de forma eficaz.
- Definiciones de los roles: Use los mensajes del sistema para definir el rol y el comportamiento del asistente.
- Avisos estructurados: use formato coherente para obtener mejores resultados.
Optimización de costos
Para optimizar el uso y evitar la limitación de velocidad:
- Implementación de la lógica de reintento: control de 429 respuestas con retroceso exponencial.
- Solicitudes por lotes: combine varias indicaciones cuando sea posible.
- Supervisión del uso de tokens: realice un seguimiento del consumo de tokens y los patrones de solicitud.
- Usar modelos adecuados: use el modelo más rentable para su caso de uso. Consulte Modelos de Claude disponibles.
Contenido relacionado
- Implementación y uso de modelos de Claude en Microsoft Foundry
- Implementación de modelos de Claude en Microsoft Foundry mediante Bicep o Terraform
- Foundry Models de asociados y de la comunidad
- Facturación de unidades de consumo de Claude (CCU) en Microsoft Foundry
- Datos, privacidad y seguridad para los modelos de Claude en Microsoft Foundry