Modelos de Claude en Microsoft Foundry

Los modelos Claude de Anthropic aportan capacidades avanzadas de IA conversacional a Microsoft Foundry, al proporcionar comprensión y generación del lenguaje de última generación para aplicaciones inteligentes. Los modelos de Claude se destacan en razonamiento complejo, generación de código y tareas multimodales, incluido el análisis de imágenes. En este artículo se describen los modelos de Claude disponibles, cómo se hospedan y facturan, las API admitidas, las funcionalidades, las cuotas y los procedimientos recomendados.

Para implementar y llamar a un modelo de Claude, consulte Implementación y uso de modelos de Claude en Microsoft Foundry.

Importante

Los elementos marcados (versión preliminar) de este artículo se encuentran actualmente en versión preliminar pública. Esta versión preliminar se ofrece sin acuerdo de nivel de servicio y no se recomienda para las cargas de trabajo de producción. Es posible que algunas características no se admitan o que tengan funcionalidades restringidas. Para más información, consulte Términos de uso complementarios para las versiones preliminares de Microsoft Azure.

Cómo se hospedan y facturan los modelos de Claude

Microsoft Foundry ofrece modelos de Claude en dos versiones:

  • Versión 1: Alojado en la infraestructura de Anthropic; estos modelos se ejecutan en la infraestructura de Anthropic (fuera de Azure).
  • Versión 2: hospedado en Azure; estos modelos se ejecutan en Azure infraestructura de un extremo a otro y están disponibles con carácter general (GA).

No todos los modelos están disponibles en ambas versiones. La fase de ciclo de vida de un modelo, como la versión preliminar o la disponible con carácter general, puede diferir entre las dos versiones. Para obtener información sobre la disponibilidad por modelo y el estado del ciclo de vida, consulte Modelos de Claude disponibles.

Para comparar ambas opciones de hospedaje en términos de residencia de datos, SLA, vías de soporte, cumplimiento normativo y proceso de compra, consulte Comparar los modelos de Claude hospedados en Azure y hospedados por Anthropic.

Nota:

Puedes acceder a los modelos de Claude en Microsoft Foundry a través de Modelos de Foundry de socios y de la comunidad. Los modelos de socios y de la comunidad que Anthropic vende y opera son Productos que no son de Microsoft según los Términos del Producto.

Los modelos de Claude en Foundry requieren una suscripción a Azure Marketplace y se facturan mediante Claude Consumption Units (CCU). Asegúrese de que tiene los permisos necesarios para suscribirse a las ofertas de modelo antes de implementar. Para obtener más información sobre los precios, consulte Facturación de unidades de consumo de Claude (CCU) en Microsoft Foundry.

Modelos de Claude disponibles

Importante

Los siguientes modelos de Claude cumplen con el estándar de marca de agua de la UE: claude-mythos-5-1, claude-fable-5-1y claude-fable-5. Mientras que claude-fable-5 usa marcas de agua de clave única, claude-mythos-5-1 y claude-fable-5-1 usan doble clave (intercalada de dos claves y C2PA) de la siguiente manera:

  • Marcado de agua de texto entrelazado (segunda clave): se añade una segunda clave para detectar marcas de agua entrelazadas según las normas de la UE. El marcado de agua se realiza del lado del servidor en el momento de la generación; no hay ningún cambio en la estructura de las solicitudes ni de las respuestas. Una API independiente de detección de marcas de agua está en acceso anticipado y no forma parte del alcance del lanzamiento de Foundry.
  • Marcado con marca de agua C2PA: marcado de procedencia del contenido C2PA, gestionado del lado del servidor y del cliente por las superficies de Anthropic. No se ha cambiado ninguna forma de API.

En la tabla siguiente se compara la disponibilidad del modelo para ambas versiones de los modelos de Claude en Foundry. Para obtener más información sobre las características a las que se hace referencia en la tabla, consulte la sección Funcionalidades y características avanzadas .

Para ver los errores que puede encontrar al implementar o llamar a modelos de Claude, consulte Deploy and use Claude models: Troubleshooting( Implementar y usar modelos de Claude: Solución de problemas).

Modelo Availability Ventana de contexto/Salida máxima Principales funcionalidades Más adecuado para
claude-mythos-5-1 1
  • Alojado en la infraestructura de Anthropic: versión preliminar de investigación restringida
1M/128K
  • Biología y ciencias de la vida
  • Ciberseguridad (casos de uso defensivos priorizados): detección de vulnerabilidades, auditoría de superficie expuesta a ataques, formación de equipos rojos, inteligencia sobre amenazas
  • Codificación autónoma
  • Agentes de ejecución prolongada
claude-mythos-5 1
  • Alojado en la infraestructura de Anthropic: versión preliminar de investigación restringida
1M/128K
  • Biología y ciencias de la vida
  • Ciberseguridad (casos de uso defensivos priorizados): detección de vulnerabilidades, auditoría de superficie expuesta a ataques, formación de equipos rojos, inteligencia sobre amenazas
  • Codificación autónoma
  • Agentes de ejecución prolongada
claude-fable-5-1
  • Alojado en infraestructura de Anthropic: Vista previa
1M/128K
  • Pensamiento adaptable
  • Trabajo de larga duración
  • Investigación científica con auto verificación
  • Trabajo del conocimiento; controlar el trabajo de conocimientos desafiantes con menos supervisión práctica
  • Rechazo stop_reason de políticas de salvaguardia de doble uso2
  • Ver las novedades de Claude Fable 5.1 y Claude Mythos 5.1
  • Agentes de ejecución prolongada
  • Codificación y agentes, con un razonamiento más profundo para los flujos de trabajo empresariales
  • Ciencia general e investigación
  • Análisis financiero
  • Vision
claude-fable-5
  • Alojado en infraestructura de Anthropic: Vista previa
1M/128K
  • Pensamiento adaptable
  • Razonamiento sobre bases de código completas y contextos de proyectos de varios días
  • Más trabajo autónomo que cualquier modelo anterior de Claude
  • Autoverificación
  • Orquestación de subagentes
  • Rechazo stop_reason de políticas de salvaguardia de doble uso2
  • Consulte Migración a Claude Fable 5.1 y Claude Mythos 5.1
  • Cybersecurity
  • Codificación autónoma
  • Agentes de ejecución prolongada
  • Codificación y agentes, con un razonamiento más profundo para los flujos de trabajo empresariales
claude-mythos-preview 1
  • Alojado en la infraestructura de Anthropic: versión preliminar de investigación restringida
1M/128K
  • Ciberseguridad (casos de uso defensivos con prioridad)
  • Codificación autónoma
  • Agentes de ejecución prolongada
claude-opus-5
  • Alojado en Azure: disponibilidad general
  • Alojado en la infraestructura de Anthropic: GA
1M/128K
  • Pensamiento adaptable con niveles de esfuerzo xhigh y max
  • Razonamiento sobre bases de código completas y contextos de proyectos de varios días
  • Controles de esfuerzo por turno3
  • A mitad de la conversación3role:"system"
  • Presupuestos de tokens3 (task_budget)
  • Ver las novedades de Claude Opus 5
  • Inteligencia cercana a la de Fable para la codificación a largo plazo y la coordinación compleja de agentes.
  • Agentes de ejecución prolongada
  • Flujos de trabajo empresariales
  • Análisis financiero
  • Uso del equipo
claude-opus-4-8
  • Alojado en Azure: disponibilidad general
  • Alojado en la infraestructura de Anthropic: GA
1M/128K
  • Pensamiento adaptativo con xhigh nivel de esfuerzo
  • Razonamiento sobre bases de código completas y contextos de proyectos de varios días
  • Entrada de imagen de alta resolución (hasta 2576px / 3,75MP)
  • Ver Migración a Claude Opus 5
  • Coding
  • Agentes de ejecución prolongada
  • Análisis financiero
  • Cybersecurity
  • Uso del equipo
claude-opus-4-7
  • Alojado en la infraestructura de Anthropic: GA
1M/128K
  • Pensamiento adaptable
  • Razonamiento sobre bases de código completas
  • Entrada de imagen de alta resolución (hasta 2576px / 3,75MP)
  • Ver Migración a Claude Opus 5
  • Coding
  • Flujos de trabajo empresariales
  • Agentes de ejecución prolongada
  • Razonamiento multimodal
  • Análisis financiero
  • Cybersecurity
claude-opus-4-6
  • Alojado en la infraestructura de Anthropic: GA
1M/128K
  • Pensamiento adaptable
  • Entrada de imagen y texto
  • Uso del equipo
  • Uso avanzado de herramientas (búsqueda, llamada mediante programación, ejemplos)
  • Ver Migración a Claude Opus 5
  • Coding
  • Agentes empresariales
claude-opus-4-5
  • Alojado en la infraestructura de Anthropic: GA
200 000 / 64 000
  • Pensamiento ampliado
  • Entrada de imagen y texto
  • Uso del equipo
  • Uso avanzado de herramientas (búsqueda, llamada mediante programación, ejemplos)
  • Ver Migración a Claude Opus 5
  • Coding
  • Agentes
  • Uso del equipo
  • Flujos de trabajo empresariales
claude-sonnet-5
  • Alojado en Azure: disponibilidad general
  • Alojado en la infraestructura de Anthropic: GA
1M/128K
  • Pensamiento adaptable
  • xhigh nivel de esfuerzo
  • Razonamiento sobre bases de código completas y contextos de proyectos de varios días
  • La entrada de imagen de alta res (hasta 2576px / 3,75MP) está activada de forma predeterminada.
  • A mitad de la conversación3role:"system"
  • Presupuestos de tokens3 (task_budget)
  • Ver las novedades de Claude Sonnet 5
  • Coding
  • Agentes de ejecución prolongada
  • Análisis financiero
  • Cybersecurity
  • Uso del equipo
claude-sonnet-4-6
  • Alojado en la infraestructura de Anthropic: GA
1M/128K
  • Pensamiento adaptable
  • Entrada de imagen y texto
  • Uso del equipo
  • Uso avanzado de herramientas (búsqueda, llamada mediante programación, ejemplos)
  • Consulte Migración a Claude Sonnet 5
  • Coding
  • Agentes
  • Flujos de trabajo empresariales
claude-sonnet-4-5
  • Alojado en la infraestructura de Anthropic: GA
200 000 / 64 000
  • Agentes y tareas complejas de largo alcance
  • Cargas de trabajo de gran volumen
claude-haiku-4-5
  • Alojado en Azure: disponibilidad general
  • Alojado en la infraestructura de Anthropic: GA
200 000 / 64 000
  • Pensamiento ampliado
  • Entrada de imagen y texto
  • Coding
  • Agentes

1Claude Mythos 5-1, Claude Mythos 5 y Claude Mythos Preview solo están disponibles como versión preliminar de investigación cerrada. El acceso a los modelos se concede únicamente a la discreción de Anthropic y se da prioridad a los casos de uso de ciberseguridad defensiva. Vea la tarjeta del sistema Claude Fable 5.1 y Claude Mythos 5.1, la tarjeta del sistema Claude Mythos 5 y la tarjeta del sistema De vista previa de Claude Mythos para obtener instrucciones de uso responsable.

2Claude Fable 5 aplica clasificadores de entrada/salida adicionales que podrían rechazar las solicitudes cuyos contenidos desencadenan directivas de protección de doble uso. Cuando se produce una denegación, la solicitud devuelve una respuesta correcta (200) con un indicador stop_reason: "refusal" de denegación en lugar de contenido generado por el modelo. No se facturan los tokens de entrada que son rechazados.

3 Los controles de esfuerzo por turno, los ajustes a mitad de conversación y los presupuestos de tokens se encuentran actualmente en fase beta.

Introducción a la API

En la tabla siguiente se enumeran las API que puede usar para interactuar tanto con las versiones de los modelos de Claude en Foundry alojadas en Azure como alojadas en la infraestructura de Anthropic.

Use los SDKs Anthropic y las siguientes APIs de Claude:

Sugerencia

La versión de infraestructura hospedada en Anthropic de modelos de Claude en Foundry admite más API que las enumeradas en esta tabla. Puede consultarlos en la página Documentación de la API de Claude: Descripción general de la API.

API Description
Mensajes1 (POST /v1/messages) API de mensajes principales: envíe una lista estructurada de mensajes de entrada con contenido de texto o imagen, incluidas las respuestas de streaming. El modelo genera el siguiente mensaje en la conversación.
Recuento de tokens (POST /v1/messages/count_tokens) API de recuento de tokens: cuente el número de tokens de un mensaje antes de enviarlo a Claude.

1Puede llamar a la API de Messages a través del anthropic paquete de Python, del @anthropic-ai/foundry-sdk paquete de JavaScript o directamente mediante REST. El punto de conexión de implementación tiene la forma https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, y los clientes REST y JavaScript usan el encabezado anthropic-version: 2023-06-01.

Funcionalidades y características avanzadas

Los modelos de Claude en Foundry exponen funcionalidades básicas para procesar, analizar y generar contenido, y herramientas que permiten a Claude interactuar con sistemas externos, ejecutar código y realizar tareas automatizadas. La API de Claude se organiza en cinco áreas:

Las siguientes secciones y tablas resumen las capacidades disponibles en las versiones de los modelos Claude en Foundry Alojadas en Azure y Alojadas en la infraestructura de Anthropic. A menos que se indique, una funcionalidad se aplica a ambas versiones.

Sugerencia

La versión alojada en la infraestructura de Anthropic de los modelos Claude en Foundry admite más capacidades que las enumeradas en estas tablas. Puede ver la lista completa de funcionalidades en Claude Platform Docs: Información general sobre las características.

Para obtener más información sobre las funcionalidades disponibles y las características avanzadas de los modelos de Claude en Foundry, consulte el blog para desarrolladores de Microsoft.

Funcionalidades del modelo

Formas de orientar a Claude y sus resultados directos, incluyendo el formato de respuesta, la profundidad del razonamiento y las modalidades de entrada.

Feature Description
Mensajes en streaming Al crear un mensaje, establezca "stream": true para transmitir la respuesta de forma incremental mediante eventos enviados desde el servidor (SSE).
Pensar Capacidades mejoradas de razonamiento para tareas complejas, lo que proporciona transparencia en el proceso de pensamiento paso a paso de Claude antes de entregar su respuesta final. Consulte Pensamiento y esfuerzo para los thinking valores de parámetro por modelo.
Pensamiento adaptable Deje que Claude decida dinámicamente cuándo y cuánto pensar. Esta función es el único modo de razonamiento en Claude 4.7 y modelos posteriores. Utilice el parámetro effort para controlar la profundidad de razonamiento.
Esfuerzo Controla cuántos tokens utiliza Claude al responder, logrando un equilibrio entre el nivel de detalle de la respuesta y la eficiencia en el uso de tokens. Consulte Pensamiento y esfuerzo para los effort valores de parámetro por modelo.
Citas Basa las respuestas de Claude en fuentes, incluidos los bloques de contenido de search_result.
Imágenes y visión Procese y analice el contenido de las imágenes. Hospedadas en implementaciones de Azure solo aceptan imágenes basadas en direcciones URL o codificadas en base64.
Compatibilidad con PDF Procese y analice el texto y el contenido visual de los documentos PDF. Proporcione archivos PDF como base64 o dirección URL.
Ventana de contexto de 1 M Hasta 1 millón de tokens para procesar documentos grandes, bases de código extensas y conversaciones largas. El soporte técnico está sujeto a la idoneidad del modelo.
Salidas estructuradas Restrinja las respuestas de Claude para seguir un esquema JSON específico, con dos características complementarias: salidas JSON (el output_config.format parámetro) para respuestas estructuradas y uso estricto de herramientas (strict: true) para entradas de herramientas validadas. En el caso de las implementaciones hospedadas en Azure, las salidas estructuradas también admiten el parámetro heredado para las salidas JSON (el output_format parámetro ).

Pensamiento y esfuerzo

La característica Pensando permite valores específicos para el thinking tipo de parámetro, según el modelo, tal como se describe en la tabla siguiente. El adaptive tipo configura la característica de pensamiento adaptable , lo que permite al modelo decidir si desea pensar, en función de la complejidad de las consultas y el nivel de esfuerzo. Por ejemplo: thinking={"type": "adaptive"}.

Modelo adaptive enabled disabled
claude-mythos-5-1 No No
claude-mythos-5 No No
claude-fable-5-1 No No
claude-fable-5 No No
claude-mythos-preview No
claude-opus-5 No 1
claude-opus-4-8 No
claude-opus-4-7 No
claude-opus-4-6
claude-sonnet-5 No
claude-sonnet-4-6

1 El razonamiento solo puede darse disabled con un esfuerzo high o inferior

La característica Esfuerzo permite niveles específicos effort para cada modelo, como se describe en la tabla siguiente. El xhigh nivel genera el mismo resultado que max.

Modelo low medium high xhigh max
claude-mythos-5-1 No
claude-mythos-5 No
claude-fable-5-1 No
claude-fable-5 No
claude-opus-5
claude-opus-4-8
claude-opus-4-7
claude-opus-4-6 No
claude-sonnet-5
claude-sonnet-4-6 No

Tools

Deje que Claude realice acciones en la web o en su entorno. Esta característica consiste en herramientas integradas que Claude invoca a través de tool_use. La plataforma ejecuta herramientas del lado servidor e implementa y ejecuta herramientas del lado cliente.

Feature Description
Uso de herramientas con herramientas ejecutadas por el cliente Herramientas personalizadas más las definidas por Anthropic bash, text editor, computer use y memory. Para obtener más información sobre estas herramientas, consulte Bash, Editor de texto, Uso de equipos y Memoria.
Búsqueda web Descubra los datos actuales del mundo real desde toda la web para usarlos para aumentar el conocimiento de Claude. En el caso de las implementaciones hospedadas en Azure, solo se admite la versión de la web_search_20250305 herramienta.
Captura web Recupere y realice un análisis detallado del contenido completo de páginas web y documentos PDF especificados, aumentando el contexto de Claude con contenido web activo. En Foundry, el acceso web requiere una implementación alojada en la infraestructura de Anthropic. En el caso de las implementaciones hospedadas en Azure, solo se admite la versión de la web_fetch_20250910 herramienta.

Infraestructura de herramientas

Descubre, orquesta y amplía el uso de herramientas.

Feature Description
Transmisión de herramientas de granularidad fina La herramienta Stream usa parámetros sin almacenamiento en búfer ni validación json, lo que reduce la latencia de los parámetros grandes. Requiere la cabecera anthropic-betafine-grained-tool-streaming-2025-05-14.
Conector MCP Conéctese a servidores MCP remotos directamente desde la API messages sin un cliente MCP independiente.
Búsqueda de herramientas Amplíe a miles de herramientas descubriéndolas y cargándolas dinámicamente bajo demanda mediante búsquedas basadas en regex y BM25, optimizando el uso del contexto y mejorando la precisión en la selección de herramientas. Para las implementaciones de Alojado en Azure, se admiten ambas versiones de las herramientas: tool_search_tool_bm25_20251119 y tool_search_tool_regex_20251119. También se aceptan los alias heredados tool_search_tool_bm25 y tool_search_tool_regex .

Administración de contexto

Controle y optimice la ventana de contexto de Claude para sesiones de larga duración.

Feature Description
Caché automática de prompts Simplifique el almacenamiento en caché de mensajes en un único parámetro de API. El sistema almacena automáticamente en caché el último bloque almacenable en caché de su solicitud, desplazando el punto de almacenamiento en caché hacia delante a medida que crecen las conversaciones.
Almacenamiento en caché de prompts (5 min) Proporcione a Claude más conocimientos y salidas de ejemplo para reducir los costos y la latencia.
Almacenamiento en caché de prompts (1 h) Duración extendida de la caché de 1 hora para un contexto menos frecuente, pero importante, que complementa la caché estándar de 5 minutos.
Edición de contexto Administre automáticamente el contexto de conversación con estrategias configurables, incluidos borrar los resultados de la herramienta y administrar bloques de pensamiento. Requiere el encabezado anthropic-beta context-management-2025-06-27.
Recuento de tokens El recuento de tokens le permite determinar el número de tokens de un mensaje antes de enviarlo a Claude, lo que le ayuda a tomar decisiones informadas sobre sus avisos y uso.

Archivos y recursos

Administre los documentos y los datos que proporcione a Claude.

Feature Description
API de archivos Actualmente solo está disponible en implementaciones de alojado en la infraestructura de Anthropic. Cargue y administre archivos para usarlos con Claude sin volver a cargar contenido con cada solicitud. Admite archivos PDF, imágenes y texto.

Soporte para agentes

Tipos y regiones de implementación

Los modelos de Claude en Foundry están disponibles para los siguientes tipos de implementación en regiones de Azure específicas:

  • Estándar global: todos los modelos de Claude (alojados en Azure y en la infraestructura de Anthropic).
  • Estándar de zona de datos (EE. UU.): hospedado en versiones de Azure de claude-opus-5, claude-opus-4-8y claude-sonnet-5.

Para consultar las regiones exactas de Azure en las que los modelos de Claude están disponibles para su implementación, consulte Disponibilidad de regiones por tipo de implementación.

Cuotas y límites de tasa

En esta sección se explica cómo los despliegues comparten la cuota y qué límites de tasa se les aplican. La gestión a nivel de suscripción gestiona la cuota de despliegue. Los recursos y las regiones comparten la cuota en lugar de asignarla por separado para cada recurso o región.

  • Todas las implementaciones de Global Standard del mismo modelo y versión dentro de una suscripción comparten una misma cuota entre todas las regiones.
  • Todas las implementaciones de Data Zone Estándar del mismo modelo y versión en una suscripción se nutren de un fondo común de cuotas compartido dentro de cada zona de datos (por ejemplo, EE. UU.).

Para obtener más información sobre la administración de las cuotas de Foundry Models, consulte Cuotas y límites de Microsoft Foundry Models.

ITPM con reconocimiento de caché

Los modelos de Claude en Foundry miden los límites de tasa en solicitudes por minuto (RPM), tokens de entrada no almacenados en caché por minuto (ITPM) y tokens de salida por minuto (OTPM) para cada modelo.

Para la mayoría de los modelos de Claude, solo los tokens de entrada sin almacenar en caché cuentan con respecto a los límites de velocidad de ITPM. Estos tokens incluyen:

  • Tokens de entrada : tokens en la solicitud después del último punto de interrupción de caché (entrada sin almacenar en caché).

  • Tokens de entrada de creación de caché : tokens que se escriben en la memoria caché, que consta de:

    • Escritura en caché de 5 m TPM — tokens que se están escribiendo en la caché de indicaciones de 5 minutos.
    • Escritura en caché de 1 h TPM: tokens que se escriben en la caché de indicaciones de 1 hora.

Sugerencia

El total de tokens de entrada es la suma de los tokens de entrada, los tokens de entrada para la creación de caché y los tokens de entrada de lectura de caché (los tokens leídos de la caché). Sin embargo, los tokens de entrada de lectura de caché no cuentan para ITPM. OTPM tampoco cuenta para ITPM.

Para obtener más información sobre los límites de velocidad y la memoria caché, consulte Claude API Docs: Límites de velocidad.

Límites de velocidad por tipo de suscripción

El tipo de suscripción de Azure determina los límites de velocidad. Las columnas Versión 2: Alojada en Azure y Versión 1: Alojada en la infraestructura de Anthropic indican si hay cuota disponible para esa combinación de modelo y tipo de implementación. Sí significa que la cuota está disponible. N/A significa que el modelo y la combinación de versión no tienen cuota para ese tipo de implementación.

En la tabla siguiente se enumeran los límites de velocidad. Para aumentar la cuota más allá de los límites predeterminados, envíe una solicitud mediante el formulario de solicitud de aumento de cuota.

Pago por uso

Modelo Tipo de implementación Versión 2: hospedada en Azure Versión 1: hospedada en la infraestructura de Anthropic RPM ITPM OTPM
claude-fable-5-1 Estándar global No disponible 0 0 0
claude-fable-5 Estándar global No disponible 0 0 0
claude-opus-5 Estándar global 40 40,000 8 000
claude-opus-5 Estándar de zona de datos (EE. UU.) No disponible 40 40,000 8 000
claude-opus-4-8 Estándar global 40 40,000 8 000
claude-opus-4-8 Estándar de zona de datos (EE. UU.) No disponible 40 40,000 8 000
claude-opus-4-7 Estándar global No disponible 40 40,000 8 000
claude-opus-4-6 Estándar global No disponible 40 40,000 8 000
claude-opus-4-5 Estándar global No disponible 40 40,000 8 000
claude-sonnet-5 Estándar global 40 40,000 8 000
claude-sonnet-5 Estándar de zona de datos (EE. UU.) No disponible 40 40,000 8 000
claude-sonnet-4-6 Estándar global No disponible 80 80,000 16 000
claude-sonnet-4-5 Estándar global No disponible 80 80,000 16 000
claude-haiku-4-5 Estándar global 80 80,000 16 000

Consideraciones sobre IA responsable

Al usar modelos de Claude en Foundry, tenga en cuenta estas prácticas de inteligencia artificial responsables:

procedimientos recomendados

Siga estos procedimientos recomendados al trabajar con modelos de Claude en Foundry:

Ingeniería rápida

  • Instrucciones claras: Proporcione avisos específicos y detallados.
  • Administración de contextos: use la ventana de contexto disponible de forma eficaz.
  • Definiciones de los roles: Use los mensajes del sistema para definir el rol y el comportamiento del asistente.
  • Avisos estructurados: use formato coherente para obtener mejores resultados.

Optimización de costos

Para optimizar el uso y evitar la limitación de velocidad:

  • Implementación de la lógica de reintento: control de 429 respuestas con retroceso exponencial.
  • Solicitudes por lotes: combine varias indicaciones cuando sea posible.
  • Supervisión del uso de tokens: realice un seguimiento del consumo de tokens y los patrones de solicitud.
  • Usar modelos adecuados: use el modelo más rentable para su caso de uso. Consulte Modelos de Claude disponibles.