Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
Les modèles Claude de Anthropic apportent des fonctionnalités d'IA conversationnelle avancées à Microsoft Foundry, offrant une compréhension et une génération de langages de pointe pour les applications intelligentes. Les modèles Claude excellent dans le raisonnement complexe, la génération de code et les tâches multimodales, notamment l’analyse d’images. Cet article décrit les modèles Claude disponibles, la façon dont ils sont hébergés et facturés, les API prises en charge, les fonctionnalités, les quotas et les meilleures pratiques.
Pour déployer et appeler un modèle Claude, consultez Déployer et utiliser des modèles Claude dans Microsoft Foundry.
Important
Les éléments indiqués comme (aperçu) dans cet article sont en aperçu public. Cette version préliminaire est fournie sans contrat de niveau de service, et nous la déconseillons pour les charges de travail en production. Certaines fonctionnalités peuvent ne pas être prises en charge ou avoir des fonctionnalités contraintes. Pour plus d’informations, consultez Conditions d'utilisation supplémentaires pour les versions préliminaires de Microsoft Azure.
Comment les modèles Claude sont hébergés et facturés
Microsoft Foundry propose des modèles Claude dans deux versions :
- Version 1 : hébergés sur Anthropic infrastructure ; ces modèles s'exécutent sur l'infrastructure de Anthropic (en dehors de Azure).
- Version 2 : hébergés sur Azure ; ces modèles s’exécutent sur Azure infrastructure de bout en bout et sont tous en disponibilité générale.
Tous les modèles ne sont pas disponibles dans les deux versions. L’étape du cycle de vie d’un modèle, telle que la préversion ou la disponibilité générale, peut différer entre les deux versions. Pour connaître la disponibilité par modèle et l’état du cycle de vie, consultez Modèles Claude disponibles.
Pour comparer les deux options d’hébergement entre la résidence des données, les contrats SLA, les chemins d’accès de support, la conformité et le flux d’achat, consultez Comparer les modèles Claude hébergés par Azure et hébergés par Anthropic.
Note
Vous accédez aux modèles Claude dans Microsoft Foundry via les Modèles Foundry de partenaires et de la communauté. Les modèles de partenaires et de la communauté qu’Anthropic vend et exploite sont des Produits non-Microsoft au titre des Conditions du produit.
Les modèles Claude dans Foundry nécessitent un abonnement Place de marché Azure et une facture par le biais de Claude Consumption Units (CCU). Vérifiez que vous disposez des autorisations nécessaires pour vous abonner aux offres de modèle avant de déployer. Pour plus d’informations sur les tarifs, consultez la facturation des unités de consommation Claude (CCU) dans Microsoft Foundry.
Modèles Claude disponibles
Important
Les modèles Claude suivants sont conformes à la norme de tatouage numérique de l’UE : claude-mythos-5-1, claude-fable-5-1 et claude-fable-5.
Alors que claude-fable-5 utilise un filigranage à clé unique, claude-mythos-5-1 et claude-fable-5-1 utilisent une double clé (entrelacement de 2 clés et C2PA) comme suit :
- Tatouage de texte entrelacé (deuxième clé) : une deuxième clé est ajoutée pour détecter le tatouage entrelacé conformément aux normes de l’UE. Le filigranage s’effectue côté serveur lors de la génération ; aucun changement n’est apporté au format des requêtes ou des réponses. Une API de détection de filigrane séparée est en accès anticipé et ne fait pas partie du périmètre de lancement de Foundry.
- Marquage C2PA: marquage C2PA de provenance du contenu, géré côté serveur/client par les interfaces d’Anthropic. Aucune modification de forme d’API.
Le tableau suivant compare la disponibilité des modèles pour les deux versions des modèles Claude dans Foundry. Pour plus d’informations sur les fonctionnalités référencées dans le tableau, consultez la section Fonctionnalités et fonctionnalités avancées .
Pour connaître les erreurs que vous pouvez rencontrer lorsque vous déployez ou appelez des modèles Claude, consultez Déployer et utiliser des modèles Claude : Résolution des problèmes.
| Model | Disponibilité | Fenêtre contextuelle / Sortie maximale | Fonctionnalités clés | Idéal pour |
|---|---|---|---|---|
claude-mythos-5-1
1 |
|
1M / 128K |
|
|
claude-mythos-5
1 |
|
1M / 128K |
|
|
claude-fable-5-1 |
|
1M / 128K |
|
|
claude-fable-5 |
|
1M / 128K |
|
|
claude-mythos-preview
1 |
|
1M / 128K |
|
|
claude-opus-5 |
|
1M / 128K |
|
|
claude-opus-4-8 |
|
1M / 128K |
|
|
claude-opus-4-7 |
|
1M / 128K |
|
|
claude-opus-4-6 |
|
1M / 128K |
|
|
claude-opus-4-5 |
|
200K / 64K |
|
|
claude-sonnet-5 |
|
1M / 128K |
|
|
claude-sonnet-4-6 |
|
1M / 128K |
|
|
claude-sonnet-4-5 |
|
200K / 64K |
|
|
claude-haiku-4-5 |
|
200K / 64K |
|
|
1Claude Mythos 5-1, Claude Mythos 5 et Claude Mythos Preview ne sont disponibles que comme préversion de recherche contrôlée. L'accès aux modèles est accordé uniquement à la discrétion de Anthropic et hiérarchisé pour les cas d'usage de cybersécurité défensifs. Consultez la carte système Claude Fable 5.1 & Claude Mythos 5.1, la carte système Claude Mythos 5 et la carte système Claude Mythos Preview pour obtenir des conseils d’utilisation responsable.
2Claude Fable 5 applique des classifieurs d’entrée/sortie supplémentaires susceptibles de refuser les demandes dont le contenu déclenche des stratégies de protection à double utilisation. Lorsqu’un refus se produit, la demande retourne une réponse réussie (200) avec un indicateur stop_reason: "refusal" de refus au lieu du contenu généré par un modèle. Vous n’êtes pas facturé pour les jetons d’entrée refusés.
3 Contrôles d’effort par tour, Mi-conversation et Budgets de jetons sont actuellement en version bêta.
Présentation de l’API
Le tableau suivant répertorie les API que vous pouvez utiliser pour interagir avec les versions hébergées sur Azure et hébergées sur l’infrastructure d’Anthropic des modèles Claude dans Foundry.
Utilisez les Anthropic SDK et les API Claude suivantes :
Tip
La version d’infrastructure hébergée sur Anthropic des modèles Claude dans Foundry prend en charge plusieurs API que celles répertoriées dans ce tableau. Vous pouvez les voir dans la page de présentation de l’API Claude : page vue d’ensemble de l’API .
| API | Description |
|---|---|
Messages1 (POST /v1/messages) |
API Messages principale : envoyez une liste structurée de messages en entrée avec du texte ou des images, y compris des réponses en streaming. Le modèle génère le message suivant dans la conversation. |
Comptage de jetons (POST /v1/messages/count_tokens) |
API Nombre de jetons : compter le nombre de jetons dans un message avant de l’envoyer à Claude. |
1Vous pouvez appeler l’API Messages à partir du anthropic package Python, du @anthropic-ai/foundry-sdk package JavaScript ou directement via REST. Le point de terminaison de déploiement suit la forme https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, et les clients REST et JavaScript utilisent l’en-tête anthropic-version: 2023-06-01 .
Fonctionnalités et fonctionnalités avancées
Les modèles Claude dans Foundry exposent des fonctionnalités de base pour le traitement, l’analyse et la génération de contenu et d’outils qui permettent à Claude d’interagir avec des systèmes externes, d’exécuter du code et d’effectuer des tâches automatisées. La surface d’API de Claude est organisée en cinq zones :
- Fonctionnalités de modèle
- Outils
- Infrastructure des outils
- Gestion du contexte
- Fichiers et ressources
Les sections et tableaux suivants résument les fonctionnalités disponibles dans les versions des modèles Claude dans Foundry hébergées sur Azure et hébergées sur l’infrastructure d’Anthropic. Sauf indication contraire, une fonctionnalité s’applique aux deux versions.
Tip
La version hébergée sur l’infrastructure d’Anthropic des modèles Claude dans Foundry prend en charge davantage de fonctionnalités que celles répertoriées dans ces tableaux. Vous pouvez voir la liste complète des fonctionnalités sur Claude Platform Docs : Vue d’ensemble des fonctionnalités.
Pour plus d’informations sur les fonctionnalités disponibles et les fonctionnalités avancées pour les modèles Claude dans Foundry, consultez le blog Microsoft développeur.
Fonctionnalités des modèles
Façons d’orienter Claude et les sorties directes produites par Claude, y compris le format de réponse, la profondeur du raisonnement et les modalités d’entrée.
| Fonctionnalité | Description |
|---|---|
| Diffusion en continu de messages | Lors de la création d’un message, définissez "stream": true pour diffuser en continu de manière incrémentielle la réponse à l’aide d’événements envoyés par le serveur (SSE). |
| Penser | Amélioration des capacités de raisonnement pour les tâches complexes, fournissant la transparence dans le processus de réflexion pas à pas de Claude avant de fournir sa réponse finale. Consultez La réflexion et l’effort pour les valeurs de thinking paramètres par modèle. |
| Pensée adaptative | Laissez Claude décider dynamiquement quand et dans quelle mesure réfléchir. Cette fonctionnalité est le seul mode de réflexion disponible sur Claude 4.7 et les versions ultérieures. Utilisez le paramètre effort pour contrôler le niveau de réflexion. |
| Effort | Contrôlez le nombre de jetons utilisés par Claude dans sa réponse, en trouvant le bon équilibre entre le niveau de détail de la réponse et l’efficacité en termes de jetons. Consultez La réflexion et l’effort pour les valeurs de effort paramètres par modèle. |
| Citations | Ancrez les réponses de Claude dans des sources, y compris les blocs de contenu search_result. |
| Images et vision | Traitez et analysez le contenu à partir d’images. Hébergés sur Azure déploiements acceptent uniquement les images codées en base64 ou basées sur des URL. |
| Prise en charge du format PDF | Traitez et analysez du texte et du contenu visuel à partir de documents PDF. Fournissez des fichiers PDF en tant que base64 ou URL. |
| Fenêtre contextuelle 1M | Jusqu’à 1 million de jetons pour le traitement de documents volumineux, de bases de code étendues et de longues conversations. Le support est soumis à l’éligibilité du modèle. |
| Sorties structurées | Limitez les réponses de Claude à suivre un schéma JSON spécifique, en utilisant deux fonctionnalités complémentaires : les sorties JSON (le output_config.format paramètre) pour les réponses structurées et l’utilisation stricte des outils (strict: true) pour les entrées d’outils validées. Pour les déploiements hébergés sur Azure, les sorties structurées prennent également en charge le paramètre hérité pour les sorties JSON (le output_format paramètre). |
Pensée et effort
La fonctionnalité Thinking permet des valeurs spécifiques pour le type de thinking paramètre, selon le modèle, comme décrit dans le tableau suivant. Le adaptive type configure la fonctionnalité de pensée adaptative , ce qui permet au modèle de décider s’il faut penser, en fonction de la complexité des requêtes et du niveau d’effort. Par exemple : thinking={"type": "adaptive"}.
| Model | adaptive |
enabled |
disabled |
|---|---|---|---|
claude-mythos-5-1 |
Yes | Non | Non |
claude-mythos-5 |
Yes | Non | Non |
claude-fable-5-1 |
Yes | Non | Non |
claude-fable-5 |
Yes | Non | Non |
claude-mythos-preview |
Yes | Yes | Non |
claude-opus-5 |
Yes | Non | Oui1 |
claude-opus-4-8 |
Yes | Non | Yes |
claude-opus-4-7 |
Yes | Non | Yes |
claude-opus-4-6 |
Yes | Yes | Yes |
claude-sonnet-5 |
Yes | Non | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes |
1 La réflexion n’est possible disabled qu’avec un effort high ou moins
La fonctionnalité Effort permet des niveaux spécifiques effort pour chaque modèle, comme décrit dans le tableau suivant. Le xhigh niveau produit le même résultat que max.
| Model | low |
medium |
high |
xhigh |
max |
|---|---|---|---|---|---|
claude-mythos-5-1 |
Yes | Yes | Yes | Yes | Non |
claude-mythos-5 |
Yes | Yes | Yes | Yes | Non |
claude-fable-5-1 |
Yes | Yes | Yes | Yes | Non |
claude-fable-5 |
Yes | Yes | Yes | Yes | Non |
claude-opus-5 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-8 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-7 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-6 |
Yes | Yes | Yes | Non | Yes |
claude-sonnet-5 |
Yes | Yes | Yes | Yes | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes | Non | Yes |
Tools
Laissez Claude prendre des actions sur le web ou dans votre environnement. Cette fonctionnalité se compose d’outils intégrés que Claude appelle à travers tool_use. La plateforme exécute des outils côté serveur et vous implémentez et exécutez des outils côté client.
| Fonctionnalité | Description |
|---|---|
| Utilisation de l’outil avec les outils exécutés par le client | Outils personnalisés ainsi que outils bash, text editor, computer use et memory définis par Anthropic. Pour plus d’informations sur ces outils, consultez Bash, Éditeur de texte, Utilisation de l’ordinateur et Mémoire. |
| Recherche web | Découvrez les données réelles actuelles du web pour améliorer les connaissances de Claude. Pour les déploiements hébergés sur Azure, seule la version de l’outil web_search_20250305 est prise en charge. |
| Récupération Web | Récupérer et effectuer une analyse approfondie de l’intégralité du contenu provenant de pages web et de documents PDF spécifiés, en enrichissant le contexte de Claude avec du contenu web en temps réel. Sur Foundry, la récupération web nécessite un déploiement hébergé sur l’infrastructure d’Anthropic. Pour les déploiements hébergés sur Azure, seule la version de l’outil web_fetch_20250910 est prise en charge. |
Infrastructure des outils
Découvrez, orchestrez et mettez à l’échelle l’utilisation de l’outil.
| Fonctionnalité | Description |
|---|---|
| Streaming granulaire des outils | L’outil stream utilise des paramètres sans mise en mémoire tampon ni validation JSON, ce qui réduit la latence pour les paramètres volumineux. Nécessite l’en-tête anthropic-betafine-grained-tool-streaming-2025-05-14. |
| Connecteur MCP | Connectez-vous aux serveurs MCP distants directement à partir de l’API Messages sans client MCP distinct. |
| Recherche d’outils | Effectuez une mise à l’échelle vers des milliers d’outils en découvrant et en charge dynamiquement des outils à la demande à l’aide de la recherche basée sur regex et BM25, en optimisant l’utilisation du contexte et en améliorant la précision de la sélection des outils. Pour les déploiements hébergés sur Azure, les versions des outils tool_search_tool_regex_20251119 et tool_search_tool_bm25_20251119 sont prises en charge. Les alias hérités tool_search_tool_regex et tool_search_tool_bm25 sont également acceptés. |
Gestion du contexte
Contrôlez et optimisez la fenêtre de contexte de Claude pour les sessions longues.
| Fonctionnalité | Description |
|---|---|
| Mise en cache automatique des prompts | Simplifiez la mise en cache des prompts en un seul paramètre d’API. Le système met automatiquement en cache le dernier bloc mis en cache dans votre requête, en déplaçant le point de cache vers l’avant à mesure que les conversations augmentent. |
| Mise en cache du prompt (5m) | Fournissez à Claude davantage de connaissances et d’exemples de sorties pour réduire les coûts et la latence. |
| Mise en cache des prompts (1 h) | Durée étendue du cache de 1 heure pour un contexte moins fréquemment consulté mais important, en complément du cache standard de 5 minutes. |
| Modification de contexte | Gérez automatiquement le contexte de conversation avec des stratégies configurables, notamment l’effacement des résultats de l’outil et la gestion des blocs de réflexion. Nécessite l’en-tête anthropic-beta context-management-2025-06-27. |
| Comptage de jetons | Le comptage de jetons vous permet de déterminer le nombre de jetons dans un message avant de l’envoyer à Claude, ce qui vous aide à prendre des décisions éclairées sur vos invites et votre utilisation. |
Fichiers et ressources
Gérez les documents et les données que vous fournissez à Claude.
| Fonctionnalité | Description |
|---|---|
| API de fichiers | Actuellement disponible uniquement sur les déploiements hébergés sur l’infrastructure d’Anthropic. Chargez et gérez des fichiers à utiliser avec Claude sans recharger le contenu avec chaque requête. Prend en charge les fichiers PDF, images et texte. |
Prise en charge de l’agent
- Microsoft Agent Framework prend en charge la création d’agents qui utilisent des modèles Claude.
- Créez des agents IA personnalisés avec le Kit de développement logiciel (SDK) Claude Agent.
Types de déploiement et régions
Les modèles Claude dans Foundry sont disponibles pour les types de déploiement suivants dans des régions Azure spécifiques :
- Standard global : tous les modèles Claude (hébergés sur Azure et hébergés sur Anthropic infrastructure).
-
Data Zone Standard (ÉTATS-Unis) : hébergé sur Azure versions de
claude-opus-5,claude-opus-4-8etclaude-sonnet-5.
Pour connaître les régions exactes Azure où les modèles Claude sont disponibles pour le déploiement, consultez Disponibilité de la région par type de déploiement.
Quotas et limites de taux
Cette section explique comment les déploiements partagent le quota et quelles limites de taux leur sont appliquées. La gestion au niveau de l’abonnement gère le quota de déploiement. Les ressources et les régions partagent le quota au lieu de l’allouer séparément pour chaque ressource ou région.
- Tous les déploiements Global Standard du même modèle et version dans un abonnement proviennent d’un pool de quotas partagés dans toutes les régions.
- Tous les déploiements Data Zone Standard d’un même modèle et d’une même version au sein d’un abonnement utilisent désormais un pool de quotas partagé dans chaque zone de données (par exemple, USA).
Pour plus d’informations sur la gestion des quotas pour les modèles Foundry, consultez Microsoft quotas et limites des modèles Foundry.
ITPM sensible au cache
Dans Foundry, les modèles Claude mesurent les limites de débit en requêtes par minute (RPM), en tokens d’entrée non mis en cache par minute (ITPM) et en tokens de sortie par minute (OTPM) pour chaque modèle.
Pour la plupart des modèles Claude, seuls les jetons d’entrée non mis en cache sont comptabilisés dans vos limites de débit ITPM. Ces jetons sont les suivants :
Jetons d’entrée — jetons de la requête situés après le dernier point d’arrêt du cache (entrée non mise en cache).
Jetons d’entrée de création de cache : jetons écrits dans le cache, qui comprend :
- Cache écrit 5m TPM : jetons écrits dans le cache d’invite de 5 minutes.
- Cache écrit 1h TPM : jetons écrits dans le cache d’invite de 1 heure.
Tip
Le nombre total de jetons d’entrée est la somme des jetons d’entrée, des jetons d’entrée de création du cache et des jetons d’entrée de lecture du cache (les jetons lus à partir du cache). Toutefois, les jetons d’entrée lus depuis le cache ne sont pas pris en compte dans l’ITPM. OTPM n’est pas non plus pris en compte dans l’ITPM.
Pour plus d’informations sur les limites de débit et le cache, consultez Claude API Docs : Limites de débit.
Limites de débit par type d’abonnement
Votre type d’abonnement Azure détermine vos limites de taux. Les colonnes Version 2 : hébergée sur Azure et Version 1 : hébergée sur l’infrastructure Anthropic indiquent si un quota est disponible pour cette combinaison de modèle et de type de déploiement. Oui signifie que le quota est disponible. N/A signifie que la combinaison de modèles et de versions n’a pas de quota pour ce type de déploiement.
Le tableau suivant répertorie les limites de débit. Pour augmenter votre quota au-delà des limites par défaut, envoyez une demande via le formulaire de demande d’augmentation de quota.
Paiement à l’utilisation
| Model | Type de déploiement | Version 2 : hébergée sur Azure | Version 1 : hébergée sur l’infrastructure Anthropic | Tr / min | ITPM | OTPM |
|---|---|---|---|---|---|---|
| claude-fable-5-1 | Standard global | N/A | Yes | 0 | 0 | 0 |
| claude-fable-5 | Standard global | N/A | Yes | 0 | 0 | 0 |
| claude-opus-5 | Standard global | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-opus-5 | Data Zone Standard (ÉTATS-Unis) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-opus-4-8 | Standard global | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-8 | Data Zone Standard (ÉTATS-Unis) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-opus-4-7 | Standard global | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-6 | Standard global | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-5 | Standard global | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-sonnet-5 | Standard global | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-sonnet-5 | Data Zone Standard (ÉTATS-Unis) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-sonnet-4-6 | Standard global | N/A | Yes | 80 | 80,000 | 16,000 |
| claude-sonnet-4-5 | Standard global | N/A | Yes | 80 | 80,000 | 16,000 |
| claude-haiku-4-5 | Standard global | Yes | Yes | 80 | 80,000 | 16,000 |
Considérations relatives à l’IA responsable
Lorsque vous utilisez des modèles Claude dans Foundry, tenez compte des pratiques d’IA responsables suivantes :
Passez en revue les données, la confidentialité et la sécurité des modèles Claude dans Microsoft Foundry pour comprendre comment vos données sont traitées et conservées lorsque vous déployez des modèles Claude.
Configurez la sécurité du contenu IA pendant l’inférence du modèle, car Foundry ne fournit pas de filtrage de contenu intégré pour les modèles Claude au moment du déploiement.
Assurez-vous que vos applications sont conformes à la stratégie d’utilisation acceptable d’Anthropic. En outre, consultez le détail des évaluations de sécurité pour Claude Fable 5.1 & Claude Mythos 5.1 , Claude Fable 5, Claude Mythos 5, Claude Mythos Preview, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5, et Claude Haiku 4.5.
Bonnes pratiques
Suivez ces bonnes pratiques lors de l’utilisation des modèles Claude dans Foundry :
Ingénierie rapide
- Instructions claires : fournissez des instructions spécifiques et détaillées.
- Gestion du contexte : utilisez efficacement la fenêtre de contexte disponible.
- Définitions de rôle : utilisez les messages système pour définir le rôle et le comportement de l’Assistant.
- Invites structurées : utilisez une mise en forme cohérente pour obtenir de meilleurs résultats.
Optimisation des coûts
Pour optimiser votre utilisation et éviter la limitation du débit :
- Implémentez la logique de nouvelle tentative : gérez les réponses 429 avec une temporisation exponentielle.
- Demandes par lots : combinez plusieurs instructions lorsque cela est possible.
- Surveiller l’utilisation des jetons : effectuez le suivi de votre consommation de jetons et de vos modèles de requête.
- Utilisez les modèles appropriés : utilisez le modèle le plus rentable pour votre cas d’usage. Voir Les modèles Claude disponibles.
Contenu connexe
- Déployer et utiliser des modèles Claude dans Microsoft Foundry
- Déployer des modèles Claude dans Microsoft Foundry à l’aide de Bicep ou Terraform
- Modèles de fabrication provenant de partenaires et de la communauté
- Facturation des unités de consommation Claude (CCU) dans Microsoft Foundry
- Données, confidentialité et sécurité pour les modèles Claude dans Microsoft Foundry