Remarque
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de vous connecter ou de modifier des répertoires.
L’accès à cette page nécessite une autorisation. Vous pouvez essayer de modifier des répertoires.
S’APPLIQUE À : Développeur | Essentiel | Essentiel v2 | Standard | Standard v2 | Premium | Premium v2
Vous pouvez créer une API de modèle unifié dans Gestion des API Azure pour exposer plusieurs back-ends LLM via un seul point de terminaison côté client. Les applications clientes utilisent un format d’API familier : l’API d’achèvement de conversation OpenAI, tandis que Gestion des API traduit automatiquement les requêtes vers les modèles back-end à l’aide de l’API d’achèvement de conversation OpenAI ou de l’API Messages Anthropic.
Note
L’API de modèle unifié est en préversion et est actuellement déployée pour les clients. Dans les offres classiques, l’accès anticipé à cette fonctionnalité est disponible via le canal de diffusion anticipée de la passerelle IA.
En centralisant l’accès au modèle derrière une seule couche d’API, vous pouvez :
- Normaliser sur un format d’API unique pour les clients indépendamment des formats utilisés par les modèles back-end.
- Unifier l’observabilité, la sécurité et la gouvernance avec des stratégies entre les fournisseurs de modèles.
- Configurez le basculement de modèle entre les fournisseurs de modèles.
- Dissociez les noms de modèles côté client des noms de modèles principaux à l’aide d’alias.
Pour en savoir plus sur la gestion des API IA dans Gestion des API, consultez fonctionnalités de passerelle AI dans Gestion des API Azure.
Back-ends pris en charge
L’API de modèle unifié prend en charge les formats d’API back-end suivants :
- API OpenAI de complétion de chat
- API de messages anthropiques
Prerequisites
- Une instance existante de gestion d’API. Si vous ne l’avez pas déjà fait, créez-en un.
- Un ou plusieurs déploiements de modèles dans un back-end pris en charge.
- Pour suivre l’utilisation des jetons par l’API, consultez Émettre des métriques personnalisées pour les prérequis.
- Pour appliquer les contrôles de sécurité du contenu sur l’API, consultez Appliquer les vérifications de sécurité du contenu sur les demandes LLM pour les conditions préalables.
Créer une API de modèle unifié - portail Azure
Procédez comme suit pour créer une API de modèle unifié dans Gestion des API.
Lorsque vous créez l’API, Gestion des API configure automatiquement :
- Point
/modelsde terminaison pour la découverte de modèles qui répertorie tous les modèles configurés. - Un point de terminaison de routage unique tel que
/llm/v1/chat/completions, qui accepte les requêtes au format d’achèvement de conversation OpenAI. - Mettre en forme la logique de traduction pour chaque modèle principal que vous ajoutez.
- Ressources principales qui redirigent les requêtes vers le point de terminaison du fournisseur approprié.
Pour créer une API de modèle unifiée :
Dans le portail Azure, accédez à votre instance Gestion des API.
Dans le menu de la barre latérale, sous API, sélectionnez Modèles>+ Ajouter>une API de modèle unifié.
Sous l’onglet Configurer l’API De modèle unifié :
- Entrez un nom d’affichage pour l’API. API Management génère automatiquement un Nom d’API à partir du nom d’affichage, mais vous pouvez le modifier si vous le souhaitez.
- Dans le chemin d’accès de l’API, entrez le chemin que les clients utilisent pour appeler l’API. La valeur par défaut est
/llm/v1, ce qui donne un point de terminaison pour les complétions de chat à l’adresse/llm/v1/chat/completions. - Sélectionnez éventuellement un ou plusieurs produits à associer à l’API.
- Sélectionnez Suivant.
Sous l’onglet Configurer les modèles , sélectionnez + Ajouter pour ouvrir le volet Ajouter un modèle , puis configurez les paramètres suivants pour chaque déploiement de modèle :
Dans Configuration d’arrière-plan :
- Dans Modèle, entrez le nom du modèle principal (par exemple,
gpt-4oouclaude-sonnet-4.6). - Dans le format API, sélectionnez le format attendu par le modèle backend, tel que API OpenAI Chat Completions ou API Anthropic Messages.
- Dans l’URL, entrez l’URL du point de terminaison principal, par exemple, un déploiement de modèle dans Foundry ou, pour d’autres fournisseurs, l’URL du point de terminaison d’API du fournisseur.
- Dans Modèle, entrez le nom du modèle principal (par exemple,
Sous Informations d’identification d’autorisation, sélectionnez comment Gestion des API s’authentifie auprès du serveur principal :
-
En-têtes : entrez un nom d’en-tête (par exemple,
api-keyouAuthorization) et la valeur d’en-tête correspondante (clé API ou secret). - Identité managée : pour les déploiements de modèles dans Azure, vous pouvez utiliser l'identité managée affectée par le système de l'instance ou une identité managée affectée par l'utilisateur pour s'authentifier auprès du serveur principal.
Pour obtenir une explication des paramètres de l’identité managée, consultez la référence de la stratégie d’identité managée d’authentification .
-
En-têtes : entrez un nom d’en-tête (par exemple,
Sous l’onglet Gérer la consommation de jetons , configurez éventuellement les stratégies suivantes pour surveiller et gérer l’utilisation des jetons :
Sous l’onglet Set up AI content safety , configurez éventuellement le service Azure AI Sécurité du Contenu pour bloquer les invites avec du contenu non sécurisé :
Sélectionnez Vérifier + créer, puis sélectionnez Créer.
Gérer les alias de modèle
Les alias de modèle fournissent aux clients un nom stable et indépendant du fournisseur qu’ils peuvent utiliser pour appeler un modèle. En affectant un alias comme gpt ou claude-sonnet, vous dissociez le nom du modèle côté client du déploiement principal réel. Lorsque vous mettez à niveau un modèle ou que vous souhaitez exécuter un test A/B, vous pouvez mettre à jour la cible d’alias sans aucune modification du code client.
Mettre à jour ou ajouter un alias de modèle
Pour mettre à jour un alias de modèle après avoir créé l’API de modèle unifiée :
- Dans le portail Azure, accédez à votre instance Gestion des API, puis sélectionnez APIs.
- Sélectionnez l’API de modèle unifié.
- Sélectionnez l’onglet Modèles pour mettre à jour ou ajouter un alias de modèle.
- Pour mettre à jour un alias côté client, sélectionnez l’alias que vous souhaitez mettre à jour, puis mettez à jour la configuration back-end pour spécifier le modèle principal. Ajoutez les informations d’identification d’autorisation pour le nouveau back-end.
- Pour ajouter un nouveau modèle, sélectionnez + Ajouter et configurer le back-end, l’autorisation et les paramètres client, comme décrit dans la section précédente.
- Cliquez sur Enregistrer.
Découvrir les alias de modèle
Les développeurs peuvent découvrir les modèles disponibles et leurs alias en appelant le /models point de terminaison de l’API de modèle unifié. Gestion des API retourne une liste de modèles avec leurs alias côté client.
Appeler l’API à partir d’une application cliente
Les applications clientes peuvent appeler l’API de modèle unifié à l’aide de n’importe quel Kit de développement logiciel (SDK) compatible OpenAI. Pointez l’URL de base du SDK sur votre point de terminaison Gestion des API et utilisez une clé d’abonnement Gestion des API ou une autre méthode d’authentification prise en charge pour l’authentification.
L’exemple suivant utilise le kit de développement logiciel (SDK) OpenAI Python et transmet une clé d’abonnement Gestion des API dans l’en-tête pour l’authentification. Le corps de la requête spécifie un alias de modèle côté client configuré dans Gestion des API, par exemple, gpt ou claude-sonnet. :
from openai import OpenAI
client = OpenAI(
base_url="https://<apim-instance>.azure-api.net/llm/v1",
api_key="<api-management-subscription-key>",
)
# Specify the client-facing model alias
response = client.chat.completions.create(
model="gpt", # or "claude-sonnet", "gemini", or any other configured alias
messages=[{"role": "user", "content": "What can you do?"}],
)
print(response.choices[0].message.content)
Pour basculer vers un autre modèle principal, modifiez uniquement la model valeur. Aucune autre modification de code n’est requise.
Contenu connexe
- Fonctionnalités de passerelle AI dans Gestion des API Azure
- Importer une API Microsoft Foundry
- Gérer la consommation des jetons LLM
- Suivre l’utilisation des jetons
- Appliquer les vérifications de sécurité du contenu sur les requêtes LLM
- Activer la mise en cache sémantique des réponses
- Serveurs principaux dans Gestion des API Azure