Aperçu des niveaux de la passerelle IA (aperçu)

S’APPLIQUE AU : niveau AI Gateway (aperçu)

Important

Le niveau de service AI Gateway est actuellement en préversion publique. Lors de l’aperçu public, le niveau IA Gateway est disponible dans les régions suivantes :

  • États-Unis - USA Est 2
  • Europe - Suède centrale

AI Gateway tier (aperçu) d’Gestion des API Azure est une passerelle entièrement gérée pour les charges de travail IA. Il offre aux équipes un seul endroit pour publier, sécuriser, gouverner et observer l’accès aux modèles d’IA et aux outils du protocole de contexte modèle (MCP).

Le palier IA Gateway est en aperçu public. Les fonctionnalités de prévisualisation, les régions, les limites de service et les API peuvent changer avant la disponibilité générale. Les prix et le modèle économique seront annoncés plus tard dans l’aperçu.

Qu’est-ce que le niveau AI Gateway ?

Le niveau IA Gateway est une passerelle gérée pour les applications qui appellent des modèles et des outils. Les applications appellent un point de terminaison passerelle au lieu d’appeler directement chaque fournisseur ou outil en arrière-plan. Pour chaque requête, la passerelle :

  1. Authentifie la clé d’accès du runtime dans l’en-tête api-key.
  2. Évalue les politiques applicables au modèle ou à l’outil cible.
  3. Aligne la requête vers le backend sélectionné – par le model champ pour les modèles, ou le nom de l’outil pour les outils – en utilisant les identifiants backend que vous avez configurés.
  4. Retourne la réponse et émet des données de télémétrie — journaux et métriques OpenTelemetry, notamment le nombre de jetons et la latence.

Pourquoi l'utiliser ?

Le niveau IA Gateway offre aux équipes de plateforme une seule limite d’exécution régie pour les applications, modèles et outils. Utilisez-le pour :

  • Placez un seul point de terminaison de passerelle devant les fournisseurs d’IA pris en charge.
  • Gardez les identifiants du fournisseur masqués aux applications.
  • Gérer les modèles, les serveurs MCP, les clés d’accès à l’exécution, les politiques et la surveillance.
  • Appliquer des contrôles de gouvernance tels que les limites de débit de token, les limites de fréquence de requête, la sécurité du contenu et les filtres IP.
  • Publiez des outils MCP approuvés pour les agents IA.
  • Découvrez et utilisez les modèles et outils disponibles via un catalogue en libre-service.
  • Connectez-vous pour gérer la passerelle avec Microsoft Entra ID.

Choisir votre chemin

Démarrage rapide

Nouveau dans le palier IA Gateway ? Créez une passerelle, ajoutez un modèle, et passez votre premier appel dans environ 20 à 30 minutes.

Gérer les modèles et outils

Ajoutez Foundry et des modèles personnalisés, et publiez des serveurs d’outils MCP derrière un seul point de terminaison gouverné.

Gouverner, sécuriser et opérer

Appliquez des stratégies, une gestion des identités, la mise en réseau et la supervision pour un déploiement en production.

Concepts clés

Gateway

Une passerelle est la frontière d’exécution et de gestion du trafic IA. C'est une ressource Azure dédiée que vous pouvez provisionner en environ une minute, sans unités d'échelle à planifier. Les applications appellent un point de terminaison de passerelle unique avec une clé d’accès d’exécution au lieu d’appeler directement le backend de chaque fournisseur ou outil. Vous gérez les modèles, outils, politiques, clés et identité en un seul endroit.

Diagramme des applications, agents et agents de codage appelant le niveau de passerelle IA, qui authentifie la clé d’exécution, applique des politiques et émet des télémétries avant de renvoyer les requêtes vers les fournisseurs de modèles et les backends des outils MCP.

Modèles

Un modèle est un modèle de fournisseur que vous publiez via la passerelle. Les applications le sélectionnent par nom dans le champ de model la requête. Tous les fournisseurs compatibles OpenAI (Microsoft Foundry, Azure OpenAI, AWS Bedrock, Google Vertex et OpenAI) partagent un seul point de terminaison, .../models/openai/v1. La passerelle effectue le routage en fonction d’une correspondance exacte sur model, donc attribuez un nom unique à chaque modèle. Anthropic utilise un fournisseur personnalisé avec transmission directe via l’API Messages à .../models/anthropic/v1/messages. La passerelle détient les identifiants backend, donc les applications ne gèrent jamais les clés des fournisseurs.

Serveurs et outils MCP

Un serveur MCP est un point de terminaison régi (.../toolservers/<server-name>/mcp) que les agents appellent pour atteindre des outils. Il fédére un ou plusieurs backends provenant de trois sources : un serveur MCP distant (par URL), une spécification OpenAPI, ou un connecteur intégré (plus de 1 000 applications SaaS, sans serveur à héberger). Les opérations de chaque backend deviennent des outils. Vous choisissez comment la passerelle s’authentifie à chaque backend : Aucun, clé API, OAuth 2.0 ou identité gérée.

Policies

Une politique est un garde-fou à l’exécution que vous configurez sous forme de carte dans le portail, sans XML.

Policy Qu’est-ce qu’il contrôle ?
Sécurité du contenu Vérifications de sécurité des requêtes et des réponses.
Filtre IP Appels d’exécution depuis des plages de réseau client approuvées.
Limite du taux de jetons Débit de jeton pendant une minute roulante.
Limite de taux de demande Demande de volume pendant une minute roulante.

Clés d’identité et d’accès

Les administrateurs se connectent pour gérer la passerelle en utilisant Microsoft Entra ID. Les applications s’authentifient avec des clés d’accès à l’exécution – créez ces clés sur la page Clés du portail (Créer une clé API) et envoyez-les dans l’en-tête api-key . Une clé est limitée à la passerelle : elle donne accès à tous les modèles et outils. Pour les backends, la passerelle utilise une identité gérée là où il est disponible (donc aucun secret n’est stocké) ou une clé fournisseur que vous fournissez. Délivrez une clé par application et environnement, et accordez à chaque identité le moindre privilège.

Catalogue en libre-service

Les développeurs découvrent des modèles et des outils dans un catalogue libre-service – chacun avec des détails de connexion et des exemples – épinglent les favoris, et sautent partout avec la palette de commandes Ctrl+K (⌘K sur macOS).

Disponibilité régionale

Lors de l’aperçu public, le palier IA Gateway est disponible dans les régions Azure suivantes.

Geography Region
États-Unis Est des États-Unis 2
Europe Sweden Central

La disponibilité des régions peut varier selon l’abonnement, l’environnement cloud, la capacité, l’indicateur de fonctionnalité et la participation à la préversion. Si votre région cible n'est pas disponible dans le portail ou les outils de déploiement, sélectionnez une autre région de prévisualisation prise en charge ou contactez votre représentant Microsoft.

Choisissez la région qui correspond le mieux à vos utilisateurs, applications, backends d’IA et dépendances réseau. Si la passerelle reroute vers Azure OpenAI, Microsoft Foundry, modèles, APIs ou serveurs MCP, considérez aussi ces emplacements. La résidence des données dépend du chemin complet de requête, pas seulement de la région passerelle. Examinez où chaque composant est déployé, y compris la passerelle, les backends d’IA, les outils, les destinations de journalisation, les identités gérées et les applications clientes.

Questions fréquemment posées

Quand devrais-je utiliser AI Gateway Tier au lieu d’appeler directement les fournisseurs ?

Utilisez le niveau AI Gateway si vous souhaitez un point de terminaison régi devant de nombreux modèles et outils : clés centrales d’exécution au lieu des identifiants fournisseurs dans chaque application, politiques partagées (limites de jetons et requêtes, sécurité du contenu, filtres IP), télémétrie unifiée et catalogue libre-service. Si vous appelez un seul modèle depuis une application unique et que vous n’avez pas besoin de gouvernance ou d’identifiants centraux, appeler directement le fournisseur peut être plus simple.

Dois-je importer depuis Foundry ou ajouter un modèle personnalisé ?

Importez depuis Foundry lorsque votre modèle s'exécute dans une ressource Microsoft Foundry ou Azure OpenAI (Azure AI Services) ; l'assistant découvre les déploiements de la ressource pour vous. Ajoutez un modèle personnalisé pour AWS Bedrock, Google Vertex, OpenAI, Anthropic ou tout autre point de terminaison compatible OpenAI, où vous entrez vous-même le point de terminaison et les noms des modèles. Voir Gérer les modèles et outils.

Le niveau IA Gateway est-il prêt pour la production ?

Le niveau AI Gateway est en préversion publique : la disponibilité est fournie selon le principe du meilleur effort, sans contrat de niveau de service (SLA), et les API, workflows du portail, la télémétrie, les limites, les régions et les tarifs peuvent changer. Les quotas de version préliminaire peuvent limiter le nombre de modèles, d’outils et de clés d’accès à l’environnement d’exécution, ainsi que le débit de vos requêtes et de vos jetons ; les limites spécifiques seront publiées avant la disponibilité générale. Commencez par des charges de travail non critiques, des pilotes contrôlés et des plans de recul clairs.

Comment la tarification est-elle prise en compte lors de l’aperçu ?

Les prix et le modèle économique pour le niveau IA Gateway seront annoncés plus tard dans l’aperçu. Vous pouvez également payer pour des ressources associées que vous utilisez avec la passerelle, telles que les fournisseurs de modèles, les Insights d’applications, les plateformes de réseautage et d’observabilité.

Quelles régions sont disponibles ?

Le niveau AI Gateway est disponible dans l’Est US 2 et la Suède Centrale. Consultez la disponibilité régionale.

Comment mes données sont-elles gérées ?

Vous choisissez où va la télémétrie. Avec Application Insights, il reste dans votre abonnement Azure. Les autres destinations OpenTelemetry (OTLP) suivent votre configuration et les conditions du fournisseur. La télémétrie utilise les conventions sémantiques GenAI d’OpenTelemetry (le préfixe gen_ai.*). La résidence des données dépend du parcours complet des requêtes, donc placez la passerelle, les backends et les destinations de télémétrie dans les régions approuvées et impliquez vos équipes sécurité et confidentialité.

Le niveau AI Gateway supporte-t-il le réseau privé ?

Yes. L’intégration du Private Link entrant et du réseau virtuel sortant fait partie de l’aperçu public. Voir Configurer le réseau privé pour la configuration, le DNS et les limitations.

Quelle version d’API devrais-je utiliser pour l’automatisation ?

Utilisez la version 2026-05-01-previewde l’API de gestion des prévisualisations. Validez l’automatisation avant un déploiement général, car l’API est en aperçu.