Endpunkte für Microsoft Foundry-Modelle

Microsoft Foundry Models bietet Zugriff auf eine Vielzahl von Modellen von vielen Anbietern über einen einzelnen Endpunkt und einen Satz von Anmeldeinformationen. Mit dieser Funktion können Sie zwischen Modellen wechseln und sie in Ihrer Anwendung verwenden, ohne Codeänderungen vorzunehmen.

In diesem Artikel wird erläutert, wie die Foundry-Dienste Modelle organisieren und wie Sie den Ableitungsendpunkt verwenden, um darauf zuzugreifen.

Voraussetzungen

Bereitstellungen

Foundry verwendet Deployments als Aliase für den Zugriff auf Modelle. Eine Bereitstellung gibt einem Modell einen Namen und eine Reihe von Konfigurationen. Sie greifen auf ein Modell zu, indem Sie in Ihren Anfragen dessen Bereitstellungsnamen verwenden.

Eine Bereitstellung definiert Folgendes:

  • Ein Modellname
  • Eine Modellversion
  • Bereitstellungs- oder Kapazitätstyp1
  • Konfiguration der Inhaltsfilterung1
  • Eine Ratenbegrenzungskonfiguration1

1 Diese Konfigurationen können sich je nach ausgewähltem Modell ändern.

Eine Foundry-Ressource kann viele Modellimplementierungen aufweisen. Sie zahlen nur für Rückschlüsse, die für Modellbereitstellungen ausgeführt wurden. Bereitstellungen sind Azure Ressourcen, sodass sie Azure Richtlinien unterliegen.

Weitere Informationen zum Erstellen von Bereitstellungen finden Sie unter Hinzufügen und Konfigurieren von Modellbereitstellungen.

Azure OpenAI-Inference-Endpunkt

Die Azure OpenAI-API macht die vollständigen Funktionen von OpenAI-Modellen verfügbar und unterstützt weitere Features wie Assistenten, Threads, Dateien und Batcheinschluss. Sie können es auch verwenden, um auf Nicht-OpenAI-Modelle zuzugreifen.

Azure OpenAI-Endpunkte haben das Format https://<resource-name>.openai.azure.com. Endpunkte sind Bereitstellungen zugeordnet, und jede Bereitstellung verfügt über eine eigene URL. Sie können jedoch denselben Authentifizierungsmechanismus verwenden, um mehrere Bereitstellungen zu nutzen. Weitere Informationen finden Sie auf der Referenzseite für Azure OpenAI-API.

Eine Illustration, die zeigt, wie Azure OpenAI-Bereitstellungen eine eindeutige URL für jede Bereitstellung enthalten.

Bereitstellungs-URLs werden durch Verketten der Azure OpenAI-Basis-URL und der Route /deployments/<model-deployment-name>gebildet. Wenn Sie die OpenAI v1-API verwenden, rufen Sie die /openai/v1/ Route auf der Basis-URL auf, https://<resource-name>.openai.azure.com/openai/v1/und übergeben Sie den Bereitstellungsnamen im model Feld Ihrer Anforderung. Die /openai/v1/-Route verwendet implizite Versionierung, sodass Sie kein api-version übergeben.

In den folgenden Beispielen wird die Antwort-API verwendet, die die neuesten Rückschlussfunktionen unterstützt.

Note

Die Antwort-API funktioniert mit Azure OpenAI-Modellen und mit Foundry-Modellen, die von Azure verkauft werden, die es unterstützen, z. B. DeepSeek-, Llama- und Grok-Modelle. Wenn eine Bereitstellung die Antwort-API nicht unterstützt, wird die Anforderung zurückgegeben 400 Model not supported. Verwenden Sie in diesem Fall die Chatabschluss-API, indem Sie stattdessen aufrufen client.chat.completions.create .

Verwenden der API-Schlüsselauthentifizierung

Sie können Rückschlussanforderungen mit einem API-Schlüssel aus Ihrer Foundry-Ressource authentifizieren. API-Schlüssel sind schnell einzurichten, aber sie gewähren vollzugriff auf die Ressource, sind schwer auf bestimmte Benutzer oder Aktionen zu beschränken und erfordern eine manuelle Drehung, um sicher zu bleiben. Verwenden Sie für Produktionsworkloads stattdessen die schlüssellose Authentifizierung mit Microsoft Entra ID.

Im folgenden Beispiel deepseek-v3-0324 ist der Name einer Modellbereitstellung in der Microsoft Foundry-Ressource. Ersetzen Sie ihn durch Ihren eigenen Bereitstellungsnamen, und speichern Sie Ihren API-Schlüssel in der AZURE_INFERENCE_CREDENTIAL Umgebungsvariable.

Installieren Sie das openai Paket mithilfe von pip:

pip install openai --upgrade

Erstellen Sie einen Client, der auf den Azure OpenAI v1-Endpunkt verweist, und generieren Sie dann eine Antwort. Die /openai/v1/-Route verwendet implizite Versionierung, sodass Sie kein api-version übergeben. Geben Sie Ihren Deployment-Namen im Feld model ein:

import os
from openai import OpenAI

client = OpenAI(
    base_url="https://<resource>.openai.azure.com/openai/v1/",
    api_key=os.environ["AZURE_INFERENCE_CREDENTIAL"],
)

response = client.responses.create(
    model="deepseek-v3-0324",  # Replace with your model deployment name.
    input="Explain the Riemann hypothesis in one paragraph.",
)

print(response.output_text)

Weitere Informationen zur Verwendung des Azure OpenAI-Endpunkts finden Sie unter Azure OpenAI SDK-Sprachunterstützung.

Verwenden der schlüssellosen Authentifizierung

Bereitgestellte Foundry Models unterstützen die schlüssellose Autorisierung mit Microsoft Entra ID. Die schlüssellose Autorisierung verbessert die Sicherheit, vereinfacht die Benutzererfahrung, verringert die Betriebskomplexität und bietet eine robuste Complianceunterstützung. Verwenden Sie schlüssellose Autorisierung, wenn Ihre Organisation sichere und skalierbare Identitätsverwaltungslösungen verwendet.

Um die schlüssellose Authentifizierung zu verwenden, konfigurieren Sie Ihre Ressource, und gewähren Sie Benutzern Zugriff auf die Durchführung von Rückschlüssen. Nachdem Sie die Ressource konfiguriert und Zugriff gewährt haben, authentifizieren Sie sich wie folgt:

Installieren Sie das OpenAI SDK mit einem Paket-Manager wie pip:

pip install openai

Installieren Sie für Microsoft Entra ID Authentifizierung auch Folgendes:

pip install azure-identity

Verwenden des Pakets, um das Modell zu nutzen. Das folgende Beispiel zeigt, wie Sie einen Client erstellen und mithilfe von Microsoft Entra ID und Ihrer Modellbereitstellung einen Testaufruf für die Responses-API ausführen.

Ersetzen Sie <resource> durch den Namen Ihrer Foundry-Ressource. Suchen Sie es im Azure-Portal oder indem Sie az cognitiveservices account list ausführen. Ersetzen Sie deepseek-v3-0324 durch Ihren tatsächlichen Bereitstellungsnamen.

from openai import OpenAI
from azure.identity import DefaultAzureCredential, get_bearer_token_provider

token_provider = get_bearer_token_provider(
    DefaultAzureCredential(), 
    "https://ai.azure.com/.default"
)

client = OpenAI(
    base_url="https://<resource>.openai.azure.com/openai/v1/",
    api_key=token_provider,
)

response = client.responses.create(
    model="deepseek-v3-0324",  # Replace with your model deployment name.
    input="What is Azure AI?",
)

print(response.output_text)

Erwartete Ausgabe

Azure AI is a comprehensive suite of artificial intelligence services and tools from Microsoft that enables developers to build intelligent applications. It includes services for natural language processing, computer vision, speech recognition, and machine learning capabilities.

Referenz: OpenAI Python SDK und DefaultAzureCredential-Klasse.