Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
GÄLLER FÖR: Utvecklare | Grundläggande | Basic v2 | Standard | Standard v2 | Premium | Premium v2
Du kan skapa ett enhetligt modell-API i Azure API Management för att exponera flera LLM-serverdelar via en enda klientriktad slutpunkt. Klientprogram använder ett välbekant API-format – API:et för slutförande av OpenAI-chatt – medan API Management automatiskt översätter begäranden till serverdelsmodellerna med hjälp av API:et för slutförande av OpenAI-chatt eller api för Anthropic-meddelanden.
Note
DET enhetliga modell-API:et är i förhandsversion och lanseras för närvarande till kunder. På de klassiska nivåerna är tidig åtkomst till den här funktionen tillgänglig via ai-gatewayens tidiga lanseringskanal.
Genom att centralisera modellåtkomsten bakom ett enda API-lager kan du:
- Standardisera på ett enda API-format för klienter oberoende av de format som används av serverdelsmodeller.
- Förena observerbarhet, säkerhet och styrning med principer mellan modellleverantörer.
- Konfigurera modellredundans mellan modellprovidrar.
- Frikoppla klientriktade modellnamn från serverdelsmodellnamn med hjälp av alias.
Mer information om hur du hanterar AI-API:er i API Management finns i AI-gatewayfunktioner i Azure API Management.
Backendar som stöds
API:et för enhetlig modell stöder följande serverdels-API-format:
- API för slutförande av OpenAI-chatt
- API för antropiska meddelanden
Förutsättningar
- En befintlig API Management-instans. Skapa en om du inte redan har gjort det.
- En eller flera modelldriftsättningar i en backend som stöds.
- För att spåra tokenanvändning via API:et, se Skicka anpassade mätvärden för information om förutsättningarna.
- Om du vill tillämpa innehållssäkerhetskontroller på API:et finns information om förutsättningarna i Tillämpa innehållssäkerhetskontroller på LLM-begäranden.
Skapa ett enhetligt modell-API – Azure portalen
Använd följande steg för att skapa ett enhetligt modell-API i API Management.
När du skapar API:et konfigurerar API Management automatiskt:
- En
/modelsslutpunkt för modellidentifiering som visar alla konfigurerade modeller. - En enda routningsslutpunkt, till exempel
/llm/v1/chat/completionssom accepterar begäranden i formatet OpenAI Chat Completions. - Formatera översättningslogik för varje serverdelsmodell som du lägger till.
- Serverdelsresurser som dirigerar begäranden till rätt providerslutpunkt.
Så här skapar du ett enhetligt modell-API:
I Azure-portalen går du till din API Management-instans.
I sidomenyn under API:er väljer du Modeller>+ Lägg till>API för enhetlig modell.
På fliken Konfigurera api för enhetlig modell :
- Ange ett visningsnamn för API:et. API Management genererar automatiskt ett API-namn baserat på visningsnamnet, men du kan redigera det om du vill.
- I API-sökvägen anger du den sökväg som klienter använder för att anropa API:et. Standardvärdet är
/llm/v1, vilket resulterar i en slutpunkt för chattens slutförande på/llm/v1/chat/completions. - Du kan också välja en eller flera produkter som ska associeras med API:et.
- Klicka på Nästa.
På fliken Konfigurera modeller väljer du + Lägg till för att öppna fönstret Lägg till modell och konfigurerar sedan följande inställningar för varje modelldistribution:
Under Backend-konfiguration:
- I Modell anger du namnet på serverdelsmodellen (till exempel
gpt-4oellerclaude-sonnet-4.6). - I API-format väljer du det format som serverdelsmodellen förväntar sig, till exempel OpenAI Chat Completions API eller Anthropic Messages API.
- I URL anger du serverdelsslutpunktens URL, till exempel en modelldistribution i Foundry eller, för andra leverantörer, leverantörens API-slutpunkts-URL.
- I Modell anger du namnet på serverdelsmodellen (till exempel
Under Autentiseringsuppgifter för auktorisering väljer du hur API Management autentiserar till serverdelen:
-
Rubriker: Ange ett rubriknamn (till exempel
api-keyellerAuthorization) och motsvarande rubrikvärde (din API-nyckel eller hemlighet). - Hanterad identitet: För modelldistributioner i Azure kan du använda instansens systemtilldelade hanterade identitet eller en användartilldelad hanterad identitet för att autentisera till serverdelen.
En beskrivning av inställningarna för den hanterade identiteten finns i referensen för principen authentication-managed-identity.
-
Rubriker: Ange ett rubriknamn (till exempel
På fliken Hantera tokenförbrukning kan du välja att konfigurera följande principer för att övervaka och hantera tokenanvändning:
På fliken Set up AI content safety kan du konfigurera Azure AI Innehållsäkerhet-tjänsten för att blockera frågor med osäkert innehåll:
Välj Granska + skapaoch välj sedan Skapa.
Hantera modellalias
Modellalias ger klienter ett stabilt, providerneutralt namn att använda när en modell anropas. Genom att tilldela ett alias som gpt eller claude-sonnetfrikopplar du det klientriktade modellnamnet från den faktiska serverdelsdistributionen. När du uppgraderar en modell eller vill köra ett A/B-test kan du uppdatera aliasmålet utan några ändringar i klientkoden.
Uppdatera eller lägga till ett modellalias
Så här uppdaterar du ett modellalias när du har skapat api:et för enhetlig modell:
- I Azure-portalen går du till din API Management-instans och väljer sedan APIs.
- Välj API:et för enhetlig modell.
- Välj fliken Modeller för att uppdatera eller lägga till ett modellalias.
- Om du vill uppdatera ett klientanslutet alias väljer du det alias som du vill uppdatera och uppdaterar sedan serverdelskonfigurationen för att ange serverdelsmodellen. Lägg till auktoriseringsuppgifter för den nya backenden.
- Om du vill lägga till en ny modell väljer du + Lägg till och konfigurerar serverdels-, auktoriserings- och klientinställningarna enligt beskrivningen i föregående avsnitt.
- Välj Spara.
Upptäck modellalias
Utvecklare kan identifiera tillgängliga modeller och deras alias genom att anropa slutpunkten för /models API:et för enhetlig modell. API Management returnerar en lista över modeller med sina klientriktade alias.
Anropa API:et från ett klientprogram
Klientprogram kan anropa API:et för enhetlig modell med hjälp av alla OpenAI-kompatibla SDK:er. Peka SDK:ns bas-URL på API Management-slutpunkten och använd en API Management-prenumerationsnyckel eller en annan autentiseringsmetod som stöds för autentisering.
I följande exempel används OpenAI:s Python-SDK, och en API Management-prenumerationsnyckel skickas i headern för autentisering. Begärandetexten anger ett klientanslutet modellalias som konfigurerats i API Management, till exempel gpt eller claude-sonnet.:
from openai import OpenAI
client = OpenAI(
base_url="https://<apim-instance>.azure-api.net/llm/v1",
api_key="<api-management-subscription-key>",
)
# Specify the client-facing model alias
response = client.chat.completions.create(
model="gpt", # or "claude-sonnet", "gemini", or any other configured alias
messages=[{"role": "user", "content": "What can you do?"}],
)
print(response.choices[0].message.content)
Om du vill växla till en annan serverdelsmodell ändrar du bara värdet model . Inga andra kodändringar krävs.