Omedelbar åtkomst till modeller i Microsoft Foundry (förhandsversion)

Med omedelbar åtkomst till modeller kan du anropa alla modeller som stöds med namn – ingen distribution krävs. Skapa ett Foundry-projekt, börja koda och använd valfri tillgänglig modell omedelbart.

Förutsättningar

  • Ett Azure-abonnemang. Skapa en kostnadsfritt.
  • Logga in på Microsoft Foundry. Kontrollera att växlingsknappen New Foundry är aktiverad. De här stegen hänvisar till Foundry (ny).
  • Ett Foundry-projekt i USA, västra 3 (den enda region som stöds för omedelbar åtkomst under förhandsversionen). Om du behöver skapa ett projekt kan du läsa Skapa ett projekt.
  • Rollen Foundry User i projektet eller kontot.

Important

Foundrys RBAC-roller har nyligen namnändrats. Foundry User, Foundry Owner, Foundry Account Owner och Foundry Project Manager hette tidigare Azure AI-användare, Azure AI-ägare, Azure AI-kontoägare och Azure AI Project Manager. Du kanske fortfarande ser de tidigare namnen på vissa platser medan namnbytet distribueras. Roll-ID:na och kärnbehörigheterna ändras inte av namnbytet.

Börja använda modeller direkt

Med omedelbar åtkomst är arbetsflödet enkelt – använd ett omedelbart modellnamn som stöds i koden. Ingen distribution krävs. Samma API, SDK och klient som du redan använder för distributioner fungerar med modeller för omedelbar åtkomst. Ingen andra SDK, ingen separat klient, inga konfigurationsändringar.

Stödet för omedelbar åtkomst fortsätter att utökas med tiden. Den exakta uppsättningen ändras ofta. Se Modeller som stöds för att se hela listan.

För parametern model använder du namnet på modellen för omedelbar åtkomst, till exempel "gpt-5-mini", i stället för ett distribuerat modellnamn.

import os

from azure.identity import DefaultAzureCredential
from azure.ai.projects import AIProjectClient

# Format: "https://resource_name.ai.azure.com/api/projects/project_name"
PROJECT_ENDPOINT = os.getenv("AZURE_AI_PROJECT_ENDPOINT", "your_project_endpoint")
MODEL_DEPLOYMENT = os.getenv("MODEL_DEPLOYMENT", "gpt-5-mini")

# Create project and openai clients to call Foundry API
project = AIProjectClient(
    endpoint=PROJECT_ENDPOINT,
    credential=DefaultAzureCredential(),
)
openai = project.get_openai_client()

# Run a responses API call
response = openai.responses.create(
    model=MODEL_DEPLOYMENT,
    input="What is the size of France in square miles?",
)
if not response.output_text or not response.output_text.strip():
    raise RuntimeError("Response output text was empty.")

print(f"Response output: {response.output_text}")

Testmiljö för modeller med direktåtkomst

Använd en av följande sökvägar för att komma till testmiljön för modeller med direktåtkomst:

  1. Välj Testa på lekplatsenfrån Start.
  2. Från Start väljer du Utforska modeller för att gå till modellkatalogen. Eller välj Identifiera>modeller. Båda sökvägarna öppnar katalogen.
  3. I modellkatalogen väljer du en omedelbar åtkomstmodell för att visa dess information.
  4. På informationssidan för en modell för direktåtkomst väljer du Öppna lekplats.
  5. Från en lekplats använder du listrutan Modell för att växla till andra omedelbar åtkomst eller distribuerade modeller.

Diagram över navigeringsvägar från Start till Lekplats, inklusive katalog- och modellvägar.

Varför omedelbar åtkomst är viktigt

  • Växla modeller genom att ändra en sträng – använd ett omedelbart modellnamn på model= raden, utan att skapa eller ta bort distributioner.
  • Samma API och SDK – samma anrop fungerar för både omedelbar åtkomst och distributioner.
  • Fungerar med dina utvecklingsverktyg – omedelbar åtkomst integreras med Foundry CLI-, VS Code- och CI/CD-pipelines på samma sätt som distributioner gör.

Distributioner försvinner inte. De är fortfarande rätt val när du behöver reserverat dataflöde, anpassade innehållsfilter, datahemvist eller avancerade företagskonfigurationer. Omedelbar åtkomst förenklar upplevelsen av att komma igång, så att driftsättningar blir något du växer in i, inte ett hinder du måste ta dig förbi innan du kan använda en modell.

Modeller som stöds

Nya modeller stöder omedelbar åtkomst som standard när de släpps. Produktteamet överväger att stödja ytterligare modeller baserat på kundernas efterfrågan. Listan växer med tiden och exempel på modeller som du kan se är:

  • chat-gpt-latest
  • gpt-5.6-sol
  • gpt-5.5
  • gpt-5-mini
  • gpt-5.3-codex

Så här ser du alla modeller som stöder omedelbar åtkomst:

  1. Öppna ett projekt i West US 3 i den nya Foundry-upplevelsen,
  2. Välj Identifiera i det övre högra navigeringsfönstret och sedan Modeller i det vänstra fönstret.
  3. I modellkatalogen väljer du Snabb under Distributionsalternativ för att visa tillgängliga modeller för omedelbar åtkomst.

Du kan också visa en lista över modeller för direktåtkomst programmatiskt:

SUBSCRIPTION_ID="<your-subscription-id>"
LOCATION="westus3"

az rest --method get \
  --url "https://management.azure.com/subscriptions/$SUBSCRIPTION_ID/providers/Microsoft.CognitiveServices/locations/$LOCATION/models?api-version=2025-06-01" \
  --output json \
| jq -r '(.value // .models // .)[]
  | select((.model.capabilities.instant // "false" | tostring | ascii_downcase) == "true")
  | .model.name' \
| sort -u

Note

Under förhandsversionen är modeller med direktåtkomst endast tillgängliga i projekt i West US 3.

Vissa modeller för omedelbar åtkomst kan visas i listan även om din prenumeration inte har någon kvot för dem. Mer information finns i Kvoter och gränser för Foundry-modeller.

När du ska använda omedelbar åtkomst jämfört med distributioner

Scenario Rekommenderat tillvägagångssätt
Komma igång, prototyper eller experimentering Omedelbar åtkomst
Använda den senaste modellen omedelbart efter lanseringen Omedelbar åtkomst
Behöver reserverad kapacitet eller förutsägbart dataflöde Deployment
Kräver etablerat dataflöde (PTU) Deployment
Behöver datahemvist i en viss region Deployment
Principer för anpassad innehållsfiltrering per modell Deployment
Anpassade skyddsräcken per modell Deployment
Slutpunktsspecifik konfiguration (till exempel versionslås per slutpunkt) Deployment
Finfördelad uppdelning av kvoter mellan team Deployment
Finjusterade modeller Deployment

Omedelbar åtkomst och distributioner kan samexistera i samma projekt. Du kan börja med omedelbar åtkomstmodell och skapa en distribution senare när dina krav utvecklas.

Modellversioner

Som standard använder omedelbar åtkomst den senaste vintergröna versionen av en modell. Om du vill fästa på en viss version lägger du till versionsdatumet i modellnamnet som ett bindestreckat suffix:

Det du skickar in som model Behavior
model-name Vägar till den senaste versionen
model-name-2025-04-01 Vägar till den specifika versionen

Versionslåsning är valfritt. Om programmet kräver stabilitet inkluderar du versionssuffixet. Annars får du alltid den senaste versionen automatiskt.

Så här används kvoten

Omedelbar åtkomst hämtas från en global kvotpool per modell som tilldelats din prenumeration. Den här kvoten är separat från den regionala kvot som används av standarddistributioner.

  • Du allokerar eller partitionerar inte global kvot – den delas automatiskt över all omedelbar modellanvändning i din prenumeration.
  • Global Standard-driftsättningar reserverar en del av din globala kvot. Modeller för omedelbar åtkomst använder den kapacitet som finns kvar.
  • Andra distributionstyper (regional standard, etablerad) använder separat regional kvot och påverkar inte din omedelbara modellkapacitet.
  • Om omedelbara modellbegäranden begränsas kan du begära en kvotökning eller skapa en distribution med reserverad kapacitet.

Mer information om hur globala och regionala kvoter interagerar finns i Hantera och öka kvoter.

Företagskontroller

Capability Så här fungerar det
Blockera specifika modeller eller leverantörer Azure Policy definitioner gäller för omedelbar åtkomst på samma sätt som för distributioner
Fäst på en modellversion Lägg till versionssuffixet i modellnamnet (se Modellversioner)
Inaktivera omedelbar åtkomst helt Administratörer kan inaktivera omedelbar åtkomst på prenumerationsnivå via Azure Policy

Om du vill ta bort omedelbar åtkomst från ett konto konfigurerar du inställningarna via Bicep eller ARM REST.

Uppdatera ditt konto med:

PATCH https://management.azure.com/subscriptions/{sub}/resourceGroups/{rg}/providers/Microsoft.CognitiveServices/accounts/{account}?api-version=2026-01-15-preview
Authorization: Bearer {arm_token}
Content-Type: application/json

Använd den här begärandetexten för att effektivt stänga av omedelbar modellåtkomst:

{
  "properties": {
    "instant": {
      "raiPolicyName": "Microsoft.DefaultV2",
      "modelAllowList": []
    }
  }
}

Important

Alla modeller för omedelbar åtkomst använder standardskyddsfilter och innehållsfilter. Du kan dock inte konfigurera anpassade skyddsräcken eller RAI-principer (Responsible AI) per modell för omedelbar åtkomst. Du kan ange en RAI-standardprincip på kontonivå via API:et, men den principen gäller enhetligt för alla modeller för omedelbar åtkomst. Om du behöver olika innehållsfiltreringsprinciper för enskilda modeller använder du en distribution.

Kollisioner med distributionsnamn

Nya distributioner kan inte använda ett namn som matchar ett befintligt modellnamn. Om du har en befintlig distribution vars namn kolliderar med ett modellnamn har distributionen företräde och omedelbar modellåtkomst för det modellnamnet är inte tillgänglig i projektet.

Begränsningar under förhandsversionen

  • Endast tillgängligt i West US 3.
  • Finjusterade modeller stöds inte. Skapa en distribution om du vill använda en finjusterad modell.
  • Skyddsräcken, anpassade RAI-principer och innehållsfilter kan inte konfigureras för omedelbar åtkomst.
  • Endast de modeller som anges i Modeller som stöds är berättigade.