Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
Med omedelbar åtkomst till modeller kan du anropa alla modeller som stöds med namn – ingen distribution krävs. Skapa ett Foundry-projekt, börja koda och använd valfri tillgänglig modell omedelbart.
Förutsättningar
- Ett Azure-abonnemang. Skapa en kostnadsfritt.
- Logga in på Microsoft Foundry. Kontrollera att växlingsknappen New Foundry är aktiverad. De här stegen hänvisar till Foundry (ny).
- Ett Foundry-projekt i USA, västra 3 (den enda region som stöds för omedelbar åtkomst under förhandsversionen). Om du behöver skapa ett projekt kan du läsa Skapa ett projekt.
- Rollen Foundry User i projektet eller kontot.
Important
Foundrys RBAC-roller har nyligen namnändrats. Foundry User, Foundry Owner, Foundry Account Owner och Foundry Project Manager hette tidigare Azure AI-användare, Azure AI-ägare, Azure AI-kontoägare och Azure AI Project Manager. Du kanske fortfarande ser de tidigare namnen på vissa platser medan namnbytet distribueras. Roll-ID:na och kärnbehörigheterna ändras inte av namnbytet.
Börja använda modeller direkt
Med omedelbar åtkomst är arbetsflödet enkelt – använd ett omedelbart modellnamn som stöds i koden. Ingen distribution krävs. Samma API, SDK och klient som du redan använder för distributioner fungerar med modeller för omedelbar åtkomst. Ingen andra SDK, ingen separat klient, inga konfigurationsändringar.
Stödet för omedelbar åtkomst fortsätter att utökas med tiden. Den exakta uppsättningen ändras ofta. Se Modeller som stöds för att se hela listan.
För parametern model använder du namnet på modellen för omedelbar åtkomst, till exempel "gpt-5-mini", i stället för ett distribuerat modellnamn.
import os
from azure.identity import DefaultAzureCredential
from azure.ai.projects import AIProjectClient
# Format: "https://resource_name.ai.azure.com/api/projects/project_name"
PROJECT_ENDPOINT = os.getenv("AZURE_AI_PROJECT_ENDPOINT", "your_project_endpoint")
MODEL_DEPLOYMENT = os.getenv("MODEL_DEPLOYMENT", "gpt-5-mini")
# Create project and openai clients to call Foundry API
project = AIProjectClient(
endpoint=PROJECT_ENDPOINT,
credential=DefaultAzureCredential(),
)
openai = project.get_openai_client()
# Run a responses API call
response = openai.responses.create(
model=MODEL_DEPLOYMENT,
input="What is the size of France in square miles?",
)
if not response.output_text or not response.output_text.strip():
raise RuntimeError("Response output text was empty.")
print(f"Response output: {response.output_text}")
Testmiljö för modeller med direktåtkomst
Använd en av följande sökvägar för att komma till testmiljön för modeller med direktåtkomst:
- Välj Testa på lekplatsenfrån Start.
- Från Start väljer du Utforska modeller för att gå till modellkatalogen. Eller välj Identifiera>modeller. Båda sökvägarna öppnar katalogen.
- I modellkatalogen väljer du en omedelbar åtkomstmodell för att visa dess information.
- På informationssidan för en modell för direktåtkomst väljer du Öppna lekplats.
- Från en lekplats använder du listrutan Modell för att växla till andra omedelbar åtkomst eller distribuerade modeller.
Varför omedelbar åtkomst är viktigt
-
Växla modeller genom att ändra en sträng – använd ett omedelbart modellnamn på
model=raden, utan att skapa eller ta bort distributioner. - Samma API och SDK – samma anrop fungerar för både omedelbar åtkomst och distributioner.
- Fungerar med dina utvecklingsverktyg – omedelbar åtkomst integreras med Foundry CLI-, VS Code- och CI/CD-pipelines på samma sätt som distributioner gör.
Distributioner försvinner inte. De är fortfarande rätt val när du behöver reserverat dataflöde, anpassade innehållsfilter, datahemvist eller avancerade företagskonfigurationer. Omedelbar åtkomst förenklar upplevelsen av att komma igång, så att driftsättningar blir något du växer in i, inte ett hinder du måste ta dig förbi innan du kan använda en modell.
Modeller som stöds
Nya modeller stöder omedelbar åtkomst som standard när de släpps. Produktteamet överväger att stödja ytterligare modeller baserat på kundernas efterfrågan. Listan växer med tiden och exempel på modeller som du kan se är:
chat-gpt-latestgpt-5.6-solgpt-5.5gpt-5-minigpt-5.3-codex
Så här ser du alla modeller som stöder omedelbar åtkomst:
- Öppna ett projekt i West US 3 i den nya Foundry-upplevelsen,
- Välj Identifiera i det övre högra navigeringsfönstret och sedan Modeller i det vänstra fönstret.
- I modellkatalogen väljer du Snabb under Distributionsalternativ för att visa tillgängliga modeller för omedelbar åtkomst.
Du kan också visa en lista över modeller för direktåtkomst programmatiskt:
SUBSCRIPTION_ID="<your-subscription-id>"
LOCATION="westus3"
az rest --method get \
--url "https://management.azure.com/subscriptions/$SUBSCRIPTION_ID/providers/Microsoft.CognitiveServices/locations/$LOCATION/models?api-version=2025-06-01" \
--output json \
| jq -r '(.value // .models // .)[]
| select((.model.capabilities.instant // "false" | tostring | ascii_downcase) == "true")
| .model.name' \
| sort -u
Note
Under förhandsversionen är modeller med direktåtkomst endast tillgängliga i projekt i West US 3.
Vissa modeller för omedelbar åtkomst kan visas i listan även om din prenumeration inte har någon kvot för dem. Mer information finns i Kvoter och gränser för Foundry-modeller.
När du ska använda omedelbar åtkomst jämfört med distributioner
| Scenario | Rekommenderat tillvägagångssätt |
|---|---|
| Komma igång, prototyper eller experimentering | Omedelbar åtkomst |
| Använda den senaste modellen omedelbart efter lanseringen | Omedelbar åtkomst |
| Behöver reserverad kapacitet eller förutsägbart dataflöde | Deployment |
| Kräver etablerat dataflöde (PTU) | Deployment |
| Behöver datahemvist i en viss region | Deployment |
| Principer för anpassad innehållsfiltrering per modell | Deployment |
| Anpassade skyddsräcken per modell | Deployment |
| Slutpunktsspecifik konfiguration (till exempel versionslås per slutpunkt) | Deployment |
| Finfördelad uppdelning av kvoter mellan team | Deployment |
| Finjusterade modeller | Deployment |
Omedelbar åtkomst och distributioner kan samexistera i samma projekt. Du kan börja med omedelbar åtkomstmodell och skapa en distribution senare när dina krav utvecklas.
Modellversioner
Som standard använder omedelbar åtkomst den senaste vintergröna versionen av en modell. Om du vill fästa på en viss version lägger du till versionsdatumet i modellnamnet som ett bindestreckat suffix:
Det du skickar in som model |
Behavior |
|---|---|
model-name |
Vägar till den senaste versionen |
model-name-2025-04-01 |
Vägar till den specifika versionen |
Versionslåsning är valfritt. Om programmet kräver stabilitet inkluderar du versionssuffixet. Annars får du alltid den senaste versionen automatiskt.
Så här används kvoten
Omedelbar åtkomst hämtas från en global kvotpool per modell som tilldelats din prenumeration. Den här kvoten är separat från den regionala kvot som används av standarddistributioner.
- Du allokerar eller partitionerar inte global kvot – den delas automatiskt över all omedelbar modellanvändning i din prenumeration.
- Global Standard-driftsättningar reserverar en del av din globala kvot. Modeller för omedelbar åtkomst använder den kapacitet som finns kvar.
- Andra distributionstyper (regional standard, etablerad) använder separat regional kvot och påverkar inte din omedelbara modellkapacitet.
- Om omedelbara modellbegäranden begränsas kan du begära en kvotökning eller skapa en distribution med reserverad kapacitet.
Mer information om hur globala och regionala kvoter interagerar finns i Hantera och öka kvoter.
Företagskontroller
| Capability | Så här fungerar det |
|---|---|
| Blockera specifika modeller eller leverantörer | Azure Policy definitioner gäller för omedelbar åtkomst på samma sätt som för distributioner |
| Fäst på en modellversion | Lägg till versionssuffixet i modellnamnet (se Modellversioner) |
| Inaktivera omedelbar åtkomst helt | Administratörer kan inaktivera omedelbar åtkomst på prenumerationsnivå via Azure Policy |
Om du vill ta bort omedelbar åtkomst från ett konto konfigurerar du inställningarna via Bicep eller ARM REST.
Uppdatera ditt konto med:
PATCH https://management.azure.com/subscriptions/{sub}/resourceGroups/{rg}/providers/Microsoft.CognitiveServices/accounts/{account}?api-version=2026-01-15-preview
Authorization: Bearer {arm_token}
Content-Type: application/json
Använd den här begärandetexten för att effektivt stänga av omedelbar modellåtkomst:
{
"properties": {
"instant": {
"raiPolicyName": "Microsoft.DefaultV2",
"modelAllowList": []
}
}
}
Important
Alla modeller för omedelbar åtkomst använder standardskyddsfilter och innehållsfilter. Du kan dock inte konfigurera anpassade skyddsräcken eller RAI-principer (Responsible AI) per modell för omedelbar åtkomst. Du kan ange en RAI-standardprincip på kontonivå via API:et, men den principen gäller enhetligt för alla modeller för omedelbar åtkomst. Om du behöver olika innehållsfiltreringsprinciper för enskilda modeller använder du en distribution.
Kollisioner med distributionsnamn
Nya distributioner kan inte använda ett namn som matchar ett befintligt modellnamn. Om du har en befintlig distribution vars namn kolliderar med ett modellnamn har distributionen företräde och omedelbar modellåtkomst för det modellnamnet är inte tillgänglig i projektet.
Begränsningar under förhandsversionen
- Endast tillgängligt i West US 3.
- Finjusterade modeller stöds inte. Skapa en distribution om du vill använda en finjusterad modell.
- Skyddsräcken, anpassade RAI-principer och innehållsfilter kan inte konfigureras för omedelbar åtkomst.
- Endast de modeller som anges i Modeller som stöds är berättigade.