Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
Anthropics Claude-modeller tillför avancerade funktioner för konversationsbaserad AI i Microsoft Foundry och erbjuder språkförståelse och textgenerering i toppklass för intelligenta applikationer. Claude-modeller utmärker sig på komplexa resonemang, kodgenerering och multimodala uppgifter, inklusive bildanalys. I den här artikeln beskrivs tillgängliga Claude-modeller, hur de hanteras och faktureras, API:er som stöds, funktioner, kvoter och metodtips.
Information om hur du distribuerar och anropar en Claude-modell finns i Distribuera och använda Claude-modeller i Microsoft Foundry.
Important
Objekt markerade (förhandsversion) i den här artikeln är för närvarande i offentlig förhandsversion. Den här förhandsversionen tillhandahålls utan ett serviceavtal och vi rekommenderar det inte för produktionsarbetsbelastningar. Vissa funktioner kanske inte stöds eller kan vara begränsade. Mer information finns i Kompletterande villkor för användning av Microsoft Azure-förhandsversioner.
Så här hanteras och faktureras Claude-modeller
Microsoft Foundry erbjuder Claude-modeller i två versioner:
- Version 1: Körs på Anthropic infrastruktur. Dessa modeller körs på Anthropic infrastruktur (utanför Azure).
- Version 2: Körs på Azure. Dessa modeller körs på Azure infrastruktur från slutpunkt till slutpunkt och är alla allmänt tillgängliga (GA).
Alla modeller är inte tillgängliga i båda versionerna. En modells livscykelsteg, till exempel Förhandsversion eller Allmänt tillgängligt, kan skilja sig mellan de två versionerna. För tillgänglighet per modell och livscykelstatus, se Tillgängliga Claude-modeller.
Om du vill jämföra båda alternativen för värdtjänst när det gäller datahemvist, SLA:er, supportvägar, regelefterlevnad och köpprocessen, se Jämförelse mellan Azure-värdbaserade och Anthropic-värdbaserade Claude-modeller.
Anmärkning
Du kommer åt Claude-modeller i Microsoft Foundry via Foundry Models från partner och community. Modeller från partner och community som Anthropic säljer och driver är icke-Microsoft produkter enligt produktvillkoren.
Claude-modeller i Foundry kräver en Azure Marketplace prenumeration och faktura via Claude Consumption Units (CCU). Se till att du har de behörigheter som krävs för att prenumerera på modellerbjudanden innan du distribuerar . Prisinformation finns i Claude Consumption Units (CCU)-fakturering i Microsoft Foundry.
Tillgängliga Claude-modeller
Important
Följande Claude-modeller följer EU:s vattenstämpelstandard : claude-mythos-5-1, claude-fable-5-1och claude-fable-5.
Medan claude-fable-5 använder vattenmärkning med en nyckel använder claude-mythos-5-1 och claude-fable-5-1 dubbla nycklar (sammanvävd 2-nyckelsteknik och C2PA) på följande sätt:
- Sammanflätade vattenstämplar för text (andra nyckeln): en andra nyckel läggs till för sammanvävd vattenstämpelidentifiering enligt EU:s standarder. Vattenmärkning sker på serversidan när innehållet genereras; det sker ingen ändring av formatet för begäranden eller svar. Ett separat API för identifiering av vattenstämplar är i tidig åtkomst och ingår inte i Foundry-startomfånget.
- C2PA-vattenmärkning: C2PA-märkning för innehållsursprung, hanteras på server- och klientsidan i Anthropics gränssnitt. Ingen API-formändring.
I följande tabell jämförs modelltillgängligheten för båda versionerna av Claude-modeller i Foundry. Mer information om de funktioner som refereras i tabellen finns i avsnittet Funktioner och avancerade funktioner .
Fel som kan uppstå när du distribuerar eller anropar Claude-modeller finns i Distribuera och använda Claude-modeller: Felsökning.
| Modell | Availability | Kontextfönster/Maxutdata | Viktiga funktioner | Bäst för |
|---|---|---|---|---|
claude-fable-5-1 |
|
1M /128K |
|
|
claude-fable-5 |
|
1M /128K |
|
|
claude-mythos-5-1
2 |
|
1M /128K |
|
|
claude-mythos-5
2 |
|
1M /128K |
|
|
claude-mythos-preview
2 |
|
1M /128K |
|
|
claude-opus-5 |
|
1M /128K |
|
|
claude-opus-4-8 |
|
1M /128K |
|
|
claude-opus-4-7 |
|
1M /128K |
|
|
claude-opus-4-6 |
|
1M /128K |
|
|
claude-opus-4-5 |
|
200 000/64 000 |
|
|
claude-sonnet-5 |
|
1M /128K |
|
|
claude-sonnet-4-6 |
|
1M /128K |
|
|
claude-sonnet-4-5 |
|
200 000/64 000 |
|
|
claude-haiku-4-5 |
|
200 000/64 000 |
|
|
1Claude Fable 5 och Claude Fable 5.1 tillämpar extra in- och utdataklassificerare som kan neka begäranden om innehållet utlöser skyddsprinciper med dubbla användningsområden. När en vägran inträffar returnerar begäran ett lyckat (200) svar med en avslagsindikator stop_reason: "refusal" i stället för modellgenererat innehåll. Du debiteras inte för indatatoken som nekas.
2Claude Mythos 5-1, Claude Mythos 5 och Claude Mythos Preview är endast tillgängliga som gated research preview. Åtkomst till modellerna beviljas endast enligt Anthropics eget gottfinnande och prioriteras för defensiva användningsfall inom cybersäkerhet. Se Claude Fable 5.1 & Claude Mythos 5.1 systemkort, Claude Mythos 5 systemkort och Claude Mythos Preview systemkort för ansvarsfull användning vägledning.
3 Arbetskontroller per tur, mellankonversation och tokenbudgetar är för närvarande i betatillstånd.
API-översikt
Följande tabell listar de API:er som du kan använda för att interagera med både Azure-värdbaserade och Anthropic-infrastrukturvärdbaserade versioner av Claude-modeller i Foundry.
Använd SDK:erna Anthropic och följande Claude-API:er:
Tip
Den version av Claude-modeller i Foundry som finns på Anthropics infrastruktur stöder fler API:er än de som anges i den här tabellen. Du kan se dem på sidan Claude API-dokumentation: API-översikt.
| API | Description |
|---|---|
Meddelanden1 (POST /v1/messages) |
API för kärnmeddelanden: Skicka en strukturerad lista över indatameddelanden med text- eller bildinnehåll, inklusive strömmande svar. Modellen genererar nästa meddelande i konversationen. |
Tokenräkning (POST /v1/messages/count_tokens) |
API för antal token: Räkna antalet token i ett meddelande innan du skickar det till Claude. |
1Du kan anropa API:et anthropic Meddelanden från Python-paketet, @anthropic-ai/foundry-sdk JavaScript-paketet eller direkt via REST. Distributionsändpunkten har formen https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, och REST- och JavaScript-klienter använder huvudet anthropic-version: 2023-06-01.
Funktioner och avancerade funktioner
Claude-modeller i Foundry exponerar kärnfunktioner för bearbetning, analys och generering av innehåll och verktyg som låter Claude interagera med externa system, köra kod och utföra automatiserade uppgifter. Claudes API-yta är uppdelad i fem områden:
Följande avsnitt och tabeller sammanfattar funktioner som är tillgängliga i versionerna Hosted on Azure och Hosted on Anthropic infrastructure av Claude-modeller i Foundry. Om inget anges gäller en funktion för båda versionerna.
Tip
Den värdbaserade Anthropic infrastrukturversionen av Claude-modeller i Foundry har stöd för fler funktioner än de som anges i dessa tabeller. Du kan se en fullständig lista över funktioner på Claude Platform Docs: Features overview( Översikt över funktioner).
Mer information om tillgängliga funktioner och avancerade funktioner för Claude-modeller i Foundry finns i Microsoft Developer-bloggen.
Modellfunktioner
Sätt att styra Claude och Claude:s direkta svar, inklusive svarsformat, resonemangsdjup och inmatningsmodaliteter.
| Feature | Description |
|---|---|
| Strömmande meddelanden | När du skapar ett Message anger du "stream": true för att strömma svaret stegvis med hjälp av serverskickade händelser (SSE). |
| Tänker | Förbättrade resonemangsfunktioner för komplexa uppgifter, vilket ger insyn i Claudes stegvisa tankeprocess innan den levererar sitt slutliga svar. Se Tänkande och ansträngning för thinking parametervärden per modell. |
| Anpassningsbart tänkande | Låt Claude dynamiskt bestämma när och hur mycket man ska tänka. Den här funktionen är det enda resonemangsläget i Claude 4.7 och senare modeller. Använd parametern effort för att styra tankedjupet. |
| Effort | Styr hur många token Claude använder i sina svar, med en avvägning mellan svarens utförlighet och effektiv tokenanvändning. Se Tänkande och ansträngning för effort parametervärden per modell. |
| Hänvisningar | Basera Claudes svar på källor, inklusive innehållsblock för sökresultatsearch_result. |
| Bilder och visioner | Bearbeta och analysera innehåll från bilder. I Azure-distributioner accepteras endast base64-kodade eller URL-baserade avbildningar. |
| PDF-stöd | Bearbeta och analysera text- och visuellt innehåll från PDF-dokument. Ange PDF-filer som base64 eller URL. |
| 1M-kontextfönster | Upp till 1 miljon token för bearbetning av stora dokument, omfattande kodbaser och långa konversationer. Support är beroende av om modellen är berättigad. |
| Strukturerade utdata | Begränsa Claudes svar så att de följer ett specifikt JSON-schema med hjälp av två kompletterande funktioner: JSON-utdata (parametern output_config.format ) för strukturerade svar och strikt verktygsanvändning (strict: true) för validerade verktygsindata. För distributioner Hosted on Azure stöder strukturerade utdata även den äldre parametern för JSON-utdata (parametern output_format). |
Tänkande och ansträngning
Funktionen Thinking tillåter specifika värden för thinking parametertypen, beroende på modell, enligt beskrivningen i följande tabell. Typen adaptive konfigurerar funktionen för anpassningsbart tänkande , så att modellen kan bestämma om den ska tänka, baserat på frågekomplexitet och ansträngningsnivå. Till exempel thinking={"type": "adaptive"}.
| Modell | adaptive |
enabled |
disabled |
|---|---|---|---|
claude-fable-5-1 |
Yes | No | No |
claude-fable-5 |
Yes | No | No |
claude-mythos-5-1 |
Yes | No | No |
claude-mythos-5 |
Yes | No | No |
claude-mythos-preview |
Yes | Yes | No |
claude-opus-5 |
Yes | No | Yes1 |
claude-opus-4-8 |
Yes | No | Yes |
claude-opus-4-7 |
Yes | No | Yes |
claude-opus-4-6 |
Yes | Yes | Yes |
claude-sonnet-5 |
Yes | No | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes |
1 Resonerande kan endast ske vid ansträngningsnivå disabled eller lägre high
Funktionen Ansträngning tillåter specifika effort nivåer för varje modell, enligt beskrivningen i följande tabell. Nivån xhigh ger samma resultat som max.
| Modell | low |
medium |
high |
xhigh |
max |
|---|---|---|---|---|---|
claude-fable-5-1 |
Yes | Yes | Yes | Yes | No |
claude-fable-5 |
Yes | Yes | Yes | Yes | No |
claude-mythos-5-1 |
Yes | Yes | Yes | Yes | No |
claude-mythos-5 |
Yes | Yes | Yes | Yes | No |
claude-opus-5 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-8 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-7 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-6 |
Yes | Yes | Yes | No | Yes |
claude-sonnet-5 |
Yes | Yes | Yes | Yes | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes | No | Yes |
Tools
Låt Claude vidta åtgärder på webben eller i din miljö. Den här funktionen består av inbyggda verktyg som Claude anropar via tool_use. Plattformen kör verktyg på serversidan och du implementerar och kör verktyg på klientsidan.
| Feature | Description |
|---|---|
| Verktygsanvändning med klientdrivna verktyg | Anpassade verktyg samt Anthropic-definierade bash, text editor, computer use och memory. Mer information om dessa verktyg finns i Bash, Textredigeraren, Datoranvändning och Minne. |
| Webbsökning | Upptäck aktuella verkliga data från hela webben som du kan använda för att utöka Claudes kunskaper. För Azure-värdbaserade distributioner stöds endast verktygsversionen web_search_20250305. |
| Webbhämtning | Hämta och utföra djupgående analys av fullständigt innehåll från angivna webbsidor och PDF-dokument, vilket utökar Claudes kontext med live-webbinnehåll. På Foundry kräver hämtning från webben en distribution som hostas på Anthropics infrastruktur. För Azure-värdbaserade distributioner stöds endast verktygsversionen web_fetch_20250910. |
Verktygsinfrastruktur
Identifiera, samordna och skala verktygsanvändning.
| Feature | Description |
|---|---|
| Detaljerad verktygsströmning | Stream-verktyget använder parametrar utan buffring eller JSON-validering, vilket minskar svarstiden för stora parametrar. Kräver sidhuvudet anthropic-betafine-grained-tool-streaming-2025-05-14. |
| MCP-anslutning | Anslut till fjärranslutna MCP-servrar direkt från Meddelande-API:et utan en separat MCP-klient. |
| Sök efter verktyg | Skala till tusentals verktyg genom att dynamiskt identifiera och läsa in verktyg på begäran med regex- och BM25-baserad sökning, optimera kontextanvändning och förbättra noggrannheten för val av verktyg. För distributioner som är Azure-värdbaserade stöds både verktygsversionerna tool_search_tool_bm25_20251119 och tool_search_tool_regex_20251119. De äldre aliasen tool_search_tool_bm25 och tool_search_tool_regex accepteras också. |
Innehållshantering
Kontrollera och optimera Claudes kontextfönster för långvariga sessioner.
| Feature | Description |
|---|---|
| Automatisk cachning av promptar | Förenkla promptcachelagring till en enda API-parameter. Systemet cachelagrar automatiskt det sista cachebara blocket i din begäran och flyttar cachepunkten framåt när konversationerna växer. |
| Fråga om cachelagring (5 m) | Ge Claude mer bakgrundskunskap och exempelutdata för att minska kostnader och svarstider. |
| Cachelagring av promptar (1 timme) | Utökad 1 timmes cachevaraktighet för mindre frekvent åtkomst men viktig kontext, som kompletterar standardcacheminnet på 5 minuter. |
| Kontextredigering | Hantera konversationskontext automatiskt med konfigurerbara strategier, inklusive att rensa verktygsresultat och hantera tankeblock. Kräver antropisk betarubrik context-management-2025-06-27. |
| Tokenräkning | Med tokenräkning kan du avgöra antalet token i ett meddelande innan du skickar det till Claude, så att du kan fatta välgrundade beslut om dina promptar och din användning. |
Filer och tillgångar
Hantera de dokument och data som du anger för Claude.
| Feature | Description |
|---|---|
| Api för filer | För närvarande endast tillgängligt på distributioner som driftas på Anthropics infrastruktur. Ladda upp och hantera filer som ska användas med Claude utan att ladda upp innehåll på nytt med varje begäran. Stöder PDF-filer, bilder och textfiler. |
Agentstöd
- Microsoft Agent Framework stöder skapande av agenter som använder Claude-modeller.
- Skapa anpassade AI-agenter med Claude Agent SDK.
Distributionstyper och -regioner
Claude-modeller i Foundry är tillgängliga för följande distributionstyper i specifika Azure regioner:
- Global Standard: Alla Claude-modeller (drivs på Azure och på Anthropics infrastruktur).
-
Data Zone Standard (USA): Finns på Azure versioner av
claude-opus-5,claude-opus-4-8ochclaude-sonnet-5.
Exakta Azure regioner där Claude-modeller är tillgängliga för distribution finns i Regiontillgänglighet efter distributionstyp.
Kvoter och hastighetsgränser
I det här avsnittet beskrivs hur distributioner delar kvot och vilka hastighetsgränser som gäller för dem. Hantering på prenumerationsnivå hanterar distributionskvoten. Resurser och regioner delar kvoten i stället för att allokera den separat för varje resurs eller region.
- Alla Global Standard-distributioner av samma modell och version i en prenumeration hämtas från en delad kvotpool i alla regioner.
- Alla Data Zone Standard-distributioner av samma modell och version i en prenumeration hämtas från en delad kvotpool inom varje datazon (till exempel USA).
Mer information om kvothantering för Foundry-modeller finns i Microsoft Foundry Models-kvoter och -gränser.
Cachemedveten ITPM
Claude-modeller i Foundry mäter hastighetsgränser i begäranden per minut (RPM), oåtkomliga indatatoken per minut (ITPM) och utdatatoken per minut (OTPM) för varje modell.
För de flesta Claude-modeller räknas endast indatatoken som inte cachelagrats in i dina ITPM-gränser. Dessa token omfattar:
Indatatoken — token i begäran efter den senaste cachebrytpunkten (indata som inte har cachats).
Indatatoken för att skapa cachen – token som skrivs till cachen, som består av:
- Cache-skrivning 5m TPM — token som skrivs till 5-minuters promptcache.
- Cacheskrivning 1h TPM – token som skrivs till 1‑timmes-cache för promptar.
Tip
Det totala antalet indatatoken är summan av indatatoken, cachegenereringsindatatoken och cacheläsningsindatatoken (token som läse från cacheminnet). Dock räknas indatatoken för läsning från cacheminnet inte in i ITPM. OTPM räknas inte heller mot ITPM.
Mer information om hastighetsbegränsningar och cacheminne finns i Claude API Docs: Hastighetsgränser.
Hastighetsbegränsningar per prenumerationstyp
Din Azure-prenumerationstyp avgör dina hastighetsgränser. Version 2: Hostad på Azure och Version 1: Hostad på Anthropics infrastruktur-kolumnerna anger om kvot är tillgänglig för den kombinationen av modell och distributionstyp. Ja innebär att kvoten är tillgänglig. N/A innebär att modell- och versionskombinationen inte har någon kvot för den distributionstypen.
I följande tabell visas hastighetsbegränsningar. Om du vill öka din kvot utöver standardgränserna skickar du en begäran via formuläret för begäran om kvotökning.
Betala efter hand
| Modell | Distributionstyp | Version 2: Värdhanterad på Azure | Version 1: Drivs på Anthropics infrastruktur | RPM | ITPM | OTPM |
|---|---|---|---|---|---|---|
| claude-fable-5-1 | Global Standard | N/A | Yes | 0 | 0 | 0 |
| claude-fable-5 | Global Standard | N/A | Yes | 0 | 0 | 0 |
| claude-opus-5 | Global Standard | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-opus-5 | Data Zone Standard (USA) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-opus-4-8 | Global Standard | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-8 | Data Zone Standard (USA) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-opus-4-7 | Global Standard | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-6 | Global Standard | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-opus-4-5 | Global Standard | N/A | Yes | 40 | 40,000 | 8,000 |
| claude-sonnet-5 | Global Standard | Yes | Yes | 40 | 40,000 | 8,000 |
| claude-sonnet-5 | Data Zone Standard (USA) | Yes | N/A | 40 | 40,000 | 8,000 |
| claude-sonnet-4-6 | Global Standard | N/A | Yes | 80 | 80,000 | 16,000 |
| claude-sonnet-4-5 | Global Standard | N/A | Yes | 80 | 80,000 | 16,000 |
| claude-haiku-4-5 | Global Standard | Yes | Yes | 80 | 80,000 | 16,000 |
Ansvarsfulla AI-överväganden
När du använder Claude-modeller i Foundry bör du överväga följande ansvarsfulla AI-metoder:
Granska Data, sekretess och säkerhet för Claude-modeller i Microsoft Foundry för att förstå hur dina data bearbetas och behålls när du distribuerar Claude-modeller.
Konfigurera AI-innehållssäkerhet under modellinferens eftersom Foundry inte tillhandahåller inbyggd innehållsfiltrering för Claude-modeller vid distributionstillfället.
Se till att dina program uppfyller Anthropic:s policy för godtagbar användning. Se även information om säkerhetsutvärderingar för Claude Fable 5.1 & Claude Mythos 5.1 , Claude Fable 5, Claude Mythos 5, Claude Mythos Preview, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5 och Claude Haiku 4.5.
Metodtips
Följ dessa metodtips när du arbetar med Claude-modeller i Foundry:
Promptteknik
- Tydliga instruktioner: Ange specifika och detaljerade frågor.
- Kontexthantering: Använd det tillgängliga kontextfönstret effektivt.
- Rolldefinitioner: Använd systemmeddelanden för att definiera assistentens roll och beteende.
- Strukturerade frågor: Använd konsekvent formatering för bättre resultat.
Kostnadsoptimering
Så här optimerar du din användning och undviker hastighetsbegränsning:
- Implementera logik för återförsök: Hantera 429 svar med exponentiell backoff.
- Batch-begäranden: Kombinera flera frågor när det är möjligt.
- Övervaka tokenanvändning: Spåra din tokenförbrukning och begärandemönster.
- Använd lämpliga modeller: Använd den mest kostnadseffektiva modellen för ditt användningsfall. Se Tillgängliga Claude-modeller.
Relaterat innehåll
- Distribuera och använda Claude-modeller i Microsoft Foundry
- Distribuera Claude-modeller i Microsoft Foundry med hjälp av Bicep eller Terraform
- Foundry-modeller från partner och gemenskapen
- Fakturering av Claude Consumption Units (CCU) i Microsoft Foundry
- Data, sekretess och säkerhet för Claude-modeller i Microsoft Foundry