Claude-modellen in Microsoft Foundry

De Claude-modellen van Anthropic brengen geavanceerde mogelijkheden voor conversationele AI naar Microsoft Foundry en bieden toonaangevend taalbegrip en tekstgeneratie voor intelligente toepassingen. Claude modellen excelleren bij complexe redenering, het genereren van code en multimodale taken, waaronder afbeeldingsanalyse. In dit artikel worden de beschikbare Claude-modellen beschreven, hoe ze worden gehost en gefactureerd, ondersteunde API's, mogelijkheden, quota en aanbevolen procedures.

Zie Claude-modellen implementeren en gebruiken in Microsoft Foundry om een Claude-model te implementeren en aan te roepen.

Belangrijk

Items die in dit artikel zijn gemarkeerd (preview) zijn momenteel beschikbaar als openbare preview. Deze preview wordt aangeboden zonder een service level agreement en we raden deze niet aan voor productieworkloads. Bepaalde functies worden mogelijk niet ondersteund of hebben mogelijk beperkte mogelijkheden. Zie Aanvullende gebruiksvoorwaarden voor Microsoft Azure Previews voor meer informatie.

Hoe Claude-modellen worden gehost en gefactureerd

Microsoft Foundry biedt Claude-modellen in twee versies:

  • Versie 1: gehost op Anthropic infrastructuur; deze modellen worden uitgevoerd op de infrastructuur van Anthropic (buiten Azure).
  • Versie 2: gehost op Azure; deze modellen worden uitgevoerd op Azure infrastructuur end-to-end en zijn allemaal algemeen beschikbaar (GA).

Niet alle modellen zijn beschikbaar in beide versies. De levenscyclusfase van een model, zoals Preview of Algemeen beschikbaar, kan verschillen tussen de twee versies. Zie Beschikbare Claude-modellen voor beschikbaarheid per model en levenscyclusstatus.

Als u zowel hostingopties wilt vergelijken voor gegevenslocatie, SLA's, ondersteuningspaden, naleving en aankoopstroom, raadpleegt u Compare Azure-hosted en Anthropic-hosted Claude-modellen.

Note

U hebt toegang tot Claude-modellen in Microsoft Foundry via Foundry Models van partners en community. Modellen van partners en community's die Anthropic verkoopt en werkt, zijn niet-Microsoft Producten onder de Productvoorwaarden.

Claude-modellen in Foundry vereisen een abonnement op Azure Marketplace en worden gefactureerd via Claude Consumption Units (CCU). Zorg ervoor dat u over de vereiste machtigingen beschikt om u te abonneren op modelaanbiedingen voordat u implementeert. Zie CCU-facturering (Claude Consumption Units) in Microsoft Foundry voor meer informatie over prijzen.

Beschikbare Claude-modellen

Belangrijk

De volgende Claude-modellen voldoen aan de eu-watermerkstandaard : claude-mythos-5-1, claude-fable-5-1en claude-fable-5. Hoewel claude-fable-5 watermerken met één sleutel gebruikt, gebruiken claude-mythos-5-1 en claude-fable-5-1 een dubbele sleutel (verweven 2-key en C2PA), als volgt:

  • Interwoven tekstwatermerken (tweede sleutel): er wordt een tweede sleutel toegevoegd voor de detectie van onderling gewoven watermerken volgens eu-normen. Watermerken vindt plaats aan de serverzijde tijdens het genereren; er is geen wijziging in aanvraag- of antwoordshapes. Een afzonderlijke API voor watermerkdetectie bevindt zich in vroege toegang en maakt geen deel uit van het launch-bereik van Foundry.
  • C2PA-watermarking: C2PA-markering van inhoudsherkomst, afgehandeld aan server-/clientzijde door interfaces van Anthropic. De vorm van de API verandert niet.

De volgende tabel vergelijkt de beschikbaarheid van modellen voor beide versies van Claude-modellen in Foundry. Zie de sectie Mogelijkheden en geavanceerde functies voor meer informatie over de functies waarnaar in de tabel wordt verwezen.

Voor fouten die kunnen optreden wanneer u Claude-modellen implementeert of aanroept, raadpleegt u Claude-modellen implementeren en gebruiken: Probleemoplossing.

Model Availability Contextvenster/Maximale uitvoer Belangrijkste mogelijkheden Ideaal voor
claude-fable-5-1
  • Gehost op de infrastructuur van Anthropic: Preview
1M / 128K
  • Adaptief denken
  • Langlopend werk
  • Wetenschappelijk onderzoek met zelfverificatie
  • Kenniswerk; het uitvoeren van uitdagend kenniswerk met minder direct toezicht
  • Weigering stop_reason inzake beleid voor dubbele gebruiksbescherming1
  • Bekijk wat er nieuw is in Claude Fable 5.1 en Claude Mythos 5.1
  • Langlopende agents
  • Coderen en agents, met diepere redenering voor bedrijfswerkstromen
  • Algemene wetenschap en onderzoek
  • Financiële analyse
  • Visie
claude-fable-5
  • Gehost op de infrastructuur van Anthropic: Preview
1M / 128K
  • Adaptief denken
  • Redeneren over volledige codebases en projectcontext met meerdere dagen
  • Langer zelfstandig werk dan een eerder Claude-model
  • Zelfverificatie
  • Orkestratie van sub-agenten
  • Weigering stop_reason inzake beleid voor dubbele gebruiksbescherming1
  • Zie Migreren naar Claude Fable 5.1 en Claude Mythos 5.1
  • Cybersecurity
  • Autonoom programmeren
  • Langlopende agents
  • Coderen en agents, met diepere redenering voor bedrijfswerkstromen
claude-mythos-5-1 2
  • Gehost op de infrastructuur van Anthropic: onderzoekspreview met beperkte toegang
1M / 128K
  • Biologie en levenswetenschappen
  • Cyberbeveiliging (met prioriteit voor defensieve toepassingsgevallen): het opsporen van kwetsbaarheden, het auditen van het aanvalsoppervlak, red teaming, dreigingsinformatie
  • Autonoom programmeren
  • Langlopende agents
claude-mythos-5 2
  • Gehost op de infrastructuur van Anthropic: onderzoekspreview met beperkte toegang
1M / 128K
  • Biologie en levenswetenschappen
  • Cyberbeveiliging (met prioriteit voor defensieve toepassingsgevallen): het opsporen van kwetsbaarheden, het auditen van het aanvalsoppervlak, red teaming, dreigingsinformatie
  • Autonoom programmeren
  • Langlopende agents
claude-mythos-preview 2
  • Gehost op de infrastructuur van Anthropic: onderzoekspreview met beperkte toegang
1M / 128K
  • Cyberbeveiliging (defensieve toepassingsgevallen krijgen prioriteit)
  • Autonoom programmeren
  • Langlopende agents
claude-opus-5
  • Gehost op Azure: GA
  • Gehost op de infrastructuur van Anthropic: GA
1M / 128K
  • Adaptief denken met xhigh en max inspanningsniveaus
  • Redeneren over volledige codebases en projectcontext met meerdere dagen
  • Besturingselementen voor inspanning per beurt3
  • Middengesprek3role:"system"
  • Tokenbudgetten3 (task_budget)
  • Bekijk wat er nieuw is in Claude Opus 5
  • Intelligentie op Near-Fable-niveau voor langetermijn-codeertaken en complexe agentische orkestratie.
  • Langlopende agents
  • Bedrijfswerkstromen
  • Financiële analyse
  • Computergebruik
claude-opus-4-8
  • Gehost op Azure: GA
  • Gehost op de infrastructuur van Anthropic: GA
1M / 128K
  • Adaptief denken met inspanningsniveau xhigh
  • Redeneren over volledige codebases en projectcontext met meerdere dagen
  • Afbeeldingsinvoer met hoge resolutie (tot 2576px / 3,75MP)
  • Zie Migreren naar Claude Opus 5
  • Coding
  • Langlopende agents
  • Financiële analyse
  • Cybersecurity
  • Computergebruik
claude-opus-4-7
  • Gehost op de infrastructuur van Anthropic: GA
1M / 128K
  • Adaptief denken
  • Redeneren over volledige codebases
  • Afbeeldingsinvoer met hoge resolutie (tot 2576px / 3,75MP)
  • Zie Migreren naar Claude Opus 5
  • Coding
  • Bedrijfswerkstromen
  • Langlopende agents
  • Multimodaal redeneervermogen
  • Financiële analyse
  • Cybersecurity
claude-opus-4-6
  • Gehost op de infrastructuur van Anthropic: GA
1M / 128K
  • Adaptief denken
  • Afbeelding en tekstinvoer
  • Computergebruik
  • Geavanceerd hulpprogrammagebruik (zoeken, programmatisch aanroepen, voorbeelden)
  • Zie Migreren naar Claude Opus 5
  • Coding
  • Ondernemingsagents
claude-opus-4-5
  • Gehost op de infrastructuur van Anthropic: GA
200K / 64K
  • Denkvorming uitbreiden
  • Afbeelding en tekstinvoer
  • Computergebruik
  • Geavanceerd hulpprogrammagebruik (zoeken, programmatisch aanroepen, voorbeelden)
  • Zie Migreren naar Claude Opus 5
  • Coding
  • Agenten
  • Computergebruik
  • Bedrijfswerkstromen
claude-sonnet-5
  • Gehost op Azure: GA
  • Gehost op de infrastructuur van Anthropic: GA
1M / 128K
  • Adaptief denken
  • xhigh inspanningsniveau
  • Redeneren over volledige codebases en projectcontext met meerdere dagen
  • Afbeeldingsinvoer met hoge grootte (maximaal 2576px/3,75MP) is standaard ingeschakeld
  • Middengesprek3role:"system"
  • Tokenbudgetten3 (task_budget)
  • Bekijk wat er nieuw is in Claude Sonnet 5
  • Coding
  • Langlopende agents
  • Financiële analyse
  • Cybersecurity
  • Computergebruik
claude-sonnet-4-6
  • Gehost op de infrastructuur van Anthropic: GA
1M / 128K
  • Adaptief denken
  • Afbeelding en tekstinvoer
  • Computergebruik
  • Geavanceerd hulpprogrammagebruik (zoeken, programmatisch aanroepen, voorbeelden)
  • Zie Migreren naar Claude Sonnet 5
  • Coding
  • Agenten
  • Bedrijfswerkstromen
claude-sonnet-4-5
  • Gehost op de infrastructuur van Anthropic: GA
200K / 64K
  • Agents en complexe taken met een lange horizon
  • Workloads met een groot volume
claude-haiku-4-5
  • Gehost op Azure: GA
  • Gehost op de infrastructuur van Anthropic: GA
200K / 64K
  • Denkvorming uitbreiden
  • Afbeelding en tekstinvoer
  • Coding
  • Agenten

1Claude Fable 5 en Claude Fable 5.1 passen extra invoer-/uitvoerclassificaties toe die aanvragen kunnen weigeren als de inhoud een beveiligingsbeleid voor dubbel gebruik activeert. Wanneer er een weigering plaatsvindt, retourneert de aanvraag een geslaagd (200) antwoord met een weigeringsindicator stop_reason: "refusal" in plaats van door het model gegenereerde inhoud. U wordt niet gefactureerd voor invoertokens die worden geweigerd.

2Claude Mythos 5-1, Claude Mythos 5 en Claude Mythos Preview zijn alleen beschikbaar als beperkte onderzoekspreview. Toegang tot de modellen wordt uitsluitend naar eigen goeddunken van Anthropic verleend en geprioriteerd voor gebruiksscenario's voor defensieve cyberbeveiliging. Zie de systeemkaart Claude Fable 5.1 & Claude Mythos 5.1, Claude Mythos 5 systeemkaart en Claude Mythos Preview-systeemkaart voor verantwoordelijk gebruik.

3 Besturingselementen voor inspanning per beurt, mid-gesprek en tokenbudgetten hebben momenteel de bètastatus.

API-overzicht

De volgende tabel vermeldt de API's die u kunt gebruiken om te werken met zowel de op Azure gehoste als de op de infrastructuur van Anthropic gehoste versies van Claude-modellen in Foundry.

Gebruik de Antropische SDK's en de volgende Claude-API's:

Tip

De gehost op Anthropic infrastructuurversie van Claude-modellen in Foundry ondersteunt meer API's dan de API's die in deze tabel worden vermeld. U kunt deze zien op de Claude API-documenten: API-overzichtspagina .

API Description
Berichten1 (POST /v1/messages) Kernberichten-API: Verzend een gestructureerde lijst met invoerberichten met tekst- of afbeeldingsinhoud, inclusief streamingreacties. Het model genereert het volgende bericht in het gesprek.
Token tellen (POST /v1/messages/count_tokens) Token count-API: het aantal tokens in een bericht tellen voordat het naar Claude wordt verzonden.

1U kunt de Berichten-API aanroepen vanuit het anthropic Python-pakket, het @anthropic-ai/foundry-sdk JavaScript-pakket of rechtstreeks via REST. Het implementatie-eindpunt volgt de shape https://<resource-name>.services.ai.azure.com/anthropic/v1/messagesen REST- en JavaScript-clients gebruiken de anthropic-version: 2023-06-01 header.

Mogelijkheden en geavanceerde functies

Claude-modellen in Foundry maken kernmogelijkheden beschikbaar voor het verwerken, analyseren en genereren van inhoud, en hulpprogramma's waarmee Claude kan communiceren met externe systemen, code kan uitvoeren en geautomatiseerde taken kan uitvoeren. Het API-oppervlak van Claude is ingedeeld in vijf gebieden:

In de volgende secties en tabellen worden de mogelijkheden samengevat die beschikbaar zijn in de versies van Claude-modellen in Foundry die worden gehost op Azure en worden gehost op Anthropic-infrastructuur. Tenzij vermeld, is een mogelijkheid van toepassing op beide versies.

Tip

De gehoste op Anthropic infrastructuurversie van Claude-modellen in Foundry ondersteunt meer mogelijkheden dan de mogelijkheden die in deze tabellen worden vermeld. U ziet de volledige lijst met mogelijkheden op Claude Platform Docs: Overzicht van functies.

Zie het Microsoft Ontwikkelaarsblog voor meer informatie over de beschikbare mogelijkheden en geavanceerde functies voor Claude-modellen in Foundry.

Modelmogelijkheden

Manieren om Claude en de directe uitvoer van Claude aan te sturen, waaronder antwoordformaat, de diepgang van de redenering en invoermodaliteiten.

Feature Description
Berichten streamen Wanneer u een bericht maakt, stelt u "stream": true in om het antwoord geleidelijk te streamen met behulp van server-sent events (SSE).
Denken Verbeterde redeneringsmogelijkheden voor complexe taken, waardoor transparantie wordt geboden in het stapsgewijze gedachteproces van Claude voordat het uiteindelijke antwoord wordt geleverd. Zie Denken en inspanning voor thinking parameterwaarden per model.
Adaptief denken Laat Claude dynamisch beslissen wanneer en hoeveel te denken. Deze functie is de enige denkmodus op Claude 4.7 en latere modellen. Gebruik de effort parameter om de diepte van het denken te bepalen.
effort Bepaal hoeveel tokens Claude gebruikt bij het reageren, ruilen tussen grondigheid van reacties en tokenefficiëntie. Zie Denken en inspanning voor effort parameterwaarden per model.
Citaten Baseer Claude's antwoorden op bronnen, inclusief inhoudsblokken voor zoekresultatensearch_result.
Afbeeldingen en visie Inhoud van afbeeldingen verwerken en analyseren. Gehost op Azure implementaties accepteren alleen base64-gecodeerde of OP URL's gebaseerde installatiekopieën.
PDF-ondersteuning Tekst en visuele inhoud van PDF-documenten verwerken en analyseren. Geef PDF-bestanden op als base64 of URL.
Contextvenster van 1M Maximaal 1 miljoen tokens voor het verwerken van grote documenten, uitgebreide codebasissen en lange gesprekken. Ondersteuning is afhankelijk van of het model in aanmerking komt.
Gestructureerde uitvoer Beperk de antwoorden van Claude om een specifiek JSON-schema te volgen, met behulp van twee aanvullende functies: JSON-uitvoer (de output_config.format parameter) voor gestructureerde antwoorden en strikt hulpprogrammagebruik (strict: true) voor gevalideerde invoer van hulpprogramma's. Voor gehoste implementaties op Azure ondersteunen gestructureerde uitvoer ook de verouderde parameter voor JSON-uitvoer (de output_format parameter).

Denken en inspanning

De functie Denken staat specifieke waarden toe voor het thinking parametertype, afhankelijk van het model, zoals beschreven in de volgende tabel. Het adaptive type configureert de functie adaptief denken , zodat het model kan bepalen of het moet denken, op basis van de complexiteit van query's en het inspanningsniveau. Bijvoorbeeld: thinking={"type": "adaptive"}.

Model adaptive enabled disabled
claude-fable-5-1 Yes No No
claude-fable-5 Yes No No
claude-mythos-5-1 Yes No No
claude-mythos-5 Yes No No
claude-mythos-preview Yes Yes No
claude-opus-5 Yes No Ja1
claude-opus-4-8 Yes No Yes
claude-opus-4-7 Yes No Yes
claude-opus-4-6 Yes Yes Yes
claude-sonnet-5 Yes No Yes
claude-sonnet-4-6 Yes Yes Yes

1 Nadenken kan disabled alleen bij inspanning high of lager

Met de functie Effort kunt u specifieke effort niveaus voor elk model instellen, zoals beschreven in de volgende tabel. Het xhigh niveau produceert hetzelfde resultaat als max.

Model low medium high xhigh max
claude-fable-5-1 Yes Yes Yes Yes No
claude-fable-5 Yes Yes Yes Yes No
claude-mythos-5-1 Yes Yes Yes Yes No
claude-mythos-5 Yes Yes Yes Yes No
claude-opus-5 Yes Yes Yes Yes Yes
claude-opus-4-8 Yes Yes Yes Yes Yes
claude-opus-4-7 Yes Yes Yes Yes Yes
claude-opus-4-6 Yes Yes Yes No Yes
claude-sonnet-5 Yes Yes Yes Yes Yes
claude-sonnet-4-6 Yes Yes Yes No Yes

Tools

Laat Claude acties ondernemen op het web of in uw omgeving. Deze functie bestaat uit ingebouwde hulpprogramma's die Claude aanroept via tool_use. Het platform voert hulpprogramma's aan de serverzijde uit en u implementeert en voert hulpprogramma's aan de clientzijde uit.

Feature Description
Hulpprogramma's gebruiken met door de client uitgevoerde hulpprogramma's Aangepaste hulpprogramma's en door Anthropic gedefinieerde bash, text editor, computer use en memory. Zie Bash, teksteditor, computergebruik en geheugen voor meer informatie over deze hulpprogramma's.
Zoeken op internet Ontdek actuele gegevens van over het hele web om de kennis van Claude te verbeteren. Voor gehoste implementaties op Azure wordt alleen de versie van het web_search_20250305 hulpprogramma ondersteund.
Webinhoud ophalen Haal de volledige inhoud op van opgegeven webpagina's en PDF-documenten en voer er een diepgaande analyse op uit, waarbij Claudes context wordt verrijkt met actuele webinhoud. Op Foundry vereist het ophalen van webgegevens een deployment gehost op Anthropic-infrastructuur. Voor gehoste implementaties op Azure wordt alleen de versie van het web_fetch_20250910 hulpprogramma ondersteund.

Toolinfrastructuur

Ontdek, orchestreer en schaal het gebruik van tools.

Feature Description
Fijnmazig hulpprogramma streamen Stream-hulpprogramma gebruikt parameters zonder buffering of JSON-validatie, waardoor de latentie voor grote parameters wordt verminderd. Vereist de anthropic-beta koptekst fine-grained-tool-streaming-2025-05-14.
MCP connector Maak rechtstreeks vanuit de Berichten-API verbinding met externe MCP-servers zonder een afzonderlijke MCP-client.
Zoeken in hulpprogramma's Schaal naar duizenden hulpprogramma's door hulpprogramma's op aanvraag dynamisch te detecteren en te laden met behulp van zoeken op basis van regex en BM25, het optimaliseren van contextgebruik en het verbeteren van de nauwkeurigheid van de selectie van hulpprogramma's. Voor gehoste implementaties op Azure worden zowel de als de tool_search_tool_bm25_20251119tool_search_tool_regex_20251119 hulpprogrammaversies ondersteund. De verouderde aliassen tool_search_tool_bm25 en tool_search_tool_regex worden ook geaccepteerd.

Contextbeheer

Het contextvenster van Claude beheren en optimaliseren voor langlopende sessies.

Feature Description
Automatisch cachen van prompts Vereenvoudig het opslaan van prompts naar één API-parameter. Het systeem cachet automatisch het laatst cachebare blok van uw aanvraag en verplaatst het cachepunt naar voren naarmate gesprekken langer worden.
Prompt opslaan in cache (5 min. Geef Claude meer achtergrondkennis en voorbeelduitvoer om de kosten en latentie te verlagen.
Prompt opslaan in cache (1 uur) Langere cacheduur van 1 uur voor minder vaak gebruikte, maar belangrijke context, die een aanvulling vormt op de standaard cache van 5 minuten.
Context bewerken Automatisch gesprekscontext beheren met configureerbare strategieën, waaronder het wissen van hulpprogrammaresultaten en het beheren van denkblokken. Vereist de antropische bèta-header context-management-2025-06-27.
Token tellen Met token tellen kunt u het aantal tokens in een bericht bepalen voordat u het naar Claude verzendt, zodat u weloverwogen beslissingen kunt nemen over uw prompts en gebruik.

Bestanden en middelen

Beheer de documenten en gegevens die u aan Claude verstrekt.

Feature Description
Files API Momenteel alleen beschikbaar voor implementaties die worden gehost op de infrastructuur van Anthropic. Upload en beheer bestanden voor gebruik met Claude zonder inhoud opnieuw te uploaden met elke aanvraag. Ondersteunt PDF-bestanden, afbeeldingen en tekstbestanden.

Ondersteuning voor agent

Implementatietypes en regio's

Claude-modellen in Foundry zijn beschikbaar voor de volgende implementatietypen in specifieke Azure regio's:

  • Global Standard: Alle Claude-modellen (gehost op Azure en op de infrastructuur van Anthropic).
  • Data Zone Standard (VS): gehost op Azure versies van claude-opus-5, claude-opus-4-8en claude-sonnet-5.

Zie Regio-beschikbaarheid per implementatietype voor de exacte Azure regio's waar Claude-modellen beschikbaar zijn voor implementatie.

Quota's en snelheidslimieten

In deze sectie wordt uitgelegd hoe het quotum voor implementaties wordt gedeeld en welke frequentielimieten hierop van toepassing zijn. Beheer op abonnementsniveau verwerkt het implementatiequotum. Resources en regio's delen het quotum, in plaats van voor elke resource of regio afzonderlijk een quotum toe te wijzen.

  • Alle Global Standard-implementaties van hetzelfde model en dezelfde versie in een abonnement zijn afkomstig van één gedeelde quotumgroep in alle regio's.
  • Alle standaardimplementaties voor gegevenszones van hetzelfde model en dezelfde versie in een abonnement zijn afkomstig van een gedeelde quotumgroep binnen elke gegevenszone (bijvoorbeeld VS).

Zie voor meer informatie over quotabeheer voor Foundry Models Microsoft Quota en limieten voor Foundry Models.

Cachebewuste ITPM

Claude-modellen in Foundry meten snelheidslimieten in aanvragen per minuut (RPM), niet-in cache geplaatste invoertokens per minuut (ITPM) en uitvoertokens per minuut (OTPM) voor elk model.

Voor de meeste Claude-modellen tellen alleen niet-in de cache opgeslagen invoertokens mee voor uw ITPM-frequentielimieten. Deze tokens zijn onder andere:

  • Invoertokens: tokens in de aanvraag na het laatste onderbrekingspunt van de cache (invoer zonder cache).

  • Invoertokens voor het maken van caches : tokens die naar de cache worden geschreven, waaronder:

    • Cache schrijft 5m TPM : tokens die naar de promptcache van 5 minuten worden geschreven.
    • Cache schrijft 1 uur TPM : tokens die naar de promptcache van 1 uur worden geschreven.

Tip

De totale invoertokens zijn de som van invoertokens, invoertokens voor het maken van de cache en het lezen van invoertokens in cache (de tokens die uit de cache worden gelezen). De leesinvoertokens voor cache tellen echter niet mee voor ITPM. OTPM telt ook niet mee voor ITPM.

Zie Claude API Docs: Frequentielimieten voor meer informatie over frequentielimieten en cache.

Frequentielimieten per abonnementstype

Uw Azure abonnementstype bepaalt uw frequentielimieten. De kolommen Versie 2: gehost op Azure en Versie 1: gehost op de infrastructuur van Anthropic geven aan of quota beschikbaar is voor die combinatie van model en implementatietype. Ja betekent dat het quotum beschikbaar is. n.v.t. betekent dat er voor die combinatie van model en versie geen quotum beschikbaar is voor dat implementatietype.

De volgende tabel geeft de snelheidslimieten weer. Als u uw quotum wilt verhogen buiten de standaardlimieten, dient u een aanvraag in via het aanvraagformulier voor quotumverhoging.

Betalen per gebruik

Model Implementatietype Versie 2: gehost op Azure Versie 1: gehost op de infrastructuur van Anthropic RPM ITPM OTPM
claude-fable-5-1 Algemene standaard N/A Yes 0 0 0
claude-fable-5 Algemene standaard N/A Yes 0 0 0
claude-opus-5 Algemene standaard Yes Yes 40 40,000 8,000
claude-opus-5 Data Zone Standard (VS) Yes N/A 40 40,000 8,000
claude-opus-4-8 Algemene standaard Yes Yes 40 40,000 8,000
claude-opus-4-8 Data Zone Standard (VS) Yes N/A 40 40,000 8,000
claude-opus-4-7 Algemene standaard N/A Yes 40 40,000 8,000
claude-opus-4-6 Algemene standaard N/A Yes 40 40,000 8,000
claude-opus-4-5 Algemene standaard N/A Yes 40 40,000 8,000
claude-sonnet-5 Algemene standaard Yes Yes 40 40,000 8,000
claude-sonnet-5 Data Zone Standard (VS) Yes N/A 40 40,000 8,000
claude-sonnet-4-6 Algemene standaard N/A Yes 80 80,000 16.000
claude-sonnet-4-5 Algemene standaard N/A Yes 80 80,000 16.000
claude-haiku-4-5 Algemene standaard Yes Yes 80 80,000 16.000

Verantwoordelijke AI-overwegingen

Houd bij het gebruik van Claude-modellen in Foundry rekening met deze verantwoorde AI-procedures:

Beste praktijken

Volg deze aanbevolen procedures bij het werken met Claude-modellen in Foundry:

Promptengineering

  • Duidelijke instructies: geef specifieke en gedetailleerde aanwijzingen op.
  • Contextbeheer: Gebruik het beschikbare contextvenster effectief.
  • Roldefinities: gebruik systeemberichten om de rol en het gedrag van de assistent te definiëren.
  • Gestructureerde prompts: gebruik consistente opmaak voor betere resultaten.

Kostenoptimalisatie

Om uw gebruik te optimaliseren en snelheidsbeperking te voorkomen:

  • Implementeren van retry-logica: 429 responses verwerken met exponentiële terugval.
  • Batchaanvragen: combineer indien mogelijk meerdere prompts.
  • Tokengebruik bewaken: uw tokenverbruik en aanvraagpatronen bijhouden.
  • Gebruik de juiste modellen: gebruik het meest rendabele model voor uw use-case. Zie Beschikbare Claude-modellen.