Claude-modeller i Microsoft Foundry

Anthropics Claude-modeller tillför avancerade funktioner för konversationsbaserad AI i Microsoft Foundry och erbjuder språkförståelse och textgenerering i toppklass för intelligenta applikationer. Claude-modeller utmärker sig på komplexa resonemang, kodgenerering och multimodala uppgifter, inklusive bildanalys. I den här artikeln beskrivs tillgängliga Claude-modeller, hur de hanteras och faktureras, API:er som stöds, funktioner, kvoter och metodtips.

Information om hur du distribuerar och anropar en Claude-modell finns i Distribuera och använda Claude-modeller i Microsoft Foundry.

Important

Objekt markerade (förhandsversion) i den här artikeln är för närvarande i offentlig förhandsversion. Den här förhandsversionen tillhandahålls utan ett serviceavtal och vi rekommenderar det inte för produktionsarbetsbelastningar. Vissa funktioner kanske inte stöds eller kan vara begränsade. Mer information finns i Kompletterande villkor för användning av Microsoft Azure-förhandsversioner.

Så här hanteras och faktureras Claude-modeller

Microsoft Foundry erbjuder Claude-modeller i två versioner:

  • Version 1: Körs på Anthropic infrastruktur. Dessa modeller körs på Anthropic infrastruktur (utanför Azure).
  • Version 2: Körs på Azure. Dessa modeller körs på Azure infrastruktur från slutpunkt till slutpunkt och är alla allmänt tillgängliga (GA).

Alla modeller är inte tillgängliga i båda versionerna. En modells livscykelsteg, till exempel Förhandsversion eller Allmänt tillgängligt, kan skilja sig mellan de två versionerna. För tillgänglighet per modell och livscykelstatus, se Tillgängliga Claude-modeller.

Om du vill jämföra båda alternativen för värdtjänst när det gäller datahemvist, SLA:er, supportvägar, regelefterlevnad och köpprocessen, se Jämförelse mellan Azure-värdbaserade och Anthropic-värdbaserade Claude-modeller.

Anmärkning

Du kommer åt Claude-modeller i Microsoft Foundry via Foundry Models från partner och community. Modeller från partner och community som Anthropic säljer och driver är icke-Microsoft produkter enligt produktvillkoren.

Claude-modeller i Foundry kräver en Azure Marketplace prenumeration och faktura via Claude Consumption Units (CCU). Se till att du har de behörigheter som krävs för att prenumerera på modellerbjudanden innan du distribuerar . Prisinformation finns i Claude Consumption Units (CCU)-fakturering i Microsoft Foundry.

Tillgängliga Claude-modeller

Important

Följande Claude-modeller följer EU:s vattenstämpelstandard : claude-mythos-5-1, claude-fable-5-1och claude-fable-5. Medan claude-fable-5 använder vattenmärkning med en nyckel använder claude-mythos-5-1 och claude-fable-5-1 dubbla nycklar (sammanvävd 2-nyckelsteknik och C2PA) på följande sätt:

  • Sammanflätade vattenstämplar för text (andra nyckeln): en andra nyckel läggs till för sammanvävd vattenstämpelidentifiering enligt EU:s standarder. Vattenmärkning sker på serversidan när innehållet genereras; det sker ingen ändring av formatet för begäranden eller svar. Ett separat API för identifiering av vattenstämplar är i tidig åtkomst och ingår inte i Foundry-startomfånget.
  • C2PA-vattenmärkning: C2PA-märkning för innehållsursprung, hanteras på server- och klientsidan i Anthropics gränssnitt. Ingen API-formändring.

I följande tabell jämförs modelltillgängligheten för båda versionerna av Claude-modeller i Foundry. Mer information om de funktioner som refereras i tabellen finns i avsnittet Funktioner och avancerade funktioner .

Fel som kan uppstå när du distribuerar eller anropar Claude-modeller finns i Distribuera och använda Claude-modeller: Felsökning.

Modell Availability Kontextfönster/Maxutdata Viktiga funktioner Bäst för
claude-fable-5-1
  • Finns på Anthropics infrastruktur: Förhandsversion
1M /128K
  • Anpassningsbart tänkande
  • Långvarigt arbete
  • Vetenskaplig forskning med självverifiering
  • Kunskapsarbete; hantera utmanande kunskapsarbete med mindre praktisk tillsyn
  • Avslag stop_reason på skyddsprinciper med dubbla användningsområden1
  • Se Nyheter i Claude Fable 5.1 och Claude Mythos 5.1
  • Långvariga agenter
  • Kodning och agenter, med djupare resonemang för företagsarbetsflöden
  • Allmän vetenskap och forskning
  • Ekonomisk analys
  • Vision
claude-fable-5
  • Finns på Anthropics infrastruktur: Förhandsversion
1M /128K
  • Anpassningsbart tänkande
  • Resonemang om hela kodbaser och projektkontext över flera dagar
  • Längre oberoende arbete än någon tidigare Claude-modell
  • Självverifiering
  • Orkestrering av underagenter
  • Avslag stop_reason på skyddsprinciper med dubbla användningsområden1
  • Se Migrera till Claude Fable 5.1 och Claude Mythos 5.1
  • Cybersecurity
  • Autonom kodning
  • Långvariga agenter
  • Kodning och agenter, med djupare resonemang för företagsarbetsflöden
claude-mythos-5-1 2
  • Drivs på Anthropics infrastruktur: begränsad forskningsförhandsvisning
1M /128K
  • Biologi och biovetenskap
  • Cybersäkerhet (prioriterade defensiva användningsfall): sårbarhetsidentifiering, granskning på attackytan, röd teamindelning, hotinformation
  • Autonom kodning
  • Långvariga agenter
claude-mythos-5 2
  • Drivs på Anthropics infrastruktur: begränsad forskningsförhandsvisning
1M /128K
  • Biologi och biovetenskap
  • Cybersäkerhet (prioriterade defensiva användningsfall): sårbarhetsidentifiering, granskning på attackytan, röd teamindelning, hotinformation
  • Autonom kodning
  • Långvariga agenter
claude-mythos-preview 2
  • Drivs på Anthropics infrastruktur: begränsad forskningsförhandsvisning
1M /128K
  • Cybersäkerhet (prioriterade defensiva användningsfall)
  • Autonom kodning
  • Långvariga agenter
claude-opus-5
  • Värdhanterad på Azure: GA
  • Finns på Anthropic infrastruktur: GA
1M /128K
  • Anpassningsbart tänkande med xhigh och max ansträngningsnivåer
  • Resonemang om hela kodbaser och projektkontext över flera dagar
  • Reglage för ansträngning per tur3
  • Mitt i samtalet3role:"system"
  • Tokenbudgeter3 (task_budget)
  • Se Nyheter i Claude Opus 5
  • Intelligens på Near-Fable-nivå för kodning med lång planeringshorisont och för komplex agentbaserad orkestrering.
  • Långvariga agenter
  • Företagsarbetsflöden
  • Ekonomisk analys
  • Datoranvändning
claude-opus-4-8
  • Värdhanterad på Azure: GA
  • Finns på Anthropic infrastruktur: GA
1M /128K
  • Anpassningsbart tänkande med xhigh ansträngningsnivå
  • Resonemang om hela kodbaser och projektkontext över flera dagar
  • Högupplösta bildindata (upp till 2 576px/3,75MP)
  • Se Migrera till Claude Opus 5
  • Coding
  • Långvariga agenter
  • Ekonomisk analys
  • Cybersecurity
  • Datoranvändning
claude-opus-4-7
  • Finns på Anthropic infrastruktur: GA
1M /128K
  • Anpassningsbart tänkande
  • Resonera kring hela kodbaser
  • Högupplösta bildindata (upp till 2 576px/3,75MP)
  • Se Migrera till Claude Opus 5
  • Coding
  • Företagsarbetsflöden
  • Långvariga agenter
  • Multimodalt resonemang
  • Ekonomisk analys
  • Cybersecurity
claude-opus-4-6
  • Finns på Anthropic infrastruktur: GA
1M /128K
  • Anpassningsbart tänkande
  • Bild- och textinmatning
  • Datoranvändning
  • Avancerad verktygsanvändning (sökning, programmeringssamtal, exempel)
  • Se Migrera till Claude Opus 5
  • Coding
  • Företagsagenter
claude-opus-4-5
  • Finns på Anthropic infrastruktur: GA
200 000/64 000
  • Utökat tänkande
  • Bild- och textinmatning
  • Datoranvändning
  • Avancerad verktygsanvändning (sökning, programmeringssamtal, exempel)
  • Se Migrera till Claude Opus 5
  • Coding
  • Agenter
  • Datoranvändning
  • Företagsarbetsflöden
claude-sonnet-5
  • Värdhanterad på Azure: GA
  • Finns på Anthropic infrastruktur: GA
1M /128K
  • Anpassningsbart tänkande
  • xhigh insatsnivå
  • Resonemang om hela kodbaser och projektkontext över flera dagar
  • Högupplöst bildindata (upp till 2576 px / 3,75 MP) är aktiverad som standard
  • Mitt i samtalet3role:"system"
  • Tokenbudgeter3 (task_budget)
  • Se Nyheter i Claude Sonnet 5
  • Coding
  • Långvariga agenter
  • Ekonomisk analys
  • Cybersecurity
  • Datoranvändning
claude-sonnet-4-6
  • Finns på Anthropic infrastruktur: GA
1M /128K
  • Anpassningsbart tänkande
  • Bild- och textinmatning
  • Datoranvändning
  • Avancerad verktygsanvändning (sökning, programmeringssamtal, exempel)
  • Se Migrera till Claude Sonnet 5
  • Coding
  • Agenter
  • Företagsarbetsflöden
claude-sonnet-4-5
  • Finns på Anthropic infrastruktur: GA
200 000/64 000
  • Agenter och komplexa uppgifter med lång horisont
  • Arbetsbelastningar med stora volymer
claude-haiku-4-5
  • Värdhanterad på Azure: GA
  • Finns på Anthropic infrastruktur: GA
200 000/64 000
  • Utökat tänkande
  • Bild- och textinmatning
  • Coding
  • Agenter

1Claude Fable 5 och Claude Fable 5.1 tillämpar extra in- och utdataklassificerare som kan neka begäranden om innehållet utlöser skyddsprinciper med dubbla användningsområden. När en vägran inträffar returnerar begäran ett lyckat (200) svar med en avslagsindikator stop_reason: "refusal" i stället för modellgenererat innehåll. Du debiteras inte för indatatoken som nekas.

2Claude Mythos 5-1, Claude Mythos 5 och Claude Mythos Preview är endast tillgängliga som gated research preview. Åtkomst till modellerna beviljas endast enligt Anthropics eget gottfinnande och prioriteras för defensiva användningsfall inom cybersäkerhet. Se Claude Fable 5.1 & Claude Mythos 5.1 systemkort, Claude Mythos 5 systemkort och Claude Mythos Preview systemkort för ansvarsfull användning vägledning.

3 Arbetskontroller per tur, mellankonversation och tokenbudgetar är för närvarande i betatillstånd.

API-översikt

Följande tabell listar de API:er som du kan använda för att interagera med både Azure-värdbaserade och Anthropic-infrastrukturvärdbaserade versioner av Claude-modeller i Foundry.

Använd SDK:erna Anthropic och följande Claude-API:er:

Tip

Den version av Claude-modeller i Foundry som finns på Anthropics infrastruktur stöder fler API:er än de som anges i den här tabellen. Du kan se dem på sidan Claude API-dokumentation: API-översikt.

API Description
Meddelanden1 (POST /v1/messages) API för kärnmeddelanden: Skicka en strukturerad lista över indatameddelanden med text- eller bildinnehåll, inklusive strömmande svar. Modellen genererar nästa meddelande i konversationen.
Tokenräkning (POST /v1/messages/count_tokens) API för antal token: Räkna antalet token i ett meddelande innan du skickar det till Claude.

1Du kan anropa API:et anthropic Meddelanden från Python-paketet, @anthropic-ai/foundry-sdk JavaScript-paketet eller direkt via REST. Distributionsändpunkten har formen https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, och REST- och JavaScript-klienter använder huvudet anthropic-version: 2023-06-01.

Funktioner och avancerade funktioner

Claude-modeller i Foundry exponerar kärnfunktioner för bearbetning, analys och generering av innehåll och verktyg som låter Claude interagera med externa system, köra kod och utföra automatiserade uppgifter. Claudes API-yta är uppdelad i fem områden:

Följande avsnitt och tabeller sammanfattar funktioner som är tillgängliga i versionerna Hosted on Azure och Hosted on Anthropic infrastructure av Claude-modeller i Foundry. Om inget anges gäller en funktion för båda versionerna.

Tip

Den värdbaserade Anthropic infrastrukturversionen av Claude-modeller i Foundry har stöd för fler funktioner än de som anges i dessa tabeller. Du kan se en fullständig lista över funktioner på Claude Platform Docs: Features overview( Översikt över funktioner).

Mer information om tillgängliga funktioner och avancerade funktioner för Claude-modeller i Foundry finns i Microsoft Developer-bloggen.

Modellfunktioner

Sätt att styra Claude och Claude:s direkta svar, inklusive svarsformat, resonemangsdjup och inmatningsmodaliteter.

Feature Description
Strömmande meddelanden När du skapar ett Message anger du "stream": true för att strömma svaret stegvis med hjälp av serverskickade händelser (SSE).
Tänker Förbättrade resonemangsfunktioner för komplexa uppgifter, vilket ger insyn i Claudes stegvisa tankeprocess innan den levererar sitt slutliga svar. Se Tänkande och ansträngning för thinking parametervärden per modell.
Anpassningsbart tänkande Låt Claude dynamiskt bestämma när och hur mycket man ska tänka. Den här funktionen är det enda resonemangsläget i Claude 4.7 och senare modeller. Använd parametern effort för att styra tankedjupet.
Effort Styr hur många token Claude använder i sina svar, med en avvägning mellan svarens utförlighet och effektiv tokenanvändning. Se Tänkande och ansträngning för effort parametervärden per modell.
Hänvisningar Basera Claudes svar på källor, inklusive innehållsblock för sökresultatsearch_result.
Bilder och visioner Bearbeta och analysera innehåll från bilder. I Azure-distributioner accepteras endast base64-kodade eller URL-baserade avbildningar.
PDF-stöd Bearbeta och analysera text- och visuellt innehåll från PDF-dokument. Ange PDF-filer som base64 eller URL.
1M-kontextfönster Upp till 1 miljon token för bearbetning av stora dokument, omfattande kodbaser och långa konversationer. Support är beroende av om modellen är berättigad.
Strukturerade utdata Begränsa Claudes svar så att de följer ett specifikt JSON-schema med hjälp av två kompletterande funktioner: JSON-utdata (parametern output_config.format ) för strukturerade svar och strikt verktygsanvändning (strict: true) för validerade verktygsindata. För distributioner Hosted on Azure stöder strukturerade utdata även den äldre parametern för JSON-utdata (parametern output_format).

Tänkande och ansträngning

Funktionen Thinking tillåter specifika värden för thinking parametertypen, beroende på modell, enligt beskrivningen i följande tabell. Typen adaptive konfigurerar funktionen för anpassningsbart tänkande , så att modellen kan bestämma om den ska tänka, baserat på frågekomplexitet och ansträngningsnivå. Till exempel thinking={"type": "adaptive"}.

Modell adaptive enabled disabled
claude-fable-5-1 Yes No No
claude-fable-5 Yes No No
claude-mythos-5-1 Yes No No
claude-mythos-5 Yes No No
claude-mythos-preview Yes Yes No
claude-opus-5 Yes No Yes1
claude-opus-4-8 Yes No Yes
claude-opus-4-7 Yes No Yes
claude-opus-4-6 Yes Yes Yes
claude-sonnet-5 Yes No Yes
claude-sonnet-4-6 Yes Yes Yes

1 Resonerande kan endast ske vid ansträngningsnivå disabled eller lägre high

Funktionen Ansträngning tillåter specifika effort nivåer för varje modell, enligt beskrivningen i följande tabell. Nivån xhigh ger samma resultat som max.

Modell low medium high xhigh max
claude-fable-5-1 Yes Yes Yes Yes No
claude-fable-5 Yes Yes Yes Yes No
claude-mythos-5-1 Yes Yes Yes Yes No
claude-mythos-5 Yes Yes Yes Yes No
claude-opus-5 Yes Yes Yes Yes Yes
claude-opus-4-8 Yes Yes Yes Yes Yes
claude-opus-4-7 Yes Yes Yes Yes Yes
claude-opus-4-6 Yes Yes Yes No Yes
claude-sonnet-5 Yes Yes Yes Yes Yes
claude-sonnet-4-6 Yes Yes Yes No Yes

Tools

Låt Claude vidta åtgärder på webben eller i din miljö. Den här funktionen består av inbyggda verktyg som Claude anropar via tool_use. Plattformen kör verktyg på serversidan och du implementerar och kör verktyg på klientsidan.

Feature Description
Verktygsanvändning med klientdrivna verktyg Anpassade verktyg samt Anthropic-definierade bash, text editor, computer use och memory. Mer information om dessa verktyg finns i Bash, Textredigeraren, Datoranvändning och Minne.
Webbsökning Upptäck aktuella verkliga data från hela webben som du kan använda för att utöka Claudes kunskaper. För Azure-värdbaserade distributioner stöds endast verktygsversionen web_search_20250305.
Webbhämtning Hämta och utföra djupgående analys av fullständigt innehåll från angivna webbsidor och PDF-dokument, vilket utökar Claudes kontext med live-webbinnehåll. På Foundry kräver hämtning från webben en distribution som hostas på Anthropics infrastruktur. För Azure-värdbaserade distributioner stöds endast verktygsversionen web_fetch_20250910.

Verktygsinfrastruktur

Identifiera, samordna och skala verktygsanvändning.

Feature Description
Detaljerad verktygsströmning Stream-verktyget använder parametrar utan buffring eller JSON-validering, vilket minskar svarstiden för stora parametrar. Kräver sidhuvudet anthropic-betafine-grained-tool-streaming-2025-05-14.
MCP-anslutning Anslut till fjärranslutna MCP-servrar direkt från Meddelande-API:et utan en separat MCP-klient.
Sök efter verktyg Skala till tusentals verktyg genom att dynamiskt identifiera och läsa in verktyg på begäran med regex- och BM25-baserad sökning, optimera kontextanvändning och förbättra noggrannheten för val av verktyg. För distributioner som är Azure-värdbaserade stöds både verktygsversionerna tool_search_tool_bm25_20251119 och tool_search_tool_regex_20251119. De äldre aliasen tool_search_tool_bm25 och tool_search_tool_regex accepteras också.

Innehållshantering

Kontrollera och optimera Claudes kontextfönster för långvariga sessioner.

Feature Description
Automatisk cachning av promptar Förenkla promptcachelagring till en enda API-parameter. Systemet cachelagrar automatiskt det sista cachebara blocket i din begäran och flyttar cachepunkten framåt när konversationerna växer.
Fråga om cachelagring (5 m) Ge Claude mer bakgrundskunskap och exempelutdata för att minska kostnader och svarstider.
Cachelagring av promptar (1 timme) Utökad 1 timmes cachevaraktighet för mindre frekvent åtkomst men viktig kontext, som kompletterar standardcacheminnet på 5 minuter.
Kontextredigering Hantera konversationskontext automatiskt med konfigurerbara strategier, inklusive att rensa verktygsresultat och hantera tankeblock. Kräver antropisk betarubrik context-management-2025-06-27.
Tokenräkning Med tokenräkning kan du avgöra antalet token i ett meddelande innan du skickar det till Claude, så att du kan fatta välgrundade beslut om dina promptar och din användning.

Filer och tillgångar

Hantera de dokument och data som du anger för Claude.

Feature Description
Api för filer För närvarande endast tillgängligt på distributioner som driftas på Anthropics infrastruktur. Ladda upp och hantera filer som ska användas med Claude utan att ladda upp innehåll på nytt med varje begäran. Stöder PDF-filer, bilder och textfiler.

Agentstöd

Distributionstyper och -regioner

Claude-modeller i Foundry är tillgängliga för följande distributionstyper i specifika Azure regioner:

  • Global Standard: Alla Claude-modeller (drivs på Azure och på Anthropics infrastruktur).
  • Data Zone Standard (USA): Finns på Azure versioner av claude-opus-5, claude-opus-4-8och claude-sonnet-5.

Exakta Azure regioner där Claude-modeller är tillgängliga för distribution finns i Regiontillgänglighet efter distributionstyp.

Kvoter och hastighetsgränser

I det här avsnittet beskrivs hur distributioner delar kvot och vilka hastighetsgränser som gäller för dem. Hantering på prenumerationsnivå hanterar distributionskvoten. Resurser och regioner delar kvoten i stället för att allokera den separat för varje resurs eller region.

  • Alla Global Standard-distributioner av samma modell och version i en prenumeration hämtas från en delad kvotpool i alla regioner.
  • Alla Data Zone Standard-distributioner av samma modell och version i en prenumeration hämtas från en delad kvotpool inom varje datazon (till exempel USA).

Mer information om kvothantering för Foundry-modeller finns i Microsoft Foundry Models-kvoter och -gränser.

Cachemedveten ITPM

Claude-modeller i Foundry mäter hastighetsgränser i begäranden per minut (RPM), oåtkomliga indatatoken per minut (ITPM) och utdatatoken per minut (OTPM) för varje modell.

För de flesta Claude-modeller räknas endast indatatoken som inte cachelagrats in i dina ITPM-gränser. Dessa token omfattar:

  • Indatatoken — token i begäran efter den senaste cachebrytpunkten (indata som inte har cachats).

  • Indatatoken för att skapa cachen – token som skrivs till cachen, som består av:

    • Cache-skrivning 5m TPM — token som skrivs till 5-minuters promptcache.
    • Cacheskrivning 1h TPM – token som skrivs till 1‑timmes-cache för promptar.

Tip

Det totala antalet indatatoken är summan av indatatoken, cachegenereringsindatatoken och cacheläsningsindatatoken (token som läse från cacheminnet). Dock räknas indatatoken för läsning från cacheminnet inte in i ITPM. OTPM räknas inte heller mot ITPM.

Mer information om hastighetsbegränsningar och cacheminne finns i Claude API Docs: Hastighetsgränser.

Hastighetsbegränsningar per prenumerationstyp

Din Azure-prenumerationstyp avgör dina hastighetsgränser. Version 2: Hostad på Azure och Version 1: Hostad på Anthropics infrastruktur-kolumnerna anger om kvot är tillgänglig för den kombinationen av modell och distributionstyp. Ja innebär att kvoten är tillgänglig. N/A innebär att modell- och versionskombinationen inte har någon kvot för den distributionstypen.

I följande tabell visas hastighetsbegränsningar. Om du vill öka din kvot utöver standardgränserna skickar du en begäran via formuläret för begäran om kvotökning.

Betala efter hand

Modell Distributionstyp Version 2: Värdhanterad på Azure Version 1: Drivs på Anthropics infrastruktur RPM ITPM OTPM
claude-fable-5-1 Global Standard N/A Yes 0 0 0
claude-fable-5 Global Standard N/A Yes 0 0 0
claude-opus-5 Global Standard Yes Yes 40 40,000 8,000
claude-opus-5 Data Zone Standard (USA) Yes N/A 40 40,000 8,000
claude-opus-4-8 Global Standard Yes Yes 40 40,000 8,000
claude-opus-4-8 Data Zone Standard (USA) Yes N/A 40 40,000 8,000
claude-opus-4-7 Global Standard N/A Yes 40 40,000 8,000
claude-opus-4-6 Global Standard N/A Yes 40 40,000 8,000
claude-opus-4-5 Global Standard N/A Yes 40 40,000 8,000
claude-sonnet-5 Global Standard Yes Yes 40 40,000 8,000
claude-sonnet-5 Data Zone Standard (USA) Yes N/A 40 40,000 8,000
claude-sonnet-4-6 Global Standard N/A Yes 80 80,000 16,000
claude-sonnet-4-5 Global Standard N/A Yes 80 80,000 16,000
claude-haiku-4-5 Global Standard Yes Yes 80 80,000 16,000

Ansvarsfulla AI-överväganden

När du använder Claude-modeller i Foundry bör du överväga följande ansvarsfulla AI-metoder:

Metodtips

Följ dessa metodtips när du arbetar med Claude-modeller i Foundry:

Promptteknik

  • Tydliga instruktioner: Ange specifika och detaljerade frågor.
  • Kontexthantering: Använd det tillgängliga kontextfönstret effektivt.
  • Rolldefinitioner: Använd systemmeddelanden för att definiera assistentens roll och beteende.
  • Strukturerade frågor: Använd konsekvent formatering för bättre resultat.

Kostnadsoptimering

Så här optimerar du din användning och undviker hastighetsbegränsning:

  • Implementera logik för återförsök: Hantera 429 svar med exponentiell backoff.
  • Batch-begäranden: Kombinera flera frågor när det är möjligt.
  • Övervaka tokenanvändning: Spåra din tokenförbrukning och begärandemönster.
  • Använd lämpliga modeller: Använd den mest kostnadseffektiva modellen för ditt användningsfall. Se Tillgängliga Claude-modeller.