Modele Claude’a w Microsoft Foundry

Modele Claude firmy Anthropic wnoszą do Microsoft Foundry zaawansowane możliwości konwersacyjnej sztucznej inteligencji, zapewniając najnowocześniejsze rozumienie i generowanie języka na potrzeby inteligentnych aplikacji. Modele Claude doskonale radzą sobie ze złożonymi zadaniami związanymi z rozumowaniem, generowaniem kodu i zadaniami wielomodalnymi, w tym analizą obrazów. W tym artykule opisano dostępne modele Claude'a, sposób ich hostowania i naliczania opłat, obsługiwanych interfejsów API, możliwości i najlepszych rozwiązań.

Aby wdrożyć i wywołać model Claude'a, zobacz Deploy and use Claude models in Microsoft Foundry (Wdrażanie i używanie modeli Claude'a w usłudze Microsoft Foundry).

Important

Elementy oznaczone podglądem w tym artykule są obecnie w wersji zapoznawczej. Ta wersja zapoznawcza jest udostępniana bez umowy dotyczącej poziomu usług, a Microsoft nie zaleca korzystania z niej w przypadku obciążeń produkcyjnych. Niektóre funkcje mogą nie być obsługiwane lub mogą mieć ograniczone możliwości. Aby uzyskać więcej informacji, zobacz Warunki dodatkowe korzystania z testowych wersji Microsoft Azure.

Jak modele Claude'a są hostowane i rozliczane

Microsoft Foundry oferuje modele Claude'a w dwóch wersjach:

  • Wersja 1: hostowana w infrastrukturze Anthropic; te modele działają w infrastrukturze Anthropic (poza Azure).
  • Wersja 2: hostowana na Azure; te modele działają na kompleksowej infrastrukturze Azure i są ogólnie dostępne .

Nie wszystkie modele są dostępne w obu wersjach. Etap cyklu życia modelu, taki jak wersja zapoznawcza lub ogólnie dostępny, może się różnić między dwiema wersjami. Aby uzyskać informacje o dostępności i stanie cyklu życia modelu, zobacz Dostępne modele Claude'a.

Aby porównać obie opcje hostingu pod względem rezydencji danych, umów SLA, kanałów pomocy technicznej, zgodności i procesu zakupu, zobacz Porównanie modeli Claude hostowanych na platformie Azure i hostowanych przez Anthropic.

Note

Masz dostęp do modeli Claude w usłudze Microsoft Foundry za pośrednictwem modeli Foundry od partnerów i społeczności. Modele partnerów i społeczności, które Anthropic sprzedaje i obsługuje, są Produktami innymi niż firmy Microsoft zgodnie z dokumentem Product Terms.

Modele Claude w usłudze Foundry wymagają subskrypcji w usłudze Azure Marketplace i są rozliczane w jednostkach zużycia Claude (CCU). Przed wdrożeniem upewnij się, że masz uprawnienia wymagane do subskrybowania ofert modeli. Aby uzyskać szczegółowe informacje o cenach, zobacz Rozliczanie jednostek zużycia Claude (CCU) w usłudze Microsoft Foundry.

Dostępne modele Claude'a

Important

Następujące modele Claude'a są zgodne ze standardem znakowania wodnego UE: claude-mythos-5-1, claude-fable-5-1 i claude-fable-5. Chociaż claude-fable-5 używa znakowania wodnego jednym kluczem, claude-mythos-5-1 i claude-fable-5-1 używają dwóch kluczy (przeplatanego układu 2-kluczowego i C2PA) w następujący sposób:

  • Znak wodny przeplatanego tekstu (drugi klucz): dodano drugi klucz do wykrywania przeplatanego znaku wodnego zgodnie z normami UE. Dodawanie znaku wodnego odbywa się po stronie serwera podczas generowania; nie powoduje to zmian w strukturze żądania ani odpowiedzi. Oddzielne API do wykrywania znaków wodnych jest dostępne we wczesnym dostępie i nie wchodzi w zakres premierowego wydania Foundry.
  • Znakowanie wodne C2PA: oznaczanie pochodzenia treści C2PA, obsługiwane po stronie serwera/klienta przez interfejsy Anthropic. Brak zmiany kształtu interfejsu API.

W poniższej tabeli porównano dostępność modelu dla obu wersji modeli Claude'a w narzędziu Foundry. Aby uzyskać szczegółowe informacje na temat funkcji, do których odwołuje się tabela, zobacz sekcję Możliwości i funkcje zaawansowane .

W przypadku błędów, które mogą wystąpić podczas wdrażania lub wywoływania modeli Claude'a, zobacz Wdrażanie i używanie modeli Claude'a: Rozwiązywanie problemów.

Model Availability Okno kontekstowe / Maksymalna liczba danych wyjściowych Kluczowe możliwości Najlepsze dla
claude-fable-5-1
  • Hostowana w infrastrukturze Anthropic: wersja zapoznawcza
1M /128K
  • Myślenie adaptacyjne
  • Długotrwała praca
  • Badania naukowe z samodzielną weryfikacją
  • Praca merytoryczna; obsługa trudnej pracy z wiedzą z mniejszym nadzorem praktycznym
  • Odmowa stop_reason stosowania zasad ochrony podwójnego zastosowania1
  • Zobacz Co nowego w Claude Fable 5.1 i Claude Mythos 5.1
  • Długotrwałe agenty
  • Programowanie i agenci z głębszym rozumowaniem dla przepływów pracy w przedsiębiorstwach
  • Ogólna nauka i badania
  • Analiza finansowa
  • Wizja
claude-fable-5
  • Hostowana w infrastrukturze Anthropic: wersja zapoznawcza
1M /128K
  • Myślenie adaptacyjne
  • Rozumowanie w obrębie całej bazy kodu oraz wielodniowego kontekstu projektu
  • Dłuższa niezależna praca niż jakikolwiek poprzedni model Claude'a
  • Samodzielna weryfikacja
  • Orkiestracja podagentów
  • Odmowa stop_reason stosowania zasad ochrony podwójnego zastosowania1
  • Zobacz Migracja do Claude Fable 5.1 i Claude Mythos 5.1
  • Cybersecurity
  • Kodowanie autonomiczne
  • Długotrwałe agenty
  • Programowanie i agenci z głębszym rozumowaniem dla przepływów pracy w przedsiębiorstwach
claude-mythos-5-1 2
  • Hostowane w infrastrukturze Anthropic: wersja zapoznawcza badań o ograniczonym dostępie
1M /128K
  • Biologia i nauki życiowe
  • Cyberbezpieczeństwo (z priorytetem dla zastosowań defensywnych): wykrywanie podatności, audyt powierzchni ataku, red teaming, wywiad o zagrożeniach
  • Kodowanie autonomiczne
  • Długotrwałe agenty
claude-mythos-5 2
  • Hostowane w infrastrukturze Anthropic: wersja zapoznawcza badań o ograniczonym dostępie
1M /128K
  • Biologia i nauki życiowe
  • Cyberbezpieczeństwo (z priorytetem dla zastosowań defensywnych): wykrywanie podatności, audyt powierzchni ataku, red teaming, wywiad o zagrożeniach
  • Kodowanie autonomiczne
  • Długotrwałe agenty
claude-mythos-preview 2
  • Hostowane w infrastrukturze Anthropic: wersja zapoznawcza badań o ograniczonym dostępie
1M /128K
  • Cyberbezpieczeństwo (priorytetowe przypadki użycia defensywnego)
  • Kodowanie autonomiczne
  • Długotrwałe agenty
claude-opus-5-5
  • Hostowane w usłudze Azure: dostępność ogólna
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
1M /128K
  • Opłacalne dzięki niższym cenom tokenów i tańszym odczytom pamięci podręcznej
  • Kodowanie z udziałem agentów podczas długotrwałych sesji; znajdowanie pierwotnych przyczyn przed wprowadzaniem zmian i sprawdzanie wyników na bieżąco
  • Myślenie adaptacyjne jest zawsze włączone, z parametrem effort służącym do określania głębokości i kosztu przy poziomach effort xhigh i max; Wartość domyślna to medium; {"type": "adaptive"} jest akceptowane dla parametru thinking; Żądania, które ustawiają parametr thinking na disabled albo na enabled z ręcznie ustawionym budget_tokens, są odrzucane z kodem 400; Żądania, w których pominięto parametr thinking, działają z myśleniem adaptacyjnym
  • Przekazuje krótsze i przejrzyste podsumowania długich procesów
  • Wykonuje pracę merytoryczną w celu utworzenia dokumentów, które wymagają ograniczonej edycji w porównaniu z poprzednimi modelami
  • Kontrolki nakładu pracy na obrót3
  • Rozmowa w połowie3role:"system"
  • Budżety tokenów3 (task_budget)
  • Zobacz Co nowego w Claude Opus 5.5
  • Agenci działający przez długi czas przy minimalnym nadzorze i z czytelnymi raportami na bieżąco
  • Przepływy pracy przedsiębiorstwa
  • Analiza finansowa
  • Używanie komputera
  • Wizja
claude-opus-5
  • Hostowane w usłudze Azure: dostępność ogólna
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
1M /128K
  • Adaptacyjne myślenie z poziomami wysiłku xhigh i max
  • Rozumowanie w obrębie całej bazy kodu oraz wielodniowego kontekstu projektu
  • Kontrolki nakładu pracy na obrót3
  • Rozmowa w połowie3role:"system"
  • Budżety tokenów3 (task_budget)
  • Zobacz Migracja do Claude Opus 5.5
  • Near-Fable inteligencja do kodowania długofalowego i złożonej orkiestracji agentów
  • Długotrwałe agenty
  • Przepływy pracy przedsiębiorstwa
  • Analiza finansowa
  • Używanie komputera
claude-opus-4-8
  • Hostowane w usłudze Azure: dostępność ogólna
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
1M /128K
  • Myślenie adaptacyjne z xhigh poziomem wysiłku
  • Rozumowanie w obrębie całej bazy kodu oraz wielodniowego kontekstu projektu
  • Dane wejściowe obrazu o wysokiej rozdzielczości (do 2576 pikseli / 3,75MP)
  • Zobacz Migracja do Claude Opus 5.5
  • Coding
  • Długotrwałe agenty
  • Analiza finansowa
  • Cybersecurity
  • Używanie komputera
claude-opus-4-7
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
1M /128K
  • Myślenie adaptacyjne
  • Rozumowanie na podstawie całej bazy kodu
  • Dane wejściowe obrazu o wysokiej rozdzielczości (do 2576 pikseli / 3,75MP)
  • Zobacz Migracja do Claude Opus 5.5
  • Coding
  • Przepływy pracy przedsiębiorstwa
  • Długotrwałe agenty
  • Rozumowanie wielomodalne
  • Analiza finansowa
  • Cybersecurity
claude-opus-4-6
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
1M /128K
  • Myślenie adaptacyjne
  • Wprowadzanie obrazów i tekstu
  • Używanie komputera
  • Zaawansowane użycie narzędzi (wyszukiwanie, wywoływanie programowe, przykłady)
  • Zobacz Migracja do Claude Opus 5.5
  • Coding
  • Agenci przedsiębiorstwa
claude-opus-4-5
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
200K/64K
  • Myślenie rozszerzone
  • Wprowadzanie obrazów i tekstu
  • Używanie komputera
  • Zaawansowane użycie narzędzi (wyszukiwanie, wywoływanie programowe, przykłady)
  • Zobacz Migracja do Claude Opus 5.5
  • Coding
  • Agenci
  • Używanie komputera
  • Przepływy pracy przedsiębiorstwa
claude-sonnet-5-5
  • Hostowane w usłudze Azure: dostępność ogólna
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
1M /128K
  • Myślenie adaptacyjne
  • xhigh poziom nakładu pracy
  • Rozumowanie w obrębie całej bazy kodu oraz wielodniowego kontekstu projektu
  • Obrazy wejściowe o wysokiej rozdzielczości (do 2576 px / 3,75 MP) są domyślnie włączone
  • Rozmowa w połowie3role:"system"
  • Budżety tokenów3 (task_budget)
claude-sonnet-5
  • Hostowane w usłudze Azure: dostępność ogólna
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
1M /128K
  • Myślenie adaptacyjne
  • xhigh poziom nakładu pracy
  • Rozumowanie w obrębie całej bazy kodu oraz wielodniowego kontekstu projektu
  • Obrazy wejściowe o wysokiej rozdzielczości (do 2576 px / 3,75 MP) są domyślnie włączone
  • Rozmowa w połowie3role:"system"
  • Budżety tokenów3 (task_budget)
  • Zobacz co nowego w Claude Sonnet 5
  • Coding
  • Długotrwałe agenty
  • Analiza finansowa
  • Cybersecurity
  • Używanie komputera
claude-sonnet-4-6
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
1M /128K
  • Myślenie adaptacyjne
  • Wprowadzanie obrazów i tekstu
  • Używanie komputera
  • Zaawansowane użycie narzędzi (wyszukiwanie, wywoływanie programowe, przykłady)
  • Zobacz Migracja do Claude Sonnet 5
  • Coding
  • Agenci
  • Przepływy pracy przedsiębiorstwa
claude-sonnet-4-5
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
200K/64K
  • Agenci i złożone zadania o długim horyzoncie
  • Obciążenia o dużej skali
claude-haiku-4-5
  • Hostowane w usłudze Azure: dostępność ogólna
  • Hostowane w infrastrukturze Anthropic: ogólnie dostępne
200K/64K
  • Myślenie rozszerzone
  • Wprowadzanie obrazów i tekstu
  • Coding
  • Agenci

1Claude Fable 5 i Claude Fable 5.1 stosują dodatkowe klasyfikatory wejściowe/wyjściowe, które mogą odrzucać żądania, jeśli zawartość wyzwala zasady zabezpieczeń podwójnego użycia. W przypadku odmowy żądanie zwraca pomyślną (200) odpowiedź ze wskaźnikiem stop_reason: "refusal" odmowy zamiast zawartości wygenerowanej przez model. Nie są naliczane opłaty za tokeny wejściowe, które są odrzucane.

2Claude Mythos 5-1, Claude Mythos 5 i Claude Mythos Preview są dostępne tylko jako gated research preview. Dostęp do modeli jest przyznawany wyłącznie według uznania firmy Anthropic i w pierwszej kolejności przeznaczony dla zastosowań w obszarze obronnego cyberbezpieczeństwa. Zobacz kartę systemowa Claude Fable 5.1 i Claude Mythos 5.1, kartę systemowa Claude'a Mitosa 5 oraz kartę systemowego Claude'a Mythos Preview , aby uzyskać wskazówki dotyczące odpowiedzialnego korzystania.

3 Ustawienia nakładu pracy na turę, W trakcie rozmowy i Budżety tokenów są obecnie w fazie beta.

Przegląd interfejsu API

W poniższej tabeli wymieniono interfejsy API, których można użyć do interakcji zarówno z hostowanymi na Azure, jak i hostowanymi w wersjach infrastruktury Anthropic modeli Claude'a w narzędziu Foundry.

Użyj zestawów SDK Anthropic i następujących interfejsów API od Claude:

Tip

Wersja modeli Claude w Foundry hostowana w infrastrukturze Anthropic obsługuje więcej interfejsów API niż wymienione w tej tabeli. Można je zobaczyć na stronie dokumentacji interfejsu API Claude: omówienie interfejsu API.

API Opis
Komunikaty1 (POST /v1/messages) Podstawowe API komunikatów: wysyłaj uporządkowaną listę komunikatów wejściowych z treścią tekstową lub obrazową, w tym odpowiedzi strumieniowe. Model generuje następny komunikat w konwersacji.
Zliczanie tokenów (POST /v1/messages/count_tokens) API do zliczania tokenów: Zlicz liczbę tokenów w komunikacie przed wysłaniem go do Claude'a.

1Interfejs API komunikatów można wywołać z pakietu Python, pakietu JavaScript lub bezpośrednio za pośrednictwem interfejsu anthropic@anthropic-ai/foundry-sdk REST. Punkt końcowy wdrożenia jest zgodny z kształtem https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, a klienci REST i JavaScript używają nagłówka anthropic-version: 2023-06-01 .

Możliwości i funkcje zaawansowane

Modele Claude'a w narzędziu Foundry udostępniają podstawowe możliwości przetwarzania, analizowania i generowania zawartości oraz narzędzi , które umożliwiają Claude'owi interakcję z systemami zewnętrznymi, wykonywanie kodu i wykonywanie zautomatyzowanych zadań. Powierzchnia interfejsu API Claude'a jest zorganizowana w pięć obszarów:

Poniższe sekcje i tabele podsumowują możliwości dostępne w wersjach modeli Claude w usłudze Foundry: hostowanych na platformie Azure oraz hostowanych w infrastrukturze Anthropic. O ile nie wspomniano, możliwość ma zastosowanie do obu wersji.

Tip

Wersja modeli Claude w Foundry hostowana w infrastrukturze Anthropic oferuje więcej funkcji, niż wymieniono w tych tabelach. Pełną listę funkcji można znaleźć w witrynie Claude Platform Docs: Omówienie funkcji.

Aby uzyskać więcej informacji na temat dostępnych możliwości i zaawansowanych funkcji dla modeli Claude'a w narzędziu Foundry, zobacz blog dla deweloperów Microsoft.

Możliwości modelu

Sposoby sterowania Claude’em i jego bezpośrednimi odpowiedziami, w tym formatem odpowiedzi, głębokością rozumowania i modalnościami wejściowymi.

Funkcja Opis
Przesyłanie strumieniowe komunikatów Podczas tworzenia wiadomości ustaw "stream": true, aby strumieniowo przesyłać odpowiedź za pomocą zdarzeń wysyłanych przez serwer (SSE).
Myślenie Ulepszone zdolności rozumowania do złożonych zadań, zapewniające wgląd w tok rozumowania Claude’a krok po kroku przed udzieleniem ostatecznej odpowiedzi. Zobacz Rozumowanie i nakład pracy, aby sprawdzić wartości parametru thinking dla poszczególnych modeli.
Myślenie adaptacyjne Pozwól Claude dynamicznie decydować, kiedy i jak wiele myśleć. Ta funkcja jest jedynym trybem myślenia w modelach Claude'a 4.7 i nowszych. Użyj parametru , effort aby kontrolować głębokość myślenia.
Wysiłek Kontroluj, ile tokenów Claude zużywa podczas generowania odpowiedzi, znajdując kompromis między szczegółowością odpowiedzi a efektywnym wykorzystaniem tokenów. Zobacz Rozumowanie i nakład pracy, aby sprawdzić wartości parametru effort dla poszczególnych modeli.
Cytaty Oprzyj odpowiedzi Claude na źródłach, w tym na blokach treści search_result.
Obrazy i wizja Przetwarzanie i analizowanie zawartości na podstawie obrazów. Hostowane na Azure wdrożeniach akceptują tylko obrazy zakodowane w formacie base64 lub oparte na adresach URL.
Obsługa plików PDF Przetwarzanie i analizowanie tekstu i zawartości wizualnej z dokumentów PDF. Podaj pliki PDF jako base64 lub URL.
Okno kontekstowe 1M Do 1 miliona tokenów do przetwarzania dużych dokumentów, obszernych baz kodu i długich konwersacji. Wsparcie zależy od tego, czy dany model się kwalifikuje.
Dane wyjściowe ze strukturą Ogranicz odpowiedzi Claude'a tak, aby były zgodne z określonym schematem JSON, używając dwóch uzupełniających się funkcji: wyników JSON (parametr output_config.format) do ustrukturyzowanych odpowiedzi oraz ścisłego korzystania z narzędzi (strict: true) do walidowanych danych wejściowych narzędzi. W przypadku wdrożeń hostowanych na platformie Azure ustrukturyzowane dane wyjściowe obsługują również starszy parametr dla danych wyjściowych JSON (parametr output_format).

Myślenie i wysiłek

Funkcja Myślenie umożliwia określenie określonych wartości dla typu parametru thinking w zależności od modelu, zgodnie z opisem w poniższej tabeli. Typ adaptive konfiguruje funkcję myślenia adaptacyjnego , umożliwiając modelowi podjęcie decyzji, czy myśleć, na podstawie złożoności zapytania i poziomu nakładu pracy. Na przykład thinking={"type": "adaptive"}.

Model adaptive enabled disabled
claude-fable-5-1 Yes No No
claude-fable-5 Yes No No
claude-mythos-5-1 Yes No No
claude-mythos-5 Yes No No
claude-mythos-preview Yes Yes No
claude-opus-5-5 Yes No Yes1
claude-opus-5 Yes No Yes1
claude-opus-4-8 Yes No Yes
claude-opus-4-7 Yes No Yes
claude-opus-4-6 Yes Yes Yes
claude-sonnet-5-5 Yes Yes Yes
claude-sonnet-5 Yes No Yes
claude-sonnet-4-6 Yes Yes Yes

1 Myślenie jest dostępne tylko przy poziomie wysiłku disabled lub niższym high

Funkcja Nakład pracy umożliwia określone effort poziomy dla każdego modelu, zgodnie z opisem w poniższej tabeli. Poziom xhigh generuje ten sam wynik co max.

Model low medium high xhigh max
claude-fable-5-1 Yes Yes Yes Yes No
claude-fable-5 Yes Yes Yes Yes No
claude-mythos-5-1 Yes Yes Yes Yes No
claude-mythos-5 Yes Yes Yes Yes No
claude-opus-5-5 Yes Yes Yes Yes Yes
claude-opus-5 Yes Yes Yes Yes Yes
claude-opus-4-8 Yes Yes Yes Yes Yes
claude-opus-4-7 Yes Yes Yes Yes Yes
claude-opus-4-6 Yes Yes Yes No Yes
claude-sonnet-5-5 Yes Yes Yes Yes Yes
claude-sonnet-5 Yes Yes Yes Yes Yes
claude-sonnet-4-6 Yes Yes Yes No Yes

Tools

Pozwól Claude podjąć działania w Internecie lub w twoim środowisku. Ta funkcja składa się z wbudowanych narzędzi, które Claude wywołuje za pomocą polecenia tool_use. Platforma uruchamia narzędzia po stronie serwera i implementuje i wykonuje narzędzia po stronie klienta.

Funkcja Opis
Korzystanie z narzędzi uruchamianych po stronie klienta Narzędzia niestandardowe oraz zdefiniowane przez Anthropic bash, text editor, computer use i memory. Aby uzyskać więcej informacji na temat tych narzędzi, zobacz Bash, Edytor tekstu, Korzystanie z komputera i Pamięć.
Wyszukiwanie w Internecie Odkryj aktualne dane rzeczywiste z całej sieci, aby wykorzystać je do rozszerzania wiedzy Claude'a. W przypadku wdrożeń hostowanych na Azure obsługiwana web_search_20250305 jest tylko wersja narzędzia.
Pobieranie internetowe Pobierać i przeprowadzać dogłębną analizę pełnej treści z określonych stron internetowych i dokumentów PDF, wzbogacając kontekst Claude'a o aktualne treści z internetu. W usłudze Foundry pobieranie z internetu wymaga wdrożenia hostowanego w infrastrukturze Anthropic. W przypadku wdrożeń hostowanych na Azure obsługiwana web_fetch_20250910 jest tylko wersja narzędzia.

Infrastruktura narzędzi

Odkrywaj, koordynuj i skaluj wykorzystanie narzędzi.

Funkcja Opis
Szczegółowe strumieniowanie narzędzi Narzędzie strumienia używa parametrów bez buforowania lub walidacji JSON, zmniejszając opóźnienie dla dużych parametrów. Wymaga nagłówka anthropic-betafine-grained-tool-streaming-2025-05-14.
Łącznik MCP Połącz się ze zdalnymi serwerami MCP bezpośrednio z interfejsu API komunikatów bez oddzielnego klienta MCP.
Wyszukiwanie narzędzi Skaluj do tysięcy narzędzi, dynamicznie odnajdując i ładując narzędzia na żądanie przy użyciu wyszukiwania regularnego i BM25, optymalizując użycie kontekstu i poprawiając dokładność wyboru narzędzi. W przypadku wdrożeń hostowanych na Azure obsługiwane są wersje tool_search_tool_bm25_20251119 narzędzi i .tool_search_tool_regex_20251119 Starsze aliasy tool_search_tool_bm25 i tool_search_tool_regex są również akceptowane.

Zarządzanie kontekstem

Kontrolowanie i optymalizowanie okna kontekstowego Claude'a na potrzeby długotrwałych sesji.

Funkcja Opis
Automatyczne buforowanie monitów Uprość buforowanie promptów do jednego parametru API. System automatycznie zapisuje w pamięci podręcznej ostatni blok podlegający buforowaniu w Twoim żądaniu, przesuwając punkt pamięci podręcznej do przodu w miarę rozrastania się konwersacji.
Buforowanie promptów (5m) Udostępnij Claude'owi więcej wiedzy i przykładowych danych wyjściowych, aby zmniejszyć koszty i opóźnienia.
Buforowanie promptów (1 godz.) Wydłużony do 1 godziny czas przechowywania w pamięci podręcznej dla rzadziej używanego, ale ważnego kontekstu, który uzupełnia standardową 5-minutową pamięć podręczną.
Edytowanie kontekstu Automatyczne zarządzanie kontekstem konwersacji za pomocą konfigurowalnych strategii, w tym czyszczenia wyników narzędzi i zarządzania blokami myślenia. Wymaga nagłówka context-management-2025-06-27antropic-beta .
Zliczanie tokenów Zliczanie tokenów pozwala określić liczbę tokenów w wiadomości przed wysłaniem jej do Claude'a, co pomaga podejmować świadome decyzje dotyczące promptów i sposobu korzystania.

Pliki i zasoby

Zarządzaj dokumentami i danymi, które udostępniasz Claude'owi.

Funkcja Opis
Interfejs API plików Obecnie dostępne tylko w przypadku wdrożeń hostowanych w infrastrukturze Anthropic. Przesyłaj pliki i zarządzaj nimi, aby używać ich w Claude bez konieczności ponownego przesyłania treści z każdym żądaniem. Obsługuje pliki PDF, obrazy i pliki tekstowe.

Obsługa agenta

Typy wdrożeń i regiony

Modele Claude'a w narzędziu Foundry są dostępne dla następujących typów wdrożeń w określonych regionach Azure:

  • Globalny standard: wszystkie modele Claude'a (hostowane w Azure i hostowane w infrastrukturze Anthropic).
  • Data Zone Standard (US): hostowane w Azure wersjach claude-opus-5-5, claude-opus-5, claude-opus-4-8, claude-sonnet-5i claude-sonnet-5-5.

Aby poznać dokładne regiony platformy Azure, w których modele Claude'a są dostępne do wdrożenia, zobacz Dostępność regionów według typu wdrożenia.

Przydziały i ograniczenia szybkości

Limity szybkości dla modeli Claude'a różnią się w zależności od modelu, typu wdrożenia, wersji hostingu i typu subskrypcji Azure. Limity są mierzone w żądaniach na minutę (RPM), niecachedowanych tokenów wejściowych na minutę (ITPM) i tokenów wyjściowych na minutę (OTPM).

Aby uzyskać informacje na temat bieżących limitów, sposobu działania współdzielonego limitu przydziału oraz rozliczania pamięci podręcznej promptów, zobacz Claude model quotas and rate limits.

Zagadnienia dotyczące odpowiedzialnej sztucznej inteligencji

W przypadku korzystania z modeli Claude'a w narzędziu Foundry należy wziąć pod uwagę następujące praktyki odpowiedzialnego używania sztucznej inteligencji:

Najlepsze rozwiązania

Postępuj zgodnie z tymi najlepszymi rozwiązaniami podczas pracy z modelami Claude'a w narzędziu Foundry:

Inżynieria poleceń

  • Jasne instrukcje: podaj konkretne i szczegółowe polecenia.
  • Zarządzanie kontekstem: efektywnie używaj dostępnego okna kontekstowego.
  • Definicje ról: użyj komunikatów systemowych, aby zdefiniować rolę i zachowanie asystenta.
  • Ustrukturyzowane polecenia: użyj spójnego formatowania, aby uzyskać lepsze wyniki.

Optymalizacja kosztów

Aby zoptymalizować użycie i uniknąć ograniczania szybkości:

  • Zaimplementuj logikę ponawiania: Przetwarzaj odpowiedzi 429 z eksponencjalnym opóźnieniem.
  • Żądania wsadowe: Połącz wiele żądań, jeśli to możliwe.
  • Monitorowanie użycia tokenu: śledzenie użycia tokenu i wzorców żądań.
  • Stosuj odpowiednie modele: stosuj najbardziej opłacalny model do swojego przypadku użycia. Zobacz Dostępne modele Claude'a.