Notatka
Dostęp do tej strony wymaga autoryzacji. Może spróbować zalogować się lub zmienić katalogi.
Dostęp do tej strony wymaga autoryzacji. Możesz spróbować zmienić katalogi.
Modele Claude firmy Anthropic wnoszą do Microsoft Foundry zaawansowane możliwości konwersacyjnej sztucznej inteligencji, zapewniając najnowocześniejsze rozumienie i generowanie języka na potrzeby inteligentnych aplikacji. Modele Claude doskonale radzą sobie ze złożonymi zadaniami związanymi z rozumowaniem, generowaniem kodu i zadaniami wielomodalnymi, w tym analizą obrazów. W tym artykule opisano dostępne modele Claude'a, sposób ich hostowania i naliczania opłat, obsługiwanych interfejsów API, możliwości i najlepszych rozwiązań.
Aby wdrożyć i wywołać model Claude'a, zobacz Deploy and use Claude models in Microsoft Foundry (Wdrażanie i używanie modeli Claude'a w usłudze Microsoft Foundry).
Important
Elementy oznaczone podglądem w tym artykule są obecnie w wersji zapoznawczej. Ta wersja zapoznawcza jest udostępniana bez umowy dotyczącej poziomu usług, a Microsoft nie zaleca korzystania z niej w przypadku obciążeń produkcyjnych. Niektóre funkcje mogą nie być obsługiwane lub mogą mieć ograniczone możliwości. Aby uzyskać więcej informacji, zobacz Warunki dodatkowe korzystania z testowych wersji Microsoft Azure.
Jak modele Claude'a są hostowane i rozliczane
Microsoft Foundry oferuje modele Claude'a w dwóch wersjach:
- Wersja 1: hostowana w infrastrukturze Anthropic; te modele działają w infrastrukturze Anthropic (poza Azure).
- Wersja 2: hostowana na Azure; te modele działają na kompleksowej infrastrukturze Azure i są ogólnie dostępne .
Nie wszystkie modele są dostępne w obu wersjach. Etap cyklu życia modelu, taki jak wersja zapoznawcza lub ogólnie dostępny, może się różnić między dwiema wersjami. Aby uzyskać informacje o dostępności i stanie cyklu życia modelu, zobacz Dostępne modele Claude'a.
Aby porównać obie opcje hostingu pod względem rezydencji danych, umów SLA, kanałów pomocy technicznej, zgodności i procesu zakupu, zobacz Porównanie modeli Claude hostowanych na platformie Azure i hostowanych przez Anthropic.
Note
Masz dostęp do modeli Claude w usłudze Microsoft Foundry za pośrednictwem modeli Foundry od partnerów i społeczności. Modele partnerów i społeczności, które Anthropic sprzedaje i obsługuje, są Produktami innymi niż firmy Microsoft zgodnie z dokumentem Product Terms.
Modele Claude w usłudze Foundry wymagają subskrypcji w usłudze Azure Marketplace i są rozliczane w jednostkach zużycia Claude (CCU). Przed wdrożeniem upewnij się, że masz uprawnienia wymagane do subskrybowania ofert modeli. Aby uzyskać szczegółowe informacje o cenach, zobacz Rozliczanie jednostek zużycia Claude (CCU) w usłudze Microsoft Foundry.
Dostępne modele Claude'a
Important
Następujące modele Claude'a są zgodne ze standardem znakowania wodnego UE: claude-mythos-5-1, claude-fable-5-1 i claude-fable-5.
Chociaż claude-fable-5 używa znakowania wodnego jednym kluczem, claude-mythos-5-1 i claude-fable-5-1 używają dwóch kluczy (przeplatanego układu 2-kluczowego i C2PA) w następujący sposób:
- Znak wodny przeplatanego tekstu (drugi klucz): dodano drugi klucz do wykrywania przeplatanego znaku wodnego zgodnie z normami UE. Dodawanie znaku wodnego odbywa się po stronie serwera podczas generowania; nie powoduje to zmian w strukturze żądania ani odpowiedzi. Oddzielne API do wykrywania znaków wodnych jest dostępne we wczesnym dostępie i nie wchodzi w zakres premierowego wydania Foundry.
- Znakowanie wodne C2PA: oznaczanie pochodzenia treści C2PA, obsługiwane po stronie serwera/klienta przez interfejsy Anthropic. Brak zmiany kształtu interfejsu API.
W poniższej tabeli porównano dostępność modelu dla obu wersji modeli Claude'a w narzędziu Foundry. Aby uzyskać szczegółowe informacje na temat funkcji, do których odwołuje się tabela, zobacz sekcję Możliwości i funkcje zaawansowane .
W przypadku błędów, które mogą wystąpić podczas wdrażania lub wywoływania modeli Claude'a, zobacz Wdrażanie i używanie modeli Claude'a: Rozwiązywanie problemów.
| Model | Availability | Okno kontekstowe / Maksymalna liczba danych wyjściowych | Kluczowe możliwości | Najlepsze dla |
|---|---|---|---|---|
claude-fable-5-1 |
|
1M /128K |
|
|
claude-fable-5 |
|
1M /128K |
|
|
claude-mythos-5-1
2 |
|
1M /128K |
|
|
claude-mythos-5
2 |
|
1M /128K |
|
|
claude-mythos-preview
2 |
|
1M /128K |
|
|
claude-opus-5-5 |
|
1M /128K |
|
|
claude-opus-5 |
|
1M /128K |
|
|
claude-opus-4-8 |
|
1M /128K |
|
|
claude-opus-4-7 |
|
1M /128K |
|
|
claude-opus-4-6 |
|
1M /128K |
|
|
claude-opus-4-5 |
|
200K/64K |
|
|
claude-sonnet-5-5 |
|
1M /128K |
|
|
claude-sonnet-5 |
|
1M /128K |
|
|
claude-sonnet-4-6 |
|
1M /128K |
|
|
claude-sonnet-4-5 |
|
200K/64K |
|
|
claude-haiku-4-5 |
|
200K/64K |
|
|
1Claude Fable 5 i Claude Fable 5.1 stosują dodatkowe klasyfikatory wejściowe/wyjściowe, które mogą odrzucać żądania, jeśli zawartość wyzwala zasady zabezpieczeń podwójnego użycia. W przypadku odmowy żądanie zwraca pomyślną (200) odpowiedź ze wskaźnikiem stop_reason: "refusal" odmowy zamiast zawartości wygenerowanej przez model. Nie są naliczane opłaty za tokeny wejściowe, które są odrzucane.
2Claude Mythos 5-1, Claude Mythos 5 i Claude Mythos Preview są dostępne tylko jako gated research preview. Dostęp do modeli jest przyznawany wyłącznie według uznania firmy Anthropic i w pierwszej kolejności przeznaczony dla zastosowań w obszarze obronnego cyberbezpieczeństwa. Zobacz kartę systemowa Claude Fable 5.1 i Claude Mythos 5.1, kartę systemowa Claude'a Mitosa 5 oraz kartę systemowego Claude'a Mythos Preview , aby uzyskać wskazówki dotyczące odpowiedzialnego korzystania.
3 Ustawienia nakładu pracy na turę, W trakcie rozmowy i Budżety tokenów są obecnie w fazie beta.
Przegląd interfejsu API
W poniższej tabeli wymieniono interfejsy API, których można użyć do interakcji zarówno z hostowanymi na Azure, jak i hostowanymi w wersjach infrastruktury Anthropic modeli Claude'a w narzędziu Foundry.
Użyj zestawów SDK Anthropic i następujących interfejsów API od Claude:
Tip
Wersja modeli Claude w Foundry hostowana w infrastrukturze Anthropic obsługuje więcej interfejsów API niż wymienione w tej tabeli. Można je zobaczyć na stronie dokumentacji interfejsu API Claude: omówienie interfejsu API.
| API | Opis |
|---|---|
Komunikaty1 (POST /v1/messages) |
Podstawowe API komunikatów: wysyłaj uporządkowaną listę komunikatów wejściowych z treścią tekstową lub obrazową, w tym odpowiedzi strumieniowe. Model generuje następny komunikat w konwersacji. |
Zliczanie tokenów (POST /v1/messages/count_tokens) |
API do zliczania tokenów: Zlicz liczbę tokenów w komunikacie przed wysłaniem go do Claude'a. |
1Interfejs API komunikatów można wywołać z pakietu Python, pakietu JavaScript lub bezpośrednio za pośrednictwem interfejsu anthropic@anthropic-ai/foundry-sdk REST. Punkt końcowy wdrożenia jest zgodny z kształtem https://<resource-name>.services.ai.azure.com/anthropic/v1/messages, a klienci REST i JavaScript używają nagłówka anthropic-version: 2023-06-01 .
Możliwości i funkcje zaawansowane
Modele Claude'a w narzędziu Foundry udostępniają podstawowe możliwości przetwarzania, analizowania i generowania zawartości oraz narzędzi , które umożliwiają Claude'owi interakcję z systemami zewnętrznymi, wykonywanie kodu i wykonywanie zautomatyzowanych zadań. Powierzchnia interfejsu API Claude'a jest zorganizowana w pięć obszarów:
Poniższe sekcje i tabele podsumowują możliwości dostępne w wersjach modeli Claude w usłudze Foundry: hostowanych na platformie Azure oraz hostowanych w infrastrukturze Anthropic. O ile nie wspomniano, możliwość ma zastosowanie do obu wersji.
Tip
Wersja modeli Claude w Foundry hostowana w infrastrukturze Anthropic oferuje więcej funkcji, niż wymieniono w tych tabelach. Pełną listę funkcji można znaleźć w witrynie Claude Platform Docs: Omówienie funkcji.
Aby uzyskać więcej informacji na temat dostępnych możliwości i zaawansowanych funkcji dla modeli Claude'a w narzędziu Foundry, zobacz blog dla deweloperów Microsoft.
Możliwości modelu
Sposoby sterowania Claude’em i jego bezpośrednimi odpowiedziami, w tym formatem odpowiedzi, głębokością rozumowania i modalnościami wejściowymi.
| Funkcja | Opis |
|---|---|
| Przesyłanie strumieniowe komunikatów | Podczas tworzenia wiadomości ustaw "stream": true, aby strumieniowo przesyłać odpowiedź za pomocą zdarzeń wysyłanych przez serwer (SSE). |
| Myślenie | Ulepszone zdolności rozumowania do złożonych zadań, zapewniające wgląd w tok rozumowania Claude’a krok po kroku przed udzieleniem ostatecznej odpowiedzi. Zobacz Rozumowanie i nakład pracy, aby sprawdzić wartości parametru thinking dla poszczególnych modeli. |
| Myślenie adaptacyjne | Pozwól Claude dynamicznie decydować, kiedy i jak wiele myśleć. Ta funkcja jest jedynym trybem myślenia w modelach Claude'a 4.7 i nowszych. Użyj parametru , effort aby kontrolować głębokość myślenia. |
| Wysiłek | Kontroluj, ile tokenów Claude zużywa podczas generowania odpowiedzi, znajdując kompromis między szczegółowością odpowiedzi a efektywnym wykorzystaniem tokenów. Zobacz Rozumowanie i nakład pracy, aby sprawdzić wartości parametru effort dla poszczególnych modeli. |
| Cytaty | Oprzyj odpowiedzi Claude na źródłach, w tym na blokach treści search_result. |
| Obrazy i wizja | Przetwarzanie i analizowanie zawartości na podstawie obrazów. Hostowane na Azure wdrożeniach akceptują tylko obrazy zakodowane w formacie base64 lub oparte na adresach URL. |
| Obsługa plików PDF | Przetwarzanie i analizowanie tekstu i zawartości wizualnej z dokumentów PDF. Podaj pliki PDF jako base64 lub URL. |
| Okno kontekstowe 1M | Do 1 miliona tokenów do przetwarzania dużych dokumentów, obszernych baz kodu i długich konwersacji. Wsparcie zależy od tego, czy dany model się kwalifikuje. |
| Dane wyjściowe ze strukturą | Ogranicz odpowiedzi Claude'a tak, aby były zgodne z określonym schematem JSON, używając dwóch uzupełniających się funkcji: wyników JSON (parametr output_config.format) do ustrukturyzowanych odpowiedzi oraz ścisłego korzystania z narzędzi (strict: true) do walidowanych danych wejściowych narzędzi. W przypadku wdrożeń hostowanych na platformie Azure ustrukturyzowane dane wyjściowe obsługują również starszy parametr dla danych wyjściowych JSON (parametr output_format). |
Myślenie i wysiłek
Funkcja Myślenie umożliwia określenie określonych wartości dla typu parametru thinking w zależności od modelu, zgodnie z opisem w poniższej tabeli. Typ adaptive konfiguruje funkcję myślenia adaptacyjnego , umożliwiając modelowi podjęcie decyzji, czy myśleć, na podstawie złożoności zapytania i poziomu nakładu pracy. Na przykład thinking={"type": "adaptive"}.
| Model | adaptive |
enabled |
disabled |
|---|---|---|---|
claude-fable-5-1 |
Yes | No | No |
claude-fable-5 |
Yes | No | No |
claude-mythos-5-1 |
Yes | No | No |
claude-mythos-5 |
Yes | No | No |
claude-mythos-preview |
Yes | Yes | No |
claude-opus-5-5 |
Yes | No | Yes1 |
claude-opus-5 |
Yes | No | Yes1 |
claude-opus-4-8 |
Yes | No | Yes |
claude-opus-4-7 |
Yes | No | Yes |
claude-opus-4-6 |
Yes | Yes | Yes |
claude-sonnet-5-5 |
Yes | Yes | Yes |
claude-sonnet-5 |
Yes | No | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes |
1 Myślenie jest dostępne tylko przy poziomie wysiłku disabled lub niższym high
Funkcja Nakład pracy umożliwia określone effort poziomy dla każdego modelu, zgodnie z opisem w poniższej tabeli. Poziom xhigh generuje ten sam wynik co max.
| Model | low |
medium |
high |
xhigh |
max |
|---|---|---|---|---|---|
claude-fable-5-1 |
Yes | Yes | Yes | Yes | No |
claude-fable-5 |
Yes | Yes | Yes | Yes | No |
claude-mythos-5-1 |
Yes | Yes | Yes | Yes | No |
claude-mythos-5 |
Yes | Yes | Yes | Yes | No |
claude-opus-5-5 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-5 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-8 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-7 |
Yes | Yes | Yes | Yes | Yes |
claude-opus-4-6 |
Yes | Yes | Yes | No | Yes |
claude-sonnet-5-5 |
Yes | Yes | Yes | Yes | Yes |
claude-sonnet-5 |
Yes | Yes | Yes | Yes | Yes |
claude-sonnet-4-6 |
Yes | Yes | Yes | No | Yes |
Tools
Pozwól Claude podjąć działania w Internecie lub w twoim środowisku. Ta funkcja składa się z wbudowanych narzędzi, które Claude wywołuje za pomocą polecenia tool_use. Platforma uruchamia narzędzia po stronie serwera i implementuje i wykonuje narzędzia po stronie klienta.
| Funkcja | Opis |
|---|---|
| Korzystanie z narzędzi uruchamianych po stronie klienta | Narzędzia niestandardowe oraz zdefiniowane przez Anthropic bash, text editor, computer use i memory. Aby uzyskać więcej informacji na temat tych narzędzi, zobacz Bash, Edytor tekstu, Korzystanie z komputera i Pamięć. |
| Wyszukiwanie w Internecie | Odkryj aktualne dane rzeczywiste z całej sieci, aby wykorzystać je do rozszerzania wiedzy Claude'a. W przypadku wdrożeń hostowanych na Azure obsługiwana web_search_20250305 jest tylko wersja narzędzia. |
| Pobieranie internetowe | Pobierać i przeprowadzać dogłębną analizę pełnej treści z określonych stron internetowych i dokumentów PDF, wzbogacając kontekst Claude'a o aktualne treści z internetu. W usłudze Foundry pobieranie z internetu wymaga wdrożenia hostowanego w infrastrukturze Anthropic. W przypadku wdrożeń hostowanych na Azure obsługiwana web_fetch_20250910 jest tylko wersja narzędzia. |
Infrastruktura narzędzi
Odkrywaj, koordynuj i skaluj wykorzystanie narzędzi.
| Funkcja | Opis |
|---|---|
| Szczegółowe strumieniowanie narzędzi | Narzędzie strumienia używa parametrów bez buforowania lub walidacji JSON, zmniejszając opóźnienie dla dużych parametrów. Wymaga nagłówka anthropic-betafine-grained-tool-streaming-2025-05-14. |
| Łącznik MCP | Połącz się ze zdalnymi serwerami MCP bezpośrednio z interfejsu API komunikatów bez oddzielnego klienta MCP. |
| Wyszukiwanie narzędzi | Skaluj do tysięcy narzędzi, dynamicznie odnajdując i ładując narzędzia na żądanie przy użyciu wyszukiwania regularnego i BM25, optymalizując użycie kontekstu i poprawiając dokładność wyboru narzędzi. W przypadku wdrożeń hostowanych na Azure obsługiwane są wersje tool_search_tool_bm25_20251119 narzędzi i .tool_search_tool_regex_20251119 Starsze aliasy tool_search_tool_bm25 i tool_search_tool_regex są również akceptowane. |
Zarządzanie kontekstem
Kontrolowanie i optymalizowanie okna kontekstowego Claude'a na potrzeby długotrwałych sesji.
| Funkcja | Opis |
|---|---|
| Automatyczne buforowanie monitów | Uprość buforowanie promptów do jednego parametru API. System automatycznie zapisuje w pamięci podręcznej ostatni blok podlegający buforowaniu w Twoim żądaniu, przesuwając punkt pamięci podręcznej do przodu w miarę rozrastania się konwersacji. |
| Buforowanie promptów (5m) | Udostępnij Claude'owi więcej wiedzy i przykładowych danych wyjściowych, aby zmniejszyć koszty i opóźnienia. |
| Buforowanie promptów (1 godz.) | Wydłużony do 1 godziny czas przechowywania w pamięci podręcznej dla rzadziej używanego, ale ważnego kontekstu, który uzupełnia standardową 5-minutową pamięć podręczną. |
| Edytowanie kontekstu | Automatyczne zarządzanie kontekstem konwersacji za pomocą konfigurowalnych strategii, w tym czyszczenia wyników narzędzi i zarządzania blokami myślenia. Wymaga nagłówka context-management-2025-06-27antropic-beta . |
| Zliczanie tokenów | Zliczanie tokenów pozwala określić liczbę tokenów w wiadomości przed wysłaniem jej do Claude'a, co pomaga podejmować świadome decyzje dotyczące promptów i sposobu korzystania. |
Pliki i zasoby
Zarządzaj dokumentami i danymi, które udostępniasz Claude'owi.
| Funkcja | Opis |
|---|---|
| Interfejs API plików | Obecnie dostępne tylko w przypadku wdrożeń hostowanych w infrastrukturze Anthropic. Przesyłaj pliki i zarządzaj nimi, aby używać ich w Claude bez konieczności ponownego przesyłania treści z każdym żądaniem. Obsługuje pliki PDF, obrazy i pliki tekstowe. |
Obsługa agenta
- Program Microsoft Agent Framework obsługuje tworzenie agentów korzystających z modeli Claude'a.
- Tworzenie niestandardowych agentów sztucznej inteligencji przy użyciu zestawu SDK agenta Claude'a.
Typy wdrożeń i regiony
Modele Claude'a w narzędziu Foundry są dostępne dla następujących typów wdrożeń w określonych regionach Azure:
- Globalny standard: wszystkie modele Claude'a (hostowane w Azure i hostowane w infrastrukturze Anthropic).
-
Data Zone Standard (US): hostowane w Azure wersjach
claude-opus-5-5,claude-opus-5,claude-opus-4-8,claude-sonnet-5iclaude-sonnet-5-5.
Aby poznać dokładne regiony platformy Azure, w których modele Claude'a są dostępne do wdrożenia, zobacz Dostępność regionów według typu wdrożenia.
Przydziały i ograniczenia szybkości
Limity szybkości dla modeli Claude'a różnią się w zależności od modelu, typu wdrożenia, wersji hostingu i typu subskrypcji Azure. Limity są mierzone w żądaniach na minutę (RPM), niecachedowanych tokenów wejściowych na minutę (ITPM) i tokenów wyjściowych na minutę (OTPM).
Aby uzyskać informacje na temat bieżących limitów, sposobu działania współdzielonego limitu przydziału oraz rozliczania pamięci podręcznej promptów, zobacz Claude model quotas and rate limits.
Zagadnienia dotyczące odpowiedzialnej sztucznej inteligencji
W przypadku korzystania z modeli Claude'a w narzędziu Foundry należy wziąć pod uwagę następujące praktyki odpowiedzialnego używania sztucznej inteligencji:
Przejrzyj dane, prywatność i zabezpieczenia modeli Claude'a w Microsoft Foundry, aby dowiedzieć się, jak dane są przetwarzane i zachowywane podczas wdrażania modeli Claude'a.
Skonfiguruj bezpieczeństwo zawartości sztucznej inteligencji podczas wnioskowania modelu, ponieważ rozwiązanie Foundry nie zapewnia wbudowanego filtrowania zawartości dla modeli Claude'a podczas wdrażania.
Upewnij się, że aplikacje są zgodne z zasadami akceptowalnego użycia Anthropic. Zobacz również szczegółowe informacje na temat ocen bezpieczeństwa modeli Claude Fable 5.1 i Claude Mythos 5.1 , Claude Fable 5, Claude Mythos 5, Claude Mythos Preview, Claude Opus 5.5, Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Opus 4.5, Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5 oraz Claude Haiku 4.5.
Najlepsze rozwiązania
Postępuj zgodnie z tymi najlepszymi rozwiązaniami podczas pracy z modelami Claude'a w narzędziu Foundry:
Inżynieria poleceń
- Jasne instrukcje: podaj konkretne i szczegółowe polecenia.
- Zarządzanie kontekstem: efektywnie używaj dostępnego okna kontekstowego.
- Definicje ról: użyj komunikatów systemowych, aby zdefiniować rolę i zachowanie asystenta.
- Ustrukturyzowane polecenia: użyj spójnego formatowania, aby uzyskać lepsze wyniki.
Optymalizacja kosztów
Aby zoptymalizować użycie i uniknąć ograniczania szybkości:
- Zaimplementuj logikę ponawiania: Przetwarzaj odpowiedzi 429 z eksponencjalnym opóźnieniem.
- Żądania wsadowe: Połącz wiele żądań, jeśli to możliwe.
- Monitorowanie użycia tokenu: śledzenie użycia tokenu i wzorców żądań.
- Stosuj odpowiednie modele: stosuj najbardziej opłacalny model do swojego przypadku użycia. Zobacz Dostępne modele Claude'a.
Treści powiązane
- Wdrażaj i używaj modeli Claude w Microsoft Foundry
- Wdróż modele Claude w usłudze Microsoft Foundry za pomocą narzędzi Bicep lub Terraform
- Modele Foundry od partnerów i społeczności
- Rozliczanie jednostek wykorzystania Claude (CCU) w Microsoft Foundry
- Dane, prywatność i zabezpieczenia modeli Claude'a w usłudze Microsoft Foundry