Planuj wdrożenia agentów Copilot Studio pod kątem przepływności i limitów szybkości

Agenty Copilot Studio gotowe do wdrożenia produkcyjnego wymagają czegoś więcej niż tylko licencji i planowania całkowitego wolumenu komunikatów. Potrzebują również planowania przepływności. Planowanie przepływności obejmuje, jak szybko dociera ruch, które usługi platformy wywołuje rozwiązanie i które limity mają zastosowanie w całym rozwiązaniu.

Ten artykuł pomaga architektom rozwiązań, twórcom i administratorom usługi Power Platform przygotować wdrożenia w usłudze Copilot Studio obsługujące duży wolumen do obsługi ruchu produkcyjnego, testów akceptacyjnych użytkowników (UAT), testów obciążeniowych, scenariuszy business-to-customer (B2C) oraz autonomicznych obciążeń.

Aprowizacja stawek jest odrębna od aprowizacji licencji

Planowanie wdrożenia produkcyjnego w Copilot Studio obejmuje dwa powiązane, ale odrębne obszary prac:

  • Udostępnianie licencji obejmuje uprawnienia komercyjne i korzystanie, takie jak licencje, kredyty, pojemność opłacona z góry, pakiety wiadomości i rozliczanie zgodnie z rzeczywistym użyciem.
  • Przepustowość określa, jak szybko ruch może być przetwarzany, zanim zostanie zastosowane ograniczanie przepustowości lub mechanizmy ochrony usługi.

Note

Microsoft używa terminu quotas dla limitów szybkości Copilot Studio. W szerszej terminologii branżowej to działanie często określa się jako konfigurowanie stawek. Przejrzyj opublikowane limity, szacuj szczytowe stawki żądań i zaplanuj przed nadejściem ruchu produkcyjnego.

Rozliczanie według rzeczywistego użycia może zwiększyć dostępne limity w porównaniu z konfiguracjami o niższej pojemności, ale przepływność nie jest nieskończona. Sprawdź bieżące limity Copilot Studio, alokacje żądań platformy Power Platform, limity Power Automate, limity ochrony usługi Dataverse, reguły ograniczania przepustowości łącznika i limity interfejsu API podrzędnego.

Co się stanie przy ograniczaniu przepustowości?

Ograniczanie przepustowości jest mechanizmem ochrony usługi. Chroni usługi współdzielone przed wzorcami ruchu przekraczającymi opublikowane limity, mechanizmy ograniczania nagłych skoków ruchu lub wydajność usługi. Konkretny objaw zależy od tego, która usługa podlega ograniczeniom.

Po osiągnięciu limitu konsekwencja jest większa niż problem z planowaniem. Żądania mogą być ograniczane, opóźniane, blokowane lub odrzucane. W czatach skierowanych do użytkownika to zachowanie może być wyświetlane jako tymczasowe przerwy w działaniu usługi. Na przykład użytkownik może nie być w stanie wysłać następnego komunikatu, odebrać komunikat o niedostępności agenta lub limitu użycia albo napotkać błąd, ponieważ przepływ, łącznik, wywołanie usługi Dataverse, usługa AI lub podrzędny interfejs API osiągnął limit.

Dowiedz się więcej o objawach i komunikatach o błędach charakterystycznych dla usługi Copilot Studio w artykule Rozwiązywanie błędów związanych z limitami użycia w agentach.

Jak są mierzone limity szybkości

Limity szybkości mierzą, ile ruchu może zaakceptować usługa w określonym przedziale czasu. Pomyśl o tych oknach szczegółowie: na minutę, na pięć minut, na 10 minut, na godzinę, dziennie, na tydzień i miesiąc. Miesięczny lub tygodniowy wolumen pomaga oszacować całkowite zapotrzebowanie, ale krótsze przedziały czasowe mają znaczenie przy planowaniu przepustowości, ponieważ dławienie często wynika ze skoncentrowanego ruchu.

Na przykład firma B2C może otrzymywać większość ruchu agentów w ciągu jednej ukierunkowanej godziny kampanii. Średnia tygodniowa może wyglądać na niską, ale ta jedna godzina nadal może stworzyć wystarczającą ilość ciśnienia przepływności, aby spowodować ograniczanie przepustowości lub przerwy w działaniu usługi. Projekt, który wygląda bezpiecznie na poziomie tygodniowym lub miesięcznym, może nadal przekraczać limity w ciągu jednej godziny szczytu.

Omówienie zakresu limitów

Limity nie mają zastosowania tylko na poziomie poszczególnych agentów. W zależności od usługi mogą one być stosowane na poziomie środowiska, na poziomie narzędzia, na poziomie interfejsu API, poziomie łącznika, poziomie kanału lub poziomie usługi podrzędnej.

Na przykład limity liczby komunikatów do agenta w usłudze Copilot Studio są określane osobno dla każdego środowiska Dataverse. Podczas szacowania ruchu uwzględnij wszystkie źródła, które wysyłają komunikaty do agentów w tym środowisku, w tym kanały dostępne dla użytkowników, integracje, autonomiczne obciążenia i umiejętności Azure Bot Framework. Sprawdź bieżące wartości oraz limity w Limitach przydziału i ograniczeniach w Copilot Studio.

Zdecyduj, czy konfiguracja szybkości dotyczy Twojego agenta

Nie każdy agent wymaga szczegółowej konfiguracji stawek. Prosty wewnętrzny agent FAQ z małą grupą odbiorców, o przewidywalnym użyciu i z niewielką liczbą wywołań podrzędnych lub bez takich wywołań raczej nie natrafi na limity szybkości. Przydzielanie limitów staje się istotne, gdy agent może przekroczyć limity liczby żądań na minutę lub na godzinę, nawet jeśli jego miesięczny wolumen wydaje się niewielki.

Pomyśl o oczekiwanym ruchu na wczesnym etapie projektu wraz z projektem rozwiązania. Przed rozpoczęciem testowania akceptacyjnego użytkownika i testowania obciążenia zespół powinien mieć pewność, że projekt agenta, środowisko, połączone usługi i systemy podrzędne mogą obsługiwać oczekiwany profil przepływności.

Te wskazówki mają największe znaczenie w przypadku większych, bardziej obciążonych agentów klasy korporacyjnej, gdy ruch może napływać skokowo, agent może być wywoływany jednocześnie przez wielu użytkowników lub wiele zdarzeń, albo każda interakcja zależy od wielu usług platformowych. Można go również zastosować do mniejszych agentów z skoncentrowanymi wzorcami użycia, takimi jak krótkie okno uruchamiania, zdarzenie dla całego działu, zaplanowany proces lub przepływ pracy, który tworzy wiele żądań w ciągu kilku minut.

B2C i autonomiczni agenci wymagają wczesnego ustalania stawek

Agenci B2C obsługujący klientów mogą otrzymywać ruch z kampanii, publicznych stron internetowych, portali klientów, komunikatów o incydentach, premier produktów lub sezonowego popytu. Agenci autonomiczni mogą generować ruch o wysokiej częstotliwości z harmonogramów, zdarzeń, procesów w tle lub podczas wywoływania wielu narzędzi i przepływów pracy.

Wskazówka

Traktuj przypadki użycia B2C i autonomicznych systemów jako podstawowe scenariusze aprowizowania stawek. Mogą generować skokowy ruch, wiele jednoczesnych żądań oraz częstą aktywność w tle szybciej niż wiele interakcji czatowych używanych przez pracowników.

Uwzględniaj okresy szczytowego obciążenia, a nie tylko sumy miesięczne

Zapytaj, czy agent może tworzyć skoncentrowane żądania w ciągu minuty lub godziny. Nawet mniejszy scenariusz może nadal wymagać przydzielania przepustowości, jeśli test obciążenia, kampania, reakcja na awarię lub automatyczny wyzwalacz powodują w krótkim czasie zbyt dużą liczbę komunikatów, wywołań generatywnej SI, akcji przepływów pracy, wywołań łączników lub żądań usługi Dataverse w środowisku.

Miesięczny wolumen jest przydatny do szacowania całkowitego zapotrzebowania, ale nie wystarcza do planowania wymaganej przepustowości. Przelicz przewidywane użycie na mniejsze przedziały czasu, aby porównać założenia projektu z bieżącymi limitami żądań na minutę (RPM), żądań na godzinę (RPH), limitami nagłych skoków ruchu oraz limitami dziennymi opisanymi na podlinkowanych stronach.

Utwórz zarówno średni profil ruchu, jak i profil szczytowego ruchu. Jeśli na przykład większość ruchu odbywa się codziennie od 17:00 do 18:00, szczyt godzinowy powinien odzwierciedlać to stężenie. Dzienne oszacowanie nie musi wynosić 24 razy w godzinach szczytu, jeśli ruch jest skoncentrowany w jednym oknie.

Wykorzystaj te szacunki do określenia rozmiaru i weryfikacji projektu. Szacunki nie są wystarczającym uzasadnieniem dla wniosku o zwiększenie przepustowości. Żądania są analizowane względem obserwowanego ruchu z fazy pilotażowej, jak opisano w Uruchom fazę pilotażową przed złożeniem wniosku o zwiększenie przepustowości.

Kiedy jeszcze może wystąpić ograniczanie przepustowości?

Ograniczanie przepustowości może również wystąpić, gdy:

  • Duża populacja pracowników korzysta z agenta w przewidywalnym przedziale szczytowym, takim jak zdarzenie lub szkolenie dla całego działu.
  • Kampania marketingowa, awaria, uruchomienie lub zaplanowane wydarzenie biznesowe powoduje krótki wzrost ruchu.
  • Przepływy usługi Power Automate obejmują pętle, ponowienia, paginację lub przepływy podrzędne, które zwiększają liczbę żądań.
  • Raportowanie, audyt, eksport telemetrii lub przechwytywanie transkrypcji odbywają się synchronicznie w ścieżce przetwarzania tury użytkownika.
  • Wielu agentów lub obciążeń współużytkuje to samo środowisko, tożsamość, łącznik lub podrzędną pojemność interfejsu API.
  • Testy obciążeniowe narastają szybciej, niż architektura produkcyjna lub proces wsparcia są przygotowane, by sobie z nimi poradzić.

Gdzie szukać odpowiednich limitów szybkości

Copilot Studio ma własne limity, a ścieżka środowiska uruchomieniowego agenta może obejmować inne usługi z własnymi limitami. Przejrzyj wszystkie odpowiednie limity dla usług używanych przez agenta.

Ograniczenia Copilot Studio

Obszar konfiguracji przepustowości Czego szukać Gdzie sprawdzić bieżące wartości Korzystanie
Komunikaty do agenta Aktualne limity RPM i RPH oraz zakres wiadomości wysyłanych do agenta. Przydziały i limity Copilot Studio Porównaj oczekiwane komunikaty na minutę i godzinę dla docelowego środowiska Dataverse.
Generowanie komunikatów sztucznej inteligencji Bieżący limit dla orkiestracji generatywnej, akcji agenta, narzędzi AI, akcji przepływu pracy agenta i odpowiedzi generatywnych. Generowanie komunikatów sztucznej inteligencji do agenta Modeluj scenariusze w dużym stopniu wykorzystujące AI i scenariusze autonomiczne względem obecnie opublikowanych limitów.
Węzły wyzwalacza autonomicznego Bieżące limity, które mają zastosowanie, gdy agent autonomiczny jest wyzwalany przez zdarzenia, harmonogramy lub procesy w tle. Przydziały i limity Copilot Studio Modelowanie obciążeń sterowanych zdarzeniami i zaplanowanych niezależnie od ruchu interaktywnego na czacie.
limity żądań subskrypcji Copilot Studio Bieżące limity żądań platformy Power Platform mające zastosowanie do korzystania z Copilot Studio. Copilot Studio limity subskrypcji Użyj tych wartości wraz z planowaniem limitu szybkości dla przepływów, usługi Dataverse i połączonych usług.

Inne limity platformy do rozważenia

Najniższy limit w ścieżce środowiska uruchomieniowego określa środowisko użytkownika. Agent w Copilot Studio może pozostawać w granicach swoich limitów, podczas gdy przepływ, łącznik, wywołanie usługi Dataverse, usługa językowa lub zewnętrzne API podlega ograniczaniu.

Note

Inne ograniczenia platformy mogą wpływać na agenta, jeśli używa on innych komponentów na ścieżce żądania agenta. Weź pod uwagę te limity, w tym platformę Power Platform, Power Automate, usługę Dataverse, łączniki, usługi językowe i systemy podrzędne.

Obszar środowiska uruchomieniowego Co należy zobaczyć Pytania dotyczące konfigurowania stawek Gdzie sprawdzić bieżące limity
Płaszczyzna żądań platformy Power Platform Żądania w usługach Power Automate, wywołaniach przepływów pracy w Copilot Studio, użyciu Dataverse, Power Apps i Dynamics 365. Który użytkownik, połączenie, użytkownik aplikacji lub jednostka usługi generuje żądania? Czy alokacje żądań są wystarczające dla oczekiwanego obciążenia dziennego i szczytowego? Żądania, limity i alokacje
Przepływy usługi Power Automate Wyzwalacze, akcje, pętle, przepływy podrzędne, akcje HTTP, akcje łącznika, ponawianie prób, paginacja i współbieżność. Ile akcji jest tworzonych na turę agenta? Czy limity skokowe, współbieżności, wyzwalacza i łącznika wchodzą w zakres? Omówienie limitów platformy i unikanie ograniczania przepustowości
Limity zautomatyzowanych, zaplanowanych i błyskawicznych przepływów
Dataverse Operacje CRUD, wtyczki, przepływy pracy, operacje przypisywania/udostępniania, wywołania łącznika i operacje systemowe wymagane do ukończenia transakcji. Którzy użytkownicy, użytkownicy aplikacji lub jednostki główne usługi generują wywołania do usługi Dataverse? Czy będą miały zastosowanie limity ochrony usługi lub mechanizm ponawiania prób? Limity API ochrony usługi
Omówienie limitów interfejsu AP usługi Dataverse
Connectors Standardowe konektory, konektory premium, konektory niestandardowe, ograniczanie przepustowości dla poszczególnych konektorów oraz interfejsy API systemów podrzędnych. Który łącznik jest wąskim gardłem? Czy usługa podrzędna wymusza własny limit szybkości? Limity przepływności interfejsu API dla łączników
Informacje o łączniku Power Automate
Usługi interpretacji języka konwersacyjnego (CLU) i sztucznej inteligencji Wywołania CLU, prompty AI, operacje wyszukiwania i podsumowywania, narzędzia obsługiwane przez model, rozmiar ładunku danych oraz limity specyficzne dla danej usługi. Czy każda tura użytkownika wywołuje usługę językową lub usługę AI? Czy te wywołania są powtarzane podczas ponownych prób lub orkiestracji? Limity interpretacji języka konwersacji
Przydziały i limity Copilot Studio
Zewnętrzne interfejsy API i systemy biznesowe API dostawców, wewnętrzne interfejsy API, bazy danych, oprogramowanie pośredniczące, bramy i usługi własne. Jaki limit wymusza właściciel podrzędny? Czy istnieje kontrakt ponawiania prób, kolejka lub mechanizm regulacji przeciążenia? Użyj bieżących limitów właściciela usługi podrzędnej, umowy dotyczącej poziomu usług (SLA) i procesu pomocy technicznej.

Projektowanie w celu zmniejszenia ciśnienia przepływności

Nie traktuj zwiększania częstotliwości jako pierwszej reakcji projektowej. Najpierw przejrzyj projekt agenta i zoptymalizuj wydajność. Jeśli agent musi coś sprawdzić, korzystaj z wywołań zewnętrznych tylko wtedy, gdy jest to zamierzone, optymalizuj wywołania interfejsu API i unikaj zbędnej liczby żądań w Copilot Studio, Power Automate, Dataverse, konektorach i systemach podrzędnych.

Gdy projekt będzie wydajny, kontroluj przepływność, aby ruch docierał do platformy w przewidywalny sposób:

  • W przypadku limitów na poziomie środowiska rozważ podzielenie agentów w wielu środowiskach, jeśli takie podejście jest zgodne z projektem operacyjnym. Takie podejście może pomóc zapobiec konkurowaniu agentów przetwarzających duże wolumeny, jednostek biznesowych, regionów lub autonomicznych obciążeń z niepowiązanymi obciążeniami o te same limity obowiązujące na poziomie środowiska.
  • W przypadku agentów autonomicznych należy stosować kolejki, przetwarzanie wsadowe, filtry wyzwalające, przetwarzanie według harmonogramu, mechanizmy ponawiania prób i monitorowanie, aby zadania w tle nie napływały w postaci niekontrolowanego spiętrzenia.
  • Jeśli to możliwe, przenieś zaplanowane zadania, raportowanie, eksport danych audytowych i zadania telemetryczne poza interaktywny tok czatu.
  • Przejrzyj wyniki testu obciążeniowego i dane telemetryczne produkcyjne, aby zidentyfikować lokalizację koncentratu żądań, a następnie dostroić agenta, przepływy, łączniki i podrzędne interfejsy API przed zażądaniem wyższych limitów.

Autonomiczne agenty mają wyjątkową możliwość maksymalizowania wykorzystania przydzielonych zasobów przy zachowaniu wysokiej przewidywalności i obserwowalności dzięki kolejkowaniu żądań oraz kontrolowaniu częstotliwości ich wyzwalania.

Przed złożeniem wniosku o zwiększenie przepustowości uruchom fazę pilotażową

Domyślne limity obejmują większość agentów produkcyjnych, w tym agentów obsługujących tysiące aktywnych użytkowników miesięcznie. Zanim zaplanujesz zwiększenie przepustowości, upewnij się, że agent faktycznie jej potrzebuje.

Przejście od razu do pełnego wdrożenia nie jest obsługiwanym modelem wdrażania. Najpierw udostępnij agenta podzbiorowi docelowej grupy odbiorców, obserwuj rzeczywiste zużycie i wykorzystaj te pomiary do planowania pełnego wdrożenia. Faza pilotażowa zarówno zmniejsza ryzyko startu, jak i dostarcza dowodów wymaganych przez żądanie zwiększenia przepustowości.

Important

Wnioski o zwiększenie przepustowości są analizowane w kontekście obserwowanego zużycia. Prognozowane objętości, szacunki uzyskane podczas projektowania, małe testy akceptacyjne (UAT) oraz syntetyczne testy obciążeniowe nie są same w sobie uznawane za uzasadnienie. Przeprowadź fazę pilotażową i prześlij zmierzone wyniki.

Rzeczywiste zużycie rutynowo różni się od szacunków sprzed premiery. Długość sesji, liczba wiadomości na sesję, częstotliwość, z jaką użytkownicy uzyskują odpowiedzi generowane przez SI lub wykonują działania, zachowanie przy ponawianiu prób oraz liczba wywołań przepływów, łączników, Dataverse i zewnętrznych interfejsów API w ramach jednej tury są trudne do przewidzenia, zanim agent zostanie oddany do użytku prawdziwym użytkownikom. Pilot ujawnia granice, które mają znaczenie, oraz wzorce ruchu, które trudno przewidzieć z wyprzedzeniem.

Opracuj skuteczny program pilotażowy

Atrybut pilota zdalnego sterowania Guidance
Publiczność Udostępnij dużej, reprezentatywnej części docelowych odbiorców, a nie zespołowi projektowemu ani testowemu. Grupa pilotażowa powinna obejmować role, regiony i oczekiwane zastosowania na pełną skalę.
Czas trwania Prowadź pilotaż przez co najmniej tydzień, aby objął pełny cykl operacyjny, w tym znane okresy wzmożonego obciążenia, takie jak zmiany zmian, przetwarzanie na koniec miesiąca, godziny kampanii czy zaplanowane autonomiczne uruchomienia.
Konfiguracja Zachowaj produkcyjną ścieżkę środowiska uruchomieniowego: te same kanały, tematy, konfigurację generatywnej sztucznej inteligencji, źródła wiedzy, akcje, przepływy, konektory i systemy podrzędne, których używa pełne wdrożenie. Ruch mierzony względem uproszczonego projektu nie daje się wiarygodnie ekstrapolować.
Telemetry Włącz analizę, Application Insights i raporty centrum administracyjnego, których potrzebujesz przed rozpoczęciem pilotażu, aby sesje, wiadomości, generatywne połączenia AI i błędy były rejestrowane przez cały okres.

Pomiar podczas pilotażu

Uchwyć wartości, które bezpośrednio odpowiadają opublikowanym limitom cenowym:

  • Wiadomości na minutę i godzinę, średnio i w szczytowym momencie.
  • Sesje, sesje równoległe, długość sesji oraz wiadomości na sesję.
  • Generatywne wywołania AI na turę i sesję, w tym odpowiedzi generatywne, działania agentów i narzędzia.
  • Działania Power Automate, wywołania łącznikowe i żądania Dataverse generowane na turę agenta.
  • Zdarzenia dławienia, błędy związane z limitami użycia, ponowienia i opóźnienia w szczytowych okresach pilotażu.
  • Wielkość widowni pilotażowej, wyrażona jako udział w pełnej docelowej widowni.

Ekstrapoluj do pełnej pojemności

Skaluj zaobserwowane pomiary szczytów do całej grupy odbiorców i dokumentuj zastosowaną metodę. Skalowanie należy opierać na szczytowym natężeniu ruchu podczas pilotażu, a nie na uśrednionych wartościach dziennych lub tygodniowych, ponieważ ograniczanie przepustowości wynika ze skoncentrowanego ruchu. Uwzględnij wszystko, czego pilot nie uwzględnił, jak dodatkowe regiony, kanały, autonomiczne obciążenia czy kampanię startową, która koncentruje ruch bardziej niż okres pilotażowy.

Efektem jest prośba oparta na dowodach: zmierzony ruch pilota, udział pilota w odbiorcach, metoda ekstrapolacji oraz wynikające z tego szczytowe zapotrzebowanie na pełną skalę.

Co zrobić, jeśli domyślne limity szybkości nie są wystarczające

Jeśli ruch zaobserwowany podczas pilotażu wskazuje, że agent lub dowolna połączona usługa przekroczy aktualnie opublikowane limity przy pełnej skali, rozpocznij proces wsparcia w zakresie zwiększenia limitów, zanim rozszerzysz wdrożenie. Nie czekaj na pierwszą awarię produkcji.

Note

Copilot Studio to usługa SaaS z limitami cenowymi, które chronią usługę dla wszystkich klientów. Z odpowiednim uzasadnieniem inżynieria może włączyć niestandardowe limity dla zatwierdzonych scenariuszy. Właściwe uzasadnienie oznacza wykorzystanie zmierzone w fazie pilotażowej, a nie prognozę.

Otwieranie wniosku o pomoc techniczną

Administratorzy mogą poprosić o pomoc techniczną w centrum administracyjnym platformy Power Platform.

Utwórz zgłoszenie po fazie pilotażowej i uwzględnij zmierzone wyniki wraz z ekstrapolacją dla pełnej wydajności. Wnioski zawierające jedynie szacunki z etapu projektowania lub ograniczone wyniki UAT nie mogą zostać rozpatrzone i opóźniają zwiększenie. Im więcej szczegółów podasz, tym szybsza recenzja. Aktualizuj żądanie w miarę rozszerzania wdrożenia i pojawiania się dalszej telemetrii.

Podstawowe informacje do uwzględnienia

Informacja Opis
Identyfikator środowiska Środowisko Dataverse, w którym działa agent.
Nazwa lub identyfikator agenta Agent, którego dotyczy żądanie.
Wpływ na działalność biznesową Krytyczny wpływ, jeśli domyślne limity nie są wystarczające.
Znane informacje Co jest znane ze scenariusza, kanału, kontekstu uruchamiania, krytycznego działania firmy i czy jest to usługa B2C, autonomiczna, skierowana do pracowników lub tylko wewnętrzna.
Migawka agenta Migawka lub eksport, które pomagają osobom oceniającym zrozumieć konfigurację agenta, jego architekturę, połączone usługi i istotne ustawienia.
Projekt agenta Ogólny opis tematów, wykorzystania generatywnej sztucznej inteligencji, źródeł wiedzy, akcji, przepływów, konektorów, wywołań usługi Dataverse i zewnętrznych interfejsów API używanych przez agenta.
Podsumowanie pilota Daty i czas trwania pilotażu, wielkość grupy odbiorców pilotażu oraz udział tej grupy w całej docelowej grupie odbiorców.
Zaobserwowany średni ruch Mierzyłem średni ruch pilota według minut, godzin i dni.
Zaobserwowany ruch szczytowy Zmierzono maksymalną liczbę komunikatów, sesji, wywołań generatywnej AI, akcji w przepływach, wywołań łączników, żądań Dataverse oraz zewnętrznych wywołań API w okresach szczytowego obciążenia podczas pilotażu.
Ekstrapolowane zapotrzebowanie szczytowe Szczytowe zapotrzebowanie przy pełnej wielkości odbiorców, wraz z metodą ekstrapolacji i założeniami, które zastosowałeś.

Więcej szczegółów, które mogą pomóc

Informacja Opis
Zakres dat Data rozpoczęcia i zakończenia żądanego zwiększenia. Zapewnij osobne przedziały dat dla testów obciążeniowych, testu akceptacji użytkownika oraz produkcji, jeśli się różnią.
Wzorzec szczytowy Okresy największego obciążenia, strefy czasowe, oczekiwane czynniki powodujące skoki ruchu oraz to, czy ruch koncentruje się w krótkim oknie w ciągu dnia.
Profil sesji Sesje współbieżne, średnia i szczytowa długość sesji, komunikaty na sesję i pytania.
Typowe przykłady sesji Reprezentatywne ścieżki użytkowników, typowe kroki wykonywane, używane narzędzia i przykładowe identyfikatory sesji tam, gdzie są dostępne.
Ścieżka uruchomieniowa Przepływy, akcje, monity AI, wywołania bazy wiedzy, żądania usługi Dataverse, łączniki i interfejsy API na jedną interakcję.
Szczyty na poziomie funkcji Szczytowy wolumin na agenta, funkcję, użytkownika, środowisko, łącznik, minutę, godzinę i dzień, gdzie jest znany.
Produkty wymagające przeglądu Niezależnie od tego, czy żądanie obejmuje Copilot Studio, przydziały żądań w usłudze Power Platform, Power Automate, łączniki, Dataverse, usługi CLU/AI czy zewnętrzne interfejsy API.
Evidence Telemetria z pilotażu, przykładowe identyfikatory sesji, błędy, identyfikatory korelacji, logi, zdarzenia dławienia i obserwacje ze środowiska produkcyjnego. Wyniki testów obciążeniowych mogą uzupełniać telemetrię pilota, ale jej nie zastępuj.
Środki łagodzące Podsumuj, jakich działań już próbowano, aby zmniejszyć presję na przepustowość. Zapoznaj się z wytycznymi Projektowanie w celu zmniejszenia presji na przepustowość, w tym z przeglądem projektu, zoptymalizowanymi wywołaniami zewnętrznymi, segmentacją środowisk, przetwarzaniem wsadowym, kolejkowaniem, filtrowaniem wyzwalaczy, harmonogramowaniem, dystrybucją obciążeń i innymi już wdrożonymi optymalizacjami.

Important

Zwiększenie przepływności nie jest gwarantowane. pomoc techniczna firmy Microsoft analizuje zgłoszenia na podstawie scenariusza, środowiska, żądanego zakresu dat, zaobserwowanego ruchu pilota, kwalifikacji, aktualnych limitów oraz pojemności usług.