Kommentar
Åtkomst till den här sidan kräver auktorisering. Du kan prova att logga in eller ändra kataloger.
Åtkomst till den här sidan kräver auktorisering. Du kan prova att ändra kataloger.
Azure SRE-agentanvändning mäts i Azure Agent Units (AAUs), ett standardiserat mått på agentisk bearbetning som används över alla förbyggda Azure-agenter. Din månatliga faktura kombinerar en fast alltid-på-avgift för att hålla varje agent tillgänglig och en variabel aktiv flödesavgift för det arbete dina agenter utför.
Nya kunder kan utvärdera SRE-agenter som avstår från den alltid på-kostnaden.
Alltid aktivt flöde (fast kostnad)
När du skapar en agent betalar du en fast ränta så länge agenten finns:
| Komponent | Hastighet |
|---|---|
| Alltid-aktivt flöde | 4 AAUs per agenttimme |
Alltid-på-flödet innebär inte att agenten aktivt bearbetar uppgifter. Den representerar baslinjekostnaden för att hålla din agent etablerad och tillgänglig. Fakturering som alltid är aktiv fortsätter från att agenten skapas tills agenten tas bort.
Aktivt flöde (variabel kostnad)
Din agent förbrukar aktivt flödes-AAU:er medan den bearbetar arbete. Denna användning gäller interaktiva frågor, automatiserade uppgifter och alla operationer som körs i bakgrunden.
Hur tokens blir AAU:er
Varje gång din agent fungerar använder den LLM-token. Varje tokentyp mäts separat med den hastighet som visas i följande tabell.
| Tokentyp | Vad den mäter |
|---|---|
| Input | Token som skickas till modellen (prompter, verktygsresultat, kontext) |
| Output | Token som genereras av modellen (svar, resonemang) |
| Cacheläsning | Token som hanteras från promptcache (upprepad kontext) |
| Cacheskrivning | Token skrivs till cacheminnet för framtida återanvändning |
Dina totala aktiva flödes-AAU:er för en uppgift = summan av AAU:er för alla fyra sorter av tokens.
AAU-priser efter modell
Antal AAUs som förbrukas per 1 miljon token:
| Modell | Indata | Resultat | Cacheläsning | Cacheskrivning |
|---|---|---|---|---|
| Claude Opus 4.6 | 100 AAU:er | 500 AAU:er | 10 AAU:er | 125 AAU:er |
| GPT 5.3-kodex | 35 AAU:er | 280 AAU:er | 3.5 AAU:er | 0 AAU:er |
| GPT 5.2 | 35 AAU:er | 280 AAU:er | 3.5 AAU:er | 0 AAU:er |
Priserna är per 1 miljon token.
Note
Azure kan lägga till fler modeller och leverantörer i framtiden. Azure anger AAU-priser och kan uppdatera dem när nya modeller släpps.
Nyckelinformation:
- Endast bearbetningstid räknas. Tid som agenten lägger på att vänta på ditt svar faktureras inte som aktivt flöde.
- Aktivt flöde återställs varje månad. Din AAU-förbrukningsräknare återställs i början av varje kalendermånad.
- Ange provider på agentnivå. Konfigurera modellprovidern (Anthropic, OpenAI och andra) i agentens inställningar. Motsvarande modell avgör dina AAU-priser.
Aktivt flöde efter aktivitetstyp
Antalet token som du använder – och de AAUs du betalar för – beror på hur komplex uppgiften är. Mer komplexa uppgifter behöver fler LLM-resonemangssteg, verktygsanrop och databehandling, så de använder fler token.
Så här översätter tokenanvändning till AAUs för vanliga scenarier:
| Scenario | Token för indata | Token för utdata | Cacheläsning | Cacheskrivning | Claude Opus 4.6 AAUs | GPT 5.3 Codex AAU:er | Exempel |
|---|---|---|---|---|---|---|---|
| Snabbfråga | ~20 000 | ~2 000 | ~15 000 | cirka 5 000 | ~3,8 | ~1,3 | "Visa de senaste aviseringarna" |
| Incidentundersökning | ~200 000 | ~15 000 | ~150 000 | ~50K | ~35,3 | ~11,7 | Automatiserad incident från Azure Monitor |
| Fullständig reparation | ~500 000 | ~40 000 | ~400 000 | ~100 000 | ~86,5 | ~30,1 | "Diagnostisera och åtgärda den misslyckade distributionen" |
Så här fungerar matematiken (Claude Opus 4.6-exempel – snabb fråga):
| Tokentyp | Token | Andel per miljon | AAUs |
|---|---|---|---|
| Indata | 20 000 | 100 | 2.0 |
| Resultat | 2K | 500 | 1.0 |
| Cacheläsning | 15 000 | 10 | 0.15 |
| Cacheskrivning | 5K | 125 | 0.625 |
| Total | 3 775 AAU:er |
Tips/Råd
Om du vill hålla aktiva flödeskostnader förutsägbara anger du en månatlig AAU-allokeringsgräns i Inställningar>Agentförbrukning.
Övervaka dina kostnader
Använd SRE-agentportalen för att följa din AAU-konsumtion och sätt en månatlig aktiv utgiftsgräns.
I SRE-agentportalen
Gå till Inställningar>Agentförbrukning för att visa din användning:
- Månatlig AAU-gräns: din kombinerade allokering av alltid på och aktivt flöde med en knapp för att justera den
- Total aktiv flödesförbrukning: ringdiagram som delar upp användning efter trådtyp (chattar, incidenter, schemalagda uppgifter, utlösare)
- Daglig aktiv flödesförbrukning: staplat stapeldiagram som visar AAU-användning per dag, färgkodad efter typ
- Förbrukning efter tråd: tabell som visar varje tråd med dess AAU-kostnad, typ och status
En fullständig genomgång finns i Övervaka agentanvändning.
Ange en utgiftsgräns för aktivt flöde
Välj Ändra AAU-allokering för att ange en månatlig AAU-gräns för aktivt flöde (minst 500, högst 1 000 000 AAUs). Den här gränsen gäller endast för aktivt flöde – alltid på-faktureringen fortsätter så länge agenten finns.
- När agenten når gränsen för aktivt flöde blir den inte tillgänglig för chatt och åtgärder fram till nästa månad. Kontinuerliga avgifter fortsätter under resten av månaden.
- Du kan öka eller minska allokeringen när som helst.
- Ökningar börjar gälla omedelbart – om du höjer gränsen över den aktuella förbrukningen återupptas chatten och åtgärderna direkt.
- Minskningar träder i kraft nästa månad. Tills dess körs agenten endast i ett konstant driftläge.
Faktureringspåverkan per åtgärd
Följande tabell jämför hur varje åtgärd påverkar aktivt flöde och altid-på-fakturering, samt hur tjänsten återupptas.
| Action | Aktivt flöde | Ständigt aktiv | Kommer att återupptas nästa månad |
|---|---|---|---|
| Ange budgetgräns (träffgräns) | Stopp | Faktureras fortfarande | Återställs automatiskt i början av månaden |
| Stoppa agenten | Stopp | Faktureras fortfarande | Välj Starta manuellt iGrunderna för > |
| Ta bort agent | Stopp | Stopp | Skapa en ny agent |
I Azure Cost Management
Detaljerade faktureringsuppdelningar för flera agenter och resurser finns i Azure Cost Management i Azure portalen.
Kostnadsoptimeringstips
| Strategi | Påverkan | Hur du gör det. |
|---|---|---|
| Lägga till kontext i din agent | Färre bortkastade token | Lägg till färdigheter, kunskaper och dokument så att agenten förblir välgrundad och koncis. Beständigt minne från tidigare interaktioner förbättrar effektiviteten över tid. |
| Filtrera incidenter med svarsplaner | Mindre onödigt arbete | Använd svarsplaner för att filtrera Azure Monitor aviseringar efter allvarlighetsgrad, tjänst eller nyckelord – agenten undersöker endast incidenter som matchar. |
| Batcharbete med schemalagda uppgifter | Färre körningar | Schemalägg aktiviteter så att de körs dagligen eller varje vecka i stället för att avsöka kontinuerligt. Se Schemalagda aktiviteter. |
| Testa i chatten innan du automatiserar | Undviker bortkastade körningar | Prova att fråga i chatten eller på Playground först. En felkonfigurerad automatisering körs upprepade gånger och slösar bort AAUs. |
| Stoppa inaktiva agenter | Eliminerar aktivt flöde | Gå tillGrunderna för> och välj Stoppa. Agenten behåller sin konfiguration men stoppar allt aktivt flöde. Always-on-kostnaden fortsätter tills den tas bort. |
| Ta bort oanvända agenter | Eliminerar alla kostnader | I sre.azure.com öppnar du agenten och går till Agenten Grundläggande>av> inställningar. All fakturering stoppas omedelbart. |
Vanliga frågor och svar
Hur beräknar agenten AAUs från tokenerna?
Varje gång agenten utför arbete spårar den de LLM-token som förbrukas för alla fyra tokentyperna och avläser dem enligt AAU-takterna för din konfigurerade modell. Du kan se din AAU-förbrukning i Inställningar>Agentförbrukning.
Påverkar den leverantör jag väljer mina kostnader?
Ange modellprovidern (Anthropic, OpenAI och andra) på agentnivå. Den avgör vilka AAU-priser som gäller. Olika modeller har olika priser. Se AAU-pristabellen för aktuella priser.
Vilken modell ska jag välja?
Claude Opus 4.6 har högre AAU-kvoter men producerar vanligtvis mer noggranna undersökningar med färre steg i resonemanget. För komplexa incidentundersökningar och rotorsaksanalyser når Opus ofta en slutsats med färre verktygsanvändningar, vilket kan kompensera för den högre kostnaden per token. GPT-modeller är ett bra val för enklare uppgifter med stora volymer, till exempel schemalagda efterlevnadskontroller där kostnadseffektivitet är viktigare än djup. Du kan ändra modellprovidern när som helst iGrunderna för > och jämföra resultat.
Debiteras jag när agenten väntar på att jag ska svara?
Nej. Endast den tid som agenten ägnar åt att aktivt bearbeta en uppgift räknas som aktivt flöde. Om agenten ber om ditt godkännande och väntar debiteras inte väntetiden.
Vad räknas som aktivt flöde?
Varje gång agenten aktivt utför arbete räknas som aktivt flöde. Det här arbetet omfattar:
- Interaktiva frågor: en användare som ställer en fråga till agenten i chatten
- Automatisering: schemalagda uppgifter, planer för incidenthantering eller andra automatiserade utlösare
- Asynkrona åtgärder: bakgrundsundersökningar, rapportgenerering eller reparationsåtgärder
I alla fall mäter agenten de förbrukade token som AAUs.
Vad händer om jag stoppar min agent?
En avstängd agent kan inte övervaka dina resurser eller svara på anmodningar, men det medför fortfarande den fasta kostnaden för konstant drift. AAUs för aktivt flöde förbrukas inte när de stoppas. Om du vill stoppa din agent går du tillGrunderna för > och väljer Stoppa. Om du vill återuppta väljer du Starta från samma sida. Om du vill stoppa all fakturering helt tar du bort agenten.
Kan en agent hantera flera arbetsbelastningar?
Ja. En enskild agent kan övervaka flera resurser inom sitt konfigurerade omfång. Att konsolidera arbetsbelastningar under en agent minskar alltid-på-kostnaderna jämfört med att ha separata agenter.
Är prissättningen densamma i alla regioner?
Kontrollera priskalkylatorn för Azure för aktuella priser i din region.