Tariffe di consumo e fatturazione per Copilot in Fabric

Copilotconsumo è il modello di fatturazione che misura in che modo Copilot le richieste utilizzano le unità di capacità Fabric (CU). Ogni interazione Copilot è misurata in base al numero di token elaborati: circa 1.000 token corrispondono a 750 parole. I token di input e di output vengono utilizzati a tariffe diverse e i prezzi vengono calcolati per 1.000 token.

Copilot frequenza di consumo per token

Le richieste a Copilot in Fabric consumano unità di capacità di Fabric (CU). La tabella seguente indica quante CU vengono consumate per 1.000 token dai prompt di input e dai completamenti di output. Queste tariffe si applicano a tutte le Copilot esperienze, tra cui Copilot per Power BI, Copilot per Data Factory e Copilot per data engineering e data science. Copilot e le funzionalità di IA utilizzano la cache di prompt per ridurre il consumo di token di input che vengono riutilizzati tra le richieste. Quando una richiesta condivide un prefisso comune con una richiesta precedente recente, come istruzioni di sistema, contesto dello schema o cronologia delle conversazioni, la parte sovrapposta viene servita dalla cache a un tasso ridotto come pubblicato. Il sistema applica automaticamente la cache dei prompt e non richiede alcuna configurazione.

Operazione nell'app Metriche Description Unità di Misura Operativa Tasso di consumo
Copilot in Struttura Richiesta di input Per 1.000 token 100 secondi CU
Copilot in Struttura Il prompt di input memorizzato nella cache Per 1.000 token 10 secondi di CU
Copilot in Struttura Completamento dell'output Per 1.000 token 400 secondi CU

Monitorare l'utilizzo Copilot

L'app Fabric Capacity Metrics visualizza l'utilizzo complessivo della capacità per le operazioni Copilot sotto il nome di operazione Copilot in Fabric. Copilotgli utenti possono anche visualizzare un riepilogo degli addebiti di fatturazione alla voce di fatturazione Copilotin Fabric.

Schermata dell'app Fabric Capacity Metrics che mostra Copilot nell'utilizzo di Fabric.

Considerare un approccio incrementale all'adozione di Copilot. Prima di distribuire le funzionalità basate sull'intelligenza artificiale su larga scala, ad esempio l'implementazione di riepiloghi delle sottoscrizioni a centinaia di utenti o l'incorporamento di oggetti visivi narrativi di intelligenza artificiale nei dashboard con traffico elevato, abilitarli per un piccolo gruppo pilota. Usa l'app Fabric Capacity Metrics per misurare il consumo di ogni scenario, quindi effettua una stima prima di passare alla scalabilità. La distribuzione su larga scala senza convalidare i modelli di consumo può esaurire rapidamente la capacità.

Classificazione e limitazione delle attività in background

Copilotle operazioni in Fabric vengono classificate come processi in background, che consentono Fabric di gestire un volume più elevato di richieste durante le ore di Copilot punta.

Fabric consente alle operazioni di accedere a più risorse CU di quelle allocate a una capacità. Fabric uniforma l'utilizzo delle CU di un processo interattivo nell'arco di almeno 5 minuti e di un processo in background nell'arco di 24 ore. Secondo i criteri di limitazione di Fabric, la prima fase della limitazione del traffico inizia quando una capacità ha consumato tutte le risorse CU disponibili per i 10 minuti successivi.

Si supponga, ad esempio, che ogni richiesta Copilot abbia 2.000 token di input e 500 token di output. Il prezzo per una Copilot richiesta viene calcolato come segue: (2.000 × 100 + 500 × 400) / 1.000 = 400.00 CU seconds = 6,67 CU minutes.

Poiché le operazioni in Fabric Copilot sono processi in background, ogni richiesta (circa 6,67 CU-minute per processo) consuma solo un CU-minute per ogni ora di capacità. Ad esempio, un cliente con una SKU F64 ha 64 × 24 = 1.536 ore CU al giorno. Ogni Copilot richiesta utilizza 6,67 / 60 = 0,11 ore cu, in modo che i clienti possano eseguire più di 13.824 Copilot richieste al giorno prima che esauriscano la capacità. Una volta esaurita la capacità, tutte le operazioni verranno arrestate.

Elaborazione dei dati tra aree per Copilot in Fabric

Copilotin Fabric è basato su Azure modelli di linguaggio OpenAI di grandi dimensioni distribuiti in data center limitati. I clienti possono abilitare l'elaborazione tra aree geografiche nelle impostazioni del tenant per Copilot elaborare i dati in un'altra area in cui è disponibile Servizio Azure OpenAI. Questa area potrebbe essere esterna all'area geografica dell'utente, al limite di conformità o all'istanza del cloud nazionale. Il mapping delle aree assegna priorità alla residenza dei dati e tenta di eseguire il mapping a un'area all'interno della stessa area geografica ogni volta che possibile.

Il costo delle unità di capacità Fabric può variare in base all'area. Indipendentemente dall'area di consumo in cui viene usata la capacità GPU, i clienti vengono fatturati in base ai prezzi delle unità di capacità nella propria area di fatturazione. Ad esempio, se le richieste di un cliente vengono mappate da region 1(area di fatturazione) a region 2(area di consumo), il cliente viene addebitato in base ai prezzi in region 1 (area di fatturazione).

Modifiche a Copilot nel tasso di consumo del Fabric

I tassi di consumo sono soggetti a variazioni in qualsiasi momento. Microsoft usa sforzi ragionevoli per fornire comunicazioni tramite posta elettronica o tramite notifica nel prodotto. Le modifiche sono valide alla data indicata nelle note sulla versione di Microsoft o nel blog Microsoft Fabric. Se qualsiasi modifica ai Copilot tassi di consumo in Fabric aumenta materialmente le unità di capacità (CU) necessarie per l'uso Copilot in Fabric, i clienti possono usare le opzioni di annullamento disponibili per il metodo di pagamento scelto.