Azure OpenAI 監視データのリファレンス

この記事には、このサービスに関するすべてのモニタリングリファレンス情報が含まれています。

Microsoft Foundry Models で Azure OpenAI 用に収集できるデータとその使用方法の詳細については、「Monitor Azure OpenAI」を参照してください。

Metrics

このセクションには、このサービスのために自動的に収集されたすべてのプラットフォーム指標が一覧化されています。 これらの指標は、Azure Monitorでサポートされているすべてのプラットフォーム指標のグローバルリストにも含まれています。

指標保持に関する情報は、Azure Monitor 指標概要を参照してください。

Microsoftのサポートメトリクス。認知サービス/アカウント

Azure OpenAI の最も重要なメトリックを監視します。 この記事の後半では、この名前空間で使用可能なすべてのメトリックの一覧を詳しく見つけます。この短い一覧には、メトリックの詳細が含まれています。 最も up-to-date 情報については、次の一覧を参照してください。 Azure チームは、次のセクションのテーブルの更新に取り組んでいます。

Important

この記事の後半で「Latency」に記載されているレガシーメトリックと混同しないでください。 従来の Latency メトリックはAzure OpenAI ワークロード向けに設計されておらず、OpenAI レイテンシの診断に使うと誤解を招く結果Azure出します。 OpenAIのレイテンシ監視Azureには、応答時間(AzureOpenAITimeToResponse)、最後のバイトまでの時間(AzureOpenAITTLTInMS)、トークン間の時間 (AzureOpenAINormalizedTBTInMS)、または正規化された最初のバイトまでの時間(AzureOpenAINormalizedTTFTInMS)を使いましょう。 これらの指標の解釈に関する指針については、 パフォーマンスとレイテンシーを参照してください。

  • OpenAI 要求のAzure
  • アクティブ トークン
  • 生成完了トークン
  • ファインチューンドトレーニング時間の処理
  • 処理推論トークン
  • 処理プロンプトトークン
  • プロビジョニング管理利用率V2
  • プロンプトトークンキャッシュマッチ率
  • 対応の時期
  • トークン間の時間
  • タイム・トゥ・ラストバイト
  • 正規化されて最初のバイトまでの時間
  • トークン数/秒

また、他の関連サービスが使用するコンテンツの安全性メトリックを監視することもできます。

  • ブロックされたボリューム
  • 有害な体積検出
  • 潜在的な悪用ユーザー数
  • 安全システムイベント
  • 安全確認のために送られた総体積

Note

プロビジョニング管理利用率メトリクスは現在非推奨となり、推奨されていません。 このメトリックは、 プロビジョニングされたマネージド使用率 V2 メトリックに 置き換えられます。 現在、標準デプロイでは、1 秒あたりのトークン数、Time to Response、Time Between Tokens は使用できません。

クイックリファレンス:ユースケース別の主な指標

この表を使って、特定のモニタリング目標に適した指標を見つけてください。 これらの指標の解釈に関するエンドツーエンドのガイダンスについては、 パフォーマンスとレイテンシーを参照してください。

監視したい... この指標を用いる REST API名
全体的な応答時間 タイム・トゥ・ラストバイト AzureOpenAITTLTInMS
ファーストトークン応答性(ストリーミング) 対応の時期 AzureOpenAITimeToResponse
トークン生成速度 トークン間の時間 AzureOpenAINormalizedTBTInMS
プロンプトサイズで正規化されたファーストトークン効率 正規化されて最初のバイトまでの時間 AzureOpenAINormalizedTTFTInMS
リクエストごとの出力トークン量 生成完了トークン GeneratedTokens
リクエストごとの入力トークン量 処理プロンプトトークン ProcessedPromptTokens
PTU容量利用率 プロビジョニング管理利用率V2 AzureOpenAIProvisionedManagedUtilizationV2
リクエストボリュームとエラー OpenAI 要求のAzure AzureOpenAIRequests

Tip

常にレイテンシ指標とトークン数指標を組み合わせてください。 トークンの増加が伴わない遅延増加は、実際の問題を示している可能性があります。 トークンの増加に伴う遅延の増加は期待される動作です。

Warnung

この記事後半で述べるCognitive Services - HTTP RequestsのメトリクスはレガシーなCognitive Servicesのメトリクスであり、OpenAIのワークロードAzure向けには設計されていません。 特に、そのカテゴリのLatencyメトリックは、OpenAIのAzureレイテンシ指標(応答時間、最終バイトまでの時間、トークン間の時間、正規化された最初のバイトまでの時間)とは異なります。 OpenAIのトラブルシューティングAzureにレガシーLatencyメトリックを使うと誤解を招く結果が出ます。 代わりに、このセクションに記載されているAzure OpenAIの指標をご利用ください。

以下の表は、Microsoftで利用可能な指標を示しています。認知サービス/アカウントリソースの種類。

  • すべての列がすべてのテーブルに存在しているわけではありません。
  • 一部の列はページの閲覧範囲を超えている場合があります。 利用可能なすべての列を見るには 「表を展開 」を選択します。

テーブル見出し

  • カテゴリ - 指標グループまたは分類。
  • Metric - Azureポータルに表示されるメトリクス名。
  • REST APIにおける名称 - REST APIで言及されるメトリック名。
  • 単位 - 単位単位。
  • 集約 - デフォルトの 集約 タイプ。 有効数値:平均(平均)、最小(最小)、最大(最大)、合計(合計)、カウント。
  • メトリックの - は利用可能です。
  • タイムグレインズ - 指標がサンプリングされる間隔。 例えば、PT1Mは指標が1分ごと、30分ごと、PT30M1時間ごとにサンプリングされる、というように、1分ごと、PT1H 10分ごと、というように示しています。
  • DS エクスポート- 診断設定を通じてAzure Monitorログにメトリクスをエクスポートできるかどうか。 指標のエクスポートに関する情報は、Azure Monitorで診斷設定を作成する」をご覧ください。

カテゴリ:Azure OpenAI - HTTP Requests

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
OpenAI AvailabilityRate のAzure

以下の計算による可用性パーセンテージ:(総通話数 - サーバーエラー数)/総通話数。 サーバーエラーにはHTTP応答 >=500が含まれます。
AzureOpenAIAvailabilityRate いいえ パーセント 最小、最大、平均 ApiNameOperationNameRegionStreamTypeModelDeploymentNameModelNameModelVersion PT1M いいえ
Azure OpenAI リクエスト

一定期間にわたってAzure OpenAI APIにかけられた呼び出し数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。 APIリクエストを分解するには、フィルターを追加したり、次の次元で分割したりできます:ModelDeploymentName、ModelName、ModelVersion、StatusCode(成功、clienterrors、server error)、スピルオーバー情報用のIsSpillover、ServiceTier、StreamType(ストリーミングリクエストと非ストリーミングリクエスト)、そして操作。
AzureOpenAIRequests いいえ 数える 合計 (和) ApiNameOperationNameRegionStreamTypeModelDeploymentNameModelNameModelVersionStatusCodeIsSpilloverServiceTierRequestServiceTierResponse PT1M はい

カテゴリ:Azure OpenAI - レイテンシー

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
トークン間の時間

ストリーミングリクエストには;モデルのトークン生成率はミリ秒単位で測定されます。 PTU、PTU管理型、従量制の展開に適用されます。
AzureOpenAINormalizedTBTInMS いいえ ミリ秒 最大、最小、平均 RegionModelDeploymentNameModelNameModelVersionServiceTierRequestServiceTierResponse PT1M はい
正規化されて最初のバイトまでの時間

ストリーミングおよび非ストリーミングリクエストについて;モデルごとにリクエストがなされた後、最初の応答データバイトが受信されるまでの時間(トークンで正規化)が該当します。 PTU、PTU管理、従量課金型の展開に適用されます。
AzureOpenAINormalizedTTFTInMS いいえ ミリ秒 最大、最小、平均 RegionModelDeploymentNameModelNameModelVersion PT1M はい
対応の時期

ストリーミングリクエストの推奨遅延(レスポンシブネス)指標。 PTU、PTU管理型、従量制の展開に適用されます。 APIゲートウェイで測定されるように、ユーザーがプロンプトを送信した後に最初の応答が表示されるまでの時間として計算されます。 この数値はプロンプトサイズが増えたり、キャッシュヒットサイズが減少したりすると増加します。 応答メトリクスに時間を分解するには、フィルターを追加したり、ModelDeploymentName、ModelName、ModelVersionの次元で分割できます。

注:この指標は近似であり、測定されたレイテンシは同時通話や全体のワークロードパターンなど複数の要因に大きく依存します。 さらに、クライアントとAPIエンドポイント間に存在する可能性のあるクライアント側の遅延も考慮していません。 最適なレイテンシトラッキングについては、ご自身のログを参照してください。
AzureOpenAITimeToResponse いいえ ミリ秒 最小、最大、平均 ApiNameOperationNameRegion、、 StreamTypeModelDeploymentNameModelNameModelVersionStatusCode PT1M はい
トークン数/秒

特定のAzure OpenAIモデル応答の生成速度を列挙します。 生成されたトークンの総数を、トークン生成までの時間(秒単位)で割ります。 PTU、PTU管理型、従量制の展開に適用されます。
AzureOpenAITokenPerSecond いいえ 数える 最大、最小、平均 RegionModelDeploymentNameModelNameModelVersion PT1M はい
タイム・トゥ・ラストバイト

ストリーミングおよび非ストリーミングリクエストについて;モデルによるリクエストが行われた後、応答データの最後のバイトが受信されるまでの時間です。 PTU、PTU管理、従量課金型の展開に適用されます。
AzureOpenAITTLTInMS いいえ ミリ秒 最大、最小、平均 RegionModelDeploymentNameModelNameModelVersion PT1M はい

カテゴリ:Azure OpenAI - 使用法

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
アクティブ トークン

一定期間にわたるキャッシュトークンを差し引いたトークンの合計。 PTUおよびPTU管理の展開に適用されます。 この指標を使って、PTUのTPSやTPMベースの利用率を理解し、シナリオのターゲットTPSやTPMのベンチマークと比較してください。 APIリクエストを分解するには、フィルターを追加したり、ModelDeploymentName、ModelName、ModelVersionの各次元で分割を適用できます。
ActiveTokens いいえ 数える 最小、最大、平均、合計(合計) RegionModelDeploymentNameModelNameModelVersionServiceTierRequestServiceTierResponse PT1M はい
オーディオ完了トークン

OpenAIモデル上で生成(出力)される音声プロンプトトークンの数。 PTU管理型および従量制モデルの展開に適用されます。
AudioCompletionTokens いいえ 数える 合計 (和) ModelDeploymentNameModelNameModelVersionRegion PT1M はい
オーディオプロンプトトークン

OpenAIモデル上で処理(入力)された音声プロンプトトークンの数。 PTU管理型および従量制モデルの展開に適用されます。
AudioPromptTokens いいえ 数える 合計 (和) ModelDeploymentNameModelNameModelVersionRegion PT1M はい
プロンプトトークンキャッシュマッチ率

キャッシュに到達したプロンプトトークンの割合。 PTUおよびPTU管理の展開に適用されます。
AzureOpenAIContextTokensCacheMatchRate いいえ パーセント 最小、最大、平均 RegionModelDeploymentNameModelNameModelVersion PT1M いいえ
プロビジョニング管理利用(非推奨)

プロヴィゾンマネージド展開の利用率 % は(消費PTU数/展開数)×100で計算されます。 利用率が100%を超えると通話が制限され、エラーコード429が返されます。 この指標を分解するために、フィルターを追加したり、次の次元で分割を適用できます:ModelDeploymentName、ModelName、ModelVersion、StreamType(ストリーミングリクエストと非ストリーミングリクエスト)
AzureOpenAIProvisionedManagedUtilization いいえ パーセント 最小、最大、平均 RegionStreamTypeModelDeploymentNameModelNameModelVersion PT1M いいえ
プロビジョニング管理利用率V2

プロヴィゾンマネージド展開の利用率 % は(消費PTU数/展開数)×100で計算されます。 利用率が100%を超えると通話が制限され、エラーコード429が返されます。 この指標を分解するために、フィルターを追加したり、次の次元で分割を適用できます:ModelDeploymentName、ModelName、ModelVersion、StreamType(ストリーミングリクエストと非ストリーミングリクエスト)
AzureOpenAIProvisionedManagedUtilizationV2 いいえ パーセント 最小、最大、平均 RegionStreamTypeModelDeploymentNameModelNameModelVersion PT1M いいえ
ファインチューンドトレーニング時間の処理

OpenAIのファインチューンモデルで処理されたトレーニング時間数
FineTunedTrainingHours いいえ 数える 合計 (和) ApiNameModelDeploymentNameFeatureNameUsageChannelRegion PT1M はい
生成完了トークン

OpenAIモデルから生成(出力)されるトークンの数。 PTU、PTU管理型、従量制の展開に適用されます。 この指標を分解するには、フィルターを追加したり、ModelDeploymentNameとModelNameの次元で分割を適用できます。
GeneratedTokens いいえ 数える 合計 (和) ApiNameModelDeploymentNameFeatureNameUsageChannelRegionModelVersion PT1M はい
処理プロンプトトークン

OpenAIモデルで処理された(入力)プロンプトトークンの数。 PTU、PTU管理型、従量制の展開に適用されます。 この指標を分解するには、フィルターを追加したり、ModelDeploymentNameとModelNameの次元で分割を適用できます。
ProcessedPromptTokens いいえ 数える 合計 (和) ApiNameModelDeploymentNameFeatureNameUsageChannelRegionModelVersion PT1M はい
使用されたリアルタイムAPI秒数

リアルタイムAPI使用秒数
RealtimeUsageTime いいえ 数える 合計 (和) RegionModelDeploymentName PT1M はい
処理推論トークン

OpenAIモデル上で処理された推論トークンの数。 プロンプトトークン(入力)と生成トークン(出力)で計算されます。 PTU、PTU管理型、従量制の展開に適用されます。 この指標を分解するには、フィルターを追加したり、ModelDeploymentNameとModelNameの次元で分割を適用できます。
TokenTransaction いいえ 数える 合計 (和) ApiNameModelDeploymentNameFeatureNameUsageChannelRegionModelVersion PT1M はい

カテゴリ:認知サービス - HTTPリクエスト

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
ブロックされた呼び出し

料金やノルマの上限を超えた通話件数。 Azure OpenAIサービスには使用しないでください。
BlockedCalls いいえ 数える 合計 (和) ApiNameOperationNameRegionRatelimitKey PT1M はい
クライアント エラー

クライアント側エラー(HTTP応答コード4xx)を含む通話回数。 Azure OpenAIサービスには使用しないでください。
ClientErrors いいえ 数える 合計 (和) ApiNameOperationNameRegionRatelimitKey PT1M はい
データイン

受信データのサイズ(バイト単位)。 Azure OpenAIサービスには使用しないでください。
DataIn いいえ バイト 合計 (和) ApiNameOperationNameRegion PT1M はい
データ出力

送信データのサイズ(バイト単位)。 Azure OpenAIサービスには使用しないでください。
DataOut いいえ バイト 合計 (和) ApiNameOperationNameRegion PT1M はい
遅延

レイテンシはミリ秒単位です。 Azure OpenAIサービスには使用しないでください。
Latency いいえ ミリ秒 Average ApiNameOperationNameRegionRatelimitKey PT1M はい
Ratelimit

レート制限キーの現在のレート制限。 Azure OpenAIサービスには使用しないでください。
Ratelimit いいえ 数える 合計 (和) RegionRatelimitKey PT1M はい
サーバー エラー

サービス内部エラー(HTTP応答コード5xx)の呼び出し数。 Azure OpenAIサービスには使用しないでください。
ServerErrors いいえ 数える 合計 (和) ApiNameOperationNameRegionRatelimitKey PT1M はい
成功した呼び出し

成功した通話回数。 Azure OpenAIサービスには使用しないでください。
SuccessfulCalls いいえ 数える 合計 (和) ApiNameOperationNameRegionRatelimitKey PT1M はい
合計通話数

通話回数の総数。 Azure OpenAIサービスには使用しないでください。
TotalCalls いいえ 数える 合計 (和) ApiNameOperationNameRegionRatelimitKey PT1M はい
合計エラー数

エラー応答(HTTP応答コード4xxまたは5xx)を持つ通話の総数。 Azure OpenAIサービスには使用しないでください。
TotalErrors いいえ 数える 合計 (和) ApiNameOperationNameRegionRatelimitKey PT1M はい
総トークン通話数

トークンコールの総数。
TotalTokenCalls いいえ 数える 合計 (和) ApiNameOperationNameRegion PT1M はい

カテゴリ:認知サービス - SLI

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
AvailabilityRate

以下の計算による可用性パーセンテージ:(総通話数 - サーバーエラー数)/総通話数。 サーバーエラーにはHTTP応答 >=500が含まれます。 Azure OpenAIサービスには使用しないでください。
SuccessRate いいえ パーセント 最小、最大、平均 ApiNameOperationNameRegionRatelimitKey PT1M いいえ

カテゴリ:コンテンツ理解 - 使用法

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
Face Transactions

Faceサービスに対して行われたAPI呼び出し数
FaceApiTransactions いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
処理済み音声分

処理された音声分数
ProcessedAudioMinutes いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
処理済みページ

処理済みのドキュメントページ数
ProcessedDocumentPages いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
処理されたイメージ

処理された画像数
ProcessedImageCount いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
処理済みビデオ分

処理された映像分数
ProcessedVideoMinutes いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
トークン

消費されたトークンの数
Tokens いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい

カテゴリ:コンテンツ安全 - リスクと安全

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
有害な体積検出

一定期間にわたって、コンテンツフィルターでAzure OpenAI APIにかけられ、有害と検出された(ブロックモデルおよび注釈モードの両方)の呼び出し数。 フィルターを追加したり、次の次元で分割を適用したりできます:ModelDeploymentName、ModelName、TextType。
RAIHarmfulRequests いいえ 数える 合計 (和) RegionModelDeploymentNameModelName、、 ModelVersionApiNameTextTypeCategorySeverity PT1M はい
ブロックされたボリューム

一定期間にわたってAzure OpenAI APIにかけられた呼び出し数と、適用されたコンテンツフィルターによって拒否された回数。 フィルターを追加したり、次の次元で分割を適用したりできます:ModelDeploymentName、ModelName、TextType。
RAIRejectedRequests いいえ 数える 合計 (和) RegionModelDeploymentNameModelNameModelVersionApiNameTextTypeCategory PT1M はい
安全システムイベント

リスクと安全監視のためのシステムイベント。 フィルターを追加したり、次の次元で分割したりできます:EventType。
RAISystemEvent いいえ 数える Average RegionEventType PT1M はい
安全確認のために送られた総体数

一定期間にわたってAzure OpenAI APIにかけられた呼び出し数と、コンテンツフィルターで検出された回数。 フィルターを追加したり、次の次元で分割したりできます:ModelDeploymentName、ModelName。
RAITotalRequests いいえ 数える 合計 (和) RegionModelDeploymentNameModelNameModelVersionApiName PT1M はい

カテゴリ:コンテンツ安全 - 使用方法

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
画像モデレーションのための通話回数

画像モデレーションの要請が多数。
ContentSafetyImageAnalyzeRequestCount いいえ 数える 合計 (和) ApiVersion PT1M はい
テキストモデレーションのための通話回数

テキストモデレーションの電話数。
ContentSafetyTextAnalyzeRequestCount いいえ 数える 合計 (和) ApiVersion PT1M はい

カテゴリ:言語 - 求人

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
ジョブ期間(プレビュー)

注:この値は入力サイズ、文書数、タスクの複雑さに大きく依存します。 これはすべてのジョブタスクを総算した値です。
JobDuration いいえ ミリ秒 最小、最大、平均 JobStatusJobType PT1M はい

カテゴリ:モデル - HTTPリクエスト

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
モデルの利用可能性

以下の計算による可用性パーセンテージ:(総通話数 - サーバーエラー数)/総通話数。 サーバーエラーにはHTTP応答 >=500が含まれます。
ModelAvailabilityRate いいえ パーセント 最小、最大、平均 RegionModelDeploymentNameModelNameModelVersion PT1M いいえ
モデル要求

一定期間にわたってモデルAPIにかけられた呼び出し数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。
ModelRequests いいえ 数える 合計 (和) ApiNameOperationNameRegionStreamTypeModelDeploymentNameModelNameModelVersionStatusCodeIsSpilloverServiceTierRequestServiceTierResponse PT1M はい

カテゴリ:モデル - レイテンシー

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
トークン間の時間

モデルのトークン生成率はミリ秒単位で測定されます。 PTUおよびPTU管理の展開に適用されます。 ストリーミング以外のリクエストの場合、この値は推定値です。
NormalizedTimeBetweenTokens いいえ ミリ秒 最大、最小、平均 ApiNameOperationNameRegionStreamTypeModelDeploymentNameModelNameModelVersion PT1M はい
正規化されて最初のバイトまでの時間

モデルによるリクエストがなされた後、最初の応答データバイトが受信されるまでの時間(トークンで正規化)です。 PTU、PTU管理、従量課金型の展開に適用されます。 ストリーミング以外のリクエストの場合、この値は推定値です。
NormalizedTimeToFirstToken いいえ ミリ秒 最大、最小、平均 ApiNameOperationNameRegionStreamTypeModelDeploymentNameModelNameModelVersionServiceTierRequestServiceTierResponse PT1M はい
タイム・トゥ・ラストバイト

モデルによるリクエスト後に応答データの最後のバイトが受信されるまでの時間です。 PTU、PTU管理、従量課金型の展開に適用されます。 ストリーミング以外のリクエストの場合、この値は推定値です。
TimeToLastByte いいえ ミリ秒 最大、最小、平均 ApiNameOperationNameRegionStreamTypeModelDeploymentNameModelNameModelVersionServiceTierRequestServiceTierResponse PT1M はい
対応の時期

推奨されるレイテンシ(応答性)指標。 PTUおよびPTU管理の展開に適用されます。 APIゲートウェイで測定されるように、ユーザーがプロンプトを送信した後に最初の応答が表示されるまでの時間として計算されます。 この数値はプロンプトサイズが増えたり、キャッシュヒットサイズが減少したりすると増加します。 応答メトリクスに時間を分解するには、フィルターを追加したり、ModelDeploymentName、ModelName、ModelVersionの次元で分割できます。

注:この指標は近似であり、測定されたレイテンシは同時通話や全体のワークロードパターンなど複数の要因に大きく依存します。 さらに、クライアントとAPIエンドポイント間に存在する可能性のあるクライアント側の遅延も考慮していません。 ストリーミング以外のリクエストの場合、この値は推定値です。 最適なレイテンシトラッキングについては、ご自身のログを参照してください。
TimeToResponse いいえ ミリ秒 最小、最大、平均 ApiNameOperationNameRegionStreamTypeModelDeploymentNameModelNameModelVersionStatusCodeServiceTierRequestServiceTierResponse PT1M はい
トークン数/秒

与えられたモデル応答に対する生成速度を列挙します。 生成されたトークンの総数を、トークン生成までの時間(秒単位)で割ります。 PTUおよびPTU管理の展開に適用されます。 ストリーミング以外のリクエストの場合、この値は推定値です。
TokensPerSecond いいえ 数える 最大、最小、平均 ApiNameOperationNameRegionStreamTypeModelDeploymentNameModelNameModelVersionServiceTierRequestServiceTierResponse PT1M はい

カテゴリ:モデル - 利用

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
注釈付きページ

注釈付き処理済みの総ページ数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。
AnnotatedPages いいえ 数える 合計 (和) ApiNameRegionModelDeploymentNameModelNameModelVersion PT1M はい
オーディオ入力トークン

OpenAIモデル上で処理(入力)された音声プロンプトトークンの数。 PTU管理モデル展開に適用されます。
AudioInputTokens いいえ 数える 合計 (和) ModelDeploymentNameModelNameModelVersionRegion PT1M はい
オーディオ出力トークン

OpenAIモデル上で生成(出力)される音声プロンプトトークンの数。 PTU管理モデル展開に適用されます。
AudioOutputTokens いいえ 数える 合計 (和) ModelDeploymentNameModelNameModelVersionRegion PT1M はい
キャッシュから読み取るプロンプトトークン

キャッシュから読み取られたトークンの総数。 Anthropicモデルの展開に適用されます。 応答用法セクションで次のように表出されました cache_read_input_tokens
cacheReadInputTokens いいえ 数える 合計 (和) ApiNameRegionModelDeploymentNameModelNameModelVersionContextLength PT1M はい
キャッシュに書き込まれたプロンプトトークン(1時間TTL)

1時間エントリーを作成するのに使われたプロンプトトークンの数。 Anthropicモデルの展開に適用されます。 応答用法セクションで次のように表出されました cache_creation.ephemeral_1h_input_tokens
ephemeral1hInputTokens いいえ 数える 合計 (和) ApiNameRegionModelDeploymentNameModelNameModelVersionContextLength PT1M はい
キャッシュに書き込まれたプロンプトトークン(5分TTL)

5分間のキャッシュエントリを作成するために使われたプロンプトトークンの数。 Anthropicモデルの展開に適用されます。 応答用法セクションで次のように表出されました cache_creation.ephemeral_5m_input_tokens
ephemeral5mInputTokens いいえ 数える 合計 (和) ApiNameRegionModelDeploymentNameModelNameModelVersionContextLength PT1M はい
生成されたイメージ

生成された画像の総数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。
GeneratedImages いいえ 数える 合計 (和) ApiNameRegionModelDeploymentNameModelNameModelVersion PT1M はい
入力トークン

モデル上で処理された(入力)プロンプトトークンの数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。
InputTokens いいえ 数える 合計 (和) ApiNameRegionModelDeploymentNameModelNameModelVersion PT1M はい
出力トークン

OpenAIモデルから生成(出力)されるトークンの数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。
OutputTokens いいえ 数える 合計 (和) ApiNameRegionModelDeploymentNameModelNameModelVersion PT1M はい
プロビジョニングされた使用率

プロヴィゾンマネージド展開の利用率 % は(消費PTU数/展開数)×100で計算されます。 利用率が100%を超えると通話が制限され、エラーコード429が返されます。
ProvisionedUtilization いいえ パーセント 最小、最大、平均 RegionModelDeploymentNameModelNameModelVersion PT1M いいえ
合計ページ数

処理済みの総ページ数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。
TotalPages いいえ 数える 合計 (和) ApiNameRegionModelDeploymentNameModelNameModelVersion PT1M はい
合計トークン数

モデル上で処理される推論トークンの数。 プロンプトトークン(入力)と生成トークン(出力)で計算されます。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。
TotalTokens いいえ 数える 合計 (和) ApiNameRegionModelDeploymentNameModelNameModelVersion PT1M はい

カテゴリ:SpeechServices - 利用

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
音声秒数バッチ文字起こし

転写されたバッチ数の秒数
AudioSecondsBatchTranscribed いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
音声秒単位のバッチささやき声起こし

バッチのささやき秒数
AudioSecondsBatchWhisperTranscribed いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
音声秒数速記

速い転写秒数
AudioSecondsFastTranscribed いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
音声秒速さやき声起こし

速いささやき秒数の転記
AudioSecondsFastWhisperTranscribed いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
音声秒数の文字起こし

転写秒数
AudioSecondsTranscribed いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
音声秒数の翻訳

翻訳された秒数
AudioSecondsTranslated いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
アバターモデルのホスティングセカンド

秒数。
AvatarModelHostingSeconds いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
アバターモデルトレーニングセカンド

秒数。
AvatarModelTrainingSeconds いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
スピーチモデルのホスティングアワー

スピーチモデルのホスティング時間数
SpeechModelHostingHours いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
合成された文字数

登場人物数。
SynthesizedCharacters いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
ビデオ秒合成

合成された秒数
VideoSecondsSynthesized いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
音声ライブオーディオ入力トークン

キャッシュトークンを除くオーディオ入力トークンの数。
VoiceLiveAudioInputTokens いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
音声ライブオーディオ出力トークン

オーディオ出力トークンの数。
VoiceLiveAudioOutputTokens いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
Voice Liveキャッシュ音声入力トークン

キャッシュされたオーディオ入力トークンの数。
VoiceLiveCachedAudioInputTokens いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
Voice Liveキャッシュテキスト入力トークン

キャッシュされたテキスト入力トークンの数。
VoiceLiveCachedTextInputTokens いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
音声ライブテキスト入力トークン

キャッシュトークンを除くテキスト入力トークンの数。
VoiceLiveTextInputTokens いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
音声ライブテキスト出力トークン

テキスト出力トークンの数。
VoiceLiveTextOutputTokens いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
ボイスモデルホスティングアワー

時間数。
VoiceModelHostingHours いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
ボイスモデルトレーニング時間

分数。
VoiceModelTrainingMinutes いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい

カテゴリ:翻訳サービス - 利用

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
文書文字の翻訳

文書翻訳の文字数要求。
DocumentCharactersTranslated いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
ドキュメントのカスタム文字を翻訳

カスタム文書翻訳リクエストの文字数。
DocumentCustomCharactersTranslated いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
文書同期文字の翻訳

文書翻訳(同期)リクエストの文字数。
OneDocumentCharactersTranslated いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
ドキュメント同期 カスタム文字の翻訳

カスタム文書翻訳(同期)リクエストの文字数。
OneDocumentCustomCharactersTranslated いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
翻訳されたテキスト文字

受信テキスト翻訳リクエストの文字数。
TextCharactersTranslated いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
テキスト カスタム文字 翻訳済み

受信するカスタムテキスト翻訳リクエストの文字数。
TextCustomCharactersTranslated いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
テキスト学習文字

テキスト翻訳で訓練した文字数。
TextTrainedCharacters いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
トランスレータープロアプリ セカンド

Translator Proアプリの使用秒数。
TranslatorProAppSeconds いいえ Seconds 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい

カテゴリ: 使用

メトリック REST APIにおける名前 高度なプラットフォーム メトリック 単位 集約 ディメンション タイムグレインズ DS エクスポート
Computer Vision トランザクション

Computer Visionトランザクションの数
ComputerVisionTransactions いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
カスタムビジョントレーニングタイム

カスタムビジョントレーニング時間
CustomVisionTrainingTime いいえ Seconds 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
カスタムビジョン取引

カスタムビジョン予測取引数
CustomVisionTransactions いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
顔画像の訓練済み

訓練した画像の数。 1トランザクションあたり1,000枚の画像を訓練しました。
FaceImagesTrained いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
保存されている顔

毎日按分で記録された顔の数です。 保存された顔の数は毎日報告されています。
FacesStored いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
Face Transactions

Faceサービスに対して行われたAPI呼び出し数
FaceTransactions いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
保存されたイメージ

保存されているカスタムビジョン画像の数。
ImagesStored いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
学習済みイベント

学習イベントの数。
LearnedEvents いいえ 数える 合計 (和) IsMatchBaselineModeRunId PT1M はい
LUISスピーチリクエスト

LUIS音声から意図への理解要求の件数
LUISSpeechRequests いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
LUISテキストリクエスト

LUISテキストリクエストの数
LUISTextRequests いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
一致した報酬

マッチした報酬の数。
MatchedRewards いいえ 数える 合計 (和) ModeRunId PT1M はい
非活性化イベント

スキップしたイベントの数。
NonActivatedEvents いいえ 数える 合計 (和) ModeRunId PT1M はい
観察された報酬

観察された報酬の数。
ObservedRewards いいえ 数える 合計 (和) ModeRunId PT1M はい
処理された文字

Immersive Readerによって処理された文字数。
ProcessedCharacters いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
処理済みヘルステキスト記録

処理された健康テキスト記録の数
ProcessedHealthTextRecords いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
処理されたイメージ

処理された画像数
ProcessedImages いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
処理済みページ

処理済みページ数
ProcessedPages いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
処理済みテキスト記録

テキスト記録の数。
ProcessedTextRecords いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
QAテキスト・レコード

処理されたテキストレコード数
QuestionAnsweringTextRecords いいえ 数える 合計 (和) ApiNameFeatureNameUsageChannelRegion PT1M はい
合計イベント数

イベント数。
TotalEvents いいえ 数える 合計 (和) ModeRunId PT1M はい
総トランザクション数(廃止)

取引総数。
TotalTransactions いいえ 数える 合計 (和) <なし> PT1M はい

メトリック ディメンション

計量次元とは何かについては、 多次元計量を参照してください。

このサービスは、その指標に関連する以下の次元を持っています。

  • ApiName
  • 機能名
  • ModelDeploymentName
  • ModelName
  • モデルバージョン
  • オペレーションネーム
  • リージョン
  • ステータスコード
  • ストリームタイプ
  • UsageChannel

リソース ログ

このセクションでは、このサービスで収集可能なリソースログの種類を一覧にしています。 このセクションは、Azure Monitorでサポートされているすべてのリソースログカテゴリタイプのリストから抽出しています。

Microsoft対応リソースログ。認知サービス/アカウント

Category 輸出コスト ログテーブル 基本的なログプランをサポートします インジェスション時間変換をサポートします クエリの例
監査 いいえ AzureDiagnostics

複数のAzureリソースからのログ。

いいえ いいえ
AzureOpenAIRequestUsage はい AzureDiagnostics

複数のAzureリソースからのログ。

いいえ いいえ
ManagedNetworkEvent はい AzureDiagnostics

複数のAzureリソースからのログ。

いいえ いいえ
RequestResponse いいえ AzureDiagnostics

複数のAzureリソースからのログ。

いいえ いいえ
追跡 いいえ AzureDiagnostics

複数のAzureリソースからのログ。

いいえ いいえ

Azure Monitor ログ テーブル

このセクションでは、このサービスに関連するAzure Monitorのログテーブルを一覧にしており、これらはKustoクエリを使ってLog Analyticsでクエリ可能です。 テーブルにはリソースログデータが含まれており、収集・ルーティングされるデータによってはそれ以上のデータも含まれる可能性があります。

Azure OpenAI microsoft.cognitiveservices/accounts

アクティビティ ログ

リンクテーブルは、このサービスのアクティビティログに記録可能な操作を一覧にしています。 これらの操作は 、アクティビティログ内のすべてのリソース提供者操作のサブセットです。

アクティビティログエントリのスキーマの詳細については、 アクティビティログスキーマをご覧ください。