この記事には、このサービスに関するすべてのモニタリングリファレンス情報が含まれています。
Microsoft Foundry Models で Azure OpenAI 用に収集できるデータとその使用方法の詳細については、「Monitor Azure OpenAI」を参照してください。
Metrics
このセクションには、このサービスのために自動的に収集されたすべてのプラットフォーム指標が一覧化されています。 これらの指標は、Azure Monitorでサポートされている
指標保持に関する情報は、Azure Monitor 指標概要を参照してください。
Microsoftのサポートメトリクス。認知サービス/アカウント
Azure OpenAI の最も重要なメトリックを監視します。 この記事の後半では、この名前空間で使用可能なすべてのメトリックの一覧を詳しく見つけます。この短い一覧には、メトリックの詳細が含まれています。 最も up-to-date 情報については、次の一覧を参照してください。 Azure チームは、次のセクションのテーブルの更新に取り組んでいます。
Important
この記事の後半で「Latency」に記載されているレガシーメトリックと混同しないでください。 従来の Latency メトリックはAzure OpenAI ワークロード向けに設計されておらず、OpenAI レイテンシの診断に使うと誤解を招く結果Azure出します。 OpenAIのレイテンシ監視Azureには、応答時間(AzureOpenAITimeToResponse)、最後のバイトまでの時間(AzureOpenAITTLTInMS)、トークン間の時間 (AzureOpenAINormalizedTBTInMS)、または正規化された最初のバイトまでの時間(AzureOpenAINormalizedTTFTInMS)を使いましょう。 これらの指標の解釈に関する指針については、 パフォーマンスとレイテンシーを参照してください。
- OpenAI 要求のAzure
- アクティブ トークン
- 生成完了トークン
- ファインチューンドトレーニング時間の処理
- 処理推論トークン
- 処理プロンプトトークン
- プロビジョニング管理利用率V2
- プロンプトトークンキャッシュマッチ率
- 対応の時期
- トークン間の時間
- タイム・トゥ・ラストバイト
- 正規化されて最初のバイトまでの時間
- トークン数/秒
また、他の関連サービスが使用するコンテンツの安全性メトリックを監視することもできます。
- ブロックされたボリューム
- 有害な体積検出
- 潜在的な悪用ユーザー数
- 安全システムイベント
- 安全確認のために送られた総体積
Note
プロビジョニング管理利用率メトリクスは現在非推奨となり、推奨されていません。 このメトリックは、 プロビジョニングされたマネージド使用率 V2 メトリックに 置き換えられます。 現在、標準デプロイでは、1 秒あたりのトークン数、Time to Response、Time Between Tokens は使用できません。
クイックリファレンス:ユースケース別の主な指標
この表を使って、特定のモニタリング目標に適した指標を見つけてください。 これらの指標の解釈に関するエンドツーエンドのガイダンスについては、 パフォーマンスとレイテンシーを参照してください。
| 監視したい... | この指標を用いる | REST API名 |
|---|---|---|
| 全体的な応答時間 | タイム・トゥ・ラストバイト | AzureOpenAITTLTInMS |
| ファーストトークン応答性(ストリーミング) | 対応の時期 | AzureOpenAITimeToResponse |
| トークン生成速度 | トークン間の時間 | AzureOpenAINormalizedTBTInMS |
| プロンプトサイズで正規化されたファーストトークン効率 | 正規化されて最初のバイトまでの時間 | AzureOpenAINormalizedTTFTInMS |
| リクエストごとの出力トークン量 | 生成完了トークン | GeneratedTokens |
| リクエストごとの入力トークン量 | 処理プロンプトトークン | ProcessedPromptTokens |
| PTU容量利用率 | プロビジョニング管理利用率V2 | AzureOpenAIProvisionedManagedUtilizationV2 |
| リクエストボリュームとエラー | OpenAI 要求のAzure | AzureOpenAIRequests |
Tip
常にレイテンシ指標とトークン数指標を組み合わせてください。 トークンの増加が伴わない遅延増加は、実際の問題を示している可能性があります。 トークンの増加に伴う遅延の増加は期待される動作です。
Warnung
この記事後半で述べるCognitive Services - HTTP RequestsのメトリクスはレガシーなCognitive Servicesのメトリクスであり、OpenAIのワークロードAzure向けには設計されていません。 特に、そのカテゴリのLatencyメトリックは、OpenAIのAzureレイテンシ指標(応答時間、最終バイトまでの時間、トークン間の時間、正規化された最初のバイトまでの時間)とは異なります。 OpenAIのトラブルシューティングAzureにレガシーLatencyメトリックを使うと誤解を招く結果が出ます。 代わりに、このセクションに記載されているAzure OpenAIの指標をご利用ください。
以下の表は、Microsoftで利用可能な指標を示しています。認知サービス/アカウントリソースの種類。
- すべての列がすべてのテーブルに存在しているわけではありません。
- 一部の列はページの閲覧範囲を超えている場合があります。 利用可能なすべての列を見るには 「表を展開 」を選択します。
テーブル見出し
- カテゴリ - 指標グループまたは分類。
- Metric - Azureポータルに表示されるメトリクス名。
- REST APIにおける名称 - REST APIで言及されるメトリック名。
- 単位 - 単位単位。
- 集約 - デフォルトの 集約 タイプ。 有効数値:平均(平均)、最小(最小)、最大(最大)、合計(合計)、カウント。
- メトリックの - は利用可能です。
-
タイムグレインズ - 指標がサンプリングされる間隔。 例えば、
PT1Mは指標が1分ごと、30分ごと、PT30M1時間ごとにサンプリングされる、というように、1分ごと、PT1H10分ごと、というように示しています。 - DS エクスポート- 診断設定を通じてAzure Monitorログにメトリクスをエクスポートできるかどうか。 指標のエクスポートに関する情報は、Azure Monitorで診斷設定を作成する」をご覧ください。
カテゴリ:Azure OpenAI - HTTP Requests
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
OpenAI AvailabilityRate のAzure 以下の計算による可用性パーセンテージ:(総通話数 - サーバーエラー数)/総通話数。 サーバーエラーにはHTTP応答 >=500が含まれます。 |
AzureOpenAIAvailabilityRate |
いいえ | パーセント | 最小、最大、平均 |
ApiName、 OperationName、 Region、 StreamType、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | いいえ |
|
Azure OpenAI リクエスト 一定期間にわたってAzure OpenAI APIにかけられた呼び出し数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。 APIリクエストを分解するには、フィルターを追加したり、次の次元で分割したりできます:ModelDeploymentName、ModelName、ModelVersion、StatusCode(成功、clienterrors、server error)、スピルオーバー情報用のIsSpillover、ServiceTier、StreamType(ストリーミングリクエストと非ストリーミングリクエスト)、そして操作。 |
AzureOpenAIRequests |
いいえ | 数える | 合計 (和) |
ApiName、 OperationName、 Region、 StreamType、 ModelDeploymentName、 ModelName、 ModelVersion、 StatusCode、 IsSpillover、 ServiceTierRequest、 ServiceTierResponse |
PT1M | はい |
カテゴリ:Azure OpenAI - レイテンシー
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
トークン間の時間 ストリーミングリクエストには;モデルのトークン生成率はミリ秒単位で測定されます。 PTU、PTU管理型、従量制の展開に適用されます。 |
AzureOpenAINormalizedTBTInMS |
いいえ | ミリ秒 | 最大、最小、平均 |
Region、 ModelDeploymentName、 ModelName、 ModelVersion、 ServiceTierRequest、 ServiceTierResponse |
PT1M | はい |
|
正規化されて最初のバイトまでの時間 ストリーミングおよび非ストリーミングリクエストについて;モデルごとにリクエストがなされた後、最初の応答データバイトが受信されるまでの時間(トークンで正規化)が該当します。 PTU、PTU管理、従量課金型の展開に適用されます。 |
AzureOpenAINormalizedTTFTInMS |
いいえ | ミリ秒 | 最大、最小、平均 |
Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | はい |
|
対応の時期 ストリーミングリクエストの推奨遅延(レスポンシブネス)指標。 PTU、PTU管理型、従量制の展開に適用されます。 APIゲートウェイで測定されるように、ユーザーがプロンプトを送信した後に最初の応答が表示されるまでの時間として計算されます。 この数値はプロンプトサイズが増えたり、キャッシュヒットサイズが減少したりすると増加します。 応答メトリクスに時間を分解するには、フィルターを追加したり、ModelDeploymentName、ModelName、ModelVersionの次元で分割できます。 注:この指標は近似であり、測定されたレイテンシは同時通話や全体のワークロードパターンなど複数の要因に大きく依存します。 さらに、クライアントとAPIエンドポイント間に存在する可能性のあるクライアント側の遅延も考慮していません。 最適なレイテンシトラッキングについては、ご自身のログを参照してください。 |
AzureOpenAITimeToResponse |
いいえ | ミリ秒 | 最小、最大、平均 |
ApiName、 OperationName、 Region、、 StreamType、 ModelDeploymentName、 ModelName、 ModelVersion、 StatusCode |
PT1M | はい |
|
トークン数/秒 特定のAzure OpenAIモデル応答の生成速度を列挙します。 生成されたトークンの総数を、トークン生成までの時間(秒単位)で割ります。 PTU、PTU管理型、従量制の展開に適用されます。 |
AzureOpenAITokenPerSecond |
いいえ | 数える | 最大、最小、平均 |
Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | はい |
|
タイム・トゥ・ラストバイト ストリーミングおよび非ストリーミングリクエストについて;モデルによるリクエストが行われた後、応答データの最後のバイトが受信されるまでの時間です。 PTU、PTU管理、従量課金型の展開に適用されます。 |
AzureOpenAITTLTInMS |
いいえ | ミリ秒 | 最大、最小、平均 |
Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | はい |
カテゴリ:Azure OpenAI - 使用法
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
アクティブ トークン 一定期間にわたるキャッシュトークンを差し引いたトークンの合計。 PTUおよびPTU管理の展開に適用されます。 この指標を使って、PTUのTPSやTPMベースの利用率を理解し、シナリオのターゲットTPSやTPMのベンチマークと比較してください。 APIリクエストを分解するには、フィルターを追加したり、ModelDeploymentName、ModelName、ModelVersionの各次元で分割を適用できます。 |
ActiveTokens |
いいえ | 数える | 最小、最大、平均、合計(合計) |
Region、 ModelDeploymentName、 ModelName、 ModelVersion、 ServiceTierRequest、 ServiceTierResponse |
PT1M | はい |
|
オーディオ完了トークン OpenAIモデル上で生成(出力)される音声プロンプトトークンの数。 PTU管理型および従量制モデルの展開に適用されます。 |
AudioCompletionTokens |
いいえ | 数える | 合計 (和) |
ModelDeploymentName、 ModelName、 ModelVersion、 Region |
PT1M | はい |
|
オーディオプロンプトトークン OpenAIモデル上で処理(入力)された音声プロンプトトークンの数。 PTU管理型および従量制モデルの展開に適用されます。 |
AudioPromptTokens |
いいえ | 数える | 合計 (和) |
ModelDeploymentName、 ModelName、 ModelVersion、 Region |
PT1M | はい |
|
プロンプトトークンキャッシュマッチ率 キャッシュに到達したプロンプトトークンの割合。 PTUおよびPTU管理の展開に適用されます。 |
AzureOpenAIContextTokensCacheMatchRate |
いいえ | パーセント | 最小、最大、平均 |
Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | いいえ |
|
プロビジョニング管理利用(非推奨) プロヴィゾンマネージド展開の利用率 % は(消費PTU数/展開数)×100で計算されます。 利用率が100%を超えると通話が制限され、エラーコード429が返されます。 この指標を分解するために、フィルターを追加したり、次の次元で分割を適用できます:ModelDeploymentName、ModelName、ModelVersion、StreamType(ストリーミングリクエストと非ストリーミングリクエスト) |
AzureOpenAIProvisionedManagedUtilization |
いいえ | パーセント | 最小、最大、平均 |
Region、 StreamType、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | いいえ |
|
プロビジョニング管理利用率V2 プロヴィゾンマネージド展開の利用率 % は(消費PTU数/展開数)×100で計算されます。 利用率が100%を超えると通話が制限され、エラーコード429が返されます。 この指標を分解するために、フィルターを追加したり、次の次元で分割を適用できます:ModelDeploymentName、ModelName、ModelVersion、StreamType(ストリーミングリクエストと非ストリーミングリクエスト) |
AzureOpenAIProvisionedManagedUtilizationV2 |
いいえ | パーセント | 最小、最大、平均 |
Region、 StreamType、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | いいえ |
|
ファインチューンドトレーニング時間の処理 OpenAIのファインチューンモデルで処理されたトレーニング時間数 |
FineTunedTrainingHours |
いいえ | 数える | 合計 (和) |
ApiName、 ModelDeploymentName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
生成完了トークン OpenAIモデルから生成(出力)されるトークンの数。 PTU、PTU管理型、従量制の展開に適用されます。 この指標を分解するには、フィルターを追加したり、ModelDeploymentNameとModelNameの次元で分割を適用できます。 |
GeneratedTokens |
いいえ | 数える | 合計 (和) |
ApiName、 ModelDeploymentName、 FeatureName、 UsageChannel、 Region、 ModelVersion |
PT1M | はい |
|
処理プロンプトトークン OpenAIモデルで処理された(入力)プロンプトトークンの数。 PTU、PTU管理型、従量制の展開に適用されます。 この指標を分解するには、フィルターを追加したり、ModelDeploymentNameとModelNameの次元で分割を適用できます。 |
ProcessedPromptTokens |
いいえ | 数える | 合計 (和) |
ApiName、 ModelDeploymentName、 FeatureName、 UsageChannel、 Region、 ModelVersion |
PT1M | はい |
|
使用されたリアルタイムAPI秒数 リアルタイムAPI使用秒数 |
RealtimeUsageTime |
いいえ | 数える | 合計 (和) |
Region、ModelDeploymentName |
PT1M | はい |
|
処理推論トークン OpenAIモデル上で処理された推論トークンの数。 プロンプトトークン(入力)と生成トークン(出力)で計算されます。 PTU、PTU管理型、従量制の展開に適用されます。 この指標を分解するには、フィルターを追加したり、ModelDeploymentNameとModelNameの次元で分割を適用できます。 |
TokenTransaction |
いいえ | 数える | 合計 (和) |
ApiName、 ModelDeploymentName、 FeatureName、 UsageChannel、 Region、 ModelVersion |
PT1M | はい |
カテゴリ:認知サービス - HTTPリクエスト
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
ブロックされた呼び出し 料金やノルマの上限を超えた通話件数。 Azure OpenAIサービスには使用しないでください。 |
BlockedCalls |
いいえ | 数える | 合計 (和) |
ApiName、 OperationName、 Region、 RatelimitKey |
PT1M | はい |
|
クライアント エラー クライアント側エラー(HTTP応答コード4xx)を含む通話回数。 Azure OpenAIサービスには使用しないでください。 |
ClientErrors |
いいえ | 数える | 合計 (和) |
ApiName、 OperationName、 Region、 RatelimitKey |
PT1M | はい |
|
データイン 受信データのサイズ(バイト単位)。 Azure OpenAIサービスには使用しないでください。 |
DataIn |
いいえ | バイト | 合計 (和) |
ApiName、 OperationName、 Region |
PT1M | はい |
|
データ出力 送信データのサイズ(バイト単位)。 Azure OpenAIサービスには使用しないでください。 |
DataOut |
いいえ | バイト | 合計 (和) |
ApiName、 OperationName、 Region |
PT1M | はい |
|
遅延 レイテンシはミリ秒単位です。 Azure OpenAIサービスには使用しないでください。 |
Latency |
いいえ | ミリ秒 | Average |
ApiName、 OperationName、 Region、 RatelimitKey |
PT1M | はい |
|
Ratelimit レート制限キーの現在のレート制限。 Azure OpenAIサービスには使用しないでください。 |
Ratelimit |
いいえ | 数える | 合計 (和) |
Region、RatelimitKey |
PT1M | はい |
|
サーバー エラー サービス内部エラー(HTTP応答コード5xx)の呼び出し数。 Azure OpenAIサービスには使用しないでください。 |
ServerErrors |
いいえ | 数える | 合計 (和) |
ApiName、 OperationName、 Region、 RatelimitKey |
PT1M | はい |
|
成功した呼び出し 成功した通話回数。 Azure OpenAIサービスには使用しないでください。 |
SuccessfulCalls |
いいえ | 数える | 合計 (和) |
ApiName、 OperationName、 Region、 RatelimitKey |
PT1M | はい |
|
合計通話数 通話回数の総数。 Azure OpenAIサービスには使用しないでください。 |
TotalCalls |
いいえ | 数える | 合計 (和) |
ApiName、 OperationName、 Region、 RatelimitKey |
PT1M | はい |
|
合計エラー数 エラー応答(HTTP応答コード4xxまたは5xx)を持つ通話の総数。 Azure OpenAIサービスには使用しないでください。 |
TotalErrors |
いいえ | 数える | 合計 (和) |
ApiName、 OperationName、 Region、 RatelimitKey |
PT1M | はい |
|
総トークン通話数 トークンコールの総数。 |
TotalTokenCalls |
いいえ | 数える | 合計 (和) |
ApiName、 OperationName、 Region |
PT1M | はい |
カテゴリ:認知サービス - SLI
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
AvailabilityRate 以下の計算による可用性パーセンテージ:(総通話数 - サーバーエラー数)/総通話数。 サーバーエラーにはHTTP応答 >=500が含まれます。 Azure OpenAIサービスには使用しないでください。 |
SuccessRate |
いいえ | パーセント | 最小、最大、平均 |
ApiName、 OperationName、 Region、 RatelimitKey |
PT1M | いいえ |
カテゴリ:コンテンツ理解 - 使用法
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
Face Transactions Faceサービスに対して行われたAPI呼び出し数 |
FaceApiTransactions |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
処理済み音声分 処理された音声分数 |
ProcessedAudioMinutes |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
処理済みページ 処理済みのドキュメントページ数 |
ProcessedDocumentPages |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
処理されたイメージ 処理された画像数 |
ProcessedImageCount |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
処理済みビデオ分 処理された映像分数 |
ProcessedVideoMinutes |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
トークン 消費されたトークンの数 |
Tokens |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
カテゴリ:コンテンツ安全 - リスクと安全
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
有害な体積検出 一定期間にわたって、コンテンツフィルターでAzure OpenAI APIにかけられ、有害と検出された(ブロックモデルおよび注釈モードの両方)の呼び出し数。 フィルターを追加したり、次の次元で分割を適用したりできます:ModelDeploymentName、ModelName、TextType。 |
RAIHarmfulRequests |
いいえ | 数える | 合計 (和) |
Region、 ModelDeploymentName、 ModelName、、 ModelVersion、 ApiName、 TextType、 Category、 Severity |
PT1M | はい |
|
ブロックされたボリューム 一定期間にわたってAzure OpenAI APIにかけられた呼び出し数と、適用されたコンテンツフィルターによって拒否された回数。 フィルターを追加したり、次の次元で分割を適用したりできます:ModelDeploymentName、ModelName、TextType。 |
RAIRejectedRequests |
いいえ | 数える | 合計 (和) |
Region、 ModelDeploymentName、 ModelName、 ModelVersion、 ApiName、 TextType、 Category |
PT1M | はい |
|
安全システムイベント リスクと安全監視のためのシステムイベント。 フィルターを追加したり、次の次元で分割したりできます:EventType。 |
RAISystemEvent |
いいえ | 数える | Average |
Region、EventType |
PT1M | はい |
|
安全確認のために送られた総体数 一定期間にわたってAzure OpenAI APIにかけられた呼び出し数と、コンテンツフィルターで検出された回数。 フィルターを追加したり、次の次元で分割したりできます:ModelDeploymentName、ModelName。 |
RAITotalRequests |
いいえ | 数える | 合計 (和) |
Region、 ModelDeploymentName、 ModelName、 ModelVersion、 ApiName |
PT1M | はい |
カテゴリ:コンテンツ安全 - 使用方法
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
画像モデレーションのための通話回数 画像モデレーションの要請が多数。 |
ContentSafetyImageAnalyzeRequestCount |
いいえ | 数える | 合計 (和) | ApiVersion |
PT1M | はい |
|
テキストモデレーションのための通話回数 テキストモデレーションの電話数。 |
ContentSafetyTextAnalyzeRequestCount |
いいえ | 数える | 合計 (和) | ApiVersion |
PT1M | はい |
カテゴリ:言語 - 求人
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
ジョブ期間(プレビュー) 注:この値は入力サイズ、文書数、タスクの複雑さに大きく依存します。 これはすべてのジョブタスクを総算した値です。 |
JobDuration |
いいえ | ミリ秒 | 最小、最大、平均 |
JobStatus、JobType |
PT1M | はい |
カテゴリ:モデル - HTTPリクエスト
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
モデルの利用可能性 以下の計算による可用性パーセンテージ:(総通話数 - サーバーエラー数)/総通話数。 サーバーエラーにはHTTP応答 >=500が含まれます。 |
ModelAvailabilityRate |
いいえ | パーセント | 最小、最大、平均 |
Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | いいえ |
|
モデル要求 一定期間にわたってモデルAPIにかけられた呼び出し数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。 |
ModelRequests |
いいえ | 数える | 合計 (和) |
ApiName、 OperationName、 Region、 StreamType、 ModelDeploymentName、 ModelName、 ModelVersion、 StatusCode、 IsSpillover、 ServiceTierRequest、 ServiceTierResponse |
PT1M | はい |
カテゴリ:モデル - レイテンシー
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
トークン間の時間 モデルのトークン生成率はミリ秒単位で測定されます。 PTUおよびPTU管理の展開に適用されます。 ストリーミング以外のリクエストの場合、この値は推定値です。 |
NormalizedTimeBetweenTokens |
いいえ | ミリ秒 | 最大、最小、平均 |
ApiName、 OperationName、 Region、 StreamType、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | はい |
|
正規化されて最初のバイトまでの時間 モデルによるリクエストがなされた後、最初の応答データバイトが受信されるまでの時間(トークンで正規化)です。 PTU、PTU管理、従量課金型の展開に適用されます。 ストリーミング以外のリクエストの場合、この値は推定値です。 |
NormalizedTimeToFirstToken |
いいえ | ミリ秒 | 最大、最小、平均 |
ApiName、 OperationName、 Region、 StreamType、 ModelDeploymentName、 ModelName、 ModelVersion、 ServiceTierRequest、 ServiceTierResponse |
PT1M | はい |
|
タイム・トゥ・ラストバイト モデルによるリクエスト後に応答データの最後のバイトが受信されるまでの時間です。 PTU、PTU管理、従量課金型の展開に適用されます。 ストリーミング以外のリクエストの場合、この値は推定値です。 |
TimeToLastByte |
いいえ | ミリ秒 | 最大、最小、平均 |
ApiName、 OperationName、 Region、 StreamType、 ModelDeploymentName、 ModelName、 ModelVersion、 ServiceTierRequest、 ServiceTierResponse |
PT1M | はい |
|
対応の時期 推奨されるレイテンシ(応答性)指標。 PTUおよびPTU管理の展開に適用されます。 APIゲートウェイで測定されるように、ユーザーがプロンプトを送信した後に最初の応答が表示されるまでの時間として計算されます。 この数値はプロンプトサイズが増えたり、キャッシュヒットサイズが減少したりすると増加します。 応答メトリクスに時間を分解するには、フィルターを追加したり、ModelDeploymentName、ModelName、ModelVersionの次元で分割できます。 注:この指標は近似であり、測定されたレイテンシは同時通話や全体のワークロードパターンなど複数の要因に大きく依存します。 さらに、クライアントとAPIエンドポイント間に存在する可能性のあるクライアント側の遅延も考慮していません。 ストリーミング以外のリクエストの場合、この値は推定値です。 最適なレイテンシトラッキングについては、ご自身のログを参照してください。 |
TimeToResponse |
いいえ | ミリ秒 | 最小、最大、平均 |
ApiName、OperationName、Region、StreamType、ModelDeploymentName、ModelName、ModelVersion、StatusCode、ServiceTierRequest、ServiceTierResponse |
PT1M | はい |
|
トークン数/秒 与えられたモデル応答に対する生成速度を列挙します。 生成されたトークンの総数を、トークン生成までの時間(秒単位)で割ります。 PTUおよびPTU管理の展開に適用されます。 ストリーミング以外のリクエストの場合、この値は推定値です。 |
TokensPerSecond |
いいえ | 数える | 最大、最小、平均 |
ApiName、 OperationName、 Region、 StreamType、 ModelDeploymentName、 ModelName、 ModelVersion、 ServiceTierRequest、 ServiceTierResponse |
PT1M | はい |
カテゴリ:モデル - 利用
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
注釈付きページ 注釈付き処理済みの総ページ数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。 |
AnnotatedPages |
いいえ | 数える | 合計 (和) |
ApiName、 Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | はい |
|
オーディオ入力トークン OpenAIモデル上で処理(入力)された音声プロンプトトークンの数。 PTU管理モデル展開に適用されます。 |
AudioInputTokens |
いいえ | 数える | 合計 (和) |
ModelDeploymentName、 ModelName、 ModelVersion、 Region |
PT1M | はい |
|
オーディオ出力トークン OpenAIモデル上で生成(出力)される音声プロンプトトークンの数。 PTU管理モデル展開に適用されます。 |
AudioOutputTokens |
いいえ | 数える | 合計 (和) |
ModelDeploymentName、 ModelName、 ModelVersion、 Region |
PT1M | はい |
|
キャッシュから読み取るプロンプトトークン キャッシュから読み取られたトークンの総数。 Anthropicモデルの展開に適用されます。 応答用法セクションで次のように表出されました cache_read_input_tokens |
cacheReadInputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 Region、 ModelDeploymentName、 ModelName、 ModelVersion、 ContextLength |
PT1M | はい |
|
キャッシュに書き込まれたプロンプトトークン(1時間TTL) 1時間エントリーを作成するのに使われたプロンプトトークンの数。 Anthropicモデルの展開に適用されます。 応答用法セクションで次のように表出されました cache_creation.ephemeral_1h_input_tokens |
ephemeral1hInputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 Region、 ModelDeploymentName、 ModelName、 ModelVersion、 ContextLength |
PT1M | はい |
|
キャッシュに書き込まれたプロンプトトークン(5分TTL) 5分間のキャッシュエントリを作成するために使われたプロンプトトークンの数。 Anthropicモデルの展開に適用されます。 応答用法セクションで次のように表出されました cache_creation.ephemeral_5m_input_tokens |
ephemeral5mInputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 Region、 ModelDeploymentName、 ModelName、 ModelVersion、 ContextLength |
PT1M | はい |
|
生成されたイメージ 生成された画像の総数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。 |
GeneratedImages |
いいえ | 数える | 合計 (和) |
ApiName、 Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | はい |
|
入力トークン モデル上で処理された(入力)プロンプトトークンの数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。 |
InputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | はい |
|
出力トークン OpenAIモデルから生成(出力)されるトークンの数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。 |
OutputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | はい |
|
プロビジョニングされた使用率 プロヴィゾンマネージド展開の利用率 % は(消費PTU数/展開数)×100で計算されます。 利用率が100%を超えると通話が制限され、エラーコード429が返されます。 |
ProvisionedUtilization |
いいえ | パーセント | 最小、最大、平均 |
Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | いいえ |
|
合計ページ数 処理済みの総ページ数。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。 |
TotalPages |
いいえ | 数える | 合計 (和) |
ApiName、 Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | はい |
|
合計トークン数 モデル上で処理される推論トークンの数。 プロンプトトークン(入力)と生成トークン(出力)で計算されます。 PTU、PTU-Managed、ペイド・アズ・ユー・ゴーの派遣に適用されます。 |
TotalTokens |
いいえ | 数える | 合計 (和) |
ApiName、 Region、 ModelDeploymentName、 ModelName、 ModelVersion |
PT1M | はい |
カテゴリ:SpeechServices - 利用
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
音声秒数バッチ文字起こし 転写されたバッチ数の秒数 |
AudioSecondsBatchTranscribed |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
音声秒単位のバッチささやき声起こし バッチのささやき秒数 |
AudioSecondsBatchWhisperTranscribed |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
音声秒数速記 速い転写秒数 |
AudioSecondsFastTranscribed |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
音声秒速さやき声起こし 速いささやき秒数の転記 |
AudioSecondsFastWhisperTranscribed |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
音声秒数の文字起こし 転写秒数 |
AudioSecondsTranscribed |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
音声秒数の翻訳 翻訳された秒数 |
AudioSecondsTranslated |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
アバターモデルのホスティングセカンド 秒数。 |
AvatarModelHostingSeconds |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
アバターモデルトレーニングセカンド 秒数。 |
AvatarModelTrainingSeconds |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
スピーチモデルのホスティングアワー スピーチモデルのホスティング時間数 |
SpeechModelHostingHours |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
合成された文字数 登場人物数。 |
SynthesizedCharacters |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
ビデオ秒合成 合成された秒数 |
VideoSecondsSynthesized |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
音声ライブオーディオ入力トークン キャッシュトークンを除くオーディオ入力トークンの数。 |
VoiceLiveAudioInputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
音声ライブオーディオ出力トークン オーディオ出力トークンの数。 |
VoiceLiveAudioOutputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
Voice Liveキャッシュ音声入力トークン キャッシュされたオーディオ入力トークンの数。 |
VoiceLiveCachedAudioInputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
Voice Liveキャッシュテキスト入力トークン キャッシュされたテキスト入力トークンの数。 |
VoiceLiveCachedTextInputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
音声ライブテキスト入力トークン キャッシュトークンを除くテキスト入力トークンの数。 |
VoiceLiveTextInputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
音声ライブテキスト出力トークン テキスト出力トークンの数。 |
VoiceLiveTextOutputTokens |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
ボイスモデルホスティングアワー 時間数。 |
VoiceModelHostingHours |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
ボイスモデルトレーニング時間 分数。 |
VoiceModelTrainingMinutes |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
カテゴリ:翻訳サービス - 利用
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
文書文字の翻訳 文書翻訳の文字数要求。 |
DocumentCharactersTranslated |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
ドキュメントのカスタム文字を翻訳 カスタム文書翻訳リクエストの文字数。 |
DocumentCustomCharactersTranslated |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
文書同期文字の翻訳 文書翻訳(同期)リクエストの文字数。 |
OneDocumentCharactersTranslated |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
ドキュメント同期 カスタム文字の翻訳 カスタム文書翻訳(同期)リクエストの文字数。 |
OneDocumentCustomCharactersTranslated |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
翻訳されたテキスト文字 受信テキスト翻訳リクエストの文字数。 |
TextCharactersTranslated |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
テキスト カスタム文字 翻訳済み 受信するカスタムテキスト翻訳リクエストの文字数。 |
TextCustomCharactersTranslated |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
テキスト学習文字 テキスト翻訳で訓練した文字数。 |
TextTrainedCharacters |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
トランスレータープロアプリ セカンド Translator Proアプリの使用秒数。 |
TranslatorProAppSeconds |
いいえ | Seconds | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
カテゴリ: 使用
| メトリック | REST APIにおける名前 | 高度なプラットフォーム メトリック | 単位 | 集約 | ディメンション | タイムグレインズ | DS エクスポート |
|---|---|---|---|---|---|---|---|
|
Computer Vision トランザクション Computer Visionトランザクションの数 |
ComputerVisionTransactions |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
カスタムビジョントレーニングタイム カスタムビジョントレーニング時間 |
CustomVisionTrainingTime |
いいえ | Seconds | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
カスタムビジョン取引 カスタムビジョン予測取引数 |
CustomVisionTransactions |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
顔画像の訓練済み 訓練した画像の数。 1トランザクションあたり1,000枚の画像を訓練しました。 |
FaceImagesTrained |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
保存されている顔 毎日按分で記録された顔の数です。 保存された顔の数は毎日報告されています。 |
FacesStored |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
Face Transactions Faceサービスに対して行われたAPI呼び出し数 |
FaceTransactions |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
保存されたイメージ 保存されているカスタムビジョン画像の数。 |
ImagesStored |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
学習済みイベント 学習イベントの数。 |
LearnedEvents |
いいえ | 数える | 合計 (和) |
IsMatchBaseline、 Mode、 RunId |
PT1M | はい |
|
LUISスピーチリクエスト LUIS音声から意図への理解要求の件数 |
LUISSpeechRequests |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
LUISテキストリクエスト LUISテキストリクエストの数 |
LUISTextRequests |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
一致した報酬 マッチした報酬の数。 |
MatchedRewards |
いいえ | 数える | 合計 (和) |
Mode、RunId |
PT1M | はい |
|
非活性化イベント スキップしたイベントの数。 |
NonActivatedEvents |
いいえ | 数える | 合計 (和) |
Mode、RunId |
PT1M | はい |
|
観察された報酬 観察された報酬の数。 |
ObservedRewards |
いいえ | 数える | 合計 (和) |
Mode、RunId |
PT1M | はい |
|
処理された文字 Immersive Readerによって処理された文字数。 |
ProcessedCharacters |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
処理済みヘルステキスト記録 処理された健康テキスト記録の数 |
ProcessedHealthTextRecords |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
処理されたイメージ 処理された画像数 |
ProcessedImages |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
処理済みページ 処理済みページ数 |
ProcessedPages |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
処理済みテキスト記録 テキスト記録の数。 |
ProcessedTextRecords |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
QAテキスト・レコード 処理されたテキストレコード数 |
QuestionAnsweringTextRecords |
いいえ | 数える | 合計 (和) |
ApiName、 FeatureName、 UsageChannel、 Region |
PT1M | はい |
|
合計イベント数 イベント数。 |
TotalEvents |
いいえ | 数える | 合計 (和) |
Mode、RunId |
PT1M | はい |
|
総トランザクション数(廃止) 取引総数。 |
TotalTransactions |
いいえ | 数える | 合計 (和) | <なし> | PT1M | はい |
メトリック ディメンション
計量次元とは何かについては、 多次元計量を参照してください。
このサービスは、その指標に関連する以下の次元を持っています。
- ApiName
- 機能名
- ModelDeploymentName
- ModelName
- モデルバージョン
- オペレーションネーム
- リージョン
- ステータスコード
- ストリームタイプ
- UsageChannel
リソース ログ
このセクションでは、このサービスで収集可能なリソースログの種類を一覧にしています。 このセクションは、Azure Monitorでサポートされている
Microsoft対応リソースログ。認知サービス/アカウント
| Category | 輸出コスト | ログテーブル | 基本的なログプランをサポートします | インジェスション時間変換をサポートします | クエリの例 |
|---|---|---|---|---|---|
| 監査 | いいえ |
AzureDiagnostics 複数のAzureリソースからのログ。 |
いいえ | いいえ | |
| AzureOpenAIRequestUsage | はい |
AzureDiagnostics 複数のAzureリソースからのログ。 |
いいえ | いいえ | |
| ManagedNetworkEvent | はい |
AzureDiagnostics 複数のAzureリソースからのログ。 |
いいえ | いいえ | |
| RequestResponse | いいえ |
AzureDiagnostics 複数のAzureリソースからのログ。 |
いいえ | いいえ | |
| 追跡 | いいえ |
AzureDiagnostics 複数のAzureリソースからのログ。 |
いいえ | いいえ |
Azure Monitor ログ テーブル
このセクションでは、このサービスに関連するAzure Monitorのログテーブルを一覧にしており、これらはKustoクエリを使ってLog Analyticsでクエリ可能です。 テーブルにはリソースログデータが含まれており、収集・ルーティングされるデータによってはそれ以上のデータも含まれる可能性があります。
Azure OpenAI microsoft.cognitiveservices/accounts
アクティビティ ログ
リンクテーブルは、このサービスのアクティビティログに記録可能な操作を一覧にしています。 これらの操作は 、アクティビティログ内のすべてのリソース提供者操作のサブセットです。
アクティビティログエントリのスキーマの詳細については、 アクティビティログスキーマをご覧ください。
関連するコンテンツ
- OpenAI Azure監視の詳細については、「Monitor Azure OpenAI」を参照してください。
- Azure リソースの監視の詳細については、Azure Monitor を使用した Azure リソースの監視に関するページを参照してください。