EquivalenceEvaluator 類別
定義
重要
部分資訊涉及發行前產品,在發行之前可能會有大幅修改。 Microsoft 對此處提供的資訊,不做任何明確或隱含的瑕疵擔保。
一個 IEvaluator 評估 AI 模型所產生的回應與另一個由 GroundTruth提供回應的「等價性」的 。
public ref class EquivalenceEvaluator sealed : Microsoft::Extensions::AI::Evaluation::IEvaluator
public sealed class EquivalenceEvaluator : Microsoft.Extensions.AI.Evaluation.IEvaluator
type EquivalenceEvaluator = class
interface IEvaluator
Public NotInheritable Class EquivalenceEvaluator
Implements IEvaluator
- 繼承
-
EquivalenceEvaluator
- 實作
備註
EquivalenceEvaluator 衡量被評估的回應與透過 GroundTruth提供的回應相似程度。 它會回傳包含「等價性」分數的 a NumericMetric 。 分數介於1到5之間,1代表低分,5代表優異分數。
註:EquivalenceEvaluator 是一款基於 AI 的評估器,使用 AI 模型來進行評估。 雖然評估者用來執行評估的提示詞設計為模型中立,但該提示(及最終評估)的表現會因所用模型而異,尤其當使用較小或局部的模型時,表現會更差。
該 EquivalenceEvaluator 提示詞已針對以下模型進行測試並調整以適合使用。 因此,使用這個評估器搭配以下清單中的模型,通常能產生最佳結果。 (所用模型可透過以下 ChatClient方式配置。)
GPT-4o
建構函式
| 名稱 | Description |
|---|---|
| EquivalenceEvaluator() |
一個 IEvaluator 評估 AI 模型所產生的回應與另一個由 GroundTruth提供回應的「等價性」的 。 |
屬性
| 名稱 | Description |
|---|---|
| EquivalenceMetricName |
得到 Name 的 NumericMetric 由 返回 EquivalenceEvaluator。 |
| EvaluationMetricNames |
由Name此IEvaluator產生 s 的 s EvaluationMetric。 |
方法
| 名稱 | Description |
|---|---|
| EvaluateAsync(IEnumerable<ChatMessage>, ChatResponse, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken) |
評估所提供的 |