Microsoft.Extensions.AI.Evaluation.Quality Namespace

Enthält Bewertungsklassen, die die Qualität von LLM-Antworten (Large Language Model) in einer App anhand verschiedener Metriken bewerten.

Klassen

Name Beschreibung
CoherenceEvaluator

Eine IEvaluator Bewertung der "Kohärenz" einer Antwort, die von einem KI-Modell erzeugt wird.

CompletenessEvaluator

Eine IEvaluator , die die "Vollständigkeit" einer Antwort auswertet, die von einem KI-Modell erzeugt wird.

CompletenessEvaluatorContext

Kontextbezogene Informationen, die zum CompletenessEvaluator Auswerten der "Vollständigkeit" einer Antwort verwendet werden.

EquivalenceEvaluator

Eine IEvaluator , die die "Äquivalenz" einer Antwort auswertet, die von einem KI-Modell mit einer anderen Antwort erzeugt wird, die über GroundTruth.

EquivalenceEvaluatorContext

Kontextbezogene Informationen, die zum EquivalenceEvaluator Auswerten der "Äquivalenz" einer Antwort verwendet werden.

FluencyEvaluator

Eine IEvaluator , die die "Fluency" einer Antwort auswertet, die von einem KI-Modell erzeugt wird.

GroundednessEvaluator

Eine IEvaluator , die die "Erdheit" einer Antwort auswertet, die von einem KI-Modell erzeugt wird.

GroundednessEvaluatorContext

Kontextbezogene Informationen, die verwendet GroundednessEvaluator werden, um die "Erdheit" einer Antwort auszuwerten.

IntentResolutionEvaluator

Eine IEvaluator Bewertung der Effektivität eines KI-Systems bei der Identifizierung und Auflösung von Benutzerabsichten.

IntentResolutionEvaluatorContext

Kontextbezogene Informationen, die verwendet werden, um die IntentResolutionEvaluator Effektivität eines KI-Systems bei der Identifizierung und Auflösung von Benutzerabsichten zu bewerten.

RelevanceEvaluator

Eine IEvaluator , die die "Relevanz" einer Antwort auswertet, die von einem KI-Modell erzeugt wird.

RelevanceTruthAndCompletenessEvaluator

Eine IEvaluator , die die "Relevanz", "Wahrheit" und "Vollständigkeit" einer Antwort auswertet, die von einem KI-Modell erzeugt wird.

RetrievalEvaluator

Ein IEvaluator Wert, der die Leistung eines KI-Systems beim Abrufen von Informationen für zusätzlichen Kontext als Reaktion auf eine Benutzeranforderung (z. B. in einem RAG-Szenario (Retrieval Augmented Generation) auswertet.

RetrievalEvaluatorContext

Kontextbezogene Informationen, die zum Auswerten der RetrievalEvaluator Leistung eines KI-Systems beim Abrufen von Informationen für zusätzlichen Kontext verwendet werden.

TaskAdherenceEvaluator

Eine IEvaluator , die die Effektivität eines KI-Systems bei der Einhaltung der ihm zugewiesenen Aufgabe auswertet.

TaskAdherenceEvaluatorContext

Kontextbezogene Informationen, die verwendet werden, um die TaskAdherenceEvaluator Effektivität eines KI-Systems bei der Einhaltung der ihm zugewiesenen Aufgabe zu bewerten.

ToolCallAccuracyEvaluator

Eine IEvaluator Bewertung der Effektivität eines KI-Systems bei der Verwendung der bereitgestellten Tools.

ToolCallAccuracyEvaluatorContext

Kontextbezogene Informationen, die verwendet werden, um die ToolCallAccuracyEvaluator Effektivität eines KI-Systems bei der Verwendung der bereitgestellten Tools zu bewerten.