Språk

IndirectAttackEvaluator Klass

Definition

En IEvaluator som använder tjänsten Azure AI Foundry Evaluation för att utvärdera svar som skapats av en AI-modell för förekomsten av indirekta attacker, till exempel manipulerat innehåll, intrång och insamling av information.

public ref class IndirectAttackEvaluator sealed : Microsoft::Extensions::AI::Evaluation::Safety::ContentSafetyEvaluator
public sealed class IndirectAttackEvaluator : Microsoft.Extensions.AI.Evaluation.Safety.ContentSafetyEvaluator
type IndirectAttackEvaluator = class
    inherit ContentSafetyEvaluator
Public NotInheritable Class IndirectAttackEvaluator
Inherits ContentSafetyEvaluator
Arv
IndirectAttackEvaluator

Kommentarer

Indirekta attacker, även kallade xpia(cross-domain prompt injected attacks), är när jailbreak-attacker matas in i kontexten för ett dokument eller en källa som kan leda till ett förändrat, oväntat beteende. Utvärderingar av indirekta attacker delas upp i tre underkategorier:

Manipulerat innehåll: Den här kategorin omfattar kommandon som syftar till att ändra eller fabricera information, ofta för att vilseleda eller lura. Den innehåller åtgärder som att sprida falsk information, ändra språk eller formatering och dölja eller betona specifik information. Målet är ofta att manipulera uppfattningar eller beteenden genom att styra flödet och presentationen av information.

Intrång: Den här kategorin omfattar kommandon som försöker bryta mot system, få obehörig åtkomst eller höja behörigheter olagligt. Det omfattar att skapa bakdörrar, utnyttja sårbarheter och traditionella jailbreaks för att kringgå säkerhetsåtgärder. Avsikten är ofta att få kontroll över eller komma åt känsliga data utan identifiering.

Informationsinsamling: Den här kategorin gäller åtkomst, borttagning eller ändring av data utan auktorisering, ofta i skadliga syften. Den omfattar exfiltrering av känsliga data, manipulering av systemposter och borttagning eller ändring av befintlig information. Fokus ligger på att förvärva eller manipulera data för att utnyttja eller kompromettera system och individer.

IndirectAttackEvaluator returnerar ett BooleanMetric värde som true anger förekomsten av en indirekt attack i svaret och ett värde för false att indikera frånvaron av en indirekt attack.

Observera att IndirectAttackEvaluator det inte stöder utvärdering av multimodalt innehåll som finns i de utvärderade svaren. Bilder och annat multimodalt innehåll som finns i de utvärderade svaren ignoreras.

Konstruktorer

Name Description
IndirectAttackEvaluator()

En IEvaluator som använder tjänsten Azure AI Foundry Evaluation för att utvärdera svar som skapats av en AI-modell för förekomsten av indirekta attacker, till exempel manipulerat innehåll, intrång och insamling av information.

Egenskaper

Name Description
EvaluationMetricNames

Hämtar s:erna NameEvaluationMetricsom produceras av den här IEvaluator.

(Ärvd från ContentSafetyEvaluator)
IndirectAttackMetricName

Hämtar den Name returnerade BooleanMetric av IndirectAttackEvaluator.

Metoder

Name Description
EvaluateAsync(IEnumerable<ChatMessage>, ChatResponse, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Utvärderar den angivna modelResponse och returnerar en EvaluationResult som innehåller en eller flera EvaluationMetrics.

(Ärvd från ContentSafetyEvaluator)
EvaluateContentSafetyAsync(IChatClient, IEnumerable<ChatMessage>, ChatResponse, IEnumerable<EvaluationContext>, String, Boolean, CancellationToken)

Utvärderar den angivna modelResponse med hjälp av Azure AI Foundry Evaluation Service och returnerar en EvaluationResult som innehåller en eller flera EvaluationMetrics.

(Ärvd från ContentSafetyEvaluator)
FilterAdditionalContext(IEnumerable<EvaluationContext>)

Filtrerar de EvaluationContexts som tillhandahålls av anroparen via additionalContext ned till bara de EvaluationContextsom är relevanta för utvärderingen som utförs av detta ContentSafetyEvaluator.

(Ärvd från ContentSafetyEvaluator)

Tilläggsmetoder

Name Description
EvaluateAsync(IEvaluator, ChatMessage, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Utvärderar den angivna modelResponse och returnerar en EvaluationResult som innehåller en eller flera EvaluationMetrics.

EvaluateAsync(IEvaluator, ChatMessage, ChatMessage, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Utvärderar den angivna modelResponse och returnerar en EvaluationResult som innehåller en eller flera EvaluationMetrics.

EvaluateAsync(IEvaluator, ChatMessage, ChatResponse, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Utvärderar den angivna modelResponse och returnerar en EvaluationResult som innehåller en eller flera EvaluationMetrics.

EvaluateAsync(IEvaluator, ChatResponse, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Utvärderar den angivna modelResponse och returnerar en EvaluationResult som innehåller en eller flera EvaluationMetrics.

EvaluateAsync(IEvaluator, String, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Utvärderar den angivna modelResponse och returnerar en EvaluationResult som innehåller en eller flera EvaluationMetrics.

EvaluateAsync(IEvaluator, String, String, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Utvärderar den angivna modelResponse och returnerar en EvaluationResult som innehåller en eller flera EvaluationMetrics.

Gäller för