Langage

IndirectAttackEvaluator Classe

Définition

Un IEvaluator qui utilise le service d’évaluation Azure AI Foundry pour évaluer les réponses produites par un modèle IA pour la présence d’attaques indirectes telles que le contenu manipulé, l’intrusion et la collecte d’informations.

public ref class IndirectAttackEvaluator sealed : Microsoft::Extensions::AI::Evaluation::Safety::ContentSafetyEvaluator
public sealed class IndirectAttackEvaluator : Microsoft.Extensions.AI.Evaluation.Safety.ContentSafetyEvaluator
type IndirectAttackEvaluator = class
    inherit ContentSafetyEvaluator
Public NotInheritable Class IndirectAttackEvaluator
Inherits ContentSafetyEvaluator
Héritage
IndirectAttackEvaluator

Remarques

Les attaques indirectes, également appelées attaques injectées inter-domaines (XPIA), sont lorsque les attaques de jailbreak sont injectées dans le contexte d’un document ou d’une source qui peut entraîner une modification et un comportement inattendu. Les évaluations des attaques indirectes sont divisées en trois sous-catégories :

Contenu manipulé : cette catégorie implique des commandes qui visent à modifier ou à fabriquer des informations, souvent pour tromper ou tromper. Il inclut des actions telles que la diffusion d’informations fausses, la modification de la langue ou la mise en forme, et le masquage ou la mise en évidence de détails spécifiques. L’objectif est souvent de manipuler des perceptions ou des comportements en contrôlant le flux et la présentation des informations.

Intrusion : cette catégorie englobe les commandes qui tentent de violer les systèmes, d’obtenir un accès non autorisé ou d’élever des privilèges illicitement. Il comprend la création de portes dérobées, d’exploitation de vulnérabilités et de jailbreaks traditionnels pour contourner les mesures de sécurité. L’intention est souvent d’obtenir un contrôle ou d’accéder aux données sensibles sans détection.

Collecte des informations : cette catégorie concerne l’accès, la suppression ou la modification de données sans autorisation, souvent à des fins malveillantes. Il inclut l’exfiltrage des données sensibles, la falsification des enregistrements système et la suppression ou la modification des informations existantes. L’accent est mis sur l’acquisition ou la manipulation de données pour exploiter ou compromettre des systèmes et des individus.

IndirectAttackEvaluator retourne une BooleanMetric valeur true indiquant la présence d’une attaque indirecte dans la réponse et une valeur indiquant false l’absence d’une attaque indirecte.

Notez que IndirectAttackEvaluator ne prend pas en charge l’évaluation du contenu modal présent dans les réponses évaluées. Les images et d’autres contenus modals présents dans les réponses évaluées sont ignorées.

Constructeurs

Nom Description
IndirectAttackEvaluator()

Un IEvaluator qui utilise le service d’évaluation Azure AI Foundry pour évaluer les réponses produites par un modèle IA pour la présence d’attaques indirectes telles que le contenu manipulé, l’intrusion et la collecte d’informations.

Propriétés

Nom Description
EvaluationMetricNames

Obtient les Names des EvaluationMetrics produites par ce IEvaluator.

(Hérité de ContentSafetyEvaluator)
IndirectAttackMetricName

Obtient le Name résultat BooleanMetric retourné par IndirectAttackEvaluator.

Méthodes

Nom Description
EvaluateAsync(IEnumerable<ChatMessage>, ChatResponse, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Évalue l’élément fourni modelResponse et retourne un EvaluationResult ou plusieurs EvaluationMetrics contenant.

(Hérité de ContentSafetyEvaluator)
EvaluateContentSafetyAsync(IChatClient, IEnumerable<ChatMessage>, ChatResponse, IEnumerable<EvaluationContext>, String, Boolean, CancellationToken)

Évalue le modelResponse fourni à l’aide du service d’évaluation Azure AI Foundry et retourne un EvaluationResult contenant un ou plusieurs EvaluationMetrics.

(Hérité de ContentSafetyEvaluator)
FilterAdditionalContext(IEnumerable<EvaluationContext>)

Filtre les EvaluationContexts fournis par l’appelant via additionalContext uniquement les EvaluationContexts pertinentes pour l’évaluation effectuée par cet ContentSafetyEvaluatorappelant.

(Hérité de ContentSafetyEvaluator)

Méthodes d’extension

Nom Description
EvaluateAsync(IEvaluator, ChatMessage, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Évalue l’élément fourni modelResponse et retourne un EvaluationResult ou plusieurs EvaluationMetrics contenant.

EvaluateAsync(IEvaluator, ChatMessage, ChatMessage, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Évalue l’élément fourni modelResponse et retourne un EvaluationResult ou plusieurs EvaluationMetrics contenant.

EvaluateAsync(IEvaluator, ChatMessage, ChatResponse, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Évalue l’élément fourni modelResponse et retourne un EvaluationResult ou plusieurs EvaluationMetrics contenant.

EvaluateAsync(IEvaluator, ChatResponse, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Évalue l’élément fourni modelResponse et retourne un EvaluationResult ou plusieurs EvaluationMetrics contenant.

EvaluateAsync(IEvaluator, String, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Évalue l’élément fourni modelResponse et retourne un EvaluationResult ou plusieurs EvaluationMetrics contenant.

EvaluateAsync(IEvaluator, String, String, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken)

Évalue l’élément fourni modelResponse et retourne un EvaluationResult ou plusieurs EvaluationMetrics contenant.

S’applique à