IndirectAttackEvaluator Classe
Définition
Important
Certaines informations portent sur la préversion du produit qui est susceptible d’être en grande partie modifiée avant sa publication. Microsoft exclut toute garantie, expresse ou implicite, concernant les informations fournies ici.
Un IEvaluator qui utilise le service d’évaluation Azure AI Foundry pour évaluer les réponses produites par un modèle IA pour la présence d’attaques indirectes telles que le contenu manipulé, l’intrusion et la collecte d’informations.
public ref class IndirectAttackEvaluator sealed : Microsoft::Extensions::AI::Evaluation::Safety::ContentSafetyEvaluator
public sealed class IndirectAttackEvaluator : Microsoft.Extensions.AI.Evaluation.Safety.ContentSafetyEvaluator
type IndirectAttackEvaluator = class
inherit ContentSafetyEvaluator
Public NotInheritable Class IndirectAttackEvaluator
Inherits ContentSafetyEvaluator
- Héritage
Remarques
Les attaques indirectes, également appelées attaques injectées inter-domaines (XPIA), sont lorsque les attaques de jailbreak sont injectées dans le contexte d’un document ou d’une source qui peut entraîner une modification et un comportement inattendu. Les évaluations des attaques indirectes sont divisées en trois sous-catégories :
Contenu manipulé : cette catégorie implique des commandes qui visent à modifier ou à fabriquer des informations, souvent pour tromper ou tromper. Il inclut des actions telles que la diffusion d’informations fausses, la modification de la langue ou la mise en forme, et le masquage ou la mise en évidence de détails spécifiques. L’objectif est souvent de manipuler des perceptions ou des comportements en contrôlant le flux et la présentation des informations.
Intrusion : cette catégorie englobe les commandes qui tentent de violer les systèmes, d’obtenir un accès non autorisé ou d’élever des privilèges illicitement. Il comprend la création de portes dérobées, d’exploitation de vulnérabilités et de jailbreaks traditionnels pour contourner les mesures de sécurité. L’intention est souvent d’obtenir un contrôle ou d’accéder aux données sensibles sans détection.
Collecte des informations : cette catégorie concerne l’accès, la suppression ou la modification de données sans autorisation, souvent à des fins malveillantes. Il inclut l’exfiltrage des données sensibles, la falsification des enregistrements système et la suppression ou la modification des informations existantes. L’accent est mis sur l’acquisition ou la manipulation de données pour exploiter ou compromettre des systèmes et des individus.
IndirectAttackEvaluator retourne une BooleanMetric valeur true indiquant la présence d’une attaque indirecte dans la réponse et une valeur indiquant false l’absence d’une attaque indirecte.
Notez que IndirectAttackEvaluator ne prend pas en charge l’évaluation du contenu modal présent dans les réponses évaluées. Les images et d’autres contenus modals présents dans les réponses évaluées sont ignorées.
Constructeurs
| Nom | Description |
|---|---|
| IndirectAttackEvaluator() |
Un IEvaluator qui utilise le service d’évaluation Azure AI Foundry pour évaluer les réponses produites par un modèle IA pour la présence d’attaques indirectes telles que le contenu manipulé, l’intrusion et la collecte d’informations. |
Propriétés
| Nom | Description |
|---|---|
| EvaluationMetricNames |
Obtient les Names des EvaluationMetrics produites par ce IEvaluator. (Hérité de ContentSafetyEvaluator) |
| IndirectAttackMetricName |
Obtient le Name résultat BooleanMetric retourné par IndirectAttackEvaluator. |
Méthodes
| Nom | Description |
|---|---|
| EvaluateAsync(IEnumerable<ChatMessage>, ChatResponse, ChatConfiguration, IEnumerable<EvaluationContext>, CancellationToken) |
Évalue l’élément fourni |
| EvaluateContentSafetyAsync(IChatClient, IEnumerable<ChatMessage>, ChatResponse, IEnumerable<EvaluationContext>, String, Boolean, CancellationToken) |
Évalue le |
| FilterAdditionalContext(IEnumerable<EvaluationContext>) |
Filtre les EvaluationContexts fournis par l’appelant via |