Travailler avec des agents de sécurité AI

Prev Next

Les agents de sécurité AI vous aident à protéger et régir les applications alimentées par AI que vous construisez, et appliquent des contrôles de sécurité en temps réel. Ils vous permettent d'appliquer des règles pour inspecter et contrôler le trafic entre les applications AI que vous construisez, vos utilisateurs, et les modèles AI supportés. Vous utilisez des gardes pour détecter les invites malveillantes, le contenu non sécurisé et l'exposition de données sensibles avant qu'ils n'affectent votre application. Les gardes vous offrent également une visibilité sur l'utilisation des applications AI, afin que vous puissiez surveiller les violations et appliquer les politiques organisationnelles avec un point de contrôle cohérent.

Un garde agit comme la couche d'application pour la sécurité AI. Il évalue les invites et, lorsqu'elles sont pertinentes, les réponses des modèles par rapport aux détections et actions que vous configurez dans votre politique. En fonction de la correspondance avec la politique, le garde peut autoriser, bloquer ou journaliser l'interaction.

Comment fonctionnent les gardes

Les gardes inspectent le trafic AI et le comparent aux détections et actions définies dans votre politique. Cela vous permet d'appliquer des contrôles de sécurité et de gouvernance aux interactions AI avant que le trafic n'atteigne le fournisseur de modèles, et dans certains cas, avant que la réponse ne soit renvoyée à l'utilisateur.

Flux de trafic

La sécurité AI prend en charge différents modèles de flux de trafic selon la manière dont votre application s'intègre avec le garde.

  • Mode Proxy - Dans ce mode, le garde se situe en ligne entre l'application et le fournisseur AI. Votre application envoie les requêtes via le garde, qui redirige le trafic vers le fournisseur après avoir évalué le contenu par rapport à la politique.

    Ce mode vous permet d'appliquer des contrôles directement dans le chemin du trafic. Le garde peut inspecter la requête avant qu'elle n'atteigne le fournisseur et, là où cela est pris en charge, inspecter la réponse avant qu'elle ne soit renvoyée à l'application. Cela vous donne un point d'application direct pour la protection et la visibilité en temps réel.

    image (19).png

  • Mode API - En mode API, votre application interagit avec le garde via une intégration basée sur l'API plutôt que de router le trafic à travers un proxy en ligne. L'application envoie le contenu pertinent au garde pour évaluation, dans le cadre du flux d'application.

    Ce mode vous offre plus de flexibilité pour les environnements où un déploiement en ligne n'est pas l'architecture préférée. Le garde évalue toujours le contenu par rapport à la politique, mais le flux d'application dépend de la manière dont votre application est intégrée avec le garde.

    image (20).png

Que détecte et applique le garde

Vous pouvez utiliser des gardes pour détecter et appliquer des politiques pour une gamme de risques liés à l'AI, y compris :

  • Tentatives d'injection d'invite

  • Contenu non sécurisé ou restreint

  • Exposition de données sensibles, telles que les informations personnellement identifiables (PII) ou les informations de santé protégées (PHI)

  • Violations de sujet ou d'utilisation basées sur la politique de l'entreprise

  • Interactions AI suspectes ou non conformes

Lorsqu'un garde détecte une correspondance, il applique l'action configurée dans la politique. Par exemple, le garde peut bloquer une requête, l'autoriser ou journaliser l'événement pour la surveillance et l'enquête.

Cas d'utilisation - Protéger un assistant AI interne

Votre entreprise utilise un assistant AI interne pour aider les employés à rechercher des documents internes et à résumer le contenu. Pour réduire le risque d'exposition de données sensibles, d'injection d'invite et de violations de politique, vous appliquez un garde de sécurité AI au trafic de l'application.

Le garde inspecte les invites et, là où cela est pris en charge, les réponses par rapport à votre politique de sécurité AI. Vous pouvez détecter des interactions non sécurisées ou non conformes et les bloquer ou les journaliser avant que le contenu n'atteigne le fournisseur AI ou ne soit renvoyé à l'utilisateur.

Fournisseurs supportés

Le mode Proxy prend en charge les fournisseurs suivants et les formats API.

Service AI sélectionné

Plateformes supportées

API supportées

Google AI Studio

Plateforme Gemini Enterprise Agent (Vertex AI)

  • Google AI Studio

  • Plateforme Gemini Enterprise Agent (Vertex AI)

  • Gemini API : generateContent, streamGenerateContent

  • API compatible OpenAI : complétions de chat

Claude d'Anthropic

  • Plateforme Claude

  • N'importe quel point de terminaison compatible Claude, tel que :

    • Microsoft Foundry

    • Amazon Bedrock

  • Claude API : messages, complètes (ancienne version)

  • API compatible OpenAI : complétions de chat

API publique OpenAI

  • Plate-forme OpenAI

  • API OpenAI : réponses, complétions de chat, embeddings

Service Azure OpenAI

  • Azure OpenAI

  • API OpenAI : complétions de chat

Bedrock d'Amazon

  • Amazon Bedrock

  • API Bedrock : Converse, ConverseStream

Point de terminaison personnalisé

  • N'importe quel point de terminaison compatible OpenAI, tel que :

    • Microsoft Foundry

    • Amazon Bedrock

    • Plateforme Gemini Enterprise Agent (Vertex AI)

  • API OpenAI : réponses, complètes, embeddings