AIセキュリティガードは、構築するAI搭載アプリケーションを保護および管理し、実行時にセキュリティ制御を実施します。 これらは、構築したAIアプリケーション、ユーザー、およびサポートされているAIモデルとの間のトラフィックを検査し制御するルールを実施することを可能にします。 ガードを使用して、アプリケーションに影響を与える前に、悪意のあるプロンプト、安全でないコンテンツ、および機密データの露出を検出します。 ガードは、AIアプリケーションがどのように使用されているかの可視性も提供し、一貫した制御ポイントで違反を監視し、組織のポリシーを実施するのに役立ちます。
ガードは、AIセキュリティの施行層として機能します。 ガードは、プロンプトを評価し、関連する検出とポリシーに設定されたアクションに応じてモデルの応答を評価します。 ポリシーの一致に基づいて、ガードはインタラクションを許可、ブロック、または記録します。
ガードの動作
ガードはAIトラフィックを検査し、ポリシーに定義された検出とアクションと比較します。 これにより、トラフィックがモデルプロバイダに到達する前、および場合によっては応答がユーザーに返される前のAIインタラクションにセキュリティとガバナンス制御を適用できます。
トラフィックフロー
AIセキュリティは、アプリケーションがガードと統合される方法に応じて、異なるトラフィックフローモデルをサポートします。
プロキシモード - このモードでは、ガードはアプリケーションとAIプロバイダの間にインラインで配置されます。 アプリケーションはリクエストをガードを通して送信し、ガードはポリシーに対してコンテンツを評価した後にトラフィックをプロバイダに転送します。
このモードでは、トラフィックパスに直接制御を適用できます。 ガードは、プロバイダに到達する前にリクエストを検査し、サポートされている場合、アプリケーションに返送される前に応答を検査します。 これにより、リアルタイムの保護と可視性を得るための直接的な施行ポイントが得られます。

APIモード - APIモードでは、アプリケーションはインラインプロキシを介してトラフィックをルーティングするのではなく、APIベースの統合を介してガードとインタラクションします。 アプリケーションは関連コンテンツをアプリケーションフローの一部としてガードに送信し、評価されます。
このモードでは、インライン展開が推奨されるアーキテクチャではない環境に柔軟性がもたらされます。 ガードはコンテンツをポリシーに対して評価しますが、施行フローはアプリケーションがガードと統合されている方法に依存します。

ガードが検出および施行する内容
ガードを使用して、AIに関連する様々なリスクに対するポリシーを検出および施行できます。これには次のものが含まれます:
プロンプト注入試み
安全でないまたは制限されたコンテンツ
個人を識別可能な情報(PII)や保護された健康情報(PHI)などの機密データの露出
会社ポリシーに基づくトピックまたは使用違反
疑わしいまたはコンプライアンスに適していないAIインタラクション
ガードが一致を検出すると、ポリシーで設定されたアクションを適用します。 例えば、ガードはリクエストをブロックしたり、許可したり、監視および調査のためにイベントを記録したりできます。
使用事例 - 内部AIアシスタントの保護
あなたの会社は、従業員が内部文書を検索し、コンテンツを要約するのを助けるために内部AIアシスタントを使用しています。 機密データの露出、プロンプト注入、ポリシー違反のリスクを軽減するために、アプリケーショントラフィックにAIセキュリティガードを適用します。
ガードはプロンプトを検査し、サポートされている場合はAIセキュリティポリシーに対する応答も検査します。 安全でないまたはコンプライアンスに適していないインタラクションを検出し、コンテンツがAIプロバイダに到達したり、ユーザーに返されたりする前にブロック、ログを取ることができます。
サポートされているプロバイダー
プロキシモードは、以下のプロバイダおよびAPI形式をサポートします。
選択されたAIサービス | サポートされているプラットフォーム | サポートされているAPI |
|---|---|---|
Google AIスタジオ ジェミニエンタープライズエージェントプラットフォーム (Vertex AI) |
|
|
AnthropicのClaude |
|
|
OpenAI公開API |
|
|
Azure OpenAIサービス |
|
|
AmazonのBedrock |
|
|
カスタムエンドポイント |
|
|