Los Guardias de Seguridad de IA te ayudan a proteger y gobernar las aplicaciones impulsadas por IA que construyes, y aplican controles de seguridad en el tiempo de ejecución. Te permiten imponer reglas para inspeccionar y controlar el tráfico entre las aplicaciones de IA que construyes, tus usuarios y los modelos de IA compatibles. Usas guardias para detectar solicitudes maliciosas, contenidos inseguros y la exposición de datos sensibles antes de que afecten tu aplicación. Los guardias también te dan visibilidad sobre cómo se usan las aplicaciones de IA, para que puedas monitorear violaciones y aplicar políticas organizacionales con un punto de control consistente.
Un guardia actúa como la capa de aplicación para la Seguridad de IA. Evalúa las solicitudes y, cuando es relevante, las respuestas del modelo en contra de las detecciones y acciones que configuras en tu política. Basado en la coincidencia con la política, el guardia puede permitir, bloquear o registrar la interacción.
Cómo Funcionan los Guardias
Los guardias inspeccionan el tráfico de IA y lo comparan con las detecciones y acciones que se definen en tu política. Esto te permite aplicar controles de seguridad y gobernanza a las interacciones de IA antes de que el tráfico llegue al proveedor del modelo, y en algunos casos, antes de que la respuesta sea devuelta al usuario.
Flujo de tráfico
La Seguridad de IA soporta diferentes modelos de flujo de tráfico, dependiendo de cómo tu aplicación se integra con el guardia.
Modo Proxy: En este modo, el guardia se sitúa en línea entre la aplicación y el proveedor de IA. Tu aplicación envía solicitudes a través del guardia, que reenvía el tráfico al proveedor después de evaluar el contenido en contra de la política.
Este modo te permite aplicar controles directamente en la ruta del tráfico. El guardia puede inspeccionar la solicitud antes de que llegue al proveedor y, donde sea compatible, inspeccionar la respuesta antes de que se devuelva a la aplicación. Esto te proporciona un punto de aplicación directo para protección y visibilidad en tiempo real.

Modo API: En el modo API, tu aplicación interactúa con el guardia a través de una integración basada en API en lugar de enrutar el tráfico a través de un proxy en línea. La aplicación envía el contenido relevante al guardia para su evaluación como parte del flujo de la aplicación.
Este modo te da más flexibilidad para entornos donde un despliegue integrado no es la arquitectura preferida. El guardia sigue evaluando el contenido en contra de la política, pero el flujo de aplicación depende de cómo tu aplicación esté integrada con el guardia.

Qué Detecta y Aplica el Guardián
Puedes usar guardias para detectar y aplicar la política para un rango de riesgos relacionados con IA, incluyendo:
Intentos de inyección de solicitud
Contenido inseguro o restringido
Exposición de datos sensibles, como información de identificación personal (PII) o información de salud protegida (PHI)
Violaciones de tema o uso basadas en la política de la empresa
Interacciones de IA sospechosas o no compatibles
Cuando un guardia detecta una coincidencia, aplica la acción que está configurada en la política. Por ejemplo, el guardia puede bloquear una solicitud, permitirla o registrar el evento para monitoreo e investigación.
Caso de Uso: Protegiendo un Asistente Interno de IA
Tu empresa usa un asistente interno de IA para ayudar a los empleados a buscar documentación interna y resumir contenido. Para reducir el riesgo de exposición a datos sensibles, inyección de solicitudes y violaciones de políticas, aplicas un guardia de Seguridad IA al tráfico de la aplicación.
El guardia inspecciona las solicitudes y, donde sea compatible, las respuestas en contra de tu política de Seguridad de IA. Puedes detectar interacciones inseguras o no compatibles y bloquearlas o registrarlas antes de que el contenido llegue al proveedor de IA o se devuelva al usuario.
Proveedores Compatibles
El modo proxy soporta los siguientes proveedores y formatos de API.
Servicio de IA seleccionado | Plataformas compatibles | APIs compatibles |
|---|---|---|
Google AI Studio Plataforma de Agentes Empresariales Gemini (Vertex AI) |
|
|
Claude de Anthropic |
|
|
API Pública de OpenAI |
|
|
Servicio Azure OpenAI |
|
|
Bedrock de Amazon |
|
|
Punto de conexión personalizado |
|
|