Os Guardas de Segurança de IA ajudam a proteger e governar as aplicações impulsionadas por IA que você cria, além de aplicarem controles de segurança em tempo de execução. Eles permitem que você aplique regras para inspecionar e controlar o tráfego entre as aplicações de IA que você cria, seus usuários e modelos de IA suportados. Você usa guardas para detectar prompts maliciosos, conteúdo inseguro e exposição de dados sensíveis antes que afetem sua aplicação. Os guardas também oferecem visibilidade sobre como as aplicações de IA são utilizadas, para que você possa monitorar violações e impor políticas organizacionais com um ponto de controle consistente.
Um guarda atua como a camada de aplicação para a Segurança de IA. Ele avalia prompts e, quando relevante, respostas de modelos em relação às detecções e ações que você configura em sua política. Com base na correspondência da política, o guarda pode permitir, bloquear ou registrar a interação.
Como os Guardas Funcionam
Os guardas inspecionam o tráfego de IA e o comparam com as detecções e ações definidas em sua política. Isso permite que você aplique controles de segurança e governança às interações de IA antes que o tráfego alcance o provedor de modelos e, em alguns casos, antes que a resposta seja retornada ao usuário.
Fluxo de Tráfego
A Segurança de IA suporta diferentes modelos de fluxo de tráfego, dependendo de como sua aplicação se integra com o guarda.
Modo Proxy - Neste modo, o guarda fica em linha entre a aplicação e o provedor de IA. Sua aplicação envia pedidos através do guarda, que direciona o tráfego ao provedor após avaliar o conteúdo em relação à política.
Este modo permite que você aplique controles diretamente no caminho do tráfego. O guarda pode inspecionar a solicitação antes que ela chegue ao provedor e, onde suportado, inspecionar a resposta antes que ela seja retornada à aplicação. Isso lhe dá um ponto direto de aplicação para proteção em tempo real e visibilidade.

Modo API - No modo API, sua aplicação interage com o guarda através de uma integração baseada em API, em vez de roteamento de tráfego por um proxy em linha. A aplicação envia o conteúdo relevante para o guarda para avaliação, como parte do fluxo da aplicação.
Este modo oferece mais flexibilidade para ambientes onde uma implantação em linha não é a arquitetura preferida. O guarda ainda avalia o conteúdo em relação à política, mas o fluxo de aplicação depende de como sua aplicação está integrada ao guarda.

O que o Guarda Detecta e Impõe
Você pode usar os guardas para detectar e impor políticas para uma gama de riscos relacionados à IA, incluindo:
Tentativas de injeção de prompts
Conteúdo inseguro ou restrito
Exposição de dados sensíveis, como informações pessoalmente identificáveis (PII) ou informações de saúde protegidas (PHI)
Violações de tópicos ou usos baseadas na política da empresa
Interações suspeitas ou não conformes de IA
Quando um guarda detecta uma correspondência, aplica a ação configurada na política. Por exemplo, o guarda pode bloquear um pedido, permiti-lo, ou registrar o evento para monitoramento e investigação.
Caso de Uso - Protegendo um Assistente de IA Interno
Sua empresa utiliza um assistente de IA interno para ajudar os funcionários a pesquisar documentos internos e resumir conteúdos. Para reduzir o risco de exposição de dados sensíveis, injeção de prompts e violações de políticas, você aplica um guarda de Segurança de IA ao tráfego da aplicação.
O guarda inspeciona prompts e, quando suportado, respostas em relação à sua política de Segurança de IA. Você pode detectar interações inseguras ou não conformes e bloqueá-las ou registrá-las antes que o conteúdo alcance o provedor de IA ou seja retornado ao usuário.
Provedores Suportados
O modo Proxy suporta os seguintes provedores e formatos de API.
Serviço de IA Selecionado | Plataformas Suportadas | APIs Suportadas |
|---|---|---|
Google AI Studio Plataforma de Agente Empresarial Gemini (Vertex AI) |
|
|
Claude da Anthropic |
|
|
API Pública OpenAI |
|
|
Serviço Azure OpenAI |
|
|
Bedrock da Amazon |
|
|
Endpoint Personalizado |
|
|