Trabalhando com Guardas de Segurança de IA

Prev Next

Os Guardas de Segurança de IA ajudam a proteger e governar as aplicações impulsionadas por IA que você cria, além de aplicarem controles de segurança em tempo de execução. Eles permitem que você aplique regras para inspecionar e controlar o tráfego entre as aplicações de IA que você cria, seus usuários e modelos de IA suportados. Você usa guardas para detectar prompts maliciosos, conteúdo inseguro e exposição de dados sensíveis antes que afetem sua aplicação. Os guardas também oferecem visibilidade sobre como as aplicações de IA são utilizadas, para que você possa monitorar violações e impor políticas organizacionais com um ponto de controle consistente.

Um guarda atua como a camada de aplicação para a Segurança de IA. Ele avalia prompts e, quando relevante, respostas de modelos em relação às detecções e ações que você configura em sua política. Com base na correspondência da política, o guarda pode permitir, bloquear ou registrar a interação.

Como os Guardas Funcionam

Os guardas inspecionam o tráfego de IA e o comparam com as detecções e ações definidas em sua política. Isso permite que você aplique controles de segurança e governança às interações de IA antes que o tráfego alcance o provedor de modelos e, em alguns casos, antes que a resposta seja retornada ao usuário.

Fluxo de Tráfego

A Segurança de IA suporta diferentes modelos de fluxo de tráfego, dependendo de como sua aplicação se integra com o guarda.

  • Modo Proxy - Neste modo, o guarda fica em linha entre a aplicação e o provedor de IA. Sua aplicação envia pedidos através do guarda, que direciona o tráfego ao provedor após avaliar o conteúdo em relação à política.

    Este modo permite que você aplique controles diretamente no caminho do tráfego. O guarda pode inspecionar a solicitação antes que ela chegue ao provedor e, onde suportado, inspecionar a resposta antes que ela seja retornada à aplicação. Isso lhe dá um ponto direto de aplicação para proteção em tempo real e visibilidade.

    imagem (19).png

  • Modo API - No modo API, sua aplicação interage com o guarda através de uma integração baseada em API, em vez de roteamento de tráfego por um proxy em linha. A aplicação envia o conteúdo relevante para o guarda para avaliação, como parte do fluxo da aplicação.

    Este modo oferece mais flexibilidade para ambientes onde uma implantação em linha não é a arquitetura preferida. O guarda ainda avalia o conteúdo em relação à política, mas o fluxo de aplicação depende de como sua aplicação está integrada ao guarda.

    imagem (20).png

O que o Guarda Detecta e Impõe

Você pode usar os guardas para detectar e impor políticas para uma gama de riscos relacionados à IA, incluindo:

  • Tentativas de injeção de prompts

  • Conteúdo inseguro ou restrito

  • Exposição de dados sensíveis, como informações pessoalmente identificáveis (PII) ou informações de saúde protegidas (PHI)

  • Violações de tópicos ou usos baseadas na política da empresa

  • Interações suspeitas ou não conformes de IA

Quando um guarda detecta uma correspondência, aplica a ação configurada na política. Por exemplo, o guarda pode bloquear um pedido, permiti-lo, ou registrar o evento para monitoramento e investigação.

Caso de Uso - Protegendo um Assistente de IA Interno

Sua empresa utiliza um assistente de IA interno para ajudar os funcionários a pesquisar documentos internos e resumir conteúdos. Para reduzir o risco de exposição de dados sensíveis, injeção de prompts e violações de políticas, você aplica um guarda de Segurança de IA ao tráfego da aplicação.

O guarda inspeciona prompts e, quando suportado, respostas em relação à sua política de Segurança de IA. Você pode detectar interações inseguras ou não conformes e bloqueá-las ou registrá-las antes que o conteúdo alcance o provedor de IA ou seja retornado ao usuário.

Provedores Suportados

O modo Proxy suporta os seguintes provedores e formatos de API.

Serviço de IA Selecionado

Plataformas Suportadas

APIs Suportadas

Google AI Studio

Plataforma de Agente Empresarial Gemini (Vertex AI)

  • Google AI Studio

  • Plataforma de Agente Empresarial Gemini (Vertex AI)

  • API Gemini: generateContent, streamGenerateContent

  • API compatível com OpenAI: conclusões de bate-papo

Claude da Anthropic

  • Plataforma Claude

  • Qualquer endpoint compatível com Claude, como:

    • Fundição Microsoft

    • Amazon Bedrock

  • API Claude: mensagens, completar (legado)

  • API compatível com OpenAI: conclusões de bate-papo

API Pública OpenAI

  • Plataforma OpenAI

  • API OpenAI: respostas, conclusões de bate-papo, embeddings

Serviço Azure OpenAI

  • Azure OpenAI

  • API OpenAI: conclusões de bate-papo

Bedrock da Amazon

  • Amazon Bedrock

  • API Bedrock: Converse, ConverseStream

Endpoint Personalizado

  • Qualquer endpoint compatível com OpenAI, como:

    • Fundição Microsoft

    • Amazon Bedrock

    • Plataforma de Agente Empresarial Gemini (Vertex AI)

  • API OpenAI: respostas, conclusões, embeddings