Segurança da IA

Red teaming de IA

Testes adversariais estruturados face a cenários de abuso realistas: o que um atacante motivado, um utilizador hostil ou um distraído consegue levar o sistema a fazer.

O problema de negócio

Ninguém o atacou antes de entrar em produção

Os sistemas são testados segundo o modo como devem ser usados. Os utilizadores reais são mais inventivos do que os planos de teste, e alguns são hostis. Para qualquer coisa virada ao cliente, a primeira interação verdadeiramente adversarial acontece em produção, em público e com captura de ecrã.

O que fazemos

Atacá-lo com objetivos, não com prompts

Trabalhamos por objetivos e não com uma lista de palavras: extrair dados que o utilizador não deveria alcançar, levá-lo a agir fora do mandato, conseguir que produza algo lesivo para a reputação, disparar o custo por abuso de recursos. Cada sucesso é documentado com o caminho exato, para ser reproduzível e corrigível. Testamos também as falhas aborrecidas, a degradação sob carga e o comportamento quando uma ferramenta falha, porque causam mais incidentes do que os ataques engenhosos.

Red teaming de IA

Competências

  • Testes adversariais de IA

  • Red teaming de agentes

  • Red teaming de LLM

  • Testes de cenários de abuso

  • Simulação de ataques a IA

Casos de uso comuns

Casos de uso comuns

  • Avaliar um assistente virado ao cliente antes do lançamento.
  • Testar um agente com acesso de escrita a sistemas de produção.
  • Dar uma garantia independente a um conselho ou a um regulador.
  • Estabelecer um ritmo de testes contínuo em vez de um exercício pontual.

Como trabalhamos

Como trabalhamos

  1. Modelar ameaças

    Estabelecer o que um atacante procuraria e o que ganharia ao alcançá-lo.

  2. Testar

    Testes adversariais perante abuso realista, não uma lista de cadeias conhecidas.

  3. Reportar

    Achados com passos de reprodução, severidade e correção, ordenados por facilidade de exploração.

  4. Testar de novo

    Verificar que as correções aguentam e deixar os testes para que as regressões apareçam.

Tecnologia

Tecnologia

  • OWASP LLM Top 10
  • MITRE ATLAS
  • Garak
  • Burp Suite
  • ISO/IEC 27001

Segurança e governação

Segurança e governação

Os testes são autorizados por escrito, delimitados a alvos acordados e executados sobre um ambiente que não é de produção, salvo decisão em contrário da sua parte. Os achados são tratados como confidenciais e comunicados a si antes de a quem quer que seja. Nada é conservado para além do trabalho, exceto o relatório e os testes de regressão que nos pediu para deixar.

Modelos de colaboração

Modelos de colaboração

Consultoria em IA

Consultores especializados fornecem estratégia, arquitetura, avaliação e acompanhamento da transformação.

Projeto de IA

Assumimos a responsabilidade de desenhar e entregar uma solução de IA definida.

IA gerida

Operamos, monitorizamos e melhoramos continuamente os sistemas de IA em produção.

Porquê a TeamExtension.ai

Reportamos o que significa, não apenas o que resultou

Uma lista de contornos conseguidos não serve de muito por si só. O que importa é quais alcançam algo valioso e que alteração de arquitetura fecha uma classe inteira de uma vez em vez de um caso de cada vez.

Clientes selecionados

Perguntas frequentes

Perguntas frequentes

Em que difere dos testes de segurança?
Os testes de segurança percorrem de forma sistemática classes de vulnerabilidade conhecidas. O red teaming trabalha por objetivos e usa qualquer via que resulte, incluindo as sociais e as de vários passos. Ambos são úteis; respondem a perguntas diferentes.
Vão encontrar alguma coisa?
Quase de certeza. A pergunta útil é se o que encontramos alcança algo que importe, e é em torno disso que o relatório é organizado.
Pode correr de forma contínua?
Sim. Conjuntos adversariais automatizados correm na cadeia, complementados por exercícios periódicos conduzidos por pessoas para os ataques criativos que a automação não encontra.
Que autorização precisam?
Autorização escrita de alguém com poderes para a dar, com âmbito, calendário e escalada acordados. Não testamos sistemas sem ela.

Falar sobre a sua iniciativa de IA

Testes adversariais de aplicações e agentes de IA face a cenários de abuso realistas.