Bezpieczeństwo AI

Red teaming AI

Uporządkowane testowanie przeciwstawne wobec realistycznych scenariuszy nadużyć: co zmotywowany napastnik, wrogi użytkownik lub nieuważny użytkownik może skłonić system do zrobienia.

Problem biznesowy

Nikt go nie zaatakował przed wdrożeniem

Systemy testuje się pod kątem tego, jak mają być używane. Prawdziwi użytkownicy są bardziej pomysłowi niż plany testów, a część z nich jest wroga. W przypadku wszystkiego, co dociera do klientów, pierwsza naprawdę wroga interakcja dzieje się na produkcji, publicznie i ze zrzutem ekranu.

Czym się zajmujemy

Atakować celami, a nie poleceniami

Pracujemy na celach, a nie na liście słów: wydobyć dane, do których użytkownik nie powinien dotrzeć, skłonić system do działania poza jego zakresem, doprowadzić do wytworzenia czegoś szkodliwego wizerunkowo, podbić koszty przez nadużycie zasobów. Każdy sukces jest dokumentowany wraz z dokładną ścieżką, więc da się go odtworzyć i naprawić. Testujemy też nudne awarie, degradację pod obciążeniem i zachowanie przy błędzie narzędzia, bo powodują one więcej incydentów niż pomysłowe ataki.

Red teaming AI

Kompetencje

  • Testowanie przeciwstawne AI

  • Red teaming agentów

  • Red teaming modeli LLM

  • Testy scenariuszy nadużyć

  • Symulacja ataków na AI

Typowe zastosowania

Typowe zastosowania

  • Ocena asystenta dla klientów przed uruchomieniem.
  • Przetestowanie agenta z prawem zapisu do systemów produkcyjnych.
  • Zapewnienie niezależnej oceny dla rady lub organu nadzoru.
  • Ustanowienie stałego rytmu testów zamiast jednorazowego ćwiczenia.

Jak realizujemy projekty

Jak realizujemy projekty

  1. Model zagrożeń

    Ustalenie, co byłoby celem napastnika i co by zyskał, gdyby to osiągnął.

  2. Testy

    Testowanie przeciwstawne wobec realistycznych nadużyć, a nie lista znanych ciągów znaków.

  3. Raport

    Ustalenia z krokami odtworzenia, wagą i sposobem naprawy, uszeregowane według możliwości wykorzystania.

  4. Testy ponowne

    Sprawdzenie, że poprawki działają, i pozostawienie testów, aby regresje były widoczne.

Technologia

Technologia

  • OWASP LLM Top 10
  • MITRE ATLAS
  • Garak
  • Burp Suite
  • ISO/IEC 27001

Bezpieczeństwo i nadzór

Bezpieczeństwo i ład

Testy są autoryzowane pisemnie, ograniczone do uzgodnionych celów i prowadzone w środowisku nieprodukcyjnym, o ile nie zdecydują Państwo inaczej. Ustalenia są traktowane jako poufne i ujawniane Państwu przed kimkolwiek innym. Poza raportem i testami regresyjnymi, o których pozostawienie Państwo poproszą, nic nie jest zachowywane po zakończeniu współpracy.

Modele współpracy

Modele współpracy

Doradztwo AI

Doświadczeni konsultanci zapewniają wsparcie w zakresie strategii, architektury, oceny i transformacji.

Projekt AI

Bierzemy odpowiedzialność za zaprojektowanie i dostarczenie określonego rozwiązania AI.

Zarządzana AI

Prowadzimy, monitorujemy i stale ulepszamy produkcyjne systemy AI.

Dlaczego TeamExtension.ai

Raportujemy, co to znaczy, a nie tylko co się udało

Lista udanych obejść sama w sobie niewiele daje. Liczy się, które z nich sięgają czegoś wartościowego i która zmiana architektoniczna zamyka całą ich klasę naraz, zamiast po jednym przypadku.

Wybrani klienci

Najczęstsze pytania

Najczęstsze pytania

Czym to się różni od testów bezpieczeństwa?
Testy bezpieczeństwa systematycznie przechodzą znane klasy podatności. Red teaming pracuje na celach i korzysta z każdej ścieżki, która działa, w tym z podejść socjotechnicznych i wieloetapowych. Oba są przydatne; odpowiadają na inne pytania.
Czy coś znajdziecie?
Niemal na pewno. Użytecznym pytaniem jest, czy to, co znajdziemy, sięga czegoś istotnego, i wokół tego zbudowany jest raport.
Czy może to działać w sposób ciągły?
Tak. Automatyczne zestawy przeciwstawne działają w procesie budowy, uzupełniane okresowymi ćwiczeniami prowadzonymi przez ludzi dla kreatywnych ataków, których automatyzacja nie znajduje.
Jakiej zgody potrzebujecie?
Pisemnej zgody osoby uprawnionej do jej udzielenia, z uzgodnionym zakresem, terminami i ścieżką eskalacji. Bez tego nie testujemy systemów.

Omów swoją inicjatywę AI

Testowanie przeciwstawne aplikacji i agentów AI wobec realistycznych scenariuszy nadużyć.