Bezpečnosť AI

Poradenstvo v bezpečnosti AI

Vkladanie pokynov, únik dát cez výstup modelu, zneužitie nástrojov a otrávené vyhľadávanie nie sú variantmi známych webových zraniteľností. Modelujeme hrozby špecifické pre systémy AI a navrhujeme architektúru a kontrolné mechanizmy, ktoré obmedzia to, čo nájdeme.

Obchodný problém

Hranica dôvery sa posunula a nikto ju neprekreslil

V bežných aplikáciách sú dáta a pokyny oddelené. V systémoch postavených okolo jazykových modelov prichádzajú rovnakým kanálom, takže akýkoľvek obsah, ktorý model prečíta, je potenciálne pokynom. Táto jediná vlastnosť búra predpoklady naprieč celým bezpečnostným modelom: dokument, webová stránka, e-mail alebo servisný tiket môže niesť pokyn, ktorý model vykoná. Pridajte nástroje a prístup do systémov a dôsledkom už nie je zlá odpoveď, ale akcia.

Čomu sa venujeme

Modelovať hrozby, potom obmedziť návrhom

Zistíme, na čo by útočník mieril a čo by získal, a potom navrhneme systém tak, aby možná škoda bola obmedzená bez ohľadu na správanie modelu. To znamená najnižšie nutné oprávnenia nástrojov, validované volania, zaobchádzanie so získaným obsahom ako s nedôveryhodnými dátami, schvaľovacie brány pri krokoch s významnými dôsledkami a kontrolu výstupu tam, kde text modelu smeruje do iného systému. Určíme aj to, čo zaznamenávať, pretože obmedzenie bez detekcie je polovičná kontrola.

Poradenstvo v bezpečnosti AI

Kompetencie

  • Modelovanie hrozieb AI

  • Bezpečnostná architektúra pre LLM

  • Bezpečnostná architektúra pre agentov

  • Posúdenie rizík AI

  • Riziko vkladania pokynov

  • Posúdenie rizika úniku dát

  • Riziko dodávateľského reťazca AI

  • Bezpečná architektúra AI

Bežné využitia

Bežné využitia

  • Vytvoriť model hrozieb pre aplikáciu AI pred nasadením do produkcie.
  • Zaviesť bezpečnú referenčnú architektúru, podľa ktorej stavajú ostatné tímy.
  • Posúdiť existujúceho asistenta, ktorý má prístup do systémov a nikto to nekontroloval.
  • Určiť, čo musí dodávateľ doložiť, kým bude jeho funkcia AI schválená.

Ako dodávame

Ako dodávame

  1. Model hrozieb

    Zistenie, na čo by útočník mieril a čo by získal, keby sa tam dostal.

  2. Testovanie

    Adversariálne testovanie proti realistickému zneužitiu, nie zoznam známych reťazcov.

  3. Správa

    Zistenia s krokmi na reprodukciu, závažnosťou a nápravou, zoradené podľa zneužiteľnosti.

  4. Opakované testy

    Overenie, že opravy držia, a zanechanie testov, aby sa regresie prejavili.

Technológia

Technológia

  • OWASP LLM Top 10
  • MITRE ATLAS
  • Garak
  • Burp Suite
  • ISO/IEC 27001

Bezpečnosť a správa

Bezpečnosť a riadenie

Testovanie je písomne schválené, obmedzené na dohodnuté ciele a prebieha v neprodukčnom prostredí, ak nerozhodnete inak. Zistenia sú dôverné a oznamujú sa vám skôr než komukoľvek inému. Po skončení spolupráce sa neuchováva nič okrem správy a regresných testov, o ktorých zanechanie požiadate.

Modely spolupráce

Modely spolupráce

Poradenstvo v oblasti AI

Skúsení konzultanti poskytujú podporu v stratégii, architektúre, posúdení a transformácii.

Projekt AI

Preberáme zodpovednosť za návrh a dodanie vymedzeného riešenia AI.

Spravovaná AI

Prevádzkujeme, monitorujeme a priebežne zlepšujeme produkčné systémy AI.

Prečo TeamExtension.ai

Architektúra je jediná trvalá kontrola

Filtre a ochranné mechanizmy stoja za to mať a nakoniec budú obídené. Kontroly, ktoré vydržia, sú architektonické: kam smie systém dosiahnuť, čo tam smie urobiť a čo vyžaduje človeka. Navrhujeme z tohto predpokladu, preto sa naše odporúčania týkajú skôr oprávnení a hraníc než detekčných pravidiel.

Vybraní klienti

Časté otázky

Časté otázky

Dá sa vkladanie pokynov vyriešiť?
Nedá sa odstrániť. Zmierňuje sa architektúrou: považovať všetok získaný obsah za nedôveryhodný, úzko vymedziť nástroje, podmieniť kroky s významnými dôsledkami schválením a navrhnúť systém tak, aby úspešné vloženie dosiahlo na niečo obmedzené. Kto sľubuje úplnú prevenciu, predáva filter.
Pokrývajú to naše existujúce penetračné testy?
Len čiastočne. Bežné testovanie pokrýva povrch aplikácie okolo modelu. Zvyčajne nepokrýva vloženie cez získaný obsah, únik cez výstup modelu ani zneužitie nástrojov, pretože to nie sú bežné triedy zraniteľností.
Aké je najčastejšie zistenie?
Príliš široké oprávnenia nástrojov. Systémy dostávajú široký prístup počas vývoja, pretože je to pohodlné, a rozsah sa pred produkciou nikdy nezúži. Býva to zároveň najlacnejšie zistenie na nápravu.
Ako to zapadá do našej existujúcej bezpečnostnej funkcie?
Rozširuje ju. Pracujeme s vaším bezpečnostným tímom, nie mimo neho, a výstup má byť ich štandardom, nie našou správou. Tam, kde im chýba hĺbka špecifická pre AI, ju s nimi budujeme.

Preberte svoju iniciatívu v oblasti AI

Modelovanie hrozieb pre systémy AI a návrh architektúry, kontrolných mechanizmov a hraníc, ktoré obmedzia ich riziko.