AI-sikkerhed

AI-sikkerhedstest

Traditionel applikationstest dækker fladen omkring modellen og stopper der. Vi tester systemet som helhed mod promptinjektion, dataudsivning, misbrug af værktøjer og forgiftet søgning.

Den forretningsmæssige udfordring

Jeres nuværende test dækker ikke dette

En penetrationstest finder injektion i en parameter, ikke instruktioner indlejret i et dokument, assistenten senere læser. Den tjekker rettigheder på endepunkter, ikke om modellen kan overtales til at bruge et værktøj på en andens vegne. Det er forskellige sårbarhedsklasser, og de er ikke dækket af det omfang, I allerede køber.

Det vi gør

Test mod realistisk misbrug

Vi arbejder ud fra en trusselsmodel frem for en tjekliste: hvad en angriber ville have, og hvad systemet gør tilgængeligt. Testen dækker injektion via alle indholdsveje, modellen kan læse, udsivning via output, misbrug af værktøjer og rettighedseskalering samt forgiftning af søgningen. Fundene kommer med reproduktionstrin, alvorlighed og en løsning, rangeret efter udnyttelighed, og vi tester igen efter udbedring og efterlader testene.

AI-sikkerhedstest

Kompetencer

  • Test af promptinjektion

  • Test af omgåelse af spærringer

  • Test af datalækage i AI

  • Sikkerhedstest af agenter

  • Test af RAG-forgiftning

  • Test af værktøjsmisbrug

Typiske anvendelser

Typiske anvendelser

  • Test en AI-applikation, før den når produktion eller en kunde.
  • Vurder en assistent, der allerede har systemadgang, ingen har gennemgået.
  • Skab dokumentation for test til et kundesikkerhedsspørgeskema eller en revisor.
  • Bekræft at guardrails tilføjet efter en hændelse faktisk holder.

Sådan leverer vi

Sådan leverer vi

  1. Trusselsmodel

    Fastslå hvad en angriber ville gå efter, og hvad de ville vinde ved at nå det.

  2. Test

    Fjendtlig test mod realistisk misbrug, ikke en tjekliste over kendte strenge.

  3. Rapporter

    Fund med reproduktionstrin, alvorlighed og løsning, rangeret efter udnyttelighed.

  4. Test igen

    Bekræft at rettelserne holder, og efterlad testene, så tilbagefald bliver synlige.

Teknologi

Teknologi

  • OWASP LLM Top 10
  • MITRE ATLAS
  • Garak
  • Burp Suite
  • ISO/IEC 27001

Sikkerhed og governance

Sikkerhed og governance

Test godkendes skriftligt, afgrænses til aftalte mål og køres mod et ikke-produktionsmiljø, medmindre I beslutter andet. Fund behandles fortroligt og oplyses til jer før nogen anden. Intet gemmes ud over engagementet bortset fra rapporten og de regressionstest, I har bedt os efterlade.

Samarbejdsmodeller

Samarbejdsmodeller

AI-rådgivning

Erfarne konsulenter leverer strategi, arkitektur, vurdering og transformationsvejledning.

AI-projekt

Vi tager ansvaret for at designe og levere en defineret AI-løsning.

Managed AI

Vi driver, overvåger og forbedrer løbende AI-systemer i produktion.

Hvorfor TeamExtension.ai

Vi tester systemet, ikke modellen

En model i sig selv har begrænset angrebsflade. Eksponeringen kommer fra det, den er forbundet til, så testen skal omfatte værktøjerne, søgningen og rettighederne. Fordi vi bygger disse systemer, ved vi, hvor sømmene er.

Udvalgte kunder

Ofte stillede spørgsmål

Ofte stillede spørgsmål

Hvordan adskiller det sig fra en penetrationstest?
Det retter sig mod AI-specifikke klasser: instruktioner i hentet indhold, udsivning via output, misbrug af værktøjer, forgiftning af søgningen. Traditionel test er stadig nødvendig for den omgivende applikation; dette dækker det, den ikke gør.
Tester I mod produktion?
Mod et repræsentativt ikke-produktionsmiljø som standard. Test i produktion sker kun med udtrykkelig skriftlig godkendelse og et snævert omfang.
Hvad modtager vi?
En rapport med reproduktionstrin, alvorlighed og udbedring pr. fund, rangeret efter udnyttelighed, samt selve testene, så tilbagefald dukker op i jeres pipeline.
Hvor lang tid tager en vurdering?
To til fire uger for en enkelt applikation afhængigt af hvor mange værktøjer og indholdskilder den når, plus fornyet test efter udbedring.

Drøft jeres AI-initiativ

Test AI-applikationer for de fejltilstande, traditionel applikationstest ikke dækker.