人工智能安全

人工智能安全测试

传统应用测试覆盖模型周边那一圈,然后就停下了。我们把系统当作一个整体,针对提示注入、数据外泄、工具滥用与检索投毒进行测试。

业务问题

您现有的测试覆盖不到这些

渗透测试找的是某个参数里的注入,而不是嵌在一份助手日后会读到的文档里的指令。它检查端点上的授权,而不是模型能否被说服代他人使用某个工具。这些是不同的漏洞类别,您已经购买的测试范围并不包含它们。

我们做什么

针对现实中的滥用来测试

我们从威胁模型出发而不是照着清单走:攻击者想要什么,以及系统让什么变得可触达。测试覆盖模型能读到的每一条内容路径上的注入、经由输出的外泄、工具滥用与权限提升,以及检索投毒。发现事项附带复现步骤、严重程度与修复方案,按可利用性排序;修复之后我们会复测,并把测试留下。

人工智能安全测试

能力

  • 提示注入测试

  • 越狱测试

  • 人工智能数据泄露测试

  • 智能体安全测试

  • RAG投毒测试

  • 工具滥用测试

常见应用场景

常见应用场景

  • 在人工智能应用进入生产或交到客户手上之前进行测试。
  • 评估一个已拥有系统访问权限、却无人复核过的助手。
  • 为客户的安全问卷或审计人员,准备已完成测试的证据。
  • 验证事故之后新增的防护栏是否真的顶得住。

我们如何交付

我们如何交付

  1. 威胁建模

    弄清攻击者会盯上什么,以及得手之后能获得什么。

  2. 测试

    针对真实滥用场景做对抗测试,而不是照着已知字符串清单走一遍。

  3. 报告

    每项发现附带复现步骤、严重程度与修复方案,按可利用性排序。

  4. 复测

    验证修复确实有效,并把测试留下,让回归问题能够显现。

技术

技术

  • OWASP LLM Top 10
  • MITRE ATLAS
  • Garak
  • Burp Suite
  • ISO/IEC 27001

安全与治理

安全与治理

测试须有书面授权,限定在约定目标范围内,除非您另有决定,否则在非生产环境执行。发现的问题按保密处理,并在告知任何其他方之前先向您披露。除报告和您要求我们留下的回归测试之外,项目结束后不保留任何内容。

合作模式

合作模式

人工智能咨询顾问

资深顾问提供战略、架构、评估与转型方面的指导。

人工智能项目

我们对既定人工智能方案的设计与交付承担责任。

托管式人工智能

我们运营、监控并持续改进生产环境中的人工智能系统。

为什么选择 TeamExtension.ai

我们测的是系统,不是模型

孤立的模型攻击面有限。风险敞口来自它连接了什么,因此测试必须包含工具、检索与权限。因为我们自己就在造这类系统,我们知道接缝在哪里。

部分客户

常见问题

常见问题

这和渗透测试有什么不同?
它瞄准人工智能特有的类别:检索内容中的指令、经由输出的外泄、工具滥用、检索投毒。周边应用仍然需要传统测试,这里覆盖的是它顾及不到的部分。
你们会对生产环境做测试吗?
默认是在具有代表性的非生产环境中进行。只有在获得明确书面授权并限定很窄的范围时,才会在生产环境测试。
我们会收到什么?
一份报告,逐项列出复现步骤、严重程度与修复方案,并按可利用性排序;此外还有测试本身,使回归问题能在您的流水线中显现。
一次评估要多久?
单个应用两到四周,取决于它触及多少工具与内容来源,另加修复后的复测。

探讨您的 AI 计划

针对传统应用测试覆盖不到的失效方式,对人工智能应用进行测试。