业务问题
您现有的测试覆盖不到这些
渗透测试找的是某个参数里的注入,而不是嵌在一份助手日后会读到的文档里的指令。它检查端点上的授权,而不是模型能否被说服代他人使用某个工具。这些是不同的漏洞类别,您已经购买的测试范围并不包含它们。
我们做什么
针对现实中的滥用来测试
我们从威胁模型出发而不是照着清单走:攻击者想要什么,以及系统让什么变得可触达。测试覆盖模型能读到的每一条内容路径上的注入、经由输出的外泄、工具滥用与权限提升,以及检索投毒。发现事项附带复现步骤、严重程度与修复方案,按可利用性排序;修复之后我们会复测,并把测试留下。
人工智能安全测试
能力
-
提示注入测试
-
越狱测试
-
人工智能数据泄露测试
-
智能体安全测试
-
RAG投毒测试
-
工具滥用测试
常见应用场景
常见应用场景
- 在人工智能应用进入生产或交到客户手上之前进行测试。
- 评估一个已拥有系统访问权限、却无人复核过的助手。
- 为客户的安全问卷或审计人员,准备已完成测试的证据。
- 验证事故之后新增的防护栏是否真的顶得住。
我们如何交付
我们如何交付
-
威胁建模
弄清攻击者会盯上什么,以及得手之后能获得什么。
-
测试
针对真实滥用场景做对抗测试,而不是照着已知字符串清单走一遍。
-
报告
每项发现附带复现步骤、严重程度与修复方案,按可利用性排序。
-
复测
验证修复确实有效,并把测试留下,让回归问题能够显现。
技术
技术
- OWASP LLM Top 10
- MITRE ATLAS
- Garak
- Burp Suite
- ISO/IEC 27001
安全与治理
安全与治理
测试须有书面授权,限定在约定目标范围内,除非您另有决定,否则在非生产环境执行。发现的问题按保密处理,并在告知任何其他方之前先向您披露。除报告和您要求我们留下的回归测试之外,项目结束后不保留任何内容。
合作模式
合作模式
人工智能咨询顾问
资深顾问提供战略、架构、评估与转型方面的指导。
人工智能项目
我们对既定人工智能方案的设计与交付承担责任。
托管式人工智能
我们运营、监控并持续改进生产环境中的人工智能系统。
为什么选择 TeamExtension.ai
我们测的是系统,不是模型
孤立的模型攻击面有限。风险敞口来自它连接了什么,因此测试必须包含工具、检索与权限。因为我们自己就在造这类系统,我们知道接缝在哪里。
部分客户
常见问题
常见问题
这和渗透测试有什么不同?
它瞄准人工智能特有的类别:检索内容中的指令、经由输出的外泄、工具滥用、检索投毒。周边应用仍然需要传统测试,这里覆盖的是它顾及不到的部分。
你们会对生产环境做测试吗?
默认是在具有代表性的非生产环境中进行。只有在获得明确书面授权并限定很窄的范围时,才会在生产环境测试。
我们会收到什么?
一份报告,逐项列出复现步骤、严重程度与修复方案,并按可利用性排序;此外还有测试本身,使回归问题能在您的流水线中显现。
一次评估要多久?
单个应用两到四周,取决于它触及多少工具与内容来源,另加修复后的复测。