人工智能安全

人工智能安全咨询

提示注入、经由模型输出的数据外泄、工具滥用与被投毒的检索内容,都不是既有Web漏洞的变体。我们专门针对人工智能系统做威胁建模,并设计能够遏制所发现问题的架构与控制措施。

业务问题

信任边界已经挪了,却没人重新画过

在传统应用中,数据与指令是分开的。在围绕语言模型构建的系统中,两者从同一条通道抵达,因此模型读到的任何内容都可能是一条指令。仅这一个特性,就击穿了整个安全模型中的诸多假设:一份文档、一个网页、一封邮件或一张支持工单,都可能携带模型将会照做的指令。再加上工具与系统访问权限,后果就不再是一个错误答案,而是一次实际操作。

我们做什么

先做威胁建模,再用设计加以约束

我们弄清攻击者会盯上什么、又能从中获得什么,然后按“无论模型表现如何,可造成的损害都有上限”来设计。这意味着最小权限的工具范围、经过校验的工具调用、把检索到的内容当作不可信数据、对有实际后果的操作设置审批关卡,以及在模型文本流向另一系统之处设置输出管控。我们也会规定该记录什么,因为没有检测的遏制只是半个控制措施。

人工智能安全咨询

能力

  • 人工智能威胁建模

  • 大语言模型安全架构

  • 智能体安全架构

  • 人工智能风险评估

  • 提示注入风险

  • 数据泄露评估

  • 人工智能供应链风险

  • 安全的人工智能架构

常见应用场景

常见应用场景

  • 在人工智能应用进入生产之前,为其做威胁建模。
  • 确立一套其他团队可据以构建的安全参考架构。
  • 评估一个已拥有系统访问权限、却无人复核过的现有助手。
  • 定义供应商的人工智能功能在获批之前必须拿出哪些证据。

我们如何交付

我们如何交付

  1. 威胁建模

    弄清攻击者会盯上什么,以及得手之后能获得什么。

  2. 测试

    针对真实滥用场景做对抗测试,而不是照着已知字符串清单走一遍。

  3. 报告

    每项发现附带复现步骤、严重程度与修复方案,按可利用性排序。

  4. 复测

    验证修复确实有效,并把测试留下,让回归问题能够显现。

技术

技术

  • OWASP LLM Top 10
  • MITRE ATLAS
  • Garak
  • Burp Suite
  • ISO/IEC 27001

安全与治理

安全与治理

测试须有书面授权,限定在约定目标范围内,除非您另有决定,否则在非生产环境执行。发现的问题按保密处理,并在告知任何其他方之前先向您披露。除报告和您要求我们留下的回归测试之外,项目结束后不保留任何内容。

合作模式

合作模式

人工智能咨询顾问

资深顾问提供战略、架构、评估与转型方面的指导。

人工智能项目

我们对既定人工智能方案的设计与交付承担责任。

托管式人工智能

我们运营、监控并持续改进生产环境中的人工智能系统。

为什么选择 TeamExtension.ai

唯一持久的控制措施是架构

过滤器与防护栏值得拥有,但终究会被绕过。真正撑得住的控制措施是架构层面的:系统被允许触达什么、在那里能做什么、什么必须经过人。我们从这个前提出发设计,这也是为什么我们的建议更多关于权限与边界,而不是检测规则。

部分客户

常见问题

常见问题

提示注入能被彻底解决吗?
无法根除,但可以靠架构缓解:把所有检索内容视为不可信、把工具范围切得很窄、把有实际后果的操作放在审批之后,并按“注入即便成功也只能触及有限范围”来设计。任何宣称能完全防止的人,卖给您的是一个过滤器。
我们现有的渗透测试覆盖这些吗?
只覆盖一部分。传统测试覆盖模型周边的应用面。它通常不覆盖经由检索内容的注入、经由模型输出的外泄,或工具滥用,因为这些不属于传统漏洞类别。
最常见的发现是什么?
工具权限过宽。开发期间为图方便给了很大的访问范围,进入生产前却从未收窄。它通常也是修复成本最低的发现。
这与我们现有的安全职能如何衔接?
是对它的扩展。我们与您的安全团队协作而非绕过他们,产出的目标是成为他们的标准,而不是我们的一份报告。在他们缺少人工智能专门深度的地方,我们和他们一起把它建起来。

探讨您的 AI 计划

为人工智能系统做威胁建模,并设计遏制其风险的架构、控制措施与边界。