融资与背景

AIUC 完成 4000 万美元 A 轮,由 Ribbit Capital 领投,First Harmonic 参与。此前它从 Nat Friedman 的基金 NFDG 拿到 1500 万美元种子轮,Emergence、Terrain 以及 Anthropic 联合创始人 Ben Mann 等参与,累计融资 5500 万美元。

创始人是一对姻亲:Rune Kvist 是 Anthropic 早期员工,Rajiv Dattani 是 AI 安全研究机构 METR 的前 COO。融资消息发生在 Anthropic 研究员 Jacob Coxon 因担心 AI 可能在十年内危及人类而辞职的第二天。Kvist 的判断是:AI 越聪明,反而越难被采纳、越难被控制,而不是越容易。

用 SOC 2 的模板解决新问题

AIUC 想把这套已经被网络安全行业验证过的模型搬到 AI 风险上:一套第三方审计与认证层。Kvist 描述客户困境的方式很具体:「银行、医院、政府和军队不再因为模型不够聪明而拒绝部署 AI。他们拒绝,是因为他们已经向自己的客户承诺过某个系统会做什么、不会做什么,而目前没有人能保证这一点。」

AIUC 以广泛采用的网络安全标准 SOC 2 为蓝本,制定了名为 AIUC-1 的标准与配套测试服务。为制定标准,它组织了一个约 250 名安全与风险负责人组成的联盟——这些人正是智能体的买方。Dattani 说他们每月与这些人见面,问的问题是:「当你向别人买智能体时,你会看什么?你想问哪些问题?你希望看到什么被解决?」

测试怎么做

这些反馈决定了测试内容。AIUC 让一个智能体跑过约 5000 项测试,观察它在越狱、幻觉和数据泄露等场景中的表现,结果是一份约 100 页的报告,说明这个智能体在哪里表现安全可靠、在哪里不是。有意思的是执行方式:AIUC 用 AI 智能体来跑测试、用 AI 分析数据,但最终审计由人复核。

这个模式并不新鲜,但不是重复

Dattani 的前东家 METR 做类似的事,为前沿实验室做测试,只是此前主要集中在性能上(智能体能否可靠完成任务)。METR 也是 OpenAI 用来调查 Hugging Face 事件的独立研究机构之一。而 Anthropic CEO Dario Amodei 近期呼吁行业「为前沿发展定速」,理由是不良行为事件在快速增加,他提出要求前沿实验室引入嵌入式第三方评估者来观察与验证安全性,并点名了 METR。

企业不部署 AI 的原因,已经不是模型不够聪明,而是没人能替它兑现向客户许下的承诺。