Anthropic联手埃森哲建驻场评估,各投至少10亿美元

来源:互联网 时间:2026-09-20

A5站长网9月20日消息,Anthropic与埃森哲联合宣布,将在Anthropic的实验室内建立一支AI安全的驻场评估团队,由埃森哲旗下AI业务Faculty牵头,对Anthropic的前沿模型开展红队测试、对齐评估与安全防护措施检验。双方承诺在未来五年内各自投入至少10亿美元。评估人员将获得与内部团队同级的访问权限,可以看到模型在训练过程中如何成形,并跟随部署决策。

这套机制被概括为嵌入式评估员。与常见的第三方测评相比,它的差别在于位置:评估方不站在公司外部等模型发布后再测,而是进驻实验室内部,能够观察训练过程、与员工直接交流,并据此判断公司是否兑现了此前的安全承诺。Anthropic同时表示,正在与其他独立评估机构探讨类似的试点安排,未来几周还会公布更多评估伙伴,这类合作不具排他性。

时间点上,这个宣布紧跟着一轮公开争论。此前Anthropic首席执行官达里奥·阿莫代伊公开呼吁全行业协同,对前沿AI的发展节奏加以管控,这一表态引发了行业内外关于谁来定节奏的讨论。把外部评估人员请进内部,被外界视为这套主张的第一个落地步骤,不追求全体停步,而是把外部监督搬进模型训练的现场。

评估的边界同样需要说清。驻场评估能验证的是公司是否履行了自述的安全流程,以及流程本身有没有明显盲点,它并不等同于对模型能力的独立认证,也很难覆盖商业化压力下的全部决策。评估人员能看什么、报告写给谁、发现问题后如何影响发布节奏,这些细节决定了这套机制是实质约束还是程序性安排。

对使用前沿模型的企业来说,这件事的现实意义在于合规链条可能变长。如果驻场评估成为行业惯例,模型供应商在对外提供能力时需要说明经过了哪些测试、由谁执行、结论如何存档。采购与开发团队在选型时,评估透明度有可能像此前的数据来源与合规资质一样,成为一个需要写进清单的考察项。

相关文章

标签:

A5创业网 版权所有

返回顶部