Anthropic 9 月 18 日宣布与 Accenture 旗下 AI 业务 Faculty 合作,尝试把独立评估人员嵌入前沿模型实验室。工作范围包括红队测试、对齐评估和安全措施验证,驻场人员预计获得接近公司员工的内部访问,以便更早观察模型研发过程。
Anthropic 与 Accenture 表示,未来五年各自预计至少投入 10 亿美元建设相关能力。与模型发布前的一次性外部测试相比,驻场方式希望把评估延伸到研发周期内部,并加入企业与政府实际部署场景中的风险判断。
这项合作仍处于机制设计阶段,访问边界、报告发布方式、利益冲突管理和行业通用标准尚未确定。双方承诺投入资金不等于评估已经具备制度性独立,后续仍要看结果能否公开、问题能否推动产品和发布决策发生变化。