Anthropic引入埃森哲做第三方AI安全评估
Anthropic宣布与埃森哲达成合作,由后者作为第三方评估机构嵌入其内部,负责监督前沿AI模型的安全合规。双方计划在未来五年内各投入至少10亿美元,此举被视为Anthropic CEO Dario Amodei提出的放缓AI发展步伐计划的第一步。
驱动中国9月20日消息,人工智能公司Anthropic宣布与全球咨询公司埃森哲(Accenture)建立合作伙伴关系,由埃森哲担任第三方评估机构,对Anthropic的前沿AI模型进行安全合规性评估。这一举措被视为Anthropic首席执行官Dario Amodei上周提出的“放缓AI发展步伐”计划中的关键第一步。
根据双方达成的协议,未来五年内,Anthropic与埃森哲将分别向这一联合项目投入至少10亿美元。埃森哲的评估团队将直接嵌入Anthropic内部,而非作为外部审计方存在。这种深度嵌入的模式旨在确保对AI模型开发全流程的实时监督。
该合作框架呼应了Dario Amodei近期提出的三步走战略。Amodei主张,所有“前沿AI”公司应向嵌入式的第三方评估人员提供“持续的、类似员工的访问权限”。这些评估人员的核心职责包括:确保安全实践和承诺得到遵守、报告潜在事故以及评估AI模型的对齐程度(alignment)。
Anthropic在声明中详细阐述了埃森哲评估团队的具体工作方式。据该公司介绍,评估人员将“观察模型在训练过程中的形成轨迹,追踪决定模型构建与部署方式的关键决策,并直接与员工进行沟通”。这种全程介入旨在从源头把控模型的安全性与可控性。
选择埃森哲作为合作伙伴,Anthropic主要看重其在企业级AI部署方面的丰富经验。该公司指出,埃森哲长期协助各类企业和政府机构在多个行业中部署人工智能技术,具备处理复杂技术合规与安全评估的专业能力。这一背景被认为有助于埃森哲更好地理解前沿模型在商业化落地过程中可能面临的安全挑战。
尽管素材中关于埃森哲具体评估方法论的细节未完全展开,但这一高额投入与深度绑定的合作模式,标志着AI行业在安全治理方面正从“内部自查”向“第三方嵌入式监督”转变。对于致力于开发通用人工智能(AGI)的头部企业而言,引入具备行业公信力的第三方机构,意在平衡技术迭代速度与安全风险控制之间的关系。