安全研究人员利用 Claude 攻破 OpenAI 系统
网络安全研究人员利用竞争对手 Anthropic 的 Claude 模型成功入侵 OpenAI 内部系统,暴露了 ChatGPT 开发商在安全防护上的漏洞。此次受控测试揭示了在 AI 行业面临安全审查之际,顶级厂商在防御机制上的潜在风险。
驱动中国9月19日消息,据 Ars Technica 报道,一组网络安全研究人员近日利用竞争对手 Anthropic 开发的人工智能工具,成功入侵了 OpenAI 的内部系统。这一事件不仅揭示了 ChatGPT 开发商在安全防护方面存在的漏洞,也正值各大人工智能巨头因安全问题面临日益严格的外部审查之际,凸显了行业内部潜在的风险。
据报道,执行此次攻击的是一个小型网络安全团队。他们利用 Anthropic 专门向安全专业人员提供的一款工具,成功获取了一名 OpenAI 员工 ChatGPT 账户的访问权限。通过这一权限,研究人员不仅能够查阅私有的软件信息,还能对系统提出修改建议。
此次入侵行动是在一个合法的漏洞挖掘计划框架下进行的。该计划旨在通过模拟攻击,在恶意行为者利用漏洞之前发现并修补潜在的安全隐患。参与测试的研究人员获得了 Anthropic 安全工具的授权访问权限,并因完成此次测试任务而获得报酬。
这一事件表明,即使是拥有强大技术实力的顶级 AI 公司,其内部系统也可能通过其竞争对手提供的 AI 工具被攻破。随着大模型能力的不断提升,其被用于自动化网络攻击或社会工程学攻击的风险也在增加。OpenAI 作为 ChatGPT 的开发者,其系统安全性直接关系到大量用户数据和商业机密。
目前,人工智能行业正面临前所未有的监管压力和安全审查。各大厂商纷纷加强自身的安全防护机制,但此次事件证明,攻防双方的技术博弈仍在持续。对于 AI 公司而言,如何在使用先进模型提高效率的同时,确保内部系统不被这些模型本身或其衍生工具所攻破,是一个亟待解决的难题。
值得注意的是,此次攻击并非由恶意黑客发起,而是通过正规的“赏金计划”或“红队测试”进行的。这种主动暴露问题的方式有助于厂商及时修复漏洞,但也从侧面反映了现有安全防御体系在面对高级 AI 辅助攻击时的局限性。
随着 AI 技术的普及,安全研究人员利用 AI 工具进行自动化漏洞挖掘已成为趋势。Anthropic 提供的安全工具显然具备强大的代码分析和系统渗透能力,能够在短时间内找到人类难以察觉的弱点。这一案例为整个行业敲响了警钟,提示企业需要重新评估其安全策略,以应对 AI 驱动的新型威胁。