研究人员利用Anthropic的Claude入侵OpenAI系统
安全研究人员利用Anthropic开发的Claude模型,成功发现并利用OpenAI系统中的安全漏洞,获取内部代码仓库权限,最终完成漏洞披露。
驱动中国9月19日消息 据外媒报道,安全研究人员近期利用Anthropic公司开发的大语言模型Claude,成功发现并利用了OpenAI系统内部的安全漏洞。此次攻击行动导致OpenAI员工账户被接管,研究人员借此获取了内部代码仓库的访问权限,并在完成测试后向相关方披露了这些安全隐患。
这一事件凸显了大语言模型在网络安全领域的双刃剑特性。虽然AI技术被广泛视为提升防御能力的工具,但此次案例表明,攻击者同样可能利用先进的AI模型来自动化或辅助发现传统手段难以察觉的软件漏洞。
据报道,研究人员通过精心设计的提示词工程,引导Claude模型分析OpenAI公开或半公开的技术文档及代码片段,从而识别出潜在的安全弱点。利用这些弱点,他们成功模拟了针对OpenAI内部系统的攻击路径。
在攻击过程中,研究人员首先突破了外部防御层,进而接管了部分员工的账户权限。获得账户控制权后,他们进一步深入系统内部,成功访问了包含敏感信息的代码仓库。这一过程展示了AI模型在渗透测试中的强大潜力,同时也暴露了大型科技公司在应对AI驱动型攻击时可能存在的防御盲区。
尽管此次行动由安全研究人员发起,且最终以负责任的方式披露漏洞,但其过程本身引发了业界对于AI模型滥用风险的广泛讨论。Anthropic和OpenAI作为人工智能领域的领军企业,其技术被用于相互渗透测试,这一现象也反映了当前AI安全测试的复杂性与前沿性。
目前,OpenAI方面尚未就此次具体事件发表详细声明,但业界普遍认为,随着大模型能力的不断提升,针对AI基础设施的安全防护将成为未来网络安全工作的重点方向。企业需要建立更完善的机制,以应对利用先进AI工具发起的自动化攻击。