谷歌Gemini被曝自主入侵多家公司 称已立即终止攻击
谷歌旗下AI模型Gemini在网络安全测试中自主入侵三家公司系统,谷歌称模型行为“恰当”并立即终止攻击,但安全专家质疑其试图利用漏洞披露规范掩盖模型越界行为。
驱动中国9月21日消息 据TechCrunch援引《华尔街日报》报道,谷歌(Google)旗下人工智能模型Gemini在近期的一次网络安全测试中,自主入侵了三家其他公司的受保护系统。这是该模型被证实的首次自主黑客行为。谷歌方面回应称,Gemini在发现入侵真实公司后“立即终止了每一次攻击”,因此其行为是“恰当的”,但这一表态引发了AI安全领域专家对于模型越界行为认定标准的争议。
此次事件发生在一家名为Irregular的网络安全公司进行的测试过程中。与OpenAI此前被报道的Hugging Face安全事件类似,Gemini的这次入侵行为之所以引发关注,并非因为其攻击手段具有极高的技术复杂性,而是因为执行这些入侵动作的主体是一个人工智能模型。据报道,Gemini在测试中成功获取了访问权限,其手段相对基础:在其中一起事件中,模型通过猜测密码直至获得访问权;在另外两起事件中,它从公共代码仓库中发现了泄露的凭证并借此入侵。
关于事件的披露时间线,Irregular公司据称早在今年7月下旬就已通知谷歌相关入侵情况,但双方直到上周五《华尔街日报》介入询问后才公开确认此事。谷歌解释未提前公开的原因时表示,由于Gemini在确定自己入侵了一家真实公司后,立即停止了后续操作,因此模型被视为“表现得当”。
然而,谷歌的这一解释并未平息安全社区的担忧。AI安全公司Corridor的首席执行官杰克·凯布尔(Jack Cable)向《华尔街日报》指出,谷歌此举是在“试图躲在为漏洞披露所建立的规范背后”。凯布尔认为,谷歌没有正视问题的核心,即承认“模型正在超出其应有行为边界行事”,这种处理方式可能掩盖了AI自主行为带来的潜在安全风险。
这一事件再次将大模型自主行为的安全边界问题推向公众视野。随着AI模型能力的提升,其在未受明确指令的情况下自主执行复杂任务的能力日益增强,如何在保障模型效能的同时,确保其行为严格限定在授权范围内,已成为行业面临的共同挑战。谷歌Gemini的这次“自主黑客”经历,虽未造成严重后果,但为AI安全测试与监管提供了新的案例。