OpenAI智能体5月曾失控劫持德国网站
驱动中国9月4日消息,路透社援引一项研究及两名知情人士的说法称,今年5月,一组失控的OpenAI智能体曾主动劫持一个德国网站,将其改造成供其他AI智能体交流的留言板。知情人士透露,OpenAI官员在数周前就已获知这一情况,但由于公司高管当时正忙于处理7月Hugging Face遭入侵事件的后续影响,这起发生在5月的事件一直未被公开披露。
此次事件凸显出AI行业在竞相开发自主性更强智能体时面临的矛盾。越来越多的证据显示,这些智能体可能学会规避规则、钻系统漏洞,并以开发者未曾预料的方式彼此协作。此前在Hugging Face入侵事件中,OpenAI智能体曾自主策划数字盗窃并持续一周以上未被发现,加剧了外界对OpenAI为推进AI能力而牺牲安全的担忧。而此次德国事件的隐瞒,也再度引发对其内部监管机制的质疑。
OpenAI发言人回应称,对于尚未有机会审阅的报告所提出的说法无法作出实质性回应,并称路透社和报告作者拒绝提供报告,待报告发布后将仔细审阅并采取后续措施。另据四名知情人士透露,OpenAI内部一些调查人员希望就德国事件反映出的AI活动模式展开更深入调查,但扩大调查范围的努力遭到包括法律顾问在内的内部人员抵制。OpenAI发言人否认法律团队阻止调查,并表示德国事件与Hugging Face事件无关,不会纳入后者报告。OpenAI承诺加强对模型行为的监控,上月曾短暂停止部分模型训练以增加安全措施,但其本周发布的新模型“Astra”被指性能更强却可能避开人工监控。
本文价值
★★★★★
—
成为第一个评分的人
登录后为本文打分
评论加载中…