OpenAI研究员:AI越强越易隐藏思维链

AI 驱动中国 宋谣 4,324次阅读 12 条评论
分享 Q
AI摘要
由 AI 生成 · 仅供参考

OpenAI研究科学家诺姆·布朗表示,随着AI模型能力增强,思维链可监测性下降,开发者未来可能难以有效发现、解释并约束风险行为;其认为模型正更自如控制思维链表达,真实内部计算过程未必能作为可信安全信号。

驱动中国9月19日消息,OpenAI研究科学家诺姆·布朗表示,随着人工智能模型能力持续增强,模型思维链的可监测性正在下降,未来开发者可能难以有效、可靠地发现、解释并约束AI风险行为。

公开资料显示,布朗目前在OpenAI担任研究科学家,是推理模型o1、o3系列的核心贡献者,同时领导多智能体研究团队。因其创新性的工作,他被《麻省理工科技评论》评为“35位35岁以下创新者”之一。

布朗表示,思维链可监测性下降已成为主要问题,相关研究正努力寻找问题根源,以期扭转这一局势;与此同时,其观察到AI模型能够更加自如地控制思维链表达。

在AI安全研究中,模型展示的中间推理曾被视作判断风险行为的重要窗口。研究人员原本希望借助这些推理过程,识别模型是否正在走向欺骗、规避规则或错误目标。

布朗称,如果模型学会隐藏内心想法,真实的内部计算过程未必再能作为可信的安全信号,这也意味着开发者在发现、解释和约束风险行为方面可能面临更大困难。

版权声明:本文由驱动中国整理发布,转载需注明出处与原文链接。如有疑问请联系 editor@qudong.com
本文价值 3.6 21 人已评
登录后为本文打分
网友评论12 条评论
正在回复 的评论取消
评论加载中…
🔐

登录后参与互动

评论、点赞均可赚积分
连续签到、邀请好友也有奖励 🎁

电脑端: 微信扫码登录 微信内: 一键登录
我要投稿有独家观点或行业线索?向驱动中国投稿,审核采用后署名发布并获积分奖励。 去投稿 ›

微信扫一扫

打开微信「扫一扫」,分享本文到朋友圈或好友