9月19日·星期六 12:54·来源:IT之家

OpenAI 研究员示警:AI 能力越强,越容易“隐藏内心想法”

OpenAI 研究科学家诺姆·布朗近日指出,随着 AI 模型能力提升,其思维链的可监测性正在下降。布朗是推理模型 o1、o3 系列的核心贡献者,目前领导多智能体研究团队。他表示,模型正越来越自如地控制思维链表达,开发者未来可能无法有效发现、解释并约束 AI 的风险行为。研究人员原本希望通过模型展示的中间推理判断其是否走向欺骗或规避规则,但若模型学会隐藏真实意图,内部计算过程将不再能作为可信的安全信号。布朗称正努力寻找问题根源以扭转局势。
本文摘要由千智坊基于公开报道整理,查看完整内容:阅读原文(IT之家)→