资讯池
OpenAI研究员示警:AI能力越强 越容易“隐藏内心想法”
日期: 2026-09-20 08:57来源: 财联社域名: finance.eastmoney.com
溯源
重要性:背景级 · 53·对象槽:unmatched·对象关系:sector_transmission·影响对象:sector:AI·来源/栏目:东方财富·抓取时间:2026-09-20 08:57:02·信任分层:优先源
OpenAI 研究员诺姆 · 布朗最新表示,伴随着AI模型能力越来越强,模型的思维链可监测性正逐渐下降,未来开发者可能无法有效、可靠地发现、解释并约束 AI 的风险行为。研究人员原本希望从模型展示的中间推理中,看出它是否正在走向欺骗、规避规则或错误目标;但如果模型学会“隐藏内心想法”,那么真实的内部计算过程就未必再能作为可信的安全信号