宏观大盘行业板块个股策略
资讯池

OpenAI披露多起AI模型“目标偏离”事件 涉编造信息与绕过限制

日期: 2026-09-17 09:45来源: 财联社电报域名: cls.cn
溯源
重要性:背景级 · 49·对象槽:unmatched·对象关系:sector_transmission·影响对象:sector:AI·来源/栏目:财联社·抓取时间:2026-09-17 09:51:01·信任分层:优先源·转载来源:东方财富

【OpenAI披露多起AI模型“目标偏离”事件 涉编造信息与绕过限制】当地时间9月16日,OpenAI披露多起此前未公开的AI模型异常行为事件,并推出一套新的跟踪和披露框架,用于今后报告类似情况。在报告中,OpenAI详细列出了AI模型为了完成任务或在评估中取得成功而出现异常行为的多个案例。其中包括编造缺失数据、试图绕过网络限制,以及AI代理之间共享本应保密的文件。OpenAI还介绍了一套员工主动报告此类“目标偏离”事件的机制。

所谓“目标偏离”,是指AI采取与人类目标不一致的行为。公司同时建立了相应的分类和处置流程。OpenAI在另一份声明中称,此次新披露的目标偏离事件均未涉及对第三方系统的黑客攻击或入侵

打开原文 ↗