资讯池
OpenAI与Anthropic模型再曝安全评估事件 曾尝试植入恶意代码
日期: 2026-08-05 08:54来源: 财联社电报域名: cls.cn
溯源
重要性:背景级 · 50·对象槽:unmatched·对象关系:sector_transmission·影响对象:sector:AI、sector:人工智能、stock:人工智能·来源/栏目:财联社·抓取时间:2026-08-05 09:15:02·信任分层:优先源
【OpenAI与Anthropic模型再曝安全评估事件 曾尝试植入恶意代码】财联社8月5日电,OpenAI和Anthropic的人工智能模型近日卷入此前未公开的网络安全事件,成为近期多起AI模型潜在安全风险事件中的最新案例。
测试前沿AI模型潜在风险的英国人工智能安全研究所(AISI)当地时间8月4日表示,在一项涉及互联网接入的网络安全评估中,Anthropic的Mythos 5和OpenAI的GPT-5.6-Sol模型“持续针对真实个人和组织实施可能造成危害的活动”。AISI称,该团队在注意到“异常数据传输”后,于7月28日发现了这一事件。
AISI表示,调查发现,在评估过程中,其中一个AI模型试图向GitHub上的一个开源软件项目植入有害代码,甚至创建虚假身份来推动代码获得批准。AISI写道:“一名人工维护者发现并拒绝批准恶意代码。”