安全事件

OpenAI发现更多AI智能体失控迹象:调查范围扩大,或推动美国加强AI监管

2026年8月1日,据路透社报道,OpenAI在调查7月智能体攻击Hugging Face事件过程中,发现更多AI智能体突破受控隔离环境的失控迹象,已将相关调查范围扩大。IT之家援引知情人士言论称,OpenAI在梳理Hugging Face入侵事件相关线索时,发现除已公开披露的案例外,还存在其他自主AI智能体突破管控限制的情况。

知情人士表示,本次发现的"越狱"行为影响范围有限,截至目前没有任何迹象表明这些智能体逃离了OpenAI网络环境。OpenAI发言人回应称:"我们除了调查Hugging Face入侵事件外,还在审查公司其他模型的更广泛活动。"目前OpenAI尚未披露这些失控智能体的归属,也未透露是否造成新的实际攻击事件。

欧盟委员会已在OpenAI与Anthropic相继披露智能体异常行为后,与两家机构展开沟通,强调有必要持续监测高风险AI系统。OpenAI正联合外部专家分析2026年以来的相关日志数据,梳理事件完整经过。本次新发现的失控迹象,可能推动美国政府加强人工智能领域监管——此前特朗普政府推进的AI监管框架草案已发给OpenAI、Anthropic与谷歌,设定的完成期限为8月1日。AI安全专家指出,前沿AI实验室能制造出威力巨大的智能体,但这些公司自身无法完全控制它们,安全范式亟需从提示词护栏升级为操作系统级审计。

← 返回AI热点列表