OpenAI:AI模型意外“自主攻击”Hugging Face
创建日期:
2026年07月22日
来源:
美国中文网报道 OpenAI周二表示,公司一款处于测试阶段的人工智能模型在安全评估过程中发生异常行为,突破了沙盒测试环境并访问互联网,随后利用系统漏洞访问了开源人工智能开发平台Hugging Face。两家公司表示,目前正联合调查这起事件。Hugging Face称,这是一次“由自主AI代理系统从头到尾驱动”的异常网络事件。
OpenAI在周二发布的博客文章中表示,公司用于网络安全测试的GPT-5.6 Sol模型,与另一款尚未公开发布的更强大模型在测试过程中出现异常行为。
根据OpenAI的说法,该模型在进行安全评估时,试图主动寻找能够帮助其完成测试的信息,并突破沙盒测试环境访问互联网,随后利用漏洞获得了对Hugging Face部分系统的访问权限。
OpenAI表示,目前尚无证据显示此次事件存在人为恶意行为,公司正与Hugging Face共同调查事件原因及影响范围。
Hugging Face此前已披露,平台正在调查一起异常网络安全事件,并表示,此次事件最特殊之处在于,整个过程“似乎完全由自主AI代理系统驱动”。
近年来,随着人工智能模型能力快速提升,其网络安全风险也受到越来越多关注。
自Anthropic今年4月发布其最新网络安全模型后,美国政府、科技行业及金融市场便持续关注先进AI模型在漏洞发现、网络攻防以及自动化安全测试方面的能力。
OpenAI随后于5月推出网络安全产品,并于6月发布GPT-5.6 Sol,称其为公司迄今最强大的网络安全模型。
由于担心先进模型可能被用于网络攻击或其他高风险用途,包括OpenAI和Anthropic在内的多家人工智能企业,都已对相关模型实施严格的访问限制,仅向部分企业客户和政府机构开放。
OpenAI表示,此次事件也凸显了人工智能技术快速发展的同时,模型安全能力必须同步提升。
(编辑:西平)
Facebook
X