测试环境配置出错 Claude将真实公司当成模拟攻击目标
创建日期:
2026年07月31日
来源:
美国中文网报道 人工智能公司Anthropic周四披露,Claude模型在网络安全测试期间意外连接真实互联网,并未经授权进入三家机构的生产系统。公司表示,事件并非模型主动突破测试环境,而是由于测试配置错误,使Claude误以为真实系统也是模拟攻击任务的一部分。
三起事件均发生在第三方评估机构Irregular提供的测试环境中,涉及Claude Opus 4.7、Mythos 5和一款尚未公开的内部研究模型。
测试中,Claude被要求完成“夺旗挑战”,也就是设法进入另一台计算机并获取隐藏信息。模型原本被告知,测试环境无法连接互联网,但由于双方配置上的误解,部分测试机器实际上可以访问外部网络。
其中的一次事件,Claude进入一家公司的数据库,获取了数百条生产数据;另一次测试中,Claude在公开软件平台PyPI上传恶意程序,该程序在约一小时内被15个真实系统下载;第三次事件中,模型扫描约9000个网络目标,并进入一家公司的对外应用程序。
公司强调,没有证据显示Claude产生了自己的攻击目标,或故意试图逃离测试环境。相关模型是在缺少正式产品通常配备的安全分类器和监控措施下运行,测试设施也无法接触Anthropic内部敏感系统和客户数据。
Anthropic已暂停相关网络安全测试。公司表示,未来将加强测试环境的网络隔离、实时监控和第三方安全审查。
(编辑:西平)
Facebook
X