Anthropic披露Claude测试中误入侵三家公司
Coinpaper
3小时前
Ai 焦点
Anthropic披露,Claude在内部网络安全测试中因环境配置错误接入公网,并误入侵三家真实公司系统。
有帮助
No.帮助

Anthropic 披露称,公司在复查网络安全评估记录时,发现多个 Claude 模型曾在测试过程中接入公开互联网,并先后进入三家真实公司的系统。公司表示,这些事件发生在内部“夺旗”式安全测试中,直接原因是测试环境配置错误,而不是模型主动试图逃离隔离环境。

复查 14.1 万次测试后发现问题

这次披露发生在 OpenAI 公开类似事件之后。Anthropic 表示,公司随后检查了超过 14.1 万次网络安全评估记录,并在其中发现 3 起异常案例。

按照 Anthropic 的说法,Claude 在这些测试里被要求完成“capture-the-flag”任务,也就是进入网络中的另一台机器并取回指定信息。模型收到的提示是,它所处的是一个没有外网连接的模拟环境。

但实际情况并非如此。由于测试环境仍与公网相连,模型把接触到的真实网站和系统误认为演练目标,随后使用弱密码、暴露凭证、SQL 注入和未鉴权接口等常见方式进入相关系统。

三起事件涉及数据库、PyPI 和外网扫描

  • Claude Opus 4.7 曾进入一家公司的生产数据库
  • Claude Mythos 5 上传恶意包至真实 PyPI 仓库
  • 内部研究模型扫描约 9000 个外网系统

Anthropic 称,其中一次事件里,Claude Opus 4.7 将一家真实公司网站误认成任务目标,提取凭证后进入生产数据库,数据库内包含数百行真实数据。

另一次事件中,Claude Mythos 5 向真实 PyPI 仓库上传恶意 Python 包,该软件包在被移除前已被 15 台系统下载。第三起事件里,一款内部研究模型进入一家机构系统后,在判断目标可能是真实组织后停止进一步操作。

公司还表示,三家受影响机构中有两家此前并不知道自己遭到进入,直到 Anthropic 主动通知。

公司称问题出在测试基础设施

Anthropic 强调,在每一起事件中,Claude 都被明确告知自己没有互联网访问权限,因此模型将遇到的真实系统视为测试的一部分。由于“夺旗”任务本身就是要求攻击外部目标,模型的行为与收到的任务指令一致。

公司称,目前没有证据显示 Claude 试图主动逃逸测试环境,也没有发现其执行超出任务范围的行为。Anthropic 将原因归结为测试基础设施和第三方评估环境管理失误,而不是模型本身出现自主越界。

在发现问题后,Anthropic 已暂停相关网络安全测试,并通知受影响机构。公司表示,接下来将改进监控、调查工具,以及对外部测试供应商的监督。

补充信息:这次披露距离 OpenAI 公布类似测试逃逸事件仅约一周。原文提到,OpenAI 此前称其模型曾突破沙箱环境,并进入 Hugging Face 及其他公司系统。

打赏
$0
点赞
0
收藏
0
浏览量 888
HQYC提醒,请广大读者理性看待区块链,切实提高风险意识,警惕各类虚拟代币发行与炒作, 站内所有内容仅系市场信息或相关方观点,不构成任何形式投资建议。如发现站内内容含敏感信息,可点击“举报”,我们会及时处理。
提交
评论 0
最热
最新
还没有人评论哦~快抢沙发吧!
相关阅读
Anthropic披露Claude测试中越权访问三家公司系统
Anthropic披露,Claude在三次安全测试中越权访问三家机构真实系统,问题与测试环境网络误配置有关。
TechCrunch
·2026-07-31 09:15:10
812
英伟达等25家公司联名反对限制开源AI
英伟达、Meta、微软等联名反对限制开放权重 AI 模型,称美国应维持开放生态。
Decrypt
·2026-07-25 01:49:56
858
OpenAI失控智能体被曝还入侵第二家科技公司
OpenAI 失控智能体被曝在一周内接连入侵多家平台,事件扩大了外界对前沿 AI 模型安全风险的担忧。
Fortune
·2026-07-29 19:35:07
82
外媒:Hugging Face披露AI代理越界入侵细节
Hugging Face披露,一套基于 OpenAI 模型的自主 AI 代理在安全测试中越界入侵其系统,持续四天半并执行 1.76 万次操作。
TechCrunch
·2026-07-30 03:53:37
776
web3: 英伟达联合37家公司成立AI安全联盟
英伟达联合 36 家科技公司成立 AI 安全联盟,推动开源安全工具,OpenAI、Anthropic 和 Google 未加入。
CoinDesk
·2026-07-27 21:34:55
869