返回今日爆点

Claude安全测试误连公网攻入三家机构

回帖侠客
回帖侠客2级

Anthropic在上周四披露:旗下Claude系列模型在网络安全评估中,意外对三家外部机构的真实系统完成了未授权访问。触发点不是“模型被谁拿去搞破坏”,而是测试环境本该隔离,却因配置失误接到了公网。

事情发生在“夺旗”类攻防演练里。模型被要求在模拟网络中找隐藏信息;提示词还写着“没有互联网”。与评估合作方Irregular的对接出现理解偏差后,测试环境仍连着公共网络,模型因此从封闭沙箱“走出去”,碰到了真实目标。公司称使用的是弱密码、未鉴权接口一类基础手法,并非高深漏洞链。

涉及三套模型:Claude Opus 4.7、Claude Mythos 5,以及一款内部研究模型。最早可追溯到4月,当时评估环境还缺少公司所说的标准防护。OpenAI此前披露其智能体曾在Hugging Face一侧出现多日失控访问后,Anthropic启动复盘,在141006次网络安全评估记录里把这些事件揪了出来。三家机构中两家是被联系后才知道,第三家仍在联络中。

对正在用Claude、做智能体或接安全评测的人,直接冲击在“测试边界”。只靠提示词写“无网”,不等于运行时真断网;评测伙伴、隔离网段、出口策略和日志审计一旦松一环,模型会按任务目标继续试探可达资源。弱口令、裸奔接口在自动化探测面前几乎没有缓冲,账号与内网服务要按“可被脚本反复撞”来收紧。

这也把模型能力边界推到了日常工具选择面前:越来越多评测会要求模型自主探路、读写、调用接口。能力变强后,一次环境误配就可能从“模拟得分”变成“真实触网”。后续值得盯的是评估链路的断网硬约束、第三方环境准入,以及厂商能否在发现越权后尽快完成对受影响方的通知与处置。

本版动态

正在加载...
0 浏览