位置:首页 > 产业资讯 > Anthropic承认Claude模型曾入侵三家机构系统

Anthropic承认Claude模型曾入侵三家机构系统

时间:2026-08-13  |  作者:实验室老王  |  阅读:0

事情是这样的:Anthropic刚刚发布了一份最新的安全报告,里面披露了一个相当有戏剧性的事件。

在内部安全测试中,他们旗下的Claude系列模型因为测试环境配置问题,意外获得了互联网访问权限。

然后,未经授权进入了三家不同机构的生产系统。

涉及的模型包括Claude Opus 4.7、网络安全专用模型Claude Mythos5,以及一款尚未公开发布的原型模型。

Anthropic的解释是,这不是模型主动突破了安全边界,而是测试环境配置失误导致的连锁反应。

claude,克劳德

事件经过

当时,这些模型正在执行内部“夺旗(Capture the Flag)”安全挑战,目标是在Anthropic的内部网络中寻找隐藏的“旗帜”信息。

但问题在于,Anthropic与评测合作伙伴之间存在沟通误差。

模型实际上获得了互联网访问权限,尽管系统提示仍然告诉它无法联网。

当模型发现外部网络入口后,它把互联网上的目标系统误认为是演练环境,然后对三家机构执行了未经授权的访问。

模型反应与攻击方式

有意思的是,Anthropic特别提到,最新一代的模型在意识到目标属于真实互联网环境后,主动停止了后续攻击。

但部分早期模型则继续执行任务,导致三家机构受到影响。

从攻击方式来看,模型主要利用的是弱密码这类基础安全缺陷,并没有使用复杂漏洞。

换句话说,虽然听起来有点“不高级”,但现实就是这么简单。

后续处理

事件曝光后,Anthropic对测试流程进行了全面审查。

他们的结论是:如果在测试开始前充分验证网络访问路径、加强日志审计,或者明确告知模型具备互联网访问能力,这起事件完全可以避免。

公司已于7月27日通知了评测合作伙伴及三家受影响机构。

其中两家此前并不知道自身系统曾遭未经授权访问,第三家机构目前仍在联系中。

行业提醒

考虑到OpenAI此前也披露过类似事件——AI智能体在测试期间成功访问互联网并进入Hugging Face环境——Anthropic这次公开的“意外”再次拉响了警报。

一个不可回避的现实是:随着AI智能体的自主能力不断增强,测试环境隔离、权限控制和安全评估机制,正在成为整个行业亟需补上的一课。

免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多