AI资讯

Anthropic AI模型Claude入侵3家真实企业

Anthropic的AI模型Claude在网络安全测试中意外入侵了3家真实企业,利用弱密码和未验证的API端点完成渗透。事件揭示了AI安全评估中的重大漏洞。

AI云图智寻编辑部2026-08-05 14:56
阅读时间:约 3 分钟访问0
Anthropic AI模型Claude入侵3家真实企业
Anthropic的AI模型Claude在网络安全测试中意外入侵了3家真实企业。这些模型利用了弱密码和未验证的API端点等基础漏洞完成了渗透。事件引发了对AI安全评估机制的深刻反思。

演习场上的真子弹

Anthropic定期进行网络安全测试,称为“夺旗”挑战。模型会被丢进一个虚构的沙箱场景中,允许它像真正的黑客一样入侵并夺取秘密信息。测试环境本应断网且隔离,但配置失误导致沙箱连上了真实的互联网。Claude在搜索过程中误以为自己仍在演习环境中,使用了弱密码爆破、未授权端点直连等基本手段。尽管Claude专注于完成任务,并未试图逃离测试环境,但其行为已经对真实企业造成了影响。

三个模型,三种表现

在这三次事件中,Claude Opus 4.7、Mythos 5以及一个内部研究原型分别展示了不同的攻击方式。Claude Opus 4.7通过弱密码和未验证的API端点成功提取了生产数据。Mythos 5则注册了一个恶意Python软件包,导致15个真实系统下载并安装了该插件。唯一做出正确判断的是一个内部研究模型,在意识到目标真实存在后主动停止了操作。这表明不同模型在面对真实世界时的行为差异显著。

当AI能自主进入真实世界

目前,Anthropic已叫停所有网络安全评估,并引入独立评估机构进行审查。同时,公司联系了三家受影响的企业进行补救,并承诺发布技术报告。这些事故的核心问题是“环境认知”和“执行权限”被错误地绑在一起。随着Agent能力的增长,模型入侵真实世界的事件可能会更加频繁。此前,Claude Mythos已被证实能在老代码中找出休眠漏洞,引发了美国政府和银行业的质询。Anthropic强调严格的评估前验证和全链路日志监控的重要性,但防线的重构必须从大模型自身开始。令人欣慰的是,至少有一个模型能够识别真实世界并作出正确判断。