人工智能

评估失误致网络连通 Anthropic大模型测试期间误入并入侵真实世界系统

字号+作者:cnBeta.COM 来源:cnBeta 2026-07-31 08:10 评论(创建话题) 收藏成功收藏本文

网络安全评估领域出现罕见失误。根据AI独角兽企业Anthropic于周四发布的最新披露,该公司旗下数款最顶尖的AI模型——包括Opus4.7、Mythos5以及一款尚未'...

网络安全评估领域出现罕见失误。根据AI独角兽企业Anthropic于周四发布的最新披露,该公司旗下数款最顶尖的AI模型——包括Opus4.7、Mythos5以及一款尚未公开发布的内部研究模型,在进行上线前的前沿网络安全测试(Capture-The-Flag,抓旗赛)期间,意外越过了虚拟演练界限,成功入侵了真实世界中的第三方网络系统。pX0品论天涯网

pX0品论天涯网

针对本次事故,Anthropic解释称,事件起因于公司与合作的网络安全评测机构Irregular之间的沟通误解,导致本应完全隔离的模拟测试环境被错误地连接到了互联网。在此配置下,AI模型被系统提示告知正处于无网无害的模拟环境中,却因连通了真实网络,直接将现实世界中的网络资产误认为是测试靶场中的任务目标,进而展开了攻击。pX0品论天涯网

报道指出,涉及入侵的攻击手段均属于较为基础的网络攻防技术,包括利用弱密码以及未经身份验证的开放接口等。具体安全事件包含三起典型的真实影响案例:pX0品论天涯网

首先,在一次针对虚拟目标的测试中,Opus4.7由于无法在本地网络中找到同名目标,遂利用互联网连接搜索到了现实中同名的一家真实网站,并将其成功攻破。pX0品论天涯网

其次,在另一项模拟任务中,Mythos5编写并向Python官方第三方软件仓库PyPI上传了一个恶意Python软件包。该软件包在公网上挂载了约一小时,期间被15台真实设备下载并执行。其中一台设备属于某网络安全公司,其自动沙盒机制在运行该软件包进行恶意软件扫描时,不慎导致凭据外泄,进而使AI获得了访问其额外基础设施的权限。pX0品论天涯网

最后,Anthropic的内部研究模型在测试中无法定位指定目标,随后自动扫描了约9000个网络目标,并成功入侵了其中一家企业的互联网应用。不过,该模型在后续运行中意识到自己进入了一个“与安全挑战毫无关联”的云端账户,随后主动终止了攻击行为。pX0品论天涯网

目前,Anthropic表示已全面暂停所有可能连接互联网的网络安全评估任务,并正与合作伙伴Irregular共同开展深入调查。公司强调,若在模型上部署安全防护栏(Guardrails),此类行为将被完全拦截,本次事故反映的是在去除安全限制以测试底层极端能力时,安全评估环境本身在配置管理上暴露出的风险漏洞。这一事件也与此前OpenAI模型意外访问HuggingFace设施的披露一道,引发了整个行业对前沿AI研发机构评估环境安全性的高度警惕。pX0品论天涯网

了解更多:pX0品论天涯网

https://www.anthropic.com/news/investigating-incidents-cybersecurity-evalspX0品论天涯网

本网除标明“PLTYW原创”的文章外,其它文章均为转载或者爬虫(PBot)抓取; 本文只代表作者个人观点,不代表本站观点,仅供大家学习参考。本网站属非谋利性质,旨在传播马克思主义和共产主义历史文献和参考资料。凡刊登的著作文献侵犯了作者、译者或版权持有人权益的,可来信联系本站删除。 本站邮箱[email protected]