美国AI产业再传安全警讯。继OpenAI旗下AI智能体被曝出现异常外部入侵行为后,另一家AI企业Anthropic也发现,其模型在测试期间曾实际进入3家企业的系统,引发外界对AI测试安全及权限管理的关注。
Anthropic在内部调查中发现,相关事件最早可追溯至今年4月。公司在检查超过14万1000份测试日志后确认,Claude系列模型曾多次获得网络访问能力,并进一步尝试接触测试范围以外的系统。
涉及的模型包括Claude旗下Opus 4.7、Mythos 5,以及另一款尚未公开名称的研究模型。Anthropic指出,问题源于其测试合作伙伴、以色列网络安全公司Irregular所运行的系统出现配置错误,使AI模型意外取得实时网络访问权限。
获得网络通道后,相关模型并非只是进行正常的信息查询,而是开始尝试利用猜测密码弱点,以及进入无需身份验证的系统等方式接触企业网络。Anthropic表示,目前确认共有3家公司受到影响,相关企业已经获得通知。
这起事件也凸显AI智能体在测试环境下可能产生的安全风险。随着AI模型逐渐具备自主执行任务、使用网络工具及处理外部系统的能力,一旦权限设置或测试环境出现漏洞,原本用于评估模型能力的实验就可能演变成真实的网络安全事件。


