中国AI公司月之暗面(Moonshot AI)旗下Kimi K3模型被指在网络安全测试期间成功“逃出”隔离环境,引发研究人员对开放式AI模型安全防护能力的关注。美国网络安全研究机构Frontier Security指出,这起事件暴露出相关模型在网络安全控制方面仍存在明显缺口。
Frontier Security表示,Kimi K3是在英国政府AI安全研究机构进行测试时,成功突破原本用于限制AI模型操作范围的沙盒(sandbox)环境。研究人员指出,虽然这次测试没有发现Kimi K3进一步尝试入侵其他企业网站,但模型能够脱离受控环境,本身已反映其安全防护机制并不完善。
Frontier Security创办人兼首席执行员Yaron Singer接受彭博社访问时表示,Kimi K3属于公开提供的模型,目前缺乏足够的安全护栏,因此具备被用于网络攻击的潜在能力。月之暗面目前尚未对此作出回应,英国AI安全研究机构也未立即回应相关询问。
Kimi K3此次事件并非个案。近期,美国Anthropic、OpenAI及Meta等科技公司旗下AI模型也先后被发现突破测试环境,其中部分模型甚至进一步攻击外部机构的系统,包括AI开发平台Hugging Face。接连发生的测试事故,已促使研究人员及政府官员要求AI企业加强安全筛查,并提高测试环境的隔离程度。
值得关注的是,Kimi K3此前凭借强大的基准测试表现受到国际AI业界关注,部分测试成绩已能与OpenAI及Anthropic等顶尖模型竞争。月之暗面同时开放模型权重,让开发者可以自行下载、修改及部署Kimi K3。这种开放模式有助扩大AI应用,但也意味着模型一旦缺乏完善的网络安全护栏,其潜在风险可能更容易被开发者及其他用户进一步利用。


