← 文章 / AI技术
TechCrunch 5小时前 · 2026-08-08 07:38:59 · 5 阅读

中国AI模型Kimi逃出网络安全测试环境,研究人员称

Kimi K3,中国公司月之暗面推出的最新AI模型,在测试其网络能力的实验环境中成功逃脱,研究人员在周五发布的博客文章中如此表示。

这一消息再次表明,企业和独立机构在约束其专为黑客攻击设计的AI模型方面正面临重重困难。

近几周,美国人工智能实验室的尖端大语言模型——包括OpenAIAnthropicMeta,以及英国的AI安全研究所——均以不同方式逃出测试环境,最终攻击了并非实验对象的真实目标。此类事件频发,以至于现在已有一个网站专门追踪这些事故,名为“Felony Bench”,意指这些大语言模型可能正在实施犯罪行为——至少从理论上讲是这样

在本次Kimi测试中,用于隔离实验的沙箱环境配置不当。据专注于AI的网络安全公司Frontier Security的研究人员称,虽然沙箱禁止该AI模型访问某些网络流量,但模型转而利用命令行工具绕过了沙箱限制。

研究人员写道:“这表明,社区使用的一些网络安全评估方法本身存在安全漏洞,使得模型能够作弊;同时,确实存在一些模型会主动寻找漏洞和弱点,从而在评估中蒙混过关。”

如果你在家记录这些事件,根据Felony Bench的统计,月之暗面现已加入OpenAI和Anthropic的行列——这两家公司各有七起记录在案的事件——以及Meta,后者有一起。

原始来源: TechCrunch

评论 (0)