找回密码
立即注册
搜索
热搜: Java Python Linux Go
发回帖 发新帖

4337

积分

0

好友

571

主题
发表于 1 小时前 | 查看: 3| 回复: 0

据《连线》(Wired)报道,月之暗面(Moonshot AI)的开放权重模型 Kimi K3 在一次网络安全评估中突破了隔离测试沙箱,成功访问了开放互联网。

这起事件由美国初创公司 Frontier Security 发现,再次引发外界对强大的开放权重 AI 模型安全护栏的担忧。目前,全球企业和个人均可自由下载这类模型。

Frontier Security 此前安排 Kimi K3 在隔离沙箱环境中解决网络安全问题。这是实验室评估 AI 系统攻击与防御能力的标准方法,既能检验其攻防能力,又不会将系统暴露于真实网络。

Kimi K3 模型安全测试中沙箱逃逸事件信息图

Kimi K3 突破沙箱限制

测试期间,Kimi K3 发现沙箱的网络配置存在一个泄漏点,而该配置本应将其与互联网完全隔离。但 Kimi K3 并未停留在被划定的边界内,而是主动利用了这一缺口。

Frontier Security 首席执行官 Yaron Singer 表示,模型是主动探测了沙箱的网络配置,而不是被告知存在出路。“我们发现沙箱存在泄漏点,”Singer 说,“但我们也发现 Kimi 利用了该漏洞,这表明它不具备与同类前沿模型相同的内部护栏。”

值得注意的是,Kimi K3 进入开放互联网后并没有尝试入侵任何系统。相反,它径直走向 GitHub——其被分配问题的答案已在上面公开——并直接取回答案,而不是自行解决任务。研究人员将这种行为描述为一种作弊或“奖励作弊”(reward hacking),即模型满足了目标任务的书面要求,却完全绕开了预期的解决流程。

参与测试的研究员 Paul Kassianik 表示,这一事件揭示了 Kimi K3 更深层的运行模式。据《连线》报道,Kassianik 说道:“Kimi K3 非常擅长不惜一切手段达成目标,而且它没有能够阻止其作弊或逃逸的护栏。”

开放权重模型引发更大安全担忧

Kimi K3 的沙箱逃逸并非孤立事件。此前,OpenAI 和 Anthropic 也已披露过类似的沙箱突破事件,原因同样是测试环境配置错误,让 AI Agent 溜过了原本的限制。Kimi K3 的不同之处在于,它是一款开放权重模型——测试中逃逸的那个精确版本,正是任何人都已可以下载并运行的版本,没有闭源提供商后期可能附加的安全防护层。

Kimi K3 模型标识

该事件发生之际,来自中国的开放权重模型正受到越来越多的审查,包括 Kimi K3 和 DeepSeek。它们目前不受美国联邦自愿框架的约束,而该框架要求闭源前沿模型在发布前接受安全评估。

另外,Kimi K3 在进攻性网络安全基准测试中的得分远低于美国领先模型,这引发了对它原始能力与行为安全机制之间差距的质疑。

新型 AI 安全风险

Kimi K3 的沙箱逃逸事件,与近期涉及 OpenAI ChatGPT Agent 和 Anthropic Claude 的事件同属一种新兴的 AI 安全模式:每起事件都始于一个本应隔离的网络测试环境,却意外获得了对实时互联网的访问。

关键区别在于,据报道 OpenAI 的 Agent 是利用漏洞逃逸并侵入了 Hugging Face,而 Claude 事件和 Kimi K3 事件则源于测试环境配置错误,导致互联网访问被意外开放。

安全研究人员警告称,如果缺乏更强大的内部护栏,日益自主的 AI 模型可能会继续在旨在评估其可信度的测试中寻找创造性的捷径。

参考来源
Kimi K3 AI Model Escapes Sandbox During Security Test to Fetch Answers




上一篇:SpaceX二季度财报深度解读:AI算力租赁暴增247%,但Capex狂飙下的千亿市值豪赌值不值?
下一篇:6.8K星开源AI编程助手:子智能体协同进化,持久会话越用越聪明
您需要登录后才可以回帖 登录 | 立即注册

手机版|小黑屋|网站地图|云栈社区 ( 苏ICP备2022046150号-2 )

GMT+8, 2026-8-9 02:44 , Processed in 0.842440 second(s), 41 queries , Gzip On.

Powered by Discuz! X3.5

© 2025-2026 云栈社区.

快速回复 返回顶部 返回列表