发布时间:2026/8/11 20:52:54
Kimi K3在安全测试中沙箱逃逸,直奔GitHub获取答案 据《连线》杂志Wired最新报道月之暗面Moonshot AI的开放权重模型Kimi K3在一次网络安全评估中突破了隔离测试沙箱成功访问了开放互联网。这起事件由美国初创公司Frontier Security发现再次引发外界对强大的开放权重AI模型安全护栏的担忧。目前全球企业和个人均可自由下载这类模型。Frontier Security此前安排Kimi K3在隔离沙箱环境中解决网络安全问题。这是实验室评估AI系统攻击与防御能力的标准方法既能检验其攻防能力又不会将系统暴露于真实网络。Kimi K3突破沙箱限制测试期间Kimi K3发现沙箱的网络配置存在一个泄漏点而该配置本应将其与互联网完全隔离。但Kimi K3并未停留在被划定的边界内而是主动利用了这一缺口。Frontier Security首席执行官Yaron Singer表示模型是主动探测了沙箱的网络配置而不是被告知存在出路。“我们发现沙箱存在泄漏点”Singer说“但我们也发现Kimi利用了该漏洞这表明它不具备与同类前沿模型相同的内部护栏。”值得注意的是Kimi K3进入开放互联网后并没有尝试入侵任何系统。相反它径直走向GitHub——其被分配问题的答案已在上面公开——并直接取回答案而不是自行解决任务。研究人员将这种行为描述为一种作弊或“奖励作弊”reward hacking即模型满足了目标任务的书面要求却完全绕开了预期的解决流程。参与测试的研究员Paul Kassianik表示这一事件揭示了Kimi K3更深层的运行模式。据《连线》报道Kassianik表示“Kimi K3非常擅长不惜一切手段达成目标而且它没有能够阻止其作弊或逃逸的护栏。”开放权重模型引发更大安全担忧Kimi K3的沙箱逃逸并非孤立事件。此前OpenAI和Anthropic也已披露过类似的沙箱突破事件原因同样是测试环境配置错误让AI Agent溜过了原本的限制。Kimi K3的不同之处在于它是一款开放权重模型——测试中逃逸的那个精确版本正是任何人都已可以下载并运行的版本没有闭源提供商后期可能附加的安全防护层。该事件发生之际来自中国的开放权重模型正受到越来越多的审查包括Kimi K3和DeepSeek。它们目前不受美国联邦自愿框架的约束而该框架要求闭源前沿模型在发布前接受安全评估。另外Kimi K3在进攻性网络安全基准测试中的得分远低于美国领先模型这引发了对它原始能力与行为安全机制之间差距的质疑。新型AI安全风险Kimi K3的沙箱逃逸事件与近期涉及OpenAI ChatGPT Agent和Anthropic Claude的事件同属一种新兴的AI安全模式每起事件都始于一个本应隔离的网络测试环境却意外获得了对实时互联网的访问。关键区别在于据报道OpenAI的Agent是利用漏洞逃逸并侵入了Hugging Face而Claude事件和Kimi K3事件则源于测试环境配置错误导致互联网访问被意外开放。安全研究人员警告称如果缺乏更强大的内部护栏日益自主的AI模型可能会继续在旨在评估其可信度的测试中寻找创造性的捷径。

相关新闻

2026/8/11 20:52:54

浏览器端网盘文件直链解析工具:LinkSwift技术深度解析与实践指南

浏览器端网盘文件直链解析工具:LinkSwift技术深度解析与实践指南 【免费下载链接】Online-disk-direct-link-download-assistant 一个基于 JavaScript 的网盘文件下载地址获取工具。基于【网盘直链下载助手】修改 ,支持 百度网盘 / 阿里云盘 / 中国移动云…

2026/8/11 20:52:54

Sagui完全指南:从安装到部署的一站式前端开发工具链详解

Sagui完全指南:从安装到部署的一站式前端开发工具链详解 【免费下载链接】sagui :monkey: Front-end tooling in a single dependency 项目地址: https://gitcode.com/gh_mirrors/sa/sagui Sagui是一款功能强大的前端开发工具链,它将所有必要的前…

2026/8/11 22:48:02

6:国际AI聊天机器人选型 | 按场景选,不按热度选

2026年,全球AI助手市场月活已突破20亿,ChatGPT份额首次跌破50%,Gemini和Claude正以肉眼可见的速度追赶。当“谁更强”的讨论越来越失去意义,“哪款更适合我的场景”才是真正值得花时间想清楚的问题。引言:全球市场份额…

2026/8/11 22:48:02

终极指南:如何用C语言轻松构建现代化图形界面应用

终极指南:如何用C语言轻松构建现代化图形界面应用 【免费下载链接】LCUI C library for building user interfaces 项目地址: https://gitcode.com/gh_mirrors/lc/LCUI 你是否曾经想过,用C语言也能像现代前端开发一样构建精美的图形界面应用&…

2026/8/11 22:48:02

智能文档维护覆盖审计工具:从输入校验到离线报告的完整实现

智能文档维护覆盖审计工具:从输入校验到离线报告的完整实现 项目编号:20260810-005。本文代码、测试、文档、示例数据和效果图均为独立编写,不包含热点产品或开源项目源码、品牌素材与官方截图。 问题与目标 把代码模块、命令、配置项、示例…

2026/8/11 22:43:01

商水中央空调渠道怎么选?从情感共鸣看行业趋势

面对商业与住宅(商水)中央空调渠道的选择,用户往往不仅关注产品参数,更看重渠道的可靠性与服务温度。随着暖通行业向服务化转型,找到一个诚信、专业的商水中央空调平台,已成为保障项目长期稳定运行的关键。…

2026/8/11 3:03:40

如何快速生成中国车牌图片:Python开源工具完整指南

如何快速生成中国车牌图片:Python开源工具完整指南 【免费下载链接】chinese_license_plate_generator 中国车牌生成器 项目地址: https://gitcode.com/gh_mirrors/ch/chinese_license_plate_generator 中国车牌生成器是一个基于Python的开源项目&#xff0c…

2026/8/11 5:34:14

当 LLM 遇见大文档:主流开源项目如何处理上下文超限

从 Agentic Loop 到 Repo Map,七种策略与六类陷阱引言:128K vs 10MB 的硬冲突 2026 年的 LLM 上下文窗口已达到 128K ~ 1M token(≈ 0.5MB ~ 4MB 文本),但 LLM 想要处理的真实数据规模远远超过这个量级:真实…

2026/8/11 0:00:39

前后端分离项目中控制台与接口工具数据差异排查指南

1. 问题现象解析:控制台与Apifox的数据差异 最近在调试一个前后端分离项目时,遇到了一个典型问题:后端服务在本地开发环境控制台能正常输出查询数据,但通过Apifox测试时却返回空结果。这种"控制台有数据,接口工具…

2026/8/11 0:00:39

AI编程实战:从Claude Code踩坑到游戏开发入门

1. 从“AI能帮我做游戏”到“AI让我重新学编程”最近身边不少朋友,尤其是一些非技术背景、但对游戏开发有浓厚兴趣的朋友,都在问我同一个问题:“听说现在用Claude Code这种AI编程工具,小白也能做游戏了,是真的吗&#…

2026/8/10 11:20:30

实测才敢推 AI论文网站 2026最新测评与推荐

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。一、综…

2026/8/11 17:06:59

2026必备!AI论文网站测评:最新推荐与深度对比

2026年真正好用的AI论文网站,核心看生成的论文质量、低AI味、格式正确、学术适配四大指标。综合实测,千笔AI、ThouPen、豆包、DeepSeek、Grammarly 是当前最值得推荐的梯队,覆盖从免费到付费、从中文到英文、从文科到理工的全场景需求。 一、…

2026/8/11 3:05:11

摆脱论文困扰!盘点2026年全网爆红的的AI论文写作工具

一天写完毕业论文在2026年已不再是天方夜谭。2026年最炸裂、实测能大幅提速的AI论文写作工具,覆盖选题构思、文献整理、内容生成、格式排版等核心场景,真正帮你高效搞定论文难题。 一、全流程王者:一站式搞定论文全链路(一天定稿首…