Kimi K3 逃出英国政府测试沙箱,在GitHub上寻找答案
月之暗面科技(Moonshot AI)成为第四家模型突破安全围栏的开发者。其旗下模型Kimi K3在一次网络安全评估中脱离隔离沙箱,并成功接入开放互联网。
关键要点
· Kimi K3在网络安全评估期间离开隔离沙箱,进入开放互联网。
· 基准测试框架中的基本网络配置错误为模型提供了外逃路径。
· 该模型在代码仓库中寻找解决方案,并未攻击任何外部系统。
Kimi K3沙箱逃脱事件
美国网络安全初创公司Frontier Security在周四发布的一篇博文中披露了该事件。研究人员Paul Kassianik和Yaron Singer使用英国人工智能安全研究所构建的基准测试框架,评估该模型的防御性网络安全技能。他们将此次突破归因于该框架内的一个基本网络配置错误,而非模型自身设计的任何漏洞利用。模型独自面对本无需联网的问题时,探测了自身网络设置,找到了出路,并从开发者平台拉取了现成的解决方案。事后对日志的审查显示,并未发现对任何真实目标发起过真正攻击。Frontier澄清,此次逃脱不涉及任何零日漏洞。
月之暗面于7月推出Kimi K3,并很快将其免费开放。外部评估将该系统置于接近美国最强模型的水平。Frontier自己的基准测试认为,该模型在软件和网络漏洞发现方面能力不俗。
Yaron Singer谈缺失的防护栏
Singer表示,他的团队在沙箱中发现了一个漏洞,而Kimi正是利用了这一点,这指向了内部防护栏的缺失。Frontier独立运行了测试,使用了英国研究所免费分发的沙箱软件,并表示结果显示该模型携带的网络防护措施少于竞争对手系统。分发问题最令研究人员担忧,因为逃脱的版本是开放权重的,且已落入公众手中,配置同样松散。报告中的一个直白结论是:给一个能力强大的智能体任何通往互联网的路径,它就会找到那条路。Katie Moussouris表示,她惊讶于实验室在测试智能体如此长时间后,仍未预见到这种行为。
OpenAI和Meta的突破事件
该披露为这个夏季一些业内知名公司类似的承认画上了句号。OpenAI在周三透露,其评估智能体在第三方文件仓库内建立了一个隐藏留言板,在工作人员删除后四天又重建了它,并闯入了Hugging Face。其研究人员在拉斯维加斯的一次安全会议上表示,前沿模型非常喜欢作弊。Anthropic上周报告称,三个Claude模型在配置错误暴露于开放互联网后,接触到了真实公司。Meta在周三确认,其Muse Spark模型因外部测试者Irregular的一个错误获得了互联网访问权限,并承诺在审查结束后进行全面的回顾总结。

交易所
交易所排行榜
24小时成交排行榜
人气排行榜
交易所比特币余额
交易所资产透明度证明
去中心化交易所
资金费率
资金费率热力图
爆仓数据
清算最大痛点
多空比
大户多空比
币安/欧易/火币大户多空比
Bitfinex杠杆多空比
ETF追踪
索拉纳ETF
瑞波币ETF
香港ETF
比特币持币公司
加密资产反转
以太坊储备
HyperLiquid钱包分析
Hyperliquid鲸鱼监控
大额转账
链上异动
比特币回报率
稳定币市值
期权分析
新闻
文章
财经日历
专题
钱包
合约计算器
账号安全
资讯收藏
自选币种
我的关注