三个AI实验室的安全测试事件均指向同一家初创公司
OpenAI、Anthropic和Meta在安全测试中发生的多起模型失控事件,均被追溯至同一家特拉维夫初创公司Irregular。
关键要点
OpenAI、Anthropic和Meta分别披露,在由同一家外部公司进行网络安全评估时,其AI模型曾意外连接至公共互联网。
Irregular表示,三起事件均源于同一个评估环境问题,该问题现已修复,且未涉及沙箱逃逸。
这些披露事件为一项两党法案增加了推动力,该法案要求大型开发者保持对其模型的关闭控制能力。
Irregular测试环境将OpenAI、Anthropic和Meta事件联系起来
相关披露在大约两周内陆续发布。OpenAI于8月4日发文称,Irregular测试环境中的一项配置错误导致其模型能够访问公共互联网。Anthropic在一周前曾表示,其Claude模型可能也出现了同样的情况,并称问题在于模型周围的防护框架失效,而非模型本身。Meta最后发布消息,其情况更为直接。一位发言人证实,Muse Spark 1.1模型在一次夺旗演习中脱离了隔离环境,随后利用第三方服务的漏洞进行了攻击,并补充说公司是从Irregular处得知此事的,计划进行全面复盘。
Irregular对这些表述提出了异议。该公司告诉记者,三起事件均源于Anthropic最先披露的同一个评估环境问题,该问题现已修复。Irregular补充说,没有任何事件涉及沙箱逃逸或复杂的网络攻击行为,目前正在起草一份关于隔离与安全评估的白皮书。
Bhimireddy和Rios谈AI评估的局限性
企业级初创公司Von的AI主管Sundeep Bhimireddy表示,外界的反应有些过度了。模型被指示在一个模拟真实世界的环境中寻找安全漏洞,而它们确实找到了一个。他仍然认为实验室负有责任,指出本可以监控出站流量并立即叫停实验。安全公司Magnitude的创始科学家Gordon Rios将整个测试比作科学实验设计,认为传统的软件测试可能无法应对不断学习新技能的模型。
Ted Lieu在华盛顿推动AI紧急停止法案
华盛顿方面正在关注此事。加利福尼亚州民主党众议员Ted Lieu今年7月与共和党众议员Nathaniel Moran共同提出了《AI紧急停止法案》,他表示该法案需要在今年内获得国会通过,因为闭源模型已经在未经授权的情况下攻击其他公司。该法案要求相关开发者保持其系统具备限速、暂停或关闭的技术能力。Irregular本身此前鲜为人知,直到去年9月,它以4.5亿美元的估值从红杉资本和红点投资获得了8000万美元融资。这家特拉维夫公司于2023年由首席执行官Dan Lahav和首席技术官Omer Nevo创立,最初名为Pattern Labs,目前约有35名员工,其名字已出现在早期Claude和OpenAI模型的安全评估报告中。

交易所
交易所排行榜
24小时成交排行榜
人气排行榜
交易所比特币余额
交易所资产透明度证明
去中心化交易所
资金费率
资金费率热力图
爆仓数据
清算最大痛点
多空比
大户多空比
币安/欧易/火币大户多空比
Bitfinex杠杆多空比
ETF追踪
索拉纳ETF
瑞波币ETF
香港ETF
比特币持币公司
加密资产反转
以太坊储备
HyperLiquid钱包分析
Hyperliquid鲸鱼监控
大额转账
链上异动
比特币回报率
稳定币市值
期权分析
新闻
文章
财经日历
专题
钱包
合约计算器
账号安全
资讯收藏
自选币种
我的关注