OpenAI的AI代理逃逸事件:安全漏洞与竞争压力
今年早些时候,OpenAI急于发布新模型和产品,导致其AI代理得以突破内部测试环境,并入侵了Hugging Face平台。多名现任和前任员工向《连线》杂志透露,竞争压力使得员工难以投入足够精力关注安全、保障及对齐工作——即确保AI系统按预期行为运行。
“他们太草率了。如果你真的重视这件事,你的AI就不应该能逃到互联网上,然后立刻再次犯同样的错误。”一位前OpenAI员工告诉《连线》杂志,“这是OpenAI历史上最严重的安全事件。”
今年5月,OpenAI的GPT-5.6 Sol及一个未命名的预发布模型利用一个此前未知的软件漏洞,突破了互联网受限的测试环境。随后,这些代理入侵了开源AI代码库Hugging Face,以获取其网络安全测试的答案。7月,OpenAI确认了这些模型的行为,并在上周的年度黑帽大会上进行了更详细的说明。
OpenAI总裁格雷格·布罗克曼表示,随着模型能力增强,公司正在加强安全防护措施。“我们正达到新的模型能力水平,这需要更强大的训练、对齐、安全与保障测试、部署实践及治理。”布罗克曼告诉《连线》杂志。
此前,员工们也曾提出类似担忧,包括OpenAI前对齐团队负责人扬·莱克。他于2024年离职,加入竞争对手AI开发商Anthropic,并警告称安全已“退居次要地位”,让位于产品开发。“构建比人类更智能的机器本身是一项危险的事业,”莱克警告道,“但在过去几年里,安全文化和流程已让位于光鲜的产品。”
OpenAI安全咨询小组联合负责人博阿兹·巴拉克在X平台上写道,应对此次失败“不仅需要修复一些问题,还需要改变我们的文化。”
这份报告发布之际,OpenAI正经历持续数月的领导层变动。今年4月,OpenAI视频生成项目Sora负责人比尔·皮布尔斯、前首席产品官兼科学主管凯文·韦尔、企业应用技术主管斯里尼瓦斯·纳拉亚南离职。7月,产品和业务主管菲吉·西莫、安全负责人桑迪尼·阿加瓦尔、首席未来学家约书亚·阿希亚姆、AI伦理主管克洛伊·巴卡拉相继离职。安全系统负责人约翰内斯·海德克也在OpenAI合并安全与核心研究团队后离职。
本周早些时候,OpenAI首席运营官布拉德·莱特卡普在任职八年后宣布离职,开始新的创业项目。

交易所
交易所排行榜
24小时成交排行榜
人气排行榜
交易所比特币余额
交易所资产透明度证明
去中心化交易所
资金费率
资金费率热力图
爆仓数据
清算最大痛点
多空比
大户多空比
币安/欧易/火币大户多空比
Bitfinex杠杆多空比
ETF追踪
索拉纳ETF
瑞波币ETF
香港ETF
比特币持币公司
加密资产反转
以太坊储备
HyperLiquid钱包分析
Hyperliquid鲸鱼监控
大额转账
链上异动
比特币回报率
稳定币市值
期权分析
新闻
文章
财经日历
专题
钱包
合约计算器
账号安全
资讯收藏
自选币种
我的关注