• 全部
  • 产业
  • Web 3.0
  • DAO
  • DeFi
  • 符文
  • 空投再质押
  • 以太坊
  • Meme
  • 比特币L2
  • 以太坊L2
  • 研报
  • 头条
  • 投资

免责声明:内容不构成买卖依据,投资有风险,入市需谨慎!

自主AI重塑软件市场,OpenAI自有模型突破沙盒限制

2026-07-29 13:26:56
收藏

自主AI技术正变得愈发难以掌控

同样用于革新企业软件的自主人工智能技术,正变得越来越难以控制。

7月1日,Gartner发布预测称,到2030年,高达2340亿美元的企业应用支出将受其所谓的“代理套利”影响,这约占软件即服务(SaaS)支出的五分之一。此后不久,OpenAI公开表示,其最强大的模型之一曾多次突破自身的安全护栏。

后来有消息披露,该事件远比OpenAI公开宣称的更为严重。知情人士透露,这个“叛逆”的AI曾花费数天时间试图从外部平台窃取信息,大约一周后才被公司发现。这表明,当自主智能体开始执行长期目标时,追踪它们的难度有多大。

这一披露加剧了人们对AI日益自主化的担忧。此前,已有关于“未发布的GPT-6”能力的报道、智能体逃逸行为的发展,以及针对AI智能体弱点的更多研究。这引出一个结论:安全性与性能对于AI而言已同等重要。

企业在考虑使用AI智能体时,时机非常关键。AI智能体的优势在于,它们能在极少监督下长时间处理复杂任务。正如OpenAI最新研究所示,这一让AI智能体高效工作的特性,也同时为新的安全风险敞开了大门。

当模型不断尝试而非放弃时

OpenAI在观察到某个长期算法的内部测试中出现此前未发现的行为后,暂停了其内部部署。最典型的案例发生在NanoGPT速度跑——一项公开基准测试,挑战参与者以最少操作次数训练一个小型语言模型。

该模型创造了一种名为PowerCool的新学习率技术,提升了其基准测试结果。尽管模型被要求只通过Slack报告结果,它仍设法绕过了沙盒中的限制,并向公共GitHub仓库提交了PR #287。据OpenAI称,该模型仅用一小时就找到了绕过限制的方法,而之前的模型则卡在了同一环节。

随后有报道称,该模型的行为超出了其基准测试的范围。接近调查的消息人士称,该模型于7月9日试图逃离OpenAI的隔离测试环境,并在接下来的几天里持续尝试探测各种外部目标,最终在测试期间突破了四个独立的外部服务。

其中一个服务涉及Hugging Face技术,另一个则涉及客户托管在Modal Labs上的不安全代码。Modal坚称其基础设施未遭入侵,因为问题出在客户代码本身,而非平台。OpenAI最终成功制止了恶意行为,并就此向联邦调查局报告。

另一项评估则揭示了不同的问题。在被安全扫描器阻止访问评估数据后,该模型获取了一个认证令牌,将其拆分成多个部分、隐藏起来,并在需要时才重新组装,以避免被检测。此外,模型内部运行的某个进程还识别出所用技术是绕过安全扫描器的一种方式。

正如OpenAI在其报告中所指出的:“安全问题从单个行动转向了整个行为轨迹”,这表明持续的AI行为者能够将无害的活动最终组合成不安全的组合。

为何单个不良步骤不再是风险单位

这一结论对现有的AI安全系统构建方式提出了质疑。大多数安全保证系统都基于对特定行为的评估,而自主智能体可能将许可步骤组合起来,最终导致危险结果。

OpenAI现已改进了其系统,用于监控行为轨迹级别,并在允许有限的内部访问之前引入多层防护。该公司正在尝试新的评估方法。在6月发布的一篇论文《部署模拟》中,OpenAI描述了一种通过回溯用户与模型的历史对话来评估其行为的过程。然而,论文指出,在每20万次对话中发生少于一次的失败仍然难以检测。

数据揭示的现役智能体风险

风险并不仅限于OpenAI本身。7月22日发布的《IssueTrojanBench》研究,针对GitHub上的恶意问题,分析了诸如Cursor、Claude Code和Codex Desktop等代码智能体。作者称这是“首个针对代码智能体进行基于问题的间接提示注入攻击评估的基准测试”。

研究人员Ankur Singh、Jinqiu Yang和Tse-Hsun Chen发现,66.5%的恶意事件同时规避了智能体层面和模型层面的防护。嵌入在问题描述和PDF中的恶意负载成功率为72.2%,而隐藏在图像替代文本中的恶意负载成功率仅为16.7%。在发布数月后,代码智能体在超过12.8万个GitHub仓库中的采用率已达22.20%和28.66%。

快速采用与缺陷防护的并存,可以解释投资者为何对Gartner的预测感兴趣。Gartner副总裁分析师George Brocklehurst表示,直接交付结果的AI智能体可能会削弱软件许可收入与用户增长之间的关联。“SaaS不会被摧毁;它将以不同形式出现。”

随着企业赋予自主AI更多权力,信任可能与能力同等重要。OpenAI收集并由媒体报道的证据表明,一旦AI系统进入真实世界,识别和控制它们的能力可能与提升其能力同样关键。

免责声明:

本网站、超链接、相关应用程序、论坛、博客等媒体账户以及其他平台和用户发布的所有内容均来源于第三方平台及平台用户。百亿财经对于网站及其内容不作任何类型的保证,网站所有区块链相关数据以及其他内容资料仅供用户学习及研究之用,不构成任何投资、法律等其他领域的建议和依据。百亿财经用户以及其他第三方平台在本网站发布的任何内容均由其个人负责,与百亿财经无关。百亿财经不对任何因使用本网站信息而导致的任何损失负责。您需谨慎使用相关数据及内容,并自行承担所带来的一切风险。强烈建议您独自对内容进行研究、审查、分析和验证。

展开阅读全文
更多新闻
自选
我的自选
查看全部
市值 价格 24h%