谷歌DeepMind推出三款新Gemini Flash模型,主打低成本与高速度
谷歌DeepMind于周二发布了三款新的Gemini Flash模型,旨在让AI代理更便宜、更快速,而其延迟发布的旗舰模型仍在合作伙伴测试中。
要点速览
周二,谷歌上线了Gemini 3.6 Flash、3.5 Flash-Lite以及一款经过安全调优的3.5 Flash Cyber模型。主力模型3.6 Flash的输出token消耗比前代最高减少17%。而此前承诺推出的Gemini 3.5 Pro依然缺席,目前仍处于与合作伙伴的测试阶段。
Gemini Flash系列阵容扩大
公司在周二的一篇帖子中确认了这三款模型,并将3.6 Flash定位为面向编程、知识工作及多模态任务的主力模型。三款模型均属于更便宜的Flash系列,专注于速度与高吞吐量,而非顶级模型的深度推理能力。谷歌表示,其目标是为大规模构建AI代理的客户提供高效、低延迟且可靠的体验。
旗舰版Flash模型相比前代版本,输出token消耗最高减少17%,从而降低了运行成本。谷歌目前将其定价为每百万输入token 1.50美元,每百万输出token 7.50美元,低于前代模型9美元的价格,并将知识截止日期更新至2026年3月。
更便宜的Flash-Lite面向文档处理、代理搜索等高吞吐量任务,价格低于其兄弟模型。第三款模型则较为特殊:Flash Cyber用于在谷歌的CodeMender代理中查找并修复软件漏洞。公司发现,在针对V8 JavaScript引擎的测试中,该模型成功标记了55个已确认的漏洞,不过其访问权限仍仅限于政府及受信任的合作伙伴。
Gemini 3.5 Pro延迟引发关注
谷歌未发布的内容与已发布的内容同样引人注目。旗舰模型3.5 Pro曾在今年5月的开发者大会上承诺于6月推出,但至今仍处于合作伙伴测试阶段,且没有明确发布日期,这比谷歌两个月前在舞台上公布的时间表晚了数月。
产品负责人Logan Kilpatrick表示,团队希望尽快推出Pro版本,并已开始了Gemini 4迄今为止最雄心勃勃的预训练工作。然而,竞争对手并未等待。仅在过去一周内,OpenAI、Anthropic等公司就相继推出了新模型,而Alphabet的股价从周四到周二中午已下跌近6%。
这一模式对谷歌而言并不陌生:它依靠更便宜、更快速的Flash模型来维持市场参与度,而顶级模型的发布却一再推迟。早在今年5月,公司还宣称3.5 Pro已接近就绪,如今随着行动更快的竞争对手不断推出新品,旗舰模型的差距反而进一步拉大。

交易所
交易所排行榜
24小时成交排行榜
人气排行榜
交易所比特币余额
交易所资产透明度证明
去中心化交易所
资金费率
资金费率热力图
爆仓数据
清算最大痛点
多空比
大户多空比
币安/欧易/火币大户多空比
Bitfinex杠杆多空比
ETF追踪
索拉纳ETF
瑞波币ETF
香港ETF
比特币持币公司
加密资产反转
以太坊储备
HyperLiquid钱包分析
Hyperliquid鲸鱼监控
大额转账
链上异动
比特币回报率
稳定币市值
期权分析
新闻
文章
财经日历
专题
钱包
合约计算器
账号安全
资讯收藏
自选币种
我的关注