⚡ AI专注速报
模型

谷歌一口气发布三款 Gemini:3.6 Flash 主打省 token

谷歌发布 Gemini 3.6 Flash、3.5 Flash-Lite 和网络安全特化版 Flash Cyber,以更少输出 token 和更低价格押注智能体生产负载,3.5 Pro 仍在测试中。

谷歌 7 月 21 日一次性推出三款 Gemini 模型——Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和 Gemini 3.5 Flash Cyber,对中端产品线做了一轮协同升级,目标直指生产环境中的智能体负载。而旗舰级的 3.5 Pro 依然停留在"测试中"。

效率是头号卖点

Gemini 3.6 Flash 被定位为新一代"主力干活模型"。谷歌称其编码与电脑操作能力显著超越 3.5 Flash:DeepSWE 得分从 37% 提升到 49%,OSWorld-Verified 从 78.4% 提升到 83.0%;同时据 Artificial Analysis 测算,完成同样任务的输出 token 减少约 17%。智能体系统要为每一个中间 token 付费,这个效率指标的商业意义不亚于跑分本身。定价为每百万输入 token 1.50 美元、输出 7.50 美元。

Gemini 3.5 Flash-Lite 瞄准工单分类、数据抽取等大批量重复任务,输出速度约每秒 350 token,价格低至 0.30/2.50 美元每百万 token。在 Terminal-Bench 2.1 上,新 Lite 从上代的 31% 跃升至 54%。

安全特化版

第三款 Gemini 3.5 Flash Cyber 是网络安全特化模型,与谷歌的 CodeMender 智能体配套,用于漏洞发现与修补。谷歌称其在 CyberGym 基准上以 Flash 级成本逼近前沿模型表现,初期仅面向政府和受信任伙伴开放试点——这一分发策略呼应了业界对具备攻击能力模型日益谨慎的态度。

两款通用模型即日起在 Gemini API、AI Studio 和 Gemini 应用中上线。谷歌同时确认 3.5 Pro 仍在与合作伙伴测试,Gemini 4 已开始预训练。

为什么重要

AI 智能体的经济账在中端市场算清——那里才是调用量所在。谷歌选择在"单任务 token 消耗"而非跑分天花板上竞争,又恰在竞品因网络攻击能力模型受审视的同一周推出受控分发的安全模型,押注的是:效率与可控分发,而不只是能力上限,将定义模型竞赛的下一阶段。

信源