Google 连发三款新 Gemini 模型:更快、更省、更安全,但 Pro 旗舰版仍在路上

2T超大容量网盘!点击领取 >> 原画质高清备份,上传下载不限速

2026年7月21日,Google DeepMind 一口气发布了三款新 AI 模型,全部基于 Gemini 3.5 Flash 架构构建。新模型在 token 效率、速度和可靠性方面全面提升,同时也带来了一个专门面向网络安全的新成员。

Google Gemini AI模型概念图

Gemini 3.6 Flash:新一代主力模型

Google 将 3.6 Flash 定位为工作马级模型,在编码、知识工作和多模态性能方面均有显著提升。最关键的改进是token 使用量比前代降低最多 17%,意味着完成相同任务的成本更低。

基准测试数据显示:

  • DeepSWE 编码测试:49%(3.5 Flash 为 37%)
  • MLE-Bench 机器学习工程:63.9%(此前为 49.7%)
  • OSWorld 计算机操作:83%(此前为 78.4%)
  • GDPval-AA v2 知识工作:1421(此前为 1349)

在某些复杂工程任务中,token 节省幅度甚至达到 65%。定价方面,输入每百万 token 1.50 美元,输出 7.50 美元,较 3.5 Flash 的输出 9 美元有所下降。知识截止日期也从 2025年1月更新到 2026年3月。

Gemini 3.6 Flash性能基准测试对比图

Gemini 3.5 Flash-Lite:极致性价比

这是目前 Google 最快、最便宜的模型,每秒可输出 350 个 token,定价仅为输入 0.3 美元/输出 2.5 美元每百万 token。虽然定位低于 3.6 Flash,但在多项 Agent 任务上反而超越了更早的 3 Flash:

  • SWE-Bench Pro:54.2% vs 49.6%
  • OSWorld-Verified:74.0% vs 65.1%
  • Terminal-Bench 2.1:54%(此前为 31%)

该模型还支持调整推理档位——简单任务开低档求快求省,复杂任务拨高思考档位。电脑操作(computer use)也已成为内置工具。

Gemini 3.5 Flash Cyber:网络安全专用模型

这是三款模型中最特别的一个——专门针对网络安全漏洞检测和修复进行微调。配合名为 CodeMender 的基础设施代理,已在 Google 内部的 Android、Chrome 和 YouTube 代码库中实际运行并修复漏洞。初期仅向政府和受信合作伙伴开放。

3.5 Pro 去哪了?Gemini 4 已启动训练

三款新模型之外,外界最关注的问题仍然是:Gemini 3.5 Pro 什么时候来?Google 上一次更新 Pro 系列还是在 2026年2月,原本计划 6 月发布,但据报道因未能达到内部性能指标而延期。Google 表示 3.5 Pro 正在与合作伙伴测试中,同时Gemini 4 的预训练工作已经启动,这将是 Google 迄今为止规模最大的模型训练计划。

2T超大容量网盘!点击领取 >> 原画质高清备份,上传下载不限速
这是一个持续运营的鼓励
如果真的对你有用的话,感谢支持服务器及作者运营
THE END