等这么久,我还以为至少会等来 Gemini 3.5 Pro,结果整来 3 个 flash 😅

三款新模型分别为:Gemini 3.6 Flash、3.5 Flash-Lite 和专攻网络安全的 3.5 Flash Cyber。
Gemini 3.6 Flash
在 Gemini 3.5 Flash 基础上优化,智能水平几乎持平。
特点:token 使用效率提升,输出 token 减少约 17%,复杂编码任务可达 65%。
主打功能:通用代理任务、复杂编码、知识工作、多模态理解、构建高效 AI 代理。任务完成更快、步骤更少。
速度:比前代更快,任务完成时间可减半(约 1.3 分钟 vs 前代 2.7 分钟),输出速度高(数百 tokens/s 级别),适合实时交互。
价格(每 1M token):输入 $1.50,输出 $7.50。
Gemini 3.5 Flash-Lite
主打极致的速度与性价比。
特点:3.5 系列中最轻量高效的版本,速度和成本优化极致,智能水平优于前代 Lite 模型,适合高频、轻量任务。
主打功能:高吞吐场景,如文档处理、搜索、翻译、分类、数据提取、简单代理子任务等。高频生产流量下的理想选择。
速度:极快,输出可达 350 tokens/s(Artificial Analysis 数据),低延迟,适合实时、高体积应用。
价格(每 1M token):输入 $0.30,输出 $2.50。
Gemini 3.5 Flash Cyber
类似 Flash 系列(多模态、1M上下文)。
特点:基于 Flash 系列微调,专门优化网络安全相关任务,如漏洞检测、软件安全分析等。
主打功能:识别软件漏洞、安全扫描、cybersecurity 工作流。针对企业/开发者安全场景设计。
速度:继承 Flash 系列的快速特性,具体取决于任务,整体高效。
定价:类似其他 Flash 模型(具体以 API 为准,可能接近 3.5/3.6 Flash)。
跑分数据
Artificial Analysis 跑分测试结果如下:

Arena.ai 的前端代码跑分测试结果如下:

最后
想象不到半年前还风光无限的 Gemini,现在沦落到发布如此令人一言难尽的模型。
另外,Gemini 的工程师还在推特上透露,已经开始针对 Gemini 4 开启最大规模的预训练:

对此 Tibo 的回复是:

嗯,照这模型发布速度,希望 Google 真有一天能完成吧。