Google在2026年7月21日发布Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,并公布Gemini 3.5 Flash Cyber在CodeMender中的部署方向。本文按Google官方发布页、DeepMind模型页整理,资料核验日期为2026年8月7日,重点回答“这三款模型有什么区别、价格如何、现在谁能用”。

先看结论:三款模型面向三种不同任务
3.6 Flash是通用工作马,强调编码、知识工作、多模态理解和更少的输出token;3.5 Flash-Lite面向低延迟、高吞吐任务;3.5 Flash Cyber专注漏洞发现、验证和修复,当前按官方说明采用政府与可信伙伴的有限访问试点。选择时先看任务形态,再看单价和访问资格。
| 模型 | 官方定位 | 官方公布价格(每百万token) | 可用范围 |
|---|---|---|---|
| Gemini 3.6 Flash | 编码、知识工作、多模态与Agent工作流 | 输入$1.50;输出$7.50 | Gemini API、Google AI Studio、Android Studio、Gemini Enterprise等 |
| Gemini 3.5 Flash-Lite | 高吞吐、低延迟、文档处理和批量任务 | 输入$0.30;输出$2.50 | Gemini API、Google AI Studio、Gemini Enterprise等,并逐步进入部分Google产品 |
| Gemini 3.5 Flash Cyber | 网络漏洞发现、验证与修复 | 发布页未给出面向公众的独立价格 | CodeMender有限访问试点,面向政府和可信伙伴 |

Gemini 3.6 Flash:通用Agent的效率升级
Google称3.6 Flash相较3.5 Flash可减少17%的输出token,并在官方引用的DeepSWE、MLE Bench和OSWorld-Verified等评测中展示编码、机器学习研究和计算机使用能力提升。页面同时给出约1.5美元输入、7.5美元输出的价格,实际账单仍要结合缓存、工具调用和所在产品的计费规则确认。
适合哪些工作
- 需要多步工具调用、长上下文或图像、视频、PDF理解的Agent。
- 需要把代码迁移、报告起草和图表分析放在同一工作流的团队。
- 希望在成本可控的前提下获得比上一代Flash更稳定的输出。

Gemini 3.5 Flash-Lite:高频任务的低延迟选项
Flash-Lite的发布重点是吞吐和价格。Google引用Artificial Analysis的测量称其输出速度可达每秒350个token,并给出每百万输入0.30美元、输出2.50美元的价格。官方示例覆盖收据翻译、商品特征抽取、批量摘要和快速原型生成,适合把单次任务拆成许多可重复调用的场景。
使用前要留意
- 低延迟不等于所有复杂推理都更好;长链路任务要用业务样本比较错误率。
- 批处理应记录输入、输出、重试和工具调用费用,避免只看模型单价。
- 需要高质量代码修改、复杂规划或多模态判断时,应把3.6 Flash作为对照。
Gemini 3.5 Flash Cyber:安全能力与访问边界
Flash Cyber构建在3.5 Flash之上,并针对漏洞发现、验证和修复进行微调。DeepMind介绍,CodeMender会多次调用模型探索更多代码路径,再生成合并报告;Google也披露了内部代码库和Chrome生产扫描管线的评估结果。这些数字属于Google自报的评测,使用者应将其视作研究信息,不当作自身系统的保证。
为什么采用有限访问
网络安全模型具有双重用途。官方说明Flash Cyber将先通过CodeMender向政府和可信伙伴开放,以便让防御方提前发现问题并降低滥用风险。普通开发者当前不能把它当作公开API模型直接购买。
开发者该怎么选?
- 先按任务分桶:把工作分成复杂Agent、常规文档、多模态分析、批量抽取和安全研究。
- 建立成本基线:用少量脱敏样本记录成功率、延迟、输入输出token和工具费用。
- 3.6 Flash做质量基线:复杂任务先固定提示词和工具,再用Flash-Lite比较吞吐与质量。
- 设置升级与降级:高风险或低置信度结果升级人工;简单任务可以降到Lite。
- 核对访问资格:Cyber需要等待官方渠道和组织资质,不能用非官方“代开”服务替代。
适用条件
- 团队能够获取官方API或产品入口,并能查看最新价格与限额。
- 任务有可复现样本、质量标准和人工复核点。
- 生产系统可以记录模型版本、工具调用、费用和失败原因。
限制与风险
- 价格、地区可用性、模型别名和限额会变化,接入前应重新查看官方页面。
- 发布页引用的基准采用特定设置,不能代替自己的业务评测。
- 网络安全相关模型有双重用途,漏洞数据和自动修复必须放在受控环境中。
- 多模态和工具调用会带来额外资源消耗,预算要覆盖重试与外部服务费用。
FAQ
Gemini 3.6 Flash现在可以直接使用吗?
Google发布页列出Gemini API、Google AI Studio、Android Studio和企业产品等入口。具体账户、地区和配额以登录后页面及开发者文档为准。
Flash-Lite能替代3.6 Flash吗?
它更适合大量、重复、低延迟的任务。复杂编码、长链路推理和多模态判断仍应以3.6 Flash或其他符合要求的模型做对照。
普通用户能申请Flash Cyber吗?
DeepMind目前描述的是政府和可信伙伴的有限访问试点,并未公布面向所有用户的公开购买入口。请等待官方更新。
