Gemini 3.6 Flash、3.5 Flash-Lite和Cyber发布:价格、能力与开放范围一文看懂

2026-08-07 0 72

Google在2026年7月21日发布Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,并公布Gemini 3.5 Flash Cyber在CodeMender中的部署方向。本文按Google官方发布页、DeepMind模型页整理,资料核验日期为2026年8月7日,重点回答“这三款模型有什么区别、价格如何、现在谁能用”。

Gemini 3.6 Flash、3.5 Flash-Lite和Cyber发布:价格、能力与开放范围一文看懂
三款模型的定位不同,选型应从任务复杂度、吞吐和访问资格开始。

先看结论:三款模型面向三种不同任务

3.6 Flash是通用工作马,强调编码、知识工作、多模态理解和更少的输出token;3.5 Flash-Lite面向低延迟、高吞吐任务;3.5 Flash Cyber专注漏洞发现、验证和修复,当前按官方说明采用政府与可信伙伴的有限访问试点。选择时先看任务形态,再看单价和访问资格。

模型 官方定位 官方公布价格(每百万token) 可用范围
Gemini 3.6 Flash 编码、知识工作、多模态与Agent工作流 输入$1.50;输出$7.50 Gemini API、Google AI Studio、Android Studio、Gemini Enterprise等
Gemini 3.5 Flash-Lite 高吞吐、低延迟、文档处理和批量任务 输入$0.30;输出$2.50 Gemini API、Google AI Studio、Gemini Enterprise等,并逐步进入部分Google产品
Gemini 3.5 Flash Cyber 网络漏洞发现、验证与修复 发布页未给出面向公众的独立价格 CodeMender有限访问试点,面向政府和可信伙伴
Gemini 3.6 Flash、3.5 Flash-Lite和Cyber发布:价格、能力与开放范围一文看懂
3.6 Flash强调把多模态理解、工具调用和编码任务放进同一条工作流。

Gemini 3.6 Flash:通用Agent的效率升级

Google称3.6 Flash相较3.5 Flash可减少17%的输出token,并在官方引用的DeepSWE、MLE Bench和OSWorld-Verified等评测中展示编码、机器学习研究和计算机使用能力提升。页面同时给出约1.5美元输入、7.5美元输出的价格,实际账单仍要结合缓存、工具调用和所在产品的计费规则确认。

适合哪些工作

  • 需要多步工具调用、长上下文或图像、视频、PDF理解的Agent。
  • 需要把代码迁移、报告起草和图表分析放在同一工作流的团队。
  • 希望在成本可控的前提下获得比上一代Flash更稳定的输出。
Gemini 3.6 Flash、3.5 Flash-Lite和Cyber发布:价格、能力与开放范围一文看懂
通用质量与批量吞吐需要用同一组业务样本分别验证。

Gemini 3.5 Flash-Lite:高频任务的低延迟选项

Flash-Lite的发布重点是吞吐和价格。Google引用Artificial Analysis的测量称其输出速度可达每秒350个token,并给出每百万输入0.30美元、输出2.50美元的价格。官方示例覆盖收据翻译、商品特征抽取、批量摘要和快速原型生成,适合把单次任务拆成许多可重复调用的场景。

使用前要留意

  • 低延迟不等于所有复杂推理都更好;长链路任务要用业务样本比较错误率。
  • 批处理应记录输入、输出、重试和工具调用费用,避免只看模型单价。
  • 需要高质量代码修改、复杂规划或多模态判断时,应把3.6 Flash作为对照。

Gemini 3.5 Flash Cyber:安全能力与访问边界

Flash Cyber构建在3.5 Flash之上,并针对漏洞发现、验证和修复进行微调。DeepMind介绍,CodeMender会多次调用模型探索更多代码路径,再生成合并报告;Google也披露了内部代码库和Chrome生产扫描管线的评估结果。这些数字属于Google自报的评测,使用者应将其视作研究信息,不当作自身系统的保证。

为什么采用有限访问

网络安全模型具有双重用途。官方说明Flash Cyber将先通过CodeMender向政府和可信伙伴开放,以便让防御方提前发现问题并降低滥用风险。普通开发者当前不能把它当作公开API模型直接购买。

开发者该怎么选?

  1. 先按任务分桶:把工作分成复杂Agent、常规文档、多模态分析、批量抽取和安全研究。
  2. 建立成本基线:用少量脱敏样本记录成功率、延迟、输入输出token和工具费用。
  3. 3.6 Flash做质量基线:复杂任务先固定提示词和工具,再用Flash-Lite比较吞吐与质量。
  4. 设置升级与降级:高风险或低置信度结果升级人工;简单任务可以降到Lite。
  5. 核对访问资格:Cyber需要等待官方渠道和组织资质,不能用非官方“代开”服务替代。

适用条件

  • 团队能够获取官方API或产品入口,并能查看最新价格与限额。
  • 任务有可复现样本、质量标准和人工复核点。
  • 生产系统可以记录模型版本、工具调用、费用和失败原因。

限制与风险

  • 价格、地区可用性、模型别名和限额会变化,接入前应重新查看官方页面。
  • 发布页引用的基准采用特定设置,不能代替自己的业务评测。
  • 网络安全相关模型有双重用途,漏洞数据和自动修复必须放在受控环境中。
  • 多模态和工具调用会带来额外资源消耗,预算要覆盖重试与外部服务费用。

FAQ

Gemini 3.6 Flash现在可以直接使用吗?

Google发布页列出Gemini API、Google AI Studio、Android Studio和企业产品等入口。具体账户、地区和配额以登录后页面及开发者文档为准。

Flash-Lite能替代3.6 Flash吗?

它更适合大量、重复、低延迟的任务。复杂编码、长链路推理和多模态判断仍应以3.6 Flash或其他符合要求的模型做对照。

普通用户能申请Flash Cyber吗?

DeepMind目前描述的是政府和可信伙伴的有限访问试点,并未公布面向所有用户的公开购买入口。请等待官方更新。

参考资料(资料日期:2026-08-07)

  1. Google:3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber(2026-07-21)
  2. Google DeepMind:Gemini 3.5 Flash Cyber(2026-07-21)
  3. Google DeepMind:Gemini 3.6 Flash模型页
收藏 (0) 打赏

感谢您的支持,我会继续努力的!

打开微信/支付宝扫一扫,即可进行扫码打赏哦,分享从这里开始,精彩与您同在
点赞 (0)

Ai篮网 新闻资讯 Gemini 3.6 Flash、3.5 Flash-Lite和Cyber发布:价格、能力与开放范围一文看懂 https://ailantuw.com/284.html

常见问题

相关文章

猜你喜欢
发表评论
暂无评论
官方客服团队

为您解决烦忧 - 24小时在线 专业服务