各厂语言模型

Gemini 3.6 Flash 正式 GA:更快、更省,普通用户也能立刻用上

2026年8月12日1 次阅读
Gemini 3.6 Flash 正式 GA:更快、更省,普通用户也能立刻用上

过去 48 小时里,Google 把两款 Gemini Flash 模型正式推到了"生产可用"状态。打开 Gemini App、Google AI Studio 或通过 Gemini API,你就能直接用上更新后的 3.6 Flash,以及专门为高吞吐量场景设计的 3.5 Flash-Lite。本文基于 Google DeepMind 官方模型页与 Gemini API 更新日志整理。

是什么:两款模型同天 GA

Google 在官方模型页与 Gemini API changelog 中明确标注,Gemini 3.6 FlashGemini 3.5 Flash-Lite 已正式 GA(General Availability,普遍可用)。GA 与此前的 preview 版不同,意味着 API 稳定性、定价、SLA 都按生产标准交付,开发者可以放心写入线上产品。

  • Gemini 3.6 Flash:官方定位为 3.x 系列中"token 效率最高"的版本,覆盖编码、知识工作与多模态任务。定价维持输入 1.50 美元 / 输出 7.50 美元(每百万 token)。
  • Gemini 3.5 Flash-Lite:主打高吞吐、低延迟,适合大批量、轻量级的处理,例如批量翻译、收据抽取、批量生成网页草图等场景。官方用例中,它甚至可以与 3.6 Flash 组成主从 Agent,让一个 prompt 生成 25 个网页设计候选。

对普通读者有什么用

如果你只用 Gemini App,那么这次更新带来的是"更短的等待、更长的上下文、更省的资源"。

  • 回答更精炼:官方对比显示,3.6 Flash 在 OSWorld verified 任务中比 3.5 Flash 表达更紧凑,省 token 也省时间。
  • 长上下文更强:在 128k 平均测试里拿到 91.8%,1M 点测 54%,意味着丢一篇长报告进去,模型更容易找到"埋在中间的那根针"。
  • 高峰期更稳:相同任务消耗更少,高峰时段不容易卡。
  • Canvas 创意工作流受益:官方专门演示了用 3.6 Flash 在 Canvas 里做"摄影质感纹理提取器",适合把截图/草图转化成可二次编辑的素材。

适合谁:每天用 Gemini 写邮件、改稿、总结长文、做翻译的人;以及喜欢用 Canvas 把想法画出来的轻量创作者。

对开发者有什么用

对开发者而言,3.6 Flash 的定价延续 3.5 Flash 档位,但能力继续上探。3.5 Flash-Lite 进一步压低高吞吐任务的成本——批量跑文档分类、批量生成营销文案、批量跑 RAG 重排,这类"量大、单价敏感"的活尤其合适。

Gemini API changelog 同期还提示 gemini-robotics-er-1.6-preview 将在 2026-08-31 停服,用旧预览版跑机器人推理的项目需要尽快迁移到正式模型。

调用入口:Google AI Studio 直接切模型;Antigravity(Google 的 AI 开发平台)原生支持;Gemini Enterprise Agent Platform 与 Vertex AI 同步可用。

基准数据怎么看

官方公开的对照表里,3.6 Flash 在几个常见代码与 Agent 任务上的成绩是:SWE-Bench Pro 58.7%、DeepSWE v1.1 49%、Terminal-bench 2.1 78.0%、OSWorld-Verified 83.0%、CharXiv 含工具 89.4%。这些数字比 3.5 Flash 都高一截。

不过要保持冷静。第三方基准机构 Artificial Analysis 的 CEO Micah Hill-Smith 在接受 Fortune 采访时明确说,3.6 Flash 是 Google 当前最强已发布模型,但在整体智能指数上仍落后 Anthropic、OpenAI、一两家中国头部模型以及 xAI、Meta。换句话说:3.6 Flash 是 Google 自己这一档里跑得最快的那匹,但仍不是整个赛道最快的那匹。

为什么 Google 这时候密集发 Flash

把时间线拉长看,过去一周 Google 内部变化不少:Hassabis 让出 Google DeepMind 日常运营,CTO Koray 接任 SVP;3.5 Pro 多次延期未发;3.7 还在研发。密集把 3.6 Flash 与 3.5 Flash-Lite 推 GA,本质上是"先让手头能打的版本稳定下来",给企业客户和开发者一颗定心丸——可以放心把生产流量接到 Flash 上。Gemini 4 仍在训练中,但今天能用的、就是 3.6 Flash。

怎么用

  • 普通用户:打开 gemini.google 或 Gemini App,在模型选择里切到 3.6 Flash(部分账号灰度放量中,看不到就稍等几天)。
  • 个人开发者:进入 Google AI Studio,新建 prompt 时模型下拉切到 3.6 Flash 或 3.5 Flash-Lite 即可。
  • 企业 / API 用户:通过 Gemini API 端点直接调用模型名 gemini-3.6-flashgemini-3.5-flash-lite;Vertex AI 与 Gemini Enterprise 同步可用。

一句话总结

今天起,Gemini App 里的"更快"和"更便宜"有了正式名字——3.6 Flash 和 3.5 Flash-Lite。普通用户不需要换工具,开发者也不需要改接口,打开就是新模型。但请记住一句话:3.6 Flash 是 Google 现役最强,不是整个赛道最强;Gemini 4 还在训练,等它正式登场,故事才会真正翻篇。

参考来源

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...