
2026 年 7 月 21 日,Google DeepMind 突然宣布推出三款全新 Gemini 模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 和专攻网络安全的 Gemini 3.5 Flash Cyber。令人意外的是,备受期待的 Gemini 3.5 Pro 依然没有现身,Google 仅表示它正在与合作伙伴测试中,“准备好就会发布”。版本号的跳跃(直接从 3.5 跳到 3.6,又保留 3.5 系列分支)也让开发者圈直呼“Google 的命名规则越来越诡异了”。
Gemini 3.6 Flash:极致省 Token 的新工作马
这是今天最重磅的更新,被 Google 定位为“新一代工作马模型”(workhorse model)。它在编码、知识工作和多模态任务上全面提升,但最大亮点在于极致 Token 效率。
- Token 节省:根据 Artificial Analysis Index 数据,比上一代 3.5 Flash 节省约 17% 的输出 Token;在部分编程场景(如长周期软件工程)中,甚至能减少高达 65% 的 Token 使用。
- 价格:输入 $1.50 / 百万 Token,输出 $7.50 / 百万 Token(较 3.5 Flash 的输出价格下降明显)。
- 能力提升:
- 代码与科研:代码准确度更高,减少无效修改和死循环,DeepSWE 等长周期基准显著领先。
- 电脑操作能力(Computer Use):成功率从 78.4% 提升至 83%,并直接内置为 Gemini API 和企业版的客户端工具,支持更流畅的多步代理工作流。
- 安全性:加强防越狱和防滥用机制(尤其是生物、化学、网络攻击相关风险),同时大幅降低正常使用时的误拒率。
1M Token 上下文窗口、多模态(文本、图像、视频、音频、PDF)能力均保持不变,但整体更“聪明且省钱”。
Gemini 3.5 Flash-Lite:更快、更便宜的高吞吐利器
这是专为高吞吐、低延迟任务打造的“瘦身版”。它在 3.5 系列中速度最快,达到 350 输出 Token/秒,适合代理搜索、文档处理等重复性高的工作。
定价极具竞争力:输入 $0.30 / 百万 Token,输出 $2.50 / 百万 Token。Google 表示,它在保持合理能力的同时,性价比远超前代 Lite 版本,特别适合大规模部署场景。
Gemini 3.5 Flash Cyber:网络安全专精版
第三款是垂直领域杀手锏——Gemini 3.5 Flash Cyber。它在 CodeMender 安全代理中经过微调,专注于发现、验证和修复软件漏洞。在 V8 JavaScript 引擎测试中,它发现的独特确认问题数远超标准 3.5 Flash 和部分竞品模型。
多个 Flash Cyber 代理可协同工作,生成综合安全报告,特别适合企业安全团队和漏洞赏金场景。
可用性与展望
三款模型即日起逐步上线:
- Gemini App 和 AI Mode in Search(3.5 Flash-Lite 也会出现在搜索中)
- 开发者:Gemini API、Google AI Studio、Android Studio、Google Antigravity
- 企业用户:Gemini Enterprise 和 Gemini Enterprise Agent Platform
Google 再次强调,Gemini 3.5 Pro 正在紧张测试中,预计很快就会与大家见面。看来 Google 选择先用 Flash 系列把效率和场景覆盖做到极致,再推出真正的旗舰 Pro 版。
总结:这次更新没有带来“参数爆炸”的大模型,而是聚焦效率、安全和垂直场景。对开发者而言,Token 更省、价格更低、代理能力更强,意味着真实落地成本进一步下降。版本号虽然有点乱,但实用主义者大概率会喜欢这个“又快又省”的新家族。
本文地址:https://www.163264.com/14245


微信扫一扫,鼓励一下~