谷歌连夜上架三款Gemini,我扒了一圈数据,发现了个扎心的事实
2026/7/22 11:42:14 网站建设 项目流程

凌晨两点,朋友圈被谷歌刷屏了。

三款Gemini同时发布:3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyber。

说实话,我第一反应是:又是发布会,又是PPT吊打友商,常规操作。

但随手翻了翻数据之后,我坐不住了。


先泼盆冷水:别被营销带跑了

看了一圈科技媒体的报道,标题全是「暴省65% Token」「价格屠夫」「吊打GPT-4o」……

说实话,这些数字都没错。但我更想关心的一个问题是:

对于我这样的开发者来说,今天发布的东西,到底能不能用、好不好用、值不值得迁移?

带着这个问,我扒了一圈官方文档和技术报告,给你提炼几条硬货。

一、3.6 Flash:省Token这事,是真的

3.6 Flash最大的卖点就是「省」。

官方给了两组数据:

输出Token节省比例(对比3.5 Flash):

  • 通用场景:平均节省17%

  • DeepSWE编程任务:最高节省65%

性能提升(同样任务下):

基准

3.5 Flash

3.6 Flash

提升

DeepSWE(编程)

37%

49%

+12pp

MLE Bench(科研)

49.7%

63.9%

+14.2pp

OSWorld(操作电脑)

78.4%

83%

+4.6pp

注意这个「同样任务下」——意思是它不仅省Token,完成质量还更高了。

价格也确实降了:

规格

3.5 Flash

3.6 Flash

输入($/M)

$0.075

$1.50

输出($/M)

$0.15

$7.50

等等,这个价格……好像还贵了?

别急。Gemini的定价体系比较特殊,官方的说法是「按有效Token计费」,考虑到压缩率,实际成本是下降的。具体省多少取决于你的业务场景——编码类任务最大能省65%,普通对话可能省20-30%。


二、Flash-Lite:这个「小弟」有点猛

3.5 Flash-Lite是我觉得最值得关注的一款。

原因就一个:性价比太高了。

价格:

  • 输入:$0.3/M Token

  • 输出:$2.5/M Token

这个价格比3.5 Flash便宜了一个数量级

速度:

  • 输出速度:350 Token/秒

  • 整个3.5系列里最快

更离谱的是,在部分基准测试里,这个「小弟」居然打赢了「大哥」3.5 Flash:

基准

3.5 Flash

Flash-Lite

SWE-Bench Pro

49.6%

54.2%

OSWorld-Verified

65.1%

74.0%

这个现象在AI领域有个名字:能力涌现悖论——模型不是越大越好,训练数据和方法的优化往往比堆参数更有效。

适用场景:

  • 海量文档处理(RAG、知识库)

  • 高并发Agent搜索

  • 实时对话机器人

  • 任何「量大管饱」的场景

一句话总结:如果你现在用的是3.5 Flash做高频调用,换Flash-Lite能省一大笔钱。


三、Cyber:安全场景的专用刀

3.5 Flash Cyber是这次最特殊的一款——普通人根本用不了。

它被集成在CodeMender安全智能体里,定位是「找漏洞、补漏洞」。

关键数据:

  • CyberGym基准:刷新SOTA

  • 成本:比同级别模型低

但目前只对企业合作伙伴开放,API还没公开。

我的判断是:这款产品对普通开发者意义不大,但如果你在安全公司或者做代码审计,关注一下后续进展。


四、Gemini 4:说了等于没说

官方还放了个预告:「史上最激进的预训练已经开始,目标Gemini 4。」

但是——

  • 3.5 Pro还没正式发布

  • 3.5 Ultra还在路上

  • 4什么时候出?「按6个月训练周期推算,年底可能看到」

翻译成人话就是:别等了,先用现在的。

期货这种东西,听听就好。

五、我该怎么选?

给你一个简单的决策树:

你的场景是什么? ├── 高并发、量大管饱 → Flash-Lite(最便宜最快) ├── 复杂推理、Agent任务 → 3.6 Flash(性价比最高) ├── 代码安全、漏洞扫描 → 等Cyber企业版 └── 等旗舰、追最新 → 等3.5 Pro/Ultra

我的建议:先试试Flash-Lite。

$0.3/M的输入价格,比Claude 3 Haiku还便宜,用来跑RAG或者做背景知识检索,血赚。


写在最后

今天这波发布,核心信息就一个:AI落地成本在下降。

  • Token消耗量在下沉

  • 价格在下沉

  • 跑一次Agent的账单在下沉

这对于真正在生产环境跑AI的人来说,比什么「吊打GPT-4o」实在多了。

至于Gemini 4——

期货归期货,现货归现货。能用、便宜、稳定的,才是今天该用的。


💬 评论区聊聊:你觉得Gemini 3.6 Flash能打得过GPT-4o吗?

👍 点赞 · 👀 在看 · 🔄 转发 三连走起

🌟 加个星标,第一时间收到推送

~谢谢你看我的文章

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询