findyi

Google刚扔出一颗深水炸弹

昨晚,Google悄悄发了个新模型。
没有大型发布会,没有CEO站台演讲,就是一篇博客,一个预览版入口。
但这个叫Gemini 3.1 Flash-Lite的模型,可能会改变很多人对AI成本的认知。
一、先说价格,因为这才是真正的杀手锏
输入:0.25美元/百万token。 输出:1.50美元/百万token。
什么概念?
拿它跟同家的旗舰Gemini 3.1 Pro比,只要1/8的价格。跟上一代2.5 Flash比,还便宜了一截。
横向对比更直观:Claude 4.5 Haiku要6美元,是它的3.4倍。Claude Opus 4.6要30美元,是它的17倍,但Google这次的杀招不只是价格,而是价格+性能的组合拳。
二、便宜不等于垃圾,这次真不是
过去我们对"Lite版""Mini版"的心理预期是什么?阉割版嘛,能用就行,别指望太多。
但Gemini 3.1 Flash-Lite的跑分让我意外:
GPQA Diamond(科学推理):86.9%——这个分数,比上一代的旗舰2.5 Flash还高;
Arena.ai排行榜Elo 1432——跟一些参数量大得多的模型打得有来有回;
首token响应速度比上代快2.5倍,整体输出363 tokens/秒。
说白了:它不是一个"能凑合用的便宜货",而是一个"又快又便宜还挺聪明"的生产力工具。
三、最让我兴奋的:Thinking Levels
这是这次发布里我觉得最值得关注的设计。
Google给这个模型加了4档"思考深度":Minimal、Low、Medium、High。
开发者可以根据任务复杂度,动态调节模型"想多深"。
简单任务——比如内容审核、文本分类、情感分析——拨到Minimal,极速出结果,成本压到最低。
复杂任务——比如生成Dashboard、写UI代码、做逻辑推理——拨到High,让模型深度思考再输出。
这对企业级应用来说,是真正的架构级优化。
四、对普通开发者意味着什么?
一句话:AI应用的门槛又降了一大截。
以前做一个AI驱动的产品,光API调用费就能让小团队肉疼。
现在0.25美元/百万token的输入成本,对大家真的是超级利好。
当AI的成本低到可以覆盖所有数据流的时候,玩法就完全不一样了。
这不是技术升级,这是商业模式的升级。
我一直说,AI行业的终局不是比谁模型最强,而是比谁能让最多人用得起、用得上。
Google这一步,走得很实在。
对了,破局在3月24号这天,会有一个大场直播,古典、赵充、ayawawa等一众大佬都会来直播间聊聊他们怎么用AI,同时我们准备了20万的奖品,大家务必预约起来: