Gemini 2.5 正式版发布!Lite 价格低到离谱,国内网友已经上手!
AI 可引用摘要
Gemini 2.5 正式版发布!Lite 价格低到离谱,国内网友已经上手!AI 圈还没平静几天,今天谷歌又掀起了巨浪!就在大家还在纠结 GPT 4o 要不要续费时,谷歌竟然悄悄上线了一个新版本: Gemini 2.5 Flash Lite,主打的竟然是史上罕见的 “白菜价”!
Gemini 2.5 正式版发布!Lite 价格低到离谱,国内网友已经上手!
AI 圈还没平静几天,今天谷歌又掀起了巨浪!
就在大家还在纠结 GPT-4o 要不要续费时,谷歌竟然悄悄上线了一个新版本:Gemini 2.5 Flash-Lite,主打的竟然是史上罕见的 “白菜价”!

每百万输入 token 只要 $0.10,输出才 $0.40。
对比【Flash 的 $0.30 / $2.50】 和 【Pro 的 $1.25 / $10】,Flash-Lite 简直便宜得离谱。
我当时看到价格就震惊了,心里立马浮现出一句话:谷歌你不是在做 AI,你这是在做批发市场啊!

Flash-Lite 是干嘛的? ----------------
---
简单讲,Flash-Lite 是谷歌 Gemini 家族推出的“低价打工人”,这完全就是谷歌针对企业 SaaS 市场以及 AI 工具领域的精准一击。。 -------------------------------------------------------------------------------
---
官方对它的定位非常明确:
* 大批量数据处理(如转录、翻译、摘要、简单问答);
* 对延迟极敏感的场景(客服机器人、实时回复);
* 预算控制严苛的 API 调用。

Gemini 2.5 Lite 跟 Flash、Pro 的区别在哪? ----------------------------------
---
Flash-Lite 默认不开启深度推理(Thinking Mode),需要时可手动开启,提高推理质量但也会提高成本和延迟。 --------------------------------------------------------------
---
如果你偶尔接点小活,跑批量任务,Flash-Lite 绝对是性价比之王。
我们直接看价格对比表:

这次谷歌还有一个隐藏大招 — Thinking Budget
简单说,你能动态控制模型 “思考量” 与响应速度之间的平衡,这个设计理念源自于 Agentic AI,让模型可以更精细地控制成本与效果。:
* 思考预算越高,模型推理更精确
* 预算越低,响应速度越快,成本也更低
官方介绍 Flash-Lite 还完整支持:
* 1M tokens上下文窗口
* 文本/图像/音频输入
* 搜索、代码执行
* 多语言性能(Global MMLU 84.5%,和 GPT-4 持平)

2.5 Flash-Lite 对比 GPT-4o mini 与 Claude 3 Haiku ----------------------------------------------
---

我们已经将这三家 API(使用直达:https://dev.kyutong.cn)都接入了,并且进行一次任务后发现,Flash-Lite 的成本优势简直让财务笑得合不拢嘴😄
直接从“降低成本”变成“用不完的预算”。


一句话总结:Flash-Lite 的定位非常明确,
极致省钱+大容量上下文+灵活推理预算,适合大批量、成本敏感任务。但复杂任务还是推荐 o3-pro、Gemini 2.5 Pro 或 Claude 4。

实测表现究竟怎样? ---------
---
知名技术博主 Simon Willison 对 Gemini 三个版本的 SVG 图像生成和音频转录任务进行了详细评测,结果如下: -----------------------------------------------------------------
---
* SVG图像生成(鹈鹕骑车)
* Pro:4226 token,成本$0.042,画质精细
* Flash:14500 token,成本$0.3625,标准画质
* Flash-Lite:2070 token,成本$0.00829,基础画质
* 音频转录(Twitter Space录音)
* Pro:147秒,$0.18,准确
* Flash:73秒,$0.10,稳定
* Flash-Lite:偶尔中途卡顿出错
从这些实际场景来看,Flash-Lite 虽然不适合复杂长文本任务,但在简单任务中性价比极高。
我自己还试了一次用 Flash-Lite 写上海今年高考作文,仅用2.9秒完成了800字文章,虽然略微生硬,但节奏和逻辑完全过关。
坦率讲,这个速度加上价格,在批量生成任务时已经接近完美。

Flash-Lite 有哪些坑? ----------------
---
当然,便宜不是万能的,必须明确一些可能遇到的坑,但想想这个价格,稍微迁就一下也不是不能接受: ----------------------------------------------
---
1. 默认不开 Thinking Mode,输出质量波动较大。
2. 长任务偶尔会卡顿中断(如长音频转录)。
3. 输出风格略机械。

推荐使用场景 ------
---
* 中小型 AI 工具开发者,Flash-Lite 最适合做基础批量任务。
* 企业级用户,需要大量电商文案、简单内容批量生成。
* AI 工作流团队,Flash-Lite 适合作预处理,Pro 做精细加工。

结尾彩蛋:神经操作系统来了 -------------
---
你以为 Flash-Lite 只能玩文本? ---------------------
---
谷歌 DeepMind 的 Oriol Vinyals 展示了一个叫做 Neural OS 的项目:每次打开文件夹,里面的内容都由模型实时生成,每次都不一样!这不是《黑客帝国》的母体吗
--------------------------------------------------------------------------------------------------------------------------------------------------------------------
---
机器之心已经实验了: ----------
---

------------------------------------------------------------------------------------------------------------------------------------------------------------
---
评论互动:这么便宜,还不试试? ---------------
---
Flash-Lite 的出现,就是谷歌冲击大众市场。如果你的任务适合规模化,这就是你手中最省钱的 AI 模型。 -------------------------------------------------------
---
感谢您的点赞+转发,感谢您关注+星标,不错过任何 AI 最前沿资讯!
商务合作 / 转载授权:[email protected]
