YutoGPT

Gemini 2.5 正式版发布!Lite 价格低到离谱,国内网友已经上手!

AI 可引用摘要

Gemini 2.5 正式版发布!Lite 价格低到离谱,国内网友已经上手!AI 圈还没平静几天,今天谷歌又掀起了巨浪!就在大家还在纠结 GPT 4o 要不要续费时,谷歌竟然悄悄上线了一个新版本: Gemini 2.5 Flash Lite,主打的竟然是史上罕见的 “白菜价”!

Gemini 2.5 正式版发布!Lite 价格低到离谱,国内网友已经上手!

AI 圈还没平静几天,今天谷歌又掀起了巨浪!

就在大家还在纠结 GPT-4o 要不要续费时,谷歌竟然悄悄上线了一个新版本:Gemini 2.5 Flash-Lite,主打的竟然是史上罕见的 “白菜价”!

每百万输入 token 只要 $0.10,输出才 $0.40。

对比【Flash 的 $0.30 / $2.50】 和 【Pro 的 $1.25 / $10】,Flash-Lite 简直便宜得离谱。

我当时看到价格就震惊了,心里立马浮现出一句话:谷歌你不是在做 AI,你这是在做批发市场啊!

Flash-Lite 是干嘛的? ----------------

---

简单讲,Flash-Lite 是谷歌 Gemini 家族推出的“低价打工人”,这完全就是谷歌针对企业 SaaS 市场以及 AI 工具领域的精准一击。。 -------------------------------------------------------------------------------

---

官方对它的定位非常明确:

* 大批量数据处理(如转录、翻译、摘要、简单问答);

* 对延迟极敏感的场景(客服机器人、实时回复);

* 预算控制严苛的 API 调用。

Gemini 2.5 Lite 跟 Flash、Pro 的区别在哪? ----------------------------------

---

Flash-Lite 默认不开启深度推理(Thinking Mode),需要时可手动开启,提高推理质量但也会提高成本和延迟。 --------------------------------------------------------------

---

如果你偶尔接点小活,跑批量任务,Flash-Lite 绝对是性价比之王。

我们直接看价格对比表:

这次谷歌还有一个隐藏大招 — Thinking Budget

简单说,你能动态控制模型 “思考量” 与响应速度之间的平衡,这个设计理念源自于 Agentic AI,让模型可以更精细地控制成本与效果。:

* 思考预算越高,模型推理更精确

* 预算越低,响应速度越快,成本也更低

官方介绍 Flash-Lite 还完整支持:

* 1M tokens上下文窗口

* 文本/图像/音频输入

* 搜索、代码执行

* 多语言性能(Global MMLU 84.5%,和 GPT-4 持平)

2.5 Flash-Lite 对比 GPT-4o mini 与 Claude 3 Haiku ----------------------------------------------

---

我们已经将这三家 API(使用直达:https://dev.kyutong.cn)都接入了,并且进行一次任务后发现,Flash-Lite 的成本优势简直让财务笑得合不拢嘴😄

直接从“降低成本”变成“用不完的预算”。

一句话总结:Flash-Lite 的定位非常明确,

极致省钱+大容量上下文+灵活推理预算,适合大批量、成本敏感任务。但复杂任务还是推荐 o3-pro、Gemini 2.5 Pro 或 Claude 4。

实测表现究竟怎样? ---------

---

知名技术博主 Simon Willison 对 Gemini 三个版本的 SVG 图像生成和音频转录任务进行了详细评测,结果如下: -----------------------------------------------------------------

---

* SVG图像生成(鹈鹕骑车)

* Pro:4226 token,成本$0.042,画质精细

* Flash:14500 token,成本$0.3625,标准画质

* Flash-Lite:2070 token,成本$0.00829,基础画质

* 音频转录(Twitter Space录音)

* Pro:147秒,$0.18,准确

* Flash:73秒,$0.10,稳定

* Flash-Lite:偶尔中途卡顿出错

从这些实际场景来看,Flash-Lite 虽然不适合复杂长文本任务,但在简单任务中性价比极高。

我自己还试了一次用 Flash-Lite 写上海今年高考作文,仅用2.9秒完成了800字文章,虽然略微生硬,但节奏和逻辑完全过关。

坦率讲,这个速度加上价格,在批量生成任务时已经接近完美。

Flash-Lite 有哪些坑? ----------------

---

当然,便宜不是万能的,必须明确一些可能遇到的坑,但想想这个价格,稍微迁就一下也不是不能接受: ----------------------------------------------

---

1. 默认不开 Thinking Mode,输出质量波动较大。

2. 长任务偶尔会卡顿中断(如长音频转录)。

3. 输出风格略机械。

推荐使用场景 ------

---

* 中小型 AI 工具开发者,Flash-Lite 最适合做基础批量任务。

* 企业级用户,需要大量电商文案、简单内容批量生成。

* AI 工作流团队,Flash-Lite 适合作预处理,Pro 做精细加工。

结尾彩蛋:神经操作系统来了 -------------

---

你以为 Flash-Lite 只能玩文本? ---------------------

---

谷歌 DeepMind 的 Oriol Vinyals 展示了一个叫做 Neural OS 的项目:每次打开文件夹,里面的内容都由模型实时生成,每次都不一样!这不是《黑客帝国》的母体吗 --------------------------------------------------------------------------------------------------------------------------------------------------------------------

---

机器之心已经实验了: ----------

---

------------------------------------------------------------------------------------------------------------------------------------------------------------

---

评论互动:这么便宜,还不试试? ---------------

---

Flash-Lite 的出现,就是谷歌冲击大众市场。如果你的任务适合规模化,这就是你手中最省钱的 AI 模型。 -------------------------------------------------------

---

感谢您的点赞+转发,感谢您关注+星标,不错过任何 AI 最前沿资讯!

商务合作 / 转载授权:[email protected]

图片
图片
扫码关注变量棱镜公众号