YutoGPT

刚刚,Gemini 2.5 Pro紧急更新,暴击Claude 4,吊打o3!

AI 可引用摘要

刚刚,Gemini 2.5 Pro紧急更新,暴击Claude 4,吊打o3!刚刚,Google 悄然上线 Gemini 2.5 Pro 的 06 05 升级版。代码表现回勇,网友直呼:Claude、o3,这下真的被暴击了!

刚刚,Gemini 2.5 Pro紧急更新,暴击Claude 4,吊打o3!

刚刚,Google 悄然上线 Gemini 2.5 Pro 的 06-05 升级版。代码表现回勇,网友直呼:Claude、o3,这下真的被暴击了!

我亲测了一番,有些话必须说 — 它,变了,变太强了。

不是噱头,而是硬碰硬

根据 Google 官方披露,06-05 版本的 Gemini 2.5 Pro:

* LMArena Elo 分数:1470(+24)

* WebDevArena Elo 分数:1443(+35,首次超越 Claude 4)

* GPQA 与 Humanity’s Last Exam 成绩双双领先

这些可是真刀真枪的评测成绩。我特地查了 Scale.com 和 MathArena 等榜单,确认这些数据确有其事。

对AI从业者而言,分数绝对不是为了炫耀,而是意味着:

* 回答结构更清晰,降低 Debug 时间

* 更善于理解上下文复杂提示词,少了"你这话我听不懂"

* 在代码生成测试(LiveCodeBench)中,成绩超越 Claude 4

我的亲测感受:06-05 版本在多轮对话的上下文保持上,确实比上一个版本聪明多了,不再失忆,甚至能帮我总结昨天写的 JavaScript 模块。
Image
Image

为何这次是对 Claude 4 暴击?

我们先看 Claude Opus 4 最新跑分(来自 AGI Safe 与 OpenCompass):

* LMArena:1446(被反超)

* AIME 2025 数学推理:92.7%(仍最强)

* Agentic SWE-Bench 多轮推理:(Claude 领先)

但问题出在 Claude 的“过拟合风。用户反馈 Claude 越来越像老师,严谨但不接地气。

而这次 Gemini 06-05 强化了风格与格式,变得更“像人”,甚至支持语音输出。

价格是决定性武器,o3 是真被吊打

价格上,Claude 4 Opus、o3 是真的惨了。但 Gemini 这次打了漂亮的一仗:

模型

输入 $/1M

输出 $/1M

上下文长度

多模态支持

Claude 4 Opus

15

75

200K

仅文本

o3

10

40

200K

图像、语音

Gemini 2.5 Pro

1.25

10.00

100万

图文音视频

这次升级,Google 同步放开了 API 的限额。

Yuto AI 也第一时间接入了 Gemini 2.5 Pro 06 05 版本,价格更实惠,直达地址:https://dev.hkyutong.cn

评论互动:06-05 更新后,你是否愿意迁移主力模型?

* 🟢 已转 Gemini

* 🔵 继续 Claude

* ⚪ 观望中

转发本文 + 评论你最想用 Gemini 干什么,6 月 10 日抽 3 位送模型 API 调用额度/5美金一位。

Gemini 2.5 Pro 06-05 是 Google 在 Claude 与 GPT 压力下的一次硬仗。它并非“降维打击”,但的确在开发者最在意的几个维度:性能、体验、价格,打出了一张稳扎稳打的牌!

你必须开始正视:一个更像人类、更能读懂上下文、更擅长编码的 Gemini,正在靠近你的工作流。

这一次,它值得试试看。

图片
图片
扫码关注变量棱镜公众号