VibeCafé
· Claude Code

Claude Opus 5 价格出炉:模型没涨价,「快」要加钱

Opus 5 的 API 定价是每百万 input $5、output $25,和上一代持平;真正的新东西是 fast mode——同一个模型输出更快,单价全线翻倍到 $10/$50。这篇拆一下 fast mode 到底贵在哪、什么场景值得开。

先回答搜「Claude Opus 5 价格」的人:每百万 token,input $5、output $25,缓存读取 $0.5——和 Opus 4.8 一模一样,换代没涨价。要加钱的是新出的 fast mode(研究预览阶段):同一个 Opus,输出速度更快,单价全线 ×2,input $10、output $50,缓存倍率照常叠在上面。

一句话:买模型不用多花钱,买速度才要。

价格表

标准 fast mode
input / 百万 $5 $10
output / 百万 $25 $50
缓存读取 / 百万 $0.5 $1

顺便一个对照:标准档 Opus 5 的 $5/$25 和 GPT-5.5 的 $5/$30 几乎是同一价位,旗舰编程模型的定价这一年在明显收敛。差异化不再做在单价上,而是做在 fast mode 这种「同模型分速度档」的玩法上——OpenAI 那边对应的是 priority tier,思路一样。

按官方定价页,fast mode 目前只对 Opus 5 和 Opus 4.8 开放,更早的 Opus 版本不支持。Claude Code 里用 /fast 开关,开了之后模型名会带 -fast 后缀按贵档计费;Cursor 这类接了 Opus 的第三方工具也一样,看到 -fast 后缀就是双倍价。

另外注意「研究预览」这四个字。它意味着这套定价和形态都没定稿——可能涨、可能降、也可能哪天毕业变成默认。现在就把团队工作流焊死在 fast mode 上(比如 CI 里全量走 fast)不是个好主意,个人手动开关才是当下合理的用法。

「贵一倍」贵在哪:不是 output

直觉上会以为快模式贵在输出——毕竟快的是吐字速度。但看我们的聚合数据,AI 编程的消耗结构里 output 只占 6% 左右,大头从来是 input(这个结构我们在消耗月报里拆过)。

fast mode 是所有单价同比例 ×2,所以你的账单就是老老实实翻一倍,input、缓存、output 一个都跑不掉。没有「我输出少所以开 fast 划算」这种空子。

值不值就变成一道很朴素的算术题:翻倍的那部分钱,买的是你自己的等待时间。

什么时候开,什么时候别开

我的用法很简单,供参考。

交互式干活——你坐在屏幕前等它回,改一段看一段——开。这时候模型每快一秒你就真省一秒,付双倍单价买的是你的工时,多数人的时薪算下来是划算的。

Agent 长任务——丢过去自己跑十几分钟那种——别开。你人都走开了,它快不快你根本感知不到,双倍账单纯属捐款。

还有一类容易被忽略的场景:批量任务。用脚本循环调 Opus 清一堆 issue、跑评测集,这种场景没有任何「人在等」,是最不该碰 fast mode 的地方——同样的活,账单直接少一半。

顺带提醒一个细节:fast mode 叠在缓存上,缓存读取也从 $0.5 涨到 $1。重度用户九成 input 走缓存,这条涨价对账单的实际影响比看起来大。

你的 fast 到底烧了多少

Vibe Usage 这周已经适配了 fast mode 的计价——带 -fast 的模型名会按贵档单独核算,不会和标准 Opus 混在一起。开了几天 /fast 之后去看一眼自己的模型账单分布,fast 那一行占比多少,答案比任何「值不值」的分析都直接。

我自己开了两天的感受:写代码的时候舍不得关,跑长任务的时候舍不得开。说白了,这就是它定价的高明之处。

相关阅读