Claude Opus 5 价格出炉:模型没涨价,「快」要加钱
Opus 5 的 API 定价是每百万 input $5、output $25,和上一代持平;真正的新东西是 fast mode——同一个模型输出更快,单价全线翻倍到 $10/$50。这篇拆一下 fast mode 到底贵在哪、什么场景值得开。
先回答搜「Claude Opus 5 价格」的人:每百万 token,input $5、output $25,缓存读取 $0.5——和 Opus 4.8 一模一样,换代没涨价。要加钱的是新出的 fast mode(研究预览阶段):同一个 Opus,输出速度更快,单价全线 ×2,input $10、output $50,缓存倍率照常叠在上面。
一句话:买模型不用多花钱,买速度才要。
价格表
| 标准 | fast mode | |
|---|---|---|
| input / 百万 | $5 | $10 |
| output / 百万 | $25 | $50 |
| 缓存读取 / 百万 | $0.5 | $1 |
顺便一个对照:标准档 Opus 5 的 $5/$25 和 GPT-5.5 的 $5/$30 几乎是同一价位,旗舰编程模型的定价这一年在明显收敛。差异化不再做在单价上,而是做在 fast mode 这种「同模型分速度档」的玩法上——OpenAI 那边对应的是 priority tier,思路一样。
按官方定价页,fast mode 目前只对 Opus 5 和 Opus 4.8 开放,更早的 Opus 版本不支持。Claude Code 里用 /fast 开关,开了之后模型名会带 -fast 后缀按贵档计费;Cursor 这类接了 Opus 的第三方工具也一样,看到 -fast 后缀就是双倍价。
另外注意「研究预览」这四个字。它意味着这套定价和形态都没定稿——可能涨、可能降、也可能哪天毕业变成默认。现在就把团队工作流焊死在 fast mode 上(比如 CI 里全量走 fast)不是个好主意,个人手动开关才是当下合理的用法。
「贵一倍」贵在哪:不是 output
直觉上会以为快模式贵在输出——毕竟快的是吐字速度。但看我们的聚合数据,AI 编程的消耗结构里 output 只占 6% 左右,大头从来是 input(这个结构我们在消耗月报里拆过)。
fast mode 是所有单价同比例 ×2,所以你的账单就是老老实实翻一倍,input、缓存、output 一个都跑不掉。没有「我输出少所以开 fast 划算」这种空子。
值不值就变成一道很朴素的算术题:翻倍的那部分钱,买的是你自己的等待时间。
什么时候开,什么时候别开
我的用法很简单,供参考。
交互式干活——你坐在屏幕前等它回,改一段看一段——开。这时候模型每快一秒你就真省一秒,付双倍单价买的是你的工时,多数人的时薪算下来是划算的。
Agent 长任务——丢过去自己跑十几分钟那种——别开。你人都走开了,它快不快你根本感知不到,双倍账单纯属捐款。
还有一类容易被忽略的场景:批量任务。用脚本循环调 Opus 清一堆 issue、跑评测集,这种场景没有任何「人在等」,是最不该碰 fast mode 的地方——同样的活,账单直接少一半。
顺带提醒一个细节:fast mode 叠在缓存上,缓存读取也从 $0.5 涨到 $1。重度用户九成 input 走缓存,这条涨价对账单的实际影响比看起来大。
你的 fast 到底烧了多少
Vibe Usage 这周已经适配了 fast mode 的计价——带 -fast 的模型名会按贵档单独核算,不会和标准 Opus 混在一起。开了几天 /fast 之后去看一眼自己的模型账单分布,fast 那一行占比多少,答案比任何「值不值」的分析都直接。
我自己开了两天的感受:写代码的时候舍不得关,跑长任务的时候舍不得开。说白了,这就是它定价的高明之处。