GPT 用量查询:三个入口,三种口径,别看错了
查 GPT 用量之前先分清你要查哪个:API 的钱包、Codex 订阅的额度、还是本地真实的 token 消耗——三个入口口径完全不同,很多「我怎么烧这么多」的恐慌其实是看错了页面。这篇把三个入口和各自的坑列清楚。
搜「GPT 用量查询」的人,其实在查三件不同的事:API 账户花了多少钱、Codex 订阅额度还剩多少、以及本地工具实际烧了多少 token。三个入口,三种口径,互相对不上是正常的。先说清你在哪种场景,再看对应入口,能省掉大半困惑。
入口一:API 用户看 platform.openai.com/usage
用 API key 的,官方入口就是 platform.openai.com 的 Usage 页。按天给你请求数和消费金额,能按模型过滤。
它的坑有两个。一是口径是「钱」不是「token 结构」——你看不到 input 里有多少走了缓存价,而缓存恰恰是账单的决定因素(这个机制我们在没被缓存的 input 才是你的账单里拆过)。二是它按 API key / 项目聚合,你本地哪个仓库烧掉大头,它答不上来。
入口二:Codex 订阅党看额度,不看 token
订阅 ChatGPT Plus / Pro 跑 Codex 的人,没有按 token 的账单,只有额度窗口——用满了就得等重置。查法我们单独写过一篇Codex 怎么看用量,这里不重复。
要提醒的是口径差异:额度的消耗速度和 token 数不是线性关系,同样「用了 50%」,背后可能是完全不同量级的 token。所以拿额度百分比去和别人比消耗,没有意义。
入口三:本地看真实 token 结构
前两个入口都是平台视角。开发者视角的问题——「我今天写代码烧了多少、哪个项目最凶、缓存吃了几成」——得看本地。Vibe Usage 直接读工具的本地日志,input / output / 缓存分开摆,按天按项目聚合,Codex、Claude Code、Gemini 这些工具放在同一个面板里。
给个参照系:我们的聚合数据里,光 GPT-5.4 一个模型就有近 300 个活跃用户,30 天烧了 700 多亿 token(这个模型为什么这么能吃,GPT-5.4 消耗之王里有完整数据)。你的量级在群体里什么位置,对着面板一眼就知道。
为什么两边数字对不上
很多人第一次同时打开官方账单和本地统计,会发现两边对不上,以为哪边坏了。都没坏,是口径差:
官方账单按「计费 token」算——走了缓存价的 input 在金额上被压到一折,光看钱你会低估真实 token 量十倍。本地统计按「实际 token」算,缓存的部分单独列。订阅额度更是完全独立的第三套口径,跟 API 账单互不相通。
还有一个常见来源:你有多个 API key 或多台机器。官方按 key 聚合、本地按机器聚合,单边看都是残缺的。
所以别试图让两边的数字相等,它们本来就不度量同一个东西。
我的建议
说白了:查「花了多少钱」去官方,查「为什么花这么多」看本地。前者是账单,后者才是可优化的结构。
大部分人只需要每周看一次官方账单确认没爆,剩下的时间让本地统计替你盯着——GPT 用量查询这件事,装一次工具就不用再搜第二次了。