教程/日常使用

看懂用量:钱到底花在哪了

用量页把每一分钱拆到了模型和 token 类型上。看懂这张表,您就能自己回答「为什么今天花得多」,也能有意识地把成本降下来。

5 分钟更新于 2026 年 7 月 30 日macOSWindows网页
本页内容

在哪看

桌面端点侧栏 用量;网页版在 /console 的「用量」页。 默认给的是预设区间(今天 / 近 7 天 / 近 14 天 / 近 30 天),也可以自己选起止日期。

用量 · 近 7 天
总 Token
1,690,620
总花费
¥ 38.72
模型合计花费
gpt-5.6-sol1,284,502¥ 32.10
gpt-5.6-terra406,118¥ 5.42
gpt-image¥ 1.20
上面两个数字是区间合计,下面按模型拆开。

四种 token 分别是什么

这是最值得花两分钟弄明白的部分 —— 它直接决定您的花费。

输入
您这次发过去的内容。注意:AI 编程工具每一轮都会把整段对话历史重新发一遍, 所以对话越长,每一轮的输入越大。
输出
模型返回的内容。单价通常是输入的数倍,但量一般小得多。
缓存写入
第一次把一段上下文存进缓存。会有一点额外成本。
缓存命中
这次的输入里有多少是从缓存里读的。这部分按远低于正常输入的价格计费
所以「缓存命中占比」越高越省钱。在同一个会话里连续对话、不要频繁新开会话, 命中率就会高 —— 这是最容易做到的降本手段。

为什么按模型分行

不同模型的单价差得很多。表格按模型拆开,是为了让您一眼看出成本集中在哪。 常见的情况是:绝大部分花费来自能力最强的那个模型,而它只承担了一小部分请求。

gpt-image 这类图片模型是按张计费,不按 token, 所以它那一行的 token 数会是空的,只有花费。

数字对不上怎么办

常见的三种「对不上」,多数不是 bug:

  • 刚发完请求,用量没变。用量按上游回传的实际结算落库,有一点延迟。等一会儿再刷新。
  • 用量表的花费和余额掉的对不上。先确认您是不是在套餐额度内 —— 套餐内的消耗走套餐额度,不扣余额。 总览页能看到当前窗口还剩多少。
  • 「实时请求」里显示的体积很大,但花费不高。体积是传输大小,跟计费无关,两者本来就不成比例。见《高速模式》里的字段说明
如果确认是真的异常(比如没用的时段出现大额消耗),请截图用量页联系客服。 不要自己反复重装 —— 重装解决不了计费问题,只会让排查更麻烦。