本对话是怎么算钱的
会话 · 数据取自 DSH 费用统计插件本机存档 ·
生成于
一句话:「本对话」= 这一个会话里,每一次模型调用的费用之和。
每次调用的费用 = 三类 token 各乘自己的单价再相加,而单价取决于
用的是哪个模型档位 和 这次调用发生在高峰还是低谷。
一、计算流程
二、公式
四个 token 计数的来源(互不重叠)
- 命中输入 = usage.cacheReadTokens —— 命中上下文硬盘缓存、按缓存价计费的部分
- 未命中输入 = usage.inputTokens —— 已经剔除命中部分,所以两者相加才是完整 prompt
- 缓存写入 = usage.cacheWriteTokens —— DeepSeek 目前恒为 0,仍按未命中单价兜底
- 输出 = usage.outputTokens —— 已包含 reasoningTokens,不重复计
三、单价来自哪里
档位(按 provider/model 精确匹配 → 模型名 → 默认档)
高峰 / 低谷(官方规则,按调用发生的时刻判定)
高峰 = 北京时间 的 ;
其余时间(含周末全天、午休、夜间)都是低谷。低谷单价 = 高峰的一半。
四、你这个会话的真实回放
下表每一行的费用都由页面用上面的公式重新算了一遍,并与账本记录值对比:
费用构成(按钱,不按 token)
五、自己试一下(计算器)
六、口径与边界
- 包含:该会话下的每一次模型调用(含多步工具轮、自动重试、上下文压缩等辅助调用)。
- 不包含:子代理(subagent)——它是另一个会话,单独累计;失败的调用(没有 usage 上报就没法计费)。
- 时间口径:高峰/低谷按每次调用发生的时刻分别判定,同一次提问跨越 12:00 时,前后两笔可能一个高峰一个低谷。
- 数据来源:DSH 费用统计插件在 llm/stream 拦截每次调用取 TokenUsage,
累加到 bySession[sessionId],并写入本机存档 。
- 与官方账单对账:这里算的是「按列表价推得的理论费用」,可用来对齐量级与趋势;
官方实际扣费还涉及赠金优先抵扣等规则。
- 单次 vs 本对话:状态栏徽标上的「单次」是上一轮提问(从发出指令到回答完成)的花费,
每轮覆盖不累计;「本对话」才是这个页面讨论的会话累计。
页面为静态离线文件,不联网、不上报;所有数字来自本机存档快照。