费用怎么算
1
发起请求
SDK 调用我们的入口。我们路由到对应厂商。
2
厂商执行
返回响应 + 本次消耗的 token 数(input + output)。
3
扣余额
按本次消耗的 token,从余额里扣对应 USD 金额。后台以 USD 计账,1 USDT / USDC = 1 USD,不换算成人民币。
4
入日志
控制台 → 日志 里能看到每一次调用的模型、input/output token 数和精确扣费。
缓存与有效价
很多场景会反复发送相同的上下文——系统提示、长文档、Agent 循环里的历史(Claude Code 之类的工具)。这些重复的输入 token 会命中缓存,计费便宜得多:Claude 约为输入价的 1/10,DeepSeek 更低。每个模型的确切费率见定价页。 在 Agent 负载里,缓存占了输入的大头——常达 80–97% 的 token。所以真实的平均输入价会明显低于标价。这个均价就是我们在每个模型旁边标出的 「有效价」。「有效价」是针对典型 Agent 负载、按 ~80% 缓存命中给出的估算,不是固定费率。你的缓存占比取决于发送多少重复上下文。输出 token 不缓存,按正常价计费。某段前缀首次写入缓存会一次性略贵于输入价,之后的每次读取都很便宜。
每次请求都有日志
每次调用都会进入控制台 → 日志。每一行都写明模型、input/output token 数和扣费的 USD 金额。你随时能查清余额花在哪、揪出消耗超预期的请求。单 key 花费上限
创建 API key 时可以设置 该 key 最多能从总余额里扣多少 USD。适用场景:- 生产 / 测试 / 开发各分配独立 key 各设上限。
- 把 key 给外包,预算不能超。
- 防止脚本失控烧光余额。