> ## Documentation Index
> Fetch the complete documentation index at: https://docs.ruapi.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# 计费是如何工作的

> 按 token 用量实时扣费、每次请求都有日志、每把 key 可设花费上限。

RuAPI 余额按实际用量扣费：每次请求只扣模型真正消耗的那些 token。没有订阅、没有月费 —— 唯一的额外项是充值时的一次性折扣。

## 费用怎么算

<Steps>
  <Step title="发起请求">
    SDK 调用我们的入口。我们路由到对应厂商。
  </Step>

  <Step title="厂商执行">
    返回响应 + 本次消耗的 token 数（input + output）。
  </Step>

  <Step title="扣余额">
    按本次消耗的 token，从余额里扣对应 USD 金额。后台以 USD 计账，1 USDT / USDC = 1 USD，不换算成人民币。
  </Step>

  <Step title="入日志">
    控制台 → **日志** 里能看到每一次调用的模型、input/output token 数和精确扣费。
  </Step>
</Steps>

<Tip>
  厂商单价会变动。最新的 token 单价在主站显示，自动同步。
</Tip>

## 缓存与有效价

很多场景会反复发送相同的上下文——系统提示、长文档、Agent 循环里的历史（Claude Code 之类的工具）。这些重复的输入 token **会命中缓存，计费便宜得多**：Claude 约为输入价的 1/10，DeepSeek 更低。每个模型的确切费率见[定价页](https://www.ruapi.ai/pricing)。

在 Agent 负载里，缓存占了输入的大头——常达 80–97% 的 token。所以真实的平均输入价会**明显低于标价**。这个均价就是我们在每个模型旁边标出的 **「有效价」**。

<Note>
  「有效价」是针对典型 Agent 负载、按 \~80% 缓存命中给出的估算，不是固定费率。你的缓存占比取决于发送多少重复上下文。输出 token 不缓存，按正常价计费。某段前缀首次写入缓存会一次性略贵于输入价，之后的每次读取都很便宜。
</Note>

想看真实一天工作的拆解——多少 token 进了缓存、对账单影响多大——见 [DeepSeek 还是 Claude：一天的活儿到底花多少钱](/zh/deepseek-vs-claude)。

## 每次请求都有日志

每次调用都会进入控制台 → **日志**。每一行都写明模型、input/output token 数和扣费的 USD 金额。你随时能查清余额花在哪、揪出消耗超预期的请求。

## 单 key 花费上限

创建 API key 时可以设置 **该 key 最多能从总余额里扣多少 USD**。适用场景：

* 生产 / 测试 / 开发各分配独立 key 各设上限。
* 把 key 给外包，预算不能超。
* 防止脚本失控烧光余额。

详见 [API key 与安全](/zh/authentication)。

## 退款与余额

未用完的余额 **不过期**：账户里放多久都行。退款规则详见 [退款政策](/zh/legal/refund)。

## 怎么充值

充值方式、USDT 网络选择和充值折扣单独说明 —— 详见 [充值指南](/zh/topup)。
