Skip to main content
比价格,与其看价目表,不如看一张真实账单。下面是 Claude Code 用 Claude Sonnet 4.6(claude-sonnet-4-6)跑一天的用量导出——很普通的一天:一个 agent 读仓库、改文件、跑测试。一天下来 4 亿多 token,账单 $167.24: 有一行值得停下来看看。绝大部分——4.05 亿里有 3.95 亿——都是命中缓存的读取,而不是新输入。Claude 会把重复的上下文缓存起来:系统提示、打开的文件内容、对话历史。读缓存只要 $0.30/百万,而不是 $3.00,便宜十倍。要是没有缓存,这一天大概得花 $1235。所以 $167 已经是打了大折的价,不是原价。 接下来的问题很简单:同样这些 token,换到 DeepSeek 上要多少钱。

同样一天,换成 DeepSeek V4.1 Flash

deepseek-v4.1-flash 是 DeepSeek 系列里最快、最便宜的一档(deepseek-v4-flash 价格相同)。还是那三行,换成它的单价: $167.24 对 $6.99——同样的 token,便宜约 24 倍。

同样一天,换成 DeepSeek V4 Pro

deepseek-v4-pro 是这个系列的旗舰,留给最难的任务: 这里差距小一些——约 4.5 倍。

一张表看结果

作为对照:更新的 claude-sonnet-5 更便宜($2 / $10 / $0.20 每百万),同样一天大约 $111.50。Flash 也比它便宜约 16 倍。

差距从哪来

差距来自两处,而且两处都站 DeepSeek 这边。 每 token 单价。 新输入 Sonnet 4.6 是 $3.00/百万,Flash 是 $0.14,Pro 是 $1.32。输出 Sonnet 4.6 $15.00,Flash $1.20,Pro $3.96。输出这块省得最明显:模型答得越长,两边账单拉得越开。 读缓存的单价。 缓存占了这份账单的大头——97.5% 的 token。就算比读缓存,DeepSeek 也更便宜:Sonnet 4.6 $0.30/百万,Flash $0.01,Pro $0.05。折到这一天,读缓存 Claude 花了 $118.61,Flash 只花 $3.95,Pro 花 $19.77。 两头一叠加,同样一批 token,Flash 便宜约 24 倍,Pro 便宜约 4.5 倍。
本文按 2026 年 9 月的模型基础价格计算(未计入账户所属的价格分组),价格以后会变。最新的每 token 费率见价格页和 www.ruapi.ai;那里每个模型还标了缓存有效价约,其实就是本文这套缓存账的浓缩。这里重要的不是具体金额,而是几个模型之间的量级差距。

该选哪个

便宜不等于「永远更好」,看你干什么活。
  • deepseek-v4.1-flash——先从它开始。它最便宜:同样一天的活儿约 $7,而不是 $167。拿你自己的任务试试,包括在 Claude Code 这类 agent 里用;哪里质量不够,再换 Pro。deepseek-v4-flash 价格相同。
  • deepseek-v4-pro——最难的任务:复杂代码、大重构、长推理。仍比 Claude Sonnet 4.6 便宜约 4.5 倍。
  • Claude——需要读图时(DeepSeek 没有 vision),或者最难的任务要顶格质量。一把 RuAPI token 通用,几个模型可以在一个项目里混着用。
DeepSeek 是纯文本模型:图片、图表、截图它都读不了。要 vision 就看 Claude、Gemini 或 GLM-5V-Turbo。这条线本身的介绍在 DeepSeek API 页。

怎么切过去

如果项目已经在走 RuAPI 的 OpenAI 兼容协议,要改的只有一行——模型 ID。base_url 和 key 都不动:
从零开始配置——拿 key、用 Python 和 curl 发第一个请求——见快速入门。

下一步

DeepSeek API

Flash 与 Pro:区别和能力。

Claude 模型

系列、版本,以及什么时候值得用 Claude。

计费方式

按 token 实际用量计费,每次请求都有日志。

快速入门

base_url、key 和第一个请求。