claude-sonnet-4-6)跑一天的用量导出——很普通的一天:一个 agent 读仓库、改文件、跑测试。一天下来 4 亿多 token,账单 $167.24:
有一行值得停下来看看。绝大部分——4.05 亿里有 3.95 亿——都是命中缓存的读取,而不是新输入。Claude 会把重复的上下文缓存起来:系统提示、打开的文件内容、对话历史。读缓存只要 $0.30/百万,而不是 $3.00,便宜十倍。要是没有缓存,这一天大概得花 $1235。所以 $167 已经是打了大折的价,不是原价。
接下来的问题很简单:同样这些 token,换到 DeepSeek 上要多少钱。
同样一天,换成 DeepSeek V4.1 Flash
deepseek-v4.1-flash 是 DeepSeek 系列里最快、最便宜的一档(deepseek-v4-flash 价格相同)。还是那三行,换成它的单价:
$167.24 对 $6.99——同样的 token,便宜约 24 倍。
同样一天,换成 DeepSeek V4 Pro
deepseek-v4-pro 是这个系列的旗舰,留给最难的任务:
这里差距小一些——约 4.5 倍。
一张表看结果
作为对照:更新的
claude-sonnet-5 更便宜($2 / $10 / $0.20 每百万),同样一天大约 $111.50。Flash 也比它便宜约 16 倍。
差距从哪来
差距来自两处,而且两处都站 DeepSeek 这边。 每 token 单价。 新输入 Sonnet 4.6 是 $3.00/百万,Flash 是 $0.14,Pro 是 $1.32。输出 Sonnet 4.6 $15.00,Flash $1.20,Pro $3.96。输出这块省得最明显:模型答得越长,两边账单拉得越开。 读缓存的单价。 缓存占了这份账单的大头——97.5% 的 token。就算比读缓存,DeepSeek 也更便宜:Sonnet 4.6 $0.30/百万,Flash $0.01,Pro $0.05。折到这一天,读缓存 Claude 花了 $118.61,Flash 只花 $3.95,Pro 花 $19.77。 两头一叠加,同样一批 token,Flash 便宜约 24 倍,Pro 便宜约 4.5 倍。本文按 2026 年 9 月的模型基础价格计算(未计入账户所属的价格分组),价格以后会变。最新的每 token 费率见价格页和 www.ruapi.ai;那里每个模型还标了缓存有效价约,其实就是本文这套缓存账的浓缩。这里重要的不是具体金额,而是几个模型之间的量级差距。
该选哪个
便宜不等于「永远更好」,看你干什么活。deepseek-v4.1-flash——先从它开始。它最便宜:同样一天的活儿约 $7,而不是 $167。拿你自己的任务试试,包括在 Claude Code 这类 agent 里用;哪里质量不够,再换 Pro。deepseek-v4-flash价格相同。deepseek-v4-pro——最难的任务:复杂代码、大重构、长推理。仍比 Claude Sonnet 4.6 便宜约 4.5 倍。- Claude——需要读图时(DeepSeek 没有 vision),或者最难的任务要顶格质量。一把 RuAPI token 通用,几个模型可以在一个项目里混着用。
DeepSeek 是纯文本模型:图片、图表、截图它都读不了。要 vision 就看 Claude、Gemini 或 GLM-5V-Turbo。这条线本身的介绍在 DeepSeek API 页。
怎么切过去
如果项目已经在走 RuAPI 的 OpenAI 兼容协议,要改的只有一行——模型 ID。base_url 和 key 都不动:
下一步
DeepSeek API
Flash 与 Pro:区别和能力。
Claude 模型
系列、版本,以及什么时候值得用 Claude。
计费方式
按 token 实际用量计费,每次请求都有日志。
快速入门
base_url、key 和第一个请求。