计价举例:DeepSeek V4 Flash
适用角色:主用户、子用户 更新日期:2026-08-06
本文使用 deepseek-v4-flash 演示费用计算方法。示例数字只用于讲解公式,不代表当前正式价格;实际单价、折扣和计费维度以模型广场及「使用记录 → 费用明细」为准。
一、示例调用
假设一条调用包含:
- 模型:
deepseek-v4-flash - 分组折扣:0.8
- 输入:10,000 Token(其中 6,000 Token 命中提示缓存)
- 输出:2,000 Token
- 缓存写入(5 分钟):4,000 Token(首次写入缓存的部分)
- 缓存读取:6,000 Token(命中缓存的部分)
- 输入标准价:2 积分 / 百万 Token
- 输出标准价:8 积分 / 百万 Token
- 缓存写入标准价:3 积分 / 百万 Token
- 缓存读取标准价:0.2 积分 / 百万 Token
上述单价和折扣均为演示值。请勿据此进行采购、报价或财务结算。
二、计算公式
单项费用 = Token 数 / 1,000,000 x 标准单价 x 分组折扣
总费用 = 输入费用 + 输出费用 + 缓存写入费用 + 缓存读取费用 + 其他已启用维度费用按示例数据计算:
输入费用 = 10,000 / 1,000,000 x 2 x 0.8 = 0.016 积分
输出费用 = 2,000 / 1,000,000 x 8 x 0.8 = 0.0128 积分
缓存写入费用 = 4,000 / 1,000,000 x 3 x 0.8 = 0.0096 积分
缓存读取费用 = 6,000 / 1,000,000 x 0.2 x 0.8 = 0.00096 积分
总费用 = 0.016 + 0.0128 + 0.0096 + 0.00096 = 0.03936 积分说明:
- 输入按全量 Token 计费(含命中缓存的部分),不会因为命中缓存就减免输入费。
- 缓存写入只在首次写入时产生,后续请求复用缓存不再计写入费。缓存写入分「5 分钟」和「1 小时」两档有效期,单价可能不同,以费用明细为准。
- 缓存读取是命中已有缓存的部分,单价远低于普通输入,是长上下文场景下控制成本的主要手段。
- 使用记录中的 Token 数和单项费用可能经过显示精度处理,逐项手工相加与实际扣费可能存在极小尾差,以费用明细中的「实际总扣费」为准。
三、折扣如何生效
未打折时的示例费用:
输入 = 10,000 / 1,000,000 x 2 = 0.02
输出 = 2,000 / 1,000,000 x 8 = 0.016
缓存写入 = 4,000 / 1,000,000 x 3 = 0.012
缓存读取 = 6,000 / 1,000,000 x 0.2 = 0.0012
标准合计 = 0.02 + 0.016 + 0.012 + 0.0012 = 0.0492 积分应用 0.8 分组折扣后实付 0.03936 积分,相比标准价节省 20%。
分组折扣可能调整,但历史记录会保留计费当刻的价格和折扣,便于审计与对账。
四、可能出现的计费维度
| 维度 | 什么时候产生 | 说明 |
|---|---|---|
| 输入 | 发送给模型的新内容 | 通常包含系统提示、历史消息和本轮请求 |
| 输出 | 模型生成的内容 | 输出越长,费用通常越高 |
| 缓存写入 | 模型和通道支持提示缓存且首次写入 | 是否支持以模型广场标注为准 |
| 缓存读取 | 后续请求命中已缓存内容 | 单价以费用明细为准 |
| 图片或其他多模态输入 | 调用支持多模态的模型 | 可能按 Token、张数或平台规则计费 |
图片/音频/视频的输入与输出各自独立计价。
并非所有模型都支持缓存或多模态,不能假设 deepseek-v4-flash、kimi-k3 一定具有相同计费维度。请以控制台展示为准。
五、如何控制费用
- 给每个业务或人员创建独立 API Key;
- 配置余额、额度、速率和并发限制;
- 缩短无用上下文,避免重复发送大段无关内容;
- 日常低延迟任务优先评估
deepseek-v4-flash; - 长文本或复杂任务可评估
kimi-k3,正式使用前先做质量和成本测试; - 定期查看使用记录,按模型、分组、用户和 Key 分析费用。
六、导出费用记录
费用明细中可能包含账号、模型、调用时间和 IP 等信息。导出报表前可以先确认接收人和使用范围;对外共享时,建议移除 API Key、个人信息和业务内容。
七、常见问题
Q:为什么实际费用和本文不一样?
A:本文使用演示单价。正式费用取决于调用时的模型、分组、标准价、折扣、实际 Token 以及是否命中缓存等维度。
Q:deepseek-v4-flash 和 kimi-k3 哪个更便宜?
A:请以模型广场当前价格为准,并结合输出长度、任务质量和重试次数综合比较。
Q:所有模型都支持缓存吗?
A:不支持。是否支持缓存及缓存单价,以模型广场和费用明细标注为准。
Q:历史价格调整后,旧记录会变化吗?
A:不会。历史记录按调用发生时的价格和折扣保存,便于对账。