计价举例:DeepSeek V4 Flash

适用角色:主用户、子用户 更新日期:2026-08-06

本文使用 deepseek-v4-flash 演示费用计算方法。示例数字只用于讲解公式,不代表当前正式价格;实际单价、折扣和计费维度以模型广场及「使用记录 → 费用明细」为准。


一、示例调用

假设一条调用包含:

  • 模型:deepseek-v4-flash
  • 分组折扣:0.8
  • 输入:10,000 Token(其中 6,000 Token 命中提示缓存)
  • 输出:2,000 Token
  • 缓存写入(5 分钟):4,000 Token(首次写入缓存的部分)
  • 缓存读取:6,000 Token(命中缓存的部分)
  • 输入标准价:2 积分 / 百万 Token
  • 输出标准价:8 积分 / 百万 Token
  • 缓存写入标准价:3 积分 / 百万 Token
  • 缓存读取标准价:0.2 积分 / 百万 Token

上述单价和折扣均为演示值。请勿据此进行采购、报价或财务结算。


二、计算公式

单项费用 = Token 数 / 1,000,000 x 标准单价 x 分组折扣
总费用 = 输入费用 + 输出费用 + 缓存写入费用 + 缓存读取费用 + 其他已启用维度费用

按示例数据计算:

输入费用     = 10,000 / 1,000,000 x 2   x 0.8 = 0.016   积分
输出费用     =  2,000 / 1,000,000 x 8   x 0.8 = 0.0128  积分
缓存写入费用 =  4,000 / 1,000,000 x 3   x 0.8 = 0.0096  积分
缓存读取费用 =  6,000 / 1,000,000 x 0.2 x 0.8 = 0.00096 积分
总费用       = 0.016 + 0.0128 + 0.0096 + 0.00096 = 0.03936 积分

说明:

  • 输入按全量 Token 计费(含命中缓存的部分),不会因为命中缓存就减免输入费。
  • 缓存写入只在首次写入时产生,后续请求复用缓存不再计写入费。缓存写入分「5 分钟」和「1 小时」两档有效期,单价可能不同,以费用明细为准。
  • 缓存读取是命中已有缓存的部分,单价远低于普通输入,是长上下文场景下控制成本的主要手段。
  • 使用记录中的 Token 数和单项费用可能经过显示精度处理,逐项手工相加与实际扣费可能存在极小尾差,以费用明细中的「实际总扣费」为准。

三、折扣如何生效

未打折时的示例费用:

输入     = 10,000 / 1,000,000 x 2   = 0.02
输出     =  2,000 / 1,000,000 x 8   = 0.016
缓存写入 =  4,000 / 1,000,000 x 3   = 0.012
缓存读取 =  6,000 / 1,000,000 x 0.2 = 0.0012
标准合计 = 0.02 + 0.016 + 0.012 + 0.0012 = 0.0492 积分

应用 0.8 分组折扣后实付 0.03936 积分,相比标准价节省 20%。

分组折扣可能调整,但历史记录会保留计费当刻的价格和折扣,便于审计与对账。


四、可能出现的计费维度

维度 什么时候产生 说明
输入 发送给模型的新内容 通常包含系统提示、历史消息和本轮请求
输出 模型生成的内容 输出越长,费用通常越高
缓存写入 模型和通道支持提示缓存且首次写入 是否支持以模型广场标注为准
缓存读取 后续请求命中已缓存内容 单价以费用明细为准
图片或其他多模态输入 调用支持多模态的模型 可能按 Token、张数或平台规则计费

图片/音频/视频的输入与输出各自独立计价。

并非所有模型都支持缓存或多模态,不能假设 deepseek-v4-flashkimi-k3 一定具有相同计费维度。请以控制台展示为准。


五、如何控制费用

  1. 给每个业务或人员创建独立 API Key;
  2. 配置余额、额度、速率和并发限制;
  3. 缩短无用上下文,避免重复发送大段无关内容;
  4. 日常低延迟任务优先评估 deepseek-v4-flash
  5. 长文本或复杂任务可评估 kimi-k3,正式使用前先做质量和成本测试;
  6. 定期查看使用记录,按模型、分组、用户和 Key 分析费用。

六、导出费用记录

费用明细中可能包含账号、模型、调用时间和 IP 等信息。导出报表前可以先确认接收人和使用范围;对外共享时,建议移除 API Key、个人信息和业务内容。


七、常见问题

Q:为什么实际费用和本文不一样?
A:本文使用演示单价。正式费用取决于调用时的模型、分组、标准价、折扣、实际 Token 以及是否命中缓存等维度。

Q:deepseek-v4-flashkimi-k3 哪个更便宜?
A:请以模型广场当前价格为准,并结合输出长度、任务质量和重试次数综合比较。

Q:所有模型都支持缓存吗?
A:不支持。是否支持缓存及缓存单价,以模型广场和费用明细标注为准。

Q:历史价格调整后,旧记录会变化吗?
A:不会。历史记录按调用发生时的价格和折扣保存,便于对账。