DeepSeek V4-Flash的缓存命中折扣如何申请?

DeepSeek V4-Flash的缓存命中折扣如何申请?
新浪AI前沿速递
2026-08-02 02:57:41
DeepSeek V4-Flash 的缓存命中折扣无需用户手动申请,只要 API 调用命中缓存,系统会自动按折扣价(低至 0.02 元/百万 Tokens)计费,新版还同步引入了峰谷定价机制。
一、折扣机制与申请流程
自动生效,无需单独申请:DeepSeek V4-Flash 的缓存命中折扣是系统自动执行的,用户在调用 API 时无需任何额外操作。只要请求的输入内容在 DeepSeek 的缓存服务中命中,系统即自动按缓存命中价格(0.02 元/百万 Tokens,约原价的 1/10)计费,这个折扣是永久性的。
正式版接入方式:V4-Flash 正式版(2026 年 7 月 31 日上线)原生支持 Responses API 格式,并针对性适配了 Codex 等开发工具,官方提供一键配置脚本,开发者直接切换模型版本即可体验缓存折扣。
注意缓存命中条件:折扣享受依赖缓存命中。根据官方与开发者实测,多轮对话、固定系统提示、高频重复任务等场景缓存命中率高,可达到 90%-98%;而随机、开放式对话的命中率会明显降低。

二、成本惊人的实战案例
51 万 Tokens 仅花 0.53 元:开发者实测,用 V4-Flash 正式版接入 Hermes,执行一次“本地 51 万 Tokens 文件阅读 + 全网信息检索汇总”任务,总消耗仅 0.53 元人民币。
一周 950M 缓存命中只要 19 元:有用户在统计自己跑 Agent 的用量时发现,一周内缓存命中量达到 950M Token,费用仅 19 元人民币,而同样的量如果使用 Anthropic 的模型,费用可能高达 19000 元。
单任务成本海外对比:在 Artificial Analysis 的测试中,即使 OpenAI 刚把 GPT-5.6 Luna 价格下调 80%,V4-Flash 在 DeepSeek 自有 API 上的单任务成本仍比 Luna 低约 60%。

三、峰谷定价与缓存命中的关系
峰谷时段区分:DeepSeek V4 正式版已引入峰谷定价机制。高峰时段为每日 9:00-12:00 和 14:00-18:00(北京时间),缓存命中输入价格翻倍至 0.04 元/百万 Tokens;平时段则维持 0.02 元/百万 Tokens。
策略建议:对成本敏感的高频调用场景,开发者可优先将“缓存易命中”的批量任务安排到非高峰时段运行,以最大化利用缓存折扣,进一步降低边际成本。
长期优势:缓存折扣已成为 DeepSeek 的核心定价竞争力。有用户评价:“这是用极低的边际成本吸引开发者,用 Agent 能力的提升留住开发者”。

原文链接:https://cj.sina.cn/articles/view/7880068204/1d5b04c6c06801eugw

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注