价格对比 · 2026.08.18

DeepSeek 价格全景对比

DeepSeek V4 系列正式调价(8 月 17 日生效)后,官方调价前后、火山引擎托管调价前后、以及与火山自研 seed-2.1 的横向对比,帮你算清这笔账。

发布日期 2026-08-18 · 单位:元 / 百万 tokens · 北京时间
1100%
V4-Pro 缓存命中 高峰涨幅
50%
闲时价格 = 高峰的一半
30x
Pro 高峰 缓存命中 vs 未命中价差
8/21
火山引擎跟进调价
1

对比一:DeepSeek 涨价前后自身价格对比

8 月 17 日 0 时起,DeepSeek-V4 系列 API 启用峰谷定价,取消统一单价。高峰时段为北京时间 9:00-12:00、14:00-18:00,其余为空闲时段,空闲时段价格为高峰的一半。

DeepSeek-V4-Flash 单位 元/百万tokens
计费项调价前空闲时段高峰时段高峰涨幅
输入(缓存命中)0.020.050.10+400%
输入(缓存未命中)1.001.503.00+200%
输出2.004.509.00+350%
DeepSeek-V4-Pro 单位 元/百万tokens
计费项调价前空闲时段高峰时段高峰涨幅
输入(缓存命中)0.0250.150.30+1100%
输入(缓存未命中)3.004.509.00+200%
输出6.0013.5027.00+350%
峰谷定价机制:把一天分成两段——高峰 7 小时(9-12、14-18 时)与空闲 17 小时(夜间、午间、周末)。同样任务挪到晚上跑,账单直接砍半。涨幅最刺眼的是 V4-Pro 缓存命中输入(+1100%),但绝对金额仍很小;真正拉高成本的是缓存未命中输入与输出。
输出价格直观对比 越短越便宜
V4-Pro 调价前
6.0 元
V4-Pro 空闲
13.5 元
V4-Pro 高峰
27.0 元
V4-Flash 调价前
2.0 元
V4-Flash 空闲
4.5 元
V4-Flash 高峰
9.0 元
2

对比二:火山引擎托管 DeepSeek 调价前后对比

火山方舟托管的 deepseek-v4-flash 正式版已于 8 月 21 日跟进调价,涨幅与 DeepSeek 官方完全同步。但火山引擎的定价结构有独特之处:在线推理对应 DeepSeek 高峰价,批量推理对应 DeepSeek 空闲价——按"调用模式"分价,而非按"时段"分价。

V4-Flash:火山托管调价前后 单位 元/百万tokens
模型 计费项 调价前 调价后 涨幅
在线推理 批量推理
V4-Flash缓存命中0.020.100.10+400%
缓存未命中1.003.001.50+200% / +50%
输出2.009.004.50+350% / +125%
V4-Pro缓存命中0.0250.30参考0.30参考
缓存未命中3.009.00参考4.50参考
输出6.0027.00参考13.50参考
调价规律:火山引擎托管的 V4-Flash 在线推理涨幅与 DeepSeek 官方高峰时段完全一致(缓存命中 +400%、缓存未命中 +200%、输出 +350%)。而批量推理涨幅显著更低——缓存未命中仅 +50%、输出仅 +125%,因为批量推理对标的是 DeepSeek 空闲价。唯一例外是缓存命中:批量推理仍按 0.10 元计费,未跟随半价
数据说明:截至发稿,火山引擎官方文档明确给出了 v4-flash 正式版(8/21)调价后的新价格;v4-pro 当前文档快照仍为旧价。上表 v4-pro 的火山侧价格系按 v4-flash 同步调价规律推算,标注"参考",实际以火山官方公告为准。
调价后的关键发现
📈

在线推理涨幅最大

在线推理价格与 DeepSeek 高峰时段完全对齐,输出从 2.0 涨到 9.0(+350%)。高峰时段实时调用火山托管,成本压力与官方高峰一致。

💾

批量推理 = 降价后最优

批量推理对标 DeepSeek 空闲价,且全天任意时段可用。输出 4.5 元 vs 在线 9.0 元,直接省一半,是可延迟任务的最佳选择。

⚠️

缓存命中不半价

唯一例外:缓存命中在批量推理中仍按 0.10 元计费(+400%),未跟随半价规律。高缓存命中场景下,批量推理的成本优势被削弱。

3

对比三:DeepSeek vs 火山引擎 seed-2.1

把 DeepSeek 与火山自研的 doubao-seed-2.1(Pro 旗舰 / Turbo 量产)同台对比。seed-2.1 为统一定价、不分峰谷,价格全天可预测。

计费项 DeepSeek V4-Flash DeepSeek V4-Pro 火山 seed-2.1
高峰 空闲 高峰 空闲 turbo pro
缓存命中0.100.050.300.150.601.20
缓存未命中3.001.509.004.503.006.00
输出9.004.5027.0013.5015.0030.00
各自优势场景
🔵

DeepSeek V4 系列优势

缓存命中价极低:Pro 高峰 0.30 vs seed-2.1-pro 1.20,便宜 4 倍;Flash 高峰 0.10 vs turbo 0.60,便宜 6 倍。闲时全维度占优:V4-Flash 空闲(1.5 / 0.05 / 4.5)全面低于 turbo;Pro 空闲全面低于 seed-2.1-pro。权重 MIT 开源,可自部署。

→ 高缓存命中率 + 可错峰场景的最优解
🟠

doubao-seed-2.1 优势

价格可预测:无峰谷波动,白天高峰也不涨价,预算好做。seed-2.1-pro 能力旗舰:在 Agent Startup Bench、MMMU-Pro、ZEROBench 等多项基准上对标 GPT-5.5/Claude 4.8。火山生态原生集成:扣子、TRAE、方舟 Agent Plan 一体化。

→ 预算稳定 + 旗舰能力 + 火山生态场景
读表技巧:看"输入"列——V4-Flash 高峰与 seed-2.1-turbo 输入同为 3.0 元,但 DeepSeek 的缓存命中输出更便宜;看 seed-2.1-pro 与 V4-Pro 高峰——DeepSeek 输入略贵(9 vs 6)但缓存命中(0.30 vs 1.20)与输出(27 vs 30)更省。缓存命中率越高,DeepSeek 越划算。
4

综合分析与成本优化建议

三种选择,分别适合谁
成本优化四条建议
🌙

1. 错峰调度

用 cron / 队列把可延迟任务排到 18:00 后或 9:00 前,DeepSeek 官方账单直接减半。这是投入产出比最高的一步。

💾

2. 提升缓存命中率

固定 system prompt、长上下文前置缓存、给高频请求打 cache 标记。Pro 高峰缓存命中 0.30 vs 未命中 9.0,差 30 倍——缓存不再是优化项,是必做项。

🔀

3. 模型分层选型

简单分类/抽取/翻译用 Flash,复杂多步 Agent / 长上下文推理才上 Pro。Flash 与 Pro 输出价差 3 倍,盲目用 Pro 会显著拉高成本。

📊

4. 渠道按需组合

实时在线用官方或火山在线推理;可批处理走火山批量推理拿全天闲时价;预算敏感且要稳定就评估 seed-2.1-turbo 统一价。加成本/预算告警,防失控循环调用。

趋势观察
从"价格屠夫"到"价值定价"。过去 18 个月 DeepSeek 以极低价冲击市场,带动全球 API 价格中枢下移;此次调价标志着国产大模型从"低价换规模"转向"商业可持续",价格战进入 2.0 阶段峰谷定价本质是用价格杠杆做算力错峰(类电网峰谷电价),引导可延迟任务避开高峰。火山引擎同步跟进调价,托管渠道与官方趋同;即便涨完,DeepSeek 相比国际旗舰(GPT-5.5、Claude 4.8)仍有明显价格优势,但"性价比锚"已被动摇——下游聚合平台、Coding 订阅服务的额度与毛利正在重新分配。