DeepSeek V4 系列正式调价(8 月 17 日生效)后,官方调价前后、火山引擎托管调价前后、以及与火山自研 seed-2.1 的横向对比,帮你算清这笔账。
8 月 17 日 0 时起,DeepSeek-V4 系列 API 启用峰谷定价,取消统一单价。高峰时段为北京时间 9:00-12:00、14:00-18:00,其余为空闲时段,空闲时段价格为高峰的一半。
| 计费项 | 调价前 | 空闲时段 | 高峰时段 | 高峰涨幅 |
|---|---|---|---|---|
| 输入(缓存命中) | 0.02 | 0.05 | 0.10 | +400% |
| 输入(缓存未命中) | 1.00 | 1.50 | 3.00 | +200% |
| 输出 | 2.00 | 4.50 | 9.00 | +350% |
| 计费项 | 调价前 | 空闲时段 | 高峰时段 | 高峰涨幅 |
|---|---|---|---|---|
| 输入(缓存命中) | 0.025 | 0.15 | 0.30 | +1100% |
| 输入(缓存未命中) | 3.00 | 4.50 | 9.00 | +200% |
| 输出 | 6.00 | 13.50 | 27.00 | +350% |
火山方舟托管的 deepseek-v4-flash 正式版已于 8 月 21 日跟进调价,涨幅与 DeepSeek 官方完全同步。但火山引擎的定价结构有独特之处:在线推理对应 DeepSeek 高峰价,批量推理对应 DeepSeek 空闲价——按"调用模式"分价,而非按"时段"分价。
| 模型 | 计费项 | 调价前 | 调价后 | 涨幅 | |
|---|---|---|---|---|---|
| 在线推理 | 批量推理 | ||||
| V4-Flash | 缓存命中 | 0.02 | 0.10 | 0.10 | +400% |
| 缓存未命中 | 1.00 | 3.00 | 1.50 | +200% / +50% | |
| 输出 | 2.00 | 9.00 | 4.50 | +350% / +125% | |
| V4-Pro | 缓存命中 | 0.025 | 0.30参考 | 0.30参考 | — |
| 缓存未命中 | 3.00 | 9.00参考 | 4.50参考 | — | |
| 输出 | 6.00 | 27.00参考 | 13.50参考 | — | |
在线推理价格与 DeepSeek 高峰时段完全对齐,输出从 2.0 涨到 9.0(+350%)。高峰时段实时调用火山托管,成本压力与官方高峰一致。
批量推理对标 DeepSeek 空闲价,且全天任意时段可用。输出 4.5 元 vs 在线 9.0 元,直接省一半,是可延迟任务的最佳选择。
唯一例外:缓存命中在批量推理中仍按 0.10 元计费(+400%),未跟随半价规律。高缓存命中场景下,批量推理的成本优势被削弱。
把 DeepSeek 与火山自研的 doubao-seed-2.1(Pro 旗舰 / Turbo 量产)同台对比。seed-2.1 为统一定价、不分峰谷,价格全天可预测。
| 计费项 | DeepSeek V4-Flash | DeepSeek V4-Pro | 火山 seed-2.1 | |||
|---|---|---|---|---|---|---|
| 高峰 | 空闲 | 高峰 | 空闲 | turbo | pro | |
| 缓存命中 | 0.10 | 0.05 | 0.30 | 0.15 | 0.60 | 1.20 |
| 缓存未命中 | 3.00 | 1.50 | 9.00 | 4.50 | 3.00 | 6.00 |
| 输出 | 9.00 | 4.50 | 27.00 | 13.50 | 15.00 | 30.00 |
缓存命中价极低:Pro 高峰 0.30 vs seed-2.1-pro 1.20,便宜 4 倍;Flash 高峰 0.10 vs turbo 0.60,便宜 6 倍。闲时全维度占优:V4-Flash 空闲(1.5 / 0.05 / 4.5)全面低于 turbo;Pro 空闲全面低于 seed-2.1-pro。权重 MIT 开源,可自部署。
价格可预测:无峰谷波动,白天高峰也不涨价,预算好做。seed-2.1-pro 能力旗舰:在 Agent Startup Bench、MMMU-Pro、ZEROBench 等多项基准上对标 GPT-5.5/Claude 4.8。火山生态原生集成:扣子、TRAE、方舟 Agent Plan 一体化。
用 cron / 队列把可延迟任务排到 18:00 后或 9:00 前,DeepSeek 官方账单直接减半。这是投入产出比最高的一步。
固定 system prompt、长上下文前置缓存、给高频请求打 cache 标记。Pro 高峰缓存命中 0.30 vs 未命中 9.0,差 30 倍——缓存不再是优化项,是必做项。
简单分类/抽取/翻译用 Flash,复杂多步 Agent / 长上下文推理才上 Pro。Flash 与 Pro 输出价差 3 倍,盲目用 Pro 会显著拉高成本。
实时在线用官方或火山在线推理;可批处理走火山批量推理拿全天闲时价;预算敏感且要稳定就评估 seed-2.1-turbo 统一价。加成本/预算告警,防失控循环调用。