⚠️ 重要更新:DeepSeek 于 2026年8月17日零时起正式实施峰谷分时计费,V4-Pro 和 V4-Flash 价格大幅调整。高峰时段(工作日 9:00-12:00、14:00-18:00)价格为闲时的2倍。本文已更新最新价格。
一、DeepSeek 最新定价总览(2026年8月17日生效)
DeepSeek 目前提供三个主要模型版本,API 采用峰谷分时计费模式:
| 模型 | 计费项 | 闲时价格 | 高峰价格 | 单位 |
|---|---|---|---|---|
| V4-Pro (旗舰推理) | 输入(缓存未命中) | ¥4.5 | ¥9.0 | 百万tokens |
| 输入(缓存命中) | ¥0.15 | ¥0.30 | 百万tokens | |
| 输出 | ¥13.5 | ¥27.0 | 百万tokens | |
| V4-Flash (轻量快速) | 输入(缓存未命中) | ¥1.5 | ¥3.0 | 百万tokens |
| 输入(缓存命中) | ¥0.05 | ¥0.10 | 百万tokens | |
| 输出 | ¥4.5 | ¥9.0 | 百万tokens | |
| V3 (稳定版) | 输入/输出 | 输入¥1.0 / 输出¥4.0(暂未分时段) | 百万tokens | |
高峰时段:工作日 9:00-12:00、14:00-18:00;其余17小时及周末、法定节假日全天为闲时。闲时价格为高峰的50%。
二、各平台价格对比
以下为 DeepSeek-V3 各主流平台的调用价格对比(V4 系列各平台可能有独立定价,建议以平台控制台为准):
| 平台 | 模型 | 输入价格 | 输出价格 | SLA保障 | 综合评级 |
|---|---|---|---|---|---|
| 阿里云百炼 | DeepSeek-V3 | ¥1.0/百万 | ¥4.0/百万 | 99.9% | ★★★★★ |
| DeepSeek-R1 | ¥4.0/百万 | ¥16.0/百万 | |||
| 火山引擎 | DeepSeek-V3 | ¥1.0/百万 | ¥4.0/百万 | 99.9% | ★★★★☆ |
| 硅基流动 | DeepSeek-V3 | ¥0.9/百万 | ¥3.8/百万 | 99.5% | ★★★★☆ |
| DeepSeek官方 | DeepSeek-V3 | ¥1.0/百万 | ¥4.0/百万 | 无SLA | ★★★☆☆ |
阿里云百炼 DeepSeek-R1 定价:输入 ¥4.0/百万tokens,输出 ¥16.0/百万tokens(华北2北京区域)。R1 模型在数学、代码、逻辑推理方面表现突出。
三、峰谷计费省钱策略
- 批处理任务移至闲时:数据分析、文档生成、批量翻译等非实时任务,安排在晚18点至次日9点或周末执行,API成本直接减半。
- 善用缓存命中:V4-Pro 缓存命中输入仅 ¥0.15/百万(闲时),相比缓存未命中的 ¥4.5 便宜30倍。构建带系统提示缓存的应用可大幅降低成本。
- 按需选模型:日常对话、简单分类用 V4-Flash(闲时输出 ¥4.5),复杂推理才用 V4-Pro。V3 目前未分时段,适合需要价格稳定的场景。
- 资源包预付费:阿里云百炼提供预付费资源包,大用量场景可额外节省约30%。
四、企业选型建议
- SLA 保障:生产环境必须选择99.9%以上可用性承诺的平台,阿里云百炼和火山引擎均满足。
- 合规认证:金融、医疗等行业需要等保三级以上认证,阿里云百炼具备等保三级、SOC2、ISO27001全认证。
- 生态整合:已使用阿里云 ECS、OSS、RDS 等服务的团队,百炼平台可实现内网调用,延迟低至30ms,且流量费用更优。
- 技术支持:企业级用户应选择有7×24技术支持的渠道,出现问题可快速响应。
常见问题
峰谷时段如何划分?
工作日(周一至周五)9:00-12:00 和 14:00-18:00 为高峰时段,其余时间(含周末全天、法定节假日全天)为闲时时段。闲时价格统一为高峰的50%。
V3 和 V4 有什么区别?
V3 是稳定版本,目前暂未实施峰谷计费,价格保持输入¥1.0/输出¥4.0。V4-Pro 是旗舰推理模型,能力最强但价格较高;V4-Flash 是轻量快速模型,性价比高。建议根据任务复杂度选择。
缓存命中是什么意思?
当多次请求包含相同的前缀内容(如系统提示词)时,DeepSeek 会缓存这部分内容,后续请求只需支付缓存命中价格,远低于未命中价格。V4-Pro 闲时缓存命中仅¥0.15/百万tokens。
如何进一步降低API成本?
1)非实时任务安排在闲时执行;2)使用资源包预付费;3)优化prompt减少重复前缀以利用缓存;4)简单任务使用Flash模型而非Pro模型;5)通过授权渠道采购可叠加额外折扣。