2026年8月6日,DeepSeek发布公告:计划近期整体上调API服务定价,预计涨幅较大。3月DeepSeek率先大幅降价引爆价格战,如今从"价格屠夫"转向涨价,标志大模型价格战结束。
V4-Flash:缓存命中0.02元/百万Token,缓存未命中1元/百万Token,输出2元
V4-Pro:缓存命中0.025元,缓存未命中3元,输出6元
6月底引入峰谷计费:9-12时、14-18时翻倍,其余时段正常。
1. 调用量暴增:V4-Flash单日处理8万亿Token,大半来自免费试用
2. 算力压力:Agent爆发带来大量推理需求
3. 行业趋势:智谱API累计提价83%调用量反增400%;阿里云、腾讯云、百度云年初已集体上调
4. 商业化转型:从烧钱抢市场到可持续盈利
对开发者:免费午餐结束,需优化Token使用。对竞品:OpenAI免费升级GPT-5.6 Luna应对,反而更香。对行业:模型质量而非价格成为竞争焦点。
1. 用缓存命中降低成本(DeepSeek缓存命中仅0.02元)
2. 峰谷时段避开高峰期调用
3. 简单任务用Flash、复杂任务用Pro,按需选模型
4. 考虑本地部署开源模型(MiniMax H3、Qwen3.8-27B)
2026年8月6日,DeepSeek发布公告:计划近期整体上调API服务定价,预计涨幅较大。3月DeepSeek率先大幅降价引爆价格战,如今从"价格屠夫"转向涨价,标志大模型价格战结束。