DeepSeek调价生效 涨幅最高达1100%

来源:新浪网· 2026-08-17 09:09:26 0

DeepSeek于2026年8月17日零时起正式调整API定价,全面转向“峰谷分时计价”模式,高峰时段输出价格最高飙升至原价的4.5倍,旗舰模型V4 Pro缓存命中输入价格在高峰时段涨幅高达1100%,同时V4 Pro结束测试转为正式商用。[1][2]这次调价标志着DeepSeek正式告别“低价换份额”阶段,行业性算力成本传导开始全面落地。

  DeepSeek正式版涨价的核心方案是什么?

  核心结论:DeepSeek将统一计费改为峰谷分时计价,高峰时段(每日9:00-12:00、14:00-18:00)价格为空闲时段的两倍,新价格于2026年8月17日00:00正式生效,V4 Pro同步转为正式商用服务。[3]

  具体来看,DeepSeek官方将每日划分为高峰和空闲两个计费区间。高峰时段为北京时间9:00-12:00和14:00-18:00,其余时间及周末执行空闲价。这一模式与电力行业的“峰谷电价”逻辑类似,本质是通过价格杠杆引导开发者将非实时任务错峰调度,缓解白天算力拥堵问题。[4]

  两款主力模型均有不同幅度调整。轻量版V4 Flash空闲时段输出从2元/百万Token涨至4.5元,涨幅125%;高峰时段输出涨至9元,涨幅350%。旗舰版V4 Pro调整幅度更大:空闲时段输出从6元涨至13.5元(+125%),高峰时段输出飙升至27元(+350%),而缓存命中输入价格在高峰时段涨幅最高,从0.025元升至0.3元,涨幅达1100%。[5][6]

  需要特别说明的是,此次调整并非单一模型的价格上调,而是结构性的计费体系重构。新的峰谷定价不仅影响单次调用的即时成本,更将深刻改变开发者的API使用习惯——是“即时响应优先”还是“成本优先”,成为开发者必须做出的新选择。

  为什么DeepSeek选择在8月17日大幅涨价?

  核心结论:DeepSeek此次涨价的直接原因是需求爆炸式增长带来的算力供给缺口和成本压力,同时也是行业从价格战转向理性商业化的标志性事件。[7]

  DeepSeek官方在8月6日的公告中解释了涨价原因:国内日均Token调用量已达140万亿,较2024年初增长超千倍;DeepSeek V4 Flash单日Token消耗量曾达8万亿,一度超越聚合平台OpenRouter全平台总和,服务器容量已经无法跟上需求。[8]这种极端的需求增速,使得长期维持低价策略变得不可持续。

  供给端的压力同样不可忽视。官方透露,高端AI芯片产能受限、供应链成本持续上涨,算力资源全面趋紧。DeepSeek的推理服务毛利率在长期低价策略下持续承压,涨价是覆盖高昂算力成本的直接手段。[9]

  值得注意的是,这一举动并非孤立事件。早在DeepSeek之前,智谱一季度API定价已提升83%,腾讯云不到一个月内连续两次涨价,Kimi暂停C端订阅。[10]整个行业正从“烧钱换规模”的粗放阶段,转向可持续商业化的精细化运营。高盛也指出,中国AI模型需求持续旺盛、算力资源趋紧,行业竞争正在从早期激进的价格战逐步回归更理性的定价框架。[11]

  从商业逻辑上看,大模型公司与20年前的互联网企业有着本质差异:互联网产品固定成本高、边际成本趋近于零,适合靠免费换规模;而大模型每多一次请求就要消耗GPU算力与电力,调用量越大,成本同步上升。模型公司涨价是行业走向成熟的必要信号,只是短期会带来下游洗牌的阵痛。[12]

  涨价对开发者的成本影响有多大?

  核心结论:以日均处理10万条咨询的智能客服为例,按基准价计算月成本从1200元升至3000元左右,若在高峰时段调用账单还将翻倍,错峰调用和缓存优化成为控制成本的关键手段。[13]

  这次调价对开发者的实际影响,取决于调用时段和模型选择两个维度。从时段维度看,高峰时段的价格是空闲时段的两倍,这意味着同样的工作负载,在上午10点运行和晚上10点运行,成本相差100%。以V4 Pro输出价格为例:高峰时段27元/百万Token,空闲时段13.5元/百万Token,价差一目了然。

  从模型选择维度看,不同档位模型的价差正在拉大。V4 Flash高峰输出9元/百万Token,V4 Pro高峰输出27元/百万Token,前者仅为后者的三分之一。对于简单任务(如文本分类、关键词提取、基础问答),使用V4 Flash即可满足需求而无需调用V4 Pro,这将成为开发者控制成本的重要思路。

  实际的成本测算更加直观:以一个日均处理10万条咨询的智能客服应用为例,假设每次咨询消耗约1000 Token输入和500 Token输出,按此前统一价格计算,月成本约1200元;按新基准价(取高峰与空闲中间值估算),月成本升至约3000元,涨幅约150%。如果该客服业务主要集中在高峰时段运行,账单将再翻一倍,月成本可能超过6000元。[14]

  开发者可以采取哪些应对措施?

  首先是错峰调用。将数据清洗、离线分析、批量处理等时延不敏感的任务转移到夜间或周末运行,可直接节省50%的API调用成本。DeepSeek官方设定空闲时段价格为高峰时段一半,本身就在引导这种调度策略。[15]

  其次是缓存优化。DeepSeek的缓存命中输入价格极低——V4 Flash仅0.05元/百万Token(空闲时段),V4 Pro为0.15元/百万Token(空闲时段)。通过固定System Prompt、分离变量、复用长文档前缀,缓存命中率可达60%-98%,能大幅抵消涨价影响。

  第三是模型路由。简单任务用V4 Flash或开源模型,复杂推理再调用V4 Pro,避免“一刀切”调用造成算力浪费。混合使用不同模型可以根据任务复杂度灵活分配成本,这是大型AI应用普遍采用的成本控制策略。

  V4 Pro正式商用意味着什么?技术底气在哪里?

  核心结论:V4 Pro正式版(版本号0813)已实现App、网页端、API三端同步更新,支持1M上下文和384K最大输出,Agent工作流能力大幅升级,性能逼近国际顶级模型——这是DeepSeek敢于涨价的底气所在。[16]

  V4 Pro从测试版转为正式商用,产品能力同步增强。新模型原生支持OpenAI Responses API与Anthropic API,思考/非思考双模式可切换,Agent工作流能力显著提升。在关键性能指标上,V4 Pro的DeepSWE从预览版12.8飙升至62.7,TerminalBench 2.1拿到87.9分,距全球第一的Claude Fable 5仅差0.1分。[17]

  这组数据传递出的信息很明确:V4 Pro在AI编程和智能体任务上的能力已经站上国际第一梯队,性能逼近顶级是涨价的底气。并且,横向对比国际竞品,即便高峰涨价后,V4 Pro的输出价格仍约为Anthropic Fable 5的1/57,“极致性价比”标签虽被削弱,但相对海外旗舰仍具显著价差。[18]

  从行业信号看,V4 Pro正式商用标志着DeepSeek进入商业化深水区。此前5月,DeepSeek曾将V4 Pro永久下调至原价的25%,以低价策略迅速扩张市场份额。如今随着用户习惯逐渐建立、模型能力得到验证,DeepSeek开始通过涨价优化收入结构,是典型的“先规模后利润”打法。

  技术要点一览

技术/产品核心指标应用场景影响对象限制条件信息来源
V4 Pro正式版(0813)1M上下文、384K最大输出,DeepSWE 62.7,TerminalBench 87.9复杂推理、AI编程、Agent智能体、长文档处理企业开发者、AI应用厂商高峰时段价格较高DeepSeek官方公告[16][17]
V4 Flash(轻量版)高峰输出9元/百万Token,闲时4.5元/百万Token基础问答、文本分类、批量处理、客服机器人个人开发者、中小团队复杂推理能力弱于V4 ProDeepSeek官方定价表[5]
峰谷定价机制高峰时段(9-12时、14-18时)价格=2倍空闲价所有API调用场景全部开发者涉及实时业务需支付高峰溢价DeepSeek调价公告[3][4]
缓存命中机制V4 Pro高峰缓存命中输入0.3元/百万Token,涨幅1100%固定Prompt、长文档复用、对话历史高频调用开发者仅限前缀复用场景DeepSeek官方计价器[6]

  DeepSeek涨价会引发行业跟风吗?

  核心结论:DeepSeek涨价并非孤例,行业性回调已经展开,但跟风力度取决于各家模型的不可替代性——头部模型的涨价空间大于同质化产品。[19]

  DeepSeek调价之前,行业内已现涨价苗头。智谱一季度API定价提升83%;腾讯云在2026年不到一个月内连续两次涨价;Kimi暂停C端订阅。[10]这些案例说明,“算力成本向市场传导”已成为行业共识,而非某家厂商的个体选择。

  但涨价并非没有边界。对于用户而言,涨价是否能被接受,取决于模型性能是否值得更高的价格。DeepSeek V4 Pro在性能逼近顶尖水平的同时,价格仍远低于国际竞品,这就是它的涨价空间所在。相比之下,能力同质化的中小模型若贸然跟涨,可能面临用户流失的风险。

  值得关注的是,资本市场对这一涨价持积极态度。A股DeepSeek概念股在8月13日集体上涨,反映出市场对“推理商业化落地”的认可。[20]涨价不仅仅是成本转嫁,更被解读为模型能力得到验证后的价值回归。

  舆论场的不同声音

  值得注意的是,不同立场对此次涨价存在明显认知差异。支持方认为,算力有真实成本,模型公司涨价是行业走向成熟的必要信号,属于利好[12];反对方则认为,DeepSeek此前以极低价格吸引开发者迁移,培养使用习惯后再大幅涨价,“先抢市场再加价”的套路让开发者有被“套牢”之感。[21]

  也有观点指出,即使涨价后,DeepSeek的价格也远低于海外同级别产品——V4 Pro高峰输出27元/百万Token,约合3.8美元,而Anthropic Fable 5价格约为其57倍。涨价更多是“从极端低价回归正常水平”,而非绝对意义上的“昂贵”。[18]但需明确,这类国际价格对比基于公开数据,具体价格可能随市场波动变化,需以官方实时信息为准。

  DeepSeek接下来还值得用吗?

  核心结论:DeepSeek在涨价后仍是性价比突出的模型之一,关键在于是否将错峰调度、缓存复用和模型路由纳入日常调用策略。

  评估DeepSeek涨价后的使用价值,需要结合具体场景计算综合成本。对于时延敏感的生产环境业务(如在线客服、实时翻译),高峰时段调用不可避免,V4 Pro高峰输出27元/百万Token的价格确实带来了显著成本压力。但对于可以错峰运行的批量任务(如数据分析、报告生成、测试用例构造),利用夜间空闲时段调用,成本可降低50%,性价比优势依然存在。

  对于长文档处理、代码生成等可复用场景,缓存命中策略能大幅拉低实际支出。假设一个文档处理应用的缓存命中率达到80%,以V4 Flash为例,实际成本约为全量缓存未命中计费的20%-50%,整体费用仍然可控。

  本质上,DeepSeek的峰谷定价在抬高成本的同时,也为精细化的成本控制提供了新的杠杆——开发者需要从“不管何时调用都一个价”的粗放模式,转向“按任务优先级分配时段”的精细运营模式。这种转型虽然会增加初期管理成本,但长期看有助于推动AI应用走向更理性的资源利用方式。

  后续关注重点有三个维度

  一是DeepSeek官方是否会根据负载情况调整峰谷时段划分和价格倍数。峰谷定价在电力行业已有成熟实践,但在API服务领域尚属探索,定价模型可能根据实际调度效果而迭代。

  二是竞争对手的跟进策略。智谱、月之暗面、百度等厂商是否会跟进峰谷定价模式,或通过其他方式(如套餐制、阶梯价)调整API定价,将影响整体市场格局。

  三是DeepSeek的算力供给缺口是否逐步缓解。据公开报道,DeepSeek自建智算中心尚未完全交付,两万张H系等效芯片训推共用的局面在短期内难以改变。[17]未来若自建算力投入使用,价格是否会有回调空间,值得持续跟踪。

  QA:开发者最关心的三个问题

  Q1:DeepSeek涨价后,API调用成本到底涨了多少?

  答:取决于调用时段和模型。以V4 Pro输出价格为例,高峰时段从6元/百万Token涨至27元,涨幅350%;空闲时段从6元涨至13.5元,涨幅125%。V4 Flash高峰期输出从2元涨至9元,涨幅也是350%。缓存命中输入涨幅最大,V4 Pro高峰时段达1100%。[5][6]

  Q2:开发者如何降低DeepSeek API的调用成本?

  答:三个有效手段:一是错峰调用,将非实时任务安排在空闲时段运行,成本直接降低50%;二是提高缓存命中率,通过固定System Prompt和复用长文档前缀,缓存命中时输入成本可低至0.05元/百万Token(Flash空闲价);三是模型路由,简单任务用V4 Flash,复杂任务才调V4 Pro。[13][15]

  Q3:DeepSeek涨价后还比国外模型便宜吗?

  答:据公开报道和价格对比,即使涨价后V4 Pro的高峰输出价格(27元/百万Token,约3.8美元)也显著低于Anthropic Fable 5等国际旗舰模型,约为其1/57。[18]但国际模型定价存在动态调整,具体价差需以各厂商官方实时价格为准。


[免责声明]如需转载请注明原创来源;本站部分文章和图片来源网络编辑,如存在版权问题请发送邮件至398879136@qq.com,我们会在3个工作日内处理。非原创标注的文章,观点仅代表作者本人,不代表本站立场。

相关推荐