2026年8月17日00:00,DeepSeek API新价格正式生效。这是国产龙头模型首次系统性价格上调,涨幅最高的缓存命中输入项达到1100%,输出价格从每百万tokens 6元一路抬到27元。表面看这是一次调价,行业层面的解读却远不止“涨价”两个字:当一家以极致性价比立身的国产模型厂商开始主动定价,说明国产大模型的商业化叙事,正在从“烧钱换规模”切换到“量价齐升的正循环”。
一、价格表里藏着算力成本的真实结构
先把账拆开看V4 Pro的调整分三个维度:输入(缓存未命中)从3元涨到9元,涨幅200%;输出从6元涨到27元,涨幅350%;缓存命中输入从0.025元涨到0.3元,涨幅1100%。三档涨幅差异本身就是重要信息——输出涨幅最大,直接指向推理成本的结构性事实:大模型的算力消耗主要发生在生成阶段,输出token越多成本越高,此前“输出只比输入贵一倍”的定价明显偏离了真实成本曲线。缓存命中输入虽涨幅惊人,绝对价格依然只有0.3元,说明DeepSeek真正想治理的不是“缓存用户”,而是那些让缓存命中率过低的调用方式。V4-Flash的调整遵循同一逻辑:缓存命中输入从0.02元涨到0.1元(+400%)、未命中输入从1元涨到3元(+200%)、输出从2元涨到9元(+350%),整体梯度与Pro保持一致,只是绝对价格更低,保留了低价走量的产品定位。
二、峰谷定价:把电力行业的智慧搬进AI算力
这次调价最值得玩味的机制创新,是峰谷定价。高峰时段锁定在北京时间9:00-12:00、14:00-18:00——恰好是上班族调用API最密集的窗口,空闲时段价格直接腰斩。这套机制几乎就是电力行业“峰谷电价”的翻版:算力中心本质上与电网同构,都存在刚性供给与潮汐需求的错配。白天峰值时段的算力是稀缺资源,夜晚空闲时段的算力则是沉没成本。DeepSeek通过价格杠杆,把一部分需求主动引导到空闲时段,既缓解高峰期的算力压力,又让低谷期的闲置算力产生收入。对成本敏感的开发者来说,错峰调度从此从“可选项”变成“省钱项”;对厂商而言,则在不扩容的前提下实现了算力利用率的再平衡——这是比单纯涨价精细得多的运营策略。
三、提价的底气:推理需求超预期,算力供给偏紧
招商证券国际在调价落地当天给出判断:此举验证推理需求超预期、算力供给偏紧的现实,也为后续国产模型提价打开了空间。这个判断值得展开。一方面,Agent应用的爆发让推理调用量从“人问模型答”的线性模式,变成“模型自主循环调用工具”的复合模式,单个任务的token消耗指数级增长,推理需求曲线远比供给曲线陡峭。另一方面,高端算力供应链的约束客观存在,算力扩张速度追不上需求增速时,价格机制就会自动介入——这恰恰说明市场已从“供给过剩、价格战”走向“供给偏紧、定价权回归”。DeepSeek敢在发布V4 Pro正式版仅五天后就调整价格,底气正来源于对需求弹性的判断:核心用户对能力升级的付费意愿,足以覆盖价格上调带来的流失风险。
四、对开发者生态的三重影响
第一重,应用层成本模型被迫重构。此前按“输入3元、输出6元”测算的Agent应用,如今高峰时段输出成本直接翻数倍,依赖高频调用的大规模Agent应用必须重新评估单位经济模型,错峰调度、缓存优化、模型路由(简单任务走Flash、复杂任务走Pro)会成为标配工程能力。第二重,缓存命中的经济价值被放大。缓存命中输入0.3元与未命中9元之间30倍的价差,让“缓存友好型”设计从优化项变成硬约束,提示词模板化、上下文复用将成为省钱的关键手段。第三重,开源与闭源的性价比天平重新摆动。当API输出涨到27元时,本地部署的开源模型在隐私、成本与可控性上的吸引力上升,尤其是对调用量稳定的中小团队而言,“自己部署”与“按量付费”的临界点被大幅前移。
五、拐点判断:低价普惠时代终结,正循环开启
把时间线拉长看DeepSeek的涨价并非孤立事件。8月12日晚V4 Pro正式版上线时定价还是“输入3元、输出6元”,五天之后即调整到新方案,节奏之快说明市场反馈来得比预期更强烈。作为国产开源模型的旗帜厂商,DeepSeek主动结束“绝对低价普惠”时代,释放的信号是明确的:国产大模型已经过了用价格换流量的阶段,接下来要比的是谁能在合理价格上提供足够强的能力与生态。对行业而言,这其实是健康信号——只有厂商赚到钱,才有持续投入算力与研发的资本,开发者才能获得更稳定、更长期的服务。涨价不是终点,而是国产大模型走向成熟商业化的起点。
本文仅代表作者个人观点(仅供参考) 来源:创客OPC原创整理