8 月 7 日消息,DeepSeek 通过后台通知方式告知开发者,计划在近期整体上调 API 服务定价,且预计涨幅较大。这距离其推出高峰时段价格翻倍的峰谷定价机制仅过去不久。与此同时,V4-Flash 正式版发布仅一周,调用量已升至全球第一:OpenRouter 周榜显示其周调用量达 7.22 万亿 Token,单日调用量一度冲上 8 万亿。公司持有约两万张 H 系等效芯片、训推共用,此番涨价被业内解读为重新分配算力资源的前置动作,也有分析认为与即将上线的 V4-Pro 正式版密切相关。
一、涨价通知:幅度大、节奏紧
据多位开发者反馈,DeepSeek 已通过后台站内通知的方式预告 API 定价上调,官方措辞为“计划近期整体上调”,并强调“预计涨幅较大”。这种先通知、后调价的做法,与以往主要依赖公开公告的节奏有所不同。选择后台触达,一方面可以精准覆盖高频调用方,让长期依赖 API 的开发者第一时间获得信息;另一方面也意味着涨价可能很快落地,留给开发者迁移方案或调整调用量的窗口有限。目前官方尚未披露具体调价幅度与生效时间,新一轮价格表仍有待后续公告确认。对于正把业务跑在 DeepSeek API 上的团队而言,这无疑是一个需要立刻评估成本冲击的信号。
二、峰谷定价刚刚落地
值得注意的是,DeepSeek 此前刚刚推出高峰时段价格翻倍的峰谷定价机制:在调用高峰期按更高单价计费,低谷时段维持原有价格,以引导流量错峰、平抑瞬时算力压力。如今在峰谷定价的基础上再度整体上调,说明单纯依靠时段价差已经不足以缓解算力供需矛盾,平台需要在更大范围内提高单位算力的收入水平,才能支撑持续扩大的推理需求。从产品逻辑看,峰谷定价解决的是“时间维度的错峰”,而整体涨价解决的是“总量维度的供需缺口”,两者叠加,反映出 DeepSeek 对当前算力紧张局面的判断正在加深。
三、V4-Flash 一周登顶:7.22 万亿 Token 周调用量
涨价之所以引发广泛讨论,与 V4-Flash 的爆发式增长直接相关。该模型正式版发布仅一周,调用量便升至全球第一。OpenRouter 周榜数据显示,V4-Flash 周调用量达到 7.22 万亿 Token,单日调用量一度冲上 8 万亿,远超同期其他头部模型。如此规模的需求集中涌入,直接导致接口频繁出现超时与排队现象,用户体验受到影响的同时,也暴露出单一大模型爆款对算力资源的巨大虹吸效应。对 DeepSeek 而言,这既是市场认可的标志,也是运维压力与成本压力陡增的起点:调用量越大,单位时间内消耗的算力与电力就越多,平台必须为持续增长的需求找到可持续的财务模型。
四、算力底座:约两万张 H 系等效芯片训推共用
支撑如此大规模调用的,是 DeepSeek 的算力家底。据公开信息,公司持有约两万张 H 系等效芯片,且采用训练与推理共用的架构设计——同一批硬件既要支撑模型训练迭代,又要承接全球规模的推理流量。训推共用的好处是资源利用率高、资金投入更集约,但代价是高峰时段算力弹性有限:一旦某个模型成为爆款,推理请求的骤增会挤压训练资源,模型迭代节奏也可能因此放缓。从这个角度看,涨价并非简单的“收割开发者”,而更接近一种算力资源再分配的信号——通过价格杠杆把需求引导到低谷时段,并为训练任务与新模型上线预留空间。
五、业内分析:涨价或为 V4-Pro 正式版铺路
业内普遍认为,此番调价大概率不是孤立事件。一方面,DeepSeek 手中约两万张等效 H 系芯片决定了其产能存在硬上限,在训推共用模式下,必须用价格手段平衡需求与供给;另一方面,市场传闻 V4-Pro 正式版即将上线,更高阶的模型往往意味着更大的推理成本与更高的算力占用,提前上调 API 价格,既能为新模型的推理预留算力预算,也能在 Pro 版上市前完成价格体系的重置,避免短期多次调价带来的舆论压力。若 V4-Pro 如期推出,开发者或将迎来“性能更强、单价更高”的新阶段,届时峰谷定价与整体涨价共同构成的价格体系,也会更直接地作用于用户的用量策略。
本文仅代表作者个人观点(仅供参考)
来源:创客OPC原创整理
参考来源:腾讯研究院AI速递