导航菜单
首页 服务 OPC项目 AI资讯 AI应用市场 OPC市场 OPC导航 工具推荐 关于 OPC城市 北京OPC 上海 广州 深圳 杭州 注册指南 OPC完全指南 AI副业
⚡ 创客OPC ← 返回资讯
DeepSeek Flash系列9月10日降价:闲置时段输出4元/百万Token,缓存命中砍六成

9月9日,DeepSeek开放平台发布公告:自北京时间2026年9月10日12时起,Flash系列模型调用价格整体下调,采用空闲与高峰分时计费。这是距离8月中旬那轮大幅涨价不到一个月后的反向调整,也是开发者成本账本上一次值得记录的变动。

一、具体调价

如果把这轮调价放进更长的时间线看,它的信号意义大于一次单纯的降价:8月涨价说明DeepSeek需要在算力压力下筛选客户、优先服务高价值负载,9月回调则说明它不希望把价格敏感型的长尾开发者推走。对一家仍处扩张期的模型公司来说,这两件事并不矛盾;创业者真正需要读懂的是价格背后的算力供给节奏——什么时候该错峰、什么时候该囤缓存,都能从调价公告里看出端倪。

:三档全线下调,缓存命中最狠

本轮覆盖deepseek-v4-flash与deepseek-v4-flash-vision-exp两款模型,执行同一标准。空闲时段(工作日周一至周五9:00—12:00、14:00—18:00之外)单价:输入缓存命中由0.05元降至0.02元,降幅60%;输入缓存未命中由1.5元降至1元,降幅33.33%;输出由4.5元降至4元,降幅11.11%。

高峰时段价格为空闲时段的两倍:输入缓存命中0.04元、未命中2元、输出8元。对比调整前,高峰档输入缓存命中由0.1元降至0.04元,未命中由3元降至2元,输出由9元降至8元。也就是说,缓存命中这一项在高峰档也直接腰斩以上。

二、背景:这更像对8月涨价的局部回调

8月13日,DeepSeek随V4 Pro正式版上线同步宣布API涨价,引入峰谷定价,V4 Pro高峰缓存命中输入一度从0.025元拉到0.3元,涨幅被外界称为最高11倍;V4 Flash高峰输出也从2元涨到9元。当时大量开发者反馈「高峰没有性价比」。

与8月涨价前相比,本次Flash系列空闲时段的缓存命中输入已回到0.02元、未命中输入回到1元,等于把涨价前的水平拉了回来;但输出价格仍停留在4元,较涨价前2元高出一倍。因此这次动作更接近于对上一轮涨价的部分回调,而非全面回到原价。

降价的另一根引线是新模型内测。9月8日,DeepSeek在官方群宣布v4.1 flash中间版本内测,称其结构更新、原生多模态、能力更强速度更快且成本更低;首批开发者反馈速度变快但「烧钱也更快」。一天后,Flash系列调价正式落地。

从行业节奏看,这已经是国产模型年内又一次成规模的调价窗口。头部厂商竞争的焦点,正从「谁的参数更强」转向「谁的边际成本更低、谁的开发者账单更友好」。对把模型当作水电一样按量付费的创业者而言,多一个愿意把价格打下来的厂商,就多一份议价筹码;而议价能力最终会传导到产品定价上,让AI应用的毛利空间不至于被模型成本吃掉。

三、对创业者的成本账:谁省得多、谁省得少

有开发者按自身Agent工作流估算,综合调用成本可能下降约40%,但实际降幅取决于缓存命中率与输入输出Token占比。对一人公司更现实的计算公式是:缓存命中率越高,省钱越明显。

典型场景——夜间在空闲时段跑一个任务,消耗100万Token输入(未命中)加100万Token输出,老价1.5+4.5=6元,新价1+4=5元,省1元约16.7%。若调用量到千万、亿级,差额会摊大。真正大头的省法在缓存命中场景:客服机器人答常见问题、文档总结复用固定提示词、长对话重复系统指令,这类任务命中率高的工作流,单位成本下降可观。

更值得算的是年化账。假设一个两人团队运营的问答类Agent每天产生200万Token输出且全部落在空闲时段,按新价4元/百万Token计,单日输出成本约8元,一个月约240元;同样用量若按8月涨价后的4.5元/百万Token计,一个月约270元,降幅约一成。真正的大头其实在缓存命中:提示词固定、知识库预热充分的工作流,输入侧命中率可以做到很高,这一项单价从0.05元砍到0.02元,省下来的钱往往能占到整体账单的两到三成。换句话说,调价公告里的数字各有含义——输出降价人人看得见,缓存降价才是懂行的人真正在抢的便宜。

DeepSeek仍用价格信号引导错峰:高峰是工作日的上午和下午两段,其余时间便宜。开发者把不急的批量任务挪到晚上或周末,能直接吃到低价。8月23日起,平台已把周六周日全天统一为低谷价,周末跑批处理是最优解之一。

四、站在创业者视角看这次调价

对一人公司而言,Flash系列的定位是「够用且便宜的干活模型」,不是冲榜旗舰。输出4元/百万Token的空闲价,意味着你可以把大量检索、摘要、初稿、分类类任务放心交给它跑,试错成本被压到很低。

但要注意两点:一是峰谷价差一倍,产品若面向实时用户,高峰调用成本会翻倍,架构上应把可延迟任务异步化;二是输出价仍比8月前高,长期成本不能按「白菜价」预期规划。把缓存命中率做高(固定系统提示、复用上下文、摘要去重),是比等降价更可控的降本动作。

把话再说透一点:这轮降价对创业者最大的意义,不是每百万Token省下几毛钱,而是DeepSeek用价格证明「小成本试错」的窗口依然开着。当输出价停在4元、比涨价前仍高一倍时,理性的做法是把Flash当作批处理与后台任务的默认引擎,把需要实时交互、对延迟敏感的前台场景交给更高规格的模型,或者用缓存设计把成本压下来。峰谷价差存在一天,异步化就是一天的必修课;把任务队列、缓存预热、错峰调度写进产品架构,比盯着每一次调价公告更值钱。

*本文仅代表作者个人观点(仅供参考)* 来源:创客OPC原创整理
微信搜一搜「北京安迪哥OPC」
上一篇
经济日报直问"一人公司":批量涌现的OPC,是政策红利还是可...
下一篇
Meta 首款个人智能体 Muse 上线:交代一句目标,它替...
需要落地支持?

从网站 / 小程序开发到 AI 工具链企业培训,提供全栈交付与落地方案;也可以先看看一个人如何用 AI 工具链撑起专业级交付。本页内容整理的是一线实践,具体项目按需评估。

查看服务与报价 → AI 工具链 + FDE 实战 →