AI推理成本断崖式下跌:OpenAI降价80%,DeepSeek缓存命中率98%的降维打击
2026年8月的第一个周末,AI行业发生了一件足以改写定价规则的事:OpenAI宣布旗舰级模型GPT-5.6 Luna单价暴跌80%,每百万token从1美元直降至20美分。几乎同一时间,DeepSeek-V4-Flash正式版上线公测,并以约98%的缓存命中折扣机制,将同等任务的单次调用成本压到比OpenAI还低60%。当全球开发者还在为"模型越强越贵"的旧逻辑买单时,一场由成本驱动的"降维打击"已经悄然打响。
一、OpenAI的"断腕":GPT-5.6 Luna为何降价80%
过去一年,海外高端模型的定价壁垒几乎坚不可摧。然而近期OpenAI重磅官宣,GPT-5.6 Luna每百万token价格从1美元降至20美分,降幅高达80%,直接打破了高端模型的价格天花板(来源:新浪网《AI大模型暴利时代终结,降价90%谁是赢家?》,https://k.sina.com.cn/article_7879996023_1d5af327706801l89c.html)。
这次降价并非简单的促销,而是战略性的市场防御。一方面,GPT-5.6系列本身被定位为"更低的成本、更强的智能体执行能力、更贴合专业工作流"的产品矩阵,旗舰版Sol、均衡版Terra、低成本版Luna各司其职,框架重心已经从"刷榜"转向"让企业用得起的规模化部署"(来源:AI Agent Hub《AI & Tech Daily Brief (2026-08-02)》,https://kuoo.uk/en/blog/openclaw-daily-2026-08-02)。另一方面,OpenAI的财报压力也在倒逼其调整策略:尽管7月年化经常性收入(ARR)仍在走高(来源:网易《AI周报|DeepSeek-V4-Flash正式版来了,扎克伯格高调支持开源模型》,https://www.163.com/dy/article/L3ALO4UV0519DDQ2.html),但面对开源阵营的步步紧逼,降价保量已是不得不做的选择。
二、DeepSeek的"杀招":98%缓存命中折扣意味着什么
如果说OpenAI的降价是主动让利,那么DeepSeek的定价策略则是一次精准的技术降维。7月31日,DeepSeek通过API文档发布日志宣布V4-Flash正式版上线公测;仅隔一天,Artificial Analysis和Arena.ai两大AI评测平台同步更新基准测试结果,V4-Flash的智能指数得分50分,仅比OpenAI GPT-5.6 Luna的51分低1分(来源:网易《AI周报|DeepSeek-V4-Flash正式版来了,扎克伯格高调支持开源模型》,https://www.163.com/dy/article/L3ALO4UV0519DDQ2.html)。
真正的杀招在价格端。DeepSeek为V4-Flash提供了约98%的缓存命中折扣,而业内普遍的折扣水平只有90%左右。所谓缓存命中,就是当用户重复调用相同或相似的输入前缀时,模型可以直接复用已计算的中间结果,大幅节省推理算力。98%的折扣意味着:在典型的多轮对话、Agent工作流和代码补全场景中,缓存命中的那部分Token几乎可以忽略不计。叠加这一机制后,即使OpenAI已将GPT-5.6 Luna降价80%,DeepSeek-V4-Flash在自有API上的单任务成本仍比前者低约60%(来源:同上)。
三、成本曲线的拐点:从"信仰定价"到"业绩定价"
如果把时间拉长,这轮降价只是行业大趋势的一个缩影。国产模型在两年内整体价格降幅已超过90%,API调用费几乎被打成"白菜价";开源模型凭借极致性价比,让用户能以极低价格调用达到80%效果的模型,不再愿意为那20%的差距支付10倍的价格(来源:新浪网《AI大模型暴利时代终结,降价90%谁是赢家?》,https://k.sina.com.cn/article_7879996023_1d5af327706801l89c.html)。
背后是三重力量共同作用的结果:其一,技术壁垒被快速填平,开源模型遍地开花,同质化竞争的唯一武器就是降价;其二,资本回归理性,不再为"概念"买单,纯靠堆参数、炒热度的模式失去溢价底气;其三,大模型的边际成本并不为零,算力成本不会随用户增加而下降,规模效应下的利润空间被逐步压缩。行业正从靠PPT讲故事拿融资的"信仰定价"阶段,切换到必须看财报、拼落地的"业绩定价"阶段(来源:同上)。
四、谁在受益:开发者、企业与整个生态
成本雪崩的直接受益者,是海量的开发者和中小企业。OpenRouter最新一周的全球调用量榜单显示,排名前五的AI大模型全部由中国企业研发,其中登顶的小米MiMo-V2.5单周调用量达10.5万亿Tokens,下载模型的用户主要是独立个人开发者、三五人规模的初创团队,以及专注AI编程、智能体工具开发的中小厂商——正是"低廉的推理成本和稳定的智能体运行能力"精准匹配了他们的需求(来源:今日头条/央视新闻《视频丨领跑全球榜单!中国AI大模型的优势在哪里?》,https://www.toutiao.com/article/7669247907219997227)。
对企业而言,这意味着AI应用的商业模式正在被重写:过去推理成本高企,Agent类产品只能停留在Demo阶段;如今98%的缓存折扣叠加90%+的降幅,使得"每次任务几分钱"成为可能,长程智能体、批量文档处理、个性化推荐等场景终于可以规模化落地。中信建投研报也指出,国产模型正从通用问答转向长上下文、Agentic Coding和真实工程交付,模型可用性提升有望带动开发者调用与企业侧试用恢复(来源:网易/智通财经《中信建投:国产模型加速迭代 算力景气度持续》,https://www.163.com/dy/article/L3AIC0NO05198UNI.html)。
五、未来展望:AI普惠时代才刚刚开始
当然,降价不等于免费,更不意味着行业进入"零利润"的至暗时刻。利润正在向上游算力基础设施和下游应用层转移——基础模型逐渐"水电煤"化,而真正的高额回报来自结合实体行业、解决真实痛点的垂直应用(来源:新浪网《AI大模型暴利时代终结,降价90%谁是赢家?》,https://k.sina.com.cn/article_7879996023_1d5af327706801l89c.html)。可以预见,接下来会有更多海外企业像Coinbase、爱彼迎一样接入中国大模型以降低成本,国产AI正从"跟跑者"变成"掀桌者"。
结语
OpenAI的80%降价是巨头面对竞争的姿态调整,DeepSeek的98%缓存命中折扣则是技术效率对商业模式的彻底重构。当推理成本不再是制约因素,AI应用的想象力才真正被打开——"暴利时代"的终结不是AI的终点,而是技术成熟并开始惠及大众的起点。对于开发者和企业来说,现在正是把AI从"尝鲜"推向"生产"的最好时机。