DeepSeek-V4-Flash正式版发布:逼近GPT-5.6 Luna,成本仅其40%
7月31日,DeepSeek通过API文档发布日志,宣布DeepSeek-V4-Flash正式版上线公测。仅隔一天,Artificial Analysis和Arena.ai两大国际评测平台同步更新了该模型的基准测试结果:Artificial Analysis智能指数给出50分,距离OpenAI旗舰级模型GPT-5.6 Luna的51分只有1分之差;而在成本端,即便OpenAI已经对GPT-5.6 Luna大幅降价,DeepSeek-V4-Flash在自有API上的单任务成本仍比前者低约60%——也就是说,用户只需要付出约四成的价格,就能买到接近顶级的智能水平。"性能逼近、价格击穿",一场教科书式的竞争正在全球AI市场重演。
一、正式版上线:从公测到转正
据第一财经资讯AI周报报道(https://www.163.com/dy/article/L3ALO4UV0519DDQ2.html),7月31日,DeepSeek通过官方API文档发布日志宣布DeepSeek-V4-Flash正式版上线公测。这标志着这款轻量级模型从测试阶段正式进入规模化商用阶段。作为DeepSeek产品矩阵中主打高性价比的"Flash"序列,V4-Flash延续了该系列"快、省、稳"的定位,与旗舰Pro版本形成高低搭配:旗舰Pro版本在代码、复杂智能体任务等场景对标海外顶级闭源模型,而Flash版本则以更低的调用成本覆盖高频、大规模的业务场景。央视新闻在报道OpenRouter最新一周AI大模型调用量榜单时指出(https://www.toutiao.com/article/7669247907219997227),榜单排名前五的产品全部由中国企业研发,其中第二、第五名均来自DeepSeek,两款模型形成高低搭配、覆盖不同开发需求,反映出市场对DeepSeek产品组合的高度认可。
二、智能指数50分:与GPT-5.6 Luna仅差1分
正式版上线后,Artificial Analysis和Arena.ai两大评测平台同步更新了DeepSeek-V4-Flash的基准测试结果。据AI周报披露(https://www.163.com/dy/article/L3ALO4UV0519DDQ2.html),Artificial Analysis智能指数显示,DeepSeek-V4-Flash获得50分,比今年4月发布的Flash版本高出整整10分,能力提升幅度显著。更值得关注的是,这一分数仅比OpenAI的GPT-5.6 Luna(51分)低1分——在全球头部模型贴身缠斗的当下,1分之差几乎可以视为同一梯队。这意味着,过去"中国模型只能靠低价换市场"的印象正在被改写:在智能水平上,国产开源模型已经摸到了闭源巨头的天花板。
三、98%缓存命中折扣:成本仅为GPT-5.6 Luna的40%
如果说50分是DeepSeek-V4-Flash的"面子",那么成本控制就是它的"里子"。AI周报的点评给出了一个惊人结论:即使OpenAI已将GPT-5.6 Luna价格下调80%,DeepSeek-V4-Flash在自有API上的单任务成本仍比前者低约60%。换算下来,完成同等任务,用户为DeepSeek-V4-Flash支付的费用只有GPT-5.6 Luna的约四成。成本优势的关键密码,是DeepSeek提供了约98%的缓存命中折扣,远超业内普遍的90%。在高频重复任务场景下,缓存命中意味着大量输入Token无需重新计算,成本被成倍压缩。新浪网的分析文章也印证了行业趋势(https://k.sina.com.cn/article_7879996023_1d5af327706801l89c.html):近期OpenAI重磅官宣GPT-5.6 Luna单价暴跌80%,每百万Token从1美元降至20美分,打破了海外高端模型的定价壁垒;而智谱、DeepSeek、Kimi等国内主流模型在两年内整体价格降幅超90%,API调用费几乎被打成"白菜价"。当价格不再是门槛,模型能力的细微差距就会被放到聚光灯下审视,这对所有厂商都是全新的考验。
四、Arena.ai同步更新:两大平台背书的"性价比之王"
与Artificial Analysis同步,Arena.ai也在正式版上线次日更新了DeepSeek-V4-Flash的基准测试结果(https://www.163.com/dy/article/L3ALO4UV0519DDQ2.html)。作为基于真实用户盲测投票的主流竞技场平台,Arena.ai的结果直接反映开发者与普通用户在实际对话中的体感体验。两大平台同一天给出更新,本身就释放出强烈信号:DeepSeek-V4-Flash不仅纸面分数过硬,实际使用体验也经得起检验。综合两大平台数据,行业共识正在形成——DeepSeek-V4-Flash是当前"性能-价格比"最高的模型之一:以一线梯队的智能表现,配上一线以下的价格,让"用顶级模型做业务"从大厂的专利变成了中小团队的日常。
五、行业格局:国产模型加速迭代,价格雪崩重塑市场
DeepSeek-V4-Flash的发布,只是国产大模型密集迭代的一个缩影。中信建投证券研报指出(https://www.163.com/dy/article/L3AIC0NO05198UNI.html),国产模型加速迭代,GLM-5.2、Kimi K2.7 Code等持续强化长上下文、长程Agent与真实工程交付能力,推动国产模型从通用问答转向开发者工具和企业级工作流;DeepSeek融资则强化了头部模型产业化预期。从OpenRouter调用量榜单到Artificial Analysis智能指数,从央视新闻的关注到券商研报的背书,中国开源模型正在打破海外厂商的生态壁垒,在完全市场化的第三方渠道实现领先。而对整个行业而言,价格雪崩带来的连锁反应更为深远:基础大模型加速"水电煤"化,利润向应用层与算力基础设施转移,谁能把模型做成又好又便宜的基础设施,谁就能在新一轮格局洗牌中占据主动。
结语
1分之差,40%的成本——这是DeepSeek-V4-Flash给2026年夏天留下的注脚。它证明了一件事:在AI赛道上,"性能"与"价格"不再是二选一的单选题。当中国开源模型以极致性价比击穿美国闭源巨头的高价护城河,用户不再愿意为那20%的差距支付10倍的价格。对于开发者而言,这意味着可以用更低的成本验证更多的想法;对于行业而言,这意味着竞争的主战场正在从"比谁模型更强"转向"比谁落地更扎实"。DeepSeek-V4-Flash已经交卷,接下来,轮到整个市场回答:当顶级智能变得触手可及,我们究竟能用它创造什么。