7月31日下午,DeepSeek悄悄在API文档里更新了一行日志:V4-Flash正式版,公测了。
没有发布会,没有倒计时海报,甚至APP和网页端都没动。但消息传开后,全球AI开发者圈炸了锅。原因很简单——这个版本的跑分,已经逼近了全球最贵的顶级模型,而价格只有对方的零头。
一、数据说话:便宜60%,性能只差1分
据IT之家8月1日报道,国际独立AI基准测试机构Artificial Analysis的最新跑分显示:DeepSeek V4 Flash 0731的智能指数(AII)拿到50分,而OpenAI的GPT-5.6 Luna最高51分。只差1分。
但价格呢?即使OpenAI在8月1日当天紧急把GPT-5.6 Luna的价格下调了80%,DeepSeek V4 Flash在自家API上的单任务成本,仍然比GPT-5.6 Luna低约60%。
秘密在于一个数字:98%的缓存命中折扣。行业大多数厂商给的是90%,DeepSeek直接拉到98%。别小看这8个百分点——对于需要反复调用AI的日常场景,省下来的就是真金白银。
观察者网旗下风闻社区的开发者评价更直白:"几亿token才几块钱。"
二、实测:40秒干完,顶级模型要1分47秒
跑分是实验室的,实测才是真功夫。
据《每日经济新闻》8月1日报道,AI深度开发者张泽第一时间把V4-Flash正式版接入了工作流。同样的任务、同样的提示词,V4-Flash配合Hermes用了大约40秒完成,而GPT-5.6 Sol配合Codex用了1分47秒。
张泽的原话很中肯:"Codex的输出质量确实更高一些,但V4-Flash的交付达到了可用水平,在及格线之上。"
另一个开发者孙涛的反馈也很实在:"在国内模型里,它比GLM 5.2好一些,但比GPT 5.6还差一些。"
而在Agent智能体终极测试中,V4-Flash正式版拿到25.2分,接近Anthropic旗舰模型Opus-4.8的25.7分,远超自家V4-Pro预览版的15.8分。这个提升幅度,不是挤牙膏,是换代。
三、普通人怎么用?你不需要会写代码
看到这里你可能觉得:API、token、缓存命中——这些词跟我有什么关系?
关系大了。
AI模型降价的连锁反应是:越来越多平台开始把便宜又好用的大模型接入自己的产品,最终用户只需要打开一个界面、说一句话,就能享受到和顶级模型几乎一样的效果。
我自己日常用的spark1就是典型例子。它把94个AI工具整合在一个入口里,你不需要去研究哪个模型API更便宜、哪个接口支持什么格式。打开工具链,选一个任务类型——写文案、做PPT大纲、分析数据、生成图片——背后的模型调度它帮你做了。DeepSeek V4 Flash这种"又快又便宜"的模型,恰恰是这类平台最喜欢接入的:成本低了,平台才舍得让你免费用、反复用。
更关键的是,spark1的工具链DAG(有向无环图)功能,可以让你把多个AI工具串起来。比如:先用DeepSeek V4 Flash写初稿,再用AIGC工具生成配图,最后用排版工具出成品。三步变一步,全程不用切换窗口。
四、一句话总结
AI行业正在从"谁拥有更多算力"转向"谁能让算力真正产生价值"。DeepSeek这次掀桌子,受益的不是投资者,是每一个打开AI工具就能干活的普通人。
别等"完美模型"了。现在够用、现在便宜、现在就能上手——这才是AI普惠该有的样子。
AI实操教练——不讲道理,只教你做。
🔧 免费体验DeepSeek V4 Flash同款低成本AI能力 → https://spark1.cn/tools
💬 你用过DeepSeek V4 Flash吗?体验如何?评论区聊聊。
📌 关注公众号「xAI智工场」,回复"提示词",免费领取10个高频场景AI提示词模板包。
💬 评论