7月31日下午,DeepSeek悄悄在API文档里更新了一行日志:V4-Flash正式版,公测了。
没有发布会,没有倒计时海报,甚至APP和网页端都没动。但消息传开后,全球AI开发者圈炸了锅。原因很简单——这个版本的跑分,已经逼近了全球最贵的顶级模型,而价格只有对方的零头。
一、数据说话:便宜60%,性能只差1分
据IT之家8月1日报道,国际独立AI基准测试机构Artificial Analysis的最新跑分显示:DeepSeek V4 Flash 0731的智能指数(AII)拿到50分,而OpenAI的GPT-5.6 Luna最高51分。只差1分。
但价格呢?即使OpenAI在8月1日当天紧急把GPT-5.6 Luna的价格下调了80%,DeepSeek V4 Flash在自家API上的单任务成本,仍然比GPT-5.6 Luna低约60%。
秘密在于一个数字:98%的缓存命中折扣。行业大多数厂商给的是90%,DeepSeek直接拉到98%。别小看这8个百分点——对于需要反复调用AI的日常场景,省下来的就是真金白银。
观察者网旗下风闻社区的开发者评价更直白:"几亿token才几块钱。"
二、实测:40秒干完,顶级模型要1分47秒
跑分是实验室的,实测才是真功夫。
据《每日经济新闻》8月1日报道,AI深度开发者张泽第一时间把V4-Flash正式版接入了工作流。同样的任务、同样的提示词,V4-Flash配合Hermes用了大约40秒完成,而GPT-5.6 Sol配合Codex用了1分47秒。
张泽的原话很中肯:"Codex的输出质量确实更高一些,但V4-Flash的交付达到了可用水平,在及格线之上。"
另一个开发者孙涛的反馈也很实在:"在国内模型里,它比GLM 5.2好一些,但比GPT 5.6还差一些。"
而在Agent智能体终极测试中,V4-Flash正式版拿到25.2分,接近Anthropic旗舰模型Opus-4.8的25.7分,远超自家V4-Pro预览版的15.8分。这个提升幅度,不是挤牙膏,是换代。
三、普通人怎么用?你不需要会写代码
看到这里你可能觉得:API、token、缓存命中——这些词跟我有什么关系?
关系大了。
AI模型降价的连锁反应是:越来越多平台开始把便宜又好用的大模型接入自己的产品,最终用户只需要打开一个界面、说一句话,就能享受到和顶级模型几乎一样的效果。
我自己日常用的spark1就是典型例子。它把98个AI工具整合在一个入口里,你不需要去研究哪个模型API更便宜、哪个接口支持什么格式。打开工具链,选一个任务类型——写文案、做PPT大纲、分析数据、生成图片——背后的模型调度它帮你做了。DeepSeek V4 Flash这种"又快又便宜"的模型,恰恰是这类平台最喜欢接入的:成本低了,平台才舍得让你免费用、反复用。
更关键的是,spark1的工具链DAG(有向无环图)功能,可以让你把多个AI工具串起来。比如:先用DeepSeek V4 Flash写初稿,再用AIGC工具生成配图,最后用排版工具出成品。三步变一步,全程不用切换窗口。
四、“斩杀线”到底斩的是什么?
“斩杀线”本来是游戏术语:Boss血量一旦跌破这条线,一套技能直接带走。去年年底这个词出圈,被用来形容普通人财务的脆弱时刻;而今年8月,网友把它送给了AI行业——DeepSeek成了大模型的“斩杀线”。
它斩的不是某个对手。新浪科技8月3日的分析说得明白:斩掉的是调用旗舰模型前“不计成本”的习惯——当一个便宜几十倍的模型能完成绝大多数任务,昂贵的模型就必须证明,那一点点领先值不值几十倍的差价。
这已经不是观点,是正在发生的事。OpenRouter的周度数据显示,DeepSeek V4 Flash冲上了平台调用量榜首,全球开发者正把生产环境的推理流量成规模地迁过去。凤凰科技的评论标题很直接:《口碑持续逆转,DeepSeek成全球AI斩杀线》。
对普通人来说,这意味着一句话:用AI的门槛,被斩到了历史最低。模型价格战的每一刀,最终都会折算成你能摸到的免费额度和低价积分。这也是我们反复说的那句——这波红利不在资本市场,在每一个打开AI就能干活的人手里。
五、一句话总结
AI行业正在从"谁拥有更多算力"转向"谁能让算力真正产生价值"。DeepSeek这次掀桌子,受益的不是投资者,是每一个打开AI工具就能干活的普通人。
别等"完美模型"了。现在够用、现在便宜、现在就能上手——这才是AI普惠该有的样子。
AI实操教练——不讲道理,只教你做。
🔧 免费体验DeepSeek V4 Flash同款低成本AI能力 → https://spark1.cn/tools
💬 你用过DeepSeek V4 Flash吗?体验如何?评论区聊聊。
📌 关注公众号「xAI智工场」,回复"提示词",免费领取10个高频场景AI提示词模板包。
💬 评论