作者 | 赵芷姗
编辑 | 周伟鹏
这几天超人梁文锋在全网杀疯了!
原本清秀的发言照片,摇身一变成为肌肉猛男,各种跳舞,迎来MVP结算画面。

原因很简单,7月31日发布的DeepSeek V4 Flash,没过几天就在第三方平台OpenRouter上,拿下全球调用量第一。

比它能力强的价格高一大截,比它便宜的能力不够看,短短几天时间,开发者社区就以DeepSeek V4 Flash为线,划分出全球大模型斩杀区。
大家调侃:超过DeepSeek没事,但要是被梁叔叔反超,那就要撞大运了。


同一梯队里价格最低
性能和GLM-5.2并肩
先来看看,DeepSeek V4 Flash有多能打。
它的输入价格仅为Fable 5的1/70,输出价格更是夸张,只有1/178,在全球大模型第一梯队里,没有比它更便宜的了。

离谱的是,第三方平台OpenCode还能把价格压到官方定价的六分之一。
便宜到北京甚至有家酒吧,只要来消费,连上WiFi,就送无限量的 V4 Flash Token。

逼得OpenAI在GPT-5.6 Luna发布不到一个月,就紧急降价80%,然而即使这样,还是比DeepSeek贵一大截,就问奥尔特曼急不急。
更关键的是,能力也不拉胯。
它总参数为284B,动态激活才13B。依靠MoE稀疏架构,它不需要全程调动、全部参数参与运算,配合深度优化的后训练体系,实现了典型的“以小博大”。
第三方测评机构Artificial Analysis显示,综合智能指数上,V4 Flash仅比智谱GLM-5.2低1分,代码指数和智能体指数上则实现反超。
一个激活参数13B的模型,表现比39B参数的GLM-5.2还好,加上碾压级的价格优势,难怪网友直呼“梁圣”。

斩杀线逼近
中端模型迎来生存大考
“斩杀线”听起来有点夸张,但事实已经如此。
V4 Flash用一条清晰的性价比红线,把大模型赛道切割成三个阵营。
顶层的高端模型,Claude Opus 5、GPT-5.6 Sol、Kimi K3这些高端模型,专攻超长文档推理、复杂数理和高阶推演,能力不可替代,贵也有人买单。
底层的低端模型,价格低能力也弱,但在简单任务这个细分赛道上,有它们的优势。
最危险的是,中间的夹心层。
能力不如V4 Flash或者只强一点点,但价格要高一大截,对开发者来说,性价比严重失衡。

同样的业务需求,切换到DeepSeek之后成本大幅下降,体验差距微乎其微甚至更好。
长远来看,这条斩杀线还会持续向外传导。
今后任何新模型一出生就得跟V4 Flash对标,如果能力相近、定价更高,那从一开始就输了。
大模型API持续涨价的时代,正式终结。效率战争,全面开打。
而这,还只是DeepSeek的一款轻量模型。
真正的重头戏在后面:DeepSeek V4 Pro,1.6万亿参数的旗舰,配上自研Harness开发工具链,才是行业真正的大杀器。
等这套组合拳正式亮相,大模型赛道的全面洗牌才算真正开场。

敢定低价的梁文锋
掌管百亿资产,不追求利润最大化
DeepSeek敢抛出如此低的价格,跟梁文锋本人离不开。
前不久曝出的投资人会议纪要里,梁文锋称DeepSeek不追求利润最大化,争取10个月回本就行,曾主动把价格降到1/4。
甚至10个月回本,都还有降价的空间。
在他看来,克制是一种策略,AI市场体量足够庞大,拓宽技术边界才是正事。
作为量化基金幻方量化的创始人,梁文锋管理数百亿资产。
网友调侃,梁叔叔就收点电费,剩下的工作日九点半以后他自有办法。
左手DeepSeek,右手幻方量化,量化赚了钱就研发模型,模型越强量化赚钱越猛,量化赚钱越猛,模型越强,如此形成“梁性循环”。
大家玩梗的背后,是开发者实打实的用脚投票:好用不贵,才是所有人想要的AI。
当大模型不再是烧钱奢侈品,普通人、小创业者都能低成本玩转AI,这条DeepSeek斩杀线,最终惠及的是整个行业与每一个使用者。
•END•
Question. Write.Narrate. Believe. Become a story.易简传媒的愿景是提问和传播商业故事,让读者更开阔,更聪明。有 2500 万微信粉丝关注我们的账号,欢迎大家关注: