

AI圈出了一个平静的疯子。

梁文锋大概没想到自己会火到今天这个地步。
最近各种有关他的AI图片非常出圈,大致长这样:

图源:抖音网友AI生成
图里的他,造型还是网上最流传的那样子,但做了些漫画化处理,整体画面充满张力。
你可能很难相信,现在在海外开发者眼中,梁文锋大概就是这个样子。
根据OpenRouter周榜最新数据,DeepSeek V4 Flash单周处理了7万多亿Token,排在第一。
而据OpenCode爆料,单8月1日这一天,DeepSeek-V4-Flash在平台上的Token处理量就高达到了8万亿,其中5万亿来自免费试用,3万亿为开发者付费使用。

图源:X
8万亿Token什么概念?按1个Token约等于1到1.5个汉字算,这相当于8万亿到12万亿个汉字,拿《红楼梦》作参照,全书约73万字,8万亿Token大概能装下1400多万部《红楼梦》。
这就是梁文锋。他左手幻方量化,右手DeepSeek,一边在A股收割,一边在全球AI市场收割。

图源:抖音

其实,在去年DeepSeek R1上线的时候,就有人把梁文锋叫做AI圈的“死神”。
那时候国产大模型还在比谁参数多、谁发布会排场大、谁的创始人朋友圈转的多,但他悄没声把大模型推理玩法做到了一个所有人都看不懂的高度,并且还有着极低的价格。
后来阿里、百度、腾讯跟着降价,国内第一次大模型价格战就这么打起来了。
当时有人怀疑DeepSeek在赔钱抢市场,梁文锋接受《暗涌Waves》采访时却说,价格是按成本核算后加上一点利润,并不是靠补贴换用户。
换句话说,他不是临时拿低价做促销,而是真的认为大模型就应该卖这么便宜。那时候大家就看出来了,他做生意的思路和别人不一样。
他从一开始就没追求做什么“全行业最强模型”,只要能力做到自己认为的最好,就可以把价格压到对手没法舒服赚钱的位置。
V2是这样,V3、R1是这样,到这次V4 Flash,这套玩法已经很成熟了。
7月31日更新的V4 Flash 0731,DeepSeek官方数据显示,其在Agents’ Last Exam测试中拿到25.2分,距离Claude Opus 4.8只有0.5分;代码能力DeepSWE从旧版的7.3分涨到54.4分,已经接近Opus的58分。

图源:DeepSeek官方账号
但价格差了近90倍。DeepSeek每百万输出Token收0.28美元,Claude Opus 4.8要25美元。
如此巨大的差异,让全世界的开发者都忍不住算一笔账。如果一个活DeepSeek已经能干到90分了,我为什么要为剩下那10分,多花几十倍的钱?
研究公司Artificial Analysis估算了DeepSeek V4-Flash每项智能指数任务的成本。最终结果是,V4-Flash的平均测试成本为3美分。
根据实测,Agent跑起来要不停读代码、调工具、翻日志,96%的输入Token都走缓存,看着token量大,实际成本极低。
Agent越能干,用的token越多,DeepSeek的价格优势就越明显。

图源:Artificial Analysis
OpenRouter平台访问流量中,美国、欧洲开发者占比接近半数,大量Agent自动化项目、代码辅助工具、长文本处理应用,主动将默认模型切换至DeepSeek。

左手幻方,右手DeepSeek
很多人是因为DeepSeek才知道的梁文锋,但其实他最早是做量化交易的。浙大电子系毕业,和同学一起创办了幻方量化,靠算法在市场里赚差价。
网上关于他流传最广的那张图片,就出自一次金融行业颁奖典礼。

图源:知乎
大模型火起来之前,幻方就自己建了万卡A100的算力集群。2023年,梁文锋把原来的AI研究团队独立出来,才有了DeepSeek。
对此,很多网友玩梗说他“左手量化右手AI,自己给自己供血”,其实没那么玄乎。
梁文锋自己公开说过,大模型和量化交易没有直接关系。不存在“模型越好,量化赚的越多”的飞轮。
幻方给DeepSeek的,是早期不用看投资人脸色的底气。
别的公司创业,先写PPT融资,拿了钱再做模型,每花一笔都要想着怎么给投资人回报,什么时候盈利,什么时候上市。梁文锋是先烧自己的钱,把模型做出来,路走通了,才接受外部投资。
2026年6月DeepSeek第一轮融了500亿,梁文锋自己掏了200亿,腾讯、宁德时代这些机构才跟着进。到现在他也是公司说了算,不用急着商业化,不用为了财报做漂亮数据。
有钱只是基础,真正把价格打下来的是技术效率。
V4 Flash总参数2840亿,每次推理只激活130亿,长上下文下的计算量和缓存占用比上一代低了很多。
别的公司是先堆算力堆出能力,再把成本转嫁给用户;DeepSeek从设计模型开始,就算着怎么少用算力、少占显存、把推理成本压到最低。
所以他能一直降价,不是做慈善,是成本真的能做到这么低。别的公司也能跟着降,但降完能不能赚钱、能不能活下去,就不好说了。

大模型游戏规则被改写
如果时间倒回到几年前,大模型之间的比赛,像是一场正常的马拉松。
OpenAI在前面跑,谷歌、Anthropic跟着,其他公司只要比身边的人快一点,就能融钱、涨估值、卖高价API。跑第一有奖金,跑中间有奖牌,跑最后也能混个参与奖。

图源:小红书网友AI制图
现在做代码、推理、Agent这些主流场景,默认及格线就是DeepSeek:能力差不多跟上,价格也不能差太远。
你做得比它好,用户觉得是应该的,不会多掏钱;你做得没它好,还卖得比它贵,用户转头就换。
这就导致,最难受的不是头部巨头,而是夹在中间的通用大模型公司。能力追不上第一梯队,成本压不到DeepSeek这么低,也没有自己的入口、产品或者云业务能托底。
之前还能靠讲故事融资,现在投资人只要问一句“那我为什么不用DeepSeek”,故事瞬间就讲不下去了。
巨头也没法置身事外。
OpenAI在7月30日把GPT-5.6 Luna降价80%,时间比V4 Flash更新还早一天,不能说是被DeepSeek逼的,但整个行业的价格趋势已经明了:模型越更新,能力溢价越低,token价格只应该越来越便宜。

图源:X
更关键的是全球开发者心智的变化。据多家媒体爆料,如今有相当一部分的美国公司正在偷偷使用中国大模型,
数字遗产平台LilyList的创始人梅因霍尔德表示,“我们超过90%的人,并不需要Anthropic的大模型。”近200家美国科技初创企业敦促美国政府不要切断对中国开源模型的访问。
这种习惯一旦养成,再想抢回去就难了。
很多人说梁文锋是价格屠夫,其实他没杀谁,只是把行业里的水分挤干了。
之前大家总说大模型贵是因为研发成本高,现在才发现,很多成本只是没人愿意优化,没人愿意把利润让出来。
不过,梁文锋这一刀,砍的不只是有其他AI公司。他狠起来,是连自己都砍。
DeepSeek把价格压得越低,模型开的越开放,整个行业就越难靠卖API赚大钱。
哪怕以后DeepSeek做得再好,也很难把价格涨回去,拿不到之前GPT或CLaude那样的高溢价。
可以说,梁文锋不仅砍掉了同行依靠高价API赚钱的可能,也顺手砍低了DeepSeek自己的利润天花板。
但也许,这些他根本就不在乎,如今的梁文锋眼里好像只剩“AGI”。
等他的AGI真正落地那天,所有人都会记住梁文锋这个名字。
铁粉推荐