死神梁文锋

科技头版 2026-08-04 18:19
死神梁文锋图1
死神梁文锋图2


AI圈出了一个平静的疯子。

死神梁文锋图3
出品 | 科技头版    作者 | 刘峰

梁文锋大概没想到自己会火到今天这个地步。

最近各种有关他的AI图片非常出圈,大致长这样:

死神梁文锋图4

图源:抖音网友AI生成

图里的他,造型还是网上最流传的那样子,但做了些漫画化处理,整体画面充满张力。

你可能很难相信,现在在海外开发者眼中,梁文锋大概就是这个样子。

根据OpenRouter周榜最新数据,DeepSeek V4 Flash单周处理了7万多亿Token,排在第一。

而据OpenCode爆料,单8月1日这一天,DeepSeek-V4-Flash在平台上的Token处理量就高达到了8万亿,其中5万亿来自免费试用,3万亿为开发者付费使用。

死神梁文锋图5

图源:X

8万亿Token什么概念?按1个Token约等于1到1.5个汉字算,这相当于8万亿到12万亿个汉字,拿《红楼梦》作参照,全书约73万字,8万亿Token大概能装下1400多万部《红楼梦》。

这就是梁文锋。他左手幻方量化,右手DeepSeek,一边在A股收割,一边在全球AI市场收割。

有网友调侃:“你梁叔叔开着一台死亡收割机在后面追,跑得快没奖励,跑慢的有惩罚。”
死神梁文锋图6

图源:抖音

死神梁文锋图7

梁文锋不是第一次这么干了

其实,在去年DeepSeek R1上线的时候,就有人把梁文锋叫做AI圈的“死神”。

那时候国产大模型还在比谁参数多、谁发布会排场大、谁的创始人朋友圈转的多,但他悄没声把大模型推理玩法做到了一个所有人都看不懂的高度,并且还有着极低的价格。

后来阿里、百度、腾讯跟着降价,国内第一次大模型价格战就这么打起来了。

当时有人怀疑DeepSeek在赔钱抢市场,梁文锋接受《暗涌Waves》采访时却说,价格是按成本核算后加上一点利润,并不是靠补贴换用户。

换句话说,他不是临时拿低价做促销,而是真的认为大模型就应该卖这么便宜。那时候大家就看出来了,他做生意的思路和别人不一样。

他从一开始就没追求做什么“全行业最强模型”,只要能力做到自己认为的最好,就可以把价格压到对手没法舒服赚钱的位置。

V2是这样,V3、R1是这样,到这次V4 Flash,这套玩法已经很成熟了。

7月31日更新的V4 Flash 0731DeepSeek官方数据显示,其在Agents’ Last Exam测试中拿到25.2分,距离Claude Opus 4.8只有0.5分;代码能力DeepSWE从旧版的7.3分涨到54.4分,已经接近Opus的58分。

死神梁文锋图8

图源:DeepSeek官方账号

但价格差了近90倍。DeepSeek每百万输出Token收0.28美元,Claude Opus 4.8要25美元。

如此巨大的差异,让全世界的开发者都忍不住算一笔账。如果一个活DeepSeek已经能干到90分了,我为什么要为剩下那10分,多花几十倍的钱?

研究公司Artificial Analysis估算了DeepSeek V4-Flash每项智能指数任务的成本。最终结果是,V4-Flash的平均测试成本为3美分

根据实测,Agent跑起来要不停读代码、调工具、翻日志,96%的输入Token都走缓存,看着token量大,实际成本极低。

Agent越能干,用的token越多,DeepSeek的价格优势就越明显。

死神梁文锋图9

图源:Artificial Analysis

OpenRouter平台访问流量中,美国、欧洲开发者占比接近半数,大量Agent自动化项目、代码辅助工具、长文本处理应用,主动将默认模型切换至DeepSeek。

可以说,梁文锋正在用性价比画出了一条全球AI的生死K线。跨不过去的,也许就会死。

死神梁文锋图10

左手幻方,右手DeepSeek

很多人是因为DeepSeek才知道的梁文锋,但其实他最早是做量化交易的。浙大电子系毕业,和同学一起创办了幻方量化,靠算法在市场里赚差价。

网上关于他流传最广的那张图片,就出自一次金融行业颁奖典礼。

死神梁文锋图11

图源:知乎

大模型火起来之前,幻方就自己建了万卡A100的算力集群。2023年,梁文锋把原来的AI研究团队独立出来,才有了DeepSeek。

对此,很多网友玩梗说他“左手量化右手AI,自己给自己供血”,其实没那么玄乎。

梁文锋自己公开说过,大模型和量化交易没有直接关系。不存在“模型越好,量化赚的越多”的飞轮。

幻方给DeepSeek的,是早期不用看投资人脸色的底气。

别的公司创业,先写PPT融资,拿了钱再做模型,每花一笔都要想着怎么给投资人回报,什么时候盈利,什么时候上市。梁文锋是先烧自己的钱,把模型做出来,路走通了,才接受外部投资。

2026年6月DeepSeek第一轮融了500亿,梁文锋自己掏了200亿,腾讯、宁德时代这些机构才跟着进。到现在他也是公司说了算,不用急着商业化,不用为了财报做漂亮数据。

有钱只是基础,真正把价格打下来的是技术效率。

V4 Flash总参数2840亿,每次推理只激活130亿,长上下文下的计算量和缓存占用比上一代低了很多。

别的公司是先堆算力堆出能力,再把成本转嫁给用户;DeepSeek从设计模型开始,就算着怎么少用算力、少占显存、把推理成本压到最低。

所以他能一直降价,不是做慈善,是成本真的能做到这么低。别的公司也能跟着降,但降完能不能赚钱、能不能活下去,就不好说了。

死神梁文锋图12

大模型游戏规则被改写

如果时间倒回到几年前,大模型之间的比赛,像是一场正常的马拉松。

OpenAI在前面跑,谷歌、Anthropic跟着,其他公司只要比身边的人快一点,就能融钱、涨估值、卖高价API。跑第一有奖金,跑中间有奖牌,跑最后也能混个参与奖。

但自从DeepSeek来了之后,规则直接变了。
死神梁文锋图13

图源:小红书网友AI制图

现在做代码、推理、Agent这些主流场景,默认及格线就是DeepSeek能力差不多跟上,价格也不能差太远。

你做得比它好,用户觉得是应该的,不会多掏钱;你做得没它好,还卖得比它贵,用户转头就换。

这就导致,最难受的不是头部巨头,而是夹在中间的通用大模型公司。能力追不上第一梯队,成本压不到DeepSeek这么低,也没有自己的入口、产品或者云业务能托底。

之前还能靠讲故事融资,现在投资人只要问一句“那我为什么不用DeepSeek”,故事瞬间就讲不下去了。

巨头也没法置身事外。

OpenAI在7月30日把GPT-5.6 Luna降价80%,时间比V4 Flash更新还早一天,不能说是被DeepSeek逼的,但整个行业的价格趋势已经明了:模型越更新,能力溢价越低,token价格只应该越来越便宜。

死神梁文锋图14

图源:X

更关键的是全球开发者心智的变化。据多家媒体爆料,如今有相当一部分的美国公司正在偷偷使用中国大模型,

数字遗产平台LilyList的创始人梅因霍尔德表示,“我们超过90%的人,并不需要Anthropic的大模型。”200家美国科技初创企业敦促美国政府不要切断对中国开源模型的访问。

这种习惯一旦养成,再想抢回去就难了。

很多人说梁文锋是价格屠夫,其实他没杀谁,只是把行业里的水分挤干了。

之前大家总说大模型贵是因为研发成本高,现在才发现,很多成本只是没人愿意优化,没人愿意把利润让出来。

不过,梁文锋这一刀,砍的不只是有其他AI公司。他狠起来,是连自己都砍。

DeepSeek把价格压得越低,模型开的越开放,整个行业就越难靠卖API赚大钱。

哪怕以后DeepSeek做得再好,也很难把价格涨回去,拿不到之前GPT或CLaude那样的高溢价。

可以说,梁文锋不仅砍掉了同行依靠高价API赚钱的可能,也顺手砍低了DeepSeek自己的利润天花板。

但也许,这些他根本就不在乎,如今的梁文锋眼里好像只剩“AGI”。

等他的AGI真正落地那天,所有人都会记住梁文锋这个名字。

铁粉推荐



关注,跟主编交个朋友 ↓↓↓

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
more
单次训练横扫9个基准,遥感检测最大数据集与基础模型框架问世
【半导体设备要闻简报】AI不只拉动光刻:先进封装、检测清洗与国产设备同步升温
Sens Actuator B Chem:计算化学优化生物酶诱导分子印迹聚合物用于原儿茶酸的电化学传感检测
Food Chem:基于MOF衍生Zn/Co/Mn-N掺杂多孔碳与DNAzyme-HCR的电化学适配体传感器实现氟苯尼考高灵敏检测
ACS Sensors:机器学习引导的钴@铜双金属电化学传感器用于尿肌酐检测
2026年中国干眼检测仪产业链图谱、竞争格局及未来趋势分析:CR10市场占有率高达95.6%[图]
有奖直播报名中|瑞萨电子传感与检测技术专题研讨会
美光CEO指厂商过度压价致内存紧张;董明珠喊话股东家电不换格力凭啥分红;Anthropic回应暗藏代码检测中国用户;卓易通适配华为鸿蒙7...
雷克萨斯ES检测漏检引纠纷,瓜子二手车最终全额退车
上海半导体检测龙头冲刺IPO!70后兄妹掌舵
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号