【科技纵览】就在DeepSeek V4.1 Flash中间版测试结束仅两天后,该模型便正式推向市场。这款总参数量达552B的MoE架构模型,引入了全新的Causal-Encoder-Decoder非对称设计。其输入激活参数仅为8B,输出为16B,在大幅降低推理成本的同时,原生支持多模态视觉理解,彻底摆脱了对外挂视觉模块的依赖。得益于KV Cache压缩技术,显存需求降至上一代的四分之一,SSD占用更是缩减至八分之一。社区实测数据显示,其输出速度可达每秒300至500 tokens。
通常而言,轻量化与高性能难以兼得,但V4.1 Flash打破了这一魔咒。其在各项基准测试中全面超越V4 Pro,GPQA Diamond得分高达90.9。更为关键的是,伴随性能提升而来的是价格下调。自9月10日12:00起,Flash模型闲时缓存命中输入价降至0.02元/百万token,未命中为1元,输出为4元;高峰时段费用翻倍。此前,缓存命中价为0.05元,未命中1.5元,输出4.5元。
在此之前,DeepSeek负责人崔添翼曾在社交媒体透露,未来V4 Pro的请求将路由至性能更优、速度更快的V4.1 Flash,并按后者价格计费。鉴于Pro版本价格是Flash的三倍,这一调整被用户戏称为“赛博义父”的馈赠。所谓“赛博义父”,源于开发者对发放免费额度或重置权限的大厂员工的昵称。月初大手大脚消耗额度,月末面临“吃土”窘境时,一次突如其来的额度重置宛如天降甘霖。OpenAI的Tibo、谷歌的洛根以及如今的崔添翼,均因此位列“仙班”。
在西方,“赛博义父”文化走的是“恩赐派”路线。OpenAI的蒂堡特·索蒂奥(Tibo)堪称此道集大成者。这位比利时人早年经历丰富,从Google Maps到DeepMind,再到2024年接手Codex。2025年11月,因系统故障补偿用户额度的举动,意外演变为一种互联网仪式。随着Codex周活突破千万,Tibo多次宣布全员重置额度,甚至设立实体“重置按钮”作为梗文化符号。他不仅会说普通话,还以中文回复粉丝,拉近了与中国开发者的距离。2026年6月,OpenAI推出Banked Reset功能,允许用户将重置券存入账户,30天内灵活使用,进一步增强了用户粘性。
谷歌方面,前OpenAI开发者关系负责人洛根·基尔帕特里克转投Gemini团队后,延续了类似的慷慨策略。在其推动下,AI Studio提供了极高的免费额度,甚至为学生免费提供长达12个月的AI Pro订阅,导致市场上出现代注册edu邮箱的黑产。此外,新用户绑定信用卡即可获赠300美元云余额,简化了付费流程。Anthropic的雷蒂亚·哈莉则通过发布免费课程和重置限额来维护开发者关系,特别是在竞品发布之际,这种福利往往被视为一种竞争手段。
相比之下,国内厂商采取的是“定价派”策略。DeepSeek创始人梁文锋主张理性克制,通过开源权重和极低Token价格吸引用户。尽管曾短暂涨价引发争议,但随着V4.1 Flash的发布及路由策略调整,实际使用成本大幅下降,重新赢得了开发者好感。智谱AI则更为激进,GLM-4.7 Flash永久免费且无Token上限,而近期发布的GLM-5.3-Flash(代号“牛来”)虽转为低价收费,但其性能对标Claude Opus 4.8,且MIT开源,极具竞争力。
这种差异背后是市场发展阶段的不同。西方巨头拥有稳定的付费基本盘,额度重置作为一种低成本的营销手段,能有效提升用户忠诚度,其本质是一种“期权”式的心理绑定。而国内厂商尚处于争夺市场份额的阶段,缺乏稳定的订阅收入支撑,因此必须通过极致的性价比和技术升级来实现“降价”,以换取用户规模。无论是西方的“恩赐”还是国内的“定价”,其核心逻辑均在于通过让利换取用户留存,这在当前同质化竞争加剧的大模型市场中,已成为决定胜负的关键变量。
从“赛博义父”到价格战:大模型厂商的存量博弈新逻辑
科技区角
2026-09-10 20:32
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。