DeepSeek酝酿本地化轻量大模型,瞄准消费级显卡市场

科技区角 2026-09-24 18:00

【区角快讯】尽管DeepSeek的API调用成本已压至极低水平,但对于高频使用者而言,累积开销仍是一笔不容忽视的负担。想要真正实现“Token自由”,将大模型部署在本地终端成为更优解。近日有消息指出,DeepSeek正秘密研发一款可本地运行的轻量级大模型,旨在降低使用门槛。

在最新流出的投资人会议纪要中,创始人梁文锋透露,团队内部正在测试一款新型轻量模型。值得注意的是,该模型已能在普通游戏显卡上流畅运行。据称,其能力覆盖范围广泛,足以应对绝大多数日常应用场景。从梁文锋的表述推断,这款模型的开发工作已接近尾声,但具体的发布日程及详细规格参数尚未对外公开。

放眼当前的开源生态,阿里的Qwen系列堪称本地部署领域的标杆。其中,Qwen3.8 27B版本凭借极高的热度与强劲性能脱颖而出,经过社区大量优化改良后,其表现甚至能与Opus 4.6一较高下。无论是处理常规事务还是辅助代码开发,该模型都展现出了不俗的实力。

DeepSeek此次的目标是让大模型在“普通显卡”上跑通,但这一定义尚存模糊空间。毕竟RTX 5090虽属桌面游戏卡范畴,但其高昂售价与顶级配置显然难言“普通”。若依循DeepSeek一贯的务实风格,理想状态应是让RTX 4060或5060级别的中端显卡也能胜任,且推理速度需维持在30T/s以上以确保可用性。对于非专业开发者而言,此类轻量模型足以满足日常需求,未必需要追求极致的代码生成能力。这一动向或许预示着大模型将进一步下沉至个人消费电子领域。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
大模型
more
刚刚,华为鸿蒙编码大模型来了!一句话生成鸿蒙应用与元服务
小米「直播炼丹」火了!把大模型训练后台全公开,一小时烧掉20万
阶跃发布 Step 5 Preview,大模型开始寻找新的平衡点
一周被用掉 23 万亿Token!“牛来大模型” GLM-5.3 Flash真有那么牛?
双节前夕AI圈暗流涌动:国内外十余款大模型蓄势待发,国产阵营能否突围?
一场户外直播,以太大模型给具身智能立了一道新考题
影视飓风Tim称「iPhoneDuo烫到握不住,可以煎鸡蛋」;罗福莉直播小米大模型训练,每小时烧掉超20万元;曝玛莎拉蒂与华为合作两款新车
大模型正在吃掉搜索广告位,下一代广告该怎么做?人大高瓴、斯坦福把拍卖写进Token生成过程
打破“算力存储通信”三堵墙,昇腾超节点给出十万亿大模型训推“最优解”
Agent 时代来了,3D 生成大模型接下来比什么?
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号