【区角快讯】尽管DeepSeek的API调用成本已压至极低水平,但对于高频使用者而言,累积开销仍是一笔不容忽视的负担。想要真正实现“Token自由”,将大模型部署在本地终端成为更优解。近日有消息指出,DeepSeek正秘密研发一款可本地运行的轻量级大模型,旨在降低使用门槛。
在最新流出的投资人会议纪要中,创始人梁文锋透露,团队内部正在测试一款新型轻量模型。值得注意的是,该模型已能在普通游戏显卡上流畅运行。据称,其能力覆盖范围广泛,足以应对绝大多数日常应用场景。从梁文锋的表述推断,这款模型的开发工作已接近尾声,但具体的发布日程及详细规格参数尚未对外公开。
放眼当前的开源生态,阿里的Qwen系列堪称本地部署领域的标杆。其中,Qwen3.8 27B版本凭借极高的热度与强劲性能脱颖而出,经过社区大量优化改良后,其表现甚至能与Opus 4.6一较高下。无论是处理常规事务还是辅助代码开发,该模型都展现出了不俗的实力。
DeepSeek此次的目标是让大模型在“普通显卡”上跑通,但这一定义尚存模糊空间。毕竟RTX 5090虽属桌面游戏卡范畴,但其高昂售价与顶级配置显然难言“普通”。若依循DeepSeek一贯的务实风格,理想状态应是让RTX 4060或5060级别的中端显卡也能胜任,且推理速度需维持在30T/s以上以确保可用性。对于非专业开发者而言,此类轻量模型足以满足日常需求,未必需要追求极致的代码生成能力。这一动向或许预示着大模型将进一步下沉至个人消费电子领域。
DeepSeek酝酿本地化轻量大模型,瞄准消费级显卡市场
科技区角
2026-09-24 18:00
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。