【区角快讯】
当SuperCLUE在8月22日抛出最新的OnDevice手机端侧大模型测评榜单时,一个令人瞩目的事实浮出水面:vivo旗下的蓝心BlueLM 3.5 Nano 3B模型,竟以综合第一的身份傲视群雄。其得分高达89.86分,这一成绩不仅领跑端侧阵营,更与众多主流云端大模型的分数咬得极紧,差距微乎其微。
此次测评的规则颇为严苛,仅针对能直接在手机本地运行的端侧模型进行排名,云端模型仅作为参照系存在,并不参与最终座次争夺。然而,对比数据依然极具冲击力:谷歌Gemini 3.6 Flash斩获93.64分,豆包Doubao Seed 2.1 pro拿下92.99分,千问Qwen3.8 Max也录得92.25分。可见,这款仅有3B参数的vivo本地模型,与顶尖云端巨头的实力鸿沟已被大幅填平。
紧随其后的是Qwen3.5 9B,以87.82分位居第二;Qwen3.5 4B则以85.16分摘得铜牌。其余如GLM 4.6V Flash (9B)、Gemma 4 E4B it及Gemma 4 E2B it等选手,分数依次递减。
端侧大模型的核心优势在于无需全程联网,推理过程完全在手机本地完成,无论是处理图片还是文本,用户输入内容均不上云,隐私保护壁垒更为坚固。尽管受限于手机硬件,参数规模难以无限扩张,此前业界普遍担忧本地模型效果会大幅落后于云端版本。但vivo此次的表现证明,即便参数小巧,能力亦可精进,未必非要依赖庞大的参数量堆砌。当然,面对超复杂任务,3B模型相较于十几B甚至几十B的大模型,仍存在能力天花板。
对于普通用户而言,端侧AI体验的重要性正日益凸显。未来,手机AI功能将不再完全受制于网络环境,断网状态下依旧可用,且隐私泄露风险显著降低。不过,单次基准测试仅代表理论性能,实际日常体验如何,仍取决于手机厂商对系统的深度调优与适配。
vivo蓝心3B模型端侧登顶,小参数逼近云端巨头
科技区角
2026-08-22 14:01
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。