【区角快讯】尽管AMD此前屡次宣称NVIDIA的CUDA护城河已非不可逾越,且其GPU在AI应用层面的追赶态势明显,但最新实测数据却给这一乐观论调泼了一盆冷水。在DeepSeek V4.1 Flash模型发布后,由于该模型原生基于NVIDIA架构开发,CUDA平台得以实现“零时差”适配运行;反观AMD,直至两天后才放出对应镜像,虽功能上实现了开箱即用,但性能表现却令人大跌眼镜。
据SemiAnalysis披露的基准测试显示,MI355X显卡的运行速度被压制在50 Token/s以内,Token经济效益惨不忍睹。具体而言,其效率不仅比H200落后了14.8倍,更是被B200/B300系列甩开了惊人的42.6倍差距。值得注意的是,就在不久前,SemiAnalysis还曾称赞AMD仅用两周便将MI355X性能提升三倍有余,并凭借每小时芯片成本优势,具备挑战CUDA生态地位的底气。然而,此次落败恰恰暴露了核心痛点:时间滞后性与初期性能的不稳定性。
虽然MI355X的理论峰值及优化后的最终性能足以与B200、B300抗衡,但这需要额外的资源投入进行后期调优,无法像N卡那样做到“即插即用”。对于追求业务连续性的AI平台而言,即便A卡的单位小时成本更低,这种初期的折腾与不确定性也是难以接受的。这就好比两名学生,一名平时成绩稳定在90-95分,另一名虽期末能拼到90分,但开学初总是状态低迷,老师的偏好不言而喻。只要这种“启动期”的性能鸿沟存在,厂商高价抢购N卡的局面便难有根本性扭转。
AMD显卡AI性价比遭重创,DeepSeek测试揭示生态短板
科技区角
2026-09-12 19:00
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。