
智东西8月13日消息,昨夜,马斯克转发SpaceXAI推文,宣布推出新一代旗舰模型Grok 4.6,它具有智能、快速、性价比超高的特点。相比Grok 4.5,Grok 4.6在相同价格下性能显著优化。从其披露的多项智能体编程和知识工作基准测试来看,Grok 4.6 high综合性能与GPT-5.6 Sol Max、Claude Fable 5 Max相当。Grok 4.6现已在Cursor和Grok Build上发布,也已在API和其他合作伙伴(如OpenRouter、Vercel和Cloudflare)的平台上发布。首周,Grok Build和Cursor内均提供2倍的使用量,让用户可立即体验4.6版本。其定价为每百万输入token 2美元(约合人民币13元),每百万输出token 6美元(约合人民币40元),还有一种快速版本的价格是普通版本的2倍。在最新披露的Code Arena代码竞技场WebDev测试结果中,Grok 4.6 (High)以1618分数排名第七,与GPT-5.6 Sol (xHigh)、GLM-5.2 (Max)、Claude Fable 5分数十分接近。Grok 4.6在Grok 4.5的基础上进行了改进,特别注重长期运行的智能体以及更具挑战性的交互式和视觉化工作,能处理多步骤的复杂任务,包括研究主题、分析信息、跨代码库工作、将想法转化为完善的应用程序或作品等。与Grok 4.5相比,Grok 4.6进行了更长时间的补充训练,使用了经过筛选的模型生成数据(用于推理和高级技术概念)、高质量的工程数据,以及改进的优化器和训练方案。这为后续的SFT和RL阶段奠定了更坚实的基础。然后,研发团队使用Grok 4.5重新生成了SFT在推理过程、智能体框架以及STEM、软件工程和知识工作等领域中的轨迹,并通过基于模型的检查过滤掉了问题轨迹。最终得到的SFT检查点展现出优异的性能和改进的行为。Grok 4.6经过广泛的智能强化学习任务训练,包括知识工作、通用编码以及核优化、Web开发、计算机辅助设计等领域的特定环境。SpaceXAI团队对Grok 4.6进行了测试,旨在拓展其应用范围,并检验其在多步骤工作中持续改进的能力,发现该模型尤其擅长将宽泛的产品构想转化为可运行的初始版本。它能够研究陌生的领域,构建应用程序框架,实现核心交互,并通过多轮反馈不断完善最终成果。在更长的轨迹上,他们也开始看到更多的自我测试和验证,模型会在继续前进之前检查自己的工作。与Grok 4.5相比,Grok 4.6在视觉和交互项目的第一阶段就能生成更强大的成果。给定一个具体的产品构想,它只需一次迭代即可为应用程序构建结构和视觉语言。这使得它对于那些需要先构建一个实质性框架,然后不断迭代才能快速取得理想结果的项目尤为有用。同时,Grok 4.6的安全防护措施已根据模型的功能进行了改进和校准。其安全堆栈旨在最大限度地提高合法使用场景的实用性和安全性,使Grok 4.6能在漏洞修补、加速工程设计周期和增强AI研究等领域发挥作用并保障安全。9月20-21日,智东西主办的2026全球AI芯片峰会将在上海举行,设有开幕式,大模型AI芯片、Agent推理芯片、具身智能芯片3场高峰论坛,以及Token工厂异构混训混推、超节点、AI芯片架构创新、新型存储器、大模型KV Cache5场技术研讨会。
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。