从Argon到Carbon仅隔十天,Gemini 4内部迭代速度令业界咋舌

科技区角 2026-10-10 20:32

【科技纵览】当绝大多数开发者还在排队等候Argon大门敞开之际,《Business Insider》的采编团队已经把目光投向了更深处。据该媒体披露,依托多份内网文档与界面截图证实,Alphabet旗下工程师正借由Jetski平台——也就是内部编程基建Antigravity的另一套叫法——跑通一个代号唤作Carbon的Gemini 4全新检查点(checkpoint)。参与试用的技术人员给出的直观反馈颇为惊人:这套新模型的代码编写体感“仿佛在用Opus 5.5”。要知道,Anthropic旗下的Claude Opus 5.5眼下稳居第一梯队,尤其在驾驭超大型工程、处理繁杂代码重构、排查深层Bug以及长周期自主编码方面表现拔尖,部分基准跑分甚至压过了Fable 5.1。与此同时,Antigravity近期还揭开了一项此前代号为“Concierge”的神秘面纱,如今它已更名为“Chief of Staff”,本质上是一套具备自主任务分发权限的agent架构。

上一代产品尚未全面铺开,下一代雏形已然闯入视野。回溯十天前,这家搜索巨头正式抛出Argon,期望其胜任耗时更长、链路更为繁琐的业务流,涵盖软件工程、法务及金融知识密集型作业,乃至网络防线构筑。目前它仅通过Fairwind Program向经过严格筛选的安全协作方放行。至于面向广大程序员与普通用户的推送,官方敲定了分批次推进的策略,付费API调用者与AI Ultra订阅用户将率先拿到入场券,但具体时间表依然成谜。对外解释这种克制节奏时,官方坦言,那些擅长挖掘、验证并修补漏洞的高阶模型,同样暗藏被恶意利用的隐患;企业必须在安全校验、第三方评估及防护策略间留出缓冲期。

不过种种迹象表明,Argon的解禁窗口或许就在未来几天内。长期追踪应用端变动的TestingCatalog注意到,Antigravity测试版里悄然冒出了Gemini 4 Argon的切换入口,连同256K、512K以及900K等多档上下文长度选项。后两档被特意标注会吞噬更多配额,消耗量大约是常规设定的1.3倍与1.8倍。10月9日前后,《Business Insider》记者Hugh Langley跟进报道称,内部员工近来频繁在名为Jetski的开发环境里把玩新的Gemini 4检查点。泄露的文件中交织着Argon、Barium、Carbon等一串代号,而最终被挑中作为公开版Argon亮相的,其实是内部标号Barium-B的变体。Carbon既可能充当Argon的后续补丁,也可能以另一种面貌跻身Gemini 4矩阵,当然也不排除永远封存在实验室里的命运。报道引述某位测试者的话说,Carbon写起代码来让他联想到了Opus 5.5的水准。早期Argon尽管在内部颇受青睐,仍有体验者认为它在特定编码场景下逊色于Claude Opus 5。查阅官方基准榜单可以发现,Argon的综合智力指数与知识工作排名位居前列,幻觉产出率大幅跳水,部分网安与逻辑推演指标反超了主要对手,但在FrontierSWE v2、Terminal-bench等几项硬核编程评测中,依然落后于领跑者。

随着Carbon浮出水面,我们似乎摸到了该公司为新模型定名的某种规律。Argon对应元素周期表第18号,一种无色无味的惰性气体,化学性质极难发生反应。Barium是第56号碱土金属,Carbon则是第6号、构成几乎所有有机生命体的基石。顺着这条线索往下推,下一个检查点的代号极有可能是Dysprosium,符号Dy,原子序数66,属于镧系金属,词源来自希腊语中“难以获取”之意——当年发现者足足折腾了30次实验,才勉强将其从混合矿石里剥离出来。

这家公司难道正在用自家模型去设计并调试下一代模型?Argon九月底刚刚官宣,十月上旬便有内部新版本走漏风声。外界尚无法断定这些检查点之间究竟跨越了几个训练周期,更无从确认Carbon必然启用了全新底层架构。即便如此,一边筹备公开发售、一边暗中推进内部升级的双线操作,依然让人不禁深思:模型能力的跃升,究竟如何反向重塑了模型自身的研发范式?路透社八月曾提及该公司的人事与研发调整,指出联合创始人Sergey Brin对递归自我改进抱有极高热情,并促使资源朝该方向倾斜。九月,研究人员抛出了题为《RRSI:Regularized Recursive Self-Improvement of Agent Harnesses》的论文。其核心主张在于,递归自我改进未必非要发生在基础模型训练层,完全可以在Agent系统层面落地——即冻结底座模型的前提下,靠反复打磨prompt编排、控制流向、工具调度、记忆机制与上下文管理策略,让系统在特定任务上的表现持续攀升。有人据此猜测,他们正拿自己的模型去搭建和调优下一代产物。倘若这一猜想成立,那就能解释为何从Argon宣布到Carbon内测曝光,中间仅仅隔了十天。

再说回Carbon的最终走向,管理层或许会选择在Argon公测后悄无声息地替换底层检查点,让用户在无感中体会到体验升级;也可能将其打包成界限分明的Gemini 4版本,单独公布性能、定价与安全白皮书。万一公开测试证明其收益无法覆盖高昂的推理开销或潜在风险,它大概率会被搁置在实验阶段。对于这家巨头而言,Carbon哪怕最终未能转化为商品,也是一块极具价值的垫脚石。Gemini 3的问世曾让其一度咬住前沿梯队,但结构性痼疾的惯性很快拖慢了步伐,这种起伏在过去一两年里重演了不止一次。前沿大模型的角力,越来越难以靠单次发布会来盖棺定论。“最强”这顶帽子,在这个圈子里的保鲜期,也早已短得令人窒息。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AR EMI
more
谷歌上线Gemini版4399游戏站
从Argon到Carbon仅隔十天,Gemini 4内部迭代速度令业界咋舌
Gemini“越界”:AI模型首次自主攻破企业系统,谷歌回应引争议
谷歌Gemini 4 Argon发布:百万Token输出与极致性价比重塑AI竞争格局
【先进封装简报】CoWoS-L扩大封装边界,EMIB-T争夺云端ASIC
狐讯 | 谷歌 Gemini 4 登场;Meta Muse 超越 ChatGPT
Gemini 4 Argon姗姗来迟:Google在Agent时代的“迟到”与“突围”
突发,谷歌关停大批免费Gemini模型!
Gemini“代客致电”功能上线:AI从“辅助接听”迈向“主动交互”的临界点
谷歌发布Gemini 4 Argon:主打网络安全,自称全面超越竞品
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号