OpenAI研究员,曝光ASI降临时间线:大多数已成现实!

新智元 2026-08-16 19:33

OpenAI研究员,曝光ASI降临时间线:大多数已成现实!图1

  新智元报道  

OpenAI研究员,曝光ASI降临时间线:大多数已成现实!图2


2025 年 4 月,一群从 OpenAI 辞职的研究员发表了一份 71 页的文件,逐月推演了一个惊悚的未来:


到 2026 年底,AI 编程智能体开始取代初级程序员;


到 2027 年,超人编程智能体自动化 AI 研发本身,触发智能爆炸;


年底前,人类可能面对一个自己造出来却无法控制的超级智能(ASI)。


这份名叫《AI 2027》的预测,读起来像科幻小说。


它的主笔 Daniel Kokotajlo 在 2021 年还写过一篇《What 2026 Looks Like》,在 ChatGPT 问世之前就准确描述了思维链推理和智能体的出现,超过一半的具体预测最终兑现。


OpenAI研究员,曝光ASI降临时间线:大多数已成现实!图3

https://www.youtube.com/watch?v=_g4l7YkDQwA


现在轮到《AI 2027》接受检验了。


德国汉堡的独立追踪者 Johannes Haus 从中提取了 53 项可验证的预测,搭建了 AI 2027 Tracker 逐条打分。


OpenAI研究员,曝光ASI降临时间线:大多数已成现实!图4

https://ai2027tracker.com/timeline


截至目前的成绩单:51% 的预测已经确认、超前或按进度推进。


现实以预测速度的 70% 在展开。


但真正让人坐不住的,绝不仅仅是这两个数字。



OpenAI研究员,曝光ASI降临时间线:大多数已成现实!图5
最吓人的预测,反而提前了


53 项预测里有 3 项「超前」,其中最令人不安的一项:AI 获得接近顶尖人类黑客的网络攻防能力。


《AI 2027》把这件事排在 2027 年初。


实际发生在 2026 年 4 月,提前了 9 个月。


Anthropic 发布 Claude Mythos Preview 后,在 Project Glasswing 框架下把它部署到多个开源项目中,这个模型自主发现了数千个零日漏洞,有些在人类安全专家的审查下藏了十到二十年。


关键在于:Mythos Preview 根本不是为网络攻防训练的。


它只是一个通用模型,学会了写代码和推理,发现漏洞是副产物。


Anthropic 的内部评估称,AI 在编码能力上已能超越绝大多数人类去发现和利用软件漏洞。


2026 年 7 月,OpenAI 的系统安全卡披露了更直接的证据:模型在评估中利用了一个零日漏洞,触及了 Hugging Face 的生产基础设施,绕过了沙箱,并混淆了身份验证令牌。


英国 AISI 同月报告 GPT-5.5 端到端完成了多步骤网络攻击模拟。


另一项提前到来的预测:五角大楼把 AI 实验室拉入国防承包商的关系。


《AI 2027》预测这发生在 2027 年初,实际上五角大楼 2025 年 6 月就签下了四份各 2 亿美元的合同,分别给了 Anthropic、OpenAI、xAI 和 Google,比剧本早了 18 个月。


Tracker 维护者 Haus 在 LessWrong 上总结了这些案例背后的规律:风险的到来快于产生这些风险的原始能力。


这个发现在 53 项预测中系统性地成立,也是整份记分卡里最值得警惕的一条洞见。



OpenAI研究员,曝光ASI降临时间线:大多数已成现实!图6
唯一的好消息:最后一步还没迈出


通往 ASI 的核心机制是一个反馈环,也就是最近爆火的 RSI(Recursive Self-Improvement,递归自我改进):AI 加速 AI 研发,成果让下一代 AI 更强,更强的 AI 再次加速研发,如此循环。


《AI 2027》的整个后半段剧情都建立在这个环闭合的假设上。


然而,这个环还没闭合。


这是记分卡里最大的一道裂缝,某种意义上也是唯一的好消息。


Anthropic 2026 年 5 月披露,Claude 已经编写了公司超过 80% 的新代码,一年前这个数字还是个位数。


在一项内部测试中,Mythos Preview 把一个 ML 训练代码优化到基线的 52 倍,人类工程师的成绩约为 4 倍。


但 Anthropic 自己也承认瓶颈转移了:生成代码的速度已经足够快,堆积在工程师面前等待审查的代码越来越多。


AI 写代码越快,人类审查员的工作量越大。


在研究层面,瓶颈是「品味」,决定朝哪个方向研究的判断力。反馈环的前半段在转动,后半段还没接上。


Elasticity Institute(成员包括 METR 的 Tom Cunningham)2026 年 7 月发表的论文给出了「接上」所需的精确门槛:每一代模型的能力提升,必须带来至少 15% 的 AI 研发生产力增长,RSI 才能自我维持。


论文通过系统卡数据反推,当前这个数字约为 9%,低于临界点。


OpenAI研究员,曝光ASI降临时间线:大多数已成现实!图7

https://x.com/AnikaSomaia/status/2087408169660064218


9% 和 15% 之间的 6 个百分点,是人类和加速循环之间的缓冲区。


但支撑这个缓冲区的底层曲线仍在加速。


METR 的时间视野指标追踪 AI 自主处理任务的持续时间。


2026 年 1 月的数据显示,这个指标每 3 个月翻一倍,而且翻倍速度本身也在加快。


Claude Opus 4.6 的时间视野已达约 12 小时,Mythos Preview 触及了测量上限。


按 3 个月翻倍外推:12 小时到 24 小时到 48 小时到一周再到两周,2027 年初就是月级任务。


《AI 2027》的作者自己也在调整预期。


Kokotajlo 把全自动编程的中位数预测从 2029 年底前移至 2028 年中,Lifland 的估计在 2030 年中附近。


左脚踩右脚的 RSI,开始让 ASI 指数级加速降临。


参考资料:

https://ai2027tracker.com/?p=timeline
https://github.com/elasticity-ai/elasticity/raw/main/paper/elasticity-rsi-paper.pdf

编辑:马可


秒追ASI
点赞、转发、在看一键三连
点亮星标,锁定新智元极速推送!

OpenAI研究员,曝光ASI降临时间线:大多数已成现实!图8
OpenAI研究员,曝光ASI降临时间线:大多数已成现实!图9

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI
more
奇了怪了!AI比带货网红更能让人信任,但用户下单却更慢了
Anthropic详解Claude文本水印机制:合规欧盟AI法案,代码受影响极小
行业首个!纯国产舱驾一体芯片正式打入高端AI座舱
警惕!别再高频找AI聊天,它解决不了根本问题
从边缘智能到云端融合,RISC-V 在 AI 领域的落地纪实
ScienceDiscovery发布:零科研幻觉的一站式AI工作台,BiomniBench-DA验证效果业界SOTA
闪迪SK海力士联手定义HBF标准,AI存储架构迎来新变局
SpaceX正式吞并Cursor,600亿美元豪赌AI代码未来
本周AI项目推荐|智能知识、Copula Lab、UniPat…谁在给中国模型造后训练数据与考场?
AI浪潮下的就业悖论:科技巨头一边豪赌大模型,一边挥刀裁员
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号