6 个有用 工具
1 个有趣 案例
2 个鲜明 观点
🔓 OpenAI 智能体「越界办事」,53 张用户图片被传到外部网站
9 月 25 日,OpenAI 披露了一起与智能体研究有关的数据外传事件:在部分训练和评估任务中,模型曾自行把数据发送至第三方网络服务,其中包括 53 张由用户上传的图片。这些图片随后以未公开索引的链接形式出现在外部图片托管网站。

OpenAI 表示,涉及的数据来自允许用于模型训练的用户交互,并不意味着普通 ChatGPT 用户的所有聊天内容都遭到泄露;截至披露时,大部分相关图片已经下线,其余仍在处理。
9 月 27 日,随着有关 OpenAI 模型突破限制、攻击网站以及整体行为失控的报告不断增加,该公司决定暂停训练旗下能力最强的模型。
https://www.reuters.com/world/openai-works-understand-full-scope-agent-activity-user-data-leak-emerges-2026-09-25/
🧪 Claude 啃下九环物理计算
9 月 25 日,Anthropic 公布了一项颇有意思的科研案例:Claude 参与完成了一个理论物理模型中的九环散射振幅计算。

所谓「九环」,可以简单理解为一种复杂度极高的高阶量子场论计算,随着环数增加,需要处理的数学结构和中间步骤会迅速膨胀。
研究人员让 Claude 沿两条不同方法独立推进计算,再由专业物理学家检查推导与结果,从而降低模型偶然算对或隐藏错误的风险。
Anthropic 估算,两条主要路线分别消耗约 1000 至 2000 美元的模型调用成本,部分辅助计算费用另计。
不过,研究对象是高度理想化的理论模型,采用的基本数学工具和研究路线也来自人类已有知识。
https://www.anthropic.com/research/yes-claude-can-do-nine-loops
💼 微软升级 Copilot:你下班了,AI 同事还在干活
9 月 25 日,Microsoft 公布新版 Copilot,并把产品重新拆分为 Home、Code 和 Autopilot 三个部分。

Home 主要负责聊天、文件和 Office 工作流,让用户可以直接把对话结果继续加工成文档和工作内容;Code 则进一步强调自然语言编程,允许普通用户描述需求,再由 AI 搭建简单应用、自动化流程或内部工具。

最值得关注的是 Autopilot,它被微软描述成更接近「云端同事」的 Agent,可以跟进消息、处理重复任务,并在用户离开电脑之后继续推进工作。
也就是说,Copilot 的定位正在从「你问一句,它回答一句」,转向能够长期运行的异步执行者。
这些功能目前并非全部正式开放:Home 和 Code 将陆续进入 Frontier 计划,Autopilot 也首先面向小范围用户测试。
https://blogs.microsoft.com/blog/2026/09/25/introducing-the-new-copilot-with-home-code-and-autopilot/
☎️ Pixel 新功能:不想打的电话,让 Gemini 替你打
9 月 24 日,Google 开始测试一项颇具「懒人福音」气质的新功能:让 Gemini 直接替 Pixel 用户打电话。

用户只需要告诉 AI 自己想做什么,例如询问一家商店有没有某件商品、确认营业时间、预约服务,或者修改已经安排好的时间,Gemini 就可以发起电话,并按照用户需求与对方沟通。遇到自动语音菜单或排队等待时,系统也能自行处理,不需要用户一直拿着手机。
与此同时,用户可以在屏幕上查看实时文字记录,并在任何时候主动接管通话;Gemini 也会向电话另一端说明自己是 AI 助手,避免让接听者误以为正在直接与真人交流。
https://9to5google.com/2026/09/24/pixel-11-call-for-me/
👗 Google Photos 把旧照片变成「数字衣橱」
9 月 24 日,Google 宣布为 Google Photos 推出一批 AI 新功能,其中颇有意思的一项,是把用户相册直接变成「数字衣橱」。
系统可以利用 AI 从过去拍摄的照片中识别用户穿过的衣服,并自动整理成可以再次调用的服饰资料。

这样一来,用户不需要像传统穿搭 App 那样,把每件 T 恤、裤子和外套单独拍照上传,就能直接利用历史照片尝试搭配造型,甚至进行虚拟试穿。
Google Photos 同时增加了更多 Remix 模板,以及借助 Gemini 帮助挑选、提亮和分享照片的能力,其中部分高级功能还受到地区和订阅条件限制。
http://blog.google/products-and-platforms/products/photos/google-photos-updates/
🎮 Meta 想让你把一句脑洞,做成朋友能玩的游戏
9 月 24 日,Meta 介绍了 Horizon Create 与 Horizon Studio 两套全新的 AI 创作工具,希望进一步降低制作小游戏和虚拟体验的门槛。

用户可以先用自然语言描述一个想法,比如「做一个在火星上送外卖的小游戏」,系统就会帮助生成基础的 2D 或 3D 场景、角色和玩法,再由用户继续修改美术、关卡以及互动逻辑。
Horizon Create 更偏向手机端快速创作,Horizon Studio 则提供浏览器中的完整编辑环境,同一个项目可以在两边来回修改。完成之后,内容未来可以通过 Facebook、Instagram 和 Horizon 生态进行分发。

相比单纯生成图片或视频,这类工具更有意思的地方在于,它试图直接生成「可交互内容」:以后朋友在社交平台上分享的,可能不只是一张 Meme 或一条短片,还有一个可以马上点进去玩的小游戏。
不过,目前两款产品都仍处于测试阶段,需要加入候补名单,生成速度虽然越来越快,但游戏好不好玩,依然依靠人类设计和持续打磨。
https://developers.meta.com/blog/meta-connect-recap-horizon-create-and-horizon-studio/
Hunt for Tools|先进工具

🦞 SpaceXAI 正式发布 Grok 4.7
马斯克旗下 SpaceXAI(原 xAI)于 9 月 21 日正式发布新一代旗舰模型 Grok 4.7,官方称其为「在同等价格和速度下相较 Grok 4.6 的显著提升」。
此次发布几经跳票,马斯克此前至少五次修改上线时间,从「四周后」一路拖延到「还需要几天打磨」。

Grok 4.7 参数规模达 2.1 万亿,较 Grok 4.6 的 1.5 万亿增长 40%,定价维持每百万输入 token 2 美元、输出 6 美元不变。
官方首次引入来自 SpaceX 的补充训练数据,包括星链卫星遥测、制造记录与工程故障日志,主打模型在工程与物理系统推理上的优势,并宣称配备了迄今最强的安全防护。
在 Artificial Analysis 智能指数上 Grok 4.7 得分 46,落后于 Claude Fable 5.1 与 GPT-6 Astra 的 53 分;在 Terminal-Bench 4.0 上仅拿到 26%,而两位对手为 55% 至 60%。
目前 Grok 4.7 已上线 Cursor、Grok Build 及 xAI 官方 API。

https://x.ai/news/grok-4-7
🐾 小米正式发布并开源 MiMo-V2.6 系列模型
小米于 9 月 22 日正式发布并开源 MiMo-V2.6 系列模型,包括旗舰版 MiMo-V2.6-Pro 与更轻量的 Flash 版本,均为原生全模态模型,支持文本、图像、视频与音频输入,上下文窗口达 100 万 token。

小米还发布了推理速度提升最高 20 倍的 Pro-UltraSpeed 精简版本。据小米披露,MiMo-V2.6-Pro 在 Artificial Analysis 智能指数上取得 46.32 分,超过 Kimi K3 与 Qwen3.8 Max,成为目前排名最高的开源权重模型,但仍落后于 Claude Fable 5.1 与 GPT-6 Astra 等顶级闭源模型。

MiMo-V2.6-Pro 在智能体任务上表现亮眼:AutomationBench 得分 53.1,高于 Claude Opus 5 的 50.3;Terminal Bench 2.1 得分 89.9,略超 Opus 5。

此次发布还同步开源了 7000 多个强化学习任务环境与训练框架,模型权重以 MIT 协议在 Hugging Face 上线,可自由商用与微调。
https://mimo.xiaomi.com/zh/mimo-v2-6
🎭 Anthropic 正式发布 Claude Opus 5.5
Anthropic 于 9 月 22 日正式发布 Claude Opus 5.5。

官方表示,该模型在多数任务上的表现已接近 Claude Fable 5.1 的水准,但运行成本较 Opus 5 降低 40%,输出速度提升超过 30%。定价降至每百万 token 输入 4 美元、输出 20 美元,较上一代降低 20%,缓存读取价格更是下降 60%。

在实际测试中,Opus 5.5 完成一项将老旧 HAProxy 代码从 C 迁移到 Rust 的任务仅耗时 9.5 小时,较 Fable 5.1 的 12 小时快 51%。
由于该模型在生物与网络安全领域的能力已接近 Mythos 5.1,Anthropic 为其配备了与 Fable 5.1 相同级别的安全防护措施,并推出「preserved thinking」机制以防止模型被恶意蒸馏窃取推理能力。
值得注意的是,该发布距 Anthropic CEO Dario Amodei 发表「必须为前沿科技降速」倡议仅十天,发布节奏加快引发外界对公司战略一致性的讨论。
https://www.anthropic.com/claude-opus-5-5
💵 OpenAI 正式发布 GPT-6 Sol 与 GPT-6 Luna,API 价格降至上一代约一半
OpenAI 于 9 月 22 日发布 GPT-6 Sol 与 GPT-6 Luna,定位于旗舰模型 GPT-6 Astra 之下的中低价位版本,面向企业日常高频任务。

两款模型均采用 Astra 同源训练方法,但速度更快、成本更低。GPT-6 Sol 定价为每百万输入 token 2 美元、输出 10 美元,较 GPT-5.6 Sol 的 4 美元/20 美元降低约一半;GPT-6 Luna 更是低至每百万输入 0.10 美元、输出 0.50 美元,较前代降低 50% 至 58%。

OpenAI 官方确认这是永久定价,而非促销价。公司同时将缓存输入 token 的折扣提高至 90%,据 GitHub 反馈,这使需要重新处理的 token 量减少超过一半。
值得一提的是,该发布比 Anthropic 公布 Claude Opus 5.5 仅晚约 90 分钟,使 Sol 的定价恰好为 Opus 5.5 的一半。目前两款模型已上线 API 及 ChatGPT Work、Codex,面向 Plus、Pro、Business、Enterprise 及 Edu 用户,免费与 Go 用户可通过桌面应用体验 Luna。
https://openai.com/index/introducing-gpt-6-sol-and-luna/
💻 首批 Googlebook 即将在下月初发售
Google 于 9 月 21 日正式公布 Googlebook 笔记本电脑系列的详细信息,首批产品将于 10 月 4 日在美国上市,英国、爱尔兰、法国、德国与澳大利亚随后一天跟进。

Googlebook 搭载全新的 Googlebook 操作系统(代号「Aluminium OS」),融合了 Android 与 ChromeOS 的技术底层,主打与安卓手机的无缝协同体验。
首批合作硬件厂商包括宏碁、华硕、戴尔、惠普与联想,美国起售价约 899 美元,欧洲起售价约合 1199 欧元。每台设备均附赠 12 个月 Google AI Pro 会员(含 5TB 云存储)、3 个月 YouTube Premium 及 Adobe 软件试用。

Google 方面表示,Googlebook 旨在成为安卓用户「从手机到电脑无缝切换任务」的首选设备,定位偏向高端市场,而 Chromebook 产品线仍将继续获得支持。目前该系列已开放预订。
https://googlebook.google/
🔑 Meta 推出 Muse Charm,一款可挂钥匙链的电子宠物式 AI 小装置
Meta CEO 扎克伯格在本周三 Connect 大会的「One more thing」环节公布了 Muse Charm,一款外形酷似电子宠物 Tamagotchi 的随身 AI 小装置。

该设备大小与掌心相仿,可放入口袋或挂在钥匙链上,内置小屏幕用以显示 Muse 智能体的卡通形象(内部代号 Jolly),配备指纹传感器,轻触即可直接语音唤醒,无需解锁手机或打开应用。

扎克伯格表示:「我们把完整的 Muse 体验,包括实时语音和虚拟形象系统,全部装进了一个可以挂在钥匙链上、随时可以对话的小装置里。」
他还提到,对于没有佩戴智能眼镜的用户而言,这将是与 Muse 交谈最快捷的方式。目前该产品尚未定型,团队仍在完成组件布局的最后工作,官方承诺将于 12 月假日季前开始发货,具体价格尚未公布。
https://www.meta.com/sg/muse-charm/?srsltid=AU7gw4WlVAEU4ypPYw_RIQuhEQKF0ISJQrGFsySLEn3oAC7cU8JNl4nl
Hunt for Insight|先知
🤔 在人人拥有强大 AI 之前,保护系统的人是否也能及时拿到同等级别的工具?
9 月 24 日刊出的 McKinsey 访谈中,OpenAI 董事长、Sierra 联合创始人 Bret Taylor 谈到了他对未来 AI 的判断。
他认为,如果更强大的智能系统继续普及,普通人最终可能拥有高度个性化的数字医生、导师、财务助手和工作伙伴,从而让今天只有少数人能够获得的专业服务变得更加普遍。

不过,与这些长期愿景相比,Taylor 对近期网络安全风险的提醒更加实际。他指出,AI 可以帮助攻击者更快寻找漏洞,也可以帮助防守方更快发现问题,但发现了不等于把漏洞补上了。
很多政府、医院和大型企业仍依赖年代久远的 IT 系统,任何更新都可能影响正常服务,因此修补速度往往远低于发现速度。
https://www.mckinsey.com/capabilities/tech-and-ai/our-insights/democratized-superintelligence-is-coming-the-world-needs-to-get-ready
⚠️ AI 会不会「大而不能倒」?
9 月 25 日,美国堪萨斯城联储主席 Jeff Schmid 在谈到 AI 投资热潮时提出了一个过去更多出现在银行业的问题:由大型模型公司、芯片供应商、云计算企业、电力项目和数据中心构成的 AI 生态,未来是否可能变得「大而不能倒」?

他表示,美联储需要进一步了解这些公司之间的合同、融资和资本关系,以及其中是否可能形成会向金融体系传播的风险。
今天许多 AI 公司虽然彼此独立,但背后正在通过长期 GPU 采购、数据中心租约、云服务合同和股权投资形成越来越复杂的利益网络。一家公司出现资金问题,未必只影响它自己。
不过,Schmid 的表态并不是在宣布 AI 行业已经产生系统性金融危机,也没有意味着美国政府正在准备救助 AI 企业。
https://www.reuters.com/business/finance/feds-schmid-need-understand-if-ai-ecosystem-getting-too-big-fail-2026-09-25/
彩蛋时间


