生成式AI
一、Anthropic上线Sonnet 5.5,Terminal-Bench反超Opus
1.Anthropic发布Claude Sonnet 5.5,标价与Sonnet 5同为输入2美元、输出10美元/百万Token,因更省Token单任务成本最高降30%,速度提升超30%;
2.Terminal-Bench 4.0得分70.6%,超过Opus 5.5的66.4%;Artificial Analysis智能指数64%居第二,Chartography由15.6%升至61.6%;
3.成为首个仅看截图通关《宝可梦 红》的Sonnet,但Max档单题约7.60美元,可能贵过Opus满档。
二、AMD以82亿美元收购World Labs,李飞飞任首席科学家
1.AMD与World Labs达成82亿美元收购协议,预计年底前完成并待监管批准,李飞飞将任AMD执行副总裁兼首席科学家,直接与CEO苏姿丰合作;
2.World Labs主攻空间智能与World Model,Atlas以“下一视角”预测做稀疏重建,Marble可用于机器人仿真,并已收购SceniX补齐模拟;
3.苏姿丰为早期投资人,双方已有GPU训练推理合作;AMD希望借此补齐空间智能,更早对接前沿workload与芯片路线图。
三、Manus推出2.0与Cue,Cascade运行成本降三成
1.蝴蝶效应发布Manus 2.0海外版与多Agent群聊应用Cue,自研框架Cascade较前代Token消耗降23.2%、完成时间缩28.2%、运行成本降32%;
2.新增云电脑、Automations事件触发与Computer Use远程操控,Studio升级文档、视频与游戏环境,视频编辑器支持Alchemy与时间线精修;
3.Cue为每个Agent配置邮箱、电话、钱包与独立电脑,可组队协作、代接电话与扫码点餐,仍处邀请码抢先体验。
四、可灵Kling 4.0将发,支持10-bit HDR与多关键帧
1.可灵Kling 4.0主打真实、可控、专业,10月正式见面,Flash版9月28日小范围开放;支持10-bit HDR与4K/1080P输出,可直进达芬奇等专业后期;
2.单次原生最长30秒,支持最多15项参考(至多10图、5视频、7主体)与10张关键帧,21:9超宽画幅,覆盖中英日韩等9种语言及多地方言口型匹配;
3.实测武侠竹林与天台激斗运镜连贯,文戏微表情与粤语对白同步,创意复刻与精准编辑降低反复抽卡。
前沿科技
五、星舰第14次试飞首次入轨,一箭释放26颗卫星
1.北京时间9月28日20:49,SpaceX第14次星舰试飞自得州Starbase升空,Ship 41完成轨道插入点火,首次进入约262×277公里、倾角32度的绕地轨道;
2.入轨后约半小时依次释放26颗运营级商业卫星,其中3颗装摄像头拍摄热防护罩,这是星舰首次携带运营级商业载荷而非模拟器;
3.上升段一台真空猛禽提前关机,任务由原定绕地6圈、约10小时缩短至约3小时提前溅落,但入轨与部署主目标均完成。
六、智元远征A3原生接入网易云,10月起可语音点歌
1.智元与网易云音乐达成深度合作,远征A3成为全球首个原生集成音乐平台的全尺寸人形机器人,10月15日起可语音点播正版曲库;
2.语音识别、曲库调用、播放控制与账号鉴权打通统一链路,已适配嘈杂环境唤醒、弱网重试与多用户并发;横琴长隆常态化部署超300台并试点音乐交互;
3.后续规划music to gesture编舞、AI DJ与随心伴唱;智元称截至2026年9月累计量产下线突破2万台。
报告观点
七、Chrome前负责人:AI编程最大风险是认知投降
1.前Chrome开发者体验负责人Addy Osmani指出,AI用得越多越易失去对问题的记忆与理解,把模型答案直接当自己的答案即“认知投降”,交付加快却说不清系统;
2.他一项任务可起20—30个子Agent,人已看不完轨迹,应留下决策摘要、风险范围与测试证据,关键目录须有人类OWNERS,出事后仍要有人接得住;
3.他判断实现会越来越自动化,稀缺的是目标设定与事故承接——代码可由机器生成,理解系统不能一起外包。
八、Anthropic招股书曝光:估值冲2万亿,亏损被误读
1.路透披露Anthropic秘密S-1草案,上市估值目标超2万亿美元;2025年净亏约420亿美元中约340亿为可转股工具估值会计费用,经营亏损80.6亿美元、收入45.9亿美元;
2.年化收入据称7月底已超650亿美元,但近四分之一来自两客户且缺长期合同;算力等多年承诺约5180亿美元,约为其现金的25倍以上;
3.Founder LLC握50.1%投票权,公司主动不开发图像视频生成;判断看,招股书把“不做什么”写成与安全叙事绑定的商业取舍。
九、a16z对谈:安全不等于限速,Agent权限边界更紧迫
1.Box CEO Aaron Levie在a16z播客中认同加强测试、沙盒与治理,但担心笼统“放缓”会变成与模型安全无关的限制,拖累其他开发者与前沿实验室竞争;
2.他认为“放缓”缺乏可核对照,实验室内部模型或远超对外产品,须说清如何判断风险及为何仍继续研发,不宜仅凭口号定规;
3.智能体可万倍扩增并读写、调用甚至花钱,企业须细粒度授权与操作审计,在频繁弹窗确认与一次交出过大权限之间划清任务匹配边界。
👇加入AGI数据库,AI智能问答

👇订阅下方合集,获取每日推送