腾讯研究院AI速递 20260920

腾讯研究院 2026-09-20 00:15

生成式AI

一、Claude Code兼容AGENTS.md,智能体共用项目指令

1.项目目录中没有CLAUDE.md时即自动读取该文件,行为可在/config中切换,能力基于内置mod agents-md实现并公开源码;

2.AGENTS.md最初源自OpenAI Codex,被官方称为“面向Agent的README”,Shopify CEO曾因兼容问题考虑内部禁用Claude Code,将维护两份文件称为“复杂性税”;

3.兼容不等于统一,.agents/skills与.claude/skills仍是两套独立目录,但项目指令文件正从工具偏好变成代码库基础设施。

二、智谱上线GLM-5.3-FlashX,速度最高200 tokens/s

1.智谱正式推出GLM-5.3-FlashX,最高输出速度达200 tokens/s,Model Key为GLM-5.3-FlashX,API与体验中心同步开放;

2.提速基于10万张国产芯片提供的推理算力,团队进一步加大Infra侧投入与推理优化,以应对调用量的持续攀升;

3.GLM-5.3-Flash此前以“Ox Alpha”之名发布,保持同尺寸最强智能水平,本次提速形成智能、价格、速度的综合竞争力。

三、千问推出Qwen3.8-Omni-Flash,全模态Agent上阵

1.支持文本、图像、音频、视频输入与1M长上下文,30项评测较上代平均提升超26%,音频能力整体超过Gemini 3.8 Flash;

2.模型主攻音视频Agent,可完成视频剪辑、短剧翻译配音、电影解说与会议纪要等端到端工作流,Agentic理解准确率升至67.8;

3.同步扩展并开源Qwen-MM-Plugins与Qwen-Live Harness,每小时音频输入价格降幅超98%,音视频输入降幅超93%。

四、MiniMax正式开源Code CLI,评测通过率达76.7%

1.MiniMax发布Code CLI v0.4.12并以MIT协议开源,该组件是MiniMax Code客户端核心部分,可通过一行安装脚本快速体验;

2.在第三方FrontierHarness Eval的30道任务评测中通过23道,通过率76.7%,成功任务耗时中位数4分33秒,两项指标均优于报告所列公开基线;

3.官方称开源意在让开发者审视工具调用与权限处理、构建可靠的企业级应用,并由社区参与发现问题与完善安全机制。

前沿科技

五、Anthropic自建湿实验室,Claude接入真实生物实验

1.路透社披露Anthropic已在旧金山湾区建立生物湿实验室并获官方确认,公司正探索让Claude直接指挥实验室机器人单元,在有限人工介入下完成实验;

2.8月的蛋白设计实验中,Claude在15个靶点里的14个成功设计出结合剂,两款模型命中率22.6%与26.7%,高于传统项目约10%—15%的典型水平,但外部验证的成本与排期成为新瓶颈;

3.配套的Model Hardware Standard为AI控制实验设备提供统一接口,把部分设备集成时间从数周缩短至数小时乃至数分钟。

六、Figure发布Helix 2.5,30户陌生家庭零样本作业

1.Figure推出新一代模型Helix 2.5,人形机器人在旧金山湾区30户未采集过数据的家庭中完成整理客厅、折叠毛巾与铺床三项长时序任务,无需微调或环境适配;

2.对照实验显示能力主要来自Index人类行为数据预训练,从零训练策略零样本成功率仅9%,预训练模型达56%,且所需适配数据较上代减半;

3.Index数据每翻一倍,动作预测损失按规律下降,Figure已与Nscale合作投入35亿美元部署最多10万GPU支撑后续扩展。

七、宇树开源具身大脑UnifoLM,6B模型统筹64项任务

1.6B参数、约2500小时真机数据训练,单模型覆盖54项桌面操作与10项全身操作共64项任务,模型、代码与数据集将开放;

2.推理底座UnifoLM-ER-1-4B基于Qwen3-VL-4B与超500万条具身推理样本训练,16项基准中7项领先开源模型,Where2Place、EmbSpatial等空间理解得分超过GPT-6 Astra;

3.技术路线为以交互为中心的世界建模,先用光流预测画面中会变化的区域,再经统一动作空间与MMDiT Action Expert解码为连续动作。

报告观点

八、Anthropic工程师拆解FDE,驻场交付成为主流模式

1.Anthropic应用AI团队成员Kevin Bai指出,Palantir依靠前置部署工程师(FDE)把平均客单价做到400万美元,远超ServiceNow的120万与Workday的60万美元;

2.FDE只适用于把极复杂技术产品卖给不懂技术的传统客户,与外包的本质区别在于必须有可复用平台底座,定制代码留在客户业务层,通用能力沉淀回平台;

3.AI让软件普遍Agent化且高度可定制,非技术客户难以自行落地,这一曾被视为异类的驻场模式正在变成主流交付方式。

九、Anthropic设计负责人:App将从同款走向千人千面

1.基础模型公司与传统软件公司不同,产品团队休假模型仍会变强,开发方式是让模型引领、轻量地为已有能力打开新通道;

2.Artifacts只是把HTML从对话框挪到右侧大区域,却带来心智模型的转变,让用户感到在与Claude共同创造,内部traction是判断产品价值的首要信号;

3.他判断未来或许不再是全民共用同样的七个App,而是每人使用数十上百个为自己定制生成的小应用,设计的价值在于判断什么值得占用人的注意力。

👇加入AGI数据库,AI智能问答  

腾讯研究院AI速递 20260920图1

👇订阅下方合集,获取每日推送

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI
more
AI时代的3种人与3种城市,你要做哪一种?
Anthropic引入埃森哲驻场审计,AI安全“自监管”能否打破信任僵局?
苹果调整返校季赠品,加 150 元可换新款 AirPods 5
股价新高!联想靠AI改命,“卖电脑的”叙事成历史
AI造出了病毒,完成首杀
AI离“理解万物”还有多远?先拿癌细胞和行星轨道试试水
一边高呼“AI可能毁灭人类”,一边在硅谷建起生物湿实验室:Anthropic的矛盾棋局
苹果悄然上调AI存储门槛,iPhone 17 Pro需预留14GB空间
OpenAI研究员自曝:你手中的GPT-6,根本不是为你训练的!
Anthropic落地实体湿实验室,AI赋能生物学研究迈入“虚实结合”新阶段
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号