腾讯研究院AI速递 20260923

腾讯研究院 2026-09-23 00:06

生成式AI

一、SpaceXAI发布Grok 4.7,长任务能力提升价格不变

1.SpaceXAI发布Grok 4.7,换用更大基础模型并延长强化学习周期,强化长时间任务、自我检查与长上下文管理,速度为可比模型两倍;

2.CursorBench 4.0得分46.3%,较上代提升5.9个百分点,Terminal-Bench 4.0由20.3%升至38.0%,GDPval与法律、医疗等专业评测同步提升;

3.标准版每百万输入、输出Token分别为2美元和6美元,与上代持平,已上线Cursor与Grok Build,但有网友对其跑分表现并不认可。

二、小米发布并开源MiMo-V2.6,大规模扩展强化学习

1.小米发布并开源MiMo-V2.6 Pro与Flash两款原生全模态模型,Pro版在AA综合智能指数获46分,成为当前最强开源模型,API沿用V2.5定价;

2.不到6天的Live RL训练中,Flash与Pro成本约85万与262万美元,累计约75万条轨迹,DeepSWE v1.1分别提升约17分和14分;

3.模型可完成3D游戏搭建、Blender建模、机械臂控制与Lean形式化证明,并同步开源7k+RL任务环境与端到端训练框架。

三、腾讯混元推出Hy Image3.5 preview,2K图0.15元

1.腾讯混元发布Hy Image3.5 preview,支持文生图、图生图与多轮编辑,单次最多参考5张图,最高2K输出,综合能力较3.0提升约30%;

2.腾讯云API 2K图定价0.15元/张、仅对输出计费,内部设计师盲测与Seedream 5.0 pro持平,略优于Nano-Banana Pro;

3.模型已接入元宝、ima、WorkBuddy等应用,元宝灰度期间生图请求量提升超50%,人像修图场景请求量提升100%。

四、理想推出触觉世界模型ME-Dex-1.0,可预测触觉

1.理想Foundation Model团队发布世界动作触觉模型ME-Dex-1.0,将触觉与视频共同作为需预测的未来世界状态,联合去噪视频、触觉与动作序列;

2.模型把异构触觉数据映射到双手34区域模板,采用视觉、触觉、动作三专家架构与H-Bridge共享注意力,并用自主式触觉数据引擎扩充仿真数据;

3.RoboTwin成功率领先最强基线7.6个百分点,DexJoCo 11项任务中7项第一,ManiFeel电源插头插入成功率由58%升至88%。

五、阿里平头哥推出AI芯片真武V900,算力达上代3倍

1.阿里平头哥在云栖大会推出AI芯片真武V900,算力为真武M890的3倍,显存216GB,片间互联1200GB/s,单集群可扩展至50万卡,预计2027年Q1就绪;

2.真武坚持一年一代演进,2028年Q3将推出J900,配套磐久超节点服务器支持千卡全带宽Scale-Up互联与百TB级统一显存;

3.倚天720与730 CPU预计2027年Q3推出,真武已服务650多家客户,T-Head SAIL SDK核心组件已完成开源。

六、海光发布1000系列CPU,国产C86架构进军嵌入式

1.海光发布面向低功耗、嵌入式和端侧场景的海光1000系列CPU,基于C86架构,4核8线程,支持DDR4/DDR5,首次集成图形能力并支持4K60双路显示;

2.典型TDP低至10W,支持宽温与无风扇设计,集成ECC及硬件密码加速单元,兼容DirectX、OpenGL等主流软硬件生态;

3.海光提供七年以上产品生命周期保障,配套IDE、SDK、BSP到RTOS的开发体系,面向工业HMI、机器视觉、边缘网关等场景。

前沿科技

七、OpenAI联手独立数学顾问组,百余道开放问题待审

1.OpenAI宣布与普林斯顿高等研究院托管的独立数学顾问组AGMAI合作,就内部模型产出数学成果的评估、审查与发布方式获取建议;

2.OpenAI称8月底开始训练的内部模型,除纳维—斯托克斯难题解答外已解决100多道长期开放问题,但相关成果尚未全部公开和经独立审查;

3.顾问组首批九人包括Gowers、Hairer、Witten等,成员不收AI公司报酬、建议公开发布,但无发布否决权,此前多位菲尔兹奖得主曾发公开信表达担忧。

报告观点

八、Jev作者访谈:AI应做程序可调用的决策基础设施

1.TypeSafe创始人、前OpenAI研究员Diogo Almeida认为,行业过度训练模型像人一样聊天,而AI真正的消费者是代码,应输出带概率与置信度的决策判断;

2.他主张把大Prompt拆成上百个可度量、可Debug的微小判定,用置信度阈值与模型级联替代盲目微调,并批评现有Function Calling设计;

3.他称团队目标是五年内推动全要素生产率增长3%,并认为部分头部实验室呼吁放慢研发的背后存在监管与政治考量。

九、姚顺宇、施天麟谈RSI:最难在于验证自我迭代有效

1.姚顺宇认为模型用自生成数据训练自己只是RSI初级阶段,能自主设计整套训练流程才超出RL范畴,终极RSI是涉及调度、上下文与硬件优化的系统工程;

2.他指出实现自我迭代并不难,难在验证迭代有效,模型执行力强但难以自定评估标准,Gemini 3.8 Flash后训练核心流程已由模型自主探索得出;

3.嘉宾认为公开benchmark常被刷榜,能存活三五个月已属不易,创业公司应把模型厂商的通用智能转化为行业专业能力。

👇加入AGI数据库,AI智能问答  

腾讯研究院AI速递 20260923图1

👇订阅下方合集,获取每日推送

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
AI
more
国产AI存储方案,跻身全球第一梯队
靠 AI 翻身!Meta 市值一夜暴增 1.29 万亿
从单卡到千卡互联,平头哥真武 V900 背后的 AI 算力变局
腾讯研究院AI速递 20260923
当 AI 数字员工上岗,会带来什么?|AI+千行百业洞察
AI末日论吵翻美国,中国为何静悄悄?
Meta Muse登顶应用榜,AI智能体赛道迎来“破局者”?
荣耀与阿里共建垂域 AI 模型,Magic9落地行业领先AI能力
导演陆川写了3个AI工具:我想弄清楚人到底哪儿不可替代
讲真,我没看出这图是AI做的,更没想到是国产AI做的
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号