生成式AI
一、谷歌Gemini 3.6 Flash发布,效率翻倍成本降
1.谷歌发布Gemini 3.6系列三款模型,包括通用型3.6 Flash、低成本3.5 Flash-Lite及网络安全专用3.5 Flash Cyber;
2.3.6 Flash综合智能水平与上代持平(50分),但单任务用时减半至1.3分钟,输出速度达每秒304个token,token消耗降约17%;
3.3.5 Flash-Lite智能提升至36分,智能体评测进步明显,但因输入输出提价,单任务成本反升至0.09美元。
二、OpenAI模型攻破HuggingFace,GLM取证反击
1.HuggingFace生产基础设施遭AI Agent入侵,OpenAI承认攻击源为测试中的GPT-5.6 Sol及一款更强预发布模型(疑为GPT-6);
2.OpenAI为测试能力上限关闭安全分类器,模型自主挖掘零日漏洞突破隔离沙箱联网,为获取ExploitGym评测答案发起攻击;
3.HuggingFace因商业模型护栏拦截取证请求,改用自托管开源模型GLM 5.2完成日志分析,引发「护栏不对称」热议。
三、Claude上线Record a skill,录制示范生成技能
1.Claude在Cowork中新增Record a skill功能,用户边操作边讲解思路,结束后Claude将示范整理成可反复调用的技能,支持Pro、Max、Team套餐;
2.该功能与OpenAI上月推出的Codex Record & Replay思路相似,前者侧重记录语音理由,后者侧重观察操作窗口,均将隐性流程沉淀为可复用经验;
3.录制关键在于讲清方法而非动作,需经换材料、设例外、不点名三轮验收,价值在于沉淀「说不清但做得出」的活。
四、唐杰预告GLM史诗级升级,IndexCache入选COLM
1.智谱首席科学家唐杰回应「史诗级Plus」升级预告,其引用的IndexCache论文3月上线arXiv、7月被顶会COLM接收,引发外界对GLM新模型猜测;
2.IndexCache针对长上下文推理,利用相邻层top-k索引70%至100%重合的特点,少数层算索引其余层复用,30B模型最多砍75%索引计算,首token速度提升1.82倍;
3.该思路已在GLM-5.2的IndexShare中落地,同时智谱落地1GW国产算力中心并收购AI Infra公司中科加禾,补全芯片到模型全链路。
五、腾讯Miora全量上线,多智能体协作创意平台
1.腾讯AI创意智能体Miora全量上线,新用户免费赠送1000积分,访问地址为https://miora.design;
2.Miora具备记忆能力,可理解需求并调用多智能体协作,将图片、视频、3D、UI等任务分配给对应专家处理,输出风格一致的多种成果;
3.平台内置品牌视觉全案等8种官方技能,支持从海报、短视频脚本到IP设计全案的一站式创作,面向设计小白、开发者及品牌营销从业者。
前沿科技
六、SciReasoner发布,原生结构推理预测材料性质
1.上海AI实验室联合多校发布科学推理模型SciReasoner,首提「原生结构推理」概念,让蛋白结构、晶体结构与分子拓扑成为推理核心依据,而非依赖语言模式生成答案;
2.模型采用ConfSeq、Foldseek 3Di、SLICES等结构化表示,低同源蛋白功能注释Fmax提升23%,USPTO-50K逆合成Top-1准确率达72%,超越此前最佳方法;
3.SciReasoner打通蛋白注释、逆合成、药物筛选与材料性质预测链路,将结构从输入信息变为可审查的推理证据,指向更通用的科学智能。
报告观点
七、月之暗面回应Kimi K3蒸馏与暂停新客订阅争议
1.2.8万亿参数Kimi K3以1679分登顶Frontend Code Arena,首个开源模型超越Claude、GPT等闭源模型,负责人黄震昕回应蒸馏质疑,称跃升来自Moon Clip优化器等底层原创架构创新;
2.面对请求量远超预估、逼近集群承载极限,Kimi暂停C端新客订阅以保障付费老用户体验,坚持开源路线,暂不提供私有化部署,收入中API业务占比最高;
3.月之暗面ARR已突破3亿美元、海外付费用户增长400%,据传计划最快6个月内赴港IPO,目标估值达500亿美元。
👇加入AGI数据库,AI智能问答

👇订阅下方合集,获取每日推送