危!Anthropic 报告称 Kimi 偷偷将请求路由到 Claude

机智流 2026-09-11 06:40

https://www.anthropic.com/threat-intelligence-report-september-2026

危!Anthropic 报告称 Kimi 偷偷将请求路由到 Claude图1

Anthropic 报告 GTG-16002:Moonshot / Kimi 相关段落(页面截图)

发生了什么

按报告写法:Moonshot 没有用自家 Kimi 处理客户请求,而是静默把请求转给 Anthropic 的 Claude,再把 Claude 的回答展示给用户。用户以为自己在用 Kimi,实际拿到的是 Claude 的输出。

报告写明:Anthropic 不知道 Moonshot 有没有把「请求被转给第三方」这件事告知客户。

规模有多大

• 有一个约 10 天窗口:转发给 Anthropic 的客户请求接近 30 万条,绝大多数打到 Opus。

• 背后是一张约 5380 个欺诈账号组成的代理网络,账号多半看起来在新加坡、日本。

• 2026 年 5 月到 7 月,Anthropic 观察到可归因到 Moonshot 蒸馏攻击模式的交换超过 2300 万次。

不止代答,还抠思维链

转发本身已经够炸。报告说,Moonshot 还把至少一部分对话存下来,搭了思维链(CoT)抽取流水线,用这些转过来的交换去训自己的模型;也通过别的途径抽过 CoT。

Claude 接口平时不把完整「原始思考」吐给调用方,只回一个「思维签名」(thinking signature),方便后续同一会话里对照。报告指认:Moonshot 把签名存下来,另开新会话,再诱导 Claude 把签名还原成完整推理轨迹——这就是跨会话重放(cross-session replay),用来绕开「藏思维」的防护。

报告怎么收尾

这起案子落在九月威胁情报报告的「非法蒸馏」板块。Anthropic 称已打断相关滥用,并在加强针对这类手法的防护。同板块还写了 DeepSeek 类似做法(GTG-16001:同样静默转发、同样跨会话抠 CoT),本稿主线仍是 Moonshot / Kimi。

危!Anthropic 报告称 Kimi 偷偷将请求路由到 Claude图2

Anthropic 官方发帖(参考)

原文

https://www.anthropic.com/threat-intelligence-report-september-2026

依据 Anthropic《Detecting and countering misuse of AI: September 2026》中 GTG-16002 等表述;数字与措辞以报告原文为准。本稿为未发表草稿,仅作信息整理。

关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。
IC
more
WordPress创始人马特·穆伦维格“夺权”风波:从被罢免到宣称重掌Automattic大权
中科曙光发布scaleFabric体系,IBGDA技术实现十万卡级集群验证
【IC Coder真实案例】约1小时跑通五阶段,AI自主操控Quartus完成卫星SDR下变频
红光量产,CPO落地,Micro LED光博会交出第一份成绩单
离开自动驾驶量产一线,张颖创业做AI for Physical AI
新品发布丨银河微电发布1200V SiC MOSFET系列新产品
2026中国MicroLED CPO产业高峰论坛今日揭幕
AI十年内会杀死全人类?Anthropic研究员发出最严重警报
Anthropic指控中国AI巨头发起大规模“蒸馏攻击”,阿里与月之暗面卷入其中
MagicOS11即将发布!荣耀全球开发者大会定档
Copyright © 2025-成都区角科技有限公司
蜀ICP备2025143415号-1
  
川公网安备51015602001305号