https://www.anthropic.com/threat-intelligence-report-september-2026

Anthropic 报告 GTG-16002:Moonshot / Kimi 相关段落(页面截图)
发生了什么
按报告写法:Moonshot 没有用自家 Kimi 处理客户请求,而是静默把请求转给 Anthropic 的 Claude,再把 Claude 的回答展示给用户。用户以为自己在用 Kimi,实际拿到的是 Claude 的输出。
报告写明:Anthropic 不知道 Moonshot 有没有把「请求被转给第三方」这件事告知客户。
规模有多大
• 有一个约 10 天窗口:转发给 Anthropic 的客户请求接近 30 万条,绝大多数打到 Opus。
• 背后是一张约 5380 个欺诈账号组成的代理网络,账号多半看起来在新加坡、日本。
• 2026 年 5 月到 7 月,Anthropic 观察到可归因到 Moonshot 蒸馏攻击模式的交换超过 2300 万次。
不止代答,还抠思维链
转发本身已经够炸。报告说,Moonshot 还把至少一部分对话存下来,搭了思维链(CoT)抽取流水线,用这些转过来的交换去训自己的模型;也通过别的途径抽过 CoT。
Claude 接口平时不把完整「原始思考」吐给调用方,只回一个「思维签名」(thinking signature),方便后续同一会话里对照。报告指认:Moonshot 把签名存下来,另开新会话,再诱导 Claude 把签名还原成完整推理轨迹——这就是跨会话重放(cross-session replay),用来绕开「藏思维」的防护。
报告怎么收尾
这起案子落在九月威胁情报报告的「非法蒸馏」板块。Anthropic 称已打断相关滥用,并在加强针对这类手法的防护。同板块还写了 DeepSeek 类似做法(GTG-16001:同样静默转发、同样跨会话抠 CoT),本稿主线仍是 Moonshot / Kimi。

Anthropic 官方发帖(参考)
原文
https://www.anthropic.com/threat-intelligence-report-september-2026
依据 Anthropic《Detecting and countering misuse of AI: September 2026》中 GTG-16002 等表述;数字与措辞以报告原文为准。本稿为未发表草稿,仅作信息整理。