未经授权的模型蒸馏

模型蒸馏与未经授权提取:技术、指称和法律判断要分开

定义

蒸馏在技术上指用一个模型的输出去训练或增强另一个模型。它可以是授权的、合同内的合作。

本主题讨论的是报告所指的未经授权访问、把用户请求转给他人模型、提取思维链或购买对话文本。这些是发布方的归因,不是本站的违法认定。

不要混淆为

不等于所有蒸馏都违法,也不等于「偷模型」可以当作对每一家被点名公司的标题。

不等于各节指控可以合并:小米一节明确未认定用 Claude 回复直接服务用户。

不等于本站会演示如何提取推理轨迹。

示意图:用户以为的服务与报告描述的数据去向可能不同。
原报告插图:蒸馏章开篇概念图。具体公司以各案例为准,不能一张图合并所有指称。图中文字为英文原文。

AI 的角色

在这些指称里,Claude 主要是被查询或被提取的对象。争议集中在授权、透明度和训练数据来源。

用户侧风险是:不知道回答来自哪家、对话去了哪里。

相关案例

未经授权的模型蒸馏

报告对 DeepSeek 请求转发的指称:GTG-16001 案例

据 Anthropic 报告,DeepSeek 也部署了与 Moonshot 类似的策略:构建 CoT 提取管道,使用相同的跨会话重放攻击提取 Claude 的思维链记录,并在未通知客户的情况下静默转发交流给 Claude。报告还称 DeepSeek 将使用第三方编码工具的用户请求转发给 Claude Opus,包括中国科技公司、俄罗斯国防机构和中国公安监控系统的敏感数据。以上均为发布方指称,不是本站的独立认定。

未经授权的模型蒸馏

报告对 Moonshot 请求转发的指称:GTG-16002 案例

据 Anthropic 报告,Moonshot(Kimi 模型的开发方)把客户请求静默转发给 Claude,再把 Claude 的回复显示给用户,用户以为自己在用 Kimi。一次十天窗口内转发了近 30 万次客户请求,绝大多数被转到 Opus;代理网络有 5,380 个虚假账号。报告没有确认用户是否知情。以上均为发布方指称,不是本站的独立认定,也不是司法结论。

未经授权的模型蒸馏

报告对 Alibaba 相关蒸馏活动的指称:GTG-16005 案例

据 Anthropic 2026 年 9 月报告,与 Alibaba 有关联的运营方被指称发起了报告测量过的最大规模蒸馏攻击,目标是 Claude Opus 4.6 和 4.7 的思维链推理记录,报告称相关数据被用于训练 Qwen 系列模型。全部归因与数字来自该报告的单方面指称,相关公司未在本站确认。

未经授权的模型蒸馏

报告对 Zhipu / Z.ai 能力提取的指称:GTG-16006 案例

据 Anthropic 报告,Zhipu(海外品牌 Z.ai)对 Claude 运行思维链提取管道,将捕获的 Claude 推理轨迹重放回 Claude 以清洗,用于训练其 GLM 模型。报告称 10 天内 Zhipu 通过 273 个欺诈账号对 Opus 4.8 运行提取管道,记录了 77 万次交流。报告还称 Zhipu 针对美国前沿模型的网络能力进行蒸馏。以上均为发布方指称,未经本站独立核实。

未经授权的模型蒸馏

报告对 Xiaomi 训练数据使用的指称:GTG-16008 案例

据 Anthropic 报告,小米把自家 MiMo 模型的用户对话和编程会话回放给 Claude,常经由第三方编程工具路由。调查未表明小米用 Claude 的回复去直接服务用户,而是保存了小米客户与自有模型之间的对话。许多会话经由美国和欧洲用户常用的第三方路由服务。本案与 Moonshot / DeepSeek 等「顶替自家模型回答」的案例性质不同:小米未用 Claude 回复直接服务用户,而是保存对话。

未经授权的模型蒸馏

第三方转售与训练数据生态的指称:GTG-16012/16003 案例

据 Anthropic 报告,代理服务的扩散创造了一个二级市场,实验室可以通过它购买或获取用户与 Claude 的交流记录。SenseTime 的蒸馏管道包含从第三方数据供应商购买的用户与 Claude 的交流记录。MiniMax 通过空壳公司建立代理网络服务,仅提供 Anthropic 和 OpenAI 模型的访问,不提供任何中国模型,表明其目的是收集用户与美国前沿模型的交流以训练自己的模型。以上均为发布方指称,未经本站独立核实。

措施局限

全部是单一发布方指称,存在商业竞争背景。

平台规则判断不能自动升级为司法结论。

相关指南

FAQ

蒸馏是不是就是偷模型?

不是。蒸馏是技术;是否授权、数据从哪来、用户知不知道,才是需要分开判断的问题。

被点名的公司是不是都做了同一件事?

不是。报告对每家的具体指称不同,应按案例分别阅读,不宜合并成一句总指控。