在一项新的指控中,美国政府指控 6 家中国 AI 公司利用大规模知识蒸馏来复制美国模型的能力。
NSA、CISA 和 FBI 联合发布了咨询文件 AA26-251A,点名 DeepSeek、月之暗面(Moonshot AI)、阿里巴巴、MiniMax、阶跃星辰(StepFun)和 Z.AI,称其自 2024 年底以来至少一直在对美国前沿模型开展工业规模的知识蒸馏行动。
这些机构表示,相关请求经由一个被称为"中转站"的 API 代理灰色市场流动,这些中转站包括跨开发团队共享的大批量高级订阅,以及剥离账户元数据的第三方聚合器。
据称,月之暗面(Moonshot AI)蒸馏了 17 个美国模型(包括 Anthropic 的 Claude Fable 5)来训练 Kimi-K3。
他们声称,DeepSeek 的提示词会促使模型写出隐藏的思维链步骤,这转移的是推理方法而非最终答案。
因此他们表示,DeepSeek 宣传的所谓训练成本只覆盖了其消耗的算力。该咨询文件认为,这个数字具有误导性,因为它没有计入训练数据的实际成本--据称 DeepSeek 是通过蒸馏美国模型获得这些数据,而非通过自身研究产出。所以"低成本训练"的说法,其实是建立在别人花钱创造的数据之上。
缓解措施部分要求美国实验室在不让对方知情的情况下,向疑似蒸馏者提供被微妙降级的响应。 其检测指标是行为层面的,涵盖全天候不间断使用、新账户立即达到最大吞吐量,以及针对缓存命中优化的流量模式。
这些模式同样适用于普通的企业智能体集群,只是由各家提供商自行决定哪些客户会收到未公开的降级待遇。