Rohan Paul
@rohanpaul_ai
在一项新指控中,美国政府指责 6 家中国 AI 公司利用大规模蒸馏复制美国模型能力。
NSA、CISA 与 FBI 发布联合警示 AA26-251A,点名 DeepSeek、Moonshot AI、阿里巴巴、MiniMax、StepFun 与 Z .AI,称其至少自 2024 年末起对美国前沿模型开展工业级蒸馏。
机构称请求经称为「中转站」的 API 代理灰市、开发团队共享的批量高级订阅、以及剥离账户元数据的第三方聚合器流转。
Moonshot AI 据称蒸馏了 17 个美国模型,包括 Anthropic 的 Claude Fable 5,用于训练 Kimi-K3。
他们称 DeepSeek 的提示会推动模型写出隐藏的思维链步骤,从而转移的是推理方法而非成品答案。
因此他们说 DeepSeek 宣传的训练成本只覆盖其烧掉的算力。警示认为该数字具有误导性,因为它未计入训练数据的真实成本——据称这些数据是通过蒸馏美国模型获得,而非自研产出。于是「便宜训练」叙事建立在别人花钱造出的数据之上。
缓解措施部分要求美国实验室对疑似蒸馏者悄悄返回降质响应且不告知对方。
其检测指标偏行为向:持续 24/7 使用、新账号立刻打满吞吐、以及为缓存命中优化的流量。
这些模式也描述普通企业 agent 集群,于是各家供应商得自行决定哪些客户会收到未披露的降级。