2026 年 9 月 8 日,美国国家安全局、联邦调查局与网络安全和基础设施安全局联合发布模型蒸馏安全通告,点名 DeepSeek、月之暗面、阿里巴巴、MiniMax、阶跃星辰和智谱,指称这些公司自 2024 年末以来通过数百万次请求提取 Claude、GPT、Gemini 与 Grok 等模型的能力。这里首先要划清事实边界:通告呈现的是美方机构的归因与指控,不是已经完成司法审理的结论。
争议不在“蒸馏”三个字本身
知识蒸馏本来是常见训练方法,让较小模型学习更强模型的输出。通告把越界线索指向规模、访问方式和规避行为:多账户与共享订阅、第三方聚合器、云平台和所谓“中转站”被组合使用,流量在不同路径间切换;部分请求还被描述为针对隐藏推理、代码、数学和智能体能力的系统化采集。想先理解合法技术路线,可阅读站内的模型蒸馏基础解析。
官方建议会改变 API 风控
三家机构给模型提供商列出三类近期动作:识别异常提示词、账号、网络与吞吐模式;对疑似恶意蒸馏请求有针对性地调整响应;在模型厂商、云平台与 API 聚合商之间共享情报。它还建议关注新账户立即跑满额度、全天无人工停顿、多个路径出现相同节奏等指标。对普通开发者的影响可能是更严格的账户验证、速率限制和用途审查,批量合成数据业务尤其容易被要求解释流量来源。
中方否认,企业尚未逐项回应
9 月 9 日,中国外交部回应称相关说法是无端指责与抹黑,并表示中国 AI 发展来自自主创新。美联社报道还指出,DeepSeek、阿里巴巴、月之暗面与智谱当时未立即回应置评请求。因此,读者应把“报告列出的技术指标”“机构的归因判断”和“涉事方的公开回应”分开阅读,不能因名单出现就推定每一项指控均已被独立证实。
这份通告真正可能留下的长期变化,是前沿模型访问从一般反滥用升级为跨平台供应链防御。行业接下来需要回答两个问题:如何区分正常研究与工业化能力提取,以及在加强追踪时如何避免误伤合法的高并发开发者。