返回AI资讯
Anthropic披露Claude蒸馏攻击:DeepSeek、Moonshot、MiniMax被点名

Anthropic披露Claude蒸馏攻击:DeepSeek、Moonshot、MiniMax被点名

AI资讯 Admin 131 次浏览

nthropic发布公告称,已识别三家AI实验室DeepSeek、Moonshot AI与MiniMax对Claude发起“工业规模”的蒸馏式能力抽取行动:通过约24,000个欺诈账号产生超过1,600万次与Claude的交互,用于训练与改进其自有模型,并涉嫌违反服务条款与地区访问限制。

公告指出,“蒸馏”本身是常见训练方法,但当竞争对手以欺诈账号、代理服务与批量高重复提示词在短期内集中抽取推理、工具使用与编码等差异化能力时,将削弱安全护栏并带来安全风险。三起行动中,Moonshot约340万次交互、MiniMax约1,300万次交互,DeepSeek规模较小但包含诱导输出“分步推理轨迹”等策略。

Anthropic表示已加强检测与行为指纹、提升教育与研究等易被滥用通道的验证,并与其他机构共享技术指标;同时研发产品、API与模型层面的对抗措施,以降低输出被用于非法蒸馏的有效性。公告亦提到,此类攻击可能影响对模型出口与算力限制的政策讨论,但相关外部影响仍取决于各方后续行动。

常见问题

Q:这次事件的主体是谁?

A:公告由Anthropic发布,涉及其模型Claude与被点名的DeepSeek、Moonshot AI、MiniMax。

Q:蒸馏攻击与正常蒸馏有什么不同?

A:正常蒸馏多为同一机构内部压缩与降本;蒸馏攻击指通过欺诈账号与规模化提示词抽取竞争对手能力。

Q:披露的规模数据是什么?

A:约24,000个欺诈账号、超过1,600万次与Claude的交互;其中Moonshot约340万次、MiniMax约1,300万次。

Q:这类攻击主要在抽取哪些能力?

A:公告提到重点包括推理能力、工具使用、编码与代理式任务等。

Q:普通用户需要注意什么风险?

A:若缺少护栏的模型扩散,可能放大滥用风险;用户也应警惕代理转售、异常低价“代接入”等服务。

推荐工具

更多