Anthropic 周四发布报告称,过去数月,针对其模型的蒸馏攻击持续增加。公司表示,这些活动试图绕过防护,提取 Claude 的推理、工具调用、编程和数据分析能力。

攻击规模扩大

Anthropic 称,相关活动已扩展到近 2 亿次交互,涉及 5 起独立行动。公司还表示,这些攻击比其今年 2 月披露的案例更大,也更具组织性。

阿里巴巴相关活动最集中

Anthropic 认为,规模最大的活动与阿里巴巴有关。公司称,5 月至 7 月间共观察到 1.51 亿次交互,峰值接近每天 300 万次,分布在 3500 个账号上。

Moonshot AI 与 DeepSeek也被提及

报告还提到,Moonshot AI 相关活动似乎直接转接自中国军方。Anthropic 称,另一项请求曾要求 Claude 评估闭路监控画面,判断目标是否“行为异常”。公司此前也曾将类似活动归因于 DeepSeek。