· Quartz (Cris Tolomia)
Anthropic详述中国AI实验室发起的2亿次模型蒸馏攻击
图片: FlyD 来自 Unsplash
<cite index="37-1">Anthropic指控五家中国人工智能公司开展未经授权的大规模行动,提取Claude的能力并用于训练竞争模型,相关活动合计近2亿次交互,与蒸馏攻击有关。</cite> <cite index="37-4,37-5">Anthropic称,阿里巴巴的行动是其有史以来记录到的最大单一蒸馏行动,与阿里巴巴相关的账号在2026年5月至7月间产生了超过1.51亿次Claude交互,分布于多达约3500个欺诈账号。</cite> <cite index="42-4">美国联邦调查局、国家安全局和网络安全与基础设施安全局发布联合公告,警告称中国人工智能企业正在对美国前沿模型开展工业规模的知识蒸馏行动。</cite>
<cite index="37-2">Anthropic于周四发布的威胁情报报告点名阿里巴巴、Moonshot AI、DeepSeek、小米和智谱为这些非法蒸馏行动的主体——蒸馏是一种在未经许可的情况下,将一个实验室的模型输出注入另一模型训练流程的技术。</cite> <cite index="37-3">报告称,这些行动瞄准了Claude最有价值的能力,包括智能体推理、软件工程和逻辑推理。</cite>
<cite index="37-5,37-6">2026年5月至7月间,阿里巴巴产生了超过1.51亿次Claude交互,日交互量最高接近300万次,来自3500多个欺诈账号,Anthropic称这些对话记录被用于帮助训练阿里巴巴的Qwen模型。</cite> <cite index="37-7,37-8,37-9">Moonshot AI则采取了不同做法:在未告知客户的情况下将部分Kimi用户请求路由至Claude,随后将Claude的回复伪装成Kimi的回复展示,在一个为期10天的时段内,通过一个由5380个欺诈账号构成的网络向Anthropic转发了近30万条客户请求。</cite>
<cite index="38-4">根据Anthropic的报告,未经授权的实验室已开发出愈发精密的方法来规避防御措施,并攫取美国前沿模型的能力。</cite> <cite index="42-1">在八个月的时间里,Anthropic追踪了与蒸馏攻击相关的近2亿次交互,涉及五个独立行动,并挫败了来自七家中国实验室的攻击。</cite> <cite index="43-6">美国情报界评估认为,蒸馏活动很可能是在中国政府知情的情况下进行的。</cite>
这些行动的规模与协同程度,凸显出一种战略意图:绕过独立开发前沿AI模型所需的资本支出。此次披露标志着AI行业内已被承认的知识产权窃取行为进一步升级,促使美国政府发出协调一致的警告,并引发了对全球部署的前沿模型开放API访问能否持续下去的质疑。
来源与版权
原始来源: Quartz (Cris Tolomia)