ReuploadVotre actu IA
Retour à l'accueil

· Quartz (Cris Tolomia)

Anthropic détaille des attaques par distillation de modèles portant sur 200 millions d'interactions, menées par des laboratoires d'IA chinois

Anthropic détaille des attaques par distillation de modèles portant sur 200 millions d'interactions, menées par des laboratoires d'IA chinois

Photo: FlyD sur Unsplash

<cite index="37-1">Anthropic a accusé cinq entreprises d'IA basées en Chine d'avoir mené des campagnes non autorisées à grande échelle visant à extraire les capacités de Claude et à les utiliser pour entraîner des modèles concurrents, l'activité combinée totalisant près de 200 millions d'échanges liés à des attaques par distillation.</cite> <cite index="37-4,37-5">Anthropic a décrit l'opération d'Alibaba comme la plus vaste campagne de distillation jamais documentée par l'entreprise, avec des comptes liés à Alibaba générant plus de 151 millions d'interactions avec Claude entre mai et juillet 2026, réparties sur jusqu'à 3 500 comptes frauduleux.</cite> <cite index="42-4">Le FBI, la National Security Agency et la Cybersecurity and Infrastructure Security Agency ont publié un avis conjoint avertissant que des entreprises d'intelligence artificielle basées en Chine mènent des campagnes de distillation de connaissances à l'échelle industrielle contre les modèles de pointe américains.</cite>

<cite index="37-2">Le rapport de renseignement sur les menaces d'Anthropic, publié jeudi, a nommé Alibaba, Moonshot AI, DeepSeek, Xiaomi et Zhipu comme les parties à l'origine de campagnes de distillation illicites — une technique par laquelle un laboratoire injecte les sorties du modèle d'un autre dans son propre pipeline d'entraînement sans autorisation.</cite> <cite index="37-3">Le rapport indique que ces campagnes ciblaient les capacités les plus précieuses de Claude, notamment le raisonnement agentique, l'ingénierie logicielle et le raisonnement logique.</cite> <cite index="37-5,37-6">Alibaba a généré plus de 151 millions d'interactions avec Claude entre mai et juillet 2026, le volume quotidien culminant à près de 3 millions depuis plus de 3 500 comptes frauduleux, et Anthropic affirme que ces transcriptions ont servi à entraîner les modèles Qwen d'Alibaba.</cite> <cite index="37-7,37-8,37-9">Moonshot AI a adopté une approche différente en acheminant certaines requêtes d'utilisateurs de Kimi vers Claude sans en informer les clients, puis en affichant les réponses de Claude comme s'il s'agissait de celles de Kimi, transmettant près de 300 000 requêtes de clients à Anthropic sur une période de dix jours via un réseau de 5 380 comptes frauduleux.</cite> <cite index="38-4">Selon le rapport d'Anthropic, des laboratoires non autorisés ont mis au point des méthodes de plus en plus sophistiquées pour contourner les défenses et s'approprier les capacités des modèles de pointe américains.</cite> <cite index="42-1">Anthropic a suivi près de 200 millions d'échanges liés à des attaques par distillation dans le cadre de cinq campagnes distinctes et a déjoué les attaques de sept laboratoires basés en Chine au cours de cette période de huit mois.</cite> <cite index="43-6">Le renseignement américain estime que les activités de distillation se produisent probablement avec la connaissance du gouvernement chinois.</cite> L'ampleur et la coordination de ces campagnes mettent en évidence un effort stratégique visant à contourner les dépenses d'investissement nécessaires au développement autonome de modèles d'IA de pointe. Cette révélation marque une escalade dans le vol de propriété intellectuelle reconnu au sein de l'industrie de l'IA, suscitant des avertissements coordonnés du gouvernement américain et soulevant des questions sur la viabilité de l'accès ouvert aux API pour les modèles de pointe déployés à l'échelle mondiale.

Sources & crédits

Source originale: Quartz (Cris Tolomia)