Anthropic a surpris la Chine en train de copier Claude. Ce faisant, il a montré à quel point il savait ce que nous faisons de lui.
Anthropic vient de publier son rapport de renseignement sur les menaces le plus détaillé à ce jour. Outre les campagnes de cyberespionnage ou les armes biologiques, une histoire particulièrement marquante apparaît : sept laboratoires chinois d’IA sont parvenus à collecter des données sur le fonctionnement de Claude par distillation. Alibaba (Qwen) s’est démarqué ici : il y a eu 151 millions d’échanges de demandes. Pendant ce temps, Moonshot (Kimi) et DeepSeek ont fait quelque chose d’encore plus étrange : envoyer les questions de leurs propres utilisateurs à Claude sans dire un mot.
Kimi n’a pas toujours été Kimi. Selon Anthropic, Moonshot a utilisé des services intermédiaires situés en dehors de la Chine – les appels – pour contourner les restrictions géographiques de Claude. Lorsque quelqu’un demandait quelque chose à Kimi, certaines requêtes parvenaient en fait à Claude, et alors les réponses de ce modèle parvenaient à l’utilisateur comme si elles avaient été générées par le modèle chinois.
Vous ne discutez pas avec qui vous pensez être. Les données révèlent que Moonshot aurait réalisé cette opération plus de 23 millions de fois entre mai et juillet. DeepSeek aurait atteint 12,1 millions en seulement deux semaines. Et les utilisateurs, bien sûr, ne s’en rendaient même pas compte : ils croyaient discuter avec Kimi, mais en réalité ils discutaient avec Claude.
Le prix : les données d’entraînement. La distillation du modèle d’IA consiste à utiliser les réponses d’un modèle puissant pour en « enseigner » un autre. Il ne s’agit pas en soi d’une technique clandestine, et les sociétés d’IA utilisent cette « astuce » en interne pour former et améliorer leurs propres modèles. Le problème apparaît lorsque la distillation est utilisée pour apprendre à partir de modèles fermés, même de manière cachée. Anthropic affirme qu’Alibaba essayait même d’obtenir le raisonnement de Claude pour l’incorporer dans la formation de Qwen. Cela ne prouve pas que les modèles chinois soient des « fourchettes » de Claude, et en fait, certains experts affirment que la distillation à elle seule n’explique pas la rapidité avec laquelle Qwen, Kimi ou DeepSeek progressent.
Attention : Anthropic peut découvrir comment vous utilisez Claude. Pour découvrir tout cela, Anthropic doit surveiller de près l’utilisation de Claude. L’entreprise explique comment son équipe de sauvegarde développe des systèmes de détection qui garantissent le respect de ses politiques et affirme avoir bloqué 11,4 millions de comptes au cours du seul premier semestre 2026. Il a identifié des campagnes de distillation utilisant par exemple des métadonnées ou des modèles anormaux. Bien que cela ne signifie pas qu’ils espionnent tout ce que vous faites, cela montre clairement que l’entreprise dispose d’une visibilité incroyable sur tout ce qui se passe au sein de sa plateforme.
Controverses passées. En mars, Anthropic a introduit un curieux mécanisme sans en parler à personne : ils ont recherché des indices tels que les fuseaux horaires chinois, les proxys ou les domaines liés aux sociétés chinoises d’IA pour détecter d’éventuelles activités de distillation. L’entreprise a supprimé ces systèmes après qu’ils ont été découverts par un chercheur, ce qui a suscité de nombreuses critiques à l’égard du rôle de « Big Brother » que l’entreprise avait adopté.
Juge et jury. Chez Anthpic, ils établissent non seulement ce que nous pouvons faire avec leurs modèles et ce que nous ne pouvons pas faire (pas de conception d’armes biologiques, par exemple), mais ils construisent également des systèmes pour détecter ces tentatives d’utilisation de leurs modèles de manière toxique. C’est raisonnable pour une entreprise développant des modèles aussi puissants qu’Anthropic, mais il y a ici un dilemme. Claude commence à s’éloigner d’un simple chatbot pour devenir un moyen permettant à Anthropic de surveiller la conversation et de décider si elle est légitime ou non.
À Simseo | OpenAI et Anthropic ont un problème : les nouveaux modèles bon marché de Google et Meta sont déjà trop bons
