Retour des allégations de distillation de Claude après enquête des chercheurs sur Kimi K3
Kimi K3 et la distillation de Claude sont de nouveau l’objet d’un examen minutieux, de nouvelles recherches ayant révélé des similitudes inhabituelles entre le modèle de Moonshot AI et les schémas de raisonnement de Claude d’Anthropic.
En février dernier, Anthropic accusait les entreprises chinoises d’IA de tenter de copier ses modèles d’IA. Quelques mois plus tôt, Anthropic avait directement accusé Alibaba de chercher à copier Claude AI.
Alibaba a par la suite banni Claude Code de ses espaces de travail.
Des chercheurs découvrent un moyen de révéler le raisonnement caché des IA
Un nouvel article de recherche a ravivé le débat sur la possibilité que le Kimi K3 de Moonshot AI ait pu être distillé à partir des modèles Claude d’Anthropic.
Les critiques avaient précédemment remis en question cette possibilité, car seulement deux semaines environ séparaient la sortie de Fable d’Anthropic et celle de Kimi K3. Cela semblait laisser peu de temps pour une distillation à grande échelle.
Les chercheurs affirment désormais qu’une faiblesse liée à l’API aurait pu rendre possible l’extraction de traces de raisonnement sans briser le chiffrement sous-jacent.
Les entreprises d’IA masquent généralement le raisonnement interne lorsqu’elles transfèrent des blocs de raisonnement chiffrés entre modèles. Les chercheurs ont constaté que les systèmes d’OpenAI, d’Anthropic et de Google pouvaient permettre à ces blocs de fonctionner entre différents modèles au sein du même écosystème.
Cela signifie que le raisonnement généré par un modèle plus puissant pourrait potentiellement atteindre un modèle frère plus faible capable de révéler des informations à partir du bloc chiffré.
Kimi K3 montre une compatibilité inhabituelle avec le raisonnement de Claude
Les chercheurs ont testé Kimi K3 en utilisant une petite section du raisonnement décodé de Claude Opus 4.8.
Selon l’article, fournir seulement 1 % du fragment de raisonnement de Claude a modifié de manière significative le raisonnement ultérieur de Kimi K3 et a rapproché sa formulation et son comportement de ceux de Claude.
Les chercheurs ont également constaté que certaines séquences de raisonnement de Claude et de GPT étaient considérablement plus faciles à extraire de Kimi K3 que des modèles ouverts concurrents.
Pour certaines portions de raisonnement, l’article indique que l’extraction était environ six ordres de grandeur plus facile à partir de Kimi K3 qu’à partir du modèle le plus proche suivant.
Kimi K3 a également montré une probabilité anormalement élevée de prédire et de poursuivre le texte généré par Claude par rapport à des modèles tels que DeepSeek-V4-Flash.
Les résultats ne prouvent pas que Kimi K3 a été distillé à partir de Claude
Les chercheurs soutiennent que Kimi K3 fait preuve d’une compatibilité anormalement forte avec les schémas de raisonnement de Claude.
Ces résultats pourraient étayer la théorie selon laquelle une forme de distillation aurait eu lieu, mais ils ne permettent pas d’établir comment Moonshot AI a entraîné Kimi K3.
Sans accès aux données d’entraînement et à la méthodologie de Moonshot, les chercheurs ne peuvent pas vérifier les allégations de manière concluante.
Les résultats apportent donc des preuves circonstancielles au débat plus large sur la distillation de Claude, plutôt que de prouver que Moonshot a copié les modèles d’Anthropic.
Par ailleurs, dans l’actualité de l’IA, le texte de Claude AI intégrera des filigranes et des métadonnées cachés dans l’UE.
Via Wccftech
Consultez notre page de divulgation pour découvrir comment vous pouvez aider Windows Report à soutenir l'équipe éditoriale. Read more
Vous rencontrez toujours des problèmes? Corrigez-les avec cet outil:
User forum
0 messages